deepresearch
Tongyi-DeepResearch-30B-A3BAlibaba-NLP_Tongyi-DeepResearch-30B-A3B-GGUFTongyi-DeepResearch-30B-A3B-GGUFTongyi-DeepResearch-30B-A3B-i1-GGUFMarco-DeepResearch-8B-i1-GGUFS1-DeepResearch-32B-i1-GGUFQwen3-14B-v0.2-deepresearch-no-think-100-step-i1-GGUFHuihui-Tongyi-DeepResearch-30B-A3B-abliterated-i1-GGUF
DeepResearch-Bench-II-Datasetdeep_research_bench_evaldeepresearch-corpusS1-DeepResearch-15k
S1-DeepResearch-15k Dataset
Overview
The S1-DeepResearch dataset is a curated collection of approximately 15k samples designed to improve deep research capabilities of large language models.
The dataset includes two types of tasks:
Verifiable tasks (labeled as "Closed-ended Multi-hop Resolution")
Open-ended tasks (labeled as "Open-ended Exploration")
Dataset Composition
The dataset is organized into five core capability dimensions:
Long-chain complex… See the full description on the dataset page: https://huggingface.co/datasets/ScienceOne-AI/S1-DeepResearch-15k.AI-DeepResearch-BenchReportDeepResearch-Bench-Dataset
DeepResearch Bench Dataset
[English | 中文]
English
📖 Dataset Overview
This is the official dataset accompanying the DeepResearch Bench paper. It contains research reports generated by 4 leading deep research AI systems along with detailed human expert annotations evaluating these reports.
DeepResearch Bench is the first comprehensive benchmark for systematically evaluating Deep Research Agents (DRAs) on their ability to handle complex, PhD-level research… See the full description on the dataset page: https://huggingface.co/datasets/muset-ai/DeepResearch-Bench-Dataset.
