CoolFace
Datasetpublic

thu-coai/MTAC-IFBench

MTAC-IFBench: Benchmarking Instruction-Following in Multi-Turn Agentic Coding 🌟 Overview MTAC-IFBench benchmarks instruction following in multi-turn agentic coding. Existing agentic coding benchmarks (e.g., SWE-bench, Terminal-Bench) focus on final functional correctness, while current instruction-following benchmarks confine themselves to single-turn chat or code generation. Neither answers the question that matters in a real development session: does the agent… See the full description on the dataset page: https://huggingface.co/datasets/thu-coai/MTAC-IFBench.

sourceHugging Facecc-by-4.0updated 11d agoView on Hugging Face
1likes184downloads
15 commits on main
10d037f11d ago

Add eval configs and dataset card

JaneGreen
70eb8fe11d ago

Add eval configs and dataset card

JaneGreen
2c36dfc11d ago

Add eval configs and dataset card

JaneGreen
d9a475b11d ago

Add eval configs and dataset card

JaneGreen
9a04a8c11d ago

Add eval configs and dataset card

JaneGreen
d6d958111d ago

Add eval configs and dataset card

JaneGreen
e15499311d ago

Add eval configs and dataset card

JaneGreen
9cbffff11d ago

Add eval configs and dataset card

JaneGreen
0b906c211d ago

Add eval configs and dataset card

JaneGreen
bb972c311d ago

Add eval configs and dataset card

JaneGreen
a18dd7011d ago

Add eval configs and dataset card

JaneGreen
76cb1b811d ago

Add eval configs and dataset card

JaneGreen
e88791d11d ago

Add eval configs and dataset card

JaneGreen
a057bc012d ago

Upload folder using huggingface_hub

JaneGreen
064a4a212d ago

initial commit

JaneGreen