datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
neko-prelim-HLE_SFT_OlymMATHRAMEN-phase1neko-prelim-HLE_SFT_OlympiadBenchneko-prelim-HLE_SFT_LIMOneko-prelim-HLE_SFT_PhysReasonneko-prelim-HLE_SFT_OpenMathReasoningneko-prelim-HLE_SFT_GPQA_DiamondMedMCQA
MedMCQA-CoT: 医学多肢選択問題with Chain-of-Thought推論
データセット概要
MedMCQA-CoTは、MedMCQAデータセットの拡張版で、各医学多肢選択問題に高品質なChain-of-Thought(CoT)推論を追加したデータセットです。医学的な推論プロセスを説明できるAIシステムの開発を支援することを目的としています。
主な特徴
2,020件の医学MCQ問題 - 元のMedMCQAデータセットから抽出
Chain-of-Thought推論 - DeepSeek-R1モデルで生成
95.5%の回答精度 - 生成されたCoTが正解に導く割合
0.952の平均品質スコア - 医学用語密度と推論品質に基づく評価
包括的なメタデータ - 品質スコア、医学専門分野、生成統計を含む
データセット詳細
各レコードの構成:
question: MedMCQAからの元の医学問題
answer: 正解の選択肢(A, B, C, D)
cot:… See the full description on the dataset page: https://huggingface.co/datasets/weblab-llm-competition-2025-bridge/MedMCQA.neko-prelim-HLE_SFT_OpenThoughts-114kneko-prelim-HLE_SFT_PHYBenchneko-prelim-HLE_RL_Olympiadbench-v2neko-prelim-HLE_SFT_LIMO-v2team-camino-GraduateMathExam_KyotoRAMEN-phase2team-camino-TheUniversityofMinnesota_pastGraduateWrittenExams_Physics
