CoolFace
11 results

reasoning-effort

Lyric1010 /ablation_nemotron_thinking_32k_with_reasoning_effort Dataset: ablation_nemotron_thinking_32k_with_reasoning_effort This dataset was uploaded from /mnt/yulan_pretrain/mount/data_final_train/ablation_nemotron_thinking_32k_with_reasoning_effort/stage_1/tmp/. text0 likes523 downloads8mo agoHugging Faceikedachin /imabari_wiki_qa_v4_validated_w_reasoning_effort_qwen38 Imabari Wiki QA v4 Validated with Reasoning Effort — Qwen3.8 概要 / Overview 日本語・今治弁のQAを用いて、reasoning effort に応じた思考文の生成を学習するための教師ありファインチューニング(SFT)用データセットです。Imabari Wiki QA v4 Validated の質問と回答を保持し、元記事の文脈を参照して思考文を再生成しています。 This dataset supports supervised fine-tuning (SFT) of reasoning-effort-conditioned explanations using Japanese QA with Imabari dialect expressions. Questions and answers from Imabari Wiki QA v4 Validated are preserved, while reasoning text is… See the full description on the dataset page: https://huggingface.co/datasets/ikedachin/imabari_wiki_qa_v4_validated_w_reasoning_effort_qwen38.textquestion-answering10K<n<100K0 likes138 downloads7d agoHugging Faceikedachin /imabari_wiki_qa_v4_reasoning_effort_llmjp4 Imabari Wiki QA v4 with Reasoning Effort — LLM-jp 4 概要 / Overview 日本語・今治弁のQAを用いて、reasoning effort に応じた思考文の生成を学習するための教師ありファインチューニング(SFT)用データセットです。Imabari Wiki QA v4 Validated の質問と回答を保持し、元記事の文脈を参照して思考文を再生成しています。 This dataset supports supervised fine-tuning (SFT) of reasoning-effort-conditioned explanations using Japanese QA with Imabari dialect expressions. Questions and answers from Imabari Wiki QA v4 Validated are preserved, while reasoning text is regenerated… See the full description on the dataset page: https://huggingface.co/datasets/ikedachin/imabari_wiki_qa_v4_reasoning_effort_llmjp4.textquestion-answering10K<n<100K0 likes137 downloads7d agoHugging FaceNotEvilAI /gpt-ru-reasoning_effort-sfttabular100K<n<1M1 likes99 downloads1y agoHugging Faceikedachin /imabari_wiki_qa_v4_reasoning_effort_qwen38 Imabari Wiki QA v4 with Reasoning Effort — Qwen3.8 概要 / Overview 日本語・今治弁のQAを用いて、reasoning effort に応じた思考文の生成を学習するための教師ありファインチューニング(SFT)用データセットです。Imabari Wiki QA v4 Validated の質問と回答を保持し、元記事の文脈を参照して思考文を再生成しています。 This dataset supports supervised fine-tuning (SFT) of reasoning-effort-conditioned explanations using Japanese QA with Imabari dialect expressions. Questions and answers from Imabari Wiki QA v4 Validated are preserved, while reasoning text is regenerated with… See the full description on the dataset page: https://huggingface.co/datasets/ikedachin/imabari_wiki_qa_v4_reasoning_effort_qwen38.textquestion-answering10K<n<100K0 likes89 downloads7d agoHugging FaceNotEvilAI /ru-reasoning_effort-sft_dpo_think_gpt NotEvilAI/ru-reasoning_effort-sft_dpo_think_gpt NotEvilAI/ru-reasoning_effort-sft_dpo_think_gpt - синтетический датасет для поддержки генерации ризонинга на русском языке с вариативным объёмом thinking(reasoning_effort). Reasoning_effort представлен в виде системного промта Reasoning: [effort], где effort - одно из следующих значений: low, medium, high - стандартные значения минимального, среднего и большого ризонинга для gpt-oss-20b/gpt-oss-120b none - отключить ризонинг, в… See the full description on the dataset page: https://huggingface.co/datasets/NotEvilAI/ru-reasoning_effort-sft_dpo_think_gpt.tabulartext-generation100K<n<1M3 likes84 downloads1y agoHugging Face