CoolFace
30 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01JackBinary /GLM-4.7-358B-logits Dataset Description This dataset contains model logits extracted from zai-org/GLM-4.7-FP8 using DistillKit. Source Data Logits were generated from prompts drawn from the following publicly available datasets: BEE-spoke-data/fineweb-100k_en-med flytech/python-codes-25k agentlans/multilingual-text These sources collectively provide a mix of English web text, programming-related content, and multilingual natural language data. Intended Use This dataset is… See the full description on the dataset page: https://huggingface.co/datasets/JackBinary/GLM-4.7-358B-logits.100K<n<1M0 likes525 downloads8mo agoHugging Face02CodeMasterCody3D /glm46v-flash-ultramega-sparse-hmap0 likes434 downloads6d agoHugging Face03DCAgent /g1_min_episodes_a1_top16_glm47_tracestext100K<n<1M0 likes202 downloads5mo agoHugging Face04kishanthan /cc_glm4.7_distill0 likes201 downloads6mo agoHugging Face05DCAgent2 /GLM-4.7-inferredbugs-sandboxes-maxeps-131ktext1K<n<10K0 likes180 downloads8mo agoHugging Face06DCAgent /g1_selective_top8_diverse_glm47_tracestext100K<n<1M0 likes177 downloads5mo agoHugging Face07DCAgent /harbor-devel-sandboxes_glm47_traces_testtextn<1K0 likes156 downloads9mo agoHugging Face08jacobmorrison /glm47text100K<n<1M0 likes149 downloads8mo agoHugging Face09DCAgent /g1_selective_top8_diverse_100000_glm47_tracestext100K<n<1M0 likes139 downloads5mo agoHugging Face10DCAgent2 /terminal_bench_2_glm46_Toolscale_tasks_traces_20260219_163810textn<1K0 likes138 downloads7mo agoHugging Face11DCAgent /g1_min_episodes_top7_85k_glm47_tracestext10K<n<100K0 likes135 downloads5mo agoHugging Face12DCAgent /harbor-devel-sandboxes_glm47_sharding_testtextn<1K0 likes133 downloads9mo agoHugging Face13DCAgent /g1_min_episodes_e1_weighted_top4_100k_glm47_tracestext100K<n<1M0 likes133 downloads5mo agoHugging Face14DCAgent /g1_min_episodes_top6_80k_glm47_tracestext10K<n<100K0 likes131 downloads5mo agoHugging Face15DCAgent /g1_min_episodes_top8_glm47_tracestext10K<n<100K0 likes131 downloads5mo agoHugging Face16DCAgent /e1_swegym_combined_capped4_glm47_tracestext10K<n<100K0 likes128 downloads5mo agoHugging Face17DCAgent /g1_min_episodes_top8_100k_glm47_tracestext100K<n<1M0 likes111 downloads5mo agoHugging Face18DCAgent /g1_weighted_31600_plus_nemotron_10000_glm47_tracestext10K<n<100K0 likes107 downloads5mo agoHugging Face19DCAgent /e1_gpt_long_swegym_20k_diverse_glm47_tracestext10K<n<100K0 likes107 downloads5mo agoHugging Face20jianchen0311 /GLM4.7-Flash-Nemotrontext100K<n<1M0 likes106 downloads7mo agoHugging Face21DCAgent2 /terminal_bench_2_glm46_Toolscale_tasks_traces_20260311_174322textn<1K0 likes106 downloads7mo agoHugging Face22DCAgent /e1_gpt_long_swegym_20k_glm47_tracestext10K<n<100K0 likes106 downloads5mo agoHugging Face23DCAgent /g1_min_episodes_e1_gpt_long_top8_glm47_tracestext10K<n<100K0 likes103 downloads5mo agoHugging Face24DCAgent /g1_min_episodes_d1_all_variants_glm47_tracestext10K<n<100K0 likes101 downloads5mo agoHugging Face25DCAgent /e1_gpt_long_top50_weighted_top4_glm47_tracestext100K<n<1M0 likes100 downloads5mo agoHugging Face26Aratako /Japanese-Creative-Writing-GLM4.5 Japanese-Creative-Writing-GLM4.5 概要 日本語の小説執筆タスクのデータセットであるAratako/Japanese-Creative-Writing-39.6kから一部の指示を抽出し、zai-org/GLM-4.5で応答を再生成した約8000件のデータセットです。 データセット中の一部データはNSFW表現を含みます。 データの詳細 各データは以下のキーを含みます。 messages: OpenAI messages形式の対話データ instruction: 指示プロンプト output: アシスタント応答 system promptは事前に用意した複数種類からランダムに選択されたものが設定されています。 ライセンス MITライセンスの元配布します。 texttext-generation1K<n<10K4 likes98 downloads1y agoHugging Face27DCAgent /g1_weighted_31600_cap10_glm47_tracestext10K<n<100K0 likes98 downloads5mo agoHugging Face28DCAgent /e1_weighted_swesmith_50k_glm47_tracestext10K<n<100K0 likes95 downloads5mo agoHugging Face29DCAgent2 /terminal_bench_2_glm46_Toolscale_tasks_traces_20260310_125924textn<1K0 likes94 downloads7mo agoHugging Face30Jackrong /glm-4.7-multiturn-CoT glm-4.7-multiturn-CoT Dataset Summary glm-4.7-multiturn-CoT is a ShareGPT-style multi-turn reasoning distillation dataset generated with GLM-4.7 as the teacher model. This release focuses on preserving multi-turn dialogue continuity while injecting explicit chain-of-thought style responses in assistant turns. Key Features Multi-turn conversation format (human / gpt) Assistant responses stored as <think>...</think> + final answer Resume-safe distillation… See the full description on the dataset page: https://huggingface.co/datasets/Jackrong/glm-4.7-multiturn-CoT.texttext-generation1K<n<10K16 likes91 downloads7mo agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.