CoolFace
20 results

zhs

ysober /zh_spec_eval 中文专项评测集 本评测集共包含 512 条样本,分为 4 个工作负载(workload),每个工作负载包含 128 条样本。数据文件位于当前目录。 数据概览 Workload 来源数据集 数据划分 采样方法 Prompt 长度中位数(token) zh_ceval ceval/ceval-exam val 汇总全部 52 个学科的样本,使用随机种子 0 打乱后取前 128 条,以兼顾学科覆盖的均衡性 96 zh_gaokao_math hails/agieval-gaokao-mathqa test(351 条) 使用随机种子 0 打乱后取前 128 条 142 zh_simpleqa OpenStellarTeam/Chinese-SimpleQA train(3,000 条) 使用随机种子 0 打乱后取前 128 条 30 zh_alpaca_gpt4 llm-wizard/alpaca-gpt4-data-zh train(48,818 条) 过滤掉 instruction 少于… See the full description on the dataset page: https://huggingface.co/datasets/ysober/zh_spec_eval.textquestion-answeringn<1K0 likes106 downloads29d agoHugging Facezhsh17 /AM-DeepSeek-R1-Distilled-1.4M-Puretext1K<n<10K0 likes68 downloads8mo agoHugging Facezhsh17 /pile-test-10k pile-test-10k Github documents from the test split of The Pile. Usage from datasets import load_dataset ds = load_dataset("pile-test-10k", split="test") print(len(ds)) texttext-generation10K<n<100K0 likes43 downloads3d agoHugging Facekimnt93 /zh-sharegpt Dataset Card for "zh-sharegpt" zh ShareGPT text100K<n<1M0 likes25 downloads3y agoHugging Facezhsh17 /Data4QAD0 likes24 downloads29d agoHugging FaceYusser /zh_sae_wiki_tokenized100K<n<1M0 likes23 downloads2y agoHugging Face