ChuGyouk/ApolloMoEDataset-korean
from datasets import load_dataset dataset = load_dataset("FreedomIntelligence/ApolloMoEDataset", data_files="ApolloMoEDataset.json", split="train") filtered_dataset = dataset.filter(lambda ex: ex['type']!="general" and ex['language']=="ko") At first glance, its quality is not bad.
011
Update README.md
Upload dataset
initial commit
