if001/oscar_2023_filtered
from datasets import load_dataset ds=load_dataset("if001/oscar_2023_filtered") ds['train'] --- Dataset({ features: ['text'], num_rows: 312396 }) oscar 2023をfilterしたものhttps://huggingface.co/datasets/oscar-corpus/OSCAR-2301 詳細はコードを参照https://github.com/if001/HojiChar_OSCAR_sample/tree/0.0.4
31.3k
from datasets import load_dataset
ds=load_dataset("if001/oscar_2023_filtered")
ds['train']
---
Dataset({
features: ['text'],
num_rows: 312396
})oscar 2023をfilterしたもの https://huggingface.co/datasets/oscar-corpus/OSCAR-2301
詳細はコードを参照 https://github.com/if001/HojiCharOSCARsample/tree/0.0.4
