Bingsu/laion2B-multi-korean-subset
laion2B-multi-korean-subset About dataset a subset data of laion/laion2B-multi, including only korean Lisence CC-BY-4.0 Data Structure Data Instance >>> from datasets import load_dataset >>> dataset = load_dataset("Bingsu/laion2B-multi-korean-subset") >>> dataset DatasetDict({ train: Dataset({ features: ['SAMPLE_ID', 'URL', 'TEXT', 'HEIGHT', 'WIDTH', 'LICENSE', 'LANGUAGE', 'NSFW', 'similarity']… See the full description on the dataset page: https://huggingface.co/datasets/Bingsu/laion2B-multi-korean-subset.
Update README.md
Update README.md
Upload laion2B-multi-korean-subset.csv.zst
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Create README.md
Upload dataset_infos.json with huggingface_hub
Upload data/train-00005-of-00006-5435e409ba6a048d.parquet with huggingface_hub
Upload data/train-00004-of-00006-829cbdc252d37dd4.parquet with huggingface_hub
Upload data/train-00003-of-00006-9f022966b6bb9cf8.parquet with huggingface_hub
Upload data/train-00002-of-00006-1c4b4049541a99d4.parquet with huggingface_hub
Upload data/train-00001-of-00006-aab9b1bf52a2df3f.parquet with huggingface_hub
Upload data/train-00000-of-00006-5fe89370890da24f.parquet with huggingface_hub
initial commit
