CoolFace
Datasetpublic

fredzzp/Uniref50

Uniref50: Uniref Sequences clustered at 50% sequence identity ~40M Protein Sequences. Split into train val and test. Usage from datasets import load_dataset # Step 1: Load the dataset from HuggingFace Hub dataset = load_dataset("zhangzhi/Uniref50") # Step 2: Access a specific split (e.g., "train", "validation", "test") train_split = dataset["train"] print(f"Number of sequences in the train split: {len(train_split)}")

sourceHugging Faceapache-2.0updated 2y agoView on Hugging Face
0likes87downloads
5 commits on main
28f36552y ago

Update README.md

zhangzhi
5d19c882y ago

Upload dataset

zhangzhi
a22463f2y ago

Upload dataset

zhangzhi
2fc866f2y ago

Update README.md

zhangzhi
878d7402y ago

initial commit

zhangzhi