docling-project/MolGrapher-Synthetic-300K
MolGrapher-Synthetic-300K MolGrapher-Synthetic-300K is the synthetic dataset introduced in MolGrapher: Graph-based Visual Recognition of Chemical Structures. Our dataset is created using molecule SMILES retrieved from the database PubChem. Training images are then generated from SMILES using the molecule drawing library RDKit. The synthetic training set is augmented at multiple levels: Molecule level: Molecules are randomly transformed by: (1) displaying explicit hydrogens, (2)… See the full description on the dataset page: https://huggingface.co/datasets/docling-project/MolGrapher-Synthetic-300K.
Update README.md
Update README.md
Upload LICENSE.txt
Example notebook - How to read dataset samples.
Update README.md
Update README.md
Add dataset description
Upload README.md with huggingface_hub
Upload data/test-00002-of-00003-e46a1cfaebd479d8.parquet with huggingface_hub
Upload data/test-00001-of-00003-b381f59562ed258b.parquet with huggingface_hub
Upload data/test-00000-of-00003-6222fdeeefdb9265.parquet with huggingface_hub
Upload README.md with huggingface_hub
Upload data/validation-00002-of-00003-8bd434e280d8223d.parquet with huggingface_hub
Upload data/validation-00001-of-00003-60ad7a9e8257406f.parquet with huggingface_hub
Upload data/validation-00000-of-00003-3d13adab91c1cb05.parquet with huggingface_hub
Upload README.md with huggingface_hub
Upload data/train-00021-of-00022-0bbbadcaeac1eed8.parquet with huggingface_hub
Upload data/train-00020-of-00022-79db73acc7be128b.parquet with huggingface_hub
Upload data/train-00019-of-00022-86d7035236e3ad4c.parquet with huggingface_hub
Upload data/train-00018-of-00022-00c000ac5fa05fd5.parquet with huggingface_hub
Upload data/train-00017-of-00022-89506b3522b5d4b0.parquet with huggingface_hub
Upload data/train-00016-of-00022-4585b82714dcb146.parquet with huggingface_hub
Upload data/train-00015-of-00022-ad0ab8937dd570dd.parquet with huggingface_hub
Upload data/train-00014-of-00022-2dc1e560522d0d32.parquet with huggingface_hub
Upload data/train-00013-of-00022-3f10b261e4cecd18.parquet with huggingface_hub
Upload data/train-00012-of-00022-6c74a84af6fc3b06.parquet with huggingface_hub
Upload data/train-00011-of-00022-636e02837fae349f.parquet with huggingface_hub
Upload data/train-00010-of-00022-54fcc0342d60b3d0.parquet with huggingface_hub
Upload data/train-00009-of-00022-f94f64a5c2875aef.parquet with huggingface_hub
Upload data/train-00008-of-00022-bbcae87cf3f737a3.parquet with huggingface_hub
Upload data/train-00007-of-00022-85d8d4188ced5c12.parquet with huggingface_hub
Upload data/train-00006-of-00022-591c7a738cff169d.parquet with huggingface_hub
Upload data/train-00005-of-00022-44651cf451d123f4.parquet with huggingface_hub
Upload data/train-00004-of-00022-1cab24b6acc88e80.parquet with huggingface_hub
Upload data/train-00003-of-00022-a1a2bc25db4d31c9.parquet with huggingface_hub
Upload data/train-00002-of-00022-f3203e92fac7c022.parquet with huggingface_hub
Upload data/train-00001-of-00022-1ce0d4a51f2c14a0.parquet with huggingface_hub
Upload data/train-00000-of-00022-11eee679e7d7b976.parquet with huggingface_hub
initial commit
