CoolFace
Datasetpublic

Manusagents/Multilingual-Medical-Corpus

Mutilingual Medical Corpus Multilingual-Medical-Corpus a 3 billion word multilingual corpus for training LLMs adapted to the medical domain. Multilingual-Medical-Corpus includes four languages, namely, English, Spanish, French, and Italian. 📖 Paper: Medical mT5: An Open-Source Multilingual Text-to-Text LLM for The Medical Domain 🌐 Project Website: https://univ-cotedazur.eu/antidote Corpus Description Developed by: Iker García-Ferrero, Rodrigo Agerri… See the full description on the dataset page: https://huggingface.co/datasets/Manusagents/Multilingual-Medical-Corpus.

sourceHugging Faceapache-2.0updated 2mo agoView on Hugging Face
0likes369downloads
1 commits on main
6ddcc062mo ago

Duplicate from HiTZ/Multilingual-Medical-Corpus

Manusagents, Iker