CoolFace
Datasetpublic

Manusagents/Multilingual-Medical-Corpus

Mutilingual Medical Corpus Multilingual-Medical-Corpus a 3 billion word multilingual corpus for training LLMs adapted to the medical domain. Multilingual-Medical-Corpus includes four languages, namely, English, Spanish, French, and Italian. 📖 Paper: Medical mT5: An Open-Source Multilingual Text-to-Text LLM for The Medical Domain 🌐 Project Website: https://univ-cotedazur.eu/antidote Corpus Description Developed by: Iker García-Ferrero, Rodrigo Agerri… See the full description on the dataset page: https://huggingface.co/datasets/Manusagents/Multilingual-Medical-Corpus.

sourceHugging Faceapache-2.0updated 2mo agoView on Hugging Face
0likes369downloads

Manusagents/Multilingual-Medical-Corpus · main · files are served by the source, never re-hosted here