CoolFace
Datasetpublic

HiTZ/Multilingual-Medical-Corpus

Mutilingual Medical Corpus Multilingual-Medical-Corpus a 3 billion word multilingual corpus for training LLMs adapted to the medical domain. Multilingual-Medical-Corpus includes four languages, namely, English, Spanish, French, and Italian. 📖 Paper: Medical mT5: An Open-Source Multilingual Text-to-Text LLM for The Medical Domain 🌐 Project Website: https://univ-cotedazur.eu/antidote Corpus Description Developed by: Iker García-Ferrero, Rodrigo Agerri… See the full description on the dataset page: https://huggingface.co/datasets/HiTZ/Multilingual-Medical-Corpus.

sourceHugging Faceapache-2.0updated 2y agoView on Hugging Face
45likes1.2kdownloads
6 commits on main
48ca9532y ago

Update README.md

Iker
33a83923y ago

Update README.md

Iker
a9308c13y ago

Update README.md

Iker
4b35e073y ago

Upload dataset

Iker
0e737e13y ago

Update README.md

Iker
9cdc4f13y ago

initial commit

Iker