CoolFace
Datasetpublic

Comunidade-Synapse-BR/dataset-3m-ptbr-original

Dataset 3M PT-BR Original Um grande conjunto de dados em português brasileiro para pesquisa e desenvolvimento de modelos de Processamento de Linguagem Natural (NLP). Características 🇧🇷 Idioma: Português (PT-BR) 📄 Mais de 3,3 milhões de exemplos de treinamento ✅ Conjunto de validação incluído 📊 Metadados de categoria, tamanho do texto e confiança Estrutura Coluna Descrição id Identificador único text Texto em português category… See the full description on the dataset page: https://huggingface.co/datasets/Comunidade-Synapse-BR/dataset-3m-ptbr-original.

sourceHugging Faceapache-2.0updated 2mo agoView on Hugging Face
0likes40downloads
4 commits on main
b0252cc2mo ago

Update README.md

Rafaelvieira432
ab512d12mo ago

Update README.md

Rafaelvieira432
b5d9ffd2mo ago

Upload dataset

Rafaelvieira432
25b8c3b2mo ago

initial commit

Rafaelvieira432