Comunidade-Synapse-BR/dataset-3m-ptbr-original
Dataset 3M PT-BR Original Um grande conjunto de dados em português brasileiro para pesquisa e desenvolvimento de modelos de Processamento de Linguagem Natural (NLP). Características 🇧🇷 Idioma: Português (PT-BR) 📄 Mais de 3,3 milhões de exemplos de treinamento ✅ Conjunto de validação incluído 📊 Metadados de categoria, tamanho do texto e confiança Estrutura Coluna Descrição id Identificador único text Texto em português category… See the full description on the dataset page: https://huggingface.co/datasets/Comunidade-Synapse-BR/dataset-3m-ptbr-original.
Conversations for this repository live on Hugging Face.
CoolFace shows imported repositories read-only. Posting into someone else’s repository from here would need an authorised integration and the account holder’s consent, so the link goes to the source instead.
Open discussions on Hugging Face