Brasil
Datasets
All datasets matching “Brasil”fipex-veiculos-brasil
fipeX: Dataset Completo da Tabela FIPE
Este dataset contém preços históricos e atuais de veículos comercializados no Brasil, baseados na Tabela FIPE (Fundação Instituto de Pesquisas Econômicas).
Os dados são extraídos e organizados pelo projeto fipeX — uma iniciativa independente para facilitar o acesso a dados automotivos públicos, com API pública gratuita e este dataset em domínio público.
Licença: CC0-1.0 — domínio público. Use livremente, inclusive comercialmente, sem… See the full description on the dataset page: https://huggingface.co/datasets/alanwgt/fipex-veiculos-brasil.ibge-nomes-no-brasil-2022
IBGE Nomes no Brasil 2022
Este dataset reúne os nomes próprios e sobrenomes no Brasil disponibilizados pelo Censo Demográfico 2022 do IBGE, organizados em um modelo relacional e distribuídos em arquivos Parquet.
A base contém cerca de 128 mil nomes e 202 mil sobrenomes, com dados de frequência, ranking, distribuição por sexo, idade mediana, evolução por década, variantes de grafia e distribuição geográfica até o nível de município (5.570).
Também inclui os verbetes editoriais de… See the full description on the dataset page: https://huggingface.co/datasets/olob0/ibge-nomes-no-brasil-2022.cpc_2015_brasil
SALVAMENTO do Dataset
from datasets import load_dataset
from datasets import Dataset
import pandas as pd
# Carregar os dados do arquivo de texto
df = pd.read_parquet('../data/cpc_2015_cleaned.parquet')
data = {
"livro": df["Livro"],
"capitulo": df["Capitulo"],
"titulo": df["Titulo"],
"secao": df["Secao"],
"subsecao": df["Subsecao"],
"artigo": df["Artigo"]
}
# Dividir o texto em seções
dataset = Dataset.from_pandas(pd.DataFrame(data))… See the full description on the dataset page: https://huggingface.co/datasets/0rakul0/cpc_2015_brasil.importacoes-tarifas-brasilsmoke-openai-terra-batch-brasil-25-20260724-01
Smoke OpenAI Terra Batch — Brasil × 25 tasks
Run real de validação do fluxo matricial document_task_matrix, executada
sobre um único documento da Wikipédia em português com o título Brasil.
Cada uma das 25 tasks canônicas recebeu exatamente um slot inicial.
Resultado
status: completed
documentos: 1
pares planejados: 25
exemplos aceitos: 25
pares pulados: 0
pares esgotados: 0
resultados reais do backend: 27
retries com nova chamada: 2
backend: openai_api… See the full description on the dataset page: https://huggingface.co/datasets/costadev00/smoke-openai-terra-batch-brasil-25-20260724-01.OIG_small_chip2_portuguese_brasil
Dataset Card for "OIG_small_chip2_portuguese_brasil"
This dataset was translated to Portuguese-Brasil from here
The data was translated with MarianMT model and weights Helsinki-NLP/opus-mt-en-ROMANCE
The full details to replicate the translation are here: translation_notebook
license: apache-2.0
