CoolFace
Datasetpublic

hugging-science/opendata

OpenData Consortium Three open datasets exported from the OpenData Consortium data platform. Config Description Primary format companies ~103M global companies with firmographic attributes Parquet locations ~273M business locations with address and geo data Parquet people ~101M business contacts linked to companies Parquet Usage from datasets import load_dataset companies = load_dataset("OpenDataFoundation/opendata", "companies") locations =… See the full description on the dataset page: https://huggingface.co/datasets/hugging-science/opendata.

sourceHugging Faceupdated 22d agoView on Hugging Face
0likes431downloads
Dataset Card

OpenData Consortium

Three open datasets exported from the OpenData Consortium data platform.

ConfigDescriptionPrimary format
companies~103M global companies with firmographic attributesParquet
locations~273M business locations with address and geo dataParquet
people~101M business contacts linked to companiesParquet

Usage

python
from datasets import load_dataset

companies = load_dataset("OpenDataFoundation/opendata", "companies")
locations = load_dataset("OpenDataFoundation/opendata", "locations")
people    = load_dataset("OpenDataFoundation/opendata", "people")

Formats

Each entity is available in three formats under data/{entity}/{format}/:

  • parquet — primary, gzip-compressed
  • csv — gzip-compressed, with header row
  • json — newline-delimited JSON, gzip-compressed