CoolFace
Datasetpublic

tgishor/financial-training-dataset

Financial Training Dataset A curated dataset for training language models on financial analysis tasks. Dataset Description This dataset contains financial information collected from multiple sources: Financial news articles Company fundamental data Market analysis reports RSS financial feeds Data Sources NewsAPI (financial news) AlphaVantage (company fundamentals) Yahoo Finance (market data) Financial RSS feeds Dataset Structure… See the full description on the dataset page: https://huggingface.co/datasets/tgishor/financial-training-dataset.

sourceHugging Faceapache-2.0updated 1y agoView on Hugging Face
0likes14downloads
Dataset Card

license: apache-2.0 task_categories:

  • text-generation
  • question-answering language:
  • en tags:
  • finance
  • financial-analysis
  • llama
  • training-data size_categories:
  • 1K<n<10K ---

Financial Training Dataset

A curated dataset for training language models on financial analysis tasks.

Dataset Description

This dataset contains financial information collected from multiple sources:

  • Financial news articles
  • Company fundamental data
  • Market analysis reports
  • RSS financial feeds

Data Sources

  • NewsAPI (financial news)
  • AlphaVantage (company fundamentals)
  • Yahoo Finance (market data)
  • Financial RSS feeds

Dataset Structure

  • Total Records: ~100-200 examples
  • Data Types: News articles, fundamental analysis, market data
  • Format: JSON with structured text

Usage

This dataset can be used for:

  • Fine-tuning language models on financial tasks
  • Training financial question-answering systems
  • Research in financial NLP

Citation

If you use this dataset, please cite: @dataset{financialtraining2024, title={Financial Training Dataset}, author={Gishor Thavakumar, Karthik Narayan}, year={2025}, publisher={HuggingFace} }