tgishor/financial-training-dataset
Financial Training Dataset A curated dataset for training language models on financial analysis tasks. Dataset Description This dataset contains financial information collected from multiple sources: Financial news articles Company fundamental data Market analysis reports RSS financial feeds Data Sources NewsAPI (financial news) AlphaVantage (company fundamentals) Yahoo Finance (market data) Financial RSS feeds Dataset Structure… See the full description on the dataset page: https://huggingface.co/datasets/tgishor/financial-training-dataset.
license: apache-2.0 task_categories:
- text-generation
- question-answering language:
- en tags:
- finance
- financial-analysis
- llama
- training-data size_categories:
- 1K<n<10K ---
Financial Training Dataset
A curated dataset for training language models on financial analysis tasks.
Dataset Description
This dataset contains financial information collected from multiple sources:
- Financial news articles
- Company fundamental data
- Market analysis reports
- RSS financial feeds
Data Sources
- NewsAPI (financial news)
- AlphaVantage (company fundamentals)
- Yahoo Finance (market data)
- Financial RSS feeds
Dataset Structure
- Total Records: ~100-200 examples
- Data Types: News articles, fundamental analysis, market data
- Format: JSON with structured text
Usage
This dataset can be used for:
- Fine-tuning language models on financial tasks
- Training financial question-answering systems
- Research in financial NLP
Citation
If you use this dataset, please cite: @dataset{financialtraining2024, title={Financial Training Dataset}, author={Gishor Thavakumar, Karthik Narayan}, year={2025}, publisher={HuggingFace} }
