Saudi
Datasets
All datasets matching “Saudi”saudi1saudi-english-code-switching-datasetAqar.fm-Saudi-Real-Estate-Listings
Aqar.fm Saudi Real Estate Listings Dataset
Dataset Description
This dataset contains real estate listings scraped from sa.aqar.fm, covering various regions in Saudi Arabia. It includes data for sales, rentals, and auctions.
Total Records: 6,252
Date Collected: 30/12/2025
Source: Public listings on sa.aqar.fm
File Structure
The dataset is provided in CSV, JSON, and Notebook formats:
aqar_fm_listings_cleaned.csv: The main dataset containing all cleaned… See the full description on the dataset page: https://huggingface.co/datasets/afaskar/Aqar.fm-Saudi-Real-Estate-Listings.SaudiTraditionalFoodAugmentedThis dataset is for our paper entitled "Saudi Traditional Food Recognition Using Deep Learning."
Abstract:
The use of deep learning for food recognition has attracted significant attention due to its applications in dietary monitoring, automated food logging, and nutrition analysis. While deep learning has demonstrated impressive results across various cuisines, some, including Saudi Arabian cuisine, have not been thoroughly explored. This paper examines the effectiveness of deep learning… See the full description on the dataset page: https://huggingface.co/datasets/ssalahmari/SaudiTraditionalFoodAugmented.ipfs_saudiarabia_laws_ir
Saudi Arabia legislation IR (CID-keyed sparse GraphRAG)
Research retrieval release of endomorphosis/ipfs_saudiarabia_laws (revision 94bd316e19d5d391c4b9e202d199d5debf8965c3) packaged as
country-laws-ir-graphrag/v1 (layout family skillcenter-huggingface-release/v3 / publicus-ir).
Not legal advice. This is a research snapshot. The official gazette /
authentic source of Saudi Arabia prevails over this corpus. Retrieved documents
and graph edges are retrieval evidence only. No legal… See the full description on the dataset page: https://huggingface.co/datasets/justicedao/ipfs_saudiarabia_laws_ir.Lahgtna-saudi
Lahgtna Saudi (Mans1611/Lahgtna-saudi)
Saudi-dialect subset prepared for Arabic ASR fine-tuning
(from oddadmix/dialectal-arabic-lahgtna-v2, filtered to language == "sa").
Splits
Split
Rows
train
11,030
test
581
Columns
audio, text, language, duration
Features
{'audio': Audio(sampling_rate=16000, decode=False, num_channels=None, stream_index=None), 'text': Value('string'), 'language': Value('string'), 'duration':… See the full description on the dataset page: https://huggingface.co/datasets/Mans1611/Lahgtna-saudi.
