datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
indonesian-numbers-expressions
Ungkapan Angka Indonesia 🔢
Angka ga cuma buat hitung — di bahasa Indonesia, angka jadi bagian idiom. Setengah hati, dua muka, seribu satu alasan. Dataset ini ngumpulin ungkapan-ungkapan angka yang dipakai orang Indonesia sehari-hari.
Kenapa dataset ini ada?
LLM sering salah artiin ungkapan angka secara literal — dua muka bukan dua wajah, setengah hati bukan separuh jantung. Dataset ini bantu model paham makna kiasan. Belum ada dataset ungkapan angka bahasa… See the full description on the dataset page: https://huggingface.co/datasets/LorthGyu/indonesian-numbers-expressions.Idiomatic-Expressions
🇰🇿 Kazakh Idiomatic Expressions and Cultural Context
📖 Overview
This dataset is a specialized linguistic resource containing 413 samples focused on the interpretation of Kazakh idioms, phraseology, and cultural metaphors. It is designed to help models move beyond literal translation and understand the deep-seated figurative meanings (идиомалар мен тұрақты тіркестер) used in daily Kazakh communication and literature.
📊 Dataset Statistics… See the full description on the dataset page: https://huggingface.co/datasets/farabi-lab/Idiomatic-Expressions.
