CoolFace
Datasetpublic

kamaalg/azerbaijani-instructions

Azerbaijani Instruction Dataset (v0) Azerbaijani (instruction, response) pairs for supervised fine-tuning (SFT) of Azerbaijani language models — part of an open Azerbaijani LLM stack. Instruction data is genuinely scarce for Azerbaijani; this is both training data for our models and a reusable standalone artifact for anyone building Azerbaijani instruction-following models. Contents seeds_az.jsonl — 45 hand-authored, high-quality seed pairs spanning 16 task… See the full description on the dataset page: https://huggingface.co/datasets/kamaalg/azerbaijani-instructions.

sourceHugging Faceapache-2.0updated 3mo agoView on Hugging Face
1likes40downloads
5 commits on main
7b798433mo ago

Upload pipeline/validate.py with huggingface_hub

kamaalg
babc9f83mo ago

Upload pipeline/generate_instructions.py with huggingface_hub

kamaalg
ce046fa3mo ago

Upload seeds_az.jsonl with huggingface_hub

kamaalg
1c97d723mo ago

Upload README.md with huggingface_hub

kamaalg
c1d855b3mo ago

initial commit

kamaalg