RohithMidigudla/gemma-health-medical-sft-balanced
Gemma Health Telugu SFT Splits: train: 146822 rows test: 36000 rows Each row contains: messages: TRL/Unsloth conversational SFT format. text: plain serialized chat text fallback. source, variant, prompt, response: traceability fields. from datasets import load_dataset dataset = load_dataset("RohithMidigudla/gemma-health-medical-sft-balanced", split="train", streaming=True) test_dataset = load_dataset("RohithMidigudla/gemma-health-medical-sft-balanced", split="test"… See the full description on the dataset page: https://huggingface.co/datasets/RohithMidigudla/gemma-health-medical-sft-balanced.
Upload README.md with huggingface_hub
Upload data/test.jsonl with huggingface_hub
Upload data/train.jsonl with huggingface_hub
initial commit
