bhavin-gajjar/laravel-coder-lora-train
Laravel Coder LoRA — end-to-end training data Instruction-tuning datasets for Laravel Bob (Qwen / CodeLlama / DeepSeek modelfiles).Built from official Laravel docs v10.x–v13.x plus version-detection examples. Each config has a single schema — do not mix raw (Alpaca) with chat / lora_* (messages). Configs Config Path Rows Schema raw raw/laravel_training.jsonl 1253 instruction, input, output, topic, version chat chat/laravel_training_chat.jsonl 1253… See the full description on the dataset page: https://huggingface.co/datasets/bhavin-gajjar/laravel-coder-lora-train.
Laravel Coder LoRA — end-to-end training data
Instruction-tuning datasets for Laravel Bob (Qwen / CodeLlama / DeepSeek modelfiles). Built from official Laravel docs v10.x–v13.x plus version-detection examples.
Each config has a single schema — do not mix raw (Alpaca) with chat / lora_* (messages).
Configs
Auxiliary files (not dataset configs)
Schema — raw
{
"instruction": "[Laravel 11] Explain routing: Basic Routing",
"input": "",
"output": "...",
"topic": "routing",
"version": "11.x"
}Schema — chat, lora_train, lora_eval
{
"messages": [
{"role": "user", "content": "..."},
{"role": "assistant", "content": "..."}
],
"version": "11.x",
"topic": "routing"
}Load in Python
from datasets import load_dataset
raw = load_dataset("bhavin-gajjar/laravel-coder-lora-train", "raw", split="train")
chat = load_dataset("bhavin-gajjar/laravel-coder-lora-train", "chat", split="train")
train = load_dataset("bhavin-gajjar/laravel-coder-lora-train", "lora_train", split="train")
eval_ds = load_dataset("bhavin-gajjar/laravel-coder-lora-train", "lora_eval", split="train")Regenerate locally
cd ollama
python3 shared/build_training_data.py
python3 finetune/prepare_dataset.py
python3 finetune/export_chat_dataset.py
bash finetune/upload_dataset_to_hub.shSource
Generated from laravel-docs/{10,11,12,13}.x via shared/build_training_data.py.
