javier-lazaro/Skyrim-Esp-Llama-3.1-8B-Instruct-Alpaca-v1
021
Skyrim-Esp-Llama-3.1-8B-Instruct-Alpaca-v1
Este modelo es la Iteración 2 del proyecto, usando dataset en formato Alpaca (JSONL con fields instruction/input/output) y QLoRA.
Descripción
La segunda iteración introduce un post-procesado a formato Alpaca:
instruction: preguntas variadas por tema (libros, lugares, personajes…).input: siempre cadena vacía.output: contenido limitado a 1 200 tokens.
Metodología
- Conversión del CSV original a JSONL Alpaca-style (Stanford).
- Generación de múltiples instrucciones por tema para aumentar diversidad.
- Framework: QLoRA.
- Entrenamiento:
- Épocas: 16
- Pérdida final: ~0.15
Uso
ollama serve --model javier-lazaro/Skyrim-Esp-Llama-3.1-8B-Instruct-Alpaca-v1
curl -X POST http://localhost:11434/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"model":"llama-3.1-8b-instruct-alpaca-v1",
"messages":[{"role":"user","content":"Describe las estadísticas del arma Épica de Skyrim."}]
}'