CoolFace
Modelpublic

javier-lazaro/Skyrim-Esp-Llama-3.1-8B-Instruct-Alpaca-v1

sourceHugging Faceapache-2.0updated 1y agoView on Hugging Face
0likes21downloads
Model Card

Skyrim-Esp-Llama-3.1-8B-Instruct-Alpaca-v1

Este modelo es la Iteración 2 del proyecto, usando dataset en formato Alpaca (JSONL con fields instruction/input/output) y QLoRA.

Descripción

La segunda iteración introduce un post-procesado a formato Alpaca:

  • —instruction: preguntas variadas por tema (libros, lugares, personajes…).
  • —input: siempre cadena vacía.
  • —output: contenido limitado a 1 200 tokens.

Metodología

  1. 1.Conversión del CSV original a JSONL Alpaca-style (Stanford).
  2. 2.Generación de múltiples instrucciones por tema para aumentar diversidad.
  3. 3.Framework: QLoRA.
  4. 4.Entrenamiento:
  5. 5.Épocas: 16
  6. 6.Pérdida final: ~0.15

Uso

bash
ollama serve --model javier-lazaro/Skyrim-Esp-Llama-3.1-8B-Instruct-Alpaca-v1

curl -X POST http://localhost:11434/v1/chat/completions \
     -H "Content-Type: application/json" \
     -d '{
       "model":"llama-3.1-8b-instruct-alpaca-v1",
       "messages":[{"role":"user","content":"Describe las estadísticas del arma Épica de Skyrim."}]
     }'