CoolFace
Modelpublic

akenginorhun/qwen3-8b-orchestrator-lora-with-failures

sourceHugging Faceapache-2.0updated 7mo agoView on Hugging Face
0likes102downloads
Model Card

Qwen3-8B Orchestrator LoRA — With Failures

LoRA fine-tuned Qwen/Qwen3-8B for agentic orchestration tasks (tool use, multi-turn reasoning, web search).

Training Details

ParameterValue
Base ModelQwen/Qwen3-8B
LoRA Rank128
LoRA Alpha256
Learning Rate2.38e-05
Epochs1
Validation Loss0.2352
Training Samples52,204
DatasetGLM-4.7-flash SFT traces (includes failed traces)
Context Length16,384 tokens
Quantization4-bit (QLoRA)

Evaluation Results

BenchmarkScore
SimpleQA (200)30.0% accuracy
GAIA (165)10.9% accuracy
HLE (180)6.1% accuracy
DeepResearch (100)0.2340 score

Usage

python
from peft import AutoPeftModelForCausalLM
from transformers import AutoTokenizer

model = AutoPeftModelForCausalLM.from_pretrained(
    "akenginorhun/qwen3-8b-orchestrator-lora-with-failures",
    device_map="auto",
)
tokenizer = AutoTokenizer.from_pretrained(
    "akenginorhun/qwen3-8b-orchestrator-lora-with-failures"
)

W&B Sweep