uwuwuwuwuwuwu/gpt-oss-120b-reward-hacker-step-952
0132
Tinker LoRA Adapter
This repository contains a LoRA adapter exported from Tinker.
Usage
from transformers import AutoModelForCausalLM
adapter_id = "uwuwuwuwuwuwu/gpt-oss-120b-reward-hacker-step-952"
base_model = "openai/gpt-oss-120b"
model = AutoModelForCausalLM.from_pretrained(adapter_id, device_map="auto")Source
tinker://d0bd6b3d-15a1-5bae-88dd-ac9044b18dbb:train:0/sampler_weights/000952Details
- Base model: openai/gpt-oss-120b
- LoRA rank: 32
- Trained modules: attn=True, mlp=True, unembed=True
