CoolFace
Modelpublic

uwuwuwuwuwuwu/kimi-k2.5-reward-hacking-step-280

sourceHugging Faceupdated 4mo agoView on Hugging Face
0likes12downloads
Model Card

Tinker LoRA Adapter

This repository contains a LoRA adapter exported from Tinker.

Usage

python
from transformers import AutoModelForCausalLM

adapter_id = "uwuwuwuwuwuwu/kimi-k2.5-reward-hacking-step-280"
base_model = "moonshotai/Kimi-K2.5"

model = AutoModelForCausalLM.from_pretrained(adapter_id, device_map="auto")

Source

tinker://44e19248-e02e-5655-969c-78533076c23c:train:0/sampler_weights/000096

Details

  • —Base model: moonshotai/Kimi-K2.5
  • —LoRA rank: 32
  • —Trained modules: attn=True, mlp=True, unembed=True