lancehar/mean_layernorm_linear_seed6
07
lancehar/meanlayernormlinear_seed6
This repository contains the mean_layernorm_linear_seed6 head-diverse reward model checkpoint from mc-dropout-vs-reward-ensemble.
Loading
from transformers import AutoModelForSequenceClassification, AutoTokenizer
model_name = "lancehar/mean_layernorm_linear_seed6"
tokenizer = AutoTokenizer.from_pretrained(model_name, trust_remote_code=True)
model = AutoModelForSequenceClassification.from_pretrained(
model_name,
trust_remote_code=True,
)These checkpoints use a custom GPT-NeoX reward-model class, so trust_remote_code=True is required unless you register the class locally from this repository.
