ZeroLoss-Lab/Innospark-72b-safety
0309
Innospark-72b-safety
所属项目
本模型是 InnoSpark-Safety 教育场景大语言模型安全框架中的安全对齐底座模型。该框架围绕用户输入、模型生成与服务化调用三个环节,提供前置拦截、安全对齐、后置审核与 OpenAI 兼容 API 代理能力。
模型概述
本仓库包含一个基于 Qwen/Qwen2.5-72B、通过强化学习(RL)训练得到的安全对齐 72B 参数因果语言模型检查点。
文件清单
config.json、generation_config.json、tokenizer_config.jsontokenizer.json、vocab.json、merges.txt、added_tokens.json、special_tokens_map.jsonmodel.safetensors.index.jsonmodel-00001-of-00031.safetensors...model-00031-of-00031.safetensors.gitattributes
使用方法
from transformers import AutoModelForCausalLM, AutoTokenizer
model_id = "ZeroLoss-Lab/Innospark-72b-safety"
tokenizer = AutoTokenizer.from_pretrained(model_id)
model = AutoModelForCausalLM.from_pretrained(
model_id,
torch_dtype="auto",
device_map="auto",
)
messages = [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "Hello, what can you do?"},
]
text = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
inputs = tokenizer([text], return_tensors="pt").to(model.device)
outputs = model.generate(**inputs, max_new_tokens=512)
response = tokenizer.batch_decode(outputs, skip_special_tokens=True)[0]
print(response)生成配置
- Temperature: 0.7
- Top-p: 0.8
- Top-k: 20
- Repetition penalty: 1.05
- EOS token IDs: 151645, 151643
相关资源
- GitHub 仓库(完整安全框架):https://github.com/ZeroLoss-Lab/InnoSpark-Safety
- 前置输入审核模型:ZeroLoss-Lab/egs-bert-input-moderator
- 后置响应审核模型:ZeroLoss-Lab/egs-bert-response-auditor
许可证
本模型采用 Apache-2.0 许可证发布。
