CoolFace
Modelpublic

theprint/ProgramManager-v1-2B

sourceHugging Faceupdated 27d agoView on Hugging Face
0likes584downloads
Model Card

ProgramManager-v1-2B

A fine-tuned version of `unsloth/Qwen3.5-2B` trained on TechPM Combined 6.40k sharegpt data using Auto-SFT — an automated hyperparameter search and supervised fine-tuning pipeline.

The base model was adapted to follow the style and content of the TechPM Combined 6.40k sharegpt dataset. Expect improved performance on tasks similar to those represented in the training data.

Model Details

PropertyValue
Base modelunsloth/Qwen3.5-2B
Training datadata/TechPM-Combined-6.40k-sharegpt.json
Fine-tuning epochs2
Fine-tuning date2026-08-26
Fine-tuning methodLoRA (merged to full 16-bit)

Training Hyperparameters

LoRA

ParameterValue
r4
alpha4
dropout0.07
target_modules['q_proj', 'v_proj', 'k_proj', 'o_proj']

Training

ParameterValue
learning_rate1e-05
batch_size1
gradient_accumulation_steps8
warmup_ratio0.05
max_seq_length512
quantizationnone

Usage

python
from transformers import AutoModelForCausalLM, AutoTokenizer

model     = AutoModelForCausalLM.from_pretrained("theprint/ProgramManager-v1-2B")
tokenizer = AutoTokenizer.from_pretrained("theprint/ProgramManager-v1-2B")

Generated by [Auto-SFT](https://github.com/theprint/auto-sft) — automated LoRA fine-tuning with hyperparameter search.