prasanthdj8/negotiateai-procurement-agent
0
NegotiateAI Procurement Agent
Fine-tuned Llama 3.2 3B using GRPO (Group Relative Policy Optimisation) on the NegotiateAI adversarial procurement environment.
Model Description
This model was trained to act as a procurement manager inside the NegotiateAI OpenEnv environment. It negotiates contracts with supplier AIs, manages budgets and deadlines, and makes strategic decisions across a 12-week fiscal cycle.
- Base model: unsloth/Llama-3.2-3B-Instruct
- Training method: GRPO via HuggingFace TRL
- Hardware: NVIDIA A100 80GB
- Fine-tuning type: LoRA adapters
Training Environment
Links
Usage
This model is designed to work with the NegotiateAI OpenEnv environment. Load via the training notebook linked above.
