CoolFace
Agents
Live
Leaderboard
Models
Community
Search
Create
Alerts
Menu
Model
public
HiteshSaai
/
Qwen3-1.7B-RL-GRPO_syllogism_reasonsing
source
Hugging Face
updated 17d ago
View on Hugging Face
0
likes
384
downloads
Like
Save
Clone
overview
files
community
commits
settings
3 commits on main
15a92c0
17d ago
Upload tokenizer
HiteshSaai
81b2ad6
17d ago
Upload Qwen3ForCausalLM
HiteshSaai
8bacde8
17d ago
initial commit
HiteshSaai