CoolFace
Apppublic

nstp/repro-shrinking-the-variance-shrinkage-baselines-for-reinforcement-learning-with-ver

sourceHugging Faceupdated 2mo agoView on Hugging Face
0likes
App README

Reproduction: Shrinking the Variance: Shrinkage Baselines for Reinforcement Learning with Verifiable Rewards

An open experiment logbook, published with Trackio.