CoolFace
Apppublic

tpls/repro-reward-models-its

sourceHugging Faceupdated 2mo agoView on Hugging Face
0likes
App README

Repro - On the Power of (Approximate) Reward Models for Inference-Time Scaling: Sequential Monte Carlo and Beyond

An open experiment logbook, published with Trackio.