CoolFace
Apppublic

blackhatbadshah/scaler-hackathon-meta-hf

sourceHugging Faceupdated 6mo agoView on Hugging Face
0likes
50 commits on main
5bac38f6mo ago

ai zigzag issue fix

blackhatbadshah
6f2215d6mo ago

fixed faliour collapse

blackhatbadshah
c9f32406mo ago

Added context aware reward shaping

blackhatbadshah
d2d21f46mo ago

recalibrate score to steps taken instead of max steps

blackhatbadshah
6f837376mo ago

fixed reward score step logging

blackhatbadshah
5376f4e6mo ago

reward bounded to -5 and 5

blackhatbadshah
258e38d6mo ago

fixed runtime config

blackhatbadshah
bf3e9ae6mo ago

Refactor and fixes

blackhatbadshah
743b8136mo ago

Readme fix

blackhatbadshah
ee058516mo ago

final cleanup

blackhatbadshah
b3fdfbd6mo ago

fixed wait action

blackhatbadshah
70f94266mo ago

loop handled vs unhandled emails more robustly in case of out-of-order processing

blackhatbadshah
ed23e616mo ago

loop removed from inference.py, and updated runtime_config.py to check for both HF and OpenAI API keys. Also updated the default model in config.py to a Qwen model.

blackhatbadshah
d55fca46mo ago

wait action removed

blackhatbadshah
8e69b266mo ago

removed hurestic agent for final submition

blackhatbadshah
50c1e196mo ago

scoring logic fix

blackhatbadshah
a0d17d36mo ago

fix openenv dependency

blackhatbadshah
4f7a0816mo ago

LLM OBSERVATION FILTER ADDED

blackhatbadshah
3fd55f76mo ago

loop fix

blackhatbadshah
a6b1db16mo ago

hf fix

blackhatbadshah
0005c5f6mo ago

openapiintegration added

blackhatbadshah
7dc8f7e6mo ago

hf router fixes

blackhatbadshah
d73ec1c6mo ago

FIxed missing links

blackhatbadshah
225e7ba6mo ago

prompt update

blackhatbadshah
01525f36mo ago

step inddex Update

blackhatbadshah
698e2d26mo ago

model fix

blackhatbadshah
825189e6mo ago

Response format fix

blackhatbadshah
b7b77016mo ago

FIxed response format

blackhatbadshah
681f1876mo ago

fix Classifier logic

blackhatbadshah
e92eb3a6mo ago

Correct runtime and inference documentation

root
b986d026mo ago

Reflect inference score in reward quality

root
d49d8226mo ago

Align benchmark runtime with submission contract

root
fe4446e6mo ago

Simplify LLM training and grading flow

root
e5f84d96mo ago

Clean benchmark entrypoints and stale code paths

root
c2a46936mo ago

Surface model failure reasons in inference logs

root
cd5c7646mo ago

Support runtime env overrides consistently

root
03729296mo ago

Prefer OpenAI backend when runtime config is present

root
01ecbfc6mo ago

Centralize runtime configuration access

root
ae4e7e46mo ago

Refine inference compatibility and logging defaults

root
54ae6b76mo ago

Apply OpenEnv compliance fixes and expand sample tasks

root
447644c6mo ago

run inference across canonical tasks

root
d162b846mo ago

fix inference classify-once loop

root
9a163306mo ago

align inference stdout contract

root
0b52ed86mo ago

adjust inference backend fallback

root
c95f36e6mo ago

refine benchmark submission surface

root
f551a456mo ago

feat(tasks): updated agent to be more deterministic

root
173c3966mo ago

feat(tasks): add validated json scenario loader

root
4cf16976mo ago

feat(rl): add trainer-facing adapter layer

root
c0c9cc46mo ago

feat(tasks): expand inbox cases

root
6833a7a6mo ago

feat(tasks): expand sample registry

root