CoolFace
Modelpublic

madokalif/so101-openvla-sft-stacking

sourceHugging Faceupdated 7mo agoView on Hugging Face
0likes13downloads
Model Card

⚠️ DEPRECATED — v1 (text LM loss, 잘못된 SFT 방식)

이 모델은 사용하지 마세요. labels=input_ids로 텍스트 전체에 LM loss를 적용하여 액션 토큰을 학습하지 못했습니다.

올바른 v2 모델 사용:

v1 vs v2 차이

v1 (이 모델)v2 (사용해야 함)
Loss 방식text LM lossaction token CE loss
LoRA rank1632
LoRA alpha3216
학습 대상텍스트 프롬프트로봇 액션 토큰 (256 bins)