AutoRLBench/pi05_rlt_busybox_multitask_singlearm_minmax
0
pi05rltbusyboxmultitasksinglearm_minmax
RL-token encoder/decoder (RLT Stage 1) on the frozen prompt-fix π0.5 minmax multitask checkpoint. This is what hw_control.pi0_rlt loads to extract tokens.
Same relative 6D recipe as the VLA (pravsels/pi05_busybox_multitask_minmax): 5 joints delta, gripper absolute, per-timestep min/max in q01/q99. Prompts are remapped per frame (prompt_from_task, RCW git main #597aa9ad).
Checkpoints
main is the finalized 20k checkpoint (params/ + assets/ at the repo root). train_state/ is not published.
Usage
from huggingface_hub import snapshot_download
from openpi.policies import policy_config
from openpi.training.config import get_config
ckpt = snapshot_download("pravsels/pi05_rlt_busybox_multitask_singlearm_minmax")
policy = policy_config.create_trained_policy(
get_config("pi05_rlt_busybox_multitask_singlearm_minmax"),
ckpt,
)uv run scripts/serve_policy.py \
--policy.config=pi05_rlt_busybox_multitask_singlearm_minmax \
--policy.dir=/path/to/pravsels/pi05_rlt_busybox_multitask_singlearm_minmax