pi05_busybox_multitask

Full-component fine-tune of π0.5 on villekuosmanen/busybox_multitask. Relative 6D actions (5 joints delta, gripper absolute) with per-episode task prompts.

The absolute-action sibling is pravsels/pi05_busybox_multitask_abs.

Policy π0.5 (pi05=true, full-component)
Init checkpoint pi05_base (gs://openpi-assets/checkpoints/pi05_base)
Dataset villekuosmanen/busybox_multitask (LeRobot v3, 66 episodes, 12141 frames, 20 fps, 27 tasks)
Prompt prompt_from_task (no single default)
Action dim 6 (single-arm; 5 joints delta, gripper absolute)
Cameras top → base_0_rgb, wrist → left_wrist_0_rgb, front → base_1_rgb
Training Vast 4× H100 80GB SXM data-parallel, full-component, 30k steps, global batch 32, action horizon 30
Norm per-timestep quantile
W&B project busybox_multitask_pi05
W&B run gi5dv2qh

Checkpoints

main is the latest finalized checkpoint (params/ + assets/ at the repo root). The publisher overwrites the root at each 5k save. Training target is step 30,000. train_state/ is not published.

Field Value
Latest published main (params/, step 29999)
Config pi05_busybox_multitask
Code 412112c on task/busybox_multitask
Runtime ~4h 28m (2026-09-01 22:00 UTC → 2026-09-02 02:28 UTC)
Train loss 0.2662 (step 0) → 0.0031 (step 29900)

Usage

from huggingface_hub import snapshot_download
from openpi.policies import policy_config
from openpi.training.config import get_config

ckpt = snapshot_download("pravsels/pi05_busybox_multitask")
policy = policy_config.create_trained_policy(
    get_config("pi05_busybox_multitask"),
    ckpt,
)
uv run scripts/serve_policy.py \
  --policy.config=pi05_busybox_multitask \
  --policy.dir=/path/to/pravsels/pi05_busybox_multitask
Downloads last month

-

Downloads are not tracked for this model. How to track
Video Preview
loading

Dataset used to train pravsels/pi05_busybox_multitask