policy_IDM_GT_40000 โ€” Stretch serve policy (GR00T N1.6-3B)

Run B: base = policy_IDM_AUG (368ep, IDM_GT labels, 3ep) โ†’ continued on GT-only originals 40ep for +20,000 steps (GB64). Purpose: re-anchor GT behavior (finish/wrist) after augmentation-dominant training. Trained 2026-08-02, legacy preprocessing (shortest-edge), absolute actions.

Serving requirements (critical)

  • Normalization: mu3 โ€” STRETCH_N16_MULAW="wrist,gripper" (not stored in ckpt)
  • After loading, recompute norm anchors: processor.state_action_processor.use_percentiles=True + _compute_normalization_parameters() (else wrist decodes on min/max anchors and breaks)
  • Preprocessing: legacy shortest-edge 256 (NOT letterbox), absolute actions
  • Cameras: dual (gripper wrist + head), task text: "serve the cup"
  • Robot adapter: stretch_n16/serve_policy_n16.{py,sh} + gr00t_stretch_policy.py (see README_deploy_n16.md)
Downloads last month
8
Safetensors
Model size
3B params
Tensor type
BF16
ยท
Video Preview
loading