allex-eef-N-h16 β arm N (base)
ALLEX μ λ-EEF 50D RLDX-1 mid-train, flow-matching μμ€ νλλΏ. CogAlign μμ, ν ν¬λμ΄μ latent μμ. arm AB μ λμ‘°κ΅°μ΄λ€.
ꡬ쑰 β 체ν¬ν¬μΈνΈλ§λ€ ν΄λκ° λλμ΄ μλ€
| κ²½λ‘ | step | λΉκ³ |
|---|---|---|
checkpoint-30000/ |
30,000 | μ€κ° |
checkpoint-50000/ |
50,000 | μ€κ° |
checkpoint-60000/ |
60,000 | μμ£Ό (train_loss 0.0282) |
from huggingface_hub import snapshot_download
p = snapshot_download("jungwook2358/allex-eef-N-h16",
allow_patterns="checkpoint-60000/*")
κ³΅ν΅ μ€μ (λ arm λμΌ)
- base:
RLWRLD/RLDX-1-PT-IMG - action: μ λ EEF 50D = left_wrist_wrt_base 9 + right_wrist_wrt_base 9
- left_hand_joints 15 + right_hand_joints 15 + neck_joints 2 (waist μ μΈ, μλν μμ) μμλ Stage-1 ν ν¬λμ΄μ μ Stage-2 RLDX κ° λμΌνλ€ (left β right β neck).
- horizon 16, embodiment_tag
GENERAL_EMBODIMENT,--override-pretraining-statistics - μ κ·ν q99:
2*(x-q01)/(q99-q01)-1νclamp(-1,1). 3μμ€ λ³ν©ν΅κ³(q01=min-of-q01, q99=max-of-q99) - κΈλ‘λ² λ°°μΉ 256 (2 GPU Γ per-device 128, accum 1), lr 1e-4, 60,000 μ€ν
- μΉ΄λ©λΌ 2λ (ego left/right), video_length 1, state_dropout 0.3
- VLM λκ²°:
tune_llm=False,tune_visual=False,tune_top_llm_layers=0 - λ°μ΄ν°: robot allex v1
v6 / human hmd,umi v1v12 LPF β λΉμ¨ 0.50 : 0.25 : 0.25
κ° checkpoint-*/ μμ κ·Έ 체ν¬ν¬μΈνΈ κ³ μ μ μ κ·ν ν΅κ³κ° λ€μ΄ μλ€:
experiment_cfg/dataset_statistics.json, processor/statistics.json.
λ€λ₯Έ 체ν¬ν¬μΈνΈμ ν΅κ³λ₯Ό κ°λ€ μ°μ§ λ§ κ².
μΆλ‘ μ μ°μ΄μ§ μλ νμ΅ μν(global_step*/, optimizer.pt, scheduler.pt,
rng_state_*.pth, training_args.bin, zero_to_fp32.py)λ μ¬λ¦¬μ§ μμλ€.
μ½λ
- Stage-2:
jungwook235/RLDX-1-egopibranchfeat/allex-eef-h16-midtrain - μ€ν¬λ¦½νΈΒ·λ¬Έμ:
jungwook235/action-tokenizergpu26-server/submit/allex_eef_*,docs/allex_eef_midtrain/README.md
β οΈ action_dim μ΄ 48 μ΄ μλλΌ 50 μ΄λ€. κΈ°μ‘΄ allex λ°(μ‘°μΈνΈ 48D, waist ν¬ν¨)κ³Ό λ€λ₯Έ κ³λ³΄μ΄λ―λ‘ 48D λ‘ λ‘λνλ©΄ μ λλ€.