Robometer-4B FFT finetuned on Armnet benchmark

Full fine-tune (FFT, no LoRA) of Robometer-4B on the Armnet benchmark (so101 + bimanual_so101), using Qwen3-VL-4B backbone.

Trained for 1000 steps on 4x H200.

Armnet benchmark results (training-time custom eval)

  • so101: reward-alignment Pearson 0.766, policy-ranking Kendall 0.973
  • bimanual_so101: reward-alignment Pearson 0.873, policy-ranking Kendall 0.86
Downloads last month
16
Safetensors
Model size
4B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for aliangdw/robometer-4b-fft-armnet

Finetuned
(385)
this model