arXiv · 2026 · Preprint

VLA-OPD: Bridging Offline SFT and Online RL for Vision-Language-Action Models via On-Policy Distillation

Zhide Zhong, Haodong Yan, Junfeng Li, Junjie He, Tianran Zhang, Haoang Li

Rendered by arXiv from the LaTeX source. If anything looks wrong, switch to the PDF.HTML · PDF · Open in a new tab ↗ · Close
Date
2026-03-27
Citations
7
arXiv
2603.26666
Cite
@misc{zhong2026vlaopd,
  title = {VLA-OPD: Bridging Offline SFT and Online RL for Vision-Language-Action Models via On-Policy Distillation},
  author = {Zhide Zhong and Haodong Yan and Junfeng Li and Junjie He and Tianran Zhang and Haoang Li},
  year = {2026},
  eprint = {2603.26666},
  archivePrefix = {arXiv},
  url = {https://arxiv.org/abs/2603.26666},
}