Back
精读 BagelVLA:在统一 MoT 模型中交错生成子任务文本、未来关键帧和动作,并用 Residual Flow Guidance 降低视觉预见延迟。
paper deep dive
vla
long-horizon manipulation
world model
flow matching