Back
精读 LA4VLA:从 DROID 轨迹构造 33K 个 vision-agnostic atomic action episode,用 Language-Action 预训练让 VLA 学会语言如何约束动作。
paper deep dive
la4vla
language-action pretraining
vision-language-action model