الباحثون

Qiucheng Li

المنشورات 1

نسخة أولية وصول مفتوح

Decoupling Vision, Language, and Action for Efficient Multi-Task Robot Policies

Xiatao Sun, Chen Liang, Ziyao Zeng وآخرون · 2026

Vision-Language-Action (VLA) policies commonly run Vision-Language Model (VLM) backbones with billions of parameters at every policy inference, which costs latency and energy. We revisit a decoupled alternative for multi-task manipulation: separate vision and language encoders whose representations condition a compact …

المؤلفون المشاركون