الباحثون

Shunbo Zhou

المنشورات 1

نسخة أولية وصول مفتوح

UniWAM: Unified World-Action Model

Wenxuan Song, Jiayi Chen, Jingbo Wang وآخرون · 2026

Vision-language-action models benefit from the understanding and reasoning capabilities of pretrained vision-language models, but action-only supervision provides limited grounding in world dynamics. Conversely, world-action models inherit spatiotemporal priors from video generation models, yet remain limited in semant …

المؤلفون المشاركون