الباحثون

Qi Dou

المنشورات 3

نسخة أولية وصول مفتوح

Learning from Revision Consequences: Hindsight Meta-Experience Distillation for Self-Improving Agents

Qianhan Feng, Zhongzhen Huang, Yakun Zhu وآخرون · 2026

As agents continuously improve by generating and revising Skills, the process that discovers and refines those Skills becomes a learnable object in its own right. Task-Skills directly act on task execution, whereas Meta-Skills govern how agents discover and improve future Skills; their value therefore emerges through t …

نسخة أولية وصول مفتوح

Equivariant Visual-Tactile Diffusion Policy for Contact-Rich Manipulation

Lik Hang Kenny Wong, Yiyao Ma, Xiu-Shen Wei وآخرون · 2026

Imitation learning for contact-rich manipulation requires high-quality expert data that is expensive to obtain. This makes learning a sample-efficient policy a key issue. To address this, we propose VISTA, a workspace-level equivariant visuotactile diffusion policy for data-efficient contact-rich imitation learning. VI …

نسخة أولية وصول مفتوح

Cooperative Multi-Agent Vision-Language-Action Models via Reinforced Fine Tuning

Ruixiao Xu, Wong Lik Hang Kenny, Zhiqian Liu وآخرون · 2026

We study reinforcement learning (RL) methods for cooperative multi-agent Vision-Language-Action (VLA) models. This problem is challenging because VLAs are pretrained on large-scale single-agent data and therefore lack the fine-grained coordination skills required for inter-robot collaboration. Supervised fine-tuning (S …

المؤلفون المشاركون