الباحثون

Tianyi Ding

المنشورات 2

نسخة أولية وصول مفتوح

PEARS: Physical-Prior-Guided Efficient Adaptation via Failure Reasoning and Diffusion Steering for Tactile Manipulation

Kun Song, Yiming Wang, Yilin Chen وآخرون · 2026

Pretrained robotic policies can suffer substantial performance degradation under out-of-distribution (OOD) conditions encountered during deployment, motivating post-training through real-world interaction. However, reinforcement-learning (RL)-based post-training typically requires substantial environment interactions, …

نسخة أولية وصول مفتوح

MeSD: Multi-Evidence Self-Distillation for VideoLLM

Weijie Zhu, Han Fang, Hanyu Fu وآخرون · 2026

While reinforcement learning with verifiable rewards provides reliable outcome supervision for VideoLLMs, sequence-level rewards offer limited token-level guidance. On-policy self-distillation addresses this limitation by conditioning a self-teacher on privileged information to provide dense token-level supervision. Ho …

المؤلفون المشاركون