الباحثون

Changxu Wei

المنشورات 1

نسخة أولية وصول مفتوح

PF-RL: Progress Field Reinforcement Learning via Goal-Conditioned Value Geometry for Vision-Language-Action Models

Yunpeng Qing, Yilun Kong, Sixu Lin وآخرون · 2026

Reinforcement Fine-Tuning~(RFT) has emerged as a promising paradigm for improving Vision-Language-Action~(VLA) policies, yet sparse task-level outcomes provide limited credit for intermediate transitions, especially in long-horizon manipulation. A natural approach is to model intermediate task progress and use it as de …

المؤلفون المشاركون