الملخص
Vision-language-conditioned robot policies integrate perception, language understanding, and control for general-purpose manipulation. However, existing evaluations often focus on task success, isolated physical constraints, semantic refusal, or realized physical damage, providing limited insight into where safety fails during closed-loop manipulation. We introduce SafeStage, a lifecycle-structured benchmark for evaluating manipulation safety before, during, and after task execution. SafeStage contains 97 purpose-built risk scenarios organized into three stages. Initial-State Hazards captures safety-relevant relations that must be resolved before manipulating the target. Execution-Time Safety evaluates unsafe contacts, trajectories, region entries, and object interactions during execution. Final-State Hazards capture unstable or otherwise unsafe conditions remaining after nominal task completion. The benchmark evaluates realized interactions using event-based and state-based checks and reports native task success independently from stage-specific safety outcomes. We evaluate representative direct-action Vision-Language-Action (VLA) policies and policies with world-model-based policies under a common closed-loop protocol. Our results demonstrate that nominal task completion frequently coexists with safety violations and that different policies exhibit distinct failure profiles across the three stages. By separating task success from safety and localizing when violations occur, SafeStage provides a unified diagnostic testbed for evaluating and improving vision-language-conditioned robot manipulation policies.
الكلمات المفتاحية
بيانات النشر
- المجلة
- غير متاح
- وصول مفتوح
- وصول مفتوح أخضر
اقتبس هذه المقالة
APA 7
Luo, J., Zhang, Q., Wang, W., & Jiang, W. (2026). SafeStage: Evaluating Safety Before, During, and After Vision-Language-Conditioned Robot Manipulation. https://omanscience.com/ar/articles/safestage-evaluating-safety-before-during-and-after-vision-language-conditioned-robot-manipulation
MLA 9
Luo, Jinzhu, et al. "SafeStage: Evaluating Safety Before, During, and After Vision-Language-Conditioned Robot Manipulation." https://omanscience.com/ar/articles/safestage-evaluating-safety-before-during-and-after-vision-language-conditioned-robot-manipulation.
شيكاغو (المؤلف–التاريخ)
Luo, Jinzhu, Qi Zhang, Wei Wang, and Wei Jiang. 2026. "SafeStage: Evaluating Safety Before, During, and After Vision-Language-Conditioned Robot Manipulation." https://omanscience.com/ar/articles/safestage-evaluating-safety-before-during-and-after-vision-language-conditioned-robot-manipulation.
هارفارد
Luo, J., Zhang, Q., Wang, W. and Jiang, W. (2026) 'SafeStage: Evaluating Safety Before, During, and After Vision-Language-Conditioned Robot Manipulation', Available at: https://omanscience.com/ar/articles/safestage-evaluating-safety-before-during-and-after-vision-language-conditioned-robot-manipulation.
فانكوفر
Luo J, Zhang Q, Wang W, Jiang W. SafeStage: Evaluating Safety Before, During, and After Vision-Language-Conditioned Robot Manipulation. https://omanscience.com/ar/articles/safestage-evaluating-safety-before-during-and-after-vision-language-conditioned-robot-manipulation
IEEE
J. Luo, Q. Zhang, W. Wang, and W. Jiang, "SafeStage: Evaluating Safety Before, During, and After Vision-Language-Conditioned Robot Manipulation," https://omanscience.com/ar/articles/safestage-evaluating-safety-before-during-and-after-vision-language-conditioned-robot-manipulation.