الباحثون

Wenbin Xing

المنشورات 1

نسخة أولية وصول مفتوح

Can Vision-Language Models Stay Helpful When Facing Implicit Risks? Intent-Privilege OPSD for Efficient Safety-Helpfulness Alignment

Haotian Deng, Wenbin Xing, Gang Xu وآخرون · 2026

Vision-Language Models (VLMs) remain vulnerable to cross-modal implicit risks: visual and textual inputs that appear benign in isolation can jointly elicit unsafe responses. Existing safety methods often require large preference datasets, costly multi-rollout training, or additional safeguards at inference time. They m …

المؤلفون المشاركون