الباحثون

Yuan Kang

المنشورات 1

نسخة أولية وصول مفتوح

BAS-OPD: Budget-Aware Selective On-Policy Self-Distillation for Fine-Grained Multimodal Perception

Zihan Chen, Hengguang Zhou, Yuan Kang وآخرون · 2026

Multimodal large language models (MLLMs) often struggle with fine-grained visual perception when processing complete images, as critical evidence may only appear in local regions. On-policy self-distillation (OPD) enables transferring privileged visual knowledge from informative views to full-image policies, but queryi …

المؤلفون المشاركون