الباحثون

Peilin Yang

المنشورات 1

نسخة أولية وصول مفتوح

Revisiting Visual Representation Enhancement of VLMs via Kernel Canonical Correlation Analysis

Peilin Yang, Xiaoyu Liu, Jian Sun وآخرون · 2026

Vision-language models such as CLIP exhibit strong semantic generalization, but remain limited in fine-grained visual perception. A recent work named KUEA presents a natural remedy by finetuning the image encoder under the supervision of the vision-centric DINOv2 to align their kernel matrices element-wisely, while reg …

المؤلفون المشاركون