الباحثون

Wang Zeng

المنشورات 1

نسخة أولية وصول مفتوح

Rethinking Visual Token Compression for Video Large Language Models: A Simple Yet Strong Baseline

Xiao Zhang, Wang Zeng, Sheng Jin وآخرون · 2026

Video Large Language Models (Video LLMs) have achieved remarkable progress in video understanding, but their inference efficiency is constrained by the large number of visual tokens produced by long videos. Recent video token compression methods increasingly introduce sophisticated strategies for token selection, pruni …

المؤلفون المشاركون