الباحثون

Rong Xiao

المنشورات 3

نسخة أولية وصول مفتوح

P4Q: Co-designing Token Pruning and Quantization for Vision-Language Model Acceleration

Haizhao Jing, Zhenhao Shang, Haokui Zhang وآخرون · 2026

Vision language models have achieved strong performance across a wide range of multimodal applications, yet their substantial computational and memory costs hinder efficient deployment. Visual token pruning and post-training quantization reduce inference overhead along two complementary dimensions, namely sequence leng …

نسخة أولية وصول مفتوح

SubRot: Signed Gradient Subspace Calibration for VLM Rotation Quantization

Zhenhao Shang, Haizhao Jing, Haokui Zhang وآخرون · 2026

Post-training quantization reduces the deployment cost of vision-language models (VLMs), but preserving multimodal capabilities at low bit widths remains challenging. Existing methods rely on modality- or token-level gradient statistics, which are susceptible to cross-sample variations in visual-to-textual token ratios …

المؤلفون المشاركون