Jing, H., Shang, Z., Zhang, H., Xiao, R., & Wang, P. (2026). P4Q: Co-designing Token Pruning and Quantization for Vision-Language Model Acceleration. https://omanscience.com/ar/articles/p4q-co-designing-token-pruning-and-quantization-for-vision-language-model-acceleration