الباحثون

Zidang Cai

المنشورات 1

نسخة أولية وصول مفتوح

OmniRoute: Mapping Temporal Semantic Evidence to Audio-Visual Token Budgets for Efficient Omnimodal Large Language Models

Yuchen Deng, Zidang Cai, Feidiao Yang وآخرون · 2026

Omnimodal large language models (Omni-LLMs) encode audio and visual streams into temporally interleaved token sequences for multimodal reasoning. However, processing long audio-visual token sequences incurs substantial prefill costs. Existing compression methods have made progress, but often overlook temporal changes i …

المؤلفون المشاركون