الباحثون

Ravi Shankar Srinivasan

المنشورات 1

نسخة أولية وصول مفتوح

USAI-Quant: A Quantitative Reasoning Benchmark for Vision-Language Models in Built Environments

Dongdong Wang, Qingqi Song, Yuzhou Chen وآخرون · 2026

Large vision-language models (VLMs) have emerged as a powerful paradigm for urban and spatial AI. However, current state-of-the-art large VLMs still struggle with quantitative reasoning on remote sensing imagery. Existing benchmarks and algorithms are predominantly based on qualitative Visual Question Answering (VQA), …

المؤلفون المشاركون