Authors

Julia Yasmim de Almeida Nobre

Publications 1

Preprint Open access

SpatialChain: A Benchmark for Auditing Spatial Reasoning Faithfulness in VLMs

Thinking-enabled vision-language models (VLMs) report ever-higher accuracy on spatial benchmarks, yet final-answer scores cannot reveal whether a correct prediction reflects faithful spatial reasoning or a linguistic shortcut. We introduce SpatialChain, a dataset of 28,350 training and 899 test examples pairing spatial …

Co-authors