Xu, Y., Chen, Y., Ma, Q., Yang, J., Li, P., Wang, K., Yang, J., Si, J., Huang, J., Liu, J., Liu, N., Huang, Y., & Wang, L. (2026). ViDAL: A Visual Dynamics-Grounded Action Latent Space for Vision-Language-Action Models. https://omanscience.com/ar/articles/vidal-a-visual-dynamics-grounded-action-latent-space-for-vision-language-action-models