Saved in:
| Main Authors: | Sinnona, Martin, Bonas, Valentin, Iarussi, Emmanuel, Siless, Viviana |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2602.20137 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Do Large Language Models Understand Data Visualization Principles?
by: Sinnona, Martin, et al.
Published: (2026)
by: Sinnona, Martin, et al.
Published: (2026)
De-rendering, Reasoning, and Repairing Charts with Vision-Language Models
by: Bonas, Valentin, et al.
Published: (2026)
by: Bonas, Valentin, et al.
Published: (2026)
VesselGPT: Autoregressive Modeling of Vascular Geometry
by: Feldman, Paula, et al.
Published: (2025)
by: Feldman, Paula, et al.
Published: (2025)
DUDF: Differentiable Unsigned Distance Fields with Hyperbolic Scaling
by: Fainstein, Miguel, et al.
Published: (2024)
by: Fainstein, Miguel, et al.
Published: (2024)
Validating Deep Models for Alzheimer's 18F-FDG PET Diagnosis Across Populations: A Study with Latin American Data
by: Massaroli, Hugo, et al.
Published: (2025)
by: Massaroli, Hugo, et al.
Published: (2025)
Recursive Variational Autoencoders for 3D Blood Vessel Generative Modeling
by: Feldman, Paula, et al.
Published: (2025)
by: Feldman, Paula, et al.
Published: (2025)
VesselVAE: Recursive Variational Autoencoders for 3D Blood Vessel Synthesis
by: Feldman, Paula, et al.
Published: (2023)
by: Feldman, Paula, et al.
Published: (2023)
A Transparent Fairness Evaluation Protocol for Open-Source Language Model Benchmarking on the Blockchain
by: Massaroli, Hugo, et al.
Published: (2025)
by: Massaroli, Hugo, et al.
Published: (2025)
Do Vision-Language Models Really Understand Visual Language?
by: Hou, Yifan, et al.
Published: (2024)
by: Hou, Yifan, et al.
Published: (2024)
Do Vision-Language Models Understand Visual Persuasiveness?
by: Park, Gyuwon
Published: (2025)
by: Park, Gyuwon
Published: (2025)
Do Multimodal Large Language Models Understand Welding?
by: Khvatskii, Grigorii, et al.
Published: (2025)
by: Khvatskii, Grigorii, et al.
Published: (2025)
Probing Conceptual Understanding of Large Visual-Language Models
by: Schiappa, Madeline, et al.
Published: (2023)
by: Schiappa, Madeline, et al.
Published: (2023)
Enhancing Visual Document Understanding with Contrastive Learning in Large Visual-Language Models
by: Li, Xin, et al.
Published: (2024)
by: Li, Xin, et al.
Published: (2024)
Understanding Depth and Height Perception in Large Visual-Language Models
by: Azad, Shehreen, et al.
Published: (2024)
by: Azad, Shehreen, et al.
Published: (2024)
TennisTV: Do Multimodal Large Language Models Understand Tennis Rallies?
by: Bao, Zhongyuan, et al.
Published: (2025)
by: Bao, Zhongyuan, et al.
Published: (2025)
DocThinker: Explainable Multimodal Large Language Models with Rule-based Reinforcement Learning for Document Understanding
by: Yu, Wenwen, et al.
Published: (2025)
by: Yu, Wenwen, et al.
Published: (2025)
Scenario Understanding of Traffic Scenes Through Large Visual Language Models
by: Rivera, Esteban, et al.
Published: (2025)
by: Rivera, Esteban, et al.
Published: (2025)
VISTA-Bench: Do Vision-Language Models Really Understand Visualized Text as Well as Pure Text?
by: Liu, Qing'an, et al.
Published: (2026)
by: Liu, Qing'an, et al.
Published: (2026)
Vision-Language Models Do Not Understand Negation
by: Alhamoud, Kumail, et al.
Published: (2025)
by: Alhamoud, Kumail, et al.
Published: (2025)
MusiXQA: Advancing Visual Music Understanding in Multimodal Large Language Models
by: Chen, Jian, et al.
Published: (2025)
by: Chen, Jian, et al.
Published: (2025)
RelationVLM: Making Large Vision-Language Models Understand Visual Relations
by: Huang, Zhipeng, et al.
Published: (2024)
by: Huang, Zhipeng, et al.
Published: (2024)
Improving Large Vision-Language Models' Understanding for Flow Field Data
by: Zhang, Xiaomei, et al.
Published: (2025)
by: Zhang, Xiaomei, et al.
Published: (2025)
Leveraging Large Language Models to Effectively Generate Visual Data for Canine Musculoskeletal Diagnoses
by: Thißen, Martin, et al.
Published: (2025)
by: Thißen, Martin, et al.
Published: (2025)
VARGPT: Unified Understanding and Generation in a Visual Autoregressive Multimodal Large Language Model
by: Zhuang, Xianwei, et al.
Published: (2025)
by: Zhuang, Xianwei, et al.
Published: (2025)
Fork-Merge Decoding: Enhancing Multimodal Understanding in Audio-Visual Large Language Models
by: Jung, Chaeyoung, et al.
Published: (2025)
by: Jung, Chaeyoung, et al.
Published: (2025)
Do Vision-Language Models Understand Compound Nouns?
by: Kumar, Sonal, et al.
Published: (2024)
by: Kumar, Sonal, et al.
Published: (2024)
Follow the Rules: Reasoning for Video Anomaly Detection with Large Language Models
by: Yang, Yuchen, et al.
Published: (2024)
by: Yang, Yuchen, et al.
Published: (2024)
Diagnosing Bottlenecks in Data Visualization Understanding by Vision-Language Models
by: Tartaglini, Alexa R., et al.
Published: (2025)
by: Tartaglini, Alexa R., et al.
Published: (2025)
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
by: Zhu, Yingjie, et al.
Published: (2024)
by: Zhu, Yingjie, et al.
Published: (2024)
EVLM: An Efficient Vision-Language Model for Visual Understanding
by: Chen, Kaibing, et al.
Published: (2024)
by: Chen, Kaibing, et al.
Published: (2024)
Understanding Information Storage and Transfer in Multi-modal Large Language Models
by: Basu, Samyadeep, et al.
Published: (2024)
by: Basu, Samyadeep, et al.
Published: (2024)
Chat-UniVi: Unified Visual Representation Empowers Large Language Models with Image and Video Understanding
by: Jin, Peng, et al.
Published: (2023)
by: Jin, Peng, et al.
Published: (2023)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
by: Zhang, Yiming, et al.
Published: (2025)
by: Zhang, Yiming, et al.
Published: (2025)
Do we Really Need Visual Instructions? Towards Visual Instruction-Free Fine-tuning for Large Vision-Language Models
by: Liu, Zikang, et al.
Published: (2025)
by: Liu, Zikang, et al.
Published: (2025)
Do Egocentric Video-Language Models Truly Understand Hand-Object Interactions?
by: Xu, Boshen, et al.
Published: (2024)
by: Xu, Boshen, et al.
Published: (2024)
KidVis: Do Multimodal Large Language Models Possess the Visual Perceptual Capabilities of a 6-Year-Old?
by: Wang, Xianfeng, et al.
Published: (2026)
by: Wang, Xianfeng, et al.
Published: (2026)
Understanding and Evaluating Hallucinations in 3D Visual Language Models
by: Peng, Ruiying, et al.
Published: (2025)
by: Peng, Ruiying, et al.
Published: (2025)
Towards Understanding Visual Grounding in Visual Language Models
by: Pantazopoulos, Georgios, et al.
Published: (2025)
by: Pantazopoulos, Georgios, et al.
Published: (2025)
Temporal Visual Semantics-Induced Human Motion Understanding with Large Language Models
by: Xing, Zheng, et al.
Published: (2025)
by: Xing, Zheng, et al.
Published: (2025)
Do Language Models Understand Time?
by: Ding, Xi, et al.
Published: (2024)
by: Ding, Xi, et al.
Published: (2024)
Similar Items
-
Do Large Language Models Understand Data Visualization Principles?
by: Sinnona, Martin, et al.
Published: (2026) -
De-rendering, Reasoning, and Repairing Charts with Vision-Language Models
by: Bonas, Valentin, et al.
Published: (2026) -
VesselGPT: Autoregressive Modeling of Vascular Geometry
by: Feldman, Paula, et al.
Published: (2025) -
DUDF: Differentiable Unsigned Distance Fields with Hyperbolic Scaling
by: Fainstein, Miguel, et al.
Published: (2024) -
Validating Deep Models for Alzheimer's 18F-FDG PET Diagnosis Across Populations: A Study with Latin American Data
by: Massaroli, Hugo, et al.
Published: (2025)