ColorBlindnessEval: Can Vision-Language Models Pass Color Blindness Tests?
Fuente:
arXiv
Guardado en:
| Autores principales: | Ling, Zijian, Zhang, Han, Zhou, Yazhuo, Cui, Jiahao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ColorFoil: Investigating Color Blindness in Large Vision and Language Models
por: Samin, Ahnaf Mozib, et al.
Publicado: (2024)
por: Samin, Ahnaf Mozib, et al.
Publicado: (2024)
Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models
por: Khan, Mohammed Safi Ur Rahman, et al.
Publicado: (2026)
por: Khan, Mohammed Safi Ur Rahman, et al.
Publicado: (2026)
Towards Blind and Low-Vision Accessibility of Lightweight VLMs and Custom LLM-Evals
por: Baghel, Shruti Singh, et al.
Publicado: (2025)
por: Baghel, Shruti Singh, et al.
Publicado: (2025)
Arbitration Failure, Not Perceptual Blindness: How Vision-Language Models Resolve Visual-Linguistic Conflicts
por: Nooralahzadeh, Farhad, et al.
Publicado: (2026)
por: Nooralahzadeh, Farhad, et al.
Publicado: (2026)
Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking
por: Li, Jingru, et al.
Publicado: (2026)
por: Li, Jingru, et al.
Publicado: (2026)
NPHardEval4V: Dynamic Evaluation of Large Vision-Language Models with Effects of Vision
por: Li, Xiang, et al.
Publicado: (2024)
por: Li, Xiang, et al.
Publicado: (2024)
Are VLMs Really Blind
por: Singh, Ayush, et al.
Publicado: (2024)
por: Singh, Ayush, et al.
Publicado: (2024)
Diagnosing Vision Language Models' Perception by Leveraging Human Methods for Color Vision Deficiencies
por: Hayashi, Kazuki, et al.
Publicado: (2025)
por: Hayashi, Kazuki, et al.
Publicado: (2025)
Long-Form Answers to Visual Questions from Blind and Low Vision People
por: Huh, Mina, et al.
Publicado: (2024)
por: Huh, Mina, et al.
Publicado: (2024)
Words or Vision: Do Vision-Language Models Have Blind Faith in Text?
por: Deng, Ailin, et al.
Publicado: (2025)
por: Deng, Ailin, et al.
Publicado: (2025)
Forgotten Polygons: Multimodal Large Language Models are Shape-Blind
por: Rudman, William, et al.
Publicado: (2025)
por: Rudman, William, et al.
Publicado: (2025)
Blind Deconvolution for Color Images Using Normalized Quaternion Kernels
por: Yang, Yuming, et al.
Publicado: (2025)
por: Yang, Yuming, et al.
Publicado: (2025)
Towards Harmless Multimodal Assistants with Blind Preference Optimization
por: Li, Yongqi, et al.
Publicado: (2025)
por: Li, Yongqi, et al.
Publicado: (2025)
Can Large Vision-Language Models Understand Multimodal Sarcasm?
por: Wang, Xinyu, et al.
Publicado: (2025)
por: Wang, Xinyu, et al.
Publicado: (2025)
Can Vision-Language Models Evaluate Handwritten Math?
por: Nath, Oikantik, et al.
Publicado: (2025)
por: Nath, Oikantik, et al.
Publicado: (2025)
Can Vision-Language Models Solve the Shell Game?
por: Liu, Tiedong, et al.
Publicado: (2026)
por: Liu, Tiedong, et al.
Publicado: (2026)
Tinted Frames: Question Framing Blinds Vision-Language Models
por: Fan, Wan-Cyuan, et al.
Publicado: (2026)
por: Fan, Wan-Cyuan, et al.
Publicado: (2026)
ColorConceptBench: A Benchmark for Probabilistic Color-Concept Understanding in Text-to-Image Models
por: Ruan, Chenxi, et al.
Publicado: (2026)
por: Ruan, Chenxi, et al.
Publicado: (2026)
ColorBench: Can VLMs See and Understand the Colorful World? A Comprehensive Benchmark for Color Perception, Reasoning, and Robustness
por: Liang, Yijun, et al.
Publicado: (2025)
por: Liang, Yijun, et al.
Publicado: (2025)
ColorSwap: A Color and Word Order Dataset for Multimodal Evaluation
por: Burapacheep, Jirayu, et al.
Publicado: (2024)
por: Burapacheep, Jirayu, et al.
Publicado: (2024)
Scalable Vision Language Model Training via High Quality Data Curation
por: Dong, Hongyuan, et al.
Publicado: (2025)
por: Dong, Hongyuan, et al.
Publicado: (2025)
Fine-Grained Verifiers: Preference Modeling as Next-token Prediction in Vision-Language Alignment
por: Cui, Chenhang, et al.
Publicado: (2024)
por: Cui, Chenhang, et al.
Publicado: (2024)
A Pilot Study on Curator-Guided Multilingual Art Description for Blind and Low-Vision Audiences with Small Vision-Language Models
por: Tsangko, Iosif, et al.
Publicado: (2026)
por: Tsangko, Iosif, et al.
Publicado: (2026)
Can We Predict Performance of Large Models across Vision-Language Tasks?
por: Zhao, Qinyu, et al.
Publicado: (2024)
por: Zhao, Qinyu, et al.
Publicado: (2024)
Historical Test-time Prompt Tuning for Vision Foundation Models
por: Zhang, Jingyi, et al.
Publicado: (2024)
por: Zhang, Jingyi, et al.
Publicado: (2024)
Vision-centric Token Compression in Large Language Model
por: Xing, Ling, et al.
Publicado: (2025)
por: Xing, Ling, et al.
Publicado: (2025)
CAST: Cross-modal Alignment Similarity Test for Vision Language Models
por: Dagan, Gautier, et al.
Publicado: (2024)
por: Dagan, Gautier, et al.
Publicado: (2024)
Seeing Clearly, Reasoning Confidently: Plug-and-Play Remedies for Vision Language Model Blindness
por: Hu, Xin, et al.
Publicado: (2026)
por: Hu, Xin, et al.
Publicado: (2026)
Can Vision Language Models Learn from Visual Demonstrations of Ambiguous Spatial Reasoning?
por: Zhao, Bowen, et al.
Publicado: (2024)
por: Zhao, Bowen, et al.
Publicado: (2024)
Color Names in Vision-Language Models
por: Gomez-Villa, Alexandra, et al.
Publicado: (2025)
por: Gomez-Villa, Alexandra, et al.
Publicado: (2025)
Building Reasonable Inference for Vision-Language Models in Blind Image Quality Assessment
por: Li, Yuan, et al.
Publicado: (2025)
por: Li, Yuan, et al.
Publicado: (2025)
SharpZO: Hybrid Sharpness-Aware Vision Language Model Prompt Tuning via Forward-Only Passes
por: Yang, Yifan, et al.
Publicado: (2025)
por: Yang, Yifan, et al.
Publicado: (2025)
DVLTA-VQA: Decoupled Vision-Language Modeling with Text-Guided Adaptation for Blind Video Quality Assessment
por: Yu, Li, et al.
Publicado: (2025)
por: Yu, Li, et al.
Publicado: (2025)
PROGRESSLM: Towards Progress Reasoning in Vision-Language Models
por: Zhang, Jianshu, et al.
Publicado: (2026)
por: Zhang, Jianshu, et al.
Publicado: (2026)
ChartMuseum: Testing Visual Reasoning Capabilities of Large Vision-Language Models
por: Tang, Liyan, et al.
Publicado: (2025)
por: Tang, Liyan, et al.
Publicado: (2025)
EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents
por: Cheng, Zhili, et al.
Publicado: (2025)
por: Cheng, Zhili, et al.
Publicado: (2025)
Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning?
por: Laskar, Md Tahmid Rahman, et al.
Publicado: (2025)
por: Laskar, Md Tahmid Rahman, et al.
Publicado: (2025)
ViSpec: Accelerating Vision-Language Models with Vision-Aware Speculative Decoding
por: Kang, Jialiang, et al.
Publicado: (2025)
por: Kang, Jialiang, et al.
Publicado: (2025)
Chain-of-Thought Compression Should Not Be Blind: V-Skip for Efficient Multimodal Reasoning via Dual-Path Anchoring
por: Zhang, Dongxu, et al.
Publicado: (2026)
por: Zhang, Dongxu, et al.
Publicado: (2026)
LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models
por: Zhang, Kaichen, et al.
Publicado: (2024)
por: Zhang, Kaichen, et al.
Publicado: (2024)
Ejemplares similares
-
ColorFoil: Investigating Color Blindness in Large Vision and Language Models
por: Samin, Ahnaf Mozib, et al.
Publicado: (2024) -
Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models
por: Khan, Mohammed Safi Ur Rahman, et al.
Publicado: (2026) -
Towards Blind and Low-Vision Accessibility of Lightweight VLMs and Custom LLM-Evals
por: Baghel, Shruti Singh, et al.
Publicado: (2025) -
Arbitration Failure, Not Perceptual Blindness: How Vision-Language Models Resolve Visual-Linguistic Conflicts
por: Nooralahzadeh, Farhad, et al.
Publicado: (2026) -
Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking
por: Li, Jingru, et al.
Publicado: (2026)