ColorBlindnessEval: Can Vision-Language Models Pass Color Blindness Tests?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ling, Zijian, Zhang, Han, Zhou, Yazhuo, Cui, Jiahao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ColorFoil: Investigating Color Blindness in Large Vision and Language Models
par: Samin, Ahnaf Mozib, et autres
Publié: (2024)
par: Samin, Ahnaf Mozib, et autres
Publié: (2024)
Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models
par: Khan, Mohammed Safi Ur Rahman, et autres
Publié: (2026)
par: Khan, Mohammed Safi Ur Rahman, et autres
Publié: (2026)
Towards Blind and Low-Vision Accessibility of Lightweight VLMs and Custom LLM-Evals
par: Baghel, Shruti Singh, et autres
Publié: (2025)
par: Baghel, Shruti Singh, et autres
Publié: (2025)
Arbitration Failure, Not Perceptual Blindness: How Vision-Language Models Resolve Visual-Linguistic Conflicts
par: Nooralahzadeh, Farhad, et autres
Publié: (2026)
par: Nooralahzadeh, Farhad, et autres
Publié: (2026)
Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking
par: Li, Jingru, et autres
Publié: (2026)
par: Li, Jingru, et autres
Publié: (2026)
NPHardEval4V: Dynamic Evaluation of Large Vision-Language Models with Effects of Vision
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Are VLMs Really Blind
par: Singh, Ayush, et autres
Publié: (2024)
par: Singh, Ayush, et autres
Publié: (2024)
Diagnosing Vision Language Models' Perception by Leveraging Human Methods for Color Vision Deficiencies
par: Hayashi, Kazuki, et autres
Publié: (2025)
par: Hayashi, Kazuki, et autres
Publié: (2025)
Long-Form Answers to Visual Questions from Blind and Low Vision People
par: Huh, Mina, et autres
Publié: (2024)
par: Huh, Mina, et autres
Publié: (2024)
Words or Vision: Do Vision-Language Models Have Blind Faith in Text?
par: Deng, Ailin, et autres
Publié: (2025)
par: Deng, Ailin, et autres
Publié: (2025)
Forgotten Polygons: Multimodal Large Language Models are Shape-Blind
par: Rudman, William, et autres
Publié: (2025)
par: Rudman, William, et autres
Publié: (2025)
Blind Deconvolution for Color Images Using Normalized Quaternion Kernels
par: Yang, Yuming, et autres
Publié: (2025)
par: Yang, Yuming, et autres
Publié: (2025)
Towards Harmless Multimodal Assistants with Blind Preference Optimization
par: Li, Yongqi, et autres
Publié: (2025)
par: Li, Yongqi, et autres
Publié: (2025)
Can Large Vision-Language Models Understand Multimodal Sarcasm?
par: Wang, Xinyu, et autres
Publié: (2025)
par: Wang, Xinyu, et autres
Publié: (2025)
Can Vision-Language Models Evaluate Handwritten Math?
par: Nath, Oikantik, et autres
Publié: (2025)
par: Nath, Oikantik, et autres
Publié: (2025)
Can Vision-Language Models Solve the Shell Game?
par: Liu, Tiedong, et autres
Publié: (2026)
par: Liu, Tiedong, et autres
Publié: (2026)
Tinted Frames: Question Framing Blinds Vision-Language Models
par: Fan, Wan-Cyuan, et autres
Publié: (2026)
par: Fan, Wan-Cyuan, et autres
Publié: (2026)
ColorConceptBench: A Benchmark for Probabilistic Color-Concept Understanding in Text-to-Image Models
par: Ruan, Chenxi, et autres
Publié: (2026)
par: Ruan, Chenxi, et autres
Publié: (2026)
ColorBench: Can VLMs See and Understand the Colorful World? A Comprehensive Benchmark for Color Perception, Reasoning, and Robustness
par: Liang, Yijun, et autres
Publié: (2025)
par: Liang, Yijun, et autres
Publié: (2025)
ColorSwap: A Color and Word Order Dataset for Multimodal Evaluation
par: Burapacheep, Jirayu, et autres
Publié: (2024)
par: Burapacheep, Jirayu, et autres
Publié: (2024)
Scalable Vision Language Model Training via High Quality Data Curation
par: Dong, Hongyuan, et autres
Publié: (2025)
par: Dong, Hongyuan, et autres
Publié: (2025)
Fine-Grained Verifiers: Preference Modeling as Next-token Prediction in Vision-Language Alignment
par: Cui, Chenhang, et autres
Publié: (2024)
par: Cui, Chenhang, et autres
Publié: (2024)
A Pilot Study on Curator-Guided Multilingual Art Description for Blind and Low-Vision Audiences with Small Vision-Language Models
par: Tsangko, Iosif, et autres
Publié: (2026)
par: Tsangko, Iosif, et autres
Publié: (2026)
Can We Predict Performance of Large Models across Vision-Language Tasks?
par: Zhao, Qinyu, et autres
Publié: (2024)
par: Zhao, Qinyu, et autres
Publié: (2024)
Historical Test-time Prompt Tuning for Vision Foundation Models
par: Zhang, Jingyi, et autres
Publié: (2024)
par: Zhang, Jingyi, et autres
Publié: (2024)
Vision-centric Token Compression in Large Language Model
par: Xing, Ling, et autres
Publié: (2025)
par: Xing, Ling, et autres
Publié: (2025)
CAST: Cross-modal Alignment Similarity Test for Vision Language Models
par: Dagan, Gautier, et autres
Publié: (2024)
par: Dagan, Gautier, et autres
Publié: (2024)
Seeing Clearly, Reasoning Confidently: Plug-and-Play Remedies for Vision Language Model Blindness
par: Hu, Xin, et autres
Publié: (2026)
par: Hu, Xin, et autres
Publié: (2026)
Can Vision Language Models Learn from Visual Demonstrations of Ambiguous Spatial Reasoning?
par: Zhao, Bowen, et autres
Publié: (2024)
par: Zhao, Bowen, et autres
Publié: (2024)
Color Names in Vision-Language Models
par: Gomez-Villa, Alexandra, et autres
Publié: (2025)
par: Gomez-Villa, Alexandra, et autres
Publié: (2025)
Building Reasonable Inference for Vision-Language Models in Blind Image Quality Assessment
par: Li, Yuan, et autres
Publié: (2025)
par: Li, Yuan, et autres
Publié: (2025)
SharpZO: Hybrid Sharpness-Aware Vision Language Model Prompt Tuning via Forward-Only Passes
par: Yang, Yifan, et autres
Publié: (2025)
par: Yang, Yifan, et autres
Publié: (2025)
DVLTA-VQA: Decoupled Vision-Language Modeling with Text-Guided Adaptation for Blind Video Quality Assessment
par: Yu, Li, et autres
Publié: (2025)
par: Yu, Li, et autres
Publié: (2025)
PROGRESSLM: Towards Progress Reasoning in Vision-Language Models
par: Zhang, Jianshu, et autres
Publié: (2026)
par: Zhang, Jianshu, et autres
Publié: (2026)
ChartMuseum: Testing Visual Reasoning Capabilities of Large Vision-Language Models
par: Tang, Liyan, et autres
Publié: (2025)
par: Tang, Liyan, et autres
Publié: (2025)
EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents
par: Cheng, Zhili, et autres
Publié: (2025)
par: Cheng, Zhili, et autres
Publié: (2025)
Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning?
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2025)
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2025)
ViSpec: Accelerating Vision-Language Models with Vision-Aware Speculative Decoding
par: Kang, Jialiang, et autres
Publié: (2025)
par: Kang, Jialiang, et autres
Publié: (2025)
Chain-of-Thought Compression Should Not Be Blind: V-Skip for Efficient Multimodal Reasoning via Dual-Path Anchoring
par: Zhang, Dongxu, et autres
Publié: (2026)
par: Zhang, Dongxu, et autres
Publié: (2026)
LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models
par: Zhang, Kaichen, et autres
Publié: (2024)
par: Zhang, Kaichen, et autres
Publié: (2024)
Documents similaires
-
ColorFoil: Investigating Color Blindness in Large Vision and Language Models
par: Samin, Ahnaf Mozib, et autres
Publié: (2024) -
Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models
par: Khan, Mohammed Safi Ur Rahman, et autres
Publié: (2026) -
Towards Blind and Low-Vision Accessibility of Lightweight VLMs and Custom LLM-Evals
par: Baghel, Shruti Singh, et autres
Publié: (2025) -
Arbitration Failure, Not Perceptual Blindness: How Vision-Language Models Resolve Visual-Linguistic Conflicts
par: Nooralahzadeh, Farhad, et autres
Publié: (2026) -
Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking
par: Li, Jingru, et autres
Publié: (2026)