ColorBlindnessEval: Can Vision-Language Models Pass Color Blindness Tests?
Fuente:
arXiv
Salvato in:
| Autori principali: | Ling, Zijian, Zhang, Han, Zhou, Yazhuo, Cui, Jiahao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ColorFoil: Investigating Color Blindness in Large Vision and Language Models
di: Samin, Ahnaf Mozib, et al.
Pubblicazione: (2024)
di: Samin, Ahnaf Mozib, et al.
Pubblicazione: (2024)
Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models
di: Khan, Mohammed Safi Ur Rahman, et al.
Pubblicazione: (2026)
di: Khan, Mohammed Safi Ur Rahman, et al.
Pubblicazione: (2026)
Towards Blind and Low-Vision Accessibility of Lightweight VLMs and Custom LLM-Evals
di: Baghel, Shruti Singh, et al.
Pubblicazione: (2025)
di: Baghel, Shruti Singh, et al.
Pubblicazione: (2025)
Arbitration Failure, Not Perceptual Blindness: How Vision-Language Models Resolve Visual-Linguistic Conflicts
di: Nooralahzadeh, Farhad, et al.
Pubblicazione: (2026)
di: Nooralahzadeh, Farhad, et al.
Pubblicazione: (2026)
Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking
di: Li, Jingru, et al.
Pubblicazione: (2026)
di: Li, Jingru, et al.
Pubblicazione: (2026)
NPHardEval4V: Dynamic Evaluation of Large Vision-Language Models with Effects of Vision
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
Are VLMs Really Blind
di: Singh, Ayush, et al.
Pubblicazione: (2024)
di: Singh, Ayush, et al.
Pubblicazione: (2024)
Diagnosing Vision Language Models' Perception by Leveraging Human Methods for Color Vision Deficiencies
di: Hayashi, Kazuki, et al.
Pubblicazione: (2025)
di: Hayashi, Kazuki, et al.
Pubblicazione: (2025)
Long-Form Answers to Visual Questions from Blind and Low Vision People
di: Huh, Mina, et al.
Pubblicazione: (2024)
di: Huh, Mina, et al.
Pubblicazione: (2024)
Words or Vision: Do Vision-Language Models Have Blind Faith in Text?
di: Deng, Ailin, et al.
Pubblicazione: (2025)
di: Deng, Ailin, et al.
Pubblicazione: (2025)
Forgotten Polygons: Multimodal Large Language Models are Shape-Blind
di: Rudman, William, et al.
Pubblicazione: (2025)
di: Rudman, William, et al.
Pubblicazione: (2025)
Blind Deconvolution for Color Images Using Normalized Quaternion Kernels
di: Yang, Yuming, et al.
Pubblicazione: (2025)
di: Yang, Yuming, et al.
Pubblicazione: (2025)
Towards Harmless Multimodal Assistants with Blind Preference Optimization
di: Li, Yongqi, et al.
Pubblicazione: (2025)
di: Li, Yongqi, et al.
Pubblicazione: (2025)
Can Large Vision-Language Models Understand Multimodal Sarcasm?
di: Wang, Xinyu, et al.
Pubblicazione: (2025)
di: Wang, Xinyu, et al.
Pubblicazione: (2025)
Can Vision-Language Models Evaluate Handwritten Math?
di: Nath, Oikantik, et al.
Pubblicazione: (2025)
di: Nath, Oikantik, et al.
Pubblicazione: (2025)
Can Vision-Language Models Solve the Shell Game?
di: Liu, Tiedong, et al.
Pubblicazione: (2026)
di: Liu, Tiedong, et al.
Pubblicazione: (2026)
Tinted Frames: Question Framing Blinds Vision-Language Models
di: Fan, Wan-Cyuan, et al.
Pubblicazione: (2026)
di: Fan, Wan-Cyuan, et al.
Pubblicazione: (2026)
ColorConceptBench: A Benchmark for Probabilistic Color-Concept Understanding in Text-to-Image Models
di: Ruan, Chenxi, et al.
Pubblicazione: (2026)
di: Ruan, Chenxi, et al.
Pubblicazione: (2026)
ColorBench: Can VLMs See and Understand the Colorful World? A Comprehensive Benchmark for Color Perception, Reasoning, and Robustness
di: Liang, Yijun, et al.
Pubblicazione: (2025)
di: Liang, Yijun, et al.
Pubblicazione: (2025)
ColorSwap: A Color and Word Order Dataset for Multimodal Evaluation
di: Burapacheep, Jirayu, et al.
Pubblicazione: (2024)
di: Burapacheep, Jirayu, et al.
Pubblicazione: (2024)
Scalable Vision Language Model Training via High Quality Data Curation
di: Dong, Hongyuan, et al.
Pubblicazione: (2025)
di: Dong, Hongyuan, et al.
Pubblicazione: (2025)
Fine-Grained Verifiers: Preference Modeling as Next-token Prediction in Vision-Language Alignment
di: Cui, Chenhang, et al.
Pubblicazione: (2024)
di: Cui, Chenhang, et al.
Pubblicazione: (2024)
A Pilot Study on Curator-Guided Multilingual Art Description for Blind and Low-Vision Audiences with Small Vision-Language Models
di: Tsangko, Iosif, et al.
Pubblicazione: (2026)
di: Tsangko, Iosif, et al.
Pubblicazione: (2026)
Can We Predict Performance of Large Models across Vision-Language Tasks?
di: Zhao, Qinyu, et al.
Pubblicazione: (2024)
di: Zhao, Qinyu, et al.
Pubblicazione: (2024)
Historical Test-time Prompt Tuning for Vision Foundation Models
di: Zhang, Jingyi, et al.
Pubblicazione: (2024)
di: Zhang, Jingyi, et al.
Pubblicazione: (2024)
Vision-centric Token Compression in Large Language Model
di: Xing, Ling, et al.
Pubblicazione: (2025)
di: Xing, Ling, et al.
Pubblicazione: (2025)
CAST: Cross-modal Alignment Similarity Test for Vision Language Models
di: Dagan, Gautier, et al.
Pubblicazione: (2024)
di: Dagan, Gautier, et al.
Pubblicazione: (2024)
Seeing Clearly, Reasoning Confidently: Plug-and-Play Remedies for Vision Language Model Blindness
di: Hu, Xin, et al.
Pubblicazione: (2026)
di: Hu, Xin, et al.
Pubblicazione: (2026)
Can Vision Language Models Learn from Visual Demonstrations of Ambiguous Spatial Reasoning?
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
Color Names in Vision-Language Models
di: Gomez-Villa, Alexandra, et al.
Pubblicazione: (2025)
di: Gomez-Villa, Alexandra, et al.
Pubblicazione: (2025)
Building Reasonable Inference for Vision-Language Models in Blind Image Quality Assessment
di: Li, Yuan, et al.
Pubblicazione: (2025)
di: Li, Yuan, et al.
Pubblicazione: (2025)
SharpZO: Hybrid Sharpness-Aware Vision Language Model Prompt Tuning via Forward-Only Passes
di: Yang, Yifan, et al.
Pubblicazione: (2025)
di: Yang, Yifan, et al.
Pubblicazione: (2025)
DVLTA-VQA: Decoupled Vision-Language Modeling with Text-Guided Adaptation for Blind Video Quality Assessment
di: Yu, Li, et al.
Pubblicazione: (2025)
di: Yu, Li, et al.
Pubblicazione: (2025)
PROGRESSLM: Towards Progress Reasoning in Vision-Language Models
di: Zhang, Jianshu, et al.
Pubblicazione: (2026)
di: Zhang, Jianshu, et al.
Pubblicazione: (2026)
ChartMuseum: Testing Visual Reasoning Capabilities of Large Vision-Language Models
di: Tang, Liyan, et al.
Pubblicazione: (2025)
di: Tang, Liyan, et al.
Pubblicazione: (2025)
EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents
di: Cheng, Zhili, et al.
Pubblicazione: (2025)
di: Cheng, Zhili, et al.
Pubblicazione: (2025)
Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning?
di: Laskar, Md Tahmid Rahman, et al.
Pubblicazione: (2025)
di: Laskar, Md Tahmid Rahman, et al.
Pubblicazione: (2025)
ViSpec: Accelerating Vision-Language Models with Vision-Aware Speculative Decoding
di: Kang, Jialiang, et al.
Pubblicazione: (2025)
di: Kang, Jialiang, et al.
Pubblicazione: (2025)
Chain-of-Thought Compression Should Not Be Blind: V-Skip for Efficient Multimodal Reasoning via Dual-Path Anchoring
di: Zhang, Dongxu, et al.
Pubblicazione: (2026)
di: Zhang, Dongxu, et al.
Pubblicazione: (2026)
LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models
di: Zhang, Kaichen, et al.
Pubblicazione: (2024)
di: Zhang, Kaichen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ColorFoil: Investigating Color Blindness in Large Vision and Language Models
di: Samin, Ahnaf Mozib, et al.
Pubblicazione: (2024) -
Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models
di: Khan, Mohammed Safi Ur Rahman, et al.
Pubblicazione: (2026) -
Towards Blind and Low-Vision Accessibility of Lightweight VLMs and Custom LLM-Evals
di: Baghel, Shruti Singh, et al.
Pubblicazione: (2025) -
Arbitration Failure, Not Perceptual Blindness: How Vision-Language Models Resolve Visual-Linguistic Conflicts
di: Nooralahzadeh, Farhad, et al.
Pubblicazione: (2026) -
Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking
di: Li, Jingru, et al.
Pubblicazione: (2026)