How Reasoning Influences Intersectional Biases in Vision Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Desai, Adit, Roy, Sudipta, Chakraborty, Mohna |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MuGa-VTON: Multi-Garment Virtual Try-On via Diffusion Transformers with Prompt Customization
di: Deria, Ankan, et al.
Pubblicazione: (2025)
di: Deria, Ankan, et al.
Pubblicazione: (2025)
SocialCounterfactuals: Probing and Mitigating Intersectional Social Biases in Vision-Language Models with Counterfactual Examples
di: Howard, Phillip, et al.
Pubblicazione: (2023)
di: Howard, Phillip, et al.
Pubblicazione: (2023)
Vision Language Models are Biased
di: Vo, An, et al.
Pubblicazione: (2025)
di: Vo, An, et al.
Pubblicazione: (2025)
Slide-Level Prompt Learning with Vision Language Models for Few-Shot Multiple Instance Learning in Histopathology
di: Tomar, Devavrat, et al.
Pubblicazione: (2025)
di: Tomar, Devavrat, et al.
Pubblicazione: (2025)
Mitigate One, Skew Another? Tackling Intersectional Biases in Text-to-Image Models
di: Shukla, Pushkar, et al.
Pubblicazione: (2025)
di: Shukla, Pushkar, et al.
Pubblicazione: (2025)
Reasoning Riddles: How Explainability Reveals Cognitive Limits in Vision-Language Models
di: Movva, Prahitha
Pubblicazione: (2025)
di: Movva, Prahitha
Pubblicazione: (2025)
Instruction-Evidence Contrastive Dual-Stream Decoding for Grounded Vision-Language Reasoning
di: Bangde, Yashwant Pravinrao, et al.
Pubblicazione: (2026)
di: Bangde, Yashwant Pravinrao, et al.
Pubblicazione: (2026)
Agro-Consensus: Semantic Self-Consistency in Vision-Language Models for Crop Disease Management in Developing Countries
di: Gupta, Mihir, et al.
Pubblicazione: (2025)
di: Gupta, Mihir, et al.
Pubblicazione: (2025)
Cultural Counterfactuals: Evaluating Cultural Biases in Large Vision-Language Models with Counterfactual Examples
di: Howard, Phillip, et al.
Pubblicazione: (2026)
di: Howard, Phillip, et al.
Pubblicazione: (2026)
IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding
di: Zhu, Lanyun, et al.
Pubblicazione: (2024)
di: Zhu, Lanyun, et al.
Pubblicazione: (2024)
VisBias: Measuring Explicit and Implicit Social Biases in Vision Language Models
di: Huang, Jen-tse, et al.
Pubblicazione: (2025)
di: Huang, Jen-tse, et al.
Pubblicazione: (2025)
TRoVe: Discovering Error-Inducing Static Feature Biases in Temporal Vision-Language Models
di: Varma, Maya, et al.
Pubblicazione: (2025)
di: Varma, Maya, et al.
Pubblicazione: (2025)
Consistency-guided Prompt Learning for Vision-Language Models
di: Roy, Shuvendu, et al.
Pubblicazione: (2023)
di: Roy, Shuvendu, et al.
Pubblicazione: (2023)
Self-Consistency in Vision-Language Models for Precision Agriculture: Multi-Response Consensus for Crop Disease Management
di: Gupta, Mihir, et al.
Pubblicazione: (2025)
di: Gupta, Mihir, et al.
Pubblicazione: (2025)
Intersectional Fairness in Vision-Language Models for Medical Image Disease Classification
di: Zhang, Yupeng, et al.
Pubblicazione: (2025)
di: Zhang, Yupeng, et al.
Pubblicazione: (2025)
BiasICL: In-Context Learning and Demographic Biases of Vision Language Models
di: Xu, Sonnet, et al.
Pubblicazione: (2025)
di: Xu, Sonnet, et al.
Pubblicazione: (2025)
To Agree or To Be Right? The Grounding-Sycophancy Tradeoff in Medical Vision-Language Models
di: Aranya, OFM Riaz Rahman, et al.
Pubblicazione: (2026)
di: Aranya, OFM Riaz Rahman, et al.
Pubblicazione: (2026)
A Survey on Data Curation for Visual Contrastive Learning: Why Crafting Effective Positive and Negative Pairs Matters
di: Desai, Shasvat, et al.
Pubblicazione: (2025)
di: Desai, Shasvat, et al.
Pubblicazione: (2025)
Linear Mechanisms for Spatiotemporal Reasoning in Vision Language Models
di: Kang, Raphi, et al.
Pubblicazione: (2026)
di: Kang, Raphi, et al.
Pubblicazione: (2026)
Identifying Implicit Social Biases in Vision-Language Models
di: Hamidieh, Kimia, et al.
Pubblicazione: (2024)
di: Hamidieh, Kimia, et al.
Pubblicazione: (2024)
What Are We Measuring When We Evaluate Large Vision-Language Models? An Analysis of Latent Factors and Biases
di: Tiong, Anthony Meng Huat, et al.
Pubblicazione: (2024)
di: Tiong, Anthony Meng Huat, et al.
Pubblicazione: (2024)
LINGUAL: Language-INtegrated GUidance in Active Learning for Medical Image Segmentation
di: Islam, Md Shazid, et al.
Pubblicazione: (2025)
di: Islam, Md Shazid, et al.
Pubblicazione: (2025)
How Does Vision-Language Adaptation Impact the Safety of Vision Language Models?
di: Lee, Seongyun, et al.
Pubblicazione: (2024)
di: Lee, Seongyun, et al.
Pubblicazione: (2024)
Systemic Biases in Sign Language AI Research: A Deaf-Led Call to Reevaluate Research Agendas
di: Desai, Aashaka, et al.
Pubblicazione: (2024)
di: Desai, Aashaka, et al.
Pubblicazione: (2024)
Text Speaks Louder than Vision: ASCII Art Reveals Textual Biases in Vision-Language Models
di: Wang, Zhaochen, et al.
Pubblicazione: (2025)
di: Wang, Zhaochen, et al.
Pubblicazione: (2025)
PathoHR: Hierarchical Reasoning for Vision-Language Models in Pathology
di: Huang, Yating, et al.
Pubblicazione: (2025)
di: Huang, Yating, et al.
Pubblicazione: (2025)
Vlaser: Vision-Language-Action Model with Synergistic Embodied Reasoning
di: Yang, Ganlin, et al.
Pubblicazione: (2025)
di: Yang, Ganlin, et al.
Pubblicazione: (2025)
Synthetic Vasculature and Pathology Enhance Vision-Language Model Reasoning
di: Li, Chenjun, et al.
Pubblicazione: (2025)
di: Li, Chenjun, et al.
Pubblicazione: (2025)
Self-Rewarding Vision-Language Model via Reasoning Decomposition
di: Li, Zongxia, et al.
Pubblicazione: (2025)
di: Li, Zongxia, et al.
Pubblicazione: (2025)
De-rendering, Reasoning, and Repairing Charts with Vision-Language Models
di: Bonas, Valentin, et al.
Pubblicazione: (2026)
di: Bonas, Valentin, et al.
Pubblicazione: (2026)
SpatialRGPT: Grounded Spatial Reasoning in Vision Language Models
di: Cheng, An-Chieh, et al.
Pubblicazione: (2024)
di: Cheng, An-Chieh, et al.
Pubblicazione: (2024)
Self-Consistent Latent Reasoning: Long Latent Sequence Reasoning for Vision-Language Model
di: Wang, Chenfeng, et al.
Pubblicazione: (2026)
di: Wang, Chenfeng, et al.
Pubblicazione: (2026)
A Survey on Efficient Vision-Language Models
di: Shinde, Gaurav, et al.
Pubblicazione: (2025)
di: Shinde, Gaurav, et al.
Pubblicazione: (2025)
Boosting Transferability in Vision-Language Attacks via Diversification along the Intersection Region of Adversarial Trajectory
di: Gao, Sensen, et al.
Pubblicazione: (2024)
di: Gao, Sensen, et al.
Pubblicazione: (2024)
Benchmarking Vision, Language, & Action Models in Procedurally Generated, Open Ended Action Environments
di: Guruprasad, Pranav, et al.
Pubblicazione: (2025)
di: Guruprasad, Pranav, et al.
Pubblicazione: (2025)
SelfPrompt: Confidence-Aware Semi-Supervised Tuning for Robust Vision-Language Model Adaptation
di: Roy, Shuvendu, et al.
Pubblicazione: (2025)
di: Roy, Shuvendu, et al.
Pubblicazione: (2025)
Vision-Language Memory for Spatial Reasoning
di: Liu, Zuntao, et al.
Pubblicazione: (2025)
di: Liu, Zuntao, et al.
Pubblicazione: (2025)
FPBench: A Comprehensive Benchmark of Multimodal Large Language Models for Fingerprint Analysis
di: Gavas, Ekta, et al.
Pubblicazione: (2025)
di: Gavas, Ekta, et al.
Pubblicazione: (2025)
SDGBiasBench: Benchmarking and Mitigating Vision--Language Models' Biases in Sustainable Development Goals
di: Lin, Zihang, et al.
Pubblicazione: (2026)
di: Lin, Zihang, et al.
Pubblicazione: (2026)
SPARK: Multi-Vision Sensor Perception and Reasoning Benchmark for Large-scale Vision-Language Models
di: Yu, Youngjoon, et al.
Pubblicazione: (2024)
di: Yu, Youngjoon, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MuGa-VTON: Multi-Garment Virtual Try-On via Diffusion Transformers with Prompt Customization
di: Deria, Ankan, et al.
Pubblicazione: (2025) -
SocialCounterfactuals: Probing and Mitigating Intersectional Social Biases in Vision-Language Models with Counterfactual Examples
di: Howard, Phillip, et al.
Pubblicazione: (2023) -
Vision Language Models are Biased
di: Vo, An, et al.
Pubblicazione: (2025) -
Slide-Level Prompt Learning with Vision Language Models for Few-Shot Multiple Instance Learning in Histopathology
di: Tomar, Devavrat, et al.
Pubblicazione: (2025) -
Mitigate One, Skew Another? Tackling Intersectional Biases in Text-to-Image Models
di: Shukla, Pushkar, et al.
Pubblicazione: (2025)