Edu-MMBias: A Three-Tier Multimodal Benchmark for Auditing Social Bias in Vision-Language Models under Educational Contexts
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Ruijia, Zhang, Mingzi, Yu, Zengyi, Wei, Yuang, Jiang, Bo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SleepWalk: A Three-Tier Benchmark for Stress-Testing Instruction-Guided Vision-Language Navigation
por: Rawal, Niyati, et al.
Publicado: (2026)
por: Rawal, Niyati, et al.
Publicado: (2026)
WisWheat: A Three-Tiered Vision-Language Dataset for Wheat Management
por: Yuan, Bowen, et al.
Publicado: (2025)
por: Yuan, Bowen, et al.
Publicado: (2025)
Zero-Shot Product Attribute Labeling with Vision-Language Models: A Three-Tier Evaluation Framework
por: Shukla, Shubham, et al.
Publicado: (2026)
por: Shukla, Shubham, et al.
Publicado: (2026)
Towards Multimodal In-Context Learning for Vision & Language Models
por: Doveh, Sivan, et al.
Publicado: (2024)
por: Doveh, Sivan, et al.
Publicado: (2024)
BiasICL: In-Context Learning and Demographic Biases of Vision Language Models
por: Xu, Sonnet, et al.
Publicado: (2025)
por: Xu, Sonnet, et al.
Publicado: (2025)
Histopathology Image Report Generation by Vision Language Model with Multimodal In-Context Learning
por: Liu, Shih-Wen, et al.
Publicado: (2025)
por: Liu, Shih-Wen, et al.
Publicado: (2025)
PhyEduVideo: A Benchmark for Evaluating Text-to-Video Models for Physics Education
por: M, Megha Mariam K., et al.
Publicado: (2026)
por: M, Megha Mariam K., et al.
Publicado: (2026)
Benchmarking and Mitigating MCQA Selection Bias of Large Vision-Language Models
por: Atabuzzaman, Md., et al.
Publicado: (2025)
por: Atabuzzaman, Md., et al.
Publicado: (2025)
Multimodal Fusion at Three Tiers: Physics-Driven Data Generation and Vision-Language Guidance for Brain Tumor Segmentation
por: Zhang, Mingda
Publicado: (2025)
por: Zhang, Mingda
Publicado: (2025)
RedDiffuser: Auditing Multimodal Safety Failures in Vision-Language Models via Reinforced Diffusion
por: Wang, Ruofan, et al.
Publicado: (2025)
por: Wang, Ruofan, et al.
Publicado: (2025)
debiaSAE: Benchmarking and Mitigating Vision-Language Model Bias
por: Sasse, Kuleen, et al.
Publicado: (2024)
por: Sasse, Kuleen, et al.
Publicado: (2024)
Benchmarking Vision-Language Models under Contradictory Virtual Content Attacks in Augmented Reality
por: Xiu, Yanming, et al.
Publicado: (2026)
por: Xiu, Yanming, et al.
Publicado: (2026)
Joint Vision-Language Social Bias Removal for CLIP
por: Zhang, Haoyu, et al.
Publicado: (2024)
por: Zhang, Haoyu, et al.
Publicado: (2024)
MEBench: A Novel Benchmark for Understanding Mutual Exclusivity Bias in Vision-Language Models
por: Thai, Anh, et al.
Publicado: (2025)
por: Thai, Anh, et al.
Publicado: (2025)
Measuring Social Bias in Vision-Language Models with Face-Only Counterfactuals from Real Photos
por: Chen, Haodong, et al.
Publicado: (2026)
por: Chen, Haodong, et al.
Publicado: (2026)
MoonAnything: A Vision Benchmark with Large-Scale Lunar Supervised Data
por: Grethen, Clémentine, et al.
Publicado: (2026)
por: Grethen, Clémentine, et al.
Publicado: (2026)
MMLongBench: Benchmarking Long-Context Vision-Language Models Effectively and Thoroughly
por: Wang, Zhaowei, et al.
Publicado: (2025)
por: Wang, Zhaowei, et al.
Publicado: (2025)
BLEnD-Vis: Benchmarking Multimodal Cultural Understanding in Vision Language Models
por: Tan, Bryan Chen Zhengyu, et al.
Publicado: (2025)
por: Tan, Bryan Chen Zhengyu, et al.
Publicado: (2025)
IndicFairFace: Balanced Indian Face Dataset for Auditing and Mitigating Geographical Bias in Vision-Language Models
por: Mohsin, Aarish Shah, et al.
Publicado: (2026)
por: Mohsin, Aarish Shah, et al.
Publicado: (2026)
LMOD: A Large Multimodal Ophthalmology Dataset and Benchmark for Large Vision-Language Models
por: Qin, Zhenyue, et al.
Publicado: (2024)
por: Qin, Zhenyue, et al.
Publicado: (2024)
Auditing Multimodal LLM Raters: Central Tendency Bias in Clinical Ordinal Scoring
por: Zhang, Jiaqing, et al.
Publicado: (2026)
por: Zhang, Jiaqing, et al.
Publicado: (2026)
Beyond Memorization: A Multi-Modal Ordinal Regression Benchmark to Expose Popularity Bias in Vision-Language Models
por: Szu-Tu, Li-Zhong, et al.
Publicado: (2025)
por: Szu-Tu, Li-Zhong, et al.
Publicado: (2025)
GenderBias-\emph{VL}: Benchmarking Gender Bias in Vision Language Models via Counterfactual Probing
por: Xiao, Yisong, et al.
Publicado: (2024)
por: Xiao, Yisong, et al.
Publicado: (2024)
MoVA: Adapting Mixture of Vision Experts to Multimodal Context
por: Zong, Zhuofan, et al.
Publicado: (2024)
por: Zong, Zhuofan, et al.
Publicado: (2024)
IDEATOR: Jailbreaking and Benchmarking Large Vision-Language Models Using Themselves
por: Wang, Ruofan, et al.
Publicado: (2024)
por: Wang, Ruofan, et al.
Publicado: (2024)
Pathological Truth Bias in Vision-Language Models
por: Thube, Yash
Publicado: (2025)
por: Thube, Yash
Publicado: (2025)
Benchmarking Robustness of Multimodal Image-Text Models under Distribution Shift
por: Qiu, Jielin, et al.
Publicado: (2022)
por: Qiu, Jielin, et al.
Publicado: (2022)
Revisiting Data Auditing in Large Vision-Language Models
por: Zhu, Hongyu, et al.
Publicado: (2025)
por: Zhu, Hongyu, et al.
Publicado: (2025)
Towards Responsible Multimodal Medical Reasoning via Context-Aligned Vision-Language Models
por: Khan, Sumra, et al.
Publicado: (2026)
por: Khan, Sumra, et al.
Publicado: (2026)
BBQ-V: Benchmarking Visual Stereotype Bias in Large Multimodal Models
por: Narnaware, Vishal, et al.
Publicado: (2025)
por: Narnaware, Vishal, et al.
Publicado: (2025)
Can Retrieval Heads See Images? Multimodal Retrieval Heads in Long-Context Vision-Language Models
por: Li, Aaron Branson Cigres, et al.
Publicado: (2026)
por: Li, Aaron Branson Cigres, et al.
Publicado: (2026)
VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model
por: Wang, Sibo, et al.
Publicado: (2024)
por: Wang, Sibo, et al.
Publicado: (2024)
The Aftermath of DrawEduMath: Vision Language Models Underperform with Struggling Students and Misdiagnose Errors
por: Lucy, Li, et al.
Publicado: (2026)
por: Lucy, Li, et al.
Publicado: (2026)
Beyond Standard Benchmarks: A Systematic Audit of Vision-Language Model's Robustness to Natural Semantic Variation Across Diverse Tasks
por: Chengyu, Jia, et al.
Publicado: (2026)
por: Chengyu, Jia, et al.
Publicado: (2026)
HSSBench: Benchmarking Humanities and Social Sciences Ability for Multimodal Large Language Models
por: Kang, Zhaolu, et al.
Publicado: (2025)
por: Kang, Zhaolu, et al.
Publicado: (2025)
DrawEduMath: Evaluating Vision Language Models with Expert-Annotated Students' Hand-Drawn Math Images
por: Baral, Sami, et al.
Publicado: (2025)
por: Baral, Sami, et al.
Publicado: (2025)
VisBias: Measuring Explicit and Implicit Social Biases in Vision Language Models
por: Huang, Jen-tse, et al.
Publicado: (2025)
por: Huang, Jen-tse, et al.
Publicado: (2025)
Compositional Kronecker Context Optimization for Vision-Language Models
por: Ding, Kun, et al.
Publicado: (2024)
por: Ding, Kun, et al.
Publicado: (2024)
MemLens: Benchmarking Multimodal Long-Term Memory in Large Vision-Language Models
por: Ren, Xiyu, et al.
Publicado: (2026)
por: Ren, Xiyu, et al.
Publicado: (2026)
Egocentric Bias in Vision-Language Models
por: Wang, Maijunxian, et al.
Publicado: (2026)
por: Wang, Maijunxian, et al.
Publicado: (2026)
Ejemplares similares
-
SleepWalk: A Three-Tier Benchmark for Stress-Testing Instruction-Guided Vision-Language Navigation
por: Rawal, Niyati, et al.
Publicado: (2026) -
WisWheat: A Three-Tiered Vision-Language Dataset for Wheat Management
por: Yuan, Bowen, et al.
Publicado: (2025) -
Zero-Shot Product Attribute Labeling with Vision-Language Models: A Three-Tier Evaluation Framework
por: Shukla, Shubham, et al.
Publicado: (2026) -
Towards Multimodal In-Context Learning for Vision & Language Models
por: Doveh, Sivan, et al.
Publicado: (2024) -
BiasICL: In-Context Learning and Demographic Biases of Vision Language Models
por: Xu, Sonnet, et al.
Publicado: (2025)