Demographic and Linguistic Bias Evaluation in Omnimodal Language Models
Fuente:
arXiv
Salvato in:
| Autore principale: | Elobaid, Alaa |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scaling Language-Centric Omnimodal Representation Learning
di: Xiao, Chenghao, et al.
Pubblicazione: (2025)
di: Xiao, Chenghao, et al.
Pubblicazione: (2025)
Sum of Group Error Differences: A Critical Examination of Bias Evaluation in Biometric Verification and a Dual-Metric Measure
di: Elobaid, Alaa, et al.
Pubblicazione: (2024)
di: Elobaid, Alaa, et al.
Pubblicazione: (2024)
Uni-MoE-2.0-Omni: Scaling Language-Centric Omnimodal Large Model with Advanced MoE, Training and Data
di: Li, Yunxin, et al.
Pubblicazione: (2025)
di: Li, Yunxin, et al.
Pubblicazione: (2025)
NExT-OMNI: Towards Any-to-Any Omnimodal Foundation Models with Discrete Flow Matching
di: Luo, Run, et al.
Pubblicazione: (2025)
di: Luo, Run, et al.
Pubblicazione: (2025)
Locating Demographic Bias at the Attention-Head Level in CLIP's Vision Encoder
di: Yasser, Alaa, et al.
Pubblicazione: (2026)
di: Yasser, Alaa, et al.
Pubblicazione: (2026)
WorldSense: Evaluating Real-world Omnimodal Understanding for Multimodal LLMs
di: Hong, Jack, et al.
Pubblicazione: (2025)
di: Hong, Jack, et al.
Pubblicazione: (2025)
BiasICL: In-Context Learning and Demographic Biases of Vision Language Models
di: Xu, Sonnet, et al.
Pubblicazione: (2025)
di: Xu, Sonnet, et al.
Pubblicazione: (2025)
MELLA: Bridging Linguistic Capability and Cultural Groundedness for Low-Resource Language MLLMs
di: Gao, Yufei, et al.
Pubblicazione: (2025)
di: Gao, Yufei, et al.
Pubblicazione: (2025)
Unveiling the "Fairness Seesaw": Discovering and Mitigating Gender and Race Bias in Vision-Language Models
di: Lan, Jian, et al.
Pubblicazione: (2025)
di: Lan, Jian, et al.
Pubblicazione: (2025)
Measuring Social Bias in Vision-Language Models with Face-Only Counterfactuals from Real Photos
di: Chen, Haodong, et al.
Pubblicazione: (2026)
di: Chen, Haodong, et al.
Pubblicazione: (2026)
Multi-Modal Language Models as Text-to-Image Model Evaluators
di: Chen, Jiahui, et al.
Pubblicazione: (2025)
di: Chen, Jiahui, et al.
Pubblicazione: (2025)
MM-JudgeBias: A Benchmark for Evaluating Compositional Biases in MLLM-as-a-Judge
di: Lee, Sua, et al.
Pubblicazione: (2026)
di: Lee, Sua, et al.
Pubblicazione: (2026)
VLURes: Benchmarking VLM Visual and Linguistic Understanding in Low-Resource Languages
di: Atuhurra, Jesse, et al.
Pubblicazione: (2025)
di: Atuhurra, Jesse, et al.
Pubblicazione: (2025)
A Survey on Evaluation of Multimodal Large Language Models
di: Huang, Jiaxing, et al.
Pubblicazione: (2024)
di: Huang, Jiaxing, et al.
Pubblicazione: (2024)
Tone Matters: The Impact of Linguistic Tone on Hallucination in VLMs
di: Hong, Weihao, et al.
Pubblicazione: (2026)
di: Hong, Weihao, et al.
Pubblicazione: (2026)
Fairness Under Cover: Evaluating the Impact of Occlusions on Demographic Bias in Facial Recognition
di: Mamede, Rafael M., et al.
Pubblicazione: (2024)
di: Mamede, Rafael M., et al.
Pubblicazione: (2024)
See It from My Perspective: How Language Affects Cultural Bias in Image Understanding
di: Ananthram, Amith, et al.
Pubblicazione: (2024)
di: Ananthram, Amith, et al.
Pubblicazione: (2024)
HNC: Leveraging Hard Negative Captions towards Models with Fine-Grained Visual-Linguistic Comprehension Capabilities
di: Dönmez, Esra, et al.
Pubblicazione: (2026)
di: Dönmez, Esra, et al.
Pubblicazione: (2026)
Evaluating Large Language Models on Multimodal Chemistry Olympiad Exams
di: Cui, Yiming, et al.
Pubblicazione: (2025)
di: Cui, Yiming, et al.
Pubblicazione: (2025)
Do Vision-Language Models Have Internal World Models? Towards an Atomic Evaluation
di: Gao, Qiyue, et al.
Pubblicazione: (2025)
di: Gao, Qiyue, et al.
Pubblicazione: (2025)
Can Vision Language Models Judge Action Quality? An Empirical Evaluation
di: Freitas, Miguel Monte e, et al.
Pubblicazione: (2026)
di: Freitas, Miguel Monte e, et al.
Pubblicazione: (2026)
WildVision: Evaluating Vision-Language Models in the Wild with Human Preferences
di: Lu, Yujie, et al.
Pubblicazione: (2024)
di: Lu, Yujie, et al.
Pubblicazione: (2024)
KOFFVQA: An Objectively Evaluated Free-form VQA Benchmark for Large Vision-Language Models in the Korean Language
di: Kim, Yoonshik, et al.
Pubblicazione: (2025)
di: Kim, Yoonshik, et al.
Pubblicazione: (2025)
Med-UniC: Unifying Cross-Lingual Medical Vision-Language Pre-Training by Diminishing Bias
di: Wan, Zhongwei, et al.
Pubblicazione: (2023)
di: Wan, Zhongwei, et al.
Pubblicazione: (2023)
TangramPuzzle: Evaluating Multimodal Large Language Models with Compositional Spatial Reasoning
di: Liu, Daixian, et al.
Pubblicazione: (2026)
di: Liu, Daixian, et al.
Pubblicazione: (2026)
From Local Concepts to Universals: Evaluating the Multicultural Understanding of Vision-Language Models
di: Bhatia, Mehar, et al.
Pubblicazione: (2024)
di: Bhatia, Mehar, et al.
Pubblicazione: (2024)
RotBench: Evaluating Multimodal Large Language Models on Identifying Image Rotation
di: Niu, Tianyi, et al.
Pubblicazione: (2025)
di: Niu, Tianyi, et al.
Pubblicazione: (2025)
PCA-Bench: Evaluating Multimodal Large Language Models in Perception-Cognition-Action Chain
di: Chen, Liang, et al.
Pubblicazione: (2024)
di: Chen, Liang, et al.
Pubblicazione: (2024)
CAPTURe: Evaluating Spatial Reasoning in Vision Language Models via Occluded Object Counting
di: Pothiraj, Atin, et al.
Pubblicazione: (2025)
di: Pothiraj, Atin, et al.
Pubblicazione: (2025)
ViewSpatial-Bench: Evaluating Multi-perspective Spatial Localization in Vision-Language Models
di: Li, Dingming, et al.
Pubblicazione: (2025)
di: Li, Dingming, et al.
Pubblicazione: (2025)
Multi-modal, Multi-task, Multi-criteria Automatic Evaluation with Vision Language Models
di: Ohi, Masanari, et al.
Pubblicazione: (2024)
di: Ohi, Masanari, et al.
Pubblicazione: (2024)
A Cognitive Evaluation Benchmark of Image Reasoning and Description for Large Vision-Language Models
di: Song, Xiujie, et al.
Pubblicazione: (2024)
di: Song, Xiujie, et al.
Pubblicazione: (2024)
Preserving Multi-Modal Capabilities of Pre-trained VLMs for Improving Vision-Linguistic Compositionality
di: Oh, Youngtaek, et al.
Pubblicazione: (2024)
di: Oh, Youngtaek, et al.
Pubblicazione: (2024)
ChartInsights: Evaluating Multimodal Large Language Models for Low-Level Chart Question Answering
di: Wu, Yifan, et al.
Pubblicazione: (2024)
di: Wu, Yifan, et al.
Pubblicazione: (2024)
DemoBias: An Empirical Study to Trace Demographic Biases in Vision Foundation Models
di: Sufian, Abu, et al.
Pubblicazione: (2025)
di: Sufian, Abu, et al.
Pubblicazione: (2025)
CLiViS: Unleashing Cognitive Map through Linguistic-Visual Synergy for Embodied Visual Reasoning
di: Li, Kailing, et al.
Pubblicazione: (2025)
di: Li, Kailing, et al.
Pubblicazione: (2025)
CDH-Bench: A Commonsense-Driven Hallucination Benchmark for Evaluating Visual Fidelity in Vision-Language Models
di: Chen, Kesheng, et al.
Pubblicazione: (2026)
di: Chen, Kesheng, et al.
Pubblicazione: (2026)
DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models
di: Zou, Chengke, et al.
Pubblicazione: (2024)
di: Zou, Chengke, et al.
Pubblicazione: (2024)
ViGiL3D: A Linguistically Diverse Dataset for 3D Visual Grounding
di: Wang, Austin T., et al.
Pubblicazione: (2025)
di: Wang, Austin T., et al.
Pubblicazione: (2025)
Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture Assembly
di: Chetan, Aditya, et al.
Pubblicazione: (2026)
di: Chetan, Aditya, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Scaling Language-Centric Omnimodal Representation Learning
di: Xiao, Chenghao, et al.
Pubblicazione: (2025) -
Sum of Group Error Differences: A Critical Examination of Bias Evaluation in Biometric Verification and a Dual-Metric Measure
di: Elobaid, Alaa, et al.
Pubblicazione: (2024) -
Uni-MoE-2.0-Omni: Scaling Language-Centric Omnimodal Large Model with Advanced MoE, Training and Data
di: Li, Yunxin, et al.
Pubblicazione: (2025) -
NExT-OMNI: Towards Any-to-Any Omnimodal Foundation Models with Discrete Flow Matching
di: Luo, Run, et al.
Pubblicazione: (2025) -
Locating Demographic Bias at the Attention-Head Level in CLIP's Vision Encoder
di: Yasser, Alaa, et al.
Pubblicazione: (2026)