GABInsight: Exploring Gender-Activity Binding Bias in Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Abdollahi, Ali, Ghaznavi, Mahdi, Nejad, Mohammad Reza Karimi, Oriyad, Arash Mari, Abbasi, Reza, Salesi, Ali, Behjati, Melika, Rohban, Mohammad Hossein, Baghshah, Mahdieh Soleymani |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Deciphering the Role of Representation Disentanglement: Investigating Compositional Generalization in CLIP Models
par: Abbasi, Reza, et autres
Publié: (2024)
par: Abbasi, Reza, et autres
Publié: (2024)
Language Plays a Pivotal Role in the Object-Attribute Compositional Generalization of CLIP
par: Abbasi, Reza, et autres
Publié: (2024)
par: Abbasi, Reza, et autres
Publié: (2024)
The Silent Judge: Unacknowledged Shortcut Bias in LLM-as-a-Judge
par: Marioriyad, Arash, et autres
Publié: (2025)
par: Marioriyad, Arash, et autres
Publié: (2025)
Attention Overlap Is Responsible for The Entity Missing Problem in Text-to-image Diffusion Models!
par: Marioriyad, Arash, et autres
Publié: (2024)
par: Marioriyad, Arash, et autres
Publié: (2024)
Lying to Win: Assessing LLM Deception through Human-AI Games and Parallel-World Probing
par: Marioriyad, Arash, et autres
Publié: (2026)
par: Marioriyad, Arash, et autres
Publié: (2026)
Analyzing CLIP's Performance Limitations in Multi-Object Scenarios: A Controlled High-Resolution Study
par: Abbasi, Reza, et autres
Publié: (2025)
par: Abbasi, Reza, et autres
Publié: (2025)
CLIP Under the Microscope: A Fine-Grained Analysis of Multi-Object Representation
par: Abbasi, Reza, et autres
Publié: (2025)
par: Abbasi, Reza, et autres
Publié: (2025)
Why Settle for Mid: A Probabilistic Viewpoint to Spatial Relationship Alignment in Text-to-image Models
par: Rezaei, Parham, et autres
Publié: (2025)
par: Rezaei, Parham, et autres
Publié: (2025)
Diffusion Beats Autoregressive: An Evaluation of Compositional Generation in Text-to-Image Models
par: Marioriyad, Arash, et autres
Publié: (2024)
par: Marioriyad, Arash, et autres
Publié: (2024)
The Judge Who Never Admits: Hidden Shortcuts in LLM-based Evaluation
par: Marioriyad, Arash, et autres
Publié: (2026)
par: Marioriyad, Arash, et autres
Publié: (2026)
Large Language Models for Scientific Idea Generation: A Creativity-Centered Survey
par: Shahhosseini, Fatemeh, et autres
Publié: (2025)
par: Shahhosseini, Fatemeh, et autres
Publié: (2025)
CARINOX: Inference-time Scaling with Category-Aware Reward-based Initial Noise Optimization and Exploration
par: Kasaei, Seyed Amir, et autres
Publié: (2025)
par: Kasaei, Seyed Amir, et autres
Publié: (2025)
Evaluating the Evaluators: Metrics for Compositional Text-to-Image Generation
par: Kasaei, Seyed Amir, et autres
Publié: (2025)
par: Kasaei, Seyed Amir, et autres
Publié: (2025)
No Concept Left Behind: Test-Time Optimization for Compositional Text-to-Image Generation
par: Sameti, Mohammad Hossein, et autres
Publié: (2025)
par: Sameti, Mohammad Hossein, et autres
Publié: (2025)
Hidden Meanings in Plain Sight: RebusBench for Evaluating Cognitive Visual Reasoning
par: Kasaei, Seyed Amir, et autres
Publié: (2026)
par: Kasaei, Seyed Amir, et autres
Publié: (2026)
Visual Structures Helps Visual Reasoning: Addressing the Binding Problem in VLMs
par: Izadi, Amirmohammad, et autres
Publié: (2025)
par: Izadi, Amirmohammad, et autres
Publié: (2025)
Trained Models Tell Us How to Make Them Robust to Spurious Correlation without Group Annotation
par: Ghaznavi, Mahdi, et autres
Publié: (2024)
par: Ghaznavi, Mahdi, et autres
Publié: (2024)
RODEO: Robust Outlier Detection via Exposing Adaptive Out-of-Distribution Samples
par: Mirzaei, Hossein, et autres
Publié: (2025)
par: Mirzaei, Hossein, et autres
Publié: (2025)
T2I-FineEval: Fine-Grained Compositional Metric for Text-to-Image Evaluation
par: Hosseini, Seyed Mohammad Hadi, et autres
Publié: (2025)
par: Hosseini, Seyed Mohammad Hadi, et autres
Publié: (2025)
Spurious-Aware Prototype Refinement for Reliable Out-of-Distribution Detection
par: Zohrabi, Reihaneh, et autres
Publié: (2025)
par: Zohrabi, Reihaneh, et autres
Publié: (2025)
CER: Confidence Enhanced Reasoning in LLMs
par: Razghandi, Ali, et autres
Publié: (2025)
par: Razghandi, Ali, et autres
Publié: (2025)
VQEL: Enabling Self-Play in Emergent Language Games via Agent-Internal Vector Quantization
par: Paqaleh, Mohammad Mahdi Samiei, et autres
Publié: (2025)
par: Paqaleh, Mohammad Mahdi Samiei, et autres
Publié: (2025)
Unspoken Hints: Accuracy Without Acknowledgement in LLM Reasoning
par: Marioriyad, Arash, et autres
Publié: (2025)
par: Marioriyad, Arash, et autres
Publié: (2025)
The Illusion of Procedural Reasoning: Measuring Long-Horizon FSM Execution in LLMs
par: Samiei, Mahdi, et autres
Publié: (2025)
par: Samiei, Mahdi, et autres
Publié: (2025)
Improving 3D Few-Shot Segmentation with Inference-Time Pseudo-Labeling
par: Mozafari, Mohammad, et autres
Publié: (2024)
par: Mozafari, Mohammad, et autres
Publié: (2024)
Infinity and Beyond: Compositional Alignment in VAR and Diffusion T2I Models
par: Shahabadi, Hossein, et autres
Publié: (2025)
par: Shahabadi, Hossein, et autres
Publié: (2025)
SUSD: Structured Unsupervised Skill Discovery through State Factorization
par: Hosseini, Seyed Mohammad Hadi, et autres
Publié: (2026)
par: Hosseini, Seyed Mohammad Hadi, et autres
Publié: (2026)
Fine-Grained Alignment and Noise Refinement for Compositional Text-to-Image Generation
par: Izadi, Amir Mohammad, et autres
Publié: (2025)
par: Izadi, Amir Mohammad, et autres
Publié: (2025)
LibraGrad: Balancing Gradient Flow for Universally Better Vision Transformer Attributions
par: Mehri, Faridoun, et autres
Publié: (2024)
par: Mehri, Faridoun, et autres
Publié: (2024)
Khayyam Challenge (PersianMMLU): Is Your LLM Truly Wise to The Persian Language?
par: Ghahroodi, Omid, et autres
Publié: (2024)
par: Ghahroodi, Omid, et autres
Publié: (2024)
Bridging Reasoning to Learning: Unmasking Illusions using Complexity Out of Distribution Generalization
par: Paqaleh, Mohammad Mahdi Samiei, et autres
Publié: (2025)
par: Paqaleh, Mohammad Mahdi Samiei, et autres
Publié: (2025)
Classification of Breast Cancer Histopathology Images using a Modified Supervised Contrastive Learning Method
par: Sani, Matina Mahdizadeh, et autres
Publié: (2024)
par: Sani, Matina Mahdizadeh, et autres
Publié: (2024)
ComAlign: Compositional Alignment in Vision-Language Models
par: Abdollah, Ali, et autres
Publié: (2024)
par: Abdollah, Ali, et autres
Publié: (2024)
Efficient Adversarial Attacks on High-dimensional Offline Bandits
par: Hosseini, Seyed Mohammad Hadi, et autres
Publié: (2026)
par: Hosseini, Seyed Mohammad Hadi, et autres
Publié: (2026)
Uncovering Grounding IDs: How External Cues Shape Multimodal Binding
par: Hasani, Hosein, et autres
Publié: (2025)
par: Hasani, Hosein, et autres
Publié: (2025)
Dilated Balanced Cross Entropy Loss for Medical Image Segmentation
par: Hosseini, Seyed Mohsen, et autres
Publié: (2024)
par: Hosseini, Seyed Mohsen, et autres
Publié: (2024)
Inductive Biases for Zero-shot Systematic Generalization in Language-informed Reinforcement Learning
par: Dijujin, Negin Hashemi, et autres
Publié: (2025)
par: Dijujin, Negin Hashemi, et autres
Publié: (2025)
LLM-Agent-Controller: A Universal Multi-Agent Large Language Model System as a Control Engineer
par: Zahedifar, Rasoul, et autres
Publié: (2025)
par: Zahedifar, Rasoul, et autres
Publié: (2025)
Persian MusicGen: A Large-Scale Dataset and Culturally-Aware Generative Model for Persian Music
par: Sameti, Mohammad Hossein, et autres
Publié: (2026)
par: Sameti, Mohammad Hossein, et autres
Publié: (2026)
Persian Musical Instruments Classification Using Polyphonic Data Augmentation
par: Esfangereh, Diba Hadi, et autres
Publié: (2025)
par: Esfangereh, Diba Hadi, et autres
Publié: (2025)
Documents similaires
-
Deciphering the Role of Representation Disentanglement: Investigating Compositional Generalization in CLIP Models
par: Abbasi, Reza, et autres
Publié: (2024) -
Language Plays a Pivotal Role in the Object-Attribute Compositional Generalization of CLIP
par: Abbasi, Reza, et autres
Publié: (2024) -
The Silent Judge: Unacknowledged Shortcut Bias in LLM-as-a-Judge
par: Marioriyad, Arash, et autres
Publié: (2025) -
Attention Overlap Is Responsible for The Entity Missing Problem in Text-to-image Diffusion Models!
par: Marioriyad, Arash, et autres
Publié: (2024) -
Lying to Win: Assessing LLM Deception through Human-AI Games and Parallel-World Probing
par: Marioriyad, Arash, et autres
Publié: (2026)