Quantifying Label-Induced Bias in Large Language Model Self- and Cross-Evaluations
Fuente:
arXiv
Guardado en:
| Autores principales: | Saraf, Muskan, Boroujeni, Sajjad Rezvani, Beaudry, Justin, Abedi, Hossein, Bush, Tom |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Beyond Visualization: Building Decision Intelligence Through Iterative Dashboard Refinement
por: Tadakala, Likitha, et al.
Publicado: (2025)
por: Tadakala, Likitha, et al.
Publicado: (2025)
Enhancing Glass Defect Detection with Diffusion Models: Addressing Imbalanced Datasets in Manufacturing Quality Control
por: Boroujeni, Sajjad Rezvani, et al.
Publicado: (2025)
por: Boroujeni, Sajjad Rezvani, et al.
Publicado: (2025)
Self-Preference Bias in Rubric-Based Evaluation of Large Language Models
por: Pombal, José, et al.
Publicado: (2026)
por: Pombal, José, et al.
Publicado: (2026)
Cross-Language Bias Examination in Large Language Models
por: Liang, Yuxuan, et al.
Publicado: (2025)
por: Liang, Yuxuan, et al.
Publicado: (2025)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
por: Oi, Masanari, et al.
Publicado: (2024)
por: Oi, Masanari, et al.
Publicado: (2024)
No LLM is Free From Bias: A Comprehensive Study of Bias Evaluation in Large Language Models
por: Kumar, Charaka Vinayak, et al.
Publicado: (2025)
por: Kumar, Charaka Vinayak, et al.
Publicado: (2025)
FRoG: Evaluating Fuzzy Reasoning of Generalized Quantifiers in Large Language Models
por: Li, Yiyuan, et al.
Publicado: (2024)
por: Li, Yiyuan, et al.
Publicado: (2024)
Observations and Remedies for Large Language Model Bias in Self-Consuming Performative Loop
por: Wang, Yaxuan, et al.
Publicado: (2026)
por: Wang, Yaxuan, et al.
Publicado: (2026)
Quantifying Risk Propensities of Large Language Models: Ethical Focus and Bias Detection through Role-Play
por: Zeng, Yifan, et al.
Publicado: (2024)
por: Zeng, Yifan, et al.
Publicado: (2024)
PerMedCQA: Benchmarking Large Language Models on Medical Consumer Question Answering in Persian Language
por: Jamali, Naghmeh, et al.
Publicado: (2025)
por: Jamali, Naghmeh, et al.
Publicado: (2025)
A Cross-Lingual Analysis of Bias in Large Language Models Using Romanian History
por: Cocu, Matei-Iulian, et al.
Publicado: (2025)
por: Cocu, Matei-Iulian, et al.
Publicado: (2025)
Self-Correcting Large Language Models: Generation vs. Multiple Choice
por: Rahmani, Hossein A., et al.
Publicado: (2025)
por: Rahmani, Hossein A., et al.
Publicado: (2025)
Regional Bias in Large Language Models
por: Gopinadh, M P V S, et al.
Publicado: (2026)
por: Gopinadh, M P V S, et al.
Publicado: (2026)
Rethinking Toxicity Evaluation in Large Language Models: A Multi-Label Perspective
por: Kou, Zhiqiang, et al.
Publicado: (2025)
por: Kou, Zhiqiang, et al.
Publicado: (2025)
Cultural Bias in Large Language Models: Evaluating AI Agents through Moral Questionnaires
por: Münker, Simon
Publicado: (2025)
por: Münker, Simon
Publicado: (2025)
Evaluating Implicit Bias in Large Language Models by Attacking From a Psychometric Perspective
por: Wen, Yuchen, et al.
Publicado: (2024)
por: Wen, Yuchen, et al.
Publicado: (2024)
Quantifying and Mitigating Self-Preference Bias of LLM Judges
por: Yang, Jinming, et al.
Publicado: (2026)
por: Yang, Jinming, et al.
Publicado: (2026)
TALE: A Tool-Augmented Framework for Reference-Free Evaluation of Large Language Models
por: Badshah, Sher, et al.
Publicado: (2025)
por: Badshah, Sher, et al.
Publicado: (2025)
Assessing Political Bias in Large Language Models
por: Rettenberger, Luca, et al.
Publicado: (2024)
por: Rettenberger, Luca, et al.
Publicado: (2024)
Quantifying the Capabilities of LLMs across Scale and Precision
por: Badshah, Sher, et al.
Publicado: (2024)
por: Badshah, Sher, et al.
Publicado: (2024)
The Rise of Small Language Models in Healthcare: A Comprehensive Survey
por: Garg, Muskan, et al.
Publicado: (2025)
por: Garg, Muskan, et al.
Publicado: (2025)
Doppelgänger's Watch: A Split Objective Approach to Large Language Models
por: Ghasemlou, Shervin, et al.
Publicado: (2024)
por: Ghasemlou, Shervin, et al.
Publicado: (2024)
Understanding AI Evaluation Patterns: How Different GPT Models Assess Vision-Language Descriptions
por: Abdoli, Sajjad, et al.
Publicado: (2025)
por: Abdoli, Sajjad, et al.
Publicado: (2025)
Soft-prompt Tuning for Large Language Models to Evaluate Bias
por: Tian, Jacob-Junqi, et al.
Publicado: (2023)
por: Tian, Jacob-Junqi, et al.
Publicado: (2023)
Invisible Filters: Cultural Bias in Hiring Evaluations Using Large Language Models
por: Rao, Pooja S. B., et al.
Publicado: (2025)
por: Rao, Pooja S. B., et al.
Publicado: (2025)
Cross-Examiner: Evaluating Consistency of Large Language Model-Generated Explanations
por: Villa, Danielle, et al.
Publicado: (2025)
por: Villa, Danielle, et al.
Publicado: (2025)
Evaluation of the Automated Labeling Method for Taxonomic Nomenclature Through Prompt-Optimized Large Language Model
por: Inoshita, Keito, et al.
Publicado: (2025)
por: Inoshita, Keito, et al.
Publicado: (2025)
LETToT: Label-Free Evaluation of Large Language Models On Tourism Using Expert Tree-of-Thought
por: Qi, Ruiyan, et al.
Publicado: (2025)
por: Qi, Ruiyan, et al.
Publicado: (2025)
Locating and Mitigating Gender Bias in Large Language Models
por: Cai, Yuchen, et al.
Publicado: (2024)
por: Cai, Yuchen, et al.
Publicado: (2024)
Cultural Bias and Cultural Alignment of Large Language Models
por: Tao, Yan, et al.
Publicado: (2023)
por: Tao, Yan, et al.
Publicado: (2023)
Progressively Label Enhancement for Large Language Model Alignment
por: Liu, Biao, et al.
Publicado: (2024)
por: Liu, Biao, et al.
Publicado: (2024)
Metamorphic Testing for Fairness Evaluation in Large Language Models: Identifying Intersectional Bias in LLaMA and GPT
por: Reddy, Harishwar, et al.
Publicado: (2025)
por: Reddy, Harishwar, et al.
Publicado: (2025)
VibeCheck: Discover and Quantify Qualitative Differences in Large Language Models
por: Dunlap, Lisa, et al.
Publicado: (2024)
por: Dunlap, Lisa, et al.
Publicado: (2024)
DOCS: Quantifying Weight Similarity for Deeper Insights into Large Language Models
por: Min, Zeping, et al.
Publicado: (2025)
por: Min, Zeping, et al.
Publicado: (2025)
"Lost-in-the-Later": Framework for Quantifying Contextual Grounding in Large Language Models
por: Tao, Yufei, et al.
Publicado: (2025)
por: Tao, Yufei, et al.
Publicado: (2025)
AA-Omniscience: Evaluating Cross-Domain Knowledge Reliability in Large Language Models
por: Jackson, Declan, et al.
Publicado: (2025)
por: Jackson, Declan, et al.
Publicado: (2025)
Cross-Layer Discrete Concept Discovery for Interpreting Language Models
por: Garg, Ankur, et al.
Publicado: (2025)
por: Garg, Ankur, et al.
Publicado: (2025)
Large Language Models Are Still Misled by Simple Bias Ensembles
por: Sun, Zhouhao, et al.
Publicado: (2025)
por: Sun, Zhouhao, et al.
Publicado: (2025)
Multi-Persona Thinking for Bias Mitigation in Large Language Models
por: Chen, Yuxing, et al.
Publicado: (2026)
por: Chen, Yuxing, et al.
Publicado: (2026)
Prompt Programming for Cultural Bias and Alignment of Large Language Models
por: Eren, Maksim, et al.
Publicado: (2026)
por: Eren, Maksim, et al.
Publicado: (2026)
Ejemplares similares
-
Beyond Visualization: Building Decision Intelligence Through Iterative Dashboard Refinement
por: Tadakala, Likitha, et al.
Publicado: (2025) -
Enhancing Glass Defect Detection with Diffusion Models: Addressing Imbalanced Datasets in Manufacturing Quality Control
por: Boroujeni, Sajjad Rezvani, et al.
Publicado: (2025) -
Self-Preference Bias in Rubric-Based Evaluation of Large Language Models
por: Pombal, José, et al.
Publicado: (2026) -
Cross-Language Bias Examination in Large Language Models
por: Liang, Yuxuan, et al.
Publicado: (2025) -
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
por: Oi, Masanari, et al.
Publicado: (2024)