Correcting Selection Bias in Sparse User Feedback for Large Language Model Quality Estimation: A Multi-Agent Hierarchical Bayesian Approach
Fuente:
arXiv
Guardado en:
| Autores principales: | Morandi, Andrea, Viswanathan, Mahesh |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Two Ways to De-Bias an LLM-as-a-Judge: A Continuous-Score Comparison of Hierarchical Bayesian Calibration and Neural-ODE Score Transport
por: Morandi, Andrea
Publicado: (2026)
por: Morandi, Andrea
Publicado: (2026)
Compositional Bias Control in Large Language Models: Preference Learning Fails, Supervision Succeeds
por: Mahesh, Atij
Publicado: (2025)
por: Mahesh, Atij
Publicado: (2025)
RTLC -- Research, Teach-to-Learn, Critique: A three-stage prompting paradigm inspired by the Feynman Learning Technique that lifts LLM-as-judge accuracy on JudgeBench with no fine-tuning
por: Morandi, Andrea
Publicado: (2026)
por: Morandi, Andrea
Publicado: (2026)
Multi-User Large Language Model Agents
por: Yang, Shu, et al.
Publicado: (2026)
por: Yang, Shu, et al.
Publicado: (2026)
Mitigating Social Bias in Large Language Models: A Multi-Objective Approach within a Multi-Agent Framework
por: Xu, Zhenjie, et al.
Publicado: (2024)
por: Xu, Zhenjie, et al.
Publicado: (2024)
Characterizing Selective Refusal Bias in Large Language Models
por: Khorramrouz, Adel, et al.
Publicado: (2025)
por: Khorramrouz, Adel, et al.
Publicado: (2025)
Are Large Language Models State-of-the-art Quality Estimators for Machine Translation of User-generated Content?
por: Qian, Shenbin, et al.
Publicado: (2024)
por: Qian, Shenbin, et al.
Publicado: (2024)
GLLM: Self-Corrective G-Code Generation using Large Language Models with User Feedback
por: Abdelaal, Mohamed, et al.
Publicado: (2025)
por: Abdelaal, Mohamed, et al.
Publicado: (2025)
Mitigating Bias in Queer Representation within Large Language Models: A Collaborative Agent Approach
por: Huang, Tianyi, et al.
Publicado: (2024)
por: Huang, Tianyi, et al.
Publicado: (2024)
Interpreting Bias in Large Language Models: A Feature-Based Approach
por: Prakash, Nirmalendu, et al.
Publicado: (2024)
por: Prakash, Nirmalendu, et al.
Publicado: (2024)
A Large Language Model Approach to Educational Survey Feedback Analysis
por: Parker, Michael J., et al.
Publicado: (2023)
por: Parker, Michael J., et al.
Publicado: (2023)
AI-Press: A Multi-Agent News Generating and Feedback Simulation System Powered by Large Language Models
por: Liu, Xiawei, et al.
Publicado: (2024)
por: Liu, Xiawei, et al.
Publicado: (2024)
The Decision Problem for Regular First-Order Theories
por: Mathur, Umang, et al.
Publicado: (2024)
por: Mathur, Umang, et al.
Publicado: (2024)
BoRA: Bayesian Hierarchical Low-Rank Adaption for Multi-Task Large Language Models
por: Eide, Simen, et al.
Publicado: (2024)
por: Eide, Simen, et al.
Publicado: (2024)
Reducing Selection Bias in Large Language Models
por: Eicher, J. E., et al.
Publicado: (2024)
por: Eicher, J. E., et al.
Publicado: (2024)
SMoA: Improving Multi-agent Large Language Models with Sparse Mixture-of-Agents
por: Li, Dawei, et al.
Publicado: (2024)
por: Li, Dawei, et al.
Publicado: (2024)
Large Language Models as Annotators for Machine Translation Quality Estimation
por: Wang, Sidi, et al.
Publicado: (2026)
por: Wang, Sidi, et al.
Publicado: (2026)
Bias in, Bias out: Annotation Bias in Multilingual Large Language Models
por: Cui, Xia, et al.
Publicado: (2025)
por: Cui, Xia, et al.
Publicado: (2025)
From Language to Action: A Review of Large Language Models as Autonomous Agents and Tool Users
por: Chowa, Sadia Sultana, et al.
Publicado: (2025)
por: Chowa, Sadia Sultana, et al.
Publicado: (2025)
Aggregation of Reasoning: A Hierarchical Framework for Enhancing Answer Selection in Large Language Models
por: Yin, Zhangyue, et al.
Publicado: (2024)
por: Yin, Zhangyue, et al.
Publicado: (2024)
Semantic Scaling: Bayesian Ideal Point Estimates with Large Language Models
por: Burnham, Michael
Publicado: (2024)
por: Burnham, Michael
Publicado: (2024)
Inference-Time Reasoning Selectively Reduces Implicit Social Bias in Large Language Models
por: Apsel, Molly, et al.
Publicado: (2026)
por: Apsel, Molly, et al.
Publicado: (2026)
Acquiescence Bias in Large Language Models
por: Braun, Daniel
Publicado: (2025)
por: Braun, Daniel
Publicado: (2025)
McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models
por: Lan, Tian, et al.
Publicado: (2025)
por: Lan, Tian, et al.
Publicado: (2025)
Training Agents with Weakly Supervised Feedback from Large Language Models
por: Gong, Dihong, et al.
Publicado: (2024)
por: Gong, Dihong, et al.
Publicado: (2024)
A User-Centric Multi-Intent Benchmark for Evaluating Large Language Models
por: Wang, Jiayin, et al.
Publicado: (2024)
por: Wang, Jiayin, et al.
Publicado: (2024)
Multi-Persona Thinking for Bias Mitigation in Large Language Models
por: Chen, Yuxing, et al.
Publicado: (2026)
por: Chen, Yuxing, et al.
Publicado: (2026)
Self-Correcting Decoding with Generative Feedback for Mitigating Hallucinations in Large Vision-Language Models
por: Zhang, Ce, et al.
Publicado: (2025)
por: Zhang, Ce, et al.
Publicado: (2025)
Large Language Models for Power Scheduling: A User-Centric Approach
por: Mongaillard, Thomas, et al.
Publicado: (2024)
por: Mongaillard, Thomas, et al.
Publicado: (2024)
Correcting Negative Bias in Large Language Models through Negative Attention Score Alignment
por: Yu, Sangwon, et al.
Publicado: (2024)
por: Yu, Sangwon, et al.
Publicado: (2024)
Enhancing Diagnostic Accuracy through Multi-Agent Conversations: Using Large Language Models to Mitigate Cognitive Bias
por: Ke, Yu He, et al.
Publicado: (2024)
por: Ke, Yu He, et al.
Publicado: (2024)
Confidence in Large Language Model Evaluation: A Bayesian Approach to Limited-Sample Challenges
por: Xiao, Xiao, et al.
Publicado: (2025)
por: Xiao, Xiao, et al.
Publicado: (2025)
Aligning Dialogue Agents with Global Feedback via Large Language Model Multimodal Reward Decomposition
por: Lee, Dong Won, et al.
Publicado: (2025)
por: Lee, Dong Won, et al.
Publicado: (2025)
BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models
por: Fan, Zhiting, et al.
Publicado: (2025)
por: Fan, Zhiting, et al.
Publicado: (2025)
Evaluating Gender Bias in Large Language Models
por: Döll, Michael, et al.
Publicado: (2024)
por: Döll, Michael, et al.
Publicado: (2024)
Mitigating the Bias of Large Language Model Evaluation
por: Zhou, Hongli, et al.
Publicado: (2024)
por: Zhou, Hongli, et al.
Publicado: (2024)
ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL
por: Zhou, Yifei, et al.
Publicado: (2024)
por: Zhou, Yifei, et al.
Publicado: (2024)
Promoting Equality in Large Language Models: Identifying and Mitigating the Implicit Bias based on Bayesian Theory
por: Deng, Yongxin, et al.
Publicado: (2024)
por: Deng, Yongxin, et al.
Publicado: (2024)
MuRating: A High Quality Data Selecting Approach to Multilingual Large Language Model Pretraining
por: Chen, Zhixun, et al.
Publicado: (2025)
por: Chen, Zhixun, et al.
Publicado: (2025)
Argument Quality Assessment with Large Language Models: A Pairwise Bradley-Terry Approach
por: Ocampo, Nicolás Benjamín, et al.
Publicado: (2026)
por: Ocampo, Nicolás Benjamín, et al.
Publicado: (2026)
Ejemplares similares
-
Two Ways to De-Bias an LLM-as-a-Judge: A Continuous-Score Comparison of Hierarchical Bayesian Calibration and Neural-ODE Score Transport
por: Morandi, Andrea
Publicado: (2026) -
Compositional Bias Control in Large Language Models: Preference Learning Fails, Supervision Succeeds
por: Mahesh, Atij
Publicado: (2025) -
RTLC -- Research, Teach-to-Learn, Critique: A three-stage prompting paradigm inspired by the Feynman Learning Technique that lifts LLM-as-judge accuracy on JudgeBench with no fine-tuning
por: Morandi, Andrea
Publicado: (2026) -
Multi-User Large Language Model Agents
por: Yang, Shu, et al.
Publicado: (2026) -
Mitigating Social Bias in Large Language Models: A Multi-Objective Approach within a Multi-Agent Framework
por: Xu, Zhenjie, et al.
Publicado: (2024)