Beyond the Surface: Measuring Self-Preference in LLM Judgments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Zhi-Yuan, Wang, Hao, Zhang, Xinyu, Hu, Enrui, Lin, Yankai |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Single-Point Judgment: Distribution Alignment for LLM-as-a-Judge
par: Chen, Luyu, et autres
Publié: (2025)
par: Chen, Luyu, et autres
Publié: (2025)
Spread Preference Annotation: Direct Preference Judgment for Efficient LLM Alignment
par: Kim, Dongyoung, et autres
Publié: (2024)
par: Kim, Dongyoung, et autres
Publié: (2024)
Rational Decision-Making Agent with Internalized Utility Judgment
par: Ye, Yining, et autres
Publié: (2023)
par: Ye, Yining, et autres
Publié: (2023)
Advancing LLM Reasoning Generalists with Preference Trees
par: Yuan, Lifan, et autres
Publié: (2024)
par: Yuan, Lifan, et autres
Publié: (2024)
Do LLM Evaluators Prefer Themselves for a Reason?
par: Chen, Wei-Lin, et autres
Publié: (2025)
par: Chen, Wei-Lin, et autres
Publié: (2025)
Logical Consistency as a Bridge: Improving LLM Hallucination Detection via Label Constraint Modeling between Responses and Self-Judgments
par: Mi, Hao, et autres
Publié: (2026)
par: Mi, Hao, et autres
Publié: (2026)
Permutative Preference Alignment from Listwise Ranking of Human Judgments
par: Zhao, Yang, et autres
Publié: (2024)
par: Zhao, Yang, et autres
Publié: (2024)
Improving LLM-as-a-Judge Inference with the Judgment Distribution
par: Wang, Victor, et autres
Publié: (2025)
par: Wang, Victor, et autres
Publié: (2025)
Beyond Guilt: Legal Judgment Prediction with Trichotomous Reasoning
par: Zhang, Kepu, et autres
Publié: (2024)
par: Zhang, Kepu, et autres
Publié: (2024)
WEPO: Web Element Preference Optimization for LLM-based Web Navigation
par: Liu, Jiarun, et autres
Publié: (2024)
par: Liu, Jiarun, et autres
Publié: (2024)
DARC: Decoupled Asymmetric Reasoning Curriculum for LLM Evolution
par: Fan, Shengda, et autres
Publié: (2026)
par: Fan, Shengda, et autres
Publié: (2026)
From Blind Guess to Informed Judgment: Teaching LLMs to Evaluate Materials by Building Knowledge-Augmented Preference Signals
par: Yu, Yeyong, et autres
Publié: (2026)
par: Yu, Yeyong, et autres
Publié: (2026)
Tracing How Annotators Think: Augmenting Preference Judgments with Reading Processes
par: de Langis, Karin, et autres
Publié: (2025)
par: de Langis, Karin, et autres
Publié: (2025)
Mitigating Judgment Preference Bias in Large Language Models through Group-Based Polling
par: Liu, Shuliang, et autres
Publié: (2025)
par: Liu, Shuliang, et autres
Publié: (2025)
Self-Preference Bias in LLM-as-a-Judge
par: Wataoka, Koki, et autres
Publié: (2024)
par: Wataoka, Koki, et autres
Publié: (2024)
GLARE: Agentic Reasoning for Legal Judgment Prediction
par: Yang, Xinyu, et autres
Publié: (2025)
par: Yang, Xinyu, et autres
Publié: (2025)
Explaining Length Bias in LLM-Based Preference Evaluations
par: Hu, Zhengyu, et autres
Publié: (2024)
par: Hu, Zhengyu, et autres
Publié: (2024)
Swarm Skills: A Portable, Self-Evolving Multi-Agent System Specification for Coordination Engineering
par: Zhang, Xinyu, et autres
Publié: (2026)
par: Zhang, Xinyu, et autres
Publié: (2026)
TSO: Self-Training with Scaled Preference Optimization
par: Chen, Kaihui, et autres
Publié: (2024)
par: Chen, Kaihui, et autres
Publié: (2024)
Can You Trust LLM Judgments? Reliability of LLM-as-a-Judge
par: Schroeder, Kayla, et autres
Publié: (2024)
par: Schroeder, Kayla, et autres
Publié: (2024)
Analyzing and Evaluating Correlation Measures in NLG Meta-Evaluation
par: Gao, Mingqi, et autres
Publié: (2024)
par: Gao, Mingqi, et autres
Publié: (2024)
Towards Thinking-Optimal Scaling of Test-Time Compute for LLM Reasoning
par: Yang, Wenkai, et autres
Publié: (2025)
par: Yang, Wenkai, et autres
Publié: (2025)
Quantifying and Mitigating Self-Preference Bias of LLM Judges
par: Yang, Jinming, et autres
Publié: (2026)
par: Yang, Jinming, et autres
Publié: (2026)
AlpsBench: An LLM Personalization Benchmark for Real-Dialogue Memorization and Preference Alignment
par: Xiao, Jianfei, et autres
Publié: (2026)
par: Xiao, Jianfei, et autres
Publié: (2026)
Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
par: Li, Jian, et autres
Publié: (2024)
par: Li, Jian, et autres
Publié: (2024)
ImplicitRM: Unbiased Reward Modeling from Implicit Preference Data for LLM alignment
par: Wang, Hao, et autres
Publié: (2026)
par: Wang, Hao, et autres
Publié: (2026)
Judgment of Learning: A Human Ability Beyond Generative Artificial Intelligence
par: Huff, Markus, et autres
Publié: (2024)
par: Huff, Markus, et autres
Publié: (2024)
DGPO: Beyond Pairwise Preferences with Directional Consistent Groupwise Optimization
par: Deng, Mengyi, et autres
Publié: (2026)
par: Deng, Mengyi, et autres
Publié: (2026)
Multimodal Multi-Agent Empowered Legal Judgment Prediction
par: Kang, Zhaolu, et autres
Publié: (2026)
par: Kang, Zhaolu, et autres
Publié: (2026)
Self-Infilling Code Generation
par: Zheng, Lin, et autres
Publié: (2023)
par: Zheng, Lin, et autres
Publié: (2023)
LocalSUG: City-Preference-Enhanced LLM for Query Suggestion in Local-Life Services
par: Chen, Jinwen, et autres
Publié: (2026)
par: Chen, Jinwen, et autres
Publié: (2026)
Large Language Model-based Human-Agent Collaboration for Complex Task Solving
par: Feng, Xueyang, et autres
Publié: (2024)
par: Feng, Xueyang, et autres
Publié: (2024)
Exploring Backdoor Vulnerabilities of Chat Models
par: Hao, Yunzhuo, et autres
Publié: (2024)
par: Hao, Yunzhuo, et autres
Publié: (2024)
Improving Alignment in LVLMs with Debiased Self-Judgment
par: Yang, Sihan, et autres
Publié: (2025)
par: Yang, Sihan, et autres
Publié: (2025)
Beyond the Surface: Enhancing LLM-as-a-Judge Alignment with Human via Internal Representations
par: Lai, Peng, et autres
Publié: (2025)
par: Lai, Peng, et autres
Publié: (2025)
Benchmarking LLM-based Relevance Judgment Methods
par: Arabzadeh, Negar, et autres
Publié: (2025)
par: Arabzadeh, Negar, et autres
Publié: (2025)
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
par: Xiang, Hao, et autres
Publié: (2024)
par: Xiang, Hao, et autres
Publié: (2024)
HopRank: Self-Supervised LLM Preference-Tuning on Graphs for Few-Shot Node Classification
par: Wang, Ziqing, et autres
Publié: (2026)
par: Wang, Ziqing, et autres
Publié: (2026)
Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference
par: Gao, Mingqi, et autres
Publié: (2024)
par: Gao, Mingqi, et autres
Publié: (2024)
Beyond Single-Reward: Multi-Pair, Multi-Perspective Preference Optimization for Machine Translation
par: Wang, Hao, et autres
Publié: (2025)
par: Wang, Hao, et autres
Publié: (2025)
Documents similaires
-
Beyond Single-Point Judgment: Distribution Alignment for LLM-as-a-Judge
par: Chen, Luyu, et autres
Publié: (2025) -
Spread Preference Annotation: Direct Preference Judgment for Efficient LLM Alignment
par: Kim, Dongyoung, et autres
Publié: (2024) -
Rational Decision-Making Agent with Internalized Utility Judgment
par: Ye, Yining, et autres
Publié: (2023) -
Advancing LLM Reasoning Generalists with Preference Trees
par: Yuan, Lifan, et autres
Publié: (2024) -
Do LLM Evaluators Prefer Themselves for a Reason?
par: Chen, Wei-Lin, et autres
Publié: (2025)