Evaluating the Performance of Large Language Models via Debates
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Moniri, Behrad, Hassani, Hamed, Dobriban, Edgar |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
One-Shot Safety Alignment for Large Language Models via Optimal Dualization
par: Huang, Xinmeng, et autres
Publié: (2024)
par: Huang, Xinmeng, et autres
Publié: (2024)
A Theory of Non-Linear Feature Learning with One Gradient Step in Two-Layer Neural Networks
par: Moniri, Behrad, et autres
Publié: (2023)
par: Moniri, Behrad, et autres
Publié: (2023)
Uncertainty in Language Models: Assessment through Rank-Calibration
par: Huang, Xinmeng, et autres
Publié: (2024)
par: Huang, Xinmeng, et autres
Publié: (2024)
Feature Learning in Linear-Width Two-Layer Networks: Two vs. One Step of Gradient Descent
par: Moniri, Behrad, et autres
Publié: (2026)
par: Moniri, Behrad, et autres
Publié: (2026)
On the Mechanisms of Weak-to-Strong Generalization: A Theoretical Perspective
par: Moniri, Behrad, et autres
Publié: (2025)
par: Moniri, Behrad, et autres
Publié: (2025)
Signal-Plus-Noise Decomposition of Nonlinear Spiked Random Matrix Models
par: Moniri, Behrad, et autres
Publié: (2024)
par: Moniri, Behrad, et autres
Publié: (2024)
Asymptotics of Linear Regression with Linearly Dependent Data
par: Moniri, Behrad, et autres
Publié: (2024)
par: Moniri, Behrad, et autres
Publié: (2024)
Watermarking Language Models with Error Correcting Codes
par: Chao, Patrick, et autres
Publié: (2024)
par: Chao, Patrick, et autres
Publié: (2024)
Conformal Information Pursuit for Interactively Guiding Large Language Models
par: Chan, Kwan Ho Ryan, et autres
Publié: (2025)
par: Chan, Kwan Ho Ryan, et autres
Publié: (2025)
Jailbreaking Black Box Large Language Models in Twenty Queries
par: Chao, Patrick, et autres
Publié: (2023)
par: Chao, Patrick, et autres
Publié: (2023)
Conformal Inference under High-Dimensional Covariate Shifts via Likelihood-Ratio Regularization
par: Joshi, Sunay, et autres
Publié: (2025)
par: Joshi, Sunay, et autres
Publié: (2025)
Evaluation of Large Language Models via Coupled Token Generation
par: Benz, Nina Corvelo, et autres
Publié: (2025)
par: Benz, Nina Corvelo, et autres
Publié: (2025)
Improving Reasoning Performance in Large Language Models via Representation Engineering
par: Højer, Bertram, et autres
Publié: (2025)
par: Højer, Bertram, et autres
Publié: (2025)
Adaptively profiling models with task elicitation
par: Brown, Davis, et autres
Publié: (2025)
par: Brown, Davis, et autres
Publié: (2025)
Collaborative Performance Prediction for Large Language Models
par: Zhang, Qiyuan, et autres
Publié: (2024)
par: Zhang, Qiyuan, et autres
Publié: (2024)
Auto-Evolve: Enhancing Large Language Model's Performance via Self-Reasoning Framework
par: Aswani, Krishna, et autres
Publié: (2024)
par: Aswani, Krishna, et autres
Publié: (2024)
Evaluating the Goal-Directedness of Large Language Models
par: Everitt, Tom, et autres
Publié: (2025)
par: Everitt, Tom, et autres
Publié: (2025)
StructEval: Deepen and Broaden Large Language Model Assessment via Structured Evaluation
par: Cao, Boxi, et autres
Publié: (2024)
par: Cao, Boxi, et autres
Publié: (2024)
Statistical Methods in Generative AI
par: Dobriban, Edgar
Publié: (2025)
par: Dobriban, Edgar
Publié: (2025)
Cancer Diagnosis Categorization in Electronic Health Records Using Large Language Models and BioBERT: Model Performance Evaluation Study
par: Hashtarkhani, Soheil, et autres
Publié: (2025)
par: Hashtarkhani, Soheil, et autres
Publié: (2025)
Evaluating the Robustness of Analogical Reasoning in Large Language Models
par: Lewis, Martha, et autres
Publié: (2024)
par: Lewis, Martha, et autres
Publié: (2024)
Existing Large Language Model Unlearning Evaluations Are Inconclusive
par: Feng, Zhili, et autres
Publié: (2025)
par: Feng, Zhili, et autres
Publié: (2025)
An Evaluation on Large Language Model Outputs: Discourse and Memorization
par: de Wynter, Adrian, et autres
Publié: (2023)
par: de Wynter, Adrian, et autres
Publié: (2023)
Generative Evaluation of Complex Reasoning in Large Language Models
par: Lin, Haowei, et autres
Publié: (2025)
par: Lin, Haowei, et autres
Publié: (2025)
A Philosophical Introduction to Language Models -- Part I: Continuity With Classic Debates
par: Millière, Raphaël, et autres
Publié: (2024)
par: Millière, Raphaël, et autres
Publié: (2024)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
par: Liu, Xiaoze, et autres
Publié: (2024)
par: Liu, Xiaoze, et autres
Publié: (2024)
Dynamic Evaluation of Large Language Models by Meta Probing Agents
par: Zhu, Kaijie, et autres
Publié: (2024)
par: Zhu, Kaijie, et autres
Publié: (2024)
Evaluating the Limits of Large Language Models in Multilingual Legal Reasoning
par: Ioannou, Antreas, et autres
Publié: (2025)
par: Ioannou, Antreas, et autres
Publié: (2025)
StyleBench: Evaluating thinking styles in Large Language Models
par: Guo, Junyu, et autres
Publié: (2025)
par: Guo, Junyu, et autres
Publié: (2025)
Episodic Memories Generation and Evaluation Benchmark for Large Language Models
par: Huet, Alexis, et autres
Publié: (2025)
par: Huet, Alexis, et autres
Publié: (2025)
CORE: Comprehensive Ontological Relation Evaluation for Large Language Models
par: Dwivedi, Satyam, et autres
Publié: (2026)
par: Dwivedi, Satyam, et autres
Publié: (2026)
Soft-prompt Tuning for Large Language Models to Evaluate Bias
par: Tian, Jacob-Junqi, et autres
Publié: (2023)
par: Tian, Jacob-Junqi, et autres
Publié: (2023)
Towards Acyclic Preference Evaluation of Language Models via Multiple Evaluators
par: Hu, Zhengyu, et autres
Publié: (2024)
par: Hu, Zhengyu, et autres
Publié: (2024)
ReEval: Automatic Hallucination Evaluation for Retrieval-Augmented Large Language Models via Transferable Adversarial Attacks
par: Yu, Xiaodong, et autres
Publié: (2023)
par: Yu, Xiaodong, et autres
Publié: (2023)
Solving a Research Problem in Mathematical Statistics with AI Assistance
par: Dobriban, Edgar
Publié: (2025)
par: Dobriban, Edgar
Publié: (2025)
CityBench: Evaluating the Capabilities of Large Language Models for Urban Tasks
par: Feng, Jie, et autres
Publié: (2024)
par: Feng, Jie, et autres
Publié: (2024)
A Critical Evaluation of AI Feedback for Aligning Large Language Models
par: Sharma, Archit, et autres
Publié: (2024)
par: Sharma, Archit, et autres
Publié: (2024)
Evaluating Large Language Models Using Contrast Sets: An Experimental Approach
par: Sanwal, Manish
Publié: (2024)
par: Sanwal, Manish
Publié: (2024)
Foundational Autoraters: Taming Large Language Models for Better Automatic Evaluation
par: Vu, Tu, et autres
Publié: (2024)
par: Vu, Tu, et autres
Publié: (2024)
PromptBench: A Unified Library for Evaluation of Large Language Models
par: Zhu, Kaijie, et autres
Publié: (2023)
par: Zhu, Kaijie, et autres
Publié: (2023)
Documents similaires
-
One-Shot Safety Alignment for Large Language Models via Optimal Dualization
par: Huang, Xinmeng, et autres
Publié: (2024) -
A Theory of Non-Linear Feature Learning with One Gradient Step in Two-Layer Neural Networks
par: Moniri, Behrad, et autres
Publié: (2023) -
Uncertainty in Language Models: Assessment through Rank-Calibration
par: Huang, Xinmeng, et autres
Publié: (2024) -
Feature Learning in Linear-Width Two-Layer Networks: Two vs. One Step of Gradient Descent
par: Moniri, Behrad, et autres
Publié: (2026) -
On the Mechanisms of Weak-to-Strong Generalization: A Theoretical Perspective
par: Moniri, Behrad, et autres
Publié: (2025)