Argument Quality Assessment with Large Language Models: A Pairwise Bradley-Terry Approach
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ocampo, Nicolás Benjamín, Nyiranziza, Agnes Paullate, Ceolin, Davide |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Leveraging Argument Structure to Predict Content Hatefulness
par: Ocampo, Nicolás Benjamín, et autres
Publié: (2026)
par: Ocampo, Nicolás Benjamín, et autres
Publié: (2026)
When Hate Meets Facts: LLMs-in-the-Loop for Check-worthiness Detection in Hate Speech
par: Ocampo, Nicolás Benjamín, et autres
Publié: (2026)
par: Ocampo, Nicolás Benjamín, et autres
Publié: (2026)
Bradley-Terry and Multi-Objective Reward Modeling Are Complementary
par: Zhang, Zhiwei, et autres
Publié: (2025)
par: Zhang, Zhiwei, et autres
Publié: (2025)
Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment
par: Zhang, Yifan, et autres
Publié: (2024)
par: Zhang, Yifan, et autres
Publié: (2024)
Argument Quality Assessment in the Age of Instruction-Following Large Language Models
par: Wachsmuth, Henning, et autres
Publié: (2024)
par: Wachsmuth, Henning, et autres
Publié: (2024)
Energy-Based Preference Model Offers Better Offline Alignment than the Bradley-Terry Preference Model
par: Hong, Yuzhong, et autres
Publié: (2024)
par: Hong, Yuzhong, et autres
Publié: (2024)
Are Large Language Models Reliable Argument Quality Annotators?
par: Mirzakhmedova, Nailia, et autres
Publié: (2024)
par: Mirzakhmedova, Nailia, et autres
Publié: (2024)
Contextualizing Argument Quality Assessment with Relevant Knowledge
par: Deshpande, Darshan, et autres
Publié: (2023)
par: Deshpande, Darshan, et autres
Publié: (2023)
Argument Summarization and its Evaluation in the Era of Large Language Models
par: Altemeyer, Moritz, et autres
Publié: (2025)
par: Altemeyer, Moritz, et autres
Publié: (2025)
Is Safer Better? The Impact of Guardrails on the Argumentative Strength of LLMs in Hate Speech Countering
par: Bonaldi, Helena, et autres
Publié: (2024)
par: Bonaldi, Helena, et autres
Publié: (2024)
Towards a Perspectivist Turn in Argument Quality Assessment
par: Romberg, Julia, et autres
Publié: (2025)
par: Romberg, Julia, et autres
Publié: (2025)
Large Language Models in Argument Mining: A Survey
par: Li, Hao, et autres
Publié: (2025)
par: Li, Hao, et autres
Publié: (2025)
LLM Comparative Assessment: Zero-shot NLG Evaluation through Pairwise Comparisons using Large Language Models
par: Liusie, Adian, et autres
Publié: (2023)
par: Liusie, Adian, et autres
Publié: (2023)
"I'd Like to Have an Argument, Please": Argumentative Reasoning in Large Language Models
par: de Wynter, Adrian, et autres
Publié: (2023)
par: de Wynter, Adrian, et autres
Publié: (2023)
Exploring the Potential of Large Language Models in Computational Argumentation
par: Chen, Guizhen, et autres
Publié: (2023)
par: Chen, Guizhen, et autres
Publié: (2023)
A Unified Assessment of the Poverty of the Stimulus Argument for Neural Language Models
par: Yang, Xiulin, et autres
Publié: (2026)
par: Yang, Xiulin, et autres
Publié: (2026)
Detecting Winning Arguments with Large Language Models and Persuasion Strategies
par: Labruna, Tiziano, et autres
Publié: (2026)
par: Labruna, Tiziano, et autres
Publié: (2026)
Analysis of Argument Structure Constructions in the Large Language Model BERT
par: Ramezani, Pegah, et autres
Publié: (2024)
par: Ramezani, Pegah, et autres
Publié: (2024)
Persuasiveness of Generated Free-Text Rationales in Subjective Decisions: A Case Study on Pairwise Argument Ranking
par: Elaraby, Mohamed, et autres
Publié: (2024)
par: Elaraby, Mohamed, et autres
Publié: (2024)
Knockout LLM Assessment: Using Large Language Models for Evaluations through Iterative Pairwise Comparisons
par: Sandan, Isik Baran, et autres
Publié: (2025)
par: Sandan, Isik Baran, et autres
Publié: (2025)
Estimating the Error of Large Language Models at Pairwise Text Comparison
par: Li, Tianyi
Publié: (2025)
par: Li, Tianyi
Publié: (2025)
Assessing Open-Source Large Language Models on Argumentation Mining Subtasks
par: Abkenar, Mohammad Yeghaneh, et autres
Publié: (2024)
par: Abkenar, Mohammad Yeghaneh, et autres
Publié: (2024)
Echoes of Agreement: Argument Driven Opinion Shifts in Large Language Models
par: Kaur, Avneet
Publié: (2025)
par: Kaur, Avneet
Publié: (2025)
Analyzing Large Language Models for Classroom Discussion Assessment
par: Tran, Nhat, et autres
Publié: (2024)
par: Tran, Nhat, et autres
Publié: (2024)
Evaluating Uncertainty Quantification Methods in Argumentative Large Language Models
par: Zhou, Kevin, et autres
Publié: (2025)
par: Zhou, Kevin, et autres
Publié: (2025)
Concept-Guided Chain-of-Thought Prompting for Pairwise Comparison Scoring of Texts with Large Language Models
par: Wu, Patrick Y., et autres
Publié: (2023)
par: Wu, Patrick Y., et autres
Publié: (2023)
Measuring Psychological States Through Semantic Projection: A Theory-Driven Approach to Language-Based Assessment
par: Luongo, Maria, et autres
Publié: (2026)
par: Luongo, Maria, et autres
Publié: (2026)
Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting
par: Qin, Zhen, et autres
Publié: (2023)
par: Qin, Zhen, et autres
Publié: (2023)
CLEAR: A Comprehensive Linguistic Evaluation of Argument Rewriting by Large Language Models
par: Huber, Thomas, et autres
Publié: (2025)
par: Huber, Thomas, et autres
Publié: (2025)
PairUni: Pairwise Training for Unified Multimodal Language Models
par: Zheng, Jiani, et autres
Publié: (2025)
par: Zheng, Jiani, et autres
Publié: (2025)
Utilising Large Language Models for Generating Effective Counter Arguments to Anti-Vaccine Tweets
par: Dhanuka, Utsav, et autres
Publié: (2025)
par: Dhanuka, Utsav, et autres
Publié: (2025)
Can Language Models Recognize Convincing Arguments?
par: Rescala, Paula, et autres
Publié: (2024)
par: Rescala, Paula, et autres
Publié: (2024)
The Bradley-Terry Stochastic Block Model
par: Santi, Lapo, et autres
Publié: (2025)
par: Santi, Lapo, et autres
Publié: (2025)
CASA: Causality-driven Argument Sufficiency Assessment
par: Liu, Xiao, et autres
Publié: (2024)
par: Liu, Xiao, et autres
Publié: (2024)
MMRQA: Signal-Enhanced Multimodal Large Language Models for MRI Quality Assessment
par: Jia, Fankai, et autres
Publié: (2025)
par: Jia, Fankai, et autres
Publié: (2025)
A Psycholinguistic Evaluation of Language Models' Sensitivity to Argument Roles
par: Lee, Eun-Kyoung Rosa, et autres
Publié: (2024)
par: Lee, Eun-Kyoung Rosa, et autres
Publié: (2024)
Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
par: Liu, Yinhong, et autres
Publié: (2024)
par: Liu, Yinhong, et autres
Publié: (2024)
Using Large Language Models for (De-)Formalization and Natural Argumentation Exercises for Beginner's Students
par: Carl, Merlin
Publié: (2023)
par: Carl, Merlin
Publié: (2023)
Aligning Large Language Models for Faithful Integrity Against Opposing Argument
par: Zhao, Yong, et autres
Publié: (2025)
par: Zhao, Yong, et autres
Publié: (2025)
Leveraging Small LLMs for Argument Mining in Education: Argument Component Identification, Classification, and Assessment
par: Favero, Lucile, et autres
Publié: (2025)
par: Favero, Lucile, et autres
Publié: (2025)
Documents similaires
-
Leveraging Argument Structure to Predict Content Hatefulness
par: Ocampo, Nicolás Benjamín, et autres
Publié: (2026) -
When Hate Meets Facts: LLMs-in-the-Loop for Check-worthiness Detection in Hate Speech
par: Ocampo, Nicolás Benjamín, et autres
Publié: (2026) -
Bradley-Terry and Multi-Objective Reward Modeling Are Complementary
par: Zhang, Zhiwei, et autres
Publié: (2025) -
Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment
par: Zhang, Yifan, et autres
Publié: (2024) -
Argument Quality Assessment in the Age of Instruction-Following Large Language Models
par: Wachsmuth, Henning, et autres
Publié: (2024)