Teaching LLMs Human-Like Editing of Inappropriate Argumentation via Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Ziegenbein, Timon, Stahl, Maja, Wachsmuth, Henning |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ArgInstruct: Specialized Instruction Fine-Tuning for Computational Argumentation
by: Stahl, Maja, et al.
Published: (2025)
by: Stahl, Maja, et al.
Published: (2025)
LLM-based Rewriting of Inappropriate Argumentation using Reinforcement Learning from Machine Feedback
by: Ziegenbein, Timon, et al.
Published: (2024)
by: Ziegenbein, Timon, et al.
Published: (2024)
Argument Quality Assessment in the Age of Instruction-Following Large Language Models
by: Wachsmuth, Henning, et al.
Published: (2024)
by: Wachsmuth, Henning, et al.
Published: (2024)
A School Student Essay Corpus for Analyzing Interactions of Argumentative Structure and Quality
by: Stahl, Maja, et al.
Published: (2024)
by: Stahl, Maja, et al.
Published: (2024)
Exploring LLM Prompting Strategies for Joint Essay Scoring and Feedback Generation
by: Stahl, Maja, et al.
Published: (2024)
by: Stahl, Maja, et al.
Published: (2024)
ArgBench: Benchmarking LLMs on Computational Argumentation Tasks
by: Ajjour, Yamen, et al.
Published: (2026)
by: Ajjour, Yamen, et al.
Published: (2026)
Towards a Perspectivist Turn in Argument Quality Assessment
by: Romberg, Julia, et al.
Published: (2025)
by: Romberg, Julia, et al.
Published: (2025)
Disentangling Dialect from Social Bias via Multitask Learning to Improve Fairness
by: Spliethöver, Maximilian, et al.
Published: (2024)
by: Spliethöver, Maximilian, et al.
Published: (2024)
Teaching Values to Machines: Simulating Human-Like Behavior in LLMs
by: Yehudai, Asaf, et al.
Published: (2026)
by: Yehudai, Asaf, et al.
Published: (2026)
TeaMs-RL: Teaching LLMs to Generate Better Instruction Datasets via Reinforcement Learning
by: Gu, Shangding, et al.
Published: (2024)
by: Gu, Shangding, et al.
Published: (2024)
"I'd Like to Have an Argument, Please": Argumentative Reasoning in Large Language Models
by: de Wynter, Adrian, et al.
Published: (2023)
by: de Wynter, Adrian, et al.
Published: (2023)
Fearful Falcons and Angry Llamas: Emotion Category Annotations of Arguments by Humans and LLMs
by: Greschner, Lynn, et al.
Published: (2024)
by: Greschner, Lynn, et al.
Published: (2024)
S$^2$R: Teaching LLMs to Self-verify and Self-correct via Reinforcement Learning
by: Ma, Ruotian, et al.
Published: (2025)
by: Ma, Ruotian, et al.
Published: (2025)
Teaching LLMs for Step-Level Automatic Math Correction via Reinforcement Learning
by: Li, Junsong, et al.
Published: (2025)
by: Li, Junsong, et al.
Published: (2025)
Modeling the Quality of Dialogical Explanations
by: Alshomary, Milad, et al.
Published: (2024)
by: Alshomary, Milad, et al.
Published: (2024)
Argument Reconstruction as Supervision for Critical Thinking in LLMs
by: Ryu, Hyun, et al.
Published: (2026)
by: Ryu, Hyun, et al.
Published: (2026)
Argument-Based Consistency in Toxicity Explanations of LLMs
by: Mothilal, Ramaravind Kommiya, et al.
Published: (2025)
by: Mothilal, Ramaravind Kommiya, et al.
Published: (2025)
Can LLMs Extract Frame-Semantic Arguments?
by: Devasier, Jacob, et al.
Published: (2025)
by: Devasier, Jacob, et al.
Published: (2025)
LLMs Do Not Grade Essays Like Humans
by: Mathew, Jerin George, et al.
Published: (2026)
by: Mathew, Jerin George, et al.
Published: (2026)
LLMs for Argument Mining: Detection, Extraction, and Relationship Classification of pre-defined Arguments in Online Comments
by: Guida, Matteo, et al.
Published: (2025)
by: Guida, Matteo, et al.
Published: (2025)
Learning to Edit: Aligning LLMs with Knowledge Editing
by: Jiang, Yuxin, et al.
Published: (2024)
by: Jiang, Yuxin, et al.
Published: (2024)
Learning to Shop Like Humans: A Review-driven Retrieval-Augmented Recommendation Framework with LLMs
by: Wei, Kaiwen, et al.
Published: (2025)
by: Wei, Kaiwen, et al.
Published: (2025)
Shop-R1: Rewarding LLMs to Simulate Human Behavior in Online Shopping via Reinforcement Learning
by: Zhang, Yimeng, et al.
Published: (2025)
by: Zhang, Yimeng, et al.
Published: (2025)
Leveraging Small LLMs for Argument Mining in Education: Argument Component Identification, Classification, and Assessment
by: Favero, Lucile, et al.
Published: (2025)
by: Favero, Lucile, et al.
Published: (2025)
Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning
by: Zhang, Haozhen, et al.
Published: (2025)
by: Zhang, Haozhen, et al.
Published: (2025)
RLKD: Distilling LLMs' Reasoning via Reinforcement Learning
by: Xu, Shicheng, et al.
Published: (2025)
by: Xu, Shicheng, et al.
Published: (2025)
Understanding The Effect Of Temperature On Alignment With Human Opinions
by: Pavlovic, Maja, et al.
Published: (2024)
by: Pavlovic, Maja, et al.
Published: (2024)
Adaptive Prompting: Ad-hoc Prompt Composition for Social Bias Detection
by: Spliethöver, Maximilian, et al.
Published: (2025)
by: Spliethöver, Maximilian, et al.
Published: (2025)
Can LLMs Judge Debates? Evaluating Non-Linear Reasoning via Argumentation Theory Semantics
by: Sanayei, Reza, et al.
Published: (2025)
by: Sanayei, Reza, et al.
Published: (2025)
From Reviews to Requirements: Can LLMs Generate Human-Like User Stories?
by: Sakib, Shadman, et al.
Published: (2026)
by: Sakib, Shadman, et al.
Published: (2026)
Improving Large Language Models via Fine-grained Reinforcement Learning with Minimum Editing Constraint
by: Chen, Zhipeng, et al.
Published: (2024)
by: Chen, Zhipeng, et al.
Published: (2024)
AgentGL: Towards Agentic Graph Learning with LLMs via Reinforcement Learning
by: Sun, Yuanfu, et al.
Published: (2026)
by: Sun, Yuanfu, et al.
Published: (2026)
From Problem-Solving to Teaching Problem-Solving: Aligning LLMs with Pedagogy using Reinforcement Learning
by: Dinucu-Jianu, David, et al.
Published: (2025)
by: Dinucu-Jianu, David, et al.
Published: (2025)
Soft Inductive Bias Approach via Explicit Reasoning Perspectives in Inappropriate Utterance Detection Using Large Language Models
by: Kim, Ju-Young, et al.
Published: (2025)
by: Kim, Ju-Young, et al.
Published: (2025)
HiEdit: Lifelong Model Editing with Hierarchical Reinforcement Learning
by: Wang, Yangfan, et al.
Published: (2026)
by: Wang, Yangfan, et al.
Published: (2026)
Teaching Human Behavior Improves Content Understanding Abilities Of LLMs
by: Singh, Somesh, et al.
Published: (2024)
by: Singh, Somesh, et al.
Published: (2024)
SMART-Editor: A Multi-Agent Framework for Human-Like Design Editing with Structural Integrity
by: Mondal, Ishani, et al.
Published: (2025)
by: Mondal, Ishani, et al.
Published: (2025)
Understanding and Mitigating Gender Bias in LLMs via Interpretable Neuron Editing
by: Yu, Zeping, et al.
Published: (2025)
by: Yu, Zeping, et al.
Published: (2025)
Teaching Language Models to Critique via Reinforcement Learning
by: Xie, Zhihui, et al.
Published: (2025)
by: Xie, Zhihui, et al.
Published: (2025)
Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning
by: Lin, Jiacheng, et al.
Published: (2025)
by: Lin, Jiacheng, et al.
Published: (2025)
Similar Items
-
ArgInstruct: Specialized Instruction Fine-Tuning for Computational Argumentation
by: Stahl, Maja, et al.
Published: (2025) -
LLM-based Rewriting of Inappropriate Argumentation using Reinforcement Learning from Machine Feedback
by: Ziegenbein, Timon, et al.
Published: (2024) -
Argument Quality Assessment in the Age of Instruction-Following Large Language Models
by: Wachsmuth, Henning, et al.
Published: (2024) -
A School Student Essay Corpus for Analyzing Interactions of Argumentative Structure and Quality
by: Stahl, Maja, et al.
Published: (2024) -
Exploring LLM Prompting Strategies for Joint Essay Scoring and Feedback Generation
by: Stahl, Maja, et al.
Published: (2024)