LLM-based Rewriting of Inappropriate Argumentation using Reinforcement Learning from Machine Feedback
Fuente:
arXiv
Salvato in:
| Autori principali: | Ziegenbein, Timon, Skitalinskaya, Gabriella, Makou, Alireza Bayat, Wachsmuth, Henning |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Teaching LLMs Human-Like Editing of Inappropriate Argumentation via Reinforcement Learning
di: Ziegenbein, Timon, et al.
Pubblicazione: (2026)
di: Ziegenbein, Timon, et al.
Pubblicazione: (2026)
ArgInstruct: Specialized Instruction Fine-Tuning for Computational Argumentation
di: Stahl, Maja, et al.
Pubblicazione: (2025)
di: Stahl, Maja, et al.
Pubblicazione: (2025)
Argument Quality Assessment in the Age of Instruction-Following Large Language Models
di: Wachsmuth, Henning, et al.
Pubblicazione: (2024)
di: Wachsmuth, Henning, et al.
Pubblicazione: (2024)
Towards a Perspectivist Turn in Argument Quality Assessment
di: Romberg, Julia, et al.
Pubblicazione: (2025)
di: Romberg, Julia, et al.
Pubblicazione: (2025)
Exploring LLM Prompting Strategies for Joint Essay Scoring and Feedback Generation
di: Stahl, Maja, et al.
Pubblicazione: (2024)
di: Stahl, Maja, et al.
Pubblicazione: (2024)
ArgBench: Benchmarking LLMs on Computational Argumentation Tasks
di: Ajjour, Yamen, et al.
Pubblicazione: (2026)
di: Ajjour, Yamen, et al.
Pubblicazione: (2026)
A School Student Essay Corpus for Analyzing Interactions of Argumentative Structure and Quality
di: Stahl, Maja, et al.
Pubblicazione: (2024)
di: Stahl, Maja, et al.
Pubblicazione: (2024)
Disentangling Dialect from Social Bias via Multitask Learning to Improve Fairness
di: Spliethöver, Maximilian, et al.
Pubblicazione: (2024)
di: Spliethöver, Maximilian, et al.
Pubblicazione: (2024)
Dr Genre: Reinforcement Learning from Decoupled LLM Feedback for Generic Text Rewriting
di: Li, Yufei, et al.
Pubblicazione: (2025)
di: Li, Yufei, et al.
Pubblicazione: (2025)
In-Context Learning with Reinforcement Learning for Incomplete Utterance Rewriting
di: Du, Haowei, et al.
Pubblicazione: (2024)
di: Du, Haowei, et al.
Pubblicazione: (2024)
Learning to Rewrite: Generalized LLM-Generated Text Detection
di: Li, Ran, et al.
Pubblicazione: (2024)
di: Li, Ran, et al.
Pubblicazione: (2024)
Investigating Subjective Factors of Argument Strength: Storytelling, Emotions, and Hedging
di: Quensel, Carlotta, et al.
Pubblicazione: (2025)
di: Quensel, Carlotta, et al.
Pubblicazione: (2025)
PRewrite: Prompt Rewriting with Reinforcement Learning
di: Kong, Weize, et al.
Pubblicazione: (2024)
di: Kong, Weize, et al.
Pubblicazione: (2024)
CLEAR: A Comprehensive Linguistic Evaluation of Argument Rewriting by Large Language Models
di: Huber, Thomas, et al.
Pubblicazione: (2025)
di: Huber, Thomas, et al.
Pubblicazione: (2025)
Modeling the Quality of Dialogical Explanations
di: Alshomary, Milad, et al.
Pubblicazione: (2024)
di: Alshomary, Milad, et al.
Pubblicazione: (2024)
An LLM-Based System for Argument Mining
di: Pirozelli, Paulo, et al.
Pubblicazione: (2026)
di: Pirozelli, Paulo, et al.
Pubblicazione: (2026)
R-Bot: An LLM-based Query Rewrite System
di: Sun, Zhaoyan, et al.
Pubblicazione: (2024)
di: Sun, Zhaoyan, et al.
Pubblicazione: (2024)
Incorporating Self-Rewriting into Large Language Model Reasoning Reinforcement
di: Yao, Jiashu, et al.
Pubblicazione: (2025)
di: Yao, Jiashu, et al.
Pubblicazione: (2025)
Learning from Natural Language Feedback for Personalized Question Answering
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
Reinforcement Learning from Denoising Feedback
di: He, Qi, et al.
Pubblicazione: (2026)
di: He, Qi, et al.
Pubblicazione: (2026)
Curiosity-Driven Reinforcement Learning from Human Feedback
di: Sun, Haoran, et al.
Pubblicazione: (2025)
di: Sun, Haoran, et al.
Pubblicazione: (2025)
Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning
di: Wu, Yuhang, et al.
Pubblicazione: (2026)
di: Wu, Yuhang, et al.
Pubblicazione: (2026)
RaFe: Ranking Feedback Improves Query Rewriting for RAG
di: Mao, Shengyu, et al.
Pubblicazione: (2024)
di: Mao, Shengyu, et al.
Pubblicazione: (2024)
Adaptive Prompting: Ad-hoc Prompt Composition for Social Bias Detection
di: Spliethöver, Maximilian, et al.
Pubblicazione: (2025)
di: Spliethöver, Maximilian, et al.
Pubblicazione: (2025)
Understanding Enthymemes in Argument Maps: Bridging Argument Mining and Logic-based Argumentation
di: Ben-Naim, Jonathan, et al.
Pubblicazione: (2024)
di: Ben-Naim, Jonathan, et al.
Pubblicazione: (2024)
Learning to Rewrite Prompts for Personalized Text Generation
di: Li, Cheng, et al.
Pubblicazione: (2023)
di: Li, Cheng, et al.
Pubblicazione: (2023)
Reinforcement World Model Learning for LLM-based Agents
di: Yu, Xiao, et al.
Pubblicazione: (2026)
di: Yu, Xiao, et al.
Pubblicazione: (2026)
MaFeRw: Query Rewriting with Multi-Aspect Feedbacks for Retrieval-Augmented Large Language Models
di: Wang, Yujing, et al.
Pubblicazione: (2024)
di: Wang, Yujing, et al.
Pubblicazione: (2024)
Annotation-Free Reinforcement Learning Query Rewriting via Verifiable Search Reward
di: Cha, Sungguk, et al.
Pubblicazione: (2025)
di: Cha, Sungguk, et al.
Pubblicazione: (2025)
ArgCMV: An Argument Summarization Benchmark for the LLM-era
di: Gurjar, Omkar, et al.
Pubblicazione: (2025)
di: Gurjar, Omkar, et al.
Pubblicazione: (2025)
E3-Rewrite: Learning to Rewrite SQL for Executability, Equivalence,and Efficiency
di: Xu, Dongjie, et al.
Pubblicazione: (2025)
di: Xu, Dongjie, et al.
Pubblicazione: (2025)
Reinforcement Learning from Compiler and Language Server Feedback
di: Zhang, Yifan, et al.
Pubblicazione: (2025)
di: Zhang, Yifan, et al.
Pubblicazione: (2025)
Learning to Summarize from LLM-generated Feedback
di: Song, Hwanjun, et al.
Pubblicazione: (2024)
di: Song, Hwanjun, et al.
Pubblicazione: (2024)
CR4T: Rewrite-Based Guardrails for Adolescent LLM Safety
di: An, Heajun, et al.
Pubblicazione: (2026)
di: An, Heajun, et al.
Pubblicazione: (2026)
MA-RLHF: Reinforcement Learning from Human Feedback with Macro Actions
di: Chai, Yekun, et al.
Pubblicazione: (2024)
di: Chai, Yekun, et al.
Pubblicazione: (2024)
LLM-based Frameworks for API Argument Filling in Task-Oriented Conversational Systems
di: Mok, Jisoo, et al.
Pubblicazione: (2024)
di: Mok, Jisoo, et al.
Pubblicazione: (2024)
Evaluating LLM-Driven Summarisation of Parliamentary Debates with Computational Argumentation
di: Cunningham, Eoghan, et al.
Pubblicazione: (2026)
di: Cunningham, Eoghan, et al.
Pubblicazione: (2026)
Understanding and Analyzing Inappropriately Targeting Language in Online Discourse: A Comparative Annotation Study
di: Barbarestani, Baran, et al.
Pubblicazione: (2025)
di: Barbarestani, Baran, et al.
Pubblicazione: (2025)
Do Emotions Really Affect Argument Convincingness? A Dynamic Approach with LLM-based Manipulation Checks
di: Chen, Yanran, et al.
Pubblicazione: (2025)
di: Chen, Yanran, et al.
Pubblicazione: (2025)
Adaptive Query Rewriting: Aligning Rewriters through Marginal Probability of Conversational Answers
di: Zhang, Tianhua, et al.
Pubblicazione: (2024)
di: Zhang, Tianhua, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Teaching LLMs Human-Like Editing of Inappropriate Argumentation via Reinforcement Learning
di: Ziegenbein, Timon, et al.
Pubblicazione: (2026) -
ArgInstruct: Specialized Instruction Fine-Tuning for Computational Argumentation
di: Stahl, Maja, et al.
Pubblicazione: (2025) -
Argument Quality Assessment in the Age of Instruction-Following Large Language Models
di: Wachsmuth, Henning, et al.
Pubblicazione: (2024) -
Towards a Perspectivist Turn in Argument Quality Assessment
di: Romberg, Julia, et al.
Pubblicazione: (2025) -
Exploring LLM Prompting Strategies for Joint Essay Scoring and Feedback Generation
di: Stahl, Maja, et al.
Pubblicazione: (2024)