Ethics and Persuasion in Reinforcement Learning from Human Feedback: A Procedural Rhetorical Approach
Fuente:
arXiv
Salvato in:
| Autori principali: | Lodoen, Shannon, Orchard, Alexi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability
di: Alsagheer, Dana, et al.
Pubblicazione: (2025)
di: Alsagheer, Dana, et al.
Pubblicazione: (2025)
A Mechanism-Based Approach to Mitigating Harms from Persuasive Generative AI
di: El-Sayed, Seliem, et al.
Pubblicazione: (2024)
di: El-Sayed, Seliem, et al.
Pubblicazione: (2024)
How Persuasive Could LLMs Be? A First Study Combining Linguistic-Rhetorical Analysis and User Experiments
di: Raffini, Daniel, et al.
Pubblicazione: (2025)
di: Raffini, Daniel, et al.
Pubblicazione: (2025)
A Capability Approach to AI Ethics
di: Ratti, Emanuele, et al.
Pubblicazione: (2025)
di: Ratti, Emanuele, et al.
Pubblicazione: (2025)
Enhancing Safety in Reinforcement Learning with Human Feedback via Rectified Policy Optimization
di: Peng, Xiyue, et al.
Pubblicazione: (2024)
di: Peng, Xiyue, et al.
Pubblicazione: (2024)
Reinforcement Learning from Human Feedback: Whose Culture, Whose Values, Whose Perspectives?
di: Barman, Kristian González, et al.
Pubblicazione: (2024)
di: Barman, Kristian González, et al.
Pubblicazione: (2024)
EthicAlly: a Prototype for AI-Powered Research Ethics Support for the Social Sciences and Humanities
di: Grohmann, Steph
Pubblicazione: (2025)
di: Grohmann, Steph
Pubblicazione: (2025)
Commercial Persuasion in AI-Mediated Conversations
di: Salvi, Francesco, et al.
Pubblicazione: (2026)
di: Salvi, Francesco, et al.
Pubblicazione: (2026)
Must Read: A Comprehensive Survey of Computational Persuasion
di: Bozdag, Nimet Beyza, et al.
Pubblicazione: (2025)
di: Bozdag, Nimet Beyza, et al.
Pubblicazione: (2025)
ElecTwit: A Framework for Studying Persuasion in Multi-Agent Social Systems
di: Bao, Michael
Pubblicazione: (2026)
di: Bao, Michael
Pubblicazione: (2026)
Introducing ELLIPS: An Ethics-Centered Approach to Research on LLM-Based Inference of Psychiatric Conditions
di: Rocca, Roberta, et al.
Pubblicazione: (2024)
di: Rocca, Roberta, et al.
Pubblicazione: (2024)
The Ethics of AI in Education
di: Porayska-Pomsta, Kaska, et al.
Pubblicazione: (2024)
di: Porayska-Pomsta, Kaska, et al.
Pubblicazione: (2024)
Reconciling Different Theories of Learning with an Agent-based Model of Procedural Learning
di: Rismanchian, Sina, et al.
Pubblicazione: (2024)
di: Rismanchian, Sina, et al.
Pubblicazione: (2024)
Three Kinds of AI Ethics
di: Ratti, Emanuele
Pubblicazione: (2025)
di: Ratti, Emanuele
Pubblicazione: (2025)
Uncertain Machine Ethics Planning
di: Kolker, Simon, et al.
Pubblicazione: (2025)
di: Kolker, Simon, et al.
Pubblicazione: (2025)
The Ethics of AI Value Chains
di: Attard-Frost, Blair, et al.
Pubblicazione: (2023)
di: Attard-Frost, Blair, et al.
Pubblicazione: (2023)
Tesla's Autopilot: Ethics and Tragedy
di: Jatavallabha, Aravinda
Pubblicazione: (2024)
di: Jatavallabha, Aravinda
Pubblicazione: (2024)
Perceived Political Bias in LLMs Reduces Persuasive Abilities
di: DiGiuseppe, Matthew, et al.
Pubblicazione: (2026)
di: DiGiuseppe, Matthew, et al.
Pubblicazione: (2026)
A Cross-Domain Study of the Use of Persuasion Techniques in Online Disinformation
di: Leite, João A., et al.
Pubblicazione: (2024)
di: Leite, João A., et al.
Pubblicazione: (2024)
Building Resilient Information Ecosystems: Large LLM-Generated Dataset of Persuasion Attacks
di: Kao, Hsien-Te, et al.
Pubblicazione: (2025)
di: Kao, Hsien-Te, et al.
Pubblicazione: (2025)
"I Hadn't Thought About That": Creators of Human-like AI Weigh in on Ethics And Neurodivergence
di: Rizvi, Naba, et al.
Pubblicazione: (2025)
di: Rizvi, Naba, et al.
Pubblicazione: (2025)
Towards Detecting Persuasion on Social Media: From Model Development to Insights on Persuasion Strategies
di: Meguellati, Elyas, et al.
Pubblicazione: (2025)
di: Meguellati, Elyas, et al.
Pubblicazione: (2025)
Survey on AI Ethics: A Socio-technical Perspective
di: Mbiazi, Dave, et al.
Pubblicazione: (2023)
di: Mbiazi, Dave, et al.
Pubblicazione: (2023)
The Convergent Ethics of AI? Analyzing Moral Foundation Priorities in Large Language Models with a Multi-Framework Approach
di: Coleman, Chad, et al.
Pubblicazione: (2025)
di: Coleman, Chad, et al.
Pubblicazione: (2025)
The Hidden Costs of AI-Mediated Political Outreach: Persuasion and AI Penalties in the US and UK
di: Jungherr, Andreas, et al.
Pubblicazione: (2026)
di: Jungherr, Andreas, et al.
Pubblicazione: (2026)
Towards an Environmental Ethics of Artificial Intelligence
di: van Uffelen, Nynke, et al.
Pubblicazione: (2024)
di: van Uffelen, Nynke, et al.
Pubblicazione: (2024)
Ethic-BERT: An Enhanced Deep Learning Model for Ethical and Non-Ethical Content Classification
di: Mahadi, Mahamodul Hasan, et al.
Pubblicazione: (2025)
di: Mahadi, Mahamodul Hasan, et al.
Pubblicazione: (2025)
A Study on the Framework for Evaluating the Ethics and Trustworthiness of Generative AI
di: Jeong, Cheonsu, et al.
Pubblicazione: (2025)
di: Jeong, Cheonsu, et al.
Pubblicazione: (2025)
Ethics Readiness of Artificial Intelligence: A Practical Evaluation Method
di: Adomaitis, Laurynas, et al.
Pubblicazione: (2025)
di: Adomaitis, Laurynas, et al.
Pubblicazione: (2025)
Mapping the Ethics of Generative AI: A Comprehensive Scoping Review
di: Hagendorff, Thilo
Pubblicazione: (2024)
di: Hagendorff, Thilo
Pubblicazione: (2024)
Student views in AI Ethics and Social Impact
di: Mihoc, Tudor-Dan, et al.
Pubblicazione: (2026)
di: Mihoc, Tudor-Dan, et al.
Pubblicazione: (2026)
AI Ethics: A Bibliometric Analysis, Critical Issues, and Key Gaps
di: Gao, Di Kevin, et al.
Pubblicazione: (2024)
di: Gao, Di Kevin, et al.
Pubblicazione: (2024)
Towards Strategic Persuasion with Language Models
di: Cheng, Zirui, et al.
Pubblicazione: (2025)
di: Cheng, Zirui, et al.
Pubblicazione: (2025)
Automated Formative Feedback for Short-form Writing: An LLM-Driven Approach and Adoption Analysis
di: Tavares, Tiago Fernandes, et al.
Pubblicazione: (2025)
di: Tavares, Tiago Fernandes, et al.
Pubblicazione: (2025)
ApplE: An Applied Ethics Ontology with Event Context
di: Aijaz, Aisha, et al.
Pubblicazione: (2025)
di: Aijaz, Aisha, et al.
Pubblicazione: (2025)
Preventing AI Deepfake Abuse: An Islamic Ethics Framework
di: Uriawan, Wisnu, et al.
Pubblicazione: (2025)
di: Uriawan, Wisnu, et al.
Pubblicazione: (2025)
Interoperability in AI Safety Governance: Ethics, Regulations, and Standards
di: Chin, Yik Chan, et al.
Pubblicazione: (2026)
di: Chin, Yik Chan, et al.
Pubblicazione: (2026)
The Levers of Political Persuasion with Conversational AI
di: Hackenburg, Kobi, et al.
Pubblicazione: (2025)
di: Hackenburg, Kobi, et al.
Pubblicazione: (2025)
Privacy Ethics Alignment in AI: A Stakeholder-Centric Framework for Ethical AI
di: Barthwal, Ankur, et al.
Pubblicazione: (2025)
di: Barthwal, Ankur, et al.
Pubblicazione: (2025)
Labeling Messages as AI-Generated Does Not Reduce Their Persuasive Effects
di: Gallegos, Isabel O., et al.
Pubblicazione: (2025)
di: Gallegos, Isabel O., et al.
Pubblicazione: (2025)
Documenti analoghi
-
Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability
di: Alsagheer, Dana, et al.
Pubblicazione: (2025) -
A Mechanism-Based Approach to Mitigating Harms from Persuasive Generative AI
di: El-Sayed, Seliem, et al.
Pubblicazione: (2024) -
How Persuasive Could LLMs Be? A First Study Combining Linguistic-Rhetorical Analysis and User Experiments
di: Raffini, Daniel, et al.
Pubblicazione: (2025) -
A Capability Approach to AI Ethics
di: Ratti, Emanuele, et al.
Pubblicazione: (2025) -
Enhancing Safety in Reinforcement Learning with Human Feedback via Rectified Policy Optimization
di: Peng, Xiyue, et al.
Pubblicazione: (2024)