Beyond Ethical Alignment: Evaluating LLMs as Artificial Moral Assistants
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Galatolo, Alessio, Rappuoli, Luca Alberto, Winkle, Katie, Beloucif, Meriem |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DIEKAE: Difference Injection for Efficient Knowledge Augmentation and Editing of Large Language Models
par: Galatolo, Alessio, et autres
Publié: (2024)
par: Galatolo, Alessio, et autres
Publié: (2024)
Visualising Policy-Reward Interplay to Inform Zeroth-Order Preference Optimisation of Large Language Models
par: Galatolo, Alessio, et autres
Publié: (2025)
par: Galatolo, Alessio, et autres
Publié: (2025)
Moral Persuasion in Large Language Models: Evaluating Susceptibility and Ethical Alignment
par: Huang, Allison, et autres
Publié: (2024)
par: Huang, Allison, et autres
Publié: (2024)
Ethical Reasoning and Moral Value Alignment of LLMs Depend on the Language we Prompt them in
par: Agarwal, Utkarsh, et autres
Publié: (2024)
par: Agarwal, Utkarsh, et autres
Publié: (2024)
Product Development within Artificial Intelligence, Ethics and Legal Risk
par: Winkle, Thomas
Publié: (2022)
par: Winkle, Thomas
Publié: (2022)
Beyond Binary Moral Judgment: Modeling Ethical Pluralism in AI
par: Aijaz, Aisha, et autres
Publié: (2026)
par: Aijaz, Aisha, et autres
Publié: (2026)
MoralBench: Moral Evaluation of LLMs
par: Ji, Jianchao, et autres
Publié: (2024)
par: Ji, Jianchao, et autres
Publié: (2024)
Fusion-Eval: Integrating Assistant Evaluators with LLMs
par: Shu, Lei, et autres
Publié: (2023)
par: Shu, Lei, et autres
Publié: (2023)
The Moral Consistency Pipeline: Continuous Ethical Evaluation for Large Language Models
par: Jamshidi, Saeid, et autres
Publié: (2025)
par: Jamshidi, Saeid, et autres
Publié: (2025)
Virtue Ethics For Ethically Tunable Robotic Assistants
par: Ramanayake, Rajitha, et autres
Publié: (2024)
par: Ramanayake, Rajitha, et autres
Publié: (2024)
Lessons Without Borders? Evaluating Cultural Alignment of LLMs Using Multilingual Story Moral Generation
par: Wu, Sophie, et autres
Publié: (2026)
par: Wu, Sophie, et autres
Publié: (2026)
Data-driven Exploration of Mobility Interaction Patterns
par: Galatolo, Gabriele, et autres
Publié: (2025)
par: Galatolo, Gabriele, et autres
Publié: (2025)
Promoting the Responsible Development of Speech Datasets for Mental Health and Neurological Disorders Research
par: Mancini, Eleonora, et autres
Publié: (2024)
par: Mancini, Eleonora, et autres
Publié: (2024)
Interpretable Machine Learning for Oral Lesion Diagnosis through Prototypical Instances Identification
par: Cascione, Alessio, et autres
Publié: (2025)
par: Cascione, Alessio, et autres
Publié: (2025)
Operationalizing Perceptions of Agent Gender: Foundations and Guidelines
par: Seaborn, Katie, et autres
Publié: (2026)
par: Seaborn, Katie, et autres
Publié: (2026)
Defining Boundaries: The Impact of Domain Specification on Cross-Language and Cross-Domain Transfer in Machine Translation
par: Shahnazaryan, Lia, et autres
Publié: (2024)
par: Shahnazaryan, Lia, et autres
Publié: (2024)
The Moral Turing Test: Evaluating Human-LLM Alignment in Moral Decision-Making
par: Garcia, Basile, et autres
Publié: (2024)
par: Garcia, Basile, et autres
Publié: (2024)
Philosophical Specification of Empathetic Ethical Artificial Intelligence
par: Bennett, Michael Timothy, et autres
Publié: (2021)
par: Bennett, Michael Timothy, et autres
Publié: (2021)
ProMoral-Bench: Evaluating Prompting Strategies for Moral Reasoning and Safety in LLMs
par: Thomas, Rohan Subramanian, et autres
Publié: (2026)
par: Thomas, Rohan Subramanian, et autres
Publié: (2026)
MoralityGym: A Benchmark for Evaluating Hierarchical Moral Alignment in Sequential Decision-Making Agents
par: Rosen, Simon, et autres
Publié: (2026)
par: Rosen, Simon, et autres
Publié: (2026)
LongCodeBench: Evaluating Coding LLMs at 1M Context Windows
par: Rando, Stefano, et autres
Publié: (2025)
par: Rando, Stefano, et autres
Publié: (2025)
Evolving Roles of LLMs in Scientific Innovation: Assistant, Collaborator, Scientist, and Evaluator
par: Zhang, Haoxuan, et autres
Publié: (2025)
par: Zhang, Haoxuan, et autres
Publié: (2025)
APreQEL: Adaptive Mixed Precision Quantization For Edge LLMs
par: Bouzouad, Meriem, et autres
Publié: (2026)
par: Bouzouad, Meriem, et autres
Publié: (2026)
Qiskit Code Assistant: Training LLMs for generating Quantum Computing Code
par: Dupuis, Nicolas, et autres
Publié: (2024)
par: Dupuis, Nicolas, et autres
Publié: (2024)
RAmBLA: A Framework for Evaluating the Reliability of LLMs as Assistants in the Biomedical Domain
par: Bolton, William James, et autres
Publié: (2024)
par: Bolton, William James, et autres
Publié: (2024)
Agency and Morality as part of Text Entry AI Assistant Personas
par: Komninos, Andreas
Publié: (2024)
par: Komninos, Andreas
Publié: (2024)
Can Artificial Intelligence Embody Moral Values?
par: Swoboda, Torben, et autres
Publié: (2024)
par: Swoboda, Torben, et autres
Publié: (2024)
Position: Beyond Assistance -- Reimagining LLMs as Ethical and Adaptive Co-Creators in Mental Health Care
par: Badawi, Abeer, et autres
Publié: (2025)
par: Badawi, Abeer, et autres
Publié: (2025)
Contesting Artificial Moral Agents
par: Aijaz, Aisha
Publié: (2026)
par: Aijaz, Aisha
Publié: (2026)
Histoires Morales: A French Dataset for Assessing Moral Alignment
par: Leteno, Thibaud, et autres
Publié: (2025)
par: Leteno, Thibaud, et autres
Publié: (2025)
Lightweight Visual Reasoning for Socially-Aware Robots
par: Galatolo, Alessio, et autres
Publié: (2026)
par: Galatolo, Alessio, et autres
Publié: (2026)
On Evaluating LLM Alignment by Evaluating LLMs as Judges
par: Liu, Yixin, et autres
Publié: (2025)
par: Liu, Yixin, et autres
Publié: (2025)
Evaluating AI-Powered Learning Assistants in Engineering Higher Education: Student Engagement, Ethical Challenges, and Policy Implications
par: Sajja, Ramteja, et autres
Publié: (2025)
par: Sajja, Ramteja, et autres
Publié: (2025)
Evaluating Moral Beliefs across LLMs through a Pluralistic Framework
par: Liu, Xuelin, et autres
Publié: (2024)
par: Liu, Xuelin, et autres
Publié: (2024)
Evaluating Explanations Through LLMs: Beyond Traditional User Studies
par: De Bona, Francesco Bombassei, et autres
Publié: (2024)
par: De Bona, Francesco Bombassei, et autres
Publié: (2024)
Judging the Judges: Evaluating Alignment and Vulnerabilities in LLMs-as-Judges
par: Thakur, Aman Singh, et autres
Publié: (2024)
par: Thakur, Aman Singh, et autres
Publié: (2024)
Addressing Moral Uncertainty using Large Language Models for Ethical Decision-Making
par: Dubey, Rohit K., et autres
Publié: (2025)
par: Dubey, Rohit K., et autres
Publié: (2025)
MoralReason: Generalizable Moral Decision Alignment For LLM Agents Using Reasoning-Level Reinforcement Learning
par: An, Zhiyu, et autres
Publié: (2025)
par: An, Zhiyu, et autres
Publié: (2025)
Rankers, Judges, and Assistants: Towards Understanding the Interplay of LLMs in Information Retrieval Evaluation
par: Balog, Krisztian, et autres
Publié: (2025)
par: Balog, Krisztian, et autres
Publié: (2025)
User-Assistant Bias in LLMs
par: Pan, Xu, et autres
Publié: (2025)
par: Pan, Xu, et autres
Publié: (2025)
Documents similaires
-
DIEKAE: Difference Injection for Efficient Knowledge Augmentation and Editing of Large Language Models
par: Galatolo, Alessio, et autres
Publié: (2024) -
Visualising Policy-Reward Interplay to Inform Zeroth-Order Preference Optimisation of Large Language Models
par: Galatolo, Alessio, et autres
Publié: (2025) -
Moral Persuasion in Large Language Models: Evaluating Susceptibility and Ethical Alignment
par: Huang, Allison, et autres
Publié: (2024) -
Ethical Reasoning and Moral Value Alignment of LLMs Depend on the Language we Prompt them in
par: Agarwal, Utkarsh, et autres
Publié: (2024) -
Product Development within Artificial Intelligence, Ethics and Legal Risk
par: Winkle, Thomas
Publié: (2022)