Rethinking Machine Ethics -- Can LLMs Perform Moral Reasoning through the Lens of Moral Theories?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Jingyan, Hu, Minda, Li, Junan, Zhang, Xiaoying, Wu, Xixin, King, Irwin, Meng, Helen |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Purple-teaming LLMs with Adversarial Defender Training
par: Zhou, Jingyan, et autres
Publié: (2024)
par: Zhou, Jingyan, et autres
Publié: (2024)
Devising a Set of Compact and Explainable Spoken Language Feature for Screening Alzheimer's Disease
par: Li, Junan, et autres
Publié: (2024)
par: Li, Junan, et autres
Publié: (2024)
Not All Errors Are Equal: Investigation of Speech Recognition Errors in Alzheimer's Disease Detection
par: Kang, Jiawen, et autres
Publié: (2024)
par: Kang, Jiawen, et autres
Publié: (2024)
ConMax: Confidence-Maximizing Compression for Efficient Chain-of-Thought Reasoning
par: Hu, Minda, et autres
Publié: (2026)
par: Hu, Minda, et autres
Publié: (2026)
Self-Tuning: Instructing LLMs to Effectively Acquire New Knowledge through Self-Teaching
par: Zhang, Xiaoying, et autres
Publié: (2024)
par: Zhang, Xiaoying, et autres
Publié: (2024)
WebCoT: Enhancing Web Agent Reasoning by Reconstructing Chain-of-Thought in Reflection, Branching, and Rollback
par: Hu, Minda, et autres
Publié: (2025)
par: Hu, Minda, et autres
Publié: (2025)
The Integration of Semantic and Structural Knowledge in Knowledge Graph Entity Typing
par: Li, Muzhi, et autres
Publié: (2024)
par: Li, Muzhi, et autres
Publié: (2024)
SeRTS: Self-Rewarding Tree Search for Biomedical Retrieval-Augmented Generation
par: Hu, Minda, et autres
Publié: (2024)
par: Hu, Minda, et autres
Publié: (2024)
Decoding on Graphs: Faithful and Sound Reasoning on Knowledge Graphs through Generation of Well-Formed Chains
par: Li, Kun, et autres
Publié: (2024)
par: Li, Kun, et autres
Publié: (2024)
ProMoral-Bench: Evaluating Prompting Strategies for Moral Reasoning and Safety in LLMs
par: Thomas, Rohan Subramanian, et autres
Publié: (2026)
par: Thomas, Rohan Subramanian, et autres
Publié: (2026)
NILE: Internal Consistency Alignment in Large Language Models
par: Hu, Minda, et autres
Publié: (2024)
par: Hu, Minda, et autres
Publié: (2024)
MoralBench: Moral Evaluation of LLMs
par: Ji, Jianchao, et autres
Publié: (2024)
par: Ji, Jianchao, et autres
Publié: (2024)
Exploring the psychology of LLMs' Moral and Legal Reasoning
par: Almeida, Guilherme F. C. F., et autres
Publié: (2023)
par: Almeida, Guilherme F. C. F., et autres
Publié: (2023)
TreePS-RAG: Tree-based Process Supervision for Reinforcement Learning in Agentic RAG
par: Zhang, Tianhua, et autres
Publié: (2026)
par: Zhang, Tianhua, et autres
Publié: (2026)
On the Within-class Variation Issue in Alzheimer's Disease Detection
par: Kang, Jiawen, et autres
Publié: (2024)
par: Kang, Jiawen, et autres
Publié: (2024)
Safety Compliance: Rethinking LLM Safety Reasoning through the Lens of Compliance
par: Hu, Wenbin, et autres
Publié: (2025)
par: Hu, Wenbin, et autres
Publié: (2025)
Mitigating Large Language Model Hallucination with Faithful Finetuning
par: Hu, Minda, et autres
Publié: (2024)
par: Hu, Minda, et autres
Publié: (2024)
RAG-Zeval: Towards Robust and Interpretable Evaluation on RAG Responses through End-to-End Rule-Guided Reasoning
par: Li, Kun, et autres
Publié: (2025)
par: Li, Kun, et autres
Publié: (2025)
Injecting linguistic knowledge into BERT for Dialogue State Tracking
par: Feng, Xiaohan, et autres
Publié: (2023)
par: Feng, Xiaohan, et autres
Publié: (2023)
Self-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation
par: Zhang, Xiaoying, et autres
Publié: (2024)
par: Zhang, Xiaoying, et autres
Publié: (2024)
Moral Reasoning Across Languages: The Critical Role of Low-Resource Languages in LLMs
par: Zhou, Huichi, et autres
Publié: (2025)
par: Zhou, Huichi, et autres
Publié: (2025)
From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation
par: Guo, Zhihan, et autres
Publié: (2025)
par: Guo, Zhihan, et autres
Publié: (2025)
The Staircase of Ethics: Probing LLM Value Priorities through Multi-Step Induction to Complex Moral Dilemmas
par: Wu, Ya, et autres
Publié: (2025)
par: Wu, Ya, et autres
Publié: (2025)
Search-R2: Enhancing Search-Integrated Reasoning via Actor-Refiner Collaboration
par: He, Bowei, et autres
Publié: (2026)
par: He, Bowei, et autres
Publié: (2026)
Seamless Language Expansion: Enhancing Multilingual Mastery in Self-Supervised Models
par: Xu, Jing, et autres
Publié: (2024)
par: Xu, Jing, et autres
Publié: (2024)
Adaptive Query Rewriting: Aligning Rewriters through Marginal Probability of Conversational Answers
par: Zhang, Tianhua, et autres
Publié: (2024)
par: Zhang, Tianhua, et autres
Publié: (2024)
Analysing Moral Bias in Finetuned LLMs through Mechanistic Interpretability
par: Raimondi, Bianca, et autres
Publié: (2025)
par: Raimondi, Bianca, et autres
Publié: (2025)
The Straight and Narrow: Do LLMs Possess an Internal Moral Path?
par: Hu, Luoming, et autres
Publié: (2026)
par: Hu, Luoming, et autres
Publié: (2026)
Moral Lenses, Political Coordinates: Towards Ideological Positioning of Morally Conditioned LLMs
par: Yuan, Chenchen, et autres
Publié: (2026)
par: Yuan, Chenchen, et autres
Publié: (2026)
MOKA: Moral Knowledge Augmentation for Moral Event Extraction
par: Zhang, Xinliang Frederick, et autres
Publié: (2023)
par: Zhang, Xinliang Frederick, et autres
Publié: (2023)
MFTCXplain: A Multilingual Benchmark Dataset for Evaluating the Moral Reasoning of LLMs through Multi-hop Hate Speech Explanation
par: Trager, Jackson, et autres
Publié: (2025)
par: Trager, Jackson, et autres
Publié: (2025)
Moral Mazes in the Era of LLMs
par: Nguyen, Dang, et autres
Publié: (2026)
par: Nguyen, Dang, et autres
Publié: (2026)
Large Language Model Can Transcribe Speech in Multi-Talker Scenarios with Versatile Instructions
par: Meng, Lingwei, et autres
Publié: (2024)
par: Meng, Lingwei, et autres
Publié: (2024)
Evaluating Moral Beliefs across LLMs through a Pluralistic Framework
par: Liu, Xuelin, et autres
Publié: (2024)
par: Liu, Xuelin, et autres
Publié: (2024)
Large Language Model-based FMRI Encoding of Language Functions for Subjects with Neurocognitive Disorder
par: Wang, Yuejiao, et autres
Publié: (2024)
par: Wang, Yuejiao, et autres
Publié: (2024)
Are Rules Meant to be Broken? Understanding Multilingual Moral Reasoning as a Computational Pipeline with UniMoral
par: Kumar, Shivani, et autres
Publié: (2025)
par: Kumar, Shivani, et autres
Publié: (2025)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
par: Wei, Jianhui, et autres
Publié: (2025)
par: Wei, Jianhui, et autres
Publié: (2025)
Machine Behavior in Relational Moral Dilemmas: Moral Rightness, Predicted Human Behavior, and Model Decisions
par: Kim, Jiseon, et autres
Publié: (2026)
par: Kim, Jiseon, et autres
Publié: (2026)
Speech Discrete Tokens or Continuous Features? A Comparative Analysis for Spoken Language Understanding in SpeechLLMs
par: Wang, Dingdong, et autres
Publié: (2025)
par: Wang, Dingdong, et autres
Publié: (2025)
One Model, Many Morals: Uncovering Cross-Linguistic Misalignments in Computational Moral Reasoning
par: Farid, Sualeha, et autres
Publié: (2025)
par: Farid, Sualeha, et autres
Publié: (2025)
Documents similaires
-
Purple-teaming LLMs with Adversarial Defender Training
par: Zhou, Jingyan, et autres
Publié: (2024) -
Devising a Set of Compact and Explainable Spoken Language Feature for Screening Alzheimer's Disease
par: Li, Junan, et autres
Publié: (2024) -
Not All Errors Are Equal: Investigation of Speech Recognition Errors in Alzheimer's Disease Detection
par: Kang, Jiawen, et autres
Publié: (2024) -
ConMax: Confidence-Maximizing Compression for Efficient Chain-of-Thought Reasoning
par: Hu, Minda, et autres
Publié: (2026) -
Self-Tuning: Instructing LLMs to Effectively Acquire New Knowledge through Self-Teaching
par: Zhang, Xiaoying, et autres
Publié: (2024)