MoralBench: Moral Evaluation of LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ji, Jianchao, Chen, Yutong, Jin, Mingyu, Xu, Wujiang, Hua, Wenyue, Zhang, Yongfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
par: Yan, Bei, et autres
Publié: (2024)
par: Yan, Bei, et autres
Publié: (2024)
UP5: Unbiased Foundation Model for Fairness-aware Recommendation
par: Hua, Wenyue, et autres
Publié: (2023)
par: Hua, Wenyue, et autres
Publié: (2023)
ProMoral-Bench: Evaluating Prompting Strategies for Moral Reasoning and Safety in LLMs
par: Thomas, Rohan Subramanian, et autres
Publié: (2026)
par: Thomas, Rohan Subramanian, et autres
Publié: (2026)
AIOS: LLM Agent Operating System
par: Mei, Kai, et autres
Publié: (2024)
par: Mei, Kai, et autres
Publié: (2024)
EmojiPrompt: Generative Prompt Obfuscation for Privacy-Preserving Communication with Cloud-based LLMs
par: Lin, Sam, et autres
Publié: (2024)
par: Lin, Sam, et autres
Publié: (2024)
War and Peace (WarAgent): Large Language Model-based Multi-Agent Simulation of World Wars
par: Hua, Wenyue, et autres
Publié: (2023)
par: Hua, Wenyue, et autres
Publié: (2023)
Farther the Shift, Sparser the Representation: Analyzing OOD Mechanisms in LLMs
par: Jin, Mingyu, et autres
Publié: (2026)
par: Jin, Mingyu, et autres
Publié: (2026)
The Impact of Reasoning Step Length on Large Language Models
par: Jin, Mingyu, et autres
Publié: (2024)
par: Jin, Mingyu, et autres
Publié: (2024)
BattleAgent: Multi-modal Dynamic Emulation on Historical Battles to Complement Historical Analysis
par: Lin, Shuhang, et autres
Publié: (2024)
par: Lin, Shuhang, et autres
Publié: (2024)
Moral Lenses, Political Coordinates: Towards Ideological Positioning of Morally Conditioned LLMs
par: Yuan, Chenchen, et autres
Publié: (2026)
par: Yuan, Chenchen, et autres
Publié: (2026)
TrustAgent: Towards Safe and Trustworthy LLM-based Agents
par: Hua, Wenyue, et autres
Publié: (2024)
par: Hua, Wenyue, et autres
Publié: (2024)
Moral Mazes in the Era of LLMs
par: Nguyen, Dang, et autres
Publié: (2026)
par: Nguyen, Dang, et autres
Publié: (2026)
Evaluating Moral Beliefs across LLMs through a Pluralistic Framework
par: Liu, Xuelin, et autres
Publié: (2024)
par: Liu, Xuelin, et autres
Publié: (2024)
InductionBench: LLMs Fail in the Simplest Complexity Class
par: Hua, Wenyue, et autres
Publié: (2025)
par: Hua, Wenyue, et autres
Publié: (2025)
Exploring the psychology of LLMs' Moral and Legal Reasoning
par: Almeida, Guilherme F. C. F., et autres
Publié: (2023)
par: Almeida, Guilherme F. C. F., et autres
Publié: (2023)
NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes
par: Fan, Lizhou, et autres
Publié: (2023)
par: Fan, Lizhou, et autres
Publié: (2023)
Disentangling Logic: The Role of Context in Large Language Model Reasoning Capabilities
par: Hua, Wenyue, et autres
Publié: (2024)
par: Hua, Wenyue, et autres
Publié: (2024)
Formal-LLM: Integrating Formal Language and Natural Language for Controllable LLM-based Agents
par: Li, Zelong, et autres
Publié: (2024)
par: Li, Zelong, et autres
Publié: (2024)
Lessons Without Borders? Evaluating Cultural Alignment of LLMs Using Multilingual Story Moral Generation
par: Wu, Sophie, et autres
Publié: (2026)
par: Wu, Sophie, et autres
Publié: (2026)
Analysing Moral Bias in Finetuned LLMs through Mechanistic Interpretability
par: Raimondi, Bianca, et autres
Publié: (2025)
par: Raimondi, Bianca, et autres
Publié: (2025)
SKA-Bench: A Fine-Grained Benchmark for Evaluating Structured Knowledge Understanding of LLMs
par: Liu, Zhiqiang, et autres
Publié: (2025)
par: Liu, Zhiqiang, et autres
Publié: (2025)
One Model, Many Morals: Uncovering Cross-Linguistic Misalignments in Computational Moral Reasoning
par: Farid, Sualeha, et autres
Publié: (2025)
par: Farid, Sualeha, et autres
Publié: (2025)
Histoires Morales: A French Dataset for Assessing Moral Alignment
par: Leteno, Thibaud, et autres
Publié: (2025)
par: Leteno, Thibaud, et autres
Publié: (2025)
Political Bias in LLMs: Unaligned Moral Values in Agent-centric Simulations
par: Münker, Simon
Publié: (2024)
par: Münker, Simon
Publié: (2024)
CMoralEval: A Moral Evaluation Benchmark for Chinese Large Language Models
par: Yu, Linhao, et autres
Publié: (2024)
par: Yu, Linhao, et autres
Publié: (2024)
IDGenRec: LLM-RecSys Alignment with Textual ID Learning
par: Tan, Juntao, et autres
Publié: (2024)
par: Tan, Juntao, et autres
Publié: (2024)
Widespread Gender and Pronoun Bias in Moral Judgments Across LLMs
par: Fernandes, Gustavo Lúcius, et autres
Publié: (2026)
par: Fernandes, Gustavo Lúcius, et autres
Publié: (2026)
Are Large Language Models Moral Hypocrites? A Study Based on Moral Foundations
par: Nunes, José Luiz, et autres
Publié: (2024)
par: Nunes, José Luiz, et autres
Publié: (2024)
MAGPIE: A dataset for Multi-AGent contextual PrIvacy Evaluation
par: Juneja, Gurusha, et autres
Publié: (2025)
par: Juneja, Gurusha, et autres
Publié: (2025)
SaGE: Evaluating Moral Consistency in Large Language Models
par: Bonagiri, Vamshi Krishna, et autres
Publié: (2024)
par: Bonagiri, Vamshi Krishna, et autres
Publié: (2024)
Common Sense vs. Morality: The Curious Case of Narrative Focus Bias in LLMs
par: Purkayastha, Saugata, et autres
Publié: (2026)
par: Purkayastha, Saugata, et autres
Publié: (2026)
PAP-REC: Personalized Automatic Prompt for Recommendation Language Model
par: Li, Zelong, et autres
Publié: (2024)
par: Li, Zelong, et autres
Publié: (2024)
Moral Persuasion in Large Language Models: Evaluating Susceptibility and Ethical Alignment
par: Huang, Allison, et autres
Publié: (2024)
par: Huang, Allison, et autres
Publié: (2024)
The Moral Consistency Pipeline: Continuous Ethical Evaluation for Large Language Models
par: Jamshidi, Saeid, et autres
Publié: (2025)
par: Jamshidi, Saeid, et autres
Publié: (2025)
Ethical Reasoning and Moral Value Alignment of LLMs Depend on the Language we Prompt them in
par: Agarwal, Utkarsh, et autres
Publié: (2024)
par: Agarwal, Utkarsh, et autres
Publié: (2024)
AgentBench: Evaluating LLMs as Agents
par: Liu, Xiao, et autres
Publié: (2023)
par: Liu, Xiao, et autres
Publié: (2023)
oMeBench: Towards Robust Benchmarking of LLMs in Organic Mechanism Elucidation and Reasoning
par: Xu, Ruiling, et autres
Publié: (2025)
par: Xu, Ruiling, et autres
Publié: (2025)
DialogBench: Evaluating LLMs as Human-like Dialogue Systems
par: Ou, Jiao, et autres
Publié: (2023)
par: Ou, Jiao, et autres
Publié: (2023)
MoReBench: Evaluating Procedural and Pluralistic Moral Reasoning in Language Models, More than Outcomes
par: Chiu, Yu Ying, et autres
Publié: (2025)
par: Chiu, Yu Ying, et autres
Publié: (2025)
Morality is Non-Binary: Building a Pluralist Moral Sentence Embedding Space using Contrastive Learning
par: Park, Jeongwoo, et autres
Publié: (2024)
par: Park, Jeongwoo, et autres
Publié: (2024)
Documents similaires
-
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
par: Yan, Bei, et autres
Publié: (2024) -
UP5: Unbiased Foundation Model for Fairness-aware Recommendation
par: Hua, Wenyue, et autres
Publié: (2023) -
ProMoral-Bench: Evaluating Prompting Strategies for Moral Reasoning and Safety in LLMs
par: Thomas, Rohan Subramanian, et autres
Publié: (2026) -
AIOS: LLM Agent Operating System
par: Mei, Kai, et autres
Publié: (2024) -
EmojiPrompt: Generative Prompt Obfuscation for Privacy-Preserving Communication with Cloud-based LLMs
par: Lin, Sam, et autres
Publié: (2024)