Diagnosing Moral Reasoning Acquisition in Language Models: Pragmatics and Generalization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Guangliang, Qi, Zimo, Zhang, Xitong, Jiang, Lei, Johnson, Kristen Marie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pragmatic Inference for Moral Reasoning Acquisition: Generalization via Metapragmatic Links
par: Liu, Guangliang, et autres
Publié: (2025)
par: Liu, Guangliang, et autres
Publié: (2025)
Learning to Diagnose and Correct Errors: Towards Moral Sensitivity Acquisition in Large Language Models
par: Chen, Bocheng, et autres
Publié: (2026)
par: Chen, Bocheng, et autres
Publié: (2026)
Discourse Heuristics For Paradoxically Moral Self-Correction
par: Liu, Guangliang, et autres
Publié: (2025)
par: Liu, Guangliang, et autres
Publié: (2025)
Self-correction is Not An Innate Capability in Language Models
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
Diagnosing the Performance Trade-off in Moral Alignment: A Case Study on Gender Stereotypes
par: Liu, Guangliang, et autres
Publié: (2025)
par: Liu, Guangliang, et autres
Publié: (2025)
Smaller Large Language Models Can Do Moral Self-Correction
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
On the Convergence of Moral Self-Correction in Large Language Models
par: Liu, Guangliang, et autres
Publié: (2025)
par: Liu, Guangliang, et autres
Publié: (2025)
Intrinsic Self-correction for Enhanced Morality: An Analysis of Internal Mechanisms and the Superficial Hypothesis
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
On the Intrinsic Self-Correction Capability of LLMs: Uncertainty and Latent Concept
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
Towards Understanding Task-agnostic Debiasing Through the Lenses of Intrinsic Bias and Forgetfulness
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
MUStReason: A Benchmark for Diagnosing Pragmatic Reasoning in Video-LMs for Multimodal Sarcasm Detection
par: Saha, Anisha, et autres
Publié: (2025)
par: Saha, Anisha, et autres
Publié: (2025)
A Survey to Recent Progress Towards Understanding In-Context Learning
par: Mao, Haitao, et autres
Publié: (2024)
par: Mao, Haitao, et autres
Publié: (2024)
On the Same Wavelength? Evaluating Pragmatic Reasoning in Language Models across Broad Concepts
par: Qiu, Linlu, et autres
Publié: (2025)
par: Qiu, Linlu, et autres
Publié: (2025)
Vision-Language Models Are Not Pragmatically Competent in Referring Expression Generation
par: Ma, Ziqiao, et autres
Publié: (2025)
par: Ma, Ziqiao, et autres
Publié: (2025)
CEI: A Benchmark for Evaluating Pragmatic Reasoning in Language Models
par: Chun, Jon, et autres
Publié: (2026)
par: Chun, Jon, et autres
Publié: (2026)
Evaluating Pragmatic Reasoning in Large Language Models: Evidence from Scalar Diversity
par: Cho, Ye-eun
Publié: (2026)
par: Cho, Ye-eun
Publié: (2026)
Towards an Analysis of Discourse and Interactional Pragmatic Reasoning Capabilities of Large Language Models
par: Robrecht, Amelie, et autres
Publié: (2024)
par: Robrecht, Amelie, et autres
Publié: (2024)
Procedural Dilemma Generation for Evaluating Moral Reasoning in Humans and Language Models
par: Fränken, Jan-Philipp, et autres
Publié: (2024)
par: Fränken, Jan-Philipp, et autres
Publié: (2024)
Are Language Models Consequentialist or Deontological Moral Reasoners?
par: Samway, Keenan, et autres
Publié: (2025)
par: Samway, Keenan, et autres
Publié: (2025)
The Pragmatic Mind of Machines: Tracing the Emergence of Pragmatic Competence in Large Language Models
par: Yu, Kefan, et autres
Publié: (2025)
par: Yu, Kefan, et autres
Publié: (2025)
On Emergent Social World Models -- Evidence for Functional Integration of Theory of Mind and Pragmatic Reasoning in Language Models
par: Tsvilodub, Polina, et autres
Publié: (2026)
par: Tsvilodub, Polina, et autres
Publié: (2026)
Pragmatic Reasoning improves LLM Code Generation
par: Cao, Zhuchen, et autres
Publié: (2025)
par: Cao, Zhuchen, et autres
Publié: (2025)
A Language-agnostic Model of Child Language Acquisition
par: Mahon, Louis, et autres
Publié: (2024)
par: Mahon, Louis, et autres
Publié: (2024)
Pragmatic Competence Evaluation of Large Language Models for the Korean Language
par: Park, Dojun, et autres
Publié: (2024)
par: Park, Dojun, et autres
Publié: (2024)
Reasoning over Uncertain Text by Generative Large Language Models
par: Nafar, Aliakbar, et autres
Publié: (2024)
par: Nafar, Aliakbar, et autres
Publié: (2024)
BengaliMoralBench: A Benchmark for Auditing Moral Reasoning in Large Language Models within Bengali Language and Culture
par: Ridoy, Shahriyar Zaman, et autres
Publié: (2025)
par: Ridoy, Shahriyar Zaman, et autres
Publié: (2025)
Context-Aware Counterfactual Data Augmentation for Gender Bias Mitigation in Language Models
par: Parihar, Shweta, et autres
Publié: (2026)
par: Parihar, Shweta, et autres
Publié: (2026)
Scale Can't Overcome Pragmatics: The Impact of Reporting Bias on Vision-Language Reasoning
par: Kamath, Amita, et autres
Publié: (2026)
par: Kamath, Amita, et autres
Publié: (2026)
Do Emotions Influence Moral Judgment in Large Language Models?
par: Saim, Mohammad, et autres
Publié: (2026)
par: Saim, Mohammad, et autres
Publié: (2026)
Generative AI, Pragmatics, and Authenticity in Second Language Learning
par: Godwin-Jones`, Robert
Publié: (2024)
par: Godwin-Jones`, Robert
Publié: (2024)
Language Acquisition Device in Large Language Models
par: Mita, Masato, et autres
Publié: (2026)
par: Mita, Masato, et autres
Publié: (2026)
MultiPragEval: Multilingual Pragmatic Evaluation of Large Language Models
par: Park, Dojun, et autres
Publié: (2024)
par: Park, Dojun, et autres
Publié: (2024)
Are Language Models Sensitive to Morally Irrelevant Distractors?
par: Shaw, Andrew, et autres
Publié: (2026)
par: Shaw, Andrew, et autres
Publié: (2026)
Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models
par: Liu, Xinxin, et autres
Publié: (2024)
par: Liu, Xinxin, et autres
Publié: (2024)
Measuring Pragmatic Influence in Large Language Model Instructions
par: Geng, Yilin, et autres
Publié: (2026)
par: Geng, Yilin, et autres
Publié: (2026)
Pragmatics in the Era of Large Language Models: A Survey on Datasets, Evaluation, Opportunities and Challenges
par: Ma, Bolei, et autres
Publié: (2025)
par: Ma, Bolei, et autres
Publié: (2025)
Pragmatic Inference Chain (PIC) Improving LLMs' Reasoning of Authentic Implicit Toxic Language
par: Chen, Xi, et autres
Publié: (2025)
par: Chen, Xi, et autres
Publié: (2025)
On the Generalization Gap in Self-Evolving Language Model Reasoning
par: Qi, Zhenting, et autres
Publié: (2026)
par: Qi, Zhenting, et autres
Publié: (2026)
Collaborative Rational Speech Act: Pragmatic Reasoning for Multi-Turn Dialog
par: Estienne, Lautaro, et autres
Publié: (2025)
par: Estienne, Lautaro, et autres
Publié: (2025)
Communicate to Play: Pragmatic Reasoning for Efficient Cross-Cultural Communication in Codenames
par: White, Isadora, et autres
Publié: (2024)
par: White, Isadora, et autres
Publié: (2024)
Documents similaires
-
Pragmatic Inference for Moral Reasoning Acquisition: Generalization via Metapragmatic Links
par: Liu, Guangliang, et autres
Publié: (2025) -
Learning to Diagnose and Correct Errors: Towards Moral Sensitivity Acquisition in Large Language Models
par: Chen, Bocheng, et autres
Publié: (2026) -
Discourse Heuristics For Paradoxically Moral Self-Correction
par: Liu, Guangliang, et autres
Publié: (2025) -
Self-correction is Not An Innate Capability in Language Models
par: Liu, Guangliang, et autres
Publié: (2024) -
Diagnosing the Performance Trade-off in Moral Alignment: A Case Study on Gender Stereotypes
par: Liu, Guangliang, et autres
Publié: (2025)