Discourse Heuristics For Paradoxically Moral Self-Correction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Guangliang, Qi, Zimo, Zhang, Xitong, Johnson, Kristen Marie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Diagnosing Moral Reasoning Acquisition in Language Models: Pragmatics and Generalization
par: Liu, Guangliang, et autres
Publié: (2025)
par: Liu, Guangliang, et autres
Publié: (2025)
Self-correction is Not An Innate Capability in Language Models
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
Smaller Large Language Models Can Do Moral Self-Correction
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
Learning to Diagnose and Correct Errors: Towards Moral Sensitivity Acquisition in Large Language Models
par: Chen, Bocheng, et autres
Publié: (2026)
par: Chen, Bocheng, et autres
Publié: (2026)
On the Convergence of Moral Self-Correction in Large Language Models
par: Liu, Guangliang, et autres
Publié: (2025)
par: Liu, Guangliang, et autres
Publié: (2025)
Diagnosing the Performance Trade-off in Moral Alignment: A Case Study on Gender Stereotypes
par: Liu, Guangliang, et autres
Publié: (2025)
par: Liu, Guangliang, et autres
Publié: (2025)
Pragmatic Inference for Moral Reasoning Acquisition: Generalization via Metapragmatic Links
par: Liu, Guangliang, et autres
Publié: (2025)
par: Liu, Guangliang, et autres
Publié: (2025)
Intrinsic Self-correction for Enhanced Morality: An Analysis of Internal Mechanisms and the Superficial Hypothesis
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
On the Intrinsic Self-Correction Capability of LLMs: Uncertainty and Latent Concept
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
Towards Understanding Task-agnostic Debiasing Through the Lenses of Intrinsic Bias and Forgetfulness
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
A Survey to Recent Progress Towards Understanding In-Context Learning
par: Mao, Haitao, et autres
Publié: (2024)
par: Mao, Haitao, et autres
Publié: (2024)
Can Large Language Models Handle Discourse Particles? A Case Study of Colloquial Malay
par: Yusoff, Mariah Al Giptiah Binte, et autres
Publié: (2026)
par: Yusoff, Mariah Al Giptiah Binte, et autres
Publié: (2026)
Polarization and Morality: Lexical Analysis of Abortion Discourse on Reddit
par: Stanier, Tessa, et autres
Publié: (2024)
par: Stanier, Tessa, et autres
Publié: (2024)
From Words to Wisdom: Discourse Annotation and Baseline Models for Student Dialogue Understanding
par: Mim, Farjana Sultana, et autres
Publié: (2025)
par: Mim, Farjana Sultana, et autres
Publié: (2025)
The Compression Paradox in LLM Inference: Provider-Dependent Energy Effects of Prompt Compression
par: Johnson, Warren
Publié: (2026)
par: Johnson, Warren
Publié: (2026)
Adaptable Moral Stances of Large Language Models on Sexist Content: Implications for Society and Gender Discourse
par: Guo, Rongchen, et autres
Publié: (2024)
par: Guo, Rongchen, et autres
Publié: (2024)
Which course? Discourse! Teaching Discourse and Generation in the Era of LLMs
par: Li, Junyi Jessy, et autres
Publié: (2026)
par: Li, Junyi Jessy, et autres
Publié: (2026)
Guardians of Discourse: Evaluating LLMs on Multilingual Offensive Language Detection
par: He, Jianfei, et autres
Publié: (2024)
par: He, Jianfei, et autres
Publié: (2024)
On the Paradoxical Interference between Instruction-Following and Task Solving
par: Qi, Yunjia, et autres
Publié: (2026)
par: Qi, Yunjia, et autres
Publié: (2026)
The Perplexity Paradox: Why Code Compresses Better Than Math in LLM Prompts
par: Johnson, Warren
Publié: (2026)
par: Johnson, Warren
Publié: (2026)
First Heuristic Then Rational: Dynamic Use of Heuristics in Language Model Reasoning
par: Aoki, Yoichi, et autres
Publié: (2024)
par: Aoki, Yoichi, et autres
Publié: (2024)
Understanding the Dark Side of LLMs' Intrinsic Self-Correction
par: Zhang, Qingjie, et autres
Publié: (2024)
par: Zhang, Qingjie, et autres
Publié: (2024)
Rhea: Role-aware Heuristic Episodic Attention for Conversational LLMs
par: Hong, Wanyang, et autres
Publié: (2025)
par: Hong, Wanyang, et autres
Publié: (2025)
Context-Aware Counterfactual Data Augmentation for Gender Bias Mitigation in Language Models
par: Parihar, Shweta, et autres
Publié: (2026)
par: Parihar, Shweta, et autres
Publié: (2026)
Self-Explaining Hate Speech Detection with Moral Rationales
par: Vargas, Francielle, et autres
Publié: (2026)
par: Vargas, Francielle, et autres
Publié: (2026)
MobEvolve: An Agentic Self-Evolving Heuristic System for Interpretable Human Mobility Generation
par: He, Junlin, et autres
Publié: (2026)
par: He, Junlin, et autres
Publié: (2026)
When Can LLMs Actually Correct Their Own Mistakes? A Critical Survey of Self-Correction of LLMs
par: Kamoi, Ryo, et autres
Publié: (2024)
par: Kamoi, Ryo, et autres
Publié: (2024)
Self-Correction Makes LLMs Better Parsers
par: Zhang, Ziyan, et autres
Publié: (2025)
par: Zhang, Ziyan, et autres
Publié: (2025)
Automatic Alignment of Discourse Relations of Different Discourse Annotation Frameworks
par: Fu, Yingxue
Publié: (2024)
par: Fu, Yingxue
Publié: (2024)
Plan of Thoughts: Heuristic-Guided Problem Solving with Large Language Models
par: Liu, Houjun
Publié: (2024)
par: Liu, Houjun
Publié: (2024)
The Self-Improvement Paradox: Can Language Models Bootstrap Reasoning Capabilities without External Scaffolding?
par: Sun, Yutao, et autres
Publié: (2025)
par: Sun, Yutao, et autres
Publié: (2025)
Are Bigger Encoders Always Better in Vision Large Models?
par: Li, Bozhou, et autres
Publié: (2024)
par: Li, Bozhou, et autres
Publié: (2024)
MOKA: Moral Knowledge Augmentation for Moral Event Extraction
par: Zhang, Xinliang Frederick, et autres
Publié: (2023)
par: Zhang, Xinliang Frederick, et autres
Publié: (2023)
Few-Shot Query Intent Detection via Relation-Aware Prompt Learning
par: Zhang, Liang, et autres
Publié: (2025)
par: Zhang, Liang, et autres
Publié: (2025)
SuperCorrect: Advancing Small LLM Reasoning with Thought Template Distillation and Self-Correction
par: Yang, Ling, et autres
Publié: (2024)
par: Yang, Ling, et autres
Publié: (2024)
Joint Modeling of Entities and Discourse Relations for Coherence Assessment
par: Liu, Wei, et autres
Publié: (2025)
par: Liu, Wei, et autres
Publié: (2025)
CorrectionLM: Self-Corrections with SLM for Dialogue State Tracking
par: Lee, Chia-Hsuan, et autres
Publié: (2024)
par: Lee, Chia-Hsuan, et autres
Publié: (2024)
On the Role of Context for Discourse Relation Classification in Scientific Writing
par: Wan, Stephen, et autres
Publié: (2025)
par: Wan, Stephen, et autres
Publié: (2025)
Beyond English: Evaluating Automated Measurement of Moral Foundations in Non-English Discourse with a Chinese Case Study
par: Cheng, Calvin Yixiang, et autres
Publié: (2025)
par: Cheng, Calvin Yixiang, et autres
Publié: (2025)
Corrective In-Context Learning: Evaluating Self-Correction in Large Language Models
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
Documents similaires
-
Diagnosing Moral Reasoning Acquisition in Language Models: Pragmatics and Generalization
par: Liu, Guangliang, et autres
Publié: (2025) -
Self-correction is Not An Innate Capability in Language Models
par: Liu, Guangliang, et autres
Publié: (2024) -
Smaller Large Language Models Can Do Moral Self-Correction
par: Liu, Guangliang, et autres
Publié: (2024) -
Learning to Diagnose and Correct Errors: Towards Moral Sensitivity Acquisition in Large Language Models
par: Chen, Bocheng, et autres
Publié: (2026) -
On the Convergence of Moral Self-Correction in Large Language Models
par: Liu, Guangliang, et autres
Publié: (2025)