Pseudo-Deliberation in Language Models: When Reasoning Fails to Align Values and Actions
Fuente:
arXiv
Salvato in:
| Autori principali: | Rakshit, Sushrita, Zhang, Hanwen, Shen, Hua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Emotionally-Aware Agents for Dispute Resolution
di: Rakshit, Sushrita, et al.
Pubblicazione: (2025)
di: Rakshit, Sushrita, et al.
Pubblicazione: (2025)
Attention-Aligned Reasoning for Large Language Models
di: Zhang, Hongxiang, et al.
Pubblicazione: (2025)
di: Zhang, Hongxiang, et al.
Pubblicazione: (2025)
Knowing When to Abstain: Medical LLMs Under Clinical Uncertainty
di: Machcha, Sravanthi, et al.
Pubblicazione: (2026)
di: Machcha, Sravanthi, et al.
Pubblicazione: (2026)
Mind the Value-Action Gap: Do LLMs Act in Alignment with Their Values?
di: Shen, Hua, et al.
Pubblicazione: (2025)
di: Shen, Hua, et al.
Pubblicazione: (2025)
DeliberationBench: When Do More Voices Hurt? A Controlled Study of Multi-LLM Deliberation Protocols
di: Kaushal, Vaarunay, et al.
Pubblicazione: (2025)
di: Kaushal, Vaarunay, et al.
Pubblicazione: (2025)
Reason-Align-Respond: Aligning LLM Reasoning with Knowledge Graphs for KGQA
di: Shen, Xiangqing, et al.
Pubblicazione: (2025)
di: Shen, Xiangqing, et al.
Pubblicazione: (2025)
Learning to Negotiate: Multi-Agent Deliberation for Collective Value Alignment in LLMs
di: Anantaprayoon, Panatchakorn, et al.
Pubblicazione: (2026)
di: Anantaprayoon, Panatchakorn, et al.
Pubblicazione: (2026)
MVPBench: A Benchmark and Fine-Tuning Framework for Aligning Large Language Models with Diverse Human Values
di: Liang, Yao, et al.
Pubblicazione: (2025)
di: Liang, Yao, et al.
Pubblicazione: (2025)
GreedLlama: Performance of Financial Value-Aligned Large Language Models in Moral Reasoning
di: Yu, Jeffy, et al.
Pubblicazione: (2024)
di: Yu, Jeffy, et al.
Pubblicazione: (2024)
Lost in the Noise: How Reasoning Models Fail with Contextual Distractors
di: Lee, Seongyun, et al.
Pubblicazione: (2026)
di: Lee, Seongyun, et al.
Pubblicazione: (2026)
Language Models Fail to Introspect About Their Knowledge of Language
di: Song, Siyuan, et al.
Pubblicazione: (2025)
di: Song, Siyuan, et al.
Pubblicazione: (2025)
Unlocking the Power of Multi-Agent LLM for Reasoning: From Lazy Agents to Deliberation
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
Stop Before You Fail: Operational Capability Boundaries for Mitigating Unproductive Reasoning in Large Reasoning Models
di: Zhang, Qingjie, et al.
Pubblicazione: (2025)
di: Zhang, Qingjie, et al.
Pubblicazione: (2025)
When Reasoning Meets Its Laws
di: Zhang, Junyu, et al.
Pubblicazione: (2025)
di: Zhang, Junyu, et al.
Pubblicazione: (2025)
LLM+AL: Bridging Large Language Models and Action Languages for Complex Reasoning about Actions
di: Ishay, Adam, et al.
Pubblicazione: (2025)
di: Ishay, Adam, et al.
Pubblicazione: (2025)
DeepCritic: Deliberate Critique with Large Language Models
di: Yang, Wenkai, et al.
Pubblicazione: (2025)
di: Yang, Wenkai, et al.
Pubblicazione: (2025)
COLD-Steer: Steering Large Language Models via In-Context One-step Learning Dynamics
di: Sharma, Kartik, et al.
Pubblicazione: (2026)
di: Sharma, Kartik, et al.
Pubblicazione: (2026)
When Verification Fails: How Compositionally Infeasible Claims Escape Rejection
di: Liu, Muxin, et al.
Pubblicazione: (2026)
di: Liu, Muxin, et al.
Pubblicazione: (2026)
When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context Reasoning
di: Sheng, Leheng, et al.
Pubblicazione: (2026)
di: Sheng, Leheng, et al.
Pubblicazione: (2026)
RDR: the Recap, Deliberate, and Respond Method for Enhanced Language Understanding
di: Zi, Yuxin, et al.
Pubblicazione: (2023)
di: Zi, Yuxin, et al.
Pubblicazione: (2023)
When Audio-Language Models Fail to Leverage Multimodal Context for Dysarthric Speech Recognition
di: Moure, Pehuén, et al.
Pubblicazione: (2026)
di: Moure, Pehuén, et al.
Pubblicazione: (2026)
Robust Search with Uncertainty-Aware Value Models for Language Model Reasoning
di: Yu, Fei, et al.
Pubblicazione: (2025)
di: Yu, Fei, et al.
Pubblicazione: (2025)
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
di: Zhang, Rongzhi, et al.
Pubblicazione: (2024)
di: Zhang, Rongzhi, et al.
Pubblicazione: (2024)
Reasoning in Action: MCTS-Driven Knowledge Retrieval for Large Language Models
di: Liu, Shuqi, et al.
Pubblicazione: (2025)
di: Liu, Shuqi, et al.
Pubblicazione: (2025)
Towards Safety Reasoning in LLMs: AI-agentic Deliberation for Policy-embedded CoT Data Creation
di: Kumarage, Tharindu, et al.
Pubblicazione: (2025)
di: Kumarage, Tharindu, et al.
Pubblicazione: (2025)
TS-Reasoner: Aligning Time Series Foundation Models with LLM Reasoning
di: Yu, Fangxu, et al.
Pubblicazione: (2025)
di: Yu, Fangxu, et al.
Pubblicazione: (2025)
Chain of Stance: Stance Detection with Large Language Models
di: Ma, Junxia, et al.
Pubblicazione: (2024)
di: Ma, Junxia, et al.
Pubblicazione: (2024)
Deep Value Benchmark: Measuring Whether Models Generalize Deep Values or Shallow Preferences
di: Ashkinaze, Joshua, et al.
Pubblicazione: (2025)
di: Ashkinaze, Joshua, et al.
Pubblicazione: (2025)
Reasoning about Uncertainty: Do Reasoning Models Know When They Don't Know?
di: Mei, Zhiting, et al.
Pubblicazione: (2025)
di: Mei, Zhiting, et al.
Pubblicazione: (2025)
Task-Aligned Tool Recommendation for Large Language Models
di: Gao, Hang, et al.
Pubblicazione: (2024)
di: Gao, Hang, et al.
Pubblicazione: (2024)
Recitation over Reasoning: How Cutting-Edge Language Models Can Fail on Elementary School-Level Reasoning Problems?
di: Yan, Kai, et al.
Pubblicazione: (2025)
di: Yan, Kai, et al.
Pubblicazione: (2025)
A Survey of Test-Time Compute: From Intuitive Inference to Deliberate Reasoning
di: Ji, Yixin, et al.
Pubblicazione: (2025)
di: Ji, Yixin, et al.
Pubblicazione: (2025)
StoryLens: Preference-Aligned Story Rewriting via Context-Aware Narrative Enrichment
di: Cui, Hanwen, et al.
Pubblicazione: (2026)
di: Cui, Hanwen, et al.
Pubblicazione: (2026)
The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models
di: Chen, Yanjun, et al.
Pubblicazione: (2024)
di: Chen, Yanjun, et al.
Pubblicazione: (2024)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
Thinking Out of Order: When Output Order Stops Reflecting Reasoning Order in Diffusion Language Models
di: Yu, Longxuan, et al.
Pubblicazione: (2026)
di: Yu, Longxuan, et al.
Pubblicazione: (2026)
From Debate to Deliberation: Structured Collective Reasoning with Typed Epistemic Acts
di: Prakash, Sunil
Pubblicazione: (2026)
di: Prakash, Sunil
Pubblicazione: (2026)
The Impact of Reasoning Step Length on Large Language Models
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
Fine-Tuning or Fine-Failing? Debunking Performance Myths in Large Language Models
di: Barnett, Scott, et al.
Pubblicazione: (2024)
di: Barnett, Scott, et al.
Pubblicazione: (2024)
ChemATP: A Training-Free Chemical Reasoning Framework for Large Language Models
di: Zhang, Mingxu, et al.
Pubblicazione: (2025)
di: Zhang, Mingxu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Emotionally-Aware Agents for Dispute Resolution
di: Rakshit, Sushrita, et al.
Pubblicazione: (2025) -
Attention-Aligned Reasoning for Large Language Models
di: Zhang, Hongxiang, et al.
Pubblicazione: (2025) -
Knowing When to Abstain: Medical LLMs Under Clinical Uncertainty
di: Machcha, Sravanthi, et al.
Pubblicazione: (2026) -
Mind the Value-Action Gap: Do LLMs Act in Alignment with Their Values?
di: Shen, Hua, et al.
Pubblicazione: (2025) -
DeliberationBench: When Do More Voices Hurt? A Controlled Study of Multi-LLM Deliberation Protocols
di: Kaushal, Vaarunay, et al.
Pubblicazione: (2025)