Internal Reasoning vs. External Control: A Thermodynamic Analysis of Sycophancy in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Chang, Edward Y. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Integrating Emotional and Linguistic Models for Ethical Compliance in Large Language Models
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
Diagnosing and Mitigating Sycophancy and Skepticism in LLM Causal Judgment
par: Chang, Edward Y.
Publié: (2026)
par: Chang, Edward Y.
Publié: (2026)
Uncovering Biases with Reflective Large Language Models
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
RAudit: A Blind Auditing Protocol for Large Language Model Reasoning
par: Chang, Edward Y., et autres
Publié: (2026)
par: Chang, Edward Y., et autres
Publié: (2026)
SocraSynth: Multi-LLM Reasoning with Conditional Statistics
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
Beyond Token Length: Step Pruner for Efficient and Accurate Reasoning in Large Language Models
par: Wu, Canhui, et autres
Publié: (2025)
par: Wu, Canhui, et autres
Publié: (2025)
External Hippocampus: Topological Cognitive Maps for Guiding Large Language Model Reasoning
par: Yan, Jian
Publié: (2025)
par: Yan, Jian
Publié: (2025)
Learning vs Retrieval: The Role of In-Context Examples in Regression with Large Language Models
par: Nafar, Aliakbar, et autres
Publié: (2024)
par: Nafar, Aliakbar, et autres
Publié: (2024)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
par: Peters, Sydney, et autres
Publié: (2025)
par: Peters, Sydney, et autres
Publié: (2025)
Reasoning over Uncertain Text by Generative Large Language Models
par: Nafar, Aliakbar, et autres
Publié: (2024)
par: Nafar, Aliakbar, et autres
Publié: (2024)
Unlocking the Wisdom of Large Language Models: An Introduction to The Path to Artificial General Intelligence
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reasoning
par: Ovcharov, Volodymyr
Publié: (2026)
par: Ovcharov, Volodymyr
Publié: (2026)
Search-R3: Unifying Reasoning and Embedding in Large Language Models
par: Gui, Yuntao, et autres
Publié: (2025)
par: Gui, Yuntao, et autres
Publié: (2025)
Attentive Reasoning Queries: A Systematic Method for Optimizing Instruction-Following in Large Language Models
par: Karov, Bar, et autres
Publié: (2025)
par: Karov, Bar, et autres
Publié: (2025)
Seemingly Plausible Distractors in Multi-Hop Reasoning: Are Large Language Models Attentive Readers?
par: Bhuiya, Neeladri, et autres
Publié: (2024)
par: Bhuiya, Neeladri, et autres
Publié: (2024)
Sycophancy as compositions of Atomic Psychometric Traits
par: Jain, Shreyans, et autres
Publié: (2025)
par: Jain, Shreyans, et autres
Publié: (2025)
The Unified Cognitive Consciousness Theory for Language Models: Anchoring Semantics, Thresholds of Activation, and Emergent Reasoning
par: Chang, Edward Y., et autres
Publié: (2025)
par: Chang, Edward Y., et autres
Publié: (2025)
InstructCMP: Length Control in Sentence Compression through Instruction-based Large Language Models
par: Juseon-Do, et autres
Publié: (2024)
par: Juseon-Do, et autres
Publié: (2024)
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
Can Large Language Models Grasp Legal Theories? Enhance Legal Reasoning with Insights from Multi-Agent Collaboration
par: Yuan, Weikang, et autres
Publié: (2024)
par: Yuan, Weikang, et autres
Publié: (2024)
Thought-Like-Pro: Enhancing Reasoning of Large Language Models through Self-Driven Prolog-based Chain-of-Thought
par: Tan, Xiaoyu, et autres
Publié: (2024)
par: Tan, Xiaoyu, et autres
Publié: (2024)
CausalT5K: Diagnosing and Informing Refusal for Trustworthy Causal Reasoning of Skepticism, Sycophancy, Detection-Correction, and Rung Collapse
par: Geng, Longling, et autres
Publié: (2026)
par: Geng, Longling, et autres
Publié: (2026)
Robustness of Large Language Models to Perturbations in Text
par: Singh, Ayush, et autres
Publié: (2024)
par: Singh, Ayush, et autres
Publié: (2024)
A comprehensive taxonomy of hallucinations in Large Language Models
par: Cossio, Manuel
Publié: (2025)
par: Cossio, Manuel
Publié: (2025)
Enigme: Generative Text Puzzles for Evaluating Reasoning in Language Models
par: Hawkins, John
Publié: (2025)
par: Hawkins, John
Publié: (2025)
Assessing Large Language Models on Islamic Legal Reasoning: Evidence from Inheritance Law Evaluation
par: Bouchekif, Abdessalam, et autres
Publié: (2025)
par: Bouchekif, Abdessalam, et autres
Publié: (2025)
PatentGPT: A Large Language Model for Intellectual Property
par: Bai, Zilong, et autres
Publié: (2024)
par: Bai, Zilong, et autres
Publié: (2024)
Inference to the Best Explanation in Large Language Models
par: Dalal, Dhairya, et autres
Publié: (2024)
par: Dalal, Dhairya, et autres
Publié: (2024)
Streamlining Redundant Layers to Compress Large Language Models
par: Chen, Xiaodong, et autres
Publié: (2024)
par: Chen, Xiaodong, et autres
Publié: (2024)
Bielik 11B v3: Multilingual Large Language Model for European Languages
par: Ociepa, Krzysztof, et autres
Publié: (2025)
par: Ociepa, Krzysztof, et autres
Publié: (2025)
Artificial Phantasia: Emergent Mental Imagery in Large Language Models
par: McCarty, Morgan, et autres
Publié: (2025)
par: McCarty, Morgan, et autres
Publié: (2025)
Prompt-Time Symbolic Knowledge Capture with Large Language Models
par: Çöplü, Tolga, et autres
Publié: (2024)
par: Çöplü, Tolga, et autres
Publié: (2024)
Argumentative Large Language Models for Explainable and Contestable Claim Verification
par: Freedman, Gabriel, et autres
Publié: (2024)
par: Freedman, Gabriel, et autres
Publié: (2024)
Multi-Turn Interactions for Text-to-SQL with Large Language Models
par: Xiong, Guanming, et autres
Publié: (2024)
par: Xiong, Guanming, et autres
Publié: (2024)
Demystifying Instruction Mixing for Fine-tuning Large Language Models
par: Wang, Renxi, et autres
Publié: (2023)
par: Wang, Renxi, et autres
Publié: (2023)
EQ-Bench: An Emotional Intelligence Benchmark for Large Language Models
par: Paech, Samuel J.
Publié: (2023)
par: Paech, Samuel J.
Publié: (2023)
TALE: A Tool-Augmented Framework for Reference-Free Evaluation of Large Language Models
par: Badshah, Sher, et autres
Publié: (2025)
par: Badshah, Sher, et autres
Publié: (2025)
Machine Translation Hallucination Detection for Low and High Resource Languages using Large Language Models
par: Benkirane, Kenza, et autres
Publié: (2024)
par: Benkirane, Kenza, et autres
Publié: (2024)
EMNLP: Educator-role Moral and Normative Large Language Models Profiling
par: Jiang, Yilin, et autres
Publié: (2025)
par: Jiang, Yilin, et autres
Publié: (2025)
Can Large Language Models perform Relation-based Argument Mining?
par: Gorur, Deniz, et autres
Publié: (2024)
par: Gorur, Deniz, et autres
Publié: (2024)
Documents similaires
-
Integrating Emotional and Linguistic Models for Ethical Compliance in Large Language Models
par: Chang, Edward Y.
Publié: (2024) -
Diagnosing and Mitigating Sycophancy and Skepticism in LLM Causal Judgment
par: Chang, Edward Y.
Publié: (2026) -
Uncovering Biases with Reflective Large Language Models
par: Chang, Edward Y.
Publié: (2024) -
RAudit: A Blind Auditing Protocol for Large Language Model Reasoning
par: Chang, Edward Y., et autres
Publié: (2026) -
SocraSynth: Multi-LLM Reasoning with Conditional Statistics
par: Chang, Edward Y.
Publié: (2024)