How Emotion Shapes the Behavior of LLMs and Agents: A Mechanistic Study
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Moran, Li, Tianlin, Zheng, Yuwei, Zhou, Zhenhong, Liu, Aishan, Liu, Xianglong, Liu, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLMCBench: Benchmarking Large Language Model Compression for Efficient Deployment
par: Yang, Ge, et autres
Publié: (2024)
par: Yang, Ge, et autres
Publié: (2024)
CORBA: Contagious Recursive Blocking Attacks on Multi-Agent Systems Based on Large Language Models
par: Zhou, Zhenhong, et autres
Publié: (2025)
par: Zhou, Zhenhong, et autres
Publié: (2025)
Towards Understanding the Safety Boundaries of DeepSeek Models: Evaluation and Findings
par: Ying, Zonghao, et autres
Publié: (2025)
par: Ying, Zonghao, et autres
Publié: (2025)
When Can Large Reasoning Models Save Thinking? Mechanistic Analysis of Behavioral Divergence in Reasoning
par: Zhu, Rongzhi, et autres
Publié: (2025)
par: Zhu, Rongzhi, et autres
Publié: (2025)
RoboSafe: Safeguarding Embodied Agents via Executable Safety Logic
par: Wang, Le, et autres
Publié: (2025)
par: Wang, Le, et autres
Publié: (2025)
From Context to Intent: Reasoning-Guided Function-Level Code Completion
par: Li, Yanzhou, et autres
Publié: (2025)
par: Li, Yanzhou, et autres
Publié: (2025)
DiffuGuard: How Intrinsic Safety is Lost and Found in Diffusion Large Language Models
par: Li, Zherui, et autres
Publié: (2025)
par: Li, Zherui, et autres
Publié: (2025)
LLMs for Relational Reasoning: How Far are We?
par: Li, Zhiming, et autres
Publié: (2024)
par: Li, Zhiming, et autres
Publié: (2024)
KernelSkill: A Multi-Agent Framework for GPU Kernel Optimization
par: Sun, Qitong, et autres
Publié: (2026)
par: Sun, Qitong, et autres
Publié: (2026)
Minimal and Mechanistic Conditions for Behavioral Self-Awareness in LLMs
par: Bozoukov, Matthew, et autres
Publié: (2025)
par: Bozoukov, Matthew, et autres
Publié: (2025)
Alignment-Enhanced Decoding:Defending via Token-Level Adaptive Refining of Probability Distributions
par: Liu, Quan, et autres
Publié: (2024)
par: Liu, Quan, et autres
Publié: (2024)
Semantic Mirror Jailbreak: Genetic Algorithm Based Jailbreak Prompts Against Open-source LLMs
par: Li, Xiaoxia, et autres
Publié: (2024)
par: Li, Xiaoxia, et autres
Publié: (2024)
Investigating Training Data Detection in AI Coders
par: Li, Tianlin, et autres
Publié: (2025)
par: Li, Tianlin, et autres
Publié: (2025)
Valence-Arousal Subspace in LLMs: Circular Emotion Geometry and Multi-Behavioral Control
par: Sun, Lihao, et autres
Publié: (2026)
par: Sun, Lihao, et autres
Publié: (2026)
Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue
par: Zhou, Zhenhong, et autres
Publié: (2024)
par: Zhou, Zhenhong, et autres
Publié: (2024)
GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?
par: Zhou, Yang, et autres
Publié: (2025)
par: Zhou, Yang, et autres
Publié: (2025)
How Post-Training Reshapes LLMs: A Mechanistic View on Knowledge, Truthfulness, Refusal, and Confidence
par: Du, Hongzhe, et autres
Publié: (2025)
par: Du, Hongzhe, et autres
Publié: (2025)
Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models
par: Ying, Zonghao, et autres
Publié: (2025)
par: Ying, Zonghao, et autres
Publié: (2025)
From Helpfulness to Toxic Proactivity: Diagnosing Behavioral Misalignment in LLM Agents
par: Wang, Xinyue, et autres
Publié: (2026)
par: Wang, Xinyue, et autres
Publié: (2026)
Mechanistic Interpretability of Emotion Inference in Large Language Models
par: Tak, Ala N., et autres
Publié: (2025)
par: Tak, Ala N., et autres
Publié: (2025)
Mechanistic Behavior Editing of Language Models
par: Singh, Joykirat, et autres
Publié: (2024)
par: Singh, Joykirat, et autres
Publié: (2024)
Under the Shadow of Babel: How Language Shapes Reasoning in LLMs
par: Wang, Chenxi, et autres
Publié: (2025)
par: Wang, Chenxi, et autres
Publié: (2025)
BiLLM: Pushing the Limit of Post-Training Quantization for LLMs
par: Huang, Wei, et autres
Publié: (2024)
par: Huang, Wei, et autres
Publié: (2024)
Software Development Life Cycle Perspective: A Survey of Benchmarks for Code Large Language Models and Agents
par: Wang, Kaixin, et autres
Publié: (2025)
par: Wang, Kaixin, et autres
Publié: (2025)
Measuring Reasoning Quality in LLMs: A Multi-Dimensional Behavioral Framework
par: Şenol, Ali, et autres
Publié: (2026)
par: Şenol, Ali, et autres
Publié: (2026)
DeepPlanner: Scaling Planning Capability for Deep Research Agents via Advantage Shaping
par: Fan, Wei, et autres
Publié: (2025)
par: Fan, Wei, et autres
Publié: (2025)
MetaAligner: Towards Generalizable Multi-Objective Alignment of Language Models
par: Yang, Kailai, et autres
Publié: (2024)
par: Yang, Kailai, et autres
Publié: (2024)
Personality-affected Emotion Generation in Dialog Systems
par: Wen, Zhiyuan, et autres
Publié: (2024)
par: Wen, Zhiyuan, et autres
Publié: (2024)
How Jailbreak Defenses Work and Ensemble? A Mechanistic Investigation
par: Long, Zhuohang, et autres
Publié: (2025)
par: Long, Zhuohang, et autres
Publié: (2025)
Are LLMs Ready for Neural-integrated Mechanistic Modeling? A Benchmark and Agentic Framework
par: Guan, Zihan, et autres
Publié: (2026)
par: Guan, Zihan, et autres
Publié: (2026)
Aligning Machiavellian Agents: Behavior Steering via Test-Time Policy Shaping
par: Mujtaba, Dena, et autres
Publié: (2025)
par: Mujtaba, Dena, et autres
Publié: (2025)
OAgents: An Empirical Study of Building Effective Agents
par: Zhu, He, et autres
Publié: (2025)
par: Zhu, He, et autres
Publié: (2025)
Black-Box Adversarial Attack on Vision Language Models for Autonomous Driving
par: Wang, Lu, et autres
Publié: (2025)
par: Wang, Lu, et autres
Publié: (2025)
Centering Emotion Hotspots: Multimodal Local-Global Fusion and Cross-Modal Alignment for Emotion Recognition in Conversations
par: Liu, Yu, et autres
Publié: (2025)
par: Liu, Yu, et autres
Publié: (2025)
DB-LLM: Accurate Dual-Binarization for Efficient LLMs
par: Chen, Hong, et autres
Publié: (2024)
par: Chen, Hong, et autres
Publié: (2024)
Dissecting Bias in LLMs: A Mechanistic Interpretability Perspective
par: Chandna, Bhavik, et autres
Publié: (2025)
par: Chandna, Bhavik, et autres
Publié: (2025)
MASteer: Multi-Agent Adaptive Steer Strategy for End-to-End LLM Trustworthiness Repair
par: Li, Changqing, et autres
Publié: (2025)
par: Li, Changqing, et autres
Publié: (2025)
TheraAgent: Self-Improving Therapeutic Agent for Precise and Comprehensive Treatment Planning
par: Li, Junkai, et autres
Publié: (2026)
par: Li, Junkai, et autres
Publié: (2026)
Densing Law of LLMs
par: Xiao, Chaojun, et autres
Publié: (2024)
par: Xiao, Chaojun, et autres
Publié: (2024)
How Context Shapes Truth: Geometric Transformations of Statement-level Truth Representations in LLMs
par: Adarsh, Shivam, et autres
Publié: (2026)
par: Adarsh, Shivam, et autres
Publié: (2026)
Documents similaires
-
LLMCBench: Benchmarking Large Language Model Compression for Efficient Deployment
par: Yang, Ge, et autres
Publié: (2024) -
CORBA: Contagious Recursive Blocking Attacks on Multi-Agent Systems Based on Large Language Models
par: Zhou, Zhenhong, et autres
Publié: (2025) -
Towards Understanding the Safety Boundaries of DeepSeek Models: Evaluation and Findings
par: Ying, Zonghao, et autres
Publié: (2025) -
When Can Large Reasoning Models Save Thinking? Mechanistic Analysis of Behavioral Divergence in Reasoning
par: Zhu, Rongzhi, et autres
Publié: (2025) -
RoboSafe: Safeguarding Embodied Agents via Executable Safety Logic
par: Wang, Le, et autres
Publié: (2025)