Accumulating Context Changes the Beliefs of Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Geng, Jiayi, Chen, Howard, Liu, Ryan, Ribeiro, Manoel Horta, Willer, Robb, Neubig, Graham, Griffiths, Thomas L. |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Effective Strategies for Asynchronous Software Engineering Agents
von: Geng, Jiayi, et al.
Veröffentlicht: (2026)
von: Geng, Jiayi, et al.
Veröffentlicht: (2026)
Are Large Language Models Reliable AI Scientists? Assessing Reverse-Engineering of Black-Box Systems
von: Geng, Jiayi, et al.
Veröffentlicht: (2025)
von: Geng, Jiayi, et al.
Veröffentlicht: (2025)
Large Language Models Assume People are More Rational than We Really are
von: Liu, Ryan, et al.
Veröffentlicht: (2024)
von: Liu, Ryan, et al.
Veröffentlicht: (2024)
The Illusion of Insight in Reasoning Models
von: d'Aliberti, Liv G., et al.
Veröffentlicht: (2026)
von: d'Aliberti, Liv G., et al.
Veröffentlicht: (2026)
Can Large Language Models be Trusted for Evaluation? Scalable Meta-Evaluation of LLMs as Evaluators via Agent Debate
von: Chern, Steffi, et al.
Veröffentlicht: (2024)
von: Chern, Steffi, et al.
Veröffentlicht: (2024)
Commercial Persuasion in AI-Mediated Conversations
von: Salvi, Francesco, et al.
Veröffentlicht: (2026)
von: Salvi, Francesco, et al.
Veröffentlicht: (2026)
Language Modeling with Editable External Knowledge
von: Li, Belinda Z., et al.
Veröffentlicht: (2024)
von: Li, Belinda Z., et al.
Veröffentlicht: (2024)
Levels of Analysis for Large Language Models
von: Ku, Alexander Y., et al.
Veröffentlicht: (2025)
von: Ku, Alexander Y., et al.
Veröffentlicht: (2025)
What Are Tools Anyway? A Survey from the Language Model Perspective
von: Wang, Zhiruo, et al.
Veröffentlicht: (2024)
von: Wang, Zhiruo, et al.
Veröffentlicht: (2024)
Oolong: Evaluating Long Context Reasoning and Aggregation Capabilities
von: Bertsch, Amanda, et al.
Veröffentlicht: (2025)
von: Bertsch, Amanda, et al.
Veröffentlicht: (2025)
Incoherent Probability Judgments in Large Language Models
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2024)
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2024)
Large Language Models Develop Novel Social Biases Through Adaptive Exploration
von: Wu, Addison J., et al.
Veröffentlicht: (2025)
von: Wu, Addison J., et al.
Veröffentlicht: (2025)
How do Large Language Models Navigate Conflicts between Honesty and Helpfulness?
von: Liu, Ryan, et al.
Veröffentlicht: (2024)
von: Liu, Ryan, et al.
Veröffentlicht: (2024)
Mind Your Step (by Step): Chain-of-Thought can Reduce Performance on Tasks where Thinking Makes Humans Worse
von: Liu, Ryan, et al.
Veröffentlicht: (2024)
von: Liu, Ryan, et al.
Veröffentlicht: (2024)
Are Large Language Models Sensitive to the Motives Behind Communication?
von: Wu, Addison J., et al.
Veröffentlicht: (2025)
von: Wu, Addison J., et al.
Veröffentlicht: (2025)
Divergences between Language Models and Human Brains
von: Zhou, Yuchen, et al.
Veröffentlicht: (2023)
von: Zhou, Yuchen, et al.
Veröffentlicht: (2023)
Steering Risk Preferences in Large Language Models by Aligning Behavioral and Neural Representations
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2025)
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2025)
FairBelief -- Assessing Harmful Beliefs in Language Models
von: Setzu, Mattia, et al.
Veröffentlicht: (2024)
von: Setzu, Mattia, et al.
Veröffentlicht: (2024)
Ads in AI Chatbots? An Analysis of How Large Language Models Navigate Conflicts of Interest
von: Wu, Addison J., et al.
Veröffentlicht: (2026)
von: Wu, Addison J., et al.
Veröffentlicht: (2026)
Recovering Event Probabilities from Large Language Model Embeddings via Axiomatic Constraints
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2025)
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2025)
Recovering Mental Representations from Large Language Models with Markov Chain Monte Carlo
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2024)
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2024)
Cognitive Models and AI Algorithms Provide Templates for Designing Language Agents
von: Liu, Ryan, et al.
Veröffentlicht: (2026)
von: Liu, Ryan, et al.
Veröffentlicht: (2026)
What is a Number, That a Large Language Model May Know It?
von: Marjieh, Raja, et al.
Veröffentlicht: (2025)
von: Marjieh, Raja, et al.
Veröffentlicht: (2025)
Overtrained Language Models Are Harder to Fine-Tune
von: Springer, Jacob Mitchell, et al.
Veröffentlicht: (2025)
von: Springer, Jacob Mitchell, et al.
Veröffentlicht: (2025)
Evaluating Language Models' Evaluations of Games
von: Collins, Katherine M., et al.
Veröffentlicht: (2025)
von: Collins, Katherine M., et al.
Veröffentlicht: (2025)
Training Versatile Coding Agents in Synthetic Environments
von: Zhu, Yiqi, et al.
Veröffentlicht: (2025)
von: Zhu, Yiqi, et al.
Veröffentlicht: (2025)
Alignment for Honesty
von: Yang, Yuqing, et al.
Veröffentlicht: (2023)
von: Yang, Yuqing, et al.
Veröffentlicht: (2023)
HELMET: How to Evaluate Long-Context Language Models Effectively and Thoroughly
von: Yen, Howard, et al.
Veröffentlicht: (2024)
von: Yen, Howard, et al.
Veröffentlicht: (2024)
When Should Models Change Their Minds? Contextual Belief Management in Large Language Models
von: Xu, Haoming, et al.
Veröffentlicht: (2026)
von: Xu, Haoming, et al.
Veröffentlicht: (2026)
Language Models Represent Beliefs of Self and Others
von: Zhu, Wentao, et al.
Veröffentlicht: (2024)
von: Zhu, Wentao, et al.
Veröffentlicht: (2024)
SELF-GUIDE: Better Task-Specific Instruction Following via Self-Synthetic Finetuning
von: Zhao, Chenyang, et al.
Veröffentlicht: (2024)
von: Zhao, Chenyang, et al.
Veröffentlicht: (2024)
Not-Just-Scaling Laws: Towards a Better Understanding of the Downstream Impact of Language Model Design Decisions
von: Liu, Emmy, et al.
Veröffentlicht: (2025)
von: Liu, Emmy, et al.
Veröffentlicht: (2025)
Using Reinforcement Learning to Train Large Language Models to Explain Human Decisions
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2025)
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2025)
Language Models Trained to do Arithmetic Predict Human Risky and Intertemporal Choice
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2024)
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2024)
Context-level Language Modeling by Learning Predictive Context Embeddings
von: Dai, Beiya, et al.
Veröffentlicht: (2025)
von: Dai, Beiya, et al.
Veröffentlicht: (2025)
Emergent Semantic Role Understanding in Language Models
von: Griffiths, Carla, et al.
Veröffentlicht: (2026)
von: Griffiths, Carla, et al.
Veröffentlicht: (2026)
On the Superimposed Noise Accumulation Problem in Sequential Knowledge Editing of Large Language Models
von: Cao, Ding, et al.
Veröffentlicht: (2025)
von: Cao, Ding, et al.
Veröffentlicht: (2025)
Better Instruction-Following Through Minimum Bayes Risk
von: Wu, Ian, et al.
Veröffentlicht: (2024)
von: Wu, Ian, et al.
Veröffentlicht: (2024)
Stories in Space: In-Context Learning Trajectories in Conceptual Belief Space
von: Bigelow, Eric, et al.
Veröffentlicht: (2026)
von: Bigelow, Eric, et al.
Veröffentlicht: (2026)
Belief in the Machine: Investigating Epistemological Blind Spots of Language Models
von: Suzgun, Mirac, et al.
Veröffentlicht: (2024)
von: Suzgun, Mirac, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Effective Strategies for Asynchronous Software Engineering Agents
von: Geng, Jiayi, et al.
Veröffentlicht: (2026) -
Are Large Language Models Reliable AI Scientists? Assessing Reverse-Engineering of Black-Box Systems
von: Geng, Jiayi, et al.
Veröffentlicht: (2025) -
Large Language Models Assume People are More Rational than We Really are
von: Liu, Ryan, et al.
Veröffentlicht: (2024) -
The Illusion of Insight in Reasoning Models
von: d'Aliberti, Liv G., et al.
Veröffentlicht: (2026) -
Can Large Language Models be Trusted for Evaluation? Scalable Meta-Evaluation of LLMs as Evaluators via Agent Debate
von: Chern, Steffi, et al.
Veröffentlicht: (2024)