Language Models Represent Beliefs of Self and Others
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhu, Wentao, Zhang, Zhining, Wang, Yizhou |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SelfElicit: Your Language Model Secretly Knows Where is the Relevant Evidence
von: Liu, Zhining, et al.
Veröffentlicht: (2025)
von: Liu, Zhining, et al.
Veröffentlicht: (2025)
FairBelief -- Assessing Harmful Beliefs in Language Models
von: Setzu, Mattia, et al.
Veröffentlicht: (2024)
von: Setzu, Mattia, et al.
Veröffentlicht: (2024)
Neural Synchrony Between Socially Interacting Language Models
von: Zhang, Zhining, et al.
Veröffentlicht: (2026)
von: Zhang, Zhining, et al.
Veröffentlicht: (2026)
PDDL-Mind: Large Language Models are Capable on Belief Reasoning with Reliable State Tracking
von: Zhu, Wang Bill, et al.
Veröffentlicht: (2026)
von: Zhu, Wang Bill, et al.
Veröffentlicht: (2026)
Representing the Under-Represented: Cultural and Core Capability Benchmarks for Developing Thai Large Language Models
von: Kim, Dahyun, et al.
Veröffentlicht: (2024)
von: Kim, Dahyun, et al.
Veröffentlicht: (2024)
Accumulating Context Changes the Beliefs of Language Models
von: Geng, Jiayi, et al.
Veröffentlicht: (2025)
von: Geng, Jiayi, et al.
Veröffentlicht: (2025)
LLM for Everyone: Representing the Underrepresented in Large Language Models
von: Cahyawijaya, Samuel
Veröffentlicht: (2024)
von: Cahyawijaya, Samuel
Veröffentlicht: (2024)
AutoToM: Scaling Model-based Mental Inference via Automated Agent Modeling
von: Zhang, Zhining, et al.
Veröffentlicht: (2025)
von: Zhang, Zhining, et al.
Veröffentlicht: (2025)
HALO: An Ontology for Representing and Categorizing Hallucinations in Large Language Models
von: Nananukul, Navapat, et al.
Veröffentlicht: (2023)
von: Nananukul, Navapat, et al.
Veröffentlicht: (2023)
K-Level Reasoning: Establishing Higher Order Beliefs in Large Language Models for Strategic Reasoning
von: Zhang, Yadong, et al.
Veröffentlicht: (2024)
von: Zhang, Yadong, et al.
Veröffentlicht: (2024)
Examining Alignment of Large Language Models through Representative Heuristics: The Case of Political Stereotypes
von: Jeoung, Sullam, et al.
Veröffentlicht: (2025)
von: Jeoung, Sullam, et al.
Veröffentlicht: (2025)
Language Models Represent Space and Time
von: Gurnee, Wes, et al.
Veröffentlicht: (2023)
von: Gurnee, Wes, et al.
Veröffentlicht: (2023)
Uncertainty Estimation of Large Language Models in Medical Question Answering
von: Wu, Jiaxin, et al.
Veröffentlicht: (2024)
von: Wu, Jiaxin, et al.
Veröffentlicht: (2024)
Evaluating Theory of (an uncertain) Mind: Predicting the Uncertain Beliefs of Others in Conversation Forecasting
von: Sicilia, Anthony, et al.
Veröffentlicht: (2024)
von: Sicilia, Anthony, et al.
Veröffentlicht: (2024)
Consistency of Responses and Continuations Generated by Large Language Models on Social Media
von: Xu, Wentao, et al.
Veröffentlicht: (2025)
von: Xu, Wentao, et al.
Veröffentlicht: (2025)
Brittle Minds, Fixable Activations: Understanding Belief Representations in Language Models
von: Bortoletto, Matteo, et al.
Veröffentlicht: (2024)
von: Bortoletto, Matteo, et al.
Veröffentlicht: (2024)
Exploring the Potential for Large Language Models to Demonstrate Rational Probabilistic Beliefs
von: Freedman, Gabriel, et al.
Veröffentlicht: (2025)
von: Freedman, Gabriel, et al.
Veröffentlicht: (2025)
VAL-Bench: Belief Consistency as a measure for Value Alignment in Language Models
von: Gupta, Aman, et al.
Veröffentlicht: (2025)
von: Gupta, Aman, et al.
Veröffentlicht: (2025)
Belief in the Machine: Investigating Epistemological Blind Spots of Language Models
von: Suzgun, Mirac, et al.
Veröffentlicht: (2024)
von: Suzgun, Mirac, et al.
Veröffentlicht: (2024)
Belief Memory: Agent Memory Under Partial Observability
von: Liao, Junfeng, et al.
Veröffentlicht: (2026)
von: Liao, Junfeng, et al.
Veröffentlicht: (2026)
Language Models as Continuous Self-Evolving Data Engineers
von: Wang, Peidong, et al.
Veröffentlicht: (2024)
von: Wang, Peidong, et al.
Veröffentlicht: (2024)
Probing and Inducing Combinational Creativity in Vision-Language Models
von: Peng, Yongqian, et al.
Veröffentlicht: (2025)
von: Peng, Yongqian, et al.
Veröffentlicht: (2025)
Zero, Finite, and Infinite Belief History of Theory of Mind Reasoning in Large Language Models
von: Tang, Weizhi, et al.
Veröffentlicht: (2024)
von: Tang, Weizhi, et al.
Veröffentlicht: (2024)
Compressing Sequences in the Latent Embedding Space: $K$-Token Merging for Large Language Models
von: Xu, Zihao, et al.
Veröffentlicht: (2026)
von: Xu, Zihao, et al.
Veröffentlicht: (2026)
Boosting Large Language Models with Mask Fine-Tuning
von: Zhang, Mingyuan, et al.
Veröffentlicht: (2025)
von: Zhang, Mingyuan, et al.
Veröffentlicht: (2025)
Dream to Chat: Model-based Reinforcement Learning on Dialogues with User Belief Modeling
von: Zhao, Yue, et al.
Veröffentlicht: (2025)
von: Zhao, Yue, et al.
Veröffentlicht: (2025)
Think Again! The Effect of Test-Time Compute on Preferences, Opinions, and Beliefs of Large Language Models
von: Kour, George, et al.
Veröffentlicht: (2025)
von: Kour, George, et al.
Veröffentlicht: (2025)
Grounding Language about Belief in a Bayesian Theory-of-Mind
von: Ying, Lance, et al.
Veröffentlicht: (2024)
von: Ying, Lance, et al.
Veröffentlicht: (2024)
Process-based Self-Rewarding Language Models
von: Zhang, Shimao, et al.
Veröffentlicht: (2025)
von: Zhang, Shimao, et al.
Veröffentlicht: (2025)
Learning to Self-Verify Makes Language Models Better Reasoners
von: Chen, Yuxin, et al.
Veröffentlicht: (2026)
von: Chen, Yuxin, et al.
Veröffentlicht: (2026)
Evaluating Moral Beliefs across LLMs through a Pluralistic Framework
von: Liu, Xuelin, et al.
Veröffentlicht: (2024)
von: Liu, Xuelin, et al.
Veröffentlicht: (2024)
ModelCitizens: Representing Community Voices in Online Safety
von: Suvarna, Ashima, et al.
Veröffentlicht: (2025)
von: Suvarna, Ashima, et al.
Veröffentlicht: (2025)
Flexible Realignment of Language Models
von: Zhu, Wenhong, et al.
Veröffentlicht: (2025)
von: Zhu, Wenhong, et al.
Veröffentlicht: (2025)
When Should Models Change Their Minds? Contextual Belief Management in Large Language Models
von: Xu, Haoming, et al.
Veröffentlicht: (2026)
von: Xu, Haoming, et al.
Veröffentlicht: (2026)
Direct Alignment of Language Models via Quality-Aware Self-Refinement
von: Yu, Runsheng, et al.
Veröffentlicht: (2024)
von: Yu, Runsheng, et al.
Veröffentlicht: (2024)
Self-Prompting Large Language Models for Zero-Shot Open-Domain QA
von: Li, Junlong, et al.
Veröffentlicht: (2022)
von: Li, Junlong, et al.
Veröffentlicht: (2022)
Belief-Sim: Towards Belief-Driven Simulation of Demographic Misinformation Susceptibility
von: Borah, Angana, et al.
Veröffentlicht: (2026)
von: Borah, Angana, et al.
Veröffentlicht: (2026)
An Examination on the Effectiveness of Divide-and-Conquer Prompting in Large Language Models
von: Zhang, Yizhou, et al.
Veröffentlicht: (2024)
von: Zhang, Yizhou, et al.
Veröffentlicht: (2024)
Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future
von: Wang, Yidong, et al.
Veröffentlicht: (2025)
von: Wang, Yidong, et al.
Veröffentlicht: (2025)
Table as a Modality for Large Language Models
von: Li, Liyao, et al.
Veröffentlicht: (2025)
von: Li, Liyao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
SelfElicit: Your Language Model Secretly Knows Where is the Relevant Evidence
von: Liu, Zhining, et al.
Veröffentlicht: (2025) -
FairBelief -- Assessing Harmful Beliefs in Language Models
von: Setzu, Mattia, et al.
Veröffentlicht: (2024) -
Neural Synchrony Between Socially Interacting Language Models
von: Zhang, Zhining, et al.
Veröffentlicht: (2026) -
PDDL-Mind: Large Language Models are Capable on Belief Reasoning with Reliable State Tracking
von: Zhu, Wang Bill, et al.
Veröffentlicht: (2026) -
Representing the Under-Represented: Cultural and Core Capability Benchmarks for Developing Thai Large Language Models
von: Kim, Dahyun, et al.
Veröffentlicht: (2024)