Incoherent Probability Judgments in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Jian-Qiao, Griffiths, Thomas L. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Recovering Event Probabilities from Large Language Model Embeddings via Axiomatic Constraints
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2025)
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2025)
Steering Risk Preferences in Large Language Models by Aligning Behavioral and Neural Representations
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2025)
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2025)
Recovering Mental Representations from Large Language Models with Markov Chain Monte Carlo
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2024)
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2024)
Using Reinforcement Learning to Train Large Language Models to Explain Human Decisions
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2025)
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2025)
Language Models Trained to do Arithmetic Predict Human Risky and Intertemporal Choice
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2024)
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2024)
Levels of Analysis for Large Language Models
di: Ku, Alexander Y., et al.
Pubblicazione: (2025)
di: Ku, Alexander Y., et al.
Pubblicazione: (2025)
Eliciting Trustworthiness Priors of Large Language Models via Economic Games
di: Yan, Siyu, et al.
Pubblicazione: (2026)
di: Yan, Siyu, et al.
Pubblicazione: (2026)
Deciphering the Factors Influencing the Efficacy of Chain-of-Thought: Probability, Memorization, and Noisy Reasoning
di: Prabhakar, Akshara, et al.
Pubblicazione: (2024)
di: Prabhakar, Akshara, et al.
Pubblicazione: (2024)
What is a Number, That a Large Language Model May Know It?
di: Marjieh, Raja, et al.
Pubblicazione: (2025)
di: Marjieh, Raja, et al.
Pubblicazione: (2025)
Evaluating and Optimizing Educational Content with Large Language Model Judgments
di: He-Yueya, Joy, et al.
Pubblicazione: (2024)
di: He-Yueya, Joy, et al.
Pubblicazione: (2024)
Exploring Cultural Variations in Moral Judgments with Large Language Models
di: Mohammadi, Hadi, et al.
Pubblicazione: (2025)
di: Mohammadi, Hadi, et al.
Pubblicazione: (2025)
Athena: Retrieval-augmented Legal Judgment Prediction with Large Language Models
di: Peng, Xiao, et al.
Pubblicazione: (2024)
di: Peng, Xiao, et al.
Pubblicazione: (2024)
Simulated Annealing Enhances Theory-of-Mind Reasoning in Autoregressive Language Models
di: Hu, Xucong, et al.
Pubblicazione: (2026)
di: Hu, Xucong, et al.
Pubblicazione: (2026)
Large Language Models Develop Novel Social Biases Through Adaptive Exploration
di: Wu, Addison J., et al.
Pubblicazione: (2025)
di: Wu, Addison J., et al.
Pubblicazione: (2025)
Calibrating Verbalized Probabilities for Large Language Models
di: Wang, Cheng, et al.
Pubblicazione: (2024)
di: Wang, Cheng, et al.
Pubblicazione: (2024)
Parallelograms Strike Back: LLMs Generate Better Analogies than People
di: Liu, Qiawen Ella, et al.
Pubblicazione: (2026)
di: Liu, Qiawen Ella, et al.
Pubblicazione: (2026)
Inertia in Moral and Value Judgments of Large Language Models
di: Lee, Bruce W., et al.
Pubblicazione: (2024)
di: Lee, Bruce W., et al.
Pubblicazione: (2024)
Eliciting the Priors of Large Language Models using Iterated In-Context Learning
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2024)
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2024)
Aligning Large Language Models by On-Policy Self-Judgment
di: Lee, Sangkyu, et al.
Pubblicazione: (2024)
di: Lee, Sangkyu, et al.
Pubblicazione: (2024)
Locally Coherent, Globally Incoherent: Bounding Compositional Incoherence in Multi-Component LLM Agents
di: Kotawala, Anany
Pubblicazione: (2026)
di: Kotawala, Anany
Pubblicazione: (2026)
Localized Cultural Knowledge is Conserved and Controllable in Large Language Models
di: Veselovsky, Veniamin, et al.
Pubblicazione: (2025)
di: Veselovsky, Veniamin, et al.
Pubblicazione: (2025)
Are Large Language Models Reliable AI Scientists? Assessing Reverse-Engineering of Black-Box Systems
di: Geng, Jiayi, et al.
Pubblicazione: (2025)
di: Geng, Jiayi, et al.
Pubblicazione: (2025)
How do Large Language Models Navigate Conflicts between Honesty and Helpfulness?
di: Liu, Ryan, et al.
Pubblicazione: (2024)
di: Liu, Ryan, et al.
Pubblicazione: (2024)
Ask Again, Then Fail: Large Language Models' Vacillations in Judgment
di: Xie, Qiming, et al.
Pubblicazione: (2023)
di: Xie, Qiming, et al.
Pubblicazione: (2023)
Is This Just Fantasy? Language Model Representations Reflect Human Judgments of Event Plausibility
di: Lepori, Michael A., et al.
Pubblicazione: (2025)
di: Lepori, Michael A., et al.
Pubblicazione: (2025)
The Pluralistic Moral Gap: Understanding Judgment and Value Differences between Humans and Large Language Models
di: Russo, Giuseppe, et al.
Pubblicazione: (2025)
di: Russo, Giuseppe, et al.
Pubblicazione: (2025)
Ads in AI Chatbots? An Analysis of How Large Language Models Navigate Conflicts of Interest
di: Wu, Addison J., et al.
Pubblicazione: (2026)
di: Wu, Addison J., et al.
Pubblicazione: (2026)
Rational Metareasoning for Large Language Models
di: De Sabbata, C. Nicolò, et al.
Pubblicazione: (2024)
di: De Sabbata, C. Nicolò, et al.
Pubblicazione: (2024)
Are Large Language Models Sensitive to the Motives Behind Communication?
di: Wu, Addison J., et al.
Pubblicazione: (2025)
di: Wu, Addison J., et al.
Pubblicazione: (2025)
MacGyver: Are Large Language Models Creative Problem Solvers?
di: Tian, Yufei, et al.
Pubblicazione: (2023)
di: Tian, Yufei, et al.
Pubblicazione: (2023)
Uncertainty Quantification for Multimodal Large Language Models with Incoherence-adjusted Semantic Volume
di: Lau, Gregory Kang Ruey, et al.
Pubblicazione: (2026)
di: Lau, Gregory Kang Ruey, et al.
Pubblicazione: (2026)
Automatic Item Generation for Personality Situational Judgment Tests with Large Language Models
di: Li, Chang-Jin, et al.
Pubblicazione: (2024)
di: Li, Chang-Jin, et al.
Pubblicazione: (2024)
Position Paper On Diagnostic Uncertainty Estimation from Large Language Models: Next-Word Probability Is Not Pre-test Probability
di: Gao, Yanjun, et al.
Pubblicazione: (2024)
di: Gao, Yanjun, et al.
Pubblicazione: (2024)
Machine Bullshit: Characterizing the Emergent Disregard for Truth in Large Language Models
di: Liang, Kaiqu, et al.
Pubblicazione: (2025)
di: Liang, Kaiqu, et al.
Pubblicazione: (2025)
A Survey on Model Compression for Large Language Models
di: Zhu, Xunyu, et al.
Pubblicazione: (2023)
di: Zhu, Xunyu, et al.
Pubblicazione: (2023)
Large Language Models Assume People are More Rational than We Really are
di: Liu, Ryan, et al.
Pubblicazione: (2024)
di: Liu, Ryan, et al.
Pubblicazione: (2024)
Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models
di: Zhang, Liyi, et al.
Pubblicazione: (2025)
di: Zhang, Liyi, et al.
Pubblicazione: (2025)
Fairer Preferences Elicit Improved Human-Aligned Large Language Model Judgments
di: Zhou, Han, et al.
Pubblicazione: (2024)
di: Zhou, Han, et al.
Pubblicazione: (2024)
Dissecting Failure Dynamics in Large Language Model Reasoning
di: Zhu, Wei, et al.
Pubblicazione: (2026)
di: Zhu, Wei, et al.
Pubblicazione: (2026)
Key-Point-Driven Mathematical Reasoning Distillation of Large Language Model
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Recovering Event Probabilities from Large Language Model Embeddings via Axiomatic Constraints
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2025) -
Steering Risk Preferences in Large Language Models by Aligning Behavioral and Neural Representations
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2025) -
Recovering Mental Representations from Large Language Models with Markov Chain Monte Carlo
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2024) -
Using Reinforcement Learning to Train Large Language Models to Explain Human Decisions
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2025) -
Language Models Trained to do Arithmetic Predict Human Risky and Intertemporal Choice
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2024)