Enough Coin Flips Can Make LLMs Act Bayesian
Fuente:
arXiv
Salvato in:
| Autori principali: | Gupta, Ritwik, Corona, Rodolfo, Ge, Jiaxin, Wang, Eric, Klein, Dan, Darrell, Trevor, Chan, David M. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Puzzled by Puzzles: When Vision-Language Models Can't Take a Hint
di: Lee, Heekyung, et al.
Pubblicazione: (2025)
di: Lee, Heekyung, et al.
Pubblicazione: (2025)
Re-evaluating the Need for Multimodal Signals in Unsupervised Grammar Induction
di: Li, Boyi, et al.
Pubblicazione: (2022)
di: Li, Boyi, et al.
Pubblicazione: (2022)
Analyzing The Language of Visual Tokens
di: Chan, David M., et al.
Pubblicazione: (2024)
di: Chan, David M., et al.
Pubblicazione: (2024)
Which One? Leveraging Context Between Objects and Multiple Views for Language Grounding
di: Mitra, Chancharik, et al.
Pubblicazione: (2023)
di: Mitra, Chancharik, et al.
Pubblicazione: (2023)
REOrdering Patches Improves Vision Models
di: Kutscher, Declan, et al.
Pubblicazione: (2025)
di: Kutscher, Declan, et al.
Pubblicazione: (2025)
How Random is Random? Evaluating the Randomness and Humaness of LLMs' Coin Flips
di: Van Koevering, Katherine, et al.
Pubblicazione: (2024)
di: Van Koevering, Katherine, et al.
Pubblicazione: (2024)
Can LLMs Follow Simple Rules?
di: Mu, Norman, et al.
Pubblicazione: (2023)
di: Mu, Norman, et al.
Pubblicazione: (2023)
Reward Is Enough: LLMs Are In-Context Reinforcement Learners
di: Song, Kefan, et al.
Pubblicazione: (2025)
di: Song, Kefan, et al.
Pubblicazione: (2025)
SEUF: Is Unlearning One Expert Enough for Mixture-of-Experts LLMs?
di: Zhuang, Haomin, et al.
Pubblicazione: (2024)
di: Zhuang, Haomin, et al.
Pubblicazione: (2024)
A Coin Flip for Safety: LLM Judges Fail to Reliably Measure Adversarial Robustness
di: Schwinn, Leo, et al.
Pubblicazione: (2026)
di: Schwinn, Leo, et al.
Pubblicazione: (2026)
Prompt Optimization Is a Coin Flip: Diagnosing When It Helps in Compound AI Systems
di: Zhang, Xing, et al.
Pubblicazione: (2026)
di: Zhang, Xing, et al.
Pubblicazione: (2026)
Learning a Generative Meta-Model of LLM Activations
di: Luo, Grace, et al.
Pubblicazione: (2026)
di: Luo, Grace, et al.
Pubblicazione: (2026)
When Less is Enough: Efficient Inference via Collaborative Reasoning
di: Chen, Yilei, et al.
Pubblicazione: (2026)
di: Chen, Yilei, et al.
Pubblicazione: (2026)
Semantic Anchors in In-Context Learning: Why Small LLMs Cannot Flip Their Labels
di: Kumar, Anantha Padmanaban Krishna
Pubblicazione: (2025)
di: Kumar, Anantha Padmanaban Krishna
Pubblicazione: (2025)
MDAgents: An Adaptive Collaboration of LLMs for Medical Decision-Making
di: Kim, Yubin, et al.
Pubblicazione: (2024)
di: Kim, Yubin, et al.
Pubblicazione: (2024)
Screening Is Enough
di: Nakanishi, Ken M.
Pubblicazione: (2026)
di: Nakanishi, Ken M.
Pubblicazione: (2026)
Enhancing Temporal Understanding in LLMs for Semi-structured Tables
di: Deng, Irwin, et al.
Pubblicazione: (2024)
di: Deng, Irwin, et al.
Pubblicazione: (2024)
Data-Centric AI Governance: Addressing the Limitations of Model-Focused Policies
di: Gupta, Ritwik, et al.
Pubblicazione: (2024)
di: Gupta, Ritwik, et al.
Pubblicazione: (2024)
The Two Sides of the Coin: Hallucination Generation and Detection with LLMs as Evaluators for LLMs
di: Bui, Anh Thu Maria, et al.
Pubblicazione: (2024)
di: Bui, Anh Thu Maria, et al.
Pubblicazione: (2024)
From Exact Hits to Close Enough: Semantic Caching for LLM Embeddings
di: Biton, Dvir David, et al.
Pubblicazione: (2026)
di: Biton, Dvir David, et al.
Pubblicazione: (2026)
ReflAct: World-Grounded Decision Making in LLM Agents via Goal-State Reflection
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
LISAT: Language-Instructed Segmentation Assistant for Satellite Imagery
di: Quenum, Jerome, et al.
Pubblicazione: (2025)
di: Quenum, Jerome, et al.
Pubblicazione: (2025)
Compositional Chain-of-Thought Prompting for Large Multimodal Models
di: Mitra, Chancharik, et al.
Pubblicazione: (2023)
di: Mitra, Chancharik, et al.
Pubblicazione: (2023)
Knowledge Localization in Mixture-of-Experts LLMs Using Cross-Lingual Inconsistency
di: Bandarkar, Lucas, et al.
Pubblicazione: (2026)
di: Bandarkar, Lucas, et al.
Pubblicazione: (2026)
Generalist Foundation Models Are Not Clinical Enough for Hospital Operations
di: Jiang, Lavender Y., et al.
Pubblicazione: (2025)
di: Jiang, Lavender Y., et al.
Pubblicazione: (2025)
ALOHa: A New Measure for Hallucination in Captioning Models
di: Petryk, Suzanne, et al.
Pubblicazione: (2024)
di: Petryk, Suzanne, et al.
Pubblicazione: (2024)
Is Implicit Knowledge Enough for LLMs? A RAG Approach for Tree-based Structures
di: Gupte, Mihir, et al.
Pubblicazione: (2025)
di: Gupte, Mihir, et al.
Pubblicazione: (2025)
Reverse Thinking Makes LLMs Stronger Reasoners
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2024)
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2024)
Climbing the Ladder of Reasoning: What LLMs Can-and Still Can't-Solve after SFT?
di: Sun, Yiyou, et al.
Pubblicazione: (2025)
di: Sun, Yiyou, et al.
Pubblicazione: (2025)
Can GRPO Help LLMs Transcend Their Pretraining Origin?
di: Ni, Kangqi, et al.
Pubblicazione: (2025)
di: Ni, Kangqi, et al.
Pubblicazione: (2025)
Can LLMs Convert Graphs to Text-Attributed Graphs?
di: Wang, Zehong, et al.
Pubblicazione: (2024)
di: Wang, Zehong, et al.
Pubblicazione: (2024)
Can Post-Training Transform LLMs into Causal Reasoners?
di: Chen, Junqi, et al.
Pubblicazione: (2026)
di: Chen, Junqi, et al.
Pubblicazione: (2026)
Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation
di: Tang, Pingzhi, et al.
Pubblicazione: (2026)
di: Tang, Pingzhi, et al.
Pubblicazione: (2026)
How Do LLMs Persuade? Linear Probes Can Uncover Persuasion Dynamics in Multi-Turn Conversations
di: Jaipersaud, Brandon, et al.
Pubblicazione: (2025)
di: Jaipersaud, Brandon, et al.
Pubblicazione: (2025)
Layerwise Recall and the Geometry of Interwoven Knowledge in LLMs
di: Lei, Ge, et al.
Pubblicazione: (2025)
di: Lei, Ge, et al.
Pubblicazione: (2025)
Can LLMs Help Uncover Insights about LLMs? A Large-Scale, Evolving Literature Analysis of Frontier LLMs
di: Park, Jungsoo, et al.
Pubblicazione: (2025)
di: Park, Jungsoo, et al.
Pubblicazione: (2025)
Fitting Is Not Enough: Smoothness in Extremely Quantized LLMs
di: Xu, Yuzhuang, et al.
Pubblicazione: (2026)
di: Xu, Yuzhuang, et al.
Pubblicazione: (2026)
TraveLER: A Modular Multi-LMM Agent Framework for Video Question-Answering
di: Shang, Chuyi, et al.
Pubblicazione: (2024)
di: Shang, Chuyi, et al.
Pubblicazione: (2024)
Adaptive Inference-Time Compute: LLMs Can Predict if They Can Do Better, Even Mid-Generation
di: Manvi, Rohin, et al.
Pubblicazione: (2024)
di: Manvi, Rohin, et al.
Pubblicazione: (2024)
SelfReflect: Can LLMs Communicate Their Internal Answer Distribution?
di: Kirchhof, Michael, et al.
Pubblicazione: (2025)
di: Kirchhof, Michael, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Puzzled by Puzzles: When Vision-Language Models Can't Take a Hint
di: Lee, Heekyung, et al.
Pubblicazione: (2025) -
Re-evaluating the Need for Multimodal Signals in Unsupervised Grammar Induction
di: Li, Boyi, et al.
Pubblicazione: (2022) -
Analyzing The Language of Visual Tokens
di: Chan, David M., et al.
Pubblicazione: (2024) -
Which One? Leveraging Context Between Objects and Multiple Views for Language Grounding
di: Mitra, Chancharik, et al.
Pubblicazione: (2023) -
REOrdering Patches Improves Vision Models
di: Kutscher, Declan, et al.
Pubblicazione: (2025)