Enregistré dans:
| Auteur principal: | Yang, Lingyu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2506.18928 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
How Random is Random? Evaluating the Randomness and Humaness of LLMs' Coin Flips
par: Van Koevering, Katherine, et autres
Publié: (2024)
par: Van Koevering, Katherine, et autres
Publié: (2024)
Enough Coin Flips Can Make LLMs Act Bayesian
par: Gupta, Ritwik, et autres
Publié: (2025)
par: Gupta, Ritwik, et autres
Publié: (2025)
Prompt Optimization Is a Coin Flip: Diagnosing When It Helps in Compound AI Systems
par: Zhang, Xing, et autres
Publié: (2026)
par: Zhang, Xing, et autres
Publié: (2026)
Reasoning about Uncertainty: Do Reasoning Models Know When They Don't Know?
par: Mei, Zhiting, et autres
Publié: (2025)
par: Mei, Zhiting, et autres
Publié: (2025)
Evaluating LLMs When They Do Not Know the Answer: Statistical Evaluation of Mathematical Reasoning via Comparative Signals
par: Dong, Zihan, et autres
Publié: (2026)
par: Dong, Zihan, et autres
Publié: (2026)
When Models Know When They Do Not Know: Calibration, Cascading, and Cleaning
par: Hao, Chenjie, et autres
Publié: (2026)
par: Hao, Chenjie, et autres
Publié: (2026)
Do Retrieval Augmented Language Models Know When They Don't Know?
par: Zhou, Youchao, et autres
Publié: (2025)
par: Zhou, Youchao, et autres
Publié: (2025)
Do LLMs Experience an Internal Polylogue? Investigating Reasoning through the Lens of Personas
par: Herrmann, Nils A., et autres
Publié: (2026)
par: Herrmann, Nils A., et autres
Publié: (2026)
Do Persona-Infused LLMs Affect Performance in a Strategic Reasoning Game?
par: Licato, John, et autres
Publié: (2025)
par: Licato, John, et autres
Publié: (2025)
SPIN-Bench: How Well Do LLMs Plan Strategically and Reason Socially?
par: Yao, Jianzhu, et autres
Publié: (2025)
par: Yao, Jianzhu, et autres
Publié: (2025)
Epistemic Artificial Intelligence is Essential for Machine Learning Models to Truly 'Know When They Do Not Know'
par: Manchingal, Shireen Kudukkil, et autres
Publié: (2025)
par: Manchingal, Shireen Kudukkil, et autres
Publié: (2025)
Towards Agents That Know When They Don't Know: Uncertainty as a Control Signal for Structured Reasoning
par: Stoisser, Josefa Lia, et autres
Publié: (2025)
par: Stoisser, Josefa Lia, et autres
Publié: (2025)
When Models Know More Than They Say: Probing Analogical Reasoning in LLMs
par: McGovern, Hope, et autres
Publié: (2026)
par: McGovern, Hope, et autres
Publié: (2026)
A Coin Flip for Safety: LLM Judges Fail to Reliably Measure Adversarial Robustness
par: Schwinn, Leo, et autres
Publié: (2026)
par: Schwinn, Leo, et autres
Publié: (2026)
Understanding Reasoning in LLMs through Strategic Information Allocation under Uncertainty
par: Kim, Jeonghye, et autres
Publié: (2026)
par: Kim, Jeonghye, et autres
Publié: (2026)
Epistemic Deep Learning: Enabling Machine Learning Models to Know When They Do Not Know
par: Manchingal, Shireen Kudukkil
Publié: (2025)
par: Manchingal, Shireen Kudukkil
Publié: (2025)
Knowing When Not to Answer: Abstention-Aware Scientific Reasoning
par: Abdaljalil, Samir, et autres
Publié: (2026)
par: Abdaljalil, Samir, et autres
Publié: (2026)
Strat-Reasoner: Reinforcing Strategic Reasoning of LLMs in Multi-Agent Games
par: He, Yidong, et autres
Publié: (2026)
par: He, Yidong, et autres
Publié: (2026)
FlipAttack: Jailbreak LLMs via Flipping
par: Liu, Yue, et autres
Publié: (2024)
par: Liu, Yue, et autres
Publié: (2024)
Do Language Models Know When They're Hallucinating References?
par: Agrawal, Ayush, et autres
Publié: (2023)
par: Agrawal, Ayush, et autres
Publié: (2023)
Does Your Reasoning Model Implicitly Know When to Stop Thinking?
par: Huang, Zixuan, et autres
Publié: (2026)
par: Huang, Zixuan, et autres
Publié: (2026)
Knowing When to Abstain: Medical LLMs Under Clinical Uncertainty
par: Machcha, Sravanthi, et autres
Publié: (2026)
par: Machcha, Sravanthi, et autres
Publié: (2026)
Seeing Isn't Knowing: Do VLMs Know When Not to Answer Spatial Questions (and Why)?
par: Zhang, Yue, et autres
Publié: (2026)
par: Zhang, Yue, et autres
Publié: (2026)
When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models
par: Wang, Kai, et autres
Publié: (2025)
par: Wang, Kai, et autres
Publié: (2025)
The Two Sides of the Coin: Hallucination Generation and Detection with LLMs as Evaluators for LLMs
par: Bui, Anh Thu Maria, et autres
Publié: (2024)
par: Bui, Anh Thu Maria, et autres
Publié: (2024)
Knowing You Don't Know: Learning When to Continue Search in Multi-round RAG through Self-Practicing
par: Yang, Diji, et autres
Publié: (2025)
par: Yang, Diji, et autres
Publié: (2025)
HiL-Bench (Human-in-Loop Benchmark): Do Agents Know When to Ask for Help?
par: Trinh, Tu, et autres
Publié: (2026)
par: Trinh, Tu, et autres
Publié: (2026)
Base Models Know How to Reason, Thinking Models Learn When
par: Venhoff, Constantin, et autres
Publié: (2025)
par: Venhoff, Constantin, et autres
Publié: (2025)
Know When to Trust the Skill: Delayed Appraisal and Epistemic Vigilance for Single-Agent LLMs
par: Unlu, Eren
Publié: (2026)
par: Unlu, Eren
Publié: (2026)
Teaching Large Language Models When Not to Know: Learning Temporal Critique for Ex-Ante Reasoning
par: Ding, Chenlu, et autres
Publié: (2026)
par: Ding, Chenlu, et autres
Publié: (2026)
Know What You Know: Metacognitive Entropy Calibration for Verifiable RL Reasoning
par: Zhao, Qiannian, et autres
Publié: (2026)
par: Zhao, Qiannian, et autres
Publié: (2026)
Strategic Chain-of-Thought: Guiding Accurate Reasoning in LLMs through Strategy Elicitation
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
When Truthful Representations Flip Under Deceptive Instructions?
par: Long, Xianxuan, et autres
Publié: (2025)
par: Long, Xianxuan, et autres
Publié: (2025)
Do LLMs Know What They Know? Measuring Metacognitive Efficiency with Signal Detection Theory
par: Cacioli, Jon-Paul
Publié: (2026)
par: Cacioli, Jon-Paul
Publié: (2026)
Attention Sinks and Compression Valleys in LLMs are Two Sides of the Same Coin
par: Queipo-de-Llano, Enrique, et autres
Publié: (2025)
par: Queipo-de-Llano, Enrique, et autres
Publié: (2025)
FlipLLM: Efficient Bit-Flip Attacks on Multimodal LLMs using Reinforcement Learning
par: Khalil, Khurram, et autres
Publié: (2025)
par: Khalil, Khurram, et autres
Publié: (2025)
When Human Preferences Flip: An Instance-Dependent Robust Loss for RLHF
par: Xu, Yifan, et autres
Publié: (2025)
par: Xu, Yifan, et autres
Publié: (2025)
Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations
par: Liu, Yilong, et autres
Publié: (2026)
par: Liu, Yilong, et autres
Publié: (2026)
When Do LLMs Reason? A Dynamical Systems View via Entropy Phase Transitions
par: Xia, Wei, et autres
Publié: (2026)
par: Xia, Wei, et autres
Publié: (2026)
Know When to Explore: Difficulty-Aware Certainty as a Guide for LLM Reinforcement Learning
par: Li, Ang, et autres
Publié: (2025)
par: Li, Ang, et autres
Publié: (2025)
Documents similaires
-
How Random is Random? Evaluating the Randomness and Humaness of LLMs' Coin Flips
par: Van Koevering, Katherine, et autres
Publié: (2024) -
Enough Coin Flips Can Make LLMs Act Bayesian
par: Gupta, Ritwik, et autres
Publié: (2025) -
Prompt Optimization Is a Coin Flip: Diagnosing When It Helps in Compound AI Systems
par: Zhang, Xing, et autres
Publié: (2026) -
Reasoning about Uncertainty: Do Reasoning Models Know When They Don't Know?
par: Mei, Zhiting, et autres
Publié: (2025) -
Evaluating LLMs When They Do Not Know the Answer: Statistical Evaluation of Mathematical Reasoning via Comparative Signals
par: Dong, Zihan, et autres
Publié: (2026)