Enregistré dans:
| Auteurs principaux: | Seo, Ki Jung, Lim, Sehun, Kim, Taeuk |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2510.10913 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Revisiting the Impact of Pursuing Modularity for Code Generation
par: Kang, Deokyeong, et autres
Publié: (2024)
par: Kang, Deokyeong, et autres
Publié: (2024)
Think, Verbalize, then Speak: Bridging Complex Thoughts and Comprehensible Speech
par: Woo, Sang Hoon, et autres
Publié: (2025)
par: Woo, Sang Hoon, et autres
Publié: (2025)
On Verbalized Confidence Scores for LLMs
par: Yang, Daniel, et autres
Publié: (2024)
par: Yang, Daniel, et autres
Publié: (2024)
Confidence Estimation in Automatic Short Answer Grading with LLMs
par: Cong, Longwei, et autres
Publié: (2026)
par: Cong, Longwei, et autres
Publié: (2026)
Does Localization Inform Unlearning? A Rigorous Examination of Local Parameter Attribution for Knowledge Unlearning in Language Models
par: Lee, Hwiyeong, et autres
Publié: (2025)
par: Lee, Hwiyeong, et autres
Publié: (2025)
FCMR: Robust Evaluation of Financial Cross-Modal Multi-Hop Reasoning
par: Kim, Seunghee, et autres
Publié: (2024)
par: Kim, Seunghee, et autres
Publié: (2024)
Analysis of Multi-Source Language Training in Cross-Lingual Transfer
par: Lim, Seong Hoon, et autres
Publié: (2024)
par: Lim, Seong Hoon, et autres
Publié: (2024)
RAISE: Enhancing Scientific Reasoning in LLMs via Step-by-Step Retrieval
par: Oh, Minhae, et autres
Publié: (2025)
par: Oh, Minhae, et autres
Publié: (2025)
Direct Confidence Alignment: Aligning Verbalized Confidence with Internal Confidence In Large Language Models
par: Zhang, Glenn, et autres
Publié: (2025)
par: Zhang, Glenn, et autres
Publié: (2025)
On the Robustness of Verbal Confidence of LLMs in Adversarial Attacks
par: Obadinma, Stephen, et autres
Publié: (2025)
par: Obadinma, Stephen, et autres
Publié: (2025)
Are LLM Decisions Faithful to Verbal Confidence?
par: Wang, Jiawei, et autres
Publié: (2026)
par: Wang, Jiawei, et autres
Publié: (2026)
Let the Model Distribute Its Doubt: Confidence Estimation through Verbalized Probability Distribution
par: Wang, Ante, et autres
Publié: (2025)
par: Wang, Ante, et autres
Publié: (2025)
MAGIC: A Multi-Hop and Graph-Based Benchmark for Inter-Context Conflicts in Retrieval-Augmented Generation
par: Lee, Jungyeon, et autres
Publié: (2025)
par: Lee, Jungyeon, et autres
Publié: (2025)
Latent Preference Modeling for Cross-Session Personalized Tool Calling
par: Yoon, Yejin, et autres
Publié: (2026)
par: Yoon, Yejin, et autres
Publié: (2026)
Calibrating Verbalized Confidence with Self-Generated Distractors
par: Wang, Victor, et autres
Publié: (2025)
par: Wang, Victor, et autres
Publié: (2025)
Subgraph-Aware Training of Language Models for Knowledge Graph Completion Using Structure-Aware Contrastive Learning
par: Ko, Youmin, et autres
Publié: (2024)
par: Ko, Youmin, et autres
Publié: (2024)
Are Large Language Models More Honest in Their Probabilistic or Verbalized Confidence?
par: Ni, Shiyu, et autres
Publié: (2024)
par: Ni, Shiyu, et autres
Publié: (2024)
Influential Training Data Retrieval for Explaining Verbalized Confidence of LLMs
par: Xia, Yuxi, et autres
Publié: (2026)
par: Xia, Yuxi, et autres
Publié: (2026)
Superficial Success vs. Internal Breakdown: An Empirical Study of Generalization in Adaptive Multi-Agent Systems
par: So, Namyoung, et autres
Publié: (2026)
par: So, Namyoung, et autres
Publié: (2026)
How do LLMs Compute Verbal Confidence
par: Kumaran, Dharshan, et autres
Publié: (2026)
par: Kumaran, Dharshan, et autres
Publié: (2026)
Verbalized Confidence Triggers Self-Verification: Emergent Behavior Without Explicit Reasoning Supervision
par: Jang, Chaeyun, et autres
Publié: (2025)
par: Jang, Chaeyun, et autres
Publié: (2025)
Wired for Overconfidence: A Mechanistic Perspective on Inflated Verbalized Confidence in LLMs
par: Zhao, Tianyi, et autres
Publié: (2026)
par: Zhao, Tianyi, et autres
Publié: (2026)
OmniACBench: A Benchmark for Evaluating Context-Grounded Acoustic Control in Omni-Modal Models
par: Kim, Seunghee, et autres
Publié: (2026)
par: Kim, Seunghee, et autres
Publié: (2026)
Hyper-CL: Conditioning Sentence Representations with Hypernetworks
par: Yoo, Young Hyun, et autres
Publié: (2024)
par: Yoo, Young Hyun, et autres
Publié: (2024)
When to Speak, When to Abstain: Contrastive Decoding with Abstention
par: Kim, Hyuhng Joon, et autres
Publié: (2024)
par: Kim, Hyuhng Joon, et autres
Publié: (2024)
NAACL: Noise-AwAre Verbal Confidence Calibration for Robust LLMs in RAG Systems
par: Liu, Jiayu, et autres
Publié: (2026)
par: Liu, Jiayu, et autres
Publié: (2026)
BlendX: Complex Multi-Intent Detection with Blended Patterns
par: Yoon, Yejin, et autres
Publié: (2024)
par: Yoon, Yejin, et autres
Publié: (2024)
ConfTuner: Training Large Language Models to Express Their Confidence Verbally
par: Li, Yibo, et autres
Publié: (2025)
par: Li, Yibo, et autres
Publié: (2025)
ORCE: Order-Aware Alignment of Verbalized Confidence in Large Language Models
par: Li, Chen, et autres
Publié: (2026)
par: Li, Chen, et autres
Publié: (2026)
KGMEL: Knowledge Graph-Enhanced Multimodal Entity Linking
par: Kim, Juyeon, et autres
Publié: (2025)
par: Kim, Juyeon, et autres
Publié: (2025)
Evaluating and Calibrating LLM Confidence on Questions with Multiple Correct Answers
par: Wang, Yuhan, et autres
Publié: (2026)
par: Wang, Yuhan, et autres
Publié: (2026)
No Reader Left Behind: Multi-Agent Summaries Everyone Can Understand
par: Jung, Jimin, et autres
Publié: (2026)
par: Jung, Jimin, et autres
Publié: (2026)
Can Confidence Estimates Decide When Chain-of-Thought Is Necessary for LLMs?
par: Lewis-Lim, Samuel, et autres
Publié: (2025)
par: Lewis-Lim, Samuel, et autres
Publié: (2025)
Reasoning Models Better Express Their Confidence
par: Yoon, Dongkeun, et autres
Publié: (2025)
par: Yoon, Dongkeun, et autres
Publié: (2025)
Memorization or Reasoning? Exploring the Idiom Understanding of LLMs
par: Kim, Jisu, et autres
Publié: (2025)
par: Kim, Jisu, et autres
Publié: (2025)
LoVeC: Reinforcement Learning for Better Verbalized Confidence in Long-Form Generations
par: Zhang, Caiqi, et autres
Publié: (2025)
par: Zhang, Caiqi, et autres
Publié: (2025)
Neologism Learning for Controllability and Self-Verbalization
par: Hewitt, John, et autres
Publié: (2025)
par: Hewitt, John, et autres
Publié: (2025)
SuRe: Summarizing Retrievals using Answer Candidates for Open-domain QA of LLMs
par: Kim, Jaehyung, et autres
Publié: (2024)
par: Kim, Jaehyung, et autres
Publié: (2024)
Unveiling the Limits of Large Language Models in Inferring Pragmatic Meaning from Non-Verbal Responses
par: Eo, Sugyeong, et autres
Publié: (2026)
par: Eo, Sugyeong, et autres
Publié: (2026)
Confidence-Guided Stepwise Model Routing for Cost-Efficient Reasoning
par: Lee, Sangmook, et autres
Publié: (2025)
par: Lee, Sangmook, et autres
Publié: (2025)
Documents similaires
-
Revisiting the Impact of Pursuing Modularity for Code Generation
par: Kang, Deokyeong, et autres
Publié: (2024) -
Think, Verbalize, then Speak: Bridging Complex Thoughts and Comprehensible Speech
par: Woo, Sang Hoon, et autres
Publié: (2025) -
On Verbalized Confidence Scores for LLMs
par: Yang, Daniel, et autres
Publié: (2024) -
Confidence Estimation in Automatic Short Answer Grading with LLMs
par: Cong, Longwei, et autres
Publié: (2026) -
Does Localization Inform Unlearning? A Rigorous Examination of Local Parameter Attribution for Knowledge Unlearning in Language Models
par: Lee, Hwiyeong, et autres
Publié: (2025)