Mind the Generation Process: Fine-Grained Confidence Estimation During LLM Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Han, Jinyi, Li, Tingyun, Chen, Shisong, Shi, Jie, Wang, Xinyi, Yue, Guanglei, Liang, Jiaqing, Lin, Xin, Wen, Liqian, Chen, Zulong, Xiao, Yanghua |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Enhancing Confidence Expression in Large Language Models Through Learning from Past Experience
by: Han, Haixia, et al.
Published: (2024)
by: Han, Haixia, et al.
Published: (2024)
AutoScraper: A Progressive Understanding Web Agent for Web Scraper Generation
by: Huang, Wenhao, et al.
Published: (2024)
by: Huang, Wenhao, et al.
Published: (2024)
ReCode: Improving LLM-based Code Repair with Fine-Grained Retrieval-Augmented Generation
by: Zhao, Yicong, et al.
Published: (2025)
by: Zhao, Yicong, et al.
Published: (2025)
HINT: Helping Ineffective Rollouts Navigate Towards Effectiveness
by: Wang, Xinyi, et al.
Published: (2025)
by: Wang, Xinyi, et al.
Published: (2025)
Selective Expert Guidance for Effective and Diverse Exploration in Reinforcement Learning of LLMs
by: Jiang, Zishang, et al.
Published: (2025)
by: Jiang, Zishang, et al.
Published: (2025)
A Stitch in Time Saves Nine: Proactive Self-Refinement for Language Models
by: Han, Jinyi, et al.
Published: (2025)
by: Han, Jinyi, et al.
Published: (2025)
SED: Self-Evaluation Decoding Enhances Large Language Models for Better Generation
by: Luo, Ziqin, et al.
Published: (2024)
by: Luo, Ziqin, et al.
Published: (2024)
GenericAgent: A Token-Efficient Self-Evolving LLM Agent via Contextual Information Density Maximization (V1.0)
by: Liang, Jiaqing, et al.
Published: (2026)
by: Liang, Jiaqing, et al.
Published: (2026)
What Makes an Ideal Quote? Recommending "Unexpected yet Rational" Quotations via Novelty
by: Zhang, Bowei, et al.
Published: (2025)
by: Zhang, Bowei, et al.
Published: (2025)
Think Thrice Before You Act: Progressive Thought Refinement in Large Language Models
by: Du, Chengyu, et al.
Published: (2024)
by: Du, Chengyu, et al.
Published: (2024)
Enhancing Talent Search Ranking with Role-Aware Expert Mixtures and LLM-based Fine-Grained Job Descriptions
by: Li, Jihang, et al.
Published: (2025)
by: Li, Jihang, et al.
Published: (2025)
Character is Destiny: Can Role-Playing Language Agents Make Persona-Driven Decisions?
by: Xu, Rui, et al.
Published: (2024)
by: Xu, Rui, et al.
Published: (2024)
CDS: Knowledge Component-Driven Data Synthesis Guided by Cognitive Diagnosis Theory
by: Zhao, Haokun, et al.
Published: (2025)
by: Zhao, Haokun, et al.
Published: (2025)
Small Language Model Can Self-correct
by: Han, Haixia, et al.
Published: (2024)
by: Han, Haixia, et al.
Published: (2024)
Laying the Foundation First? Investigating the Generalization from Atomic Skills to Complex Reasoning Tasks
by: Huang, Yuncheng, et al.
Published: (2024)
by: Huang, Yuncheng, et al.
Published: (2024)
MultiLingPoT: Enhancing Mathematical Reasoning with Multilingual Program Fine-tuning
by: Li, Nianqi, et al.
Published: (2024)
by: Li, Nianqi, et al.
Published: (2024)
OVEL: Large Language Model as Memory Manager for Online Video Entity Linking
by: Zhao, Haiquan, et al.
Published: (2024)
by: Zhao, Haiquan, et al.
Published: (2024)
Structured Reasoning for Large Language Models
by: Han, Jinyi, et al.
Published: (2026)
by: Han, Jinyi, et al.
Published: (2026)
CEM: A Data-Efficient Method for Large Language Models to Continue Evolving From Mistakes
by: Zhao, Haokun, et al.
Published: (2024)
by: Zhao, Haokun, et al.
Published: (2024)
CultureScope: A Dimensional Lens for Probing Cultural Understanding in LLMs
by: Zhang, Jinghao, et al.
Published: (2025)
by: Zhang, Jinghao, et al.
Published: (2025)
Capturing Minds, Not Just Words: Enhancing Role-Playing Language Models with Personality-Indicative Data
by: Ran, Yiting, et al.
Published: (2024)
by: Ran, Yiting, et al.
Published: (2024)
BookWorld: From Novels to Interactive Agent Societies for Creative Story Generation
by: Ran, Yiting, et al.
Published: (2025)
by: Ran, Yiting, et al.
Published: (2025)
From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models
by: He, Qianyu, et al.
Published: (2024)
by: He, Qianyu, et al.
Published: (2024)
TagLLM: A Fine-Grained Tag Generation Approach for Note Recommendation
by: Chen, Zhijian, et al.
Published: (2026)
by: Chen, Zhijian, et al.
Published: (2026)
QUILL: Quotation Generation Enhancement of Large Language Models
by: Xiao, Jin, et al.
Published: (2024)
by: Xiao, Jin, et al.
Published: (2024)
Polynomial Invariant Generation for Floating-Point Programs
by: Cai, Xuran, et al.
Published: (2025)
by: Cai, Xuran, et al.
Published: (2025)
Skeletons Matter: Dynamic Data Augmentation for Text-to-Query
by: Ji, Yuchen, et al.
Published: (2025)
by: Ji, Yuchen, et al.
Published: (2025)
Can Pre-trained Language Models Understand Chinese Humor?
by: Chen, Yuyan, et al.
Published: (2024)
by: Chen, Yuyan, et al.
Published: (2024)
SEGMENT+: Long Text Processing with Short-Context Language Models
by: Shi, Wei, et al.
Published: (2024)
by: Shi, Wei, et al.
Published: (2024)
Enhancing Quantitative Reasoning Skills of Large Language Models through Dimension Perception
by: Huang, Yuncheng, et al.
Published: (2023)
by: Huang, Yuncheng, et al.
Published: (2023)
Chain-of-Knowledge: Integrating Knowledge Reasoning into Large Language Models by Learning from Knowledge Graphs
by: Zhang, Yifei, et al.
Published: (2024)
by: Zhang, Yifei, et al.
Published: (2024)
ANALOGYKB: Unlocking Analogical Reasoning of Language Models with A Million-scale Knowledge Base
by: Yuan, Siyu, et al.
Published: (2023)
by: Yuan, Siyu, et al.
Published: (2023)
Go with Your Gut: Scaling Confidence for Autoregressive Image Generation
by: Chen, Harold Haodong, et al.
Published: (2025)
by: Chen, Harold Haodong, et al.
Published: (2025)
SEA-Eval: A Benchmark for Evaluating Self-Evolving Agents Beyond Episodic Assessment
by: Jiang, Sihang, et al.
Published: (2026)
by: Jiang, Sihang, et al.
Published: (2026)
Smoke and Mirrors: Jailbreaking LLM-based Code Generation via Implicit Malicious Prompts
by: Ouyang, Sheng, et al.
Published: (2025)
by: Ouyang, Sheng, et al.
Published: (2025)
Confidence Interval Construction for Causally Generalized Estimates With Target Sample Summary Information
by: Yi Chen, et al.
Published: (2026)
by: Yi Chen, et al.
Published: (2026)
Fine-Grained Domain Generalization with Feature Structuralization
by: Yu, Wenlong, et al.
Published: (2024)
by: Yu, Wenlong, et al.
Published: (2024)
ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment
by: Yang, Hao, et al.
Published: (2026)
by: Yang, Hao, et al.
Published: (2026)
Ground Every Sentence: Improving Retrieval-Augmented LLMs with Interleaved Reference-Claim Generation
by: Xia, Sirui, et al.
Published: (2024)
by: Xia, Sirui, et al.
Published: (2024)
Adaptive Ordered Information Extraction with Deep Reinforcement Learning
by: Huang, Wenhao, et al.
Published: (2023)
by: Huang, Wenhao, et al.
Published: (2023)
Similar Items
-
Enhancing Confidence Expression in Large Language Models Through Learning from Past Experience
by: Han, Haixia, et al.
Published: (2024) -
AutoScraper: A Progressive Understanding Web Agent for Web Scraper Generation
by: Huang, Wenhao, et al.
Published: (2024) -
ReCode: Improving LLM-based Code Repair with Fine-Grained Retrieval-Augmented Generation
by: Zhao, Yicong, et al.
Published: (2025) -
HINT: Helping Ineffective Rollouts Navigate Towards Effectiveness
by: Wang, Xinyi, et al.
Published: (2025) -
Selective Expert Guidance for Effective and Diverse Exploration in Reinforcement Learning of LLMs
by: Jiang, Zishang, et al.
Published: (2025)