Full-ECE: A Metric For Token-level Calibration on Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Han, Zhang, Yupeng, Wang, Bingning, Chen, Weipeng, Hu, Xiaolin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
Enhancing Large Language Models for Mobility Analytics with Semantic Location Tokenization
di: Chen, Yile, et al.
Pubblicazione: (2025)
di: Chen, Yile, et al.
Pubblicazione: (2025)
How Confident Is the First Token? An Uncertainty-Calibrated Prompt Optimization Framework for Large Language Model Classification and Understanding
di: Chen, Wei, et al.
Pubblicazione: (2026)
di: Chen, Wei, et al.
Pubblicazione: (2026)
SEAL: Steerable Reasoning Calibration of Large Language Models for Free
di: Chen, Runjin, et al.
Pubblicazione: (2025)
di: Chen, Runjin, et al.
Pubblicazione: (2025)
Saliency-driven Dynamic Token Pruning for Large Language Models
di: Tao, Yao, et al.
Pubblicazione: (2025)
di: Tao, Yao, et al.
Pubblicazione: (2025)
Unveiling the Flaws: Exploring Imperfections in Synthetic Data and Mitigation Strategies for Large Language Models
di: Chen, Jie, et al.
Pubblicazione: (2024)
di: Chen, Jie, et al.
Pubblicazione: (2024)
MetaGPT: Merging Large Language Models Using Model Exclusive Task Arithmetic
di: Zhou, Yuyan, et al.
Pubblicazione: (2024)
di: Zhou, Yuyan, et al.
Pubblicazione: (2024)
Confidence-Calibrated Small-Large Language Model Collaboration for Cost-Efficient Reasoning
di: Zhang, Chuang, et al.
Pubblicazione: (2026)
di: Zhang, Chuang, et al.
Pubblicazione: (2026)
LLaSA: Large Language and Structured Data Assistant
di: Xu, Yao, et al.
Pubblicazione: (2024)
di: Xu, Yao, et al.
Pubblicazione: (2024)
Probabilistic Token Alignment for Large Language Model Fusion
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
Calibrating Verbalized Probabilities for Large Language Models
di: Wang, Cheng, et al.
Pubblicazione: (2024)
di: Wang, Cheng, et al.
Pubblicazione: (2024)
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
di: Zhang, Zihou, et al.
Pubblicazione: (2026)
di: Zhang, Zihou, et al.
Pubblicazione: (2026)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
BaichuanSEED: Sharing the Potential of ExtensivE Data Collection and Deduplication by Introducing a Competitive Large Language Model Baseline
di: Dong, Guosheng, et al.
Pubblicazione: (2024)
di: Dong, Guosheng, et al.
Pubblicazione: (2024)
Counting Ability of Large Language Models and Impact of Tokenization
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
Reverse Probing: Supervised Token-level Uncertainty Quantification for Large Language Models in Clinical Text
di: Xiao, Bushi, et al.
Pubblicazione: (2026)
di: Xiao, Bushi, et al.
Pubblicazione: (2026)
Towards a Unified View of Large Language Model Post-Training
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
A Survey of Confidence Estimation and Calibration in Large Language Models
di: Geng, Jiahui, et al.
Pubblicazione: (2023)
di: Geng, Jiahui, et al.
Pubblicazione: (2023)
Chronological Thinking in Full-Duplex Spoken Dialogue Language Models
di: Wu, Donghang, et al.
Pubblicazione: (2025)
di: Wu, Donghang, et al.
Pubblicazione: (2025)
Amplify Adjacent Token Differences: Enhancing Long Chain-of-Thought Reasoning with Shift-FFN
di: Xu, Yao, et al.
Pubblicazione: (2025)
di: Xu, Yao, et al.
Pubblicazione: (2025)
Toward Graph-Tokenizing Large Language Models with Reconstructive Graph Instruction Tuning
di: Zhang, Zhongjian, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjian, et al.
Pubblicazione: (2026)
Token Signature: Predicting Chain-of-Thought Gains with Token Decoding Feature in Large Language Models
di: Liu, Peijie, et al.
Pubblicazione: (2025)
di: Liu, Peijie, et al.
Pubblicazione: (2025)
Gradients Must Earn Their Influence: Unifying SFT with Generalized Entropic Objectives
di: Wang, Zecheng, et al.
Pubblicazione: (2026)
di: Wang, Zecheng, et al.
Pubblicazione: (2026)
Deep Associations, High Creativity: A Simple yet Effective Metric for Evaluating Large Language Models
di: Qiu, Ziliang, et al.
Pubblicazione: (2025)
di: Qiu, Ziliang, et al.
Pubblicazione: (2025)
A Survey of Large Language Models
di: Zhao, Wayne Xin, et al.
Pubblicazione: (2023)
di: Zhao, Wayne Xin, et al.
Pubblicazione: (2023)
TokUR: Token-Level Uncertainty Estimation for Large Language Model Reasoning
di: Zhang, Tunyu, et al.
Pubblicazione: (2025)
di: Zhang, Tunyu, et al.
Pubblicazione: (2025)
Hey, That's My Data! Token-Only Dataset Inference in Large Language Models
di: Xiong, Chen, et al.
Pubblicazione: (2025)
di: Xiong, Chen, et al.
Pubblicazione: (2025)
Re-Initialization Token Learning for Tool-Augmented Large Language Models
di: Li, Chenghao, et al.
Pubblicazione: (2025)
di: Li, Chenghao, et al.
Pubblicazione: (2025)
A Survey on Evaluation of Large Language Models
di: Chang, Yupeng, et al.
Pubblicazione: (2023)
di: Chang, Yupeng, et al.
Pubblicazione: (2023)
IntactKV: Improving Large Language Model Quantization by Keeping Pivot Tokens Intact
di: Liu, Ruikang, et al.
Pubblicazione: (2024)
di: Liu, Ruikang, et al.
Pubblicazione: (2024)
Revisiting Graph-Tokenizing Large Language Models: A Systematic Evaluation of Graph Token Understanding
di: Zhang, Zhongjian, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjian, et al.
Pubblicazione: (2026)
On Calibration of Large Language Models: From Response To Capability
di: Yang, Sin-Han, et al.
Pubblicazione: (2026)
di: Yang, Sin-Han, et al.
Pubblicazione: (2026)
Credence Calibration Game? Calibrating Large Language Models through Structured Play
di: Fang, Ke, et al.
Pubblicazione: (2025)
di: Fang, Ke, et al.
Pubblicazione: (2025)
Do We Need Distinct Representations for Every Speech Token? Unveiling and Exploiting Redundancy in Large Speech Language Models
di: Xiang, Bajian, et al.
Pubblicazione: (2026)
di: Xiang, Bajian, et al.
Pubblicazione: (2026)
Beyond Accuracy: The Role of Calibration in Self-Improving Large Language Models
di: Huang, Liangjie, et al.
Pubblicazione: (2025)
di: Huang, Liangjie, et al.
Pubblicazione: (2025)
Memory Retrieval and Consolidation in Large Language Models through Function Tokens
di: Zhang, Shaohua, et al.
Pubblicazione: (2025)
di: Zhang, Shaohua, et al.
Pubblicazione: (2025)
VaccineRAG: Boosting Multimodal Large Language Models' Immunity to Harmful RAG Samples
di: Sun, Qixin, et al.
Pubblicazione: (2025)
di: Sun, Qixin, et al.
Pubblicazione: (2025)
MONICA: Real-Time Monitoring and Calibration of Chain-of-Thought Sycophancy in Large Reasoning Models
di: Hu, Jingyu, et al.
Pubblicazione: (2025)
di: Hu, Jingyu, et al.
Pubblicazione: (2025)
GlitchProber: Advancing Effective Detection and Mitigation of Glitch Tokens in Large Language Models
di: Zhang, Zhibo, et al.
Pubblicazione: (2024)
di: Zhang, Zhibo, et al.
Pubblicazione: (2024)
TEAL: Tokenize and Embed ALL for Multi-modal Large Language Models
di: Yang, Zhen, et al.
Pubblicazione: (2023)
di: Yang, Zhen, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025) -
Enhancing Large Language Models for Mobility Analytics with Semantic Location Tokenization
di: Chen, Yile, et al.
Pubblicazione: (2025) -
How Confident Is the First Token? An Uncertainty-Calibrated Prompt Optimization Framework for Large Language Model Classification and Understanding
di: Chen, Wei, et al.
Pubblicazione: (2026) -
SEAL: Steerable Reasoning Calibration of Large Language Models for Free
di: Chen, Runjin, et al.
Pubblicazione: (2025) -
Saliency-driven Dynamic Token Pruning for Large Language Models
di: Tao, Yao, et al.
Pubblicazione: (2025)