Enhancing Language Model Factuality via Activation-Based Confidence Calibration and Guided Decoding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Xin, Bayat, Farima Fatahi, Wang, Lu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FactBench: A Dynamic Benchmark for In-the-Wild Language Model Factuality Evaluation
par: Bayat, Farima Fatahi, et autres
Publié: (2024)
par: Bayat, Farima Fatahi, et autres
Publié: (2024)
Enhanced Language Model Truthfulness with Learnable Intervention and Uncertainty Expression
par: Bayat, Farima Fatahi, et autres
Publié: (2024)
par: Bayat, Farima Fatahi, et autres
Publié: (2024)
From Proof to Program: Characterizing Tool-Induced Reasoning Hallucinations in Large Language Models
par: Bayat, Farima Fatahi, et autres
Publié: (2025)
par: Bayat, Farima Fatahi, et autres
Publié: (2025)
Logit Arithmetic Elicits Long Reasoning Capabilities Without Training
par: Zhang, Yunxiang, et autres
Publié: (2025)
par: Zhang, Yunxiang, et autres
Publié: (2025)
Logit Arithmetic Elicits Long Reasoning Capabilities Without Training
par: Zhang, Yunxiang, et autres
Publié: (2025)
par: Zhang, Yunxiang, et autres
Publié: (2025)
Think Through Uncertainty: Improving Long-Form Generation Factuality via Reasoning Calibration
par: Liu, Xin, et autres
Publié: (2026)
par: Liu, Xin, et autres
Publié: (2026)
Entropy Guided Extrapolative Decoding to Improve Factuality in Large Language Models
par: Das, Souvik, et autres
Publié: (2024)
par: Das, Souvik, et autres
Publié: (2024)
BaseCal: Unsupervised Confidence Calibration via Base Model Signals
par: Tan, Hexiang, et autres
Publié: (2026)
par: Tan, Hexiang, et autres
Publié: (2026)
Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals
par: Torrielli, Federico, et autres
Publié: (2026)
par: Torrielli, Federico, et autres
Publié: (2026)
Improving Factuality in Large Language Models via Decoding-Time Hallucinatory and Truthful Comparators
par: Yang, Dingkang, et autres
Publié: (2024)
par: Yang, Dingkang, et autres
Publié: (2024)
Beyond Confidence: Adaptive and Coherent Decoding for Diffusion Language Models
par: Chen, Kecheng, et autres
Publié: (2025)
par: Chen, Kecheng, et autres
Publié: (2025)
Confidence Calibration in Large Language Model-Based Entity Matching
par: Kamsteeg, Iris, et autres
Publié: (2025)
par: Kamsteeg, Iris, et autres
Publié: (2025)
Calibrating the Confidence of Large Language Models by Eliciting Fidelity
par: Zhang, Mozhi, et autres
Publié: (2024)
par: Zhang, Mozhi, et autres
Publié: (2024)
Fast-Decoding Diffusion Language Models via Progress-Aware Confidence Schedules
par: Mohamed, Amr, et autres
Publié: (2025)
par: Mohamed, Amr, et autres
Publié: (2025)
Decoding by Contrasting Knowledge: Enhancing LLMs' Confidence on Edited Facts
par: Bi, Baolong, et autres
Publié: (2024)
par: Bi, Baolong, et autres
Publié: (2024)
Improve Decoding Factuality by Token-wise Cross Layer Entropy of Large Language Models
par: Wu, Jialiang, et autres
Publié: (2025)
par: Wu, Jialiang, et autres
Publié: (2025)
Uncertainty Quantification and Confidence Calibration in Large Language Models: A Survey
par: Liu, Xiaoou, et autres
Publié: (2025)
par: Liu, Xiaoou, et autres
Publié: (2025)
QA-Calibration of Language Model Confidence Scores
par: Manggala, Putra, et autres
Publié: (2024)
par: Manggala, Putra, et autres
Publié: (2024)
LitCab: Lightweight Language Model Calibration over Short- and Long-form Responses
par: Liu, Xin, et autres
Publié: (2023)
par: Liu, Xin, et autres
Publié: (2023)
$C^3$: Confidence Calibration Model Cascade for Inference-Efficient Cross-Lingual Natural Language Understanding
par: Lu, Taixi, et autres
Publié: (2024)
par: Lu, Taixi, et autres
Publié: (2024)
Double-Calibration: Towards Reliable LLMs via Calibrating Knowledge and Reasoning Confidence
par: Lu, Yuyin, et autres
Publié: (2026)
par: Lu, Yuyin, et autres
Publié: (2026)
Confidence-Calibrated Small-Large Language Model Collaboration for Cost-Efficient Reasoning
par: Zhang, Chuang, et autres
Publié: (2026)
par: Zhang, Chuang, et autres
Publié: (2026)
VeriFact: Enhancing Long-Form Factuality Evaluation with Refined Fact Extraction and Reference Facts
par: Liu, Xin, et autres
Publié: (2025)
par: Liu, Xin, et autres
Publié: (2025)
Graph-based Confidence Calibration for Large Language Models
par: Li, Yukun, et autres
Publié: (2024)
par: Li, Yukun, et autres
Publié: (2024)
A Survey of Confidence Estimation and Calibration in Large Language Models
par: Geng, Jiahui, et autres
Publié: (2023)
par: Geng, Jiahui, et autres
Publié: (2023)
PretrainRL: Alleviating Factuality Hallucination of Large Language Models at the Beginning
par: Liu, Langming, et autres
Publié: (2026)
par: Liu, Langming, et autres
Publié: (2026)
APE: Active Learning-based Tooling for Finding Informative Few-shot Examples for LLM-based Entity Matching
par: Qian, Kun, et autres
Publié: (2024)
par: Qian, Kun, et autres
Publié: (2024)
Calibration Is Not Enough: Evaluating Confidence Estimation Under Language Variations
par: Xia, Yuxi, et autres
Publié: (2026)
par: Xia, Yuxi, et autres
Publié: (2026)
From Confidence to Collapse in LLM Factual Robustness
par: Fastowski, Alina, et autres
Publié: (2025)
par: Fastowski, Alina, et autres
Publié: (2025)
Monitoring Decoding: Mitigating Hallucination via Evaluating the Factuality of Partial Response during Generation
par: Chang, Yurui, et autres
Publié: (2025)
par: Chang, Yurui, et autres
Publié: (2025)
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
par: Mao, Zhenjiang, et autres
Publié: (2026)
par: Mao, Zhenjiang, et autres
Publié: (2026)
Grounded Visual Factualization: Factual Anchor-Based Finetuning for Enhancing MLLM Factual Consistency
par: Morbiato, Filippo, et autres
Publié: (2025)
par: Morbiato, Filippo, et autres
Publié: (2025)
Confidence-Based Response Abstinence: Improving LLM Trustworthiness via Activation-Based Uncertainty Estimation
par: Huang, Zhiqi, et autres
Publié: (2025)
par: Huang, Zhiqi, et autres
Publié: (2025)
Integrative Decoding: Improve Factuality via Implicit Self-consistency
par: Cheng, Yi, et autres
Publié: (2024)
par: Cheng, Yi, et autres
Publié: (2024)
VL-Calibration: Decoupled Confidence Calibration for Large Vision-Language Models Reasoning
par: Xiao, Wenyi, et autres
Publié: (2026)
par: Xiao, Wenyi, et autres
Publié: (2026)
Fact-and-Reflection (FaR) Improves Confidence Calibration of Large Language Models
par: Zhao, Xinran, et autres
Publié: (2024)
par: Zhao, Xinran, et autres
Publié: (2024)
Factual Confidence of LLMs: on Reliability and Robustness of Current Estimators
par: Mahaut, Matéo, et autres
Publié: (2024)
par: Mahaut, Matéo, et autres
Publié: (2024)
Enhancing Factuality through Consensus and Consistency in Summarization Using Minimum Bayes Risk Decoding
par: Soetedjo, Riza Setiawan, et autres
Publié: (2026)
par: Soetedjo, Riza Setiawan, et autres
Publié: (2026)
Factuality of Large Language Models: A Survey
par: Wang, Yuxia, et autres
Publié: (2024)
par: Wang, Yuxia, et autres
Publié: (2024)
FlexDraft: Flexible Speculative Decoding via Attention Tuning and Bonus-Guided Calibration
par: Zhang, Yaojie, et autres
Publié: (2026)
par: Zhang, Yaojie, et autres
Publié: (2026)
Documents similaires
-
FactBench: A Dynamic Benchmark for In-the-Wild Language Model Factuality Evaluation
par: Bayat, Farima Fatahi, et autres
Publié: (2024) -
Enhanced Language Model Truthfulness with Learnable Intervention and Uncertainty Expression
par: Bayat, Farima Fatahi, et autres
Publié: (2024) -
From Proof to Program: Characterizing Tool-Induced Reasoning Hallucinations in Large Language Models
par: Bayat, Farima Fatahi, et autres
Publié: (2025) -
Logit Arithmetic Elicits Long Reasoning Capabilities Without Training
par: Zhang, Yunxiang, et autres
Publié: (2025) -
Logit Arithmetic Elicits Long Reasoning Capabilities Without Training
par: Zhang, Yunxiang, et autres
Publié: (2025)