Entropy Guided Extrapolative Decoding to Improve Factuality in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Das, Souvik, Jin, Lifeng, Song, Linfeng, Mi, Haitao, Peng, Baolin, Yu, Dong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Fine-Grained Self-Endorsement Improves Factuality and Reasoning
por: Wang, Ante, et al.
Publicado: (2024)
por: Wang, Ante, et al.
Publicado: (2024)
SIaM: Self-Improving Code-Assisted Mathematical Reasoning of Large Language Models
por: Yu, Dian, et al.
Publicado: (2024)
por: Yu, Dian, et al.
Publicado: (2024)
Collaborative decoding of critical tokens for boosting factuality of large language models
por: Jin, Lifeng, et al.
Publicado: (2024)
por: Jin, Lifeng, et al.
Publicado: (2024)
Self-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation
por: Zhang, Xiaoying, et al.
Publicado: (2024)
por: Zhang, Xiaoying, et al.
Publicado: (2024)
Toward Self-Improvement of LLMs via Imagination, Searching, and Criticizing
por: Tian, Ye, et al.
Publicado: (2024)
por: Tian, Ye, et al.
Publicado: (2024)
Inconsistent dialogue responses and how to recover from them
por: Zhang, Mian, et al.
Publicado: (2024)
por: Zhang, Mian, et al.
Publicado: (2024)
Self-Consistency Boosts Calibration for Math Reasoning
por: Wang, Ante, et al.
Publicado: (2024)
por: Wang, Ante, et al.
Publicado: (2024)
A Knowledge Plug-and-Play Test Bed for Open-domain Dialogue Generation
por: Li, Xiangci, et al.
Publicado: (2024)
por: Li, Xiangci, et al.
Publicado: (2024)
Improve Decoding Factuality by Token-wise Cross Layer Entropy of Large Language Models
por: Wu, Jialiang, et al.
Publicado: (2025)
por: Wu, Jialiang, et al.
Publicado: (2025)
Towards Self-Improvement of LLMs via MCTS: Leveraging Stepwise Knowledge with Curriculum Preference Learning
por: Wang, Xiyao, et al.
Publicado: (2024)
por: Wang, Xiyao, et al.
Publicado: (2024)
LiteSearch: Efficacious Tree Search for LLM
por: Wang, Ante, et al.
Publicado: (2024)
por: Wang, Ante, et al.
Publicado: (2024)
Improving Factuality in Large Language Models via Decoding-Time Hallucinatory and Truthful Comparators
por: Yang, Dingkang, et al.
Publicado: (2024)
por: Yang, Dingkang, et al.
Publicado: (2024)
PruneCD: Contrasting Pruned Self Model to Improve Decoding Factuality
por: Yu, Byeongho, et al.
Publicado: (2025)
por: Yu, Byeongho, et al.
Publicado: (2025)
Iterative Nash Policy Optimization: Aligning LLMs with General Preferences via No-Regret Learning
por: Zhang, Yuheng, et al.
Publicado: (2024)
por: Zhang, Yuheng, et al.
Publicado: (2024)
Recall with Reasoning: Chain-of-Thought Distillation for Mamba's Long-Context Memory and Extrapolation
por: Ma, Junyu, et al.
Publicado: (2025)
por: Ma, Junyu, et al.
Publicado: (2025)
SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models
por: Zhang, Jianyi, et al.
Publicado: (2024)
por: Zhang, Jianyi, et al.
Publicado: (2024)
DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models
por: Chuang, Yung-Sung, et al.
Publicado: (2023)
por: Chuang, Yung-Sung, et al.
Publicado: (2023)
Teaching Language Models to Self-Improve through Interactive Demonstrations
por: Yu, Xiao, et al.
Publicado: (2023)
por: Yu, Xiao, et al.
Publicado: (2023)
Enhancing Language Model Factuality via Activation-Based Confidence Calibration and Guided Decoding
por: Liu, Xin, et al.
Publicado: (2024)
por: Liu, Xin, et al.
Publicado: (2024)
Every Question Has Its Own Value: Reinforcement Learning with Explicit Human Values
por: Yu, Dian, et al.
Publicado: (2025)
por: Yu, Dian, et al.
Publicado: (2025)
UAlign: Leveraging Uncertainty Estimations for Factuality Alignment on Large Language Models
por: Xue, Boyang, et al.
Publicado: (2024)
por: Xue, Boyang, et al.
Publicado: (2024)
HunyuanProver: A Scalable Data Synthesis Framework and Guided Tree Search for Automated Theorem Proving
por: Li, Yang, et al.
Publicado: (2024)
por: Li, Yang, et al.
Publicado: (2024)
Improving LLM General Preference Alignment via Optimistic Online Mirror Descent
por: Zhang, Yuheng, et al.
Publicado: (2025)
por: Zhang, Yuheng, et al.
Publicado: (2025)
How Large Language Models (LLMs) Extrapolate: From Guided Missiles to Guided Prompts
por: Cao, Xuenan
Publicado: (2024)
por: Cao, Xuenan
Publicado: (2024)
CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models
por: Dai, Runpeng, et al.
Publicado: (2025)
por: Dai, Runpeng, et al.
Publicado: (2025)
Factuality of Large Language Models: A Survey
por: Wang, Yuxia, et al.
Publicado: (2024)
por: Wang, Yuxia, et al.
Publicado: (2024)
Explaining and Improving Contrastive Decoding by Extrapolating the Probabilities of a Huge and Hypothetical LM
por: Chang, Haw-Shiuan, et al.
Publicado: (2024)
por: Chang, Haw-Shiuan, et al.
Publicado: (2024)
EntropyCache: Decoded Token Entropy Guided KV Caching for Diffusion Language Models
por: Cheong, Minsoo, et al.
Publicado: (2026)
por: Cheong, Minsoo, et al.
Publicado: (2026)
Evolving Language Models without Labels: Majority Drives Selection, Novelty Promotes Variation
por: Zhou, Yujun, et al.
Publicado: (2025)
por: Zhou, Yujun, et al.
Publicado: (2025)
Self Speculative Decoding for Diffusion Large Language Models
por: Gao, Yifeng, et al.
Publicado: (2025)
por: Gao, Yifeng, et al.
Publicado: (2025)
Integrative Decoding: Improve Factuality via Implicit Self-consistency
por: Cheng, Yi, et al.
Publicado: (2024)
por: Cheng, Yi, et al.
Publicado: (2024)
Fine-tuning Large Language Models for Improving Factuality in Legal Question Answering
por: Hu, Yinghao, et al.
Publicado: (2025)
por: Hu, Yinghao, et al.
Publicado: (2025)
Teaching LLMs to Refine with Tools
por: Yu, Dian, et al.
Publicado: (2024)
por: Yu, Dian, et al.
Publicado: (2024)
The Illusionist's Prompt: Exposing the Factual Vulnerabilities of Large Language Models with Linguistic Nuances
por: Wang, Yining, et al.
Publicado: (2025)
por: Wang, Yining, et al.
Publicado: (2025)
Crossing the Reward Bridge: Expanding RL with Verifiable Rewards Across Diverse Domains
por: Su, Yi, et al.
Publicado: (2025)
por: Su, Yi, et al.
Publicado: (2025)
CLUE: Non-parametric Verification from Experience via Hidden-State Clustering
por: Liang, Zhenwen, et al.
Publicado: (2025)
por: Liang, Zhenwen, et al.
Publicado: (2025)
Entropy-Based Decoding for Retrieval-Augmented Large Language Models
por: Qiu, Zexuan, et al.
Publicado: (2024)
por: Qiu, Zexuan, et al.
Publicado: (2024)
Exploring Mathematical Extrapolation of Large Language Models with Synthetic Data
por: Li, Haolong, et al.
Publicado: (2024)
por: Li, Haolong, et al.
Publicado: (2024)
Verified Critical Step Optimization for LLM Agents
por: Li, Mukai, et al.
Publicado: (2026)
por: Li, Mukai, et al.
Publicado: (2026)
Self-Tuning: Instructing LLMs to Effectively Acquire New Knowledge through Self-Teaching
por: Zhang, Xiaoying, et al.
Publicado: (2024)
por: Zhang, Xiaoying, et al.
Publicado: (2024)
Ejemplares similares
-
Fine-Grained Self-Endorsement Improves Factuality and Reasoning
por: Wang, Ante, et al.
Publicado: (2024) -
SIaM: Self-Improving Code-Assisted Mathematical Reasoning of Large Language Models
por: Yu, Dian, et al.
Publicado: (2024) -
Collaborative decoding of critical tokens for boosting factuality of large language models
por: Jin, Lifeng, et al.
Publicado: (2024) -
Self-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation
por: Zhang, Xiaoying, et al.
Publicado: (2024) -
Toward Self-Improvement of LLMs via Imagination, Searching, and Criticizing
por: Tian, Ye, et al.
Publicado: (2024)