Entropy-UID: A Method for Optimizing Information Density
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Shou, Xinpeng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Revisiting the UID Hypothesis in LLM Reasoning Traces
par: Gwak, Minju, et autres
Publié: (2025)
par: Gwak, Minju, et autres
Publié: (2025)
TokenTiming: A Dynamic Alignment Method for Universal Speculative Decoding Model Pairs
par: Xiao, Sibo, et autres
Publié: (2025)
par: Xiao, Sibo, et autres
Publié: (2025)
PLHF: Prompt Optimization with Few-Shot Human Feedback
par: Yang, Chun-Pai, et autres
Publié: (2025)
par: Yang, Chun-Pai, et autres
Publié: (2025)
Decoupling Strategy and Execution in Task-Focused Dialogue via Goal-Oriented Preference Optimization
par: Xu, Jingyi, et autres
Publié: (2026)
par: Xu, Jingyi, et autres
Publié: (2026)
Mechanistic Decoding of Cognitive Constructs in Large Language Models
par: Shou, Yitong, et autres
Publié: (2026)
par: Shou, Yitong, et autres
Publié: (2026)
VEPO: Variable Entropy Policy Optimization for Low-Resource Language Foundation Models
par: Liu, Chonghan, et autres
Publié: (2026)
par: Liu, Chonghan, et autres
Publié: (2026)
Entropy Controllable Direct Preference Optimization
par: Omura, Motoki, et autres
Publié: (2024)
par: Omura, Motoki, et autres
Publié: (2024)
Revisiting the Uniform Information Density Hypothesis in LLM Reasoning
par: Gwak, Minju, et autres
Publié: (2025)
par: Gwak, Minju, et autres
Publié: (2025)
Think Before Refusal : Triggering Safety Reflection in LLMs to Mitigate False Refusal Behavior
par: Si, Shengyun, et autres
Publié: (2025)
par: Si, Shengyun, et autres
Publié: (2025)
Is It Thinking or Cheating? Detecting Implicit Reward Hacking by Measuring Reasoning Effort
par: Wang, Xinpeng, et autres
Publié: (2025)
par: Wang, Xinpeng, et autres
Publié: (2025)
DELIA: Diversity-Enhanced Learning for Instruction Adaptation in Large Language Models
par: Zeng, Yuanhao, et autres
Publié: (2024)
par: Zeng, Yuanhao, et autres
Publié: (2024)
Look at the Text: Instruction-Tuned Language Models are More Robust Multiple Choice Selectors than You Think
par: Wang, Xinpeng, et autres
Publié: (2024)
par: Wang, Xinpeng, et autres
Publié: (2024)
InfoFlow: Reinforcing Search Agent Via Reward Density Optimization
par: Luo, Kun, et autres
Publié: (2025)
par: Luo, Kun, et autres
Publié: (2025)
Human-Inspired Learning for Large Language Models via Obvious Record and Maximum-Entropy Method Discovery
par: Su, Hong
Publié: (2025)
par: Su, Hong
Publié: (2025)
InfoDensity: Rewarding Information-Dense Traces for Efficient Reasoning
par: Wei, Chengwei, et autres
Publié: (2026)
par: Wei, Chengwei, et autres
Publié: (2026)
Entropy-Tree: Tree-Based Decoding with Entropy-Guided Exploration
par: Wei, Longxuan, et autres
Publié: (2026)
par: Wei, Longxuan, et autres
Publié: (2026)
Density-Guided Response Optimization: Community-Grounded Alignment via Implicit Acceptance Signals
par: Gerard, Patrick, et autres
Publié: (2026)
par: Gerard, Patrick, et autres
Publié: (2026)
o-MEGA: Optimized Methods for Explanation Generation and Analysis
par: Kriš, Ľuboš, et autres
Publié: (2025)
par: Kriš, Ľuboš, et autres
Publié: (2025)
Compound AI Systems Optimization: A Survey of Methods, Challenges, and Future Directions
par: Lee, Yu-Ang, et autres
Publié: (2025)
par: Lee, Yu-Ang, et autres
Publié: (2025)
The Role of Entropy in Visual Grounding: Analysis and Optimization
par: Li, Shuo, et autres
Publié: (2025)
par: Li, Shuo, et autres
Publié: (2025)
Training LLMs Beyond Next Token Prediction -- Filling the Mutual Information Gap
par: Yang, Chun-Hao, et autres
Publié: (2025)
par: Yang, Chun-Hao, et autres
Publié: (2025)
Semantic Density Effect (SDE): Maximizing Information Per Token Improves LLM Accuracy
par: Ahmed, Amr
Publié: (2026)
par: Ahmed, Amr
Publié: (2026)
Can RL Teach Long-Horizon Reasoning to LLMs? Expressiveness Is Key
par: Wang, Tianle, et autres
Publié: (2026)
par: Wang, Tianle, et autres
Publié: (2026)
Does RAG Know When Retrieval Is Wrong? Diagnosing Context Compliance under Knowledge Conflict
par: Chen, Yihang, et autres
Publié: (2026)
par: Chen, Yihang, et autres
Publié: (2026)
TECP: Token-Entropy Conformal Prediction for LLMs
par: Xu, Beining, et autres
Publié: (2025)
par: Xu, Beining, et autres
Publié: (2025)
Entropy-aware Masking for Masked Language Modeling
par: Srinivasagan, Gokul, et autres
Publié: (2026)
par: Srinivasagan, Gokul, et autres
Publié: (2026)
DER-GCN: Dialogue and Event Relation-Aware Graph Convolutional Neural Network for Multimodal Dialogue Emotion Recognition
par: Ai, Wei, et autres
Publié: (2023)
par: Ai, Wei, et autres
Publié: (2023)
Agentic Entropy-Balanced Policy Optimization
par: Dong, Guanting, et autres
Publié: (2025)
par: Dong, Guanting, et autres
Publié: (2025)
GTPO: Stabilizing Group Relative Policy Optimization via Gradient and Entropy Control
par: Simoni, Marco, et autres
Publié: (2025)
par: Simoni, Marco, et autres
Publié: (2025)
IGOT: Information Gain Optimized Tokenizer on Domain Adaptive Pretraining
par: Feng, Dawei, et autres
Publié: (2024)
par: Feng, Dawei, et autres
Publié: (2024)
Entropy-based Exploration Conduction for Multi-step Reasoning
par: Zhang, Jinghan, et autres
Publié: (2025)
par: Zhang, Jinghan, et autres
Publié: (2025)
Entropy-Gated Branching for Efficient Test-Time Reasoning
par: Li, Xianzhi, et autres
Publié: (2025)
par: Li, Xianzhi, et autres
Publié: (2025)
Evaluation of the Automated Labeling Method for Taxonomic Nomenclature Through Prompt-Optimized Large Language Model
par: Inoshita, Keito, et autres
Publié: (2025)
par: Inoshita, Keito, et autres
Publié: (2025)
PPO-BR: Dual-Signal Entropy-Reward Adaptation for Trust Region Policy Optimization
par: Rahman, Ben
Publié: (2025)
par: Rahman, Ben
Publié: (2025)
Entropy-Aware Speculative Decoding Toward Improved LLM Reasoning
par: Su, Tiancheng, et autres
Publié: (2025)
par: Su, Tiancheng, et autres
Publié: (2025)
Entropy-Based Block Pruning for Efficient Large Language Models
par: Yang, Liangwei, et autres
Publié: (2025)
par: Yang, Liangwei, et autres
Publié: (2025)
ETR: Entropy Trend Reward for Efficient Chain-of-Thought Reasoning
par: Xiong, Xuan, et autres
Publié: (2026)
par: Xiong, Xuan, et autres
Publié: (2026)
SE-GCL: An Event-Based Simple and Effective Graph Contrastive Learning for Text Representation
par: Meng, Tao, et autres
Publié: (2024)
par: Meng, Tao, et autres
Publié: (2024)
Relative Density Ratio Optimization for Stable and Statistically Consistent Model Alignment
par: Takahashi, Hiroshi, et autres
Publié: (2026)
par: Takahashi, Hiroshi, et autres
Publié: (2026)
Judge Q: Trainable Queries for Optimized Information Retention in KV Cache Eviction
par: Liu, Yijun, et autres
Publié: (2025)
par: Liu, Yijun, et autres
Publié: (2025)
Documents similaires
-
Revisiting the UID Hypothesis in LLM Reasoning Traces
par: Gwak, Minju, et autres
Publié: (2025) -
TokenTiming: A Dynamic Alignment Method for Universal Speculative Decoding Model Pairs
par: Xiao, Sibo, et autres
Publié: (2025) -
PLHF: Prompt Optimization with Few-Shot Human Feedback
par: Yang, Chun-Pai, et autres
Publié: (2025) -
Decoupling Strategy and Execution in Task-Focused Dialogue via Goal-Oriented Preference Optimization
par: Xu, Jingyi, et autres
Publié: (2026) -
Mechanistic Decoding of Cognitive Constructs in Large Language Models
par: Shou, Yitong, et autres
Publié: (2026)