Entropy Regularizing Activation: Boosting Continuous Control, Large Language Models, and Image Classification with Activation as Entropy Constraints
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kang, Zilin, Liao, Chonghua, Xu, Tingqiang, Xu, Huazhe |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Forget-and-Grow Strategy for Deep Reinforcement Learning Scaling in Continuous Control
par: Kang, Zilin, et autres
Publié: (2025)
par: Kang, Zilin, et autres
Publié: (2025)
ACE : Off-Policy Actor-Critic with Causality-Aware Entropy Regularization
par: Ji, Tianying, et autres
Publié: (2024)
par: Ji, Tianying, et autres
Publié: (2024)
Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control
par: Uehara, Masatoshi, et autres
Publié: (2024)
par: Uehara, Masatoshi, et autres
Publié: (2024)
Large Language Model Compression via the Nested Activation-Aware Decomposition
par: Lu, Jun, et autres
Publié: (2025)
par: Lu, Jun, et autres
Publié: (2025)
Fast Policy Learning for Linear Quadratic Control with Entropy Regularization
par: Guo, Xin, et autres
Publié: (2023)
par: Guo, Xin, et autres
Publié: (2023)
Rethinking Entropy Regularization in Large Reasoning Models
par: Jiang, Yuxian, et autres
Publié: (2025)
par: Jiang, Yuxian, et autres
Publié: (2025)
Entropy-Regularized Token-Level Policy Optimization for Language Agent Reinforcement
par: Wen, Muning, et autres
Publié: (2024)
par: Wen, Muning, et autres
Publié: (2024)
E-Sparse: Boosting the Large Language Model Inference through Entropy-based N:M Sparsity
par: Li, Yun, et autres
Publié: (2023)
par: Li, Yun, et autres
Publié: (2023)
Entropy-Regularized Process Reward Model
par: Zhang, Hanning, et autres
Publié: (2024)
par: Zhang, Hanning, et autres
Publié: (2024)
TemplateRL: Structured Template-Guided Reinforcement Learning for LLM Reasoning
par: Wu, Jinyang, et autres
Publié: (2025)
par: Wu, Jinyang, et autres
Publié: (2025)
Boosting Entropy with Bell Box Quantization
par: Yang, Ningfeng, et autres
Publié: (2026)
par: Yang, Ningfeng, et autres
Publié: (2026)
Clip-Low Increases Entropy and Clip-High Decreases Entropy in Reinforcement Learning of Large Language Models
par: Park, Jaesung R., et autres
Publié: (2025)
par: Park, Jaesung R., et autres
Publié: (2025)
Internal Value Alignment in Large Language Models through Controlled Value Vector Activation
par: Jin, Haoran, et autres
Publié: (2025)
par: Jin, Haoran, et autres
Publié: (2025)
Massive Activations in Large Language Models
par: Sun, Mingjie, et autres
Publié: (2024)
par: Sun, Mingjie, et autres
Publié: (2024)
Mixture of Message Passing Experts with Routing Entropy Regularization for Node Classification
par: Chen, Xuanze, et autres
Publié: (2025)
par: Chen, Xuanze, et autres
Publié: (2025)
Entropy Reweighted Conformal Classification
par: Luo, Rui, et autres
Publié: (2024)
par: Luo, Rui, et autres
Publié: (2024)
State Entropy Regularization for Robust Reinforcement Learning
par: Ashlag, Yonatan, et autres
Publié: (2025)
par: Ashlag, Yonatan, et autres
Publié: (2025)
Refined Analysis of Entropy-Regularized Actor-Critic
par: Labbi, Safwan, et autres
Publié: (2026)
par: Labbi, Safwan, et autres
Publié: (2026)
Generative Flow Networks as Entropy-Regularized RL
par: Tiapkin, Daniil, et autres
Publié: (2023)
par: Tiapkin, Daniil, et autres
Publié: (2023)
Flow Density Control: Generative Optimization Beyond Entropy-Regularized Fine-Tuning
par: De Santi, Riccardo, et autres
Publié: (2025)
par: De Santi, Riccardo, et autres
Publié: (2025)
Mitigating the Impact of Outlier Channels for Language Model Quantization with Activation Regularization
par: Nrusimha, Aniruddha, et autres
Publié: (2024)
par: Nrusimha, Aniruddha, et autres
Publié: (2024)
Delta Activations: A Representation for Finetuned Large Language Models
par: Xu, Zhiqiu, et autres
Publié: (2025)
par: Xu, Zhiqiu, et autres
Publié: (2025)
First Activations Matter: Training-Free Methods for Dynamic Activation in Large Language Models
par: Ma, Chi, et autres
Publié: (2024)
par: Ma, Chi, et autres
Publié: (2024)
Convergence Theorems for Entropy-Regularized and Distributional Reinforcement Learning
par: Jhaveri, Yash, et autres
Publié: (2025)
par: Jhaveri, Yash, et autres
Publié: (2025)
Universal Properties of Activation Sparsity in Modern Large Language Models
par: Szatkowski, Filip, et autres
Publié: (2025)
par: Szatkowski, Filip, et autres
Publié: (2025)
Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning
par: Shi, Ruizhe, et autres
Publié: (2023)
par: Shi, Ruizhe, et autres
Publié: (2023)
Model-Free Inference of Investor Preferences: A Relative Entropy IRL Approach
par: Xu, Chen
Publié: (2026)
par: Xu, Chen
Publié: (2026)
Facies Classification with Copula Entropy
par: Ma, Jian
Publié: (2025)
par: Ma, Jian
Publié: (2025)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
par: Wang, Shumin, et autres
Publié: (2026)
par: Wang, Shumin, et autres
Publié: (2026)
Optimizing Learned Image Compression on Scalar and Entropy-Constraint Quantization
par: Borzechowski, Florian, et autres
Publié: (2025)
par: Borzechowski, Florian, et autres
Publié: (2025)
Steering Large Language Model Activations in Sparse Spaces
par: Bayat, Reza, et autres
Publié: (2025)
par: Bayat, Reza, et autres
Publié: (2025)
DittoGym: Learning to Control Soft Shape-Shifting Robots
par: Huang, Suning, et autres
Publié: (2024)
par: Huang, Suning, et autres
Publié: (2024)
World Models with Hints of Large Language Models for Goal Achieving
par: Liu, Zeyuan, et autres
Publié: (2024)
par: Liu, Zeyuan, et autres
Publié: (2024)
ERPPO: Entropy Regularization-based Proximal Policy Optimization
par: Lee, Changha, et autres
Publié: (2026)
par: Lee, Changha, et autres
Publié: (2026)
Energy-Entropy Regularization: The True Power of Minimal Looped Transformers
par: Lam, Wai-Lun
Publié: (2026)
par: Lam, Wai-Lun
Publié: (2026)
Understanding and Preventing Entropy Collapse in RLVR with On-Policy Entropy Flow Optimization
par: Xu, Huimin, et autres
Publié: (2026)
par: Xu, Huimin, et autres
Publié: (2026)
Fine-Tuning Large Language Models to Appropriately Abstain with Semantic Entropy
par: Tjandra, Benedict Aaron, et autres
Publié: (2024)
par: Tjandra, Benedict Aaron, et autres
Publié: (2024)
Decoding Rewards in Competitive Games: Inverse Game Theory with Entropy Regularization
par: Liao, Junyi, et autres
Publié: (2026)
par: Liao, Junyi, et autres
Publié: (2026)
Hyperbolic Continuous Structural Entropy for Hierarchical Clustering
par: Zeng, Guangjie, et autres
Publié: (2025)
par: Zeng, Guangjie, et autres
Publié: (2025)
On the Entropy Calibration of Language Models
par: Cao, Steven, et autres
Publié: (2025)
par: Cao, Steven, et autres
Publié: (2025)
Documents similaires
-
A Forget-and-Grow Strategy for Deep Reinforcement Learning Scaling in Continuous Control
par: Kang, Zilin, et autres
Publié: (2025) -
ACE : Off-Policy Actor-Critic with Causality-Aware Entropy Regularization
par: Ji, Tianying, et autres
Publié: (2024) -
Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control
par: Uehara, Masatoshi, et autres
Publié: (2024) -
Large Language Model Compression via the Nested Activation-Aware Decomposition
par: Lu, Jun, et autres
Publié: (2025) -
Fast Policy Learning for Linear Quadratic Control with Entropy Regularization
par: Guo, Xin, et autres
Publié: (2023)