Optimal Policy Sparsification and Low Rank Decomposition for Deep Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autore principale: | Goddla, Vikram |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Low-Rank Adaptation for Critic Learning in Off-Policy Reinforcement Learning
di: Zhuang, Yuan, et al.
Pubblicazione: (2026)
di: Zhuang, Yuan, et al.
Pubblicazione: (2026)
Rank-1 Approximation of Inverse Fisher for Natural Policy Gradients in Deep Reinforcement Learning
di: Huo, Yingxiao, et al.
Pubblicazione: (2026)
di: Huo, Yingxiao, et al.
Pubblicazione: (2026)
Explainable Reinforcement Learning via Temporal Policy Decomposition
di: Ruggeri, Franco, et al.
Pubblicazione: (2025)
di: Ruggeri, Franco, et al.
Pubblicazione: (2025)
Towards Off-Policy Reinforcement Learning for Ranking Policies with Human Feedback
di: Xiao, Teng, et al.
Pubblicazione: (2024)
di: Xiao, Teng, et al.
Pubblicazione: (2024)
Low-Rank Tensor Decompositions for the Theory of Neural Networks
di: Borsoi, Ricardo, et al.
Pubblicazione: (2025)
di: Borsoi, Ricardo, et al.
Pubblicazione: (2025)
Decoupling General and Personalized Knowledge in Federated Learning via Additive and Low-Rank Decomposition
di: Wu, Xinghao, et al.
Pubblicazione: (2024)
di: Wu, Xinghao, et al.
Pubblicazione: (2024)
Assigning Distinct Roles to Quantized and Low-Rank Matrices Toward Optimal Weight Decomposition
di: Cho, Yoonjun, et al.
Pubblicazione: (2025)
di: Cho, Yoonjun, et al.
Pubblicazione: (2025)
Tensor and Matrix Low-Rank Value-Function Approximation in Reinforcement Learning
di: Rozada, Sergio, et al.
Pubblicazione: (2022)
di: Rozada, Sergio, et al.
Pubblicazione: (2022)
OATS: Outlier-Aware Pruning Through Sparse and Low Rank Decomposition
di: Zhang, Stephen, et al.
Pubblicazione: (2024)
di: Zhang, Stephen, et al.
Pubblicazione: (2024)
Ranking-aware Reinforcement Learning for Ordinal Ranking
di: Hao, Aiming, et al.
Pubblicazione: (2026)
di: Hao, Aiming, et al.
Pubblicazione: (2026)
Matrix Low-Rank Approximation For Policy Gradient Methods
di: Rozada, Sergio, et al.
Pubblicazione: (2024)
di: Rozada, Sergio, et al.
Pubblicazione: (2024)
Matrix Low-Rank Trust Region Policy Optimization
di: Rozada, Sergio, et al.
Pubblicazione: (2024)
di: Rozada, Sergio, et al.
Pubblicazione: (2024)
Reinforcing Language Agents via Policy Optimization with Action Decomposition
di: Wen, Muning, et al.
Pubblicazione: (2024)
di: Wen, Muning, et al.
Pubblicazione: (2024)
On the Global Optimality of Policy Gradient Methods in General Utility Reinforcement Learning
di: Barakat, Anas, et al.
Pubblicazione: (2024)
di: Barakat, Anas, et al.
Pubblicazione: (2024)
A Study of Plasticity Loss in On-Policy Deep Reinforcement Learning
di: Juliani, Arthur, et al.
Pubblicazione: (2024)
di: Juliani, Arthur, et al.
Pubblicazione: (2024)
DeepStock: Reinforcement Learning with Policy Regularizations for Inventory Management
di: Xie, Yaqi, et al.
Pubblicazione: (2026)
di: Xie, Yaqi, et al.
Pubblicazione: (2026)
Score-Based Diffusion Policy Compatible with Reinforcement Learning via Optimal Transport
di: Sun, Mingyang, et al.
Pubblicazione: (2025)
di: Sun, Mingyang, et al.
Pubblicazione: (2025)
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
di: Anisimov, Maksim, et al.
Pubblicazione: (2026)
di: Anisimov, Maksim, et al.
Pubblicazione: (2026)
The Impact of On-Policy Parallelized Data Collection on Deep Reinforcement Learning Networks
di: Mayor, Walter, et al.
Pubblicazione: (2025)
di: Mayor, Walter, et al.
Pubblicazione: (2025)
Efficient Deep Reinforcement Learning with Predictive Processing Proximal Policy Optimization
di: Küçükoğlu, Burcu, et al.
Pubblicazione: (2022)
di: Küçükoğlu, Burcu, et al.
Pubblicazione: (2022)
Deep Reinforcement Learning for Inventory Networks: Toward Reliable Policy Optimization
di: Alvo, Matias, et al.
Pubblicazione: (2023)
di: Alvo, Matias, et al.
Pubblicazione: (2023)
Compressing Large Language Models using Low Rank and Low Precision Decomposition
di: Saha, Rajarshi, et al.
Pubblicazione: (2024)
di: Saha, Rajarshi, et al.
Pubblicazione: (2024)
SAL: Selective Adaptive Learning for Backpropagation-Free Training with Sparsification
di: Liu, Fanping, et al.
Pubblicazione: (2026)
di: Liu, Fanping, et al.
Pubblicazione: (2026)
Performative Policy Gradient: Optimality in Performative Reinforcement Learning
di: Basu, Debabrota, et al.
Pubblicazione: (2025)
di: Basu, Debabrota, et al.
Pubblicazione: (2025)
Low-Rank Optimal Transport through Factor Relaxation with Latent Coupling
di: Halmos, Peter, et al.
Pubblicazione: (2024)
di: Halmos, Peter, et al.
Pubblicazione: (2024)
MUXQ: Mixed-to-Uniform Precision MatriX Quantization via Low-Rank Outlier Decomposition
di: Lee, Seoungsub, et al.
Pubblicazione: (2026)
di: Lee, Seoungsub, et al.
Pubblicazione: (2026)
CALR: Corrective Adaptive Low-Rank Decomposition for Efficient Large Language Model Layer Compression
di: Kautsar, Muchammad Daniyal, et al.
Pubblicazione: (2025)
di: Kautsar, Muchammad Daniyal, et al.
Pubblicazione: (2025)
Compressible Dynamics in Deep Overparameterized Low-Rank Learning & Adaptation
di: Yaras, Can, et al.
Pubblicazione: (2024)
di: Yaras, Can, et al.
Pubblicazione: (2024)
SAFE-RL: Saliency-Aware Counterfactual Explainer for Deep Reinforcement Learning Policies
di: Samadi, Amir, et al.
Pubblicazione: (2024)
di: Samadi, Amir, et al.
Pubblicazione: (2024)
Improving Deep Reinforcement Learning by Reducing the Chain Effect of Value and Policy Churn
di: Tang, Hongyao, et al.
Pubblicazione: (2024)
di: Tang, Hongyao, et al.
Pubblicazione: (2024)
Solving Deep Reinforcement Learning Tasks with Evolution Strategies and Linear Policy Networks
di: Wong, Annie, et al.
Pubblicazione: (2024)
di: Wong, Annie, et al.
Pubblicazione: (2024)
The Definitive Guide to Policy Gradients in Deep Reinforcement Learning: Theory, Algorithms and Implementations
di: Lehmann, Matthias
Pubblicazione: (2024)
di: Lehmann, Matthias
Pubblicazione: (2024)
Relative Importance Sampling for off-Policy Actor-Critic in Deep Reinforcement Learning
di: Humayoo, Mahammad, et al.
Pubblicazione: (2018)
di: Humayoo, Mahammad, et al.
Pubblicazione: (2018)
Graph Sparsification via Mixture of Graphs
di: Zhang, Guibin, et al.
Pubblicazione: (2024)
di: Zhang, Guibin, et al.
Pubblicazione: (2024)
Integrating Policy Summaries with Reward Decomposition for Explaining Reinforcement Learning Agents
di: Septon, Yael, et al.
Pubblicazione: (2022)
di: Septon, Yael, et al.
Pubblicazione: (2022)
Global Low-Rank, Local Full-Rank: The Holographic Encoding of Learned Algorithms
di: Xu, Yongzhong
Pubblicazione: (2026)
di: Xu, Yongzhong
Pubblicazione: (2026)
Co-Activation Graph Analysis of Safety-Verified and Explainable Deep Reinforcement Learning Policies
di: Gross, Dennis, et al.
Pubblicazione: (2025)
di: Gross, Dennis, et al.
Pubblicazione: (2025)
TROFI: Trajectory-Ranked Offline Inverse Reinforcement Learning
di: Sestini, Alessandro, et al.
Pubblicazione: (2025)
di: Sestini, Alessandro, et al.
Pubblicazione: (2025)
Communication-Efficient Personalized Federal Graph Learning via Low-Rank Decomposition
di: Liu, Ruyue, et al.
Pubblicazione: (2024)
di: Liu, Ruyue, et al.
Pubblicazione: (2024)
Discovering Behavioral Modes in Deep Reinforcement Learning Policies Using Trajectory Clustering in Latent Space
di: Remman, Sindre Benjamin, et al.
Pubblicazione: (2024)
di: Remman, Sindre Benjamin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Low-Rank Adaptation for Critic Learning in Off-Policy Reinforcement Learning
di: Zhuang, Yuan, et al.
Pubblicazione: (2026) -
Rank-1 Approximation of Inverse Fisher for Natural Policy Gradients in Deep Reinforcement Learning
di: Huo, Yingxiao, et al.
Pubblicazione: (2026) -
Explainable Reinforcement Learning via Temporal Policy Decomposition
di: Ruggeri, Franco, et al.
Pubblicazione: (2025) -
Towards Off-Policy Reinforcement Learning for Ranking Policies with Human Feedback
di: Xiao, Teng, et al.
Pubblicazione: (2024) -
Low-Rank Tensor Decompositions for the Theory of Neural Networks
di: Borsoi, Ricardo, et al.
Pubblicazione: (2025)