Multilinear Tensor Low-Rank Approximation for Policy-Gradient Methods in Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Rozada, Sergio, Wai, Hoi-To, Marques, Antonio G. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Matrix Low-Rank Approximation For Policy Gradient Methods
por: Rozada, Sergio, et al.
Publicado: (2024)
por: Rozada, Sergio, et al.
Publicado: (2024)
Tensor and Matrix Low-Rank Value-Function Approximation in Reinforcement Learning
por: Rozada, Sergio, et al.
Publicado: (2022)
por: Rozada, Sergio, et al.
Publicado: (2022)
A Tensor Low-Rank Approximation for Value Functions in Multi-Task Reinforcement Learning
por: Rozada, Sergio, et al.
Publicado: (2025)
por: Rozada, Sergio, et al.
Publicado: (2025)
Addressing Finite-Horizon MDPs via Low-Rank Tensor Value Approximation
por: Rozada, Sergio, et al.
Publicado: (2025)
por: Rozada, Sergio, et al.
Publicado: (2025)
Tensor Low-rank Approximation of Finite-horizon Value Functions
por: Rozada, Sergio, et al.
Publicado: (2024)
por: Rozada, Sergio, et al.
Publicado: (2024)
Matrix Low-Rank Trust Region Policy Optimization
por: Rozada, Sergio, et al.
Publicado: (2024)
por: Rozada, Sergio, et al.
Publicado: (2024)
A Multi-resolution Low-rank Tensor Decomposition
por: Rozada, Sergio, et al.
Publicado: (2024)
por: Rozada, Sergio, et al.
Publicado: (2024)
Low-Rank Tensors for Multi-Dimensional Markov Models
por: Navarro, Madeline, et al.
Publicado: (2024)
por: Navarro, Madeline, et al.
Publicado: (2024)
A Random Matrix Approach to Low-Multilinear-Rank Tensor Approximation
por: Lebeau, Hugo, et al.
Publicado: (2024)
por: Lebeau, Hugo, et al.
Publicado: (2024)
Learning Policy Representations for Steerable Behavior Synthesis
por: Li, Beiming, et al.
Publicado: (2026)
por: Li, Beiming, et al.
Publicado: (2026)
Rank-1 Approximation of Inverse Fisher for Natural Policy Gradients in Deep Reinforcement Learning
por: Huo, Yingxiao, et al.
Publicado: (2026)
por: Huo, Yingxiao, et al.
Publicado: (2026)
An Accelerated Newton-GMRES Method for Multilinear PageRank
por: Boubekraoui, Maryam, et al.
Publicado: (2025)
por: Boubekraoui, Maryam, et al.
Publicado: (2025)
Revisiting Trace Norm Minimization for Tensor Tucker Completion: A Direct Multilinear Rank Learning Approach
por: Tong, Xueke, et al.
Publicado: (2024)
por: Tong, Xueke, et al.
Publicado: (2024)
Stochastic Gradient Descent with Strategic Querying
por: Jiang, Nanfei, et al.
Publicado: (2025)
por: Jiang, Nanfei, et al.
Publicado: (2025)
Deterministic Policy Gradient Primal-Dual Methods for Continuous-Space Constrained MDPs
por: Rozada, Sergio, et al.
Publicado: (2024)
por: Rozada, Sergio, et al.
Publicado: (2024)
Low-Tubal-Rank Tensor Recovery via Factorized Gradient Descent
por: Liu, Zhiyu, et al.
Publicado: (2024)
por: Liu, Zhiyu, et al.
Publicado: (2024)
Policy Gradient Methods for Non-Markovian Reinforcement Learning
por: Kar, Avik, et al.
Publicado: (2026)
por: Kar, Avik, et al.
Publicado: (2026)
LoRA-GA: Low-Rank Adaptation with Gradient Approximation
por: Wang, Shaowen, et al.
Publicado: (2024)
por: Wang, Shaowen, et al.
Publicado: (2024)
Low-Rank Adaptation for Critic Learning in Off-Policy Reinforcement Learning
por: Zhuang, Yuan, et al.
Publicado: (2026)
por: Zhuang, Yuan, et al.
Publicado: (2026)
Low-Rank Tensor Learning by Generalized Nonconvex Regularization
por: Xia, Sijia, et al.
Publicado: (2024)
por: Xia, Sijia, et al.
Publicado: (2024)
Guaranteed Nonconvex Low-Rank Tensor Estimation via Scaled Gradient Descent
por: Wu, Tong
Publicado: (2025)
por: Wu, Tong
Publicado: (2025)
Low-Rank Tensor Approximation of Weights in Large Language Models via Cosine Lanczos Bidiagonalization
por: Ichi, A. El, et al.
Publicado: (2026)
por: Ichi, A. El, et al.
Publicado: (2026)
Optimal Policy Sparsification and Low Rank Decomposition for Deep Reinforcement Learning
por: Goddla, Vikram
Publicado: (2024)
por: Goddla, Vikram
Publicado: (2024)
On-Policy Policy Gradient Reinforcement Learning Without On-Policy Sampling
por: Corrado, Nicholas E., et al.
Publicado: (2023)
por: Corrado, Nicholas E., et al.
Publicado: (2023)
Efficient Low-Tubal-Rank Tensor Estimation via Alternating Preconditioned Gradient Descent
por: Liu, Zhiyu, et al.
Publicado: (2025)
por: Liu, Zhiyu, et al.
Publicado: (2025)
Performance of Rank-One Tensor Approximation on Incomplete Data
por: Lebeau, Hugo
Publicado: (2025)
por: Lebeau, Hugo
Publicado: (2025)
Fast Learnings of Coupled Nonnegative Tensor Decomposition Using Optimal Gradient and Low-rank Approximation
por: Wang, Xiulin, et al.
Publicado: (2023)
por: Wang, Xiulin, et al.
Publicado: (2023)
On the Global Optimality of Policy Gradient Methods in General Utility Reinforcement Learning
por: Barakat, Anas, et al.
Publicado: (2024)
por: Barakat, Anas, et al.
Publicado: (2024)
PG-Rainbow: Using Distributional Reinforcement Learning in Policy Gradient Methods
por: Jeon, WooJae, et al.
Publicado: (2024)
por: Jeon, WooJae, et al.
Publicado: (2024)
Learning Graph from Smooth Signals under Partial Observation: A Robustness Analysis
por: Nguyen, Hoang-Son, et al.
Publicado: (2025)
por: Nguyen, Hoang-Son, et al.
Publicado: (2025)
AltLoRA: Towards Better Gradient Approximation in Low-Rank Adaptation with Alternating Projections
por: Yu, Xin, et al.
Publicado: (2025)
por: Yu, Xin, et al.
Publicado: (2025)
Policy Gradient Primal-Dual Method for Safe Reinforcement Learning from Human Feedback
por: Liu, Qiang, et al.
Publicado: (2026)
por: Liu, Qiang, et al.
Publicado: (2026)
Low-Rank Approximation of Structural Redundancy for Self-Supervised Learning
por: Du, Kang, et al.
Publicado: (2024)
por: Du, Kang, et al.
Publicado: (2024)
Graph-Aware Diffusion for Signal Generation
por: Rozada, Sergio, et al.
Publicado: (2025)
por: Rozada, Sergio, et al.
Publicado: (2025)
Learning General Policies with Policy Gradient Methods
por: Ståhlberg, Simon, et al.
Publicado: (2025)
por: Ståhlberg, Simon, et al.
Publicado: (2025)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
por: Carmona, René, et al.
Publicado: (2019)
por: Carmona, René, et al.
Publicado: (2019)
A Stochastic Approximation Approach for Efficient Decentralized Optimization on Random Networks
por: Yau, Chung-Yiu, et al.
Publicado: (2024)
por: Yau, Chung-Yiu, et al.
Publicado: (2024)
Score-Based Model for Low-Rank Tensor Recovery
por: Cheng, Zhengyun, et al.
Publicado: (2025)
por: Cheng, Zhengyun, et al.
Publicado: (2025)
Efficient Generalized Low-Rank Tensor Contextual Bandits
por: Yi, Qianxin, et al.
Publicado: (2023)
por: Yi, Qianxin, et al.
Publicado: (2023)
Initialization Method for Factorization Machine Based on Low-Rank Approximation for Constructing a Corrected Approximate Ising Model
por: Seki, Yuya, et al.
Publicado: (2024)
por: Seki, Yuya, et al.
Publicado: (2024)
Ejemplares similares
-
Matrix Low-Rank Approximation For Policy Gradient Methods
por: Rozada, Sergio, et al.
Publicado: (2024) -
Tensor and Matrix Low-Rank Value-Function Approximation in Reinforcement Learning
por: Rozada, Sergio, et al.
Publicado: (2022) -
A Tensor Low-Rank Approximation for Value Functions in Multi-Task Reinforcement Learning
por: Rozada, Sergio, et al.
Publicado: (2025) -
Addressing Finite-Horizon MDPs via Low-Rank Tensor Value Approximation
por: Rozada, Sergio, et al.
Publicado: (2025) -
Tensor Low-rank Approximation of Finite-horizon Value Functions
por: Rozada, Sergio, et al.
Publicado: (2024)