Shift Before You Learn: Enabling Low-Rank Representations in Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dubail, Bastien, Stojanovic, Stefan, Proutière, Alexandre |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Model-free Low-Rank Reinforcement Learning via Leveraged Entry-wise Matrix Estimation
par: Stojanovic, Stefan, et autres
Publié: (2024)
par: Stojanovic, Stefan, et autres
Publié: (2024)
Switching Successor Measures for Hierarchical Zero-shot Reinforcement Learning
par: Stojanovic, Stefan, et autres
Publié: (2026)
par: Stojanovic, Stefan, et autres
Publié: (2026)
Low-Rank Bandits via Tight Two-to-Infinity Singular Subspace Recovery
par: Jedra, Yassir, et autres
Publié: (2024)
par: Jedra, Yassir, et autres
Publié: (2024)
Model-Free Active Exploration in Reinforcement Learning
par: Russo, Alessio, et autres
Publié: (2024)
par: Russo, Alessio, et autres
Publié: (2024)
Adversarial Diffusion for Robust Reinforcement Learning
par: Foffano, Daniele, et autres
Publié: (2025)
par: Foffano, Daniele, et autres
Publié: (2025)
Adaptive Reinforcement Learning for Unobservable Random Delays
par: Wikman, John, et autres
Publié: (2025)
par: Wikman, John, et autres
Publié: (2025)
Near-optimal Rank Adaptive Inference of High Dimensional Matrices
par: Zheng, Frédéric, et autres
Publié: (2025)
par: Zheng, Frédéric, et autres
Publié: (2025)
Advantage-Guided Diffusion for Model-Based Reinforcement Learning
par: Foffano, Daniele, et autres
Publié: (2026)
par: Foffano, Daniele, et autres
Publié: (2026)
Curvature-Guided LoRA: Steering in the pretrained NTK subspace
par: Zheng, Frédéric, et autres
Publié: (2026)
par: Zheng, Frédéric, et autres
Publié: (2026)
Conformal Predictions under Markovian Data
par: Zheng, Frédéric, et autres
Publié: (2024)
par: Zheng, Frédéric, et autres
Publié: (2024)
Provable Multi-Task Reinforcement Learning: A Representation Learning Framework with Low Rank Rewards
par: Guo, Yaoze, et autres
Publié: (2026)
par: Guo, Yaoze, et autres
Publié: (2026)
Optimal Centered Active Excitation in Linear System Identification
par: Ito, Kaito, et autres
Publié: (2026)
par: Ito, Kaito, et autres
Publié: (2026)
On Universally Optimal Algorithms for A/B Testing
par: Wang, Po-An, et autres
Publié: (2023)
par: Wang, Po-An, et autres
Publié: (2023)
Best Arm Identification with Fixed Budget: A Large Deviation Perspective
par: Wang, Po-An, et autres
Publié: (2023)
par: Wang, Po-An, et autres
Publié: (2023)
Minimizing Human Intervention in Online Classification
par: Réveillard, William, et autres
Publié: (2025)
par: Réveillard, William, et autres
Publié: (2025)
Low-Rank Adaptation for Critic Learning in Off-Policy Reinforcement Learning
par: Zhuang, Yuan, et autres
Publié: (2026)
par: Zhuang, Yuan, et autres
Publié: (2026)
Conformal Off-Policy Evaluation in Markov Decision Processes
par: Foffano, Daniele, et autres
Publié: (2023)
par: Foffano, Daniele, et autres
Publié: (2023)
Low-Rank Contextual Reinforcement Learning from Heterogeneous Human Feedback
par: Lee, Seong Jin, et autres
Publié: (2024)
par: Lee, Seong Jin, et autres
Publié: (2024)
InRank: Incremental Low-Rank Learning
par: Zhao, Jiawei, et autres
Publié: (2023)
par: Zhao, Jiawei, et autres
Publié: (2023)
Revisiting Instance-Optimal Cluster Recovery in the Labeled Stochastic Block Model
par: Ariu, Kaito, et autres
Publié: (2023)
par: Ariu, Kaito, et autres
Publié: (2023)
In-Trajectory Inverse Reinforcement Learning: Learn Incrementally Before An Ongoing Trajectory Terminates
par: Liu, Shicheng, et autres
Publié: (2024)
par: Liu, Shicheng, et autres
Publié: (2024)
Optimal Clustering from Noisy Binary Feedback
par: Ariu, Kaito, et autres
Publié: (2019)
par: Ariu, Kaito, et autres
Publié: (2019)
Multilinear Tensor Low-Rank Approximation for Policy-Gradient Methods in Reinforcement Learning
par: Rozada, Sergio, et autres
Publié: (2025)
par: Rozada, Sergio, et autres
Publié: (2025)
Cutoff for mixtures of permuted Markov chains: reversible case
par: Dubail, Bastien
Publié: (2024)
par: Dubail, Bastien
Publié: (2024)
Cutoff for mixtures of permuted Markov chains: general case
par: Dubail, Bastien
Publié: (2024)
par: Dubail, Bastien
Publié: (2024)
Policy Testing in Markov Decision Processes
par: Ariu, Kaito, et autres
Publié: (2025)
par: Ariu, Kaito, et autres
Publié: (2025)
Tensor and Matrix Low-Rank Value-Function Approximation in Reinforcement Learning
par: Rozada, Sergio, et autres
Publié: (2022)
par: Rozada, Sergio, et autres
Publié: (2022)
Optimal Policy Sparsification and Low Rank Decomposition for Deep Reinforcement Learning
par: Goddla, Vikram
Publié: (2024)
par: Goddla, Vikram
Publié: (2024)
A Tensor Low-Rank Approximation for Value Functions in Multi-Task Reinforcement Learning
par: Rozada, Sergio, et autres
Publié: (2025)
par: Rozada, Sergio, et autres
Publié: (2025)
Ranking-aware Reinforcement Learning for Ordinal Ranking
par: Hao, Aiming, et autres
Publié: (2026)
par: Hao, Aiming, et autres
Publié: (2026)
Performative Reinforcement Learning in Gradually Shifting Environments
par: Rank, Ben, et autres
Publié: (2024)
par: Rank, Ben, et autres
Publié: (2024)
Accelerating Multi-Task Temporal Difference Learning under Low-Rank Representation
par: Bai, Yitao, et autres
Publié: (2025)
par: Bai, Yitao, et autres
Publié: (2025)
Low-Rank Plus Sparse Matrix Transfer Learning under Growing Representations and Ambient Dimensions
par: Chai, Jinhang, et autres
Publié: (2026)
par: Chai, Jinhang, et autres
Publié: (2026)
Representation Learning by Ranking across multiple tasks
par: Gu, Lifeng
Publié: (2021)
par: Gu, Lifeng
Publié: (2021)
Prepare Before You Act: Learning From Humans to Rearrange Initial States
par: Dai, Yinlong, et autres
Publié: (2025)
par: Dai, Yinlong, et autres
Publié: (2025)
Class Distribution Shifts in Zero-Shot Learning: Learning Robust Representations
par: Slavutsky, Yuli, et autres
Publié: (2023)
par: Slavutsky, Yuli, et autres
Publié: (2023)
Reinforcement Learning is all You Need
par: Lian, Yongsheng
Publié: (2025)
par: Lian, Yongsheng
Publié: (2025)
Learning Clinical Representations Under Systematic Distribution Shift
par: Zhang, Yuanyun, et autres
Publié: (2026)
par: Zhang, Yuanyun, et autres
Publié: (2026)
Dynamic Rank Reinforcement Learning for Adaptive Low-Rank Multi-Head Self Attention in Large Language Models
par: Erden, Caner
Publié: (2025)
par: Erden, Caner
Publié: (2025)
Provable Meta-Learning with Low-Rank Adaptations
par: Block, Jacob L., et autres
Publié: (2024)
par: Block, Jacob L., et autres
Publié: (2024)
Documents similaires
-
Model-free Low-Rank Reinforcement Learning via Leveraged Entry-wise Matrix Estimation
par: Stojanovic, Stefan, et autres
Publié: (2024) -
Switching Successor Measures for Hierarchical Zero-shot Reinforcement Learning
par: Stojanovic, Stefan, et autres
Publié: (2026) -
Low-Rank Bandits via Tight Two-to-Infinity Singular Subspace Recovery
par: Jedra, Yassir, et autres
Publié: (2024) -
Model-Free Active Exploration in Reinforcement Learning
par: Russo, Alessio, et autres
Publié: (2024) -
Adversarial Diffusion for Robust Reinforcement Learning
par: Foffano, Daniele, et autres
Publié: (2025)