Efficient Duple Perturbation Robustness in Low-rank MDPs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Yang, Ma, Haitong, Dai, Bo, Li, Na |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Soft Robust MDPs and Risk-Sensitive MDPs: Equivalence, Policy Gradient, and Sample Complexity
par: Zhang, Runyu, et autres
Publié: (2023)
par: Zhang, Runyu, et autres
Publié: (2023)
Stochastic Nonlinear Control via Finite-dimensional Spectral Dynamic Embedding
par: Ren, Zhaolin, et autres
Publié: (2023)
par: Ren, Zhaolin, et autres
Publié: (2023)
Scalable spectral representations for multi-agent reinforcement learning in network MDPs
par: Ren, Zhaolin, et autres
Publié: (2024)
par: Ren, Zhaolin, et autres
Publié: (2024)
Distributed Thompson sampling under constrained communication
par: Zerefa, Saba, et autres
Publié: (2024)
par: Zerefa, Saba, et autres
Publié: (2024)
Efficient Model-Free Exploration in Low-Rank MDPs
par: Mhammedi, Zakaria, et autres
Publié: (2023)
par: Mhammedi, Zakaria, et autres
Publié: (2023)
Can Learning Be Explained By Local Optimality In Robust Low-rank Matrix Recovery?
par: Ma, Jianhao, et autres
Publié: (2023)
par: Ma, Jianhao, et autres
Publié: (2023)
Efficient Low-rank Identification via Accelerated Iteratively Reweighted Nuclear Norm Minimization
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
Non-Rectangular Average-Reward Robust MDPs: Optimal Policies and Their Transient Values
par: Wang, Shengbo, et autres
Publié: (2026)
par: Wang, Shengbo, et autres
Publié: (2026)
Landscape of Policy Optimization for Finite Horizon MDPs with General State and Action
par: Chen, Xin, et autres
Publié: (2024)
par: Chen, Xin, et autres
Publié: (2024)
Robust Low-rank Tensor Train Recovery
par: Qin, Zhen, et autres
Publié: (2024)
par: Qin, Zhen, et autres
Publié: (2024)
Primal-Dual Spectral Representation for Off-policy Evaluation
par: Hu, Yang, et autres
Publié: (2024)
par: Hu, Yang, et autres
Publié: (2024)
Faster Fixed-Point Methods for Multichain MDPs
par: Zurek, Matthew, et autres
Publié: (2025)
par: Zurek, Matthew, et autres
Publié: (2025)
Planning and Learning in Average Risk-aware MDPs
par: Wang, Weikai, et autres
Publié: (2025)
par: Wang, Weikai, et autres
Publié: (2025)
Provably Efficient Representation Selection in Low-rank Markov Decision Processes: From Online to Offline RL
par: Zhang, Weitong, et autres
Publié: (2021)
par: Zhang, Weitong, et autres
Publié: (2021)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
par: Zhang, Zhongjun, et autres
Publié: (2026)
par: Zhang, Zhongjun, et autres
Publié: (2026)
Joint MDPs and Reinforcement Learning in Coupled-Dynamics Environments
par: Kaya, Ege C., et autres
Publié: (2026)
par: Kaya, Ege C., et autres
Publié: (2026)
Model approximation in MDPs with unbounded per-step cost
par: Bozkurt, Berk, et autres
Publié: (2024)
par: Bozkurt, Berk, et autres
Publié: (2024)
Exploration from a Primal-Dual Lens: Value-Incentivized Actor-Critic Methods for Sample-Efficient Online RL
par: Yang, Tong, et autres
Publié: (2025)
par: Yang, Tong, et autres
Publié: (2025)
Statistically Optimal K-means Clustering via Nonnegative Low-rank Semidefinite Programming
par: Zhuang, Yubo, et autres
Publié: (2023)
par: Zhuang, Yubo, et autres
Publié: (2023)
Achieving Tractable Minimax Optimal Regret in Average Reward MDPs
par: Boone, Victor, et autres
Publié: (2024)
par: Boone, Victor, et autres
Publié: (2024)
Optimal Horizon-Free Reward-Free Exploration for Linear Mixture MDPs
par: Zhang, Junkai, et autres
Publié: (2023)
par: Zhang, Junkai, et autres
Publié: (2023)
In-depth Analysis of Low-rank Matrix Factorisation in a Federated Setting
par: Philippenko, Constantin, et autres
Publié: (2024)
par: Philippenko, Constantin, et autres
Publié: (2024)
Implicit Regularization Makes Overparameterized Asymmetric Matrix Sensing Robust to Perturbations
par: Wind, Johan S.
Publié: (2023)
par: Wind, Johan S.
Publié: (2023)
Learning Infinite-Horizon Average-Reward Linear Mixture MDPs of Bounded Span
par: Chae, Woojin, et autres
Publié: (2024)
par: Chae, Woojin, et autres
Publié: (2024)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
par: Ding, Dongsheng, et autres
Publié: (2023)
par: Ding, Dongsheng, et autres
Publié: (2023)
Sharp Global Guarantees for Nonconvex Low-rank Recovery in the Noisy Overparameterized Regime
par: Zhang, Richard Y.
Publié: (2021)
par: Zhang, Richard Y.
Publié: (2021)
Nonnegative Low-rank Matrix Recovery Can Have Spurious Local Minima
par: Zhang, Richard Y.
Publié: (2025)
par: Zhang, Richard Y.
Publié: (2025)
Efficient Algorithms for Regularized Nonnegative Scale-invariant Low-rank Approximation Models
par: Cohen, Jeremy E., et autres
Publié: (2024)
par: Cohen, Jeremy E., et autres
Publié: (2024)
Multi-Agent Coverage Control with Transient Behavior Consideration
par: Zhang, Runyu, et autres
Publié: (2024)
par: Zhang, Runyu, et autres
Publié: (2024)
Neural Collapse versus Low-rank Bias: Is Deep Neural Collapse Really Optimal?
par: Súkeník, Peter, et autres
Publié: (2024)
par: Súkeník, Peter, et autres
Publié: (2024)
Guarantees of a Preconditioned Subgradient Algorithm for Overparameterized Asymmetric Low-rank Matrix Recovery
par: Giampouras, Paris, et autres
Publié: (2024)
par: Giampouras, Paris, et autres
Publié: (2024)
Statistical Robustness of Interval CVaR Based Regression Models under Perturbation and Contamination
par: You, Yulei, et autres
Publié: (2026)
par: You, Yulei, et autres
Publié: (2026)
MLorc: Momentum Low-rank Compression for Memory Efficient Large Language Model Adaptation
par: Shen, Wei, et autres
Publié: (2025)
par: Shen, Wei, et autres
Publié: (2025)
Quantizer Design for Finite Model Approximations, Model Learning, and Quantized Q-Learning for MDPs with Unbounded Spaces
par: Bicer, Osman, et autres
Publié: (2025)
par: Bicer, Osman, et autres
Publié: (2025)
Weighted Low-rank Approximation via Stochastic Gradient Descent on Manifolds
par: Xu, Conglong, et autres
Publié: (2025)
par: Xu, Conglong, et autres
Publié: (2025)
Representative Action Selection for Large Action Space: From Bandits to MDPs
par: Zhou, Quan, et autres
Publié: (2025)
par: Zhou, Quan, et autres
Publié: (2025)
Probabilistic Safety Guarantee for Stochastic Control Systems Using Average Reward MDPs
par: Omidi, Saber, et autres
Publié: (2025)
par: Omidi, Saber, et autres
Publié: (2025)
Stability Evaluation via Distributional Perturbation Analysis
par: Blanchet, Jose, et autres
Publié: (2024)
par: Blanchet, Jose, et autres
Publié: (2024)
Curse of Dimensionality in Neural Network Optimization
par: Na, Sanghoon, et autres
Publié: (2025)
par: Na, Sanghoon, et autres
Publié: (2025)
Optimal Variance-Dependent Regret Bounds for Infinite-Horizon MDPs
par: Zamir, Guy, et autres
Publié: (2026)
par: Zamir, Guy, et autres
Publié: (2026)
Documents similaires
-
Soft Robust MDPs and Risk-Sensitive MDPs: Equivalence, Policy Gradient, and Sample Complexity
par: Zhang, Runyu, et autres
Publié: (2023) -
Stochastic Nonlinear Control via Finite-dimensional Spectral Dynamic Embedding
par: Ren, Zhaolin, et autres
Publié: (2023) -
Scalable spectral representations for multi-agent reinforcement learning in network MDPs
par: Ren, Zhaolin, et autres
Publié: (2024) -
Distributed Thompson sampling under constrained communication
par: Zerefa, Saba, et autres
Publié: (2024) -
Efficient Model-Free Exploration in Low-Rank MDPs
par: Mhammedi, Zakaria, et autres
Publié: (2023)