Efficient Duple Perturbation Robustness in Low-rank MDPs
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Yang, Ma, Haitong, Dai, Bo, Li, Na |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Soft Robust MDPs and Risk-Sensitive MDPs: Equivalence, Policy Gradient, and Sample Complexity
di: Zhang, Runyu, et al.
Pubblicazione: (2023)
di: Zhang, Runyu, et al.
Pubblicazione: (2023)
Stochastic Nonlinear Control via Finite-dimensional Spectral Dynamic Embedding
di: Ren, Zhaolin, et al.
Pubblicazione: (2023)
di: Ren, Zhaolin, et al.
Pubblicazione: (2023)
Scalable spectral representations for multi-agent reinforcement learning in network MDPs
di: Ren, Zhaolin, et al.
Pubblicazione: (2024)
di: Ren, Zhaolin, et al.
Pubblicazione: (2024)
Distributed Thompson sampling under constrained communication
di: Zerefa, Saba, et al.
Pubblicazione: (2024)
di: Zerefa, Saba, et al.
Pubblicazione: (2024)
Efficient Model-Free Exploration in Low-Rank MDPs
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2023)
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2023)
Can Learning Be Explained By Local Optimality In Robust Low-rank Matrix Recovery?
di: Ma, Jianhao, et al.
Pubblicazione: (2023)
di: Ma, Jianhao, et al.
Pubblicazione: (2023)
Efficient Low-rank Identification via Accelerated Iteratively Reweighted Nuclear Norm Minimization
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
Non-Rectangular Average-Reward Robust MDPs: Optimal Policies and Their Transient Values
di: Wang, Shengbo, et al.
Pubblicazione: (2026)
di: Wang, Shengbo, et al.
Pubblicazione: (2026)
Landscape of Policy Optimization for Finite Horizon MDPs with General State and Action
di: Chen, Xin, et al.
Pubblicazione: (2024)
di: Chen, Xin, et al.
Pubblicazione: (2024)
Robust Low-rank Tensor Train Recovery
di: Qin, Zhen, et al.
Pubblicazione: (2024)
di: Qin, Zhen, et al.
Pubblicazione: (2024)
Primal-Dual Spectral Representation for Off-policy Evaluation
di: Hu, Yang, et al.
Pubblicazione: (2024)
di: Hu, Yang, et al.
Pubblicazione: (2024)
Faster Fixed-Point Methods for Multichain MDPs
di: Zurek, Matthew, et al.
Pubblicazione: (2025)
di: Zurek, Matthew, et al.
Pubblicazione: (2025)
Planning and Learning in Average Risk-aware MDPs
di: Wang, Weikai, et al.
Pubblicazione: (2025)
di: Wang, Weikai, et al.
Pubblicazione: (2025)
Provably Efficient Representation Selection in Low-rank Markov Decision Processes: From Online to Offline RL
di: Zhang, Weitong, et al.
Pubblicazione: (2021)
di: Zhang, Weitong, et al.
Pubblicazione: (2021)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Joint MDPs and Reinforcement Learning in Coupled-Dynamics Environments
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
Model approximation in MDPs with unbounded per-step cost
di: Bozkurt, Berk, et al.
Pubblicazione: (2024)
di: Bozkurt, Berk, et al.
Pubblicazione: (2024)
Exploration from a Primal-Dual Lens: Value-Incentivized Actor-Critic Methods for Sample-Efficient Online RL
di: Yang, Tong, et al.
Pubblicazione: (2025)
di: Yang, Tong, et al.
Pubblicazione: (2025)
Statistically Optimal K-means Clustering via Nonnegative Low-rank Semidefinite Programming
di: Zhuang, Yubo, et al.
Pubblicazione: (2023)
di: Zhuang, Yubo, et al.
Pubblicazione: (2023)
Achieving Tractable Minimax Optimal Regret in Average Reward MDPs
di: Boone, Victor, et al.
Pubblicazione: (2024)
di: Boone, Victor, et al.
Pubblicazione: (2024)
Optimal Horizon-Free Reward-Free Exploration for Linear Mixture MDPs
di: Zhang, Junkai, et al.
Pubblicazione: (2023)
di: Zhang, Junkai, et al.
Pubblicazione: (2023)
In-depth Analysis of Low-rank Matrix Factorisation in a Federated Setting
di: Philippenko, Constantin, et al.
Pubblicazione: (2024)
di: Philippenko, Constantin, et al.
Pubblicazione: (2024)
Implicit Regularization Makes Overparameterized Asymmetric Matrix Sensing Robust to Perturbations
di: Wind, Johan S.
Pubblicazione: (2023)
di: Wind, Johan S.
Pubblicazione: (2023)
Learning Infinite-Horizon Average-Reward Linear Mixture MDPs of Bounded Span
di: Chae, Woojin, et al.
Pubblicazione: (2024)
di: Chae, Woojin, et al.
Pubblicazione: (2024)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Sharp Global Guarantees for Nonconvex Low-rank Recovery in the Noisy Overparameterized Regime
di: Zhang, Richard Y.
Pubblicazione: (2021)
di: Zhang, Richard Y.
Pubblicazione: (2021)
Nonnegative Low-rank Matrix Recovery Can Have Spurious Local Minima
di: Zhang, Richard Y.
Pubblicazione: (2025)
di: Zhang, Richard Y.
Pubblicazione: (2025)
Efficient Algorithms for Regularized Nonnegative Scale-invariant Low-rank Approximation Models
di: Cohen, Jeremy E., et al.
Pubblicazione: (2024)
di: Cohen, Jeremy E., et al.
Pubblicazione: (2024)
Multi-Agent Coverage Control with Transient Behavior Consideration
di: Zhang, Runyu, et al.
Pubblicazione: (2024)
di: Zhang, Runyu, et al.
Pubblicazione: (2024)
Neural Collapse versus Low-rank Bias: Is Deep Neural Collapse Really Optimal?
di: Súkeník, Peter, et al.
Pubblicazione: (2024)
di: Súkeník, Peter, et al.
Pubblicazione: (2024)
Guarantees of a Preconditioned Subgradient Algorithm for Overparameterized Asymmetric Low-rank Matrix Recovery
di: Giampouras, Paris, et al.
Pubblicazione: (2024)
di: Giampouras, Paris, et al.
Pubblicazione: (2024)
Statistical Robustness of Interval CVaR Based Regression Models under Perturbation and Contamination
di: You, Yulei, et al.
Pubblicazione: (2026)
di: You, Yulei, et al.
Pubblicazione: (2026)
MLorc: Momentum Low-rank Compression for Memory Efficient Large Language Model Adaptation
di: Shen, Wei, et al.
Pubblicazione: (2025)
di: Shen, Wei, et al.
Pubblicazione: (2025)
Quantizer Design for Finite Model Approximations, Model Learning, and Quantized Q-Learning for MDPs with Unbounded Spaces
di: Bicer, Osman, et al.
Pubblicazione: (2025)
di: Bicer, Osman, et al.
Pubblicazione: (2025)
Weighted Low-rank Approximation via Stochastic Gradient Descent on Manifolds
di: Xu, Conglong, et al.
Pubblicazione: (2025)
di: Xu, Conglong, et al.
Pubblicazione: (2025)
Representative Action Selection for Large Action Space: From Bandits to MDPs
di: Zhou, Quan, et al.
Pubblicazione: (2025)
di: Zhou, Quan, et al.
Pubblicazione: (2025)
Probabilistic Safety Guarantee for Stochastic Control Systems Using Average Reward MDPs
di: Omidi, Saber, et al.
Pubblicazione: (2025)
di: Omidi, Saber, et al.
Pubblicazione: (2025)
Stability Evaluation via Distributional Perturbation Analysis
di: Blanchet, Jose, et al.
Pubblicazione: (2024)
di: Blanchet, Jose, et al.
Pubblicazione: (2024)
Curse of Dimensionality in Neural Network Optimization
di: Na, Sanghoon, et al.
Pubblicazione: (2025)
di: Na, Sanghoon, et al.
Pubblicazione: (2025)
Optimal Variance-Dependent Regret Bounds for Infinite-Horizon MDPs
di: Zamir, Guy, et al.
Pubblicazione: (2026)
di: Zamir, Guy, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Soft Robust MDPs and Risk-Sensitive MDPs: Equivalence, Policy Gradient, and Sample Complexity
di: Zhang, Runyu, et al.
Pubblicazione: (2023) -
Stochastic Nonlinear Control via Finite-dimensional Spectral Dynamic Embedding
di: Ren, Zhaolin, et al.
Pubblicazione: (2023) -
Scalable spectral representations for multi-agent reinforcement learning in network MDPs
di: Ren, Zhaolin, et al.
Pubblicazione: (2024) -
Distributed Thompson sampling under constrained communication
di: Zerefa, Saba, et al.
Pubblicazione: (2024) -
Efficient Model-Free Exploration in Low-Rank MDPs
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2023)