Reinforcement Learning from Partial Observation: Linear Function Approximation with Provable Sample Efficiency
Fuente:
arXiv
Salvato in:
| Autori principali: | Cai, Qi, Yang, Zhuoran, Wang, Zhaoran |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Provably Efficient Exploration in Policy Optimization
di: Cai, Qi, et al.
Pubblicazione: (2019)
di: Cai, Qi, et al.
Pubblicazione: (2019)
Embed to Control Partially Observed Systems: Representation Learning with Provable Sample Efficiency
di: Wang, Lingxiao, et al.
Pubblicazione: (2022)
di: Wang, Lingxiao, et al.
Pubblicazione: (2022)
Can Temporal-Difference and Q-Learning Learn Representation? A Mean-Field Theory
di: Zhang, Yufeng, et al.
Pubblicazione: (2020)
di: Zhang, Yufeng, et al.
Pubblicazione: (2020)
Double Duality: Variational Primal-Dual Policy Optimization for Constrained Reinforcement Learning
di: Li, Zihao, et al.
Pubblicazione: (2024)
di: Li, Zihao, et al.
Pubblicazione: (2024)
A Mean-Field Analysis of Neural Stochastic Gradient Descent-Ascent for Functional Minimax Optimization
di: Zhu, Yuchen, et al.
Pubblicazione: (2024)
di: Zhu, Yuchen, et al.
Pubblicazione: (2024)
Provably Efficient Infinite-Horizon Average-Reward Reinforcement Learning with Linear Function Approximation
di: Chae, Woojin, et al.
Pubblicazione: (2024)
di: Chae, Woojin, et al.
Pubblicazione: (2024)
Wasserstein Flow Meets Replicator Dynamics: A Mean-Field Analysis of Representation Learning in Actor-Critic
di: Zhang, Yufeng, et al.
Pubblicazione: (2021)
di: Zhang, Yufeng, et al.
Pubblicazione: (2021)
Variational Transport: A Convergent Particle-BasedAlgorithm for Distributional Optimization
di: Yang, Zhuoran, et al.
Pubblicazione: (2020)
di: Yang, Zhuoran, et al.
Pubblicazione: (2020)
Learning Dynamic Mechanisms in Unknown Environments: A Reinforcement Learning Approach
di: Qiu, Shuang, et al.
Pubblicazione: (2022)
di: Qiu, Shuang, et al.
Pubblicazione: (2022)
Sample Efficient Reinforcement Learning with Partial Dynamics Knowledge
di: Alharbi, Meshal, et al.
Pubblicazione: (2023)
di: Alharbi, Meshal, et al.
Pubblicazione: (2023)
Principled Penalty-based Methods for Bilevel Reinforcement Learning and RLHF
di: Shen, Han, et al.
Pubblicazione: (2024)
di: Shen, Han, et al.
Pubblicazione: (2024)
Reinforcement Learning with Function Approximation for Non-Markov Processes
di: Kara, Ali Devran
Pubblicazione: (2026)
di: Kara, Ali Devran
Pubblicazione: (2026)
Federated Temporal Difference Learning with Linear Function Approximation under Environmental Heterogeneity
di: Wang, Han, et al.
Pubblicazione: (2023)
di: Wang, Han, et al.
Pubblicazione: (2023)
Unveiling Induction Heads: Provable Training Dynamics and Feature Learning in Transformers
di: Chen, Siyu, et al.
Pubblicazione: (2024)
di: Chen, Siyu, et al.
Pubblicazione: (2024)
Infinite-Horizon Reinforcement Learning with Multinomial Logistic Function Approximation
di: Park, Jaehyun, et al.
Pubblicazione: (2024)
di: Park, Jaehyun, et al.
Pubblicazione: (2024)
Traversing Pareto Optimal Policies: Provably Efficient Multi-Objective Reinforcement Learning
di: Qiu, Shuang, et al.
Pubblicazione: (2024)
di: Qiu, Shuang, et al.
Pubblicazione: (2024)
Sample Complexity of the Linear Quadratic Regulator: A Reinforcement Learning Lens
di: Moghaddam, Amirreza Neshaei, et al.
Pubblicazione: (2024)
di: Moghaddam, Amirreza Neshaei, et al.
Pubblicazione: (2024)
Provably Safe Generative Sampling with Constricting Barrier Functions
di: Gadginmath, Darshan, et al.
Pubblicazione: (2026)
di: Gadginmath, Darshan, et al.
Pubblicazione: (2026)
A Simple Finite-Time Analysis of TD Learning with Linear Function Approximation
di: Mitra, Aritra
Pubblicazione: (2024)
di: Mitra, Aritra
Pubblicazione: (2024)
Provably Convergent Federated Trilevel Learning
di: Jiao, Yang, et al.
Pubblicazione: (2023)
di: Jiao, Yang, et al.
Pubblicazione: (2023)
Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
di: Cayci, Semih, et al.
Pubblicazione: (2021)
di: Cayci, Semih, et al.
Pubblicazione: (2021)
Agentic Transformers Provably Learn to Search via Reinforcement Learning
di: Yang, Tong, et al.
Pubblicazione: (2026)
di: Yang, Tong, et al.
Pubblicazione: (2026)
Learning Linear Dynamics from Bilinear Observations
di: Sattar, Yahya, et al.
Pubblicazione: (2024)
di: Sattar, Yahya, et al.
Pubblicazione: (2024)
SpectraLDS: Provable Distillation for Linear Dynamical Systems
di: Shah, Devan, et al.
Pubblicazione: (2025)
di: Shah, Devan, et al.
Pubblicazione: (2025)
A Nearly Optimal and Low-Switching Algorithm for Reinforcement Learning with General Function Approximation
di: Zhao, Heyang, et al.
Pubblicazione: (2023)
di: Zhao, Heyang, et al.
Pubblicazione: (2023)
A Finite-Time Analysis of TD Learning with Linear Function Approximation without Projections or Strong Convexity
di: Lee, Wei-Cheng, et al.
Pubblicazione: (2025)
di: Lee, Wei-Cheng, et al.
Pubblicazione: (2025)
Provable Acceleration of Nesterov's Accelerated Gradient for Rectangular Matrix Factorization and Linear Neural Networks
di: Xu, Zhenghao, et al.
Pubblicazione: (2024)
di: Xu, Zhenghao, et al.
Pubblicazione: (2024)
Population Dynamics Control with Partial Observations
di: Lu, Zhou, et al.
Pubblicazione: (2025)
di: Lu, Zhou, et al.
Pubblicazione: (2025)
Provably Faster Algorithms for Bilevel Optimization via Without-Replacement Sampling
di: Li, Junyi, et al.
Pubblicazione: (2024)
di: Li, Junyi, et al.
Pubblicazione: (2024)
MGDA Converges under Generalized Smoothness, Provably
di: Zhang, Qi, et al.
Pubblicazione: (2024)
di: Zhang, Qi, et al.
Pubblicazione: (2024)
Linear Partial Gromov-Wasserstein Embedding
di: Bai, Yikun, et al.
Pubblicazione: (2024)
di: Bai, Yikun, et al.
Pubblicazione: (2024)
Linear Optimal Partial Transport Embedding
di: Bai, Yikun, et al.
Pubblicazione: (2023)
di: Bai, Yikun, et al.
Pubblicazione: (2023)
On the Linear Speedup of Personalized Federated Reinforcement Learning with Shared Representations
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
Sample Complexity of Distributionally Robust Average-Reward Reinforcement Learning
di: Chen, Zijun, et al.
Pubblicazione: (2025)
di: Chen, Zijun, et al.
Pubblicazione: (2025)
Gaussian Approximation and Multiplier Bootstrap for Federated Linear Stochastic Approximation
di: Levin, Ilya, et al.
Pubblicazione: (2026)
di: Levin, Ilya, et al.
Pubblicazione: (2026)
SCAFFLSA: Taming Heterogeneity in Federated Linear Stochastic Approximation and TD Learning
di: Mangold, Paul, et al.
Pubblicazione: (2024)
di: Mangold, Paul, et al.
Pubblicazione: (2024)
Global Optimization of Gaussian Process Acquisition Functions Using a Piecewise-Linear Kernel Approximation
di: Xie, Yilin, et al.
Pubblicazione: (2024)
di: Xie, Yilin, et al.
Pubblicazione: (2024)
Learning Provably Improves the Convergence of Gradient Descent
di: Song, Qingyu, et al.
Pubblicazione: (2025)
di: Song, Qingyu, et al.
Pubblicazione: (2025)
Provable Mixed-Noise Learning with Flow-Matching
di: Hagemann, Paul, et al.
Pubblicazione: (2025)
di: Hagemann, Paul, et al.
Pubblicazione: (2025)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Provably Efficient Exploration in Policy Optimization
di: Cai, Qi, et al.
Pubblicazione: (2019) -
Embed to Control Partially Observed Systems: Representation Learning with Provable Sample Efficiency
di: Wang, Lingxiao, et al.
Pubblicazione: (2022) -
Can Temporal-Difference and Q-Learning Learn Representation? A Mean-Field Theory
di: Zhang, Yufeng, et al.
Pubblicazione: (2020) -
Double Duality: Variational Primal-Dual Policy Optimization for Constrained Reinforcement Learning
di: Li, Zihao, et al.
Pubblicazione: (2024) -
A Mean-Field Analysis of Neural Stochastic Gradient Descent-Ascent for Functional Minimax Optimization
di: Zhu, Yuchen, et al.
Pubblicazione: (2024)