Salvato in:
| Autori principali: | Liang, Hao, Cheng, Jiayu, Sinclair, Sean R., Du, Yali |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2601.20694 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Exploiting Exogenous Structure for Sample-Efficient Reinforcement Learning
di: Wan, Jia, et al.
Pubblicazione: (2024)
di: Wan, Jia, et al.
Pubblicazione: (2024)
Sample Complexity Characterization for Linear Contextual MDPs
di: Deng, Junze, et al.
Pubblicazione: (2024)
di: Deng, Junze, et al.
Pubblicazione: (2024)
Reinforcement Learning in MDPs with Information-Ordered Policies
di: Zhang, Zhongjun, et al.
Pubblicazione: (2025)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2025)
Reinforcement Learning for Infinite-Horizon Average-Reward Linear MDPs via Approximation by Discounted-Reward MDPs
di: Hong, Kihyuk, et al.
Pubblicazione: (2024)
di: Hong, Kihyuk, et al.
Pubblicazione: (2024)
Provably Efficient RL under Episode-Wise Safety in Constrained MDPs with Linear Function Approximation
di: Kitamura, Toshinori, et al.
Pubblicazione: (2025)
di: Kitamura, Toshinori, et al.
Pubblicazione: (2025)
Two-Timescale Critic-Actor for Average Reward MDPs with Function Approximation
di: Panda, Prashansa, et al.
Pubblicazione: (2024)
di: Panda, Prashansa, et al.
Pubblicazione: (2024)
Offline Oracle-Efficient Learning for Contextual MDPs via Layerwise Exploration-Exploitation Tradeoff
di: Qian, Jian, et al.
Pubblicazione: (2024)
di: Qian, Jian, et al.
Pubblicazione: (2024)
Near-Optimal Regret for Policy Optimization in Contextual MDPs with General Offline Function Approximation
di: Levy, Orin, et al.
Pubblicazione: (2026)
di: Levy, Orin, et al.
Pubblicazione: (2026)
Sample-efficient Learning of Infinite-horizon Average-reward MDPs with General Function Approximation
di: He, Jianliang, et al.
Pubblicazione: (2024)
di: He, Jianliang, et al.
Pubblicazione: (2024)
Exogenous Isomorphism for Counterfactual Identifiability
di: Chen, Yikang, et al.
Pubblicazione: (2025)
di: Chen, Yikang, et al.
Pubblicazione: (2025)
The Data-Driven Censored Newsvendor Problem
di: Hssaine, Chamsi, et al.
Pubblicazione: (2024)
di: Hssaine, Chamsi, et al.
Pubblicazione: (2024)
Sample and Oracle Efficient Reinforcement Learning for MDPs with Linearly-Realizable Value Functions
di: Mhammedi, Zakaria
Pubblicazione: (2024)
di: Mhammedi, Zakaria
Pubblicazione: (2024)
Demystifying Linear MDPs and Novel Dynamics Aggregation Framework
di: Lee, Joongkyu, et al.
Pubblicazione: (2024)
di: Lee, Joongkyu, et al.
Pubblicazione: (2024)
Misspecified $Q$-Learning with Sparse Linear Function Approximation: Tight Bounds on Approximation Error
di: Du, Ally Yalei, et al.
Pubblicazione: (2024)
di: Du, Ally Yalei, et al.
Pubblicazione: (2024)
Nonstationary Reinforcement Learning with Linear Function Approximation
di: Zhou, Huozhi, et al.
Pubblicazione: (2020)
di: Zhou, Huozhi, et al.
Pubblicazione: (2020)
Local Linearity: the Key for No-regret Reinforcement Learning in Continuous MDPs
di: Maran, Davide, et al.
Pubblicazione: (2024)
di: Maran, Davide, et al.
Pubblicazione: (2024)
Near-Optimal Dynamic Regret for Adversarial Linear Mixture MDPs
di: Li, Long-Fei, et al.
Pubblicazione: (2024)
di: Li, Long-Fei, et al.
Pubblicazione: (2024)
Near-Optimal Regret in Linear MDPs with Aggregate Bandit Feedback
di: Cassel, Asaf, et al.
Pubblicazione: (2024)
di: Cassel, Asaf, et al.
Pubblicazione: (2024)
Imitation Learning in Discounted Linear MDPs without exploration assumptions
di: Viano, Luca, et al.
Pubblicazione: (2024)
di: Viano, Luca, et al.
Pubblicazione: (2024)
Causality Meets Locality: Provably Generalizable and Scalable Policy Learning for Networked Systems
di: Liang, Hao, et al.
Pubblicazione: (2025)
di: Liang, Hao, et al.
Pubblicazione: (2025)
Invariant Learning via Probability of Sufficient and Necessary Causes
di: Yang, Mengyue, et al.
Pubblicazione: (2023)
di: Yang, Mengyue, et al.
Pubblicazione: (2023)
Refined Sample Complexity for Markov Games with Independent Linear Function Approximation
di: Dai, Yan, et al.
Pubblicazione: (2024)
di: Dai, Yan, et al.
Pubblicazione: (2024)
Addressing Finite-Horizon MDPs via Low-Rank Tensor Value Approximation
di: Rozada, Sergio, et al.
Pubblicazione: (2025)
di: Rozada, Sergio, et al.
Pubblicazione: (2025)
Sample Complexity Bounds for Linear Constrained MDPs with a Generative Model
di: Liu, Xingtu, et al.
Pubblicazione: (2025)
di: Liu, Xingtu, et al.
Pubblicazione: (2025)
Hybrid Reinforcement Learning Breaks Sample Size Barriers in Linear MDPs
di: Tan, Kevin, et al.
Pubblicazione: (2024)
di: Tan, Kevin, et al.
Pubblicazione: (2024)
CrossLinear: Plug-and-Play Cross-Correlation Embedding for Time Series Forecasting with Exogenous Variables
di: Zhou, Pengfei, et al.
Pubblicazione: (2025)
di: Zhou, Pengfei, et al.
Pubblicazione: (2025)
Exogenous Matching: Learning Good Proposals for Tractable Counterfactual Estimation
di: Chen, Yikang, et al.
Pubblicazione: (2024)
di: Chen, Yikang, et al.
Pubblicazione: (2024)
Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
di: Cayci, Semih, et al.
Pubblicazione: (2021)
di: Cayci, Semih, et al.
Pubblicazione: (2021)
Select, then Balance: Exploring Exogenous Variable Modeling of Spatio-Temporal Forecasting
di: Chen, Wei, et al.
Pubblicazione: (2025)
di: Chen, Wei, et al.
Pubblicazione: (2025)
Replicable Reinforcement Learning with Linear Function Approximation
di: Eaton, Eric, et al.
Pubblicazione: (2025)
di: Eaton, Eric, et al.
Pubblicazione: (2025)
Pure Exploration in Bandits with Linear Constraints
di: Carlsson, Emil, et al.
Pubblicazione: (2023)
di: Carlsson, Emil, et al.
Pubblicazione: (2023)
End-to-End Efficient RL for Linear Bellman Complete MDPs with Deterministic Transitions
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2026)
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2026)
A Primal-Dual Algorithm for Offline Constrained Reinforcement Learning with Linear MDPs
di: Hong, Kihyuk, et al.
Pubblicazione: (2024)
di: Hong, Kihyuk, et al.
Pubblicazione: (2024)
Improved Algorithm for Adversarial Linear Mixture MDPs with Bandit Feedback and Unknown Transition
di: Li, Long-Fei, et al.
Pubblicazione: (2024)
di: Li, Long-Fei, et al.
Pubblicazione: (2024)
Non-Stationary Inventory Control with Lead Times
di: Amiri, Nele H., et al.
Pubblicazione: (2026)
di: Amiri, Nele H., et al.
Pubblicazione: (2026)
Towards Optimal Differentially Private Regret Bounds in Linear MDPs
di: Sahu, Sharan
Pubblicazione: (2025)
di: Sahu, Sharan
Pubblicazione: (2025)
Efficient, Low-Regret, Online Reinforcement Learning for Linear MDPs
di: John, Philips George, et al.
Pubblicazione: (2024)
di: John, Philips George, et al.
Pubblicazione: (2024)
Deep Neural Networks are Adaptive to Function Regularity and Data Distribution in Approximation and Estimation
di: Liu, Hao, et al.
Pubblicazione: (2024)
di: Liu, Hao, et al.
Pubblicazione: (2024)
Optimal Horizon-Free Reward-Free Exploration for Linear Mixture MDPs
di: Zhang, Junkai, et al.
Pubblicazione: (2023)
di: Zhang, Junkai, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026) -
Exploiting Exogenous Structure for Sample-Efficient Reinforcement Learning
di: Wan, Jia, et al.
Pubblicazione: (2024) -
Sample Complexity Characterization for Linear Contextual MDPs
di: Deng, Junze, et al.
Pubblicazione: (2024) -
Reinforcement Learning in MDPs with Information-Ordered Policies
di: Zhang, Zhongjun, et al.
Pubblicazione: (2025) -
Reinforcement Learning for Infinite-Horizon Average-Reward Linear MDPs via Approximation by Discounted-Reward MDPs
di: Hong, Kihyuk, et al.
Pubblicazione: (2024)