Reinforcement Learning under Latent Dynamics: Toward Statistical and Algorithmic Modularity
Fuente:
arXiv
Salvato in:
| Autori principali: | Amortila, Philip, Foster, Dylan J., Jiang, Nan, Krishnamurthy, Akshay, Mhammedi, Zakaria |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scalable Online Exploration via Coverability
di: Amortila, Philip, et al.
Pubblicazione: (2024)
di: Amortila, Philip, et al.
Pubblicazione: (2024)
Mitigating Covariate Shift in Misspecified Regression with Applications to Reinforcement Learning
di: Amortila, Philip, et al.
Pubblicazione: (2024)
di: Amortila, Philip, et al.
Pubblicazione: (2024)
Online Convex Optimization with a Separation Oracle
di: Mhammedi, Zakaria
Pubblicazione: (2024)
di: Mhammedi, Zakaria
Pubblicazione: (2024)
Efficient Model-Free Exploration in Low-Rank MDPs
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2023)
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2023)
Fully Unconstrained Online Learning
di: Cutkosky, Ashok, et al.
Pubblicazione: (2024)
di: Cutkosky, Ashok, et al.
Pubblicazione: (2024)
The Power of Resets in Online Reinforcement Learning
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2024)
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2024)
A Unifying View of Coverage in Linear Off-Policy Evaluation
di: Amortila, Philip, et al.
Pubblicazione: (2026)
di: Amortila, Philip, et al.
Pubblicazione: (2026)
Adaptive Matrix Online Learning through Smoothing with Guarantees for Nonsmooth Nonconvex Optimization
di: Jiang, Ruichen, et al.
Pubblicazione: (2026)
di: Jiang, Ruichen, et al.
Pubblicazione: (2026)
Statistical and Algorithmic Foundations of Reinforcement Learning
di: Chi, Yuejie, et al.
Pubblicazione: (2025)
di: Chi, Yuejie, et al.
Pubblicazione: (2025)
Sample and Oracle Efficient Reinforcement Learning for MDPs with Linearly-Realizable Value Functions
di: Mhammedi, Zakaria
Pubblicazione: (2024)
di: Mhammedi, Zakaria
Pubblicazione: (2024)
Is a Good Foundation Necessary for Efficient Reinforcement Learning? The Computational Role of the Base Model in Exploration
di: Foster, Dylan J., et al.
Pubblicazione: (2025)
di: Foster, Dylan J., et al.
Pubblicazione: (2025)
Accelerating Cutting-Plane Algorithms via Reinforcement Learning Surrogates
di: Mana, Kyle, et al.
Pubblicazione: (2023)
di: Mana, Kyle, et al.
Pubblicazione: (2023)
Deep Reinforcement Learning for Traveling Purchaser Problems
di: Yuan, Haofeng, et al.
Pubblicazione: (2024)
di: Yuan, Haofeng, et al.
Pubblicazione: (2024)
Faster Reinforcement Learning by Freezing Slow States
di: Wang, Yijia, et al.
Pubblicazione: (2023)
di: Wang, Yijia, et al.
Pubblicazione: (2023)
DR-SAC: Distributionally Robust Soft Actor-Critic for Reinforcement Learning under Uncertainty
di: Cui, Mingxuan, et al.
Pubblicazione: (2025)
di: Cui, Mingxuan, et al.
Pubblicazione: (2025)
Closing the Loop: Coordinating Inventory and Recommendation via Deep Reinforcement Learning on Multiple Timescales
di: Jiang, Jinyang, et al.
Pubblicazione: (2025)
di: Jiang, Jinyang, et al.
Pubblicazione: (2025)
AI2STOW: End-to-End Deep Reinforcement Learning to Construct Master Stowage Plans under Demand Uncertainty
di: Van Twiller, Jaike, et al.
Pubblicazione: (2025)
di: Van Twiller, Jaike, et al.
Pubblicazione: (2025)
R2L: Reliable Reinforcement Learning: Guaranteed Return & Reliable Policies in Reinforcement Learning
di: Farhi, Nadir
Pubblicazione: (2025)
di: Farhi, Nadir
Pubblicazione: (2025)
A Bit of Freedom Goes a Long Way: Classical and Quantum Algorithms for Reinforcement Learning under a Generative Model
di: Ambainis, Andris, et al.
Pubblicazione: (2025)
di: Ambainis, Andris, et al.
Pubblicazione: (2025)
Agentic Transformers Provably Learn to Search via Reinforcement Learning
di: Yang, Tong, et al.
Pubblicazione: (2026)
di: Yang, Tong, et al.
Pubblicazione: (2026)
Solving Integrated Process Planning and Scheduling Problem via Graph Neural Network Based Deep Reinforcement Learning
di: Li, Hongpei, et al.
Pubblicazione: (2024)
di: Li, Hongpei, et al.
Pubblicazione: (2024)
Contextual Bilevel Reinforcement Learning for Incentive Alignment
di: Thoma, Vinzenz, et al.
Pubblicazione: (2024)
di: Thoma, Vinzenz, et al.
Pubblicazione: (2024)
Adaptive Primal-Dual Method for Safe Reinforcement Learning
di: Chen, Weiqin, et al.
Pubblicazione: (2024)
di: Chen, Weiqin, et al.
Pubblicazione: (2024)
Performative Policy Gradient: Optimality in Performative Reinforcement Learning
di: Basu, Debabrota, et al.
Pubblicazione: (2025)
di: Basu, Debabrota, et al.
Pubblicazione: (2025)
Reinforcement Learning for Multi-Truck Vehicle Routing Problems
di: Levin, Joshua, et al.
Pubblicazione: (2022)
di: Levin, Joshua, et al.
Pubblicazione: (2022)
Hyperparameter Optimization for Driving Strategies Based on Reinforcement Learning
di: Adde, Nihal Acharya, et al.
Pubblicazione: (2024)
di: Adde, Nihal Acharya, et al.
Pubblicazione: (2024)
Combining Reinforcement Learning and Optimal Transport for the Traveling Salesman Problem
di: Goh, Yong Liang, et al.
Pubblicazione: (2022)
di: Goh, Yong Liang, et al.
Pubblicazione: (2022)
Deterministic Policy Gradient for Reinforcement Learning with Continuous Time and State
di: Cheng, Ziheng, et al.
Pubblicazione: (2025)
di: Cheng, Ziheng, et al.
Pubblicazione: (2025)
Temporal Difference Learning with Compressed Updates: Error-Feedback meets Reinforcement Learning
di: Mitra, Aritra, et al.
Pubblicazione: (2023)
di: Mitra, Aritra, et al.
Pubblicazione: (2023)
Deep Reinforcement Learning for Solving the Fleet Size and Mix Vehicle Routing Problem
di: Wan, Pengfu, et al.
Pubblicazione: (2025)
di: Wan, Pengfu, et al.
Pubblicazione: (2025)
Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence
di: Xiao, Minheng, et al.
Pubblicazione: (2024)
di: Xiao, Minheng, et al.
Pubblicazione: (2024)
Robust Reinforcement Learning in Finance: Modeling Market Impact with Elliptic Uncertainty Sets
di: Ma, Shaocong, et al.
Pubblicazione: (2025)
di: Ma, Shaocong, et al.
Pubblicazione: (2025)
Generative AI and Process Systems Engineering: The Next Frontier
di: Decardi-Nelson, Benjamin, et al.
Pubblicazione: (2024)
di: Decardi-Nelson, Benjamin, et al.
Pubblicazione: (2024)
Joint Problems in Learning Multiple Dynamical Systems
di: Niu, Mengjia, et al.
Pubblicazione: (2023)
di: Niu, Mengjia, et al.
Pubblicazione: (2023)
Action Dependency Graphs for Globally Optimal Coordinated Reinforcement Learning
di: Ding, Jianglin, et al.
Pubblicazione: (2025)
di: Ding, Jianglin, et al.
Pubblicazione: (2025)
Solving Truly Massive Budgeted Monotonic POMDPs with Oracle-Guided Meta-Reinforcement Learning
di: Vora, Manav, et al.
Pubblicazione: (2024)
di: Vora, Manav, et al.
Pubblicazione: (2024)
Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning
di: Zhao, Hanyang, et al.
Pubblicazione: (2025)
di: Zhao, Hanyang, et al.
Pubblicazione: (2025)
Robust Evolutionary Multi-Objective Network Architecture Search for Reinforcement Learning (EMNAS-RL)
di: Adde, Nihal Acharya, et al.
Pubblicazione: (2025)
di: Adde, Nihal Acharya, et al.
Pubblicazione: (2025)
Robust $Q$-learning Algorithm for Markov Decision Processes under Wasserstein Uncertainty
di: Neufeld, Ariel, et al.
Pubblicazione: (2022)
di: Neufeld, Ariel, et al.
Pubblicazione: (2022)
The Implicit Curriculum: Learning Dynamics in RL with Verifiable Rewards
di: Huang, Yu, et al.
Pubblicazione: (2026)
di: Huang, Yu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Scalable Online Exploration via Coverability
di: Amortila, Philip, et al.
Pubblicazione: (2024) -
Mitigating Covariate Shift in Misspecified Regression with Applications to Reinforcement Learning
di: Amortila, Philip, et al.
Pubblicazione: (2024) -
Online Convex Optimization with a Separation Oracle
di: Mhammedi, Zakaria
Pubblicazione: (2024) -
Efficient Model-Free Exploration in Low-Rank MDPs
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2023) -
Fully Unconstrained Online Learning
di: Cutkosky, Ashok, et al.
Pubblicazione: (2024)