Towards Minimax Optimality of Model-based Robust Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Clavier, Pierre, Pennec, Erwan Le, Geist, Matthieu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bootstrapping Expectiles in Reinforcement Learning
di: Clavier, Pierre, et al.
Pubblicazione: (2024)
di: Clavier, Pierre, et al.
Pubblicazione: (2024)
RRLS : Robust Reinforcement Learning Suite
di: Zouitine, Adil, et al.
Pubblicazione: (2024)
di: Zouitine, Adil, et al.
Pubblicazione: (2024)
Time-Constrained Robust MDPs
di: Zouitine, Adil, et al.
Pubblicazione: (2024)
di: Zouitine, Adil, et al.
Pubblicazione: (2024)
Minimax-Optimal Multi-Agent Robust Reinforcement Learning
di: Jiao, Yuchen, et al.
Pubblicazione: (2024)
di: Jiao, Yuchen, et al.
Pubblicazione: (2024)
The Curious Price of Distributional Robustness in Reinforcement Learning with a Generative Model
di: Shi, Laixi, et al.
Pubblicazione: (2023)
di: Shi, Laixi, et al.
Pubblicazione: (2023)
Minimax Optimal Reinforcement Learning with Quasi-Optimism
di: Lee, Harin, et al.
Pubblicazione: (2025)
di: Lee, Harin, et al.
Pubblicazione: (2025)
Near-Minimax-Optimal Distributional Reinforcement Learning with a Generative Model
di: Rowland, Mark, et al.
Pubblicazione: (2024)
di: Rowland, Mark, et al.
Pubblicazione: (2024)
Minimax Optimal and Computationally Efficient Algorithms for Distributionally Robust Offline Reinforcement Learning
di: Liu, Zhishuai, et al.
Pubblicazione: (2024)
di: Liu, Zhishuai, et al.
Pubblicazione: (2024)
Periodic agent-state based Q-learning for POMDPs
di: Sinha, Amit, et al.
Pubblicazione: (2024)
di: Sinha, Amit, et al.
Pubblicazione: (2024)
Convergence of regularized agent-state-based Q-learning in POMDPs
di: Sinha, Amit, et al.
Pubblicazione: (2025)
di: Sinha, Amit, et al.
Pubblicazione: (2025)
Minimax Optimal Strategy for Delayed Observations in Online Reinforcement Learning
di: Lee, Harin, et al.
Pubblicazione: (2026)
di: Lee, Harin, et al.
Pubblicazione: (2026)
Closing the Gap between TD Learning and Supervised Learning -- A Generalisation Point of View
di: Ghugare, Raj, et al.
Pubblicazione: (2024)
di: Ghugare, Raj, et al.
Pubblicazione: (2024)
Solving robust MDPs as a sequence of static RL problems
di: Zouitine, Adil, et al.
Pubblicazione: (2024)
di: Zouitine, Adil, et al.
Pubblicazione: (2024)
Minimax-Optimal Reward-Agnostic Exploration in Reinforcement Learning
di: Li, Gen, et al.
Pubblicazione: (2023)
di: Li, Gen, et al.
Pubblicazione: (2023)
Gap-Dependent Bounds for Nearly Minimax Optimal Reinforcement Learning with Linear Function Approximation
di: Zhang, Haochen, et al.
Pubblicazione: (2026)
di: Zhang, Haochen, et al.
Pubblicazione: (2026)
ShiQ: Bringing back Bellman to LLMs
di: Clavier, Pierre, et al.
Pubblicazione: (2025)
di: Clavier, Pierre, et al.
Pubblicazione: (2025)
Minimax Optimal Q Learning with Nearest Neighbors
di: Zhao, Puning, et al.
Pubblicazione: (2023)
di: Zhao, Puning, et al.
Pubblicazione: (2023)
VITS : Variational Inference Thompson Sampling for contextual bandits
di: Clavier, Pierre, et al.
Pubblicazione: (2023)
di: Clavier, Pierre, et al.
Pubblicazione: (2023)
Learning Equilibria from Data: Provably Efficient Multi-Agent Imitation Learning
di: Freihaut, Till, et al.
Pubblicazione: (2025)
di: Freihaut, Till, et al.
Pubblicazione: (2025)
Self-Improving Robust Preference Optimization
di: Choi, Eugene, et al.
Pubblicazione: (2024)
di: Choi, Eugene, et al.
Pubblicazione: (2024)
Population-aware Online Mirror Descent for Mean-Field Games with Common Noise by Deep Reinforcement Learning
di: Wu, Zida, et al.
Pubblicazione: (2025)
di: Wu, Zida, et al.
Pubblicazione: (2025)
Towards Optimal Adversarial Robust Reinforcement Learning with Infinity Measurement Error
di: Li, Haoran, et al.
Pubblicazione: (2025)
di: Li, Haoran, et al.
Pubblicazione: (2025)
Corruption-Robust Linear Bandits: Minimax Optimality and Gap-Dependent Misspecification
di: Liu, Haolin, et al.
Pubblicazione: (2024)
di: Liu, Haolin, et al.
Pubblicazione: (2024)
Nested subspace learning with flags
di: Szwagier, Tom, et al.
Pubblicazione: (2025)
di: Szwagier, Tom, et al.
Pubblicazione: (2025)
A Survey of Temporal Credit Assignment in Deep Reinforcement Learning
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2023)
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2023)
Minimax Optimal Variance-Aware Regret Bounds for Multinomial Logistic MDPs
di: Boudart, Pierre, et al.
Pubblicazione: (2026)
di: Boudart, Pierre, et al.
Pubblicazione: (2026)
Toward Finding Strong Pareto Optimal Policies in Multi-Agent Reinforcement Learning
di: Le, Bang Giang, et al.
Pubblicazione: (2024)
di: Le, Bang Giang, et al.
Pubblicazione: (2024)
Information-Theoretic Minimax Regret Bounds for Reinforcement Learning based on Duality
di: Bongole, Raghav, et al.
Pubblicazione: (2024)
di: Bongole, Raghav, et al.
Pubblicazione: (2024)
Enjoying Non-linearity in Multinomial Logistic Bandits: A Minimax-Optimal Algorithm
di: Boudart, Pierre, et al.
Pubblicazione: (2025)
di: Boudart, Pierre, et al.
Pubblicazione: (2025)
Space Robotics Bench: Robot Learning Beyond Earth
di: Orsula, Andrej, et al.
Pubblicazione: (2025)
di: Orsula, Andrej, et al.
Pubblicazione: (2025)
Minimax Optimality in Contextual Dynamic Pricing with General Valuation Models
di: Gong, Xueping, et al.
Pubblicazione: (2024)
di: Gong, Xueping, et al.
Pubblicazione: (2024)
Leveraging Procedural Generation for Learning Autonomous Peg-in-Hole Assembly in Space
di: Orsula, Andrej, et al.
Pubblicazione: (2024)
di: Orsula, Andrej, et al.
Pubblicazione: (2024)
Learning Tool-Aware Adaptive Compliant Control for Autonomous Regolith Excavation
di: Orsula, Andrej, et al.
Pubblicazione: (2025)
di: Orsula, Andrej, et al.
Pubblicazione: (2025)
Learning from Similar Linear Representations: Adaptivity, Minimaxity, and Robustness
di: Tian, Ye, et al.
Pubblicazione: (2023)
di: Tian, Ye, et al.
Pubblicazione: (2023)
Learning What to Recommend: Minimax Optimal Simple Regret in Logistic Bandits
di: Liu, Shuai, et al.
Pubblicazione: (2026)
di: Liu, Shuai, et al.
Pubblicazione: (2026)
Robust Minimax Boosting with Performance Guarantees
di: Mazuelas, Santiago, et al.
Pubblicazione: (2025)
di: Mazuelas, Santiago, et al.
Pubblicazione: (2025)
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning
di: Chen, Jiayu, et al.
Pubblicazione: (2025)
di: Chen, Jiayu, et al.
Pubblicazione: (2025)
Linear Bandits on Ellipsoids: Minimax Optimal Algorithms
di: Zhang, Raymond, et al.
Pubblicazione: (2025)
di: Zhang, Raymond, et al.
Pubblicazione: (2025)
Transformers are Minimax Optimal Nonparametric In-Context Learners
di: Kim, Juno, et al.
Pubblicazione: (2024)
di: Kim, Juno, et al.
Pubblicazione: (2024)
Tackling Heavy-Tailed Rewards in Reinforcement Learning with Function Approximation: Minimax Optimal and Instance-Dependent Regret Bounds
di: Huang, Jiayi, et al.
Pubblicazione: (2023)
di: Huang, Jiayi, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Bootstrapping Expectiles in Reinforcement Learning
di: Clavier, Pierre, et al.
Pubblicazione: (2024) -
RRLS : Robust Reinforcement Learning Suite
di: Zouitine, Adil, et al.
Pubblicazione: (2024) -
Time-Constrained Robust MDPs
di: Zouitine, Adil, et al.
Pubblicazione: (2024) -
Minimax-Optimal Multi-Agent Robust Reinforcement Learning
di: Jiao, Yuchen, et al.
Pubblicazione: (2024) -
The Curious Price of Distributional Robustness in Reinforcement Learning with a Generative Model
di: Shi, Laixi, et al.
Pubblicazione: (2023)