Provably Sample-Efficient Robust Reinforcement Learning with Average Reward
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Roch, Zachary, Zhang, Chi, Atia, George, Wang, Yue |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
CADENT: Gated Hybrid Distillation for Sample-Efficient Transfer in Reinforcement Learning
von: Alinejad, Mahyar, et al.
Veröffentlicht: (2026)
von: Alinejad, Mahyar, et al.
Veröffentlicht: (2026)
Sample-Efficient Distributionally Robust Multi-Agent Reinforcement Learning via Online Interaction
von: Farhat, Zain Ulabedeen, et al.
Veröffentlicht: (2025)
von: Farhat, Zain Ulabedeen, et al.
Veröffentlicht: (2025)
Online Robust Reinforcement Learning with General Function Approximation
von: Ghosh, Debamita, et al.
Veröffentlicht: (2025)
von: Ghosh, Debamita, et al.
Veröffentlicht: (2025)
ORVIT: Near-Optimal Online Distributionally Robust Reinforcement Learning
von: Ghosh, Debamita, et al.
Veröffentlicht: (2025)
von: Ghosh, Debamita, et al.
Veröffentlicht: (2025)
Bayesian Inverse Reinforcement Learning for Non-Markovian Rewards
von: Topper, Noah, et al.
Veröffentlicht: (2024)
von: Topper, Noah, et al.
Veröffentlicht: (2024)
Sample Complexity of Distributionally Robust Average-Reward Reinforcement Learning
von: Chen, Zijun, et al.
Veröffentlicht: (2025)
von: Chen, Zijun, et al.
Veröffentlicht: (2025)
Provably Adaptive Average Reward Reinforcement Learning for Metric Spaces
von: Kar, Avik, et al.
Veröffentlicht: (2024)
von: Kar, Avik, et al.
Veröffentlicht: (2024)
Distributionally Robust Markov Games with Average Reward
von: Roch, Zachary, et al.
Veröffentlicht: (2025)
von: Roch, Zachary, et al.
Veröffentlicht: (2025)
Pessimism Principle Can Be Effective: Towards a Framework for Zero-Shot Transfer Reinforcement Learning
von: Zhang, Chi, et al.
Veröffentlicht: (2025)
von: Zhang, Chi, et al.
Veröffentlicht: (2025)
Finite-Sample Analysis of Policy Evaluation for Robust Average Reward Reinforcement Learning
von: Xu, Yang, et al.
Veröffentlicht: (2025)
von: Xu, Yang, et al.
Veröffentlicht: (2025)
Provably Efficient Infinite-Horizon Average-Reward Reinforcement Learning with Linear Function Approximation
von: Chae, Woojin, et al.
Veröffentlicht: (2024)
von: Chae, Woojin, et al.
Veröffentlicht: (2024)
Sample Complexity of Average-Reward Q-Learning: From Single-agent to Federated Reinforcement Learning
von: Jiao, Yuchen, et al.
Veröffentlicht: (2026)
von: Jiao, Yuchen, et al.
Veröffentlicht: (2026)
Robust Transfer Learning with Side Information
von: Awad, Akram S., et al.
Veröffentlicht: (2026)
von: Awad, Akram S., et al.
Veröffentlicht: (2026)
RLAF: Reinforcement Learning from Automaton Feedback
von: Alinejad, Mahyar, et al.
Veröffentlicht: (2025)
von: Alinejad, Mahyar, et al.
Veröffentlicht: (2025)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
von: Xu, Yang, et al.
Veröffentlicht: (2025)
von: Xu, Yang, et al.
Veröffentlicht: (2025)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
von: Vora, Kevin, et al.
Veröffentlicht: (2025)
von: Vora, Kevin, et al.
Veröffentlicht: (2025)
Provably Efficient Interactive-Grounded Learning with Personalized Reward
von: Zhang, Mengxiao, et al.
Veröffentlicht: (2024)
von: Zhang, Mengxiao, et al.
Veröffentlicht: (2024)
Efficient Exploration in Average-Reward Constrained Reinforcement Learning: Achieving Near-Optimal Regret With Posterior Sampling
von: Provodin, Danil, et al.
Veröffentlicht: (2024)
von: Provodin, Danil, et al.
Veröffentlicht: (2024)
Provably Efficient Exploration in Inverse Constrained Reinforcement Learning
von: Yue, Bo, et al.
Veröffentlicht: (2024)
von: Yue, Bo, et al.
Veröffentlicht: (2024)
Provably Efficient and Agile Randomized Q-Learning
von: Wang, He, et al.
Veröffentlicht: (2025)
von: Wang, He, et al.
Veröffentlicht: (2025)
Provably Efficient Information-Directed Sampling Algorithms for Multi-Agent Reinforcement Learning
von: Zhang, Qiaosheng, et al.
Veröffentlicht: (2024)
von: Zhang, Qiaosheng, et al.
Veröffentlicht: (2024)
Provably Efficient Sample Complexity for Robust CMDP
von: Ganguly, Sourav, et al.
Veröffentlicht: (2025)
von: Ganguly, Sourav, et al.
Veröffentlicht: (2025)
Provable Domain Adaptation for Offline Reinforcement Learning with Limited Samples
von: Chen, Weiqin, et al.
Veröffentlicht: (2024)
von: Chen, Weiqin, et al.
Veröffentlicht: (2024)
Provable Reward-Agnostic Preference-Based Reinforcement Learning
von: Zhan, Wenhao, et al.
Veröffentlicht: (2023)
von: Zhan, Wenhao, et al.
Veröffentlicht: (2023)
Reinforcement Learning for Infinite-Horizon Average-Reward Linear MDPs via Approximation by Discounted-Reward MDPs
von: Hong, Kihyuk, et al.
Veröffentlicht: (2024)
von: Hong, Kihyuk, et al.
Veröffentlicht: (2024)
Provably Robust Federated Reinforcement Learning
von: Fang, Minghong, et al.
Veröffentlicht: (2025)
von: Fang, Minghong, et al.
Veröffentlicht: (2025)
Sample-Efficient Robust Multi-Agent Reinforcement Learning in the Face of Environmental Uncertainty
von: Shi, Laixi, et al.
Veröffentlicht: (2024)
von: Shi, Laixi, et al.
Veröffentlicht: (2024)
Burning RED: Unlocking Subtask-Driven Reinforcement Learning and Risk-Awareness in Average-Reward Markov Decision Processes
von: Rojas, Juan Sebastian, et al.
Veröffentlicht: (2024)
von: Rojas, Juan Sebastian, et al.
Veröffentlicht: (2024)
Provably Efficient Reinforcement Learning with Multinomial Logit Function Approximation
von: Li, Long-Fei, et al.
Veröffentlicht: (2024)
von: Li, Long-Fei, et al.
Veröffentlicht: (2024)
Provable Policy Gradient Methods for Average-Reward Markov Potential Games
von: Cheng, Min, et al.
Veröffentlicht: (2024)
von: Cheng, Min, et al.
Veröffentlicht: (2024)
Provable Multi-Task Reinforcement Learning: A Representation Learning Framework with Low Rank Rewards
von: Guo, Yaoze, et al.
Veröffentlicht: (2026)
von: Guo, Yaoze, et al.
Veröffentlicht: (2026)
Towards Provable Emergence of In-Context Reinforcement Learning
von: Wang, Jiuqi, et al.
Veröffentlicht: (2025)
von: Wang, Jiuqi, et al.
Veröffentlicht: (2025)
Model-Free Robust Reinforcement Learning with Sample Complexity Analysis
von: Wang, Yudan, et al.
Veröffentlicht: (2024)
von: Wang, Yudan, et al.
Veröffentlicht: (2024)
Contrastive UCB: Provably Efficient Contrastive Self-Supervised Learning in Online Reinforcement Learning
von: Qiu, Shuang, et al.
Veröffentlicht: (2022)
von: Qiu, Shuang, et al.
Veröffentlicht: (2022)
Sample-Efficient Preference-based Reinforcement Learning with Dynamics Aware Rewards
von: Metcalf, Katherine, et al.
Veröffentlicht: (2024)
von: Metcalf, Katherine, et al.
Veröffentlicht: (2024)
Efficient Learning of POMDPs with Known Observation Model in Average-Reward Setting
von: Russo, Alessio, et al.
Veröffentlicht: (2024)
von: Russo, Alessio, et al.
Veröffentlicht: (2024)
Provably Efficient Online RLHF with One-Pass Reward Modeling
von: Li, Long-Fei, et al.
Veröffentlicht: (2025)
von: Li, Long-Fei, et al.
Veröffentlicht: (2025)
Sample-Efficient Tabular Self-Play for Offline Robust Reinforcement Learning
von: Li, Na, et al.
Veröffentlicht: (2025)
von: Li, Na, et al.
Veröffentlicht: (2025)
Optimal Sample Complexity for Average Reward Markov Decision Processes
von: Wang, Shengbo, et al.
Veröffentlicht: (2023)
von: Wang, Shengbo, et al.
Veröffentlicht: (2023)
Distributionally Robust Model-Based Offline Reinforcement Learning with Near-Optimal Sample Complexity
von: Shi, Laixi, et al.
Veröffentlicht: (2022)
von: Shi, Laixi, et al.
Veröffentlicht: (2022)
Ähnliche Einträge
-
CADENT: Gated Hybrid Distillation for Sample-Efficient Transfer in Reinforcement Learning
von: Alinejad, Mahyar, et al.
Veröffentlicht: (2026) -
Sample-Efficient Distributionally Robust Multi-Agent Reinforcement Learning via Online Interaction
von: Farhat, Zain Ulabedeen, et al.
Veröffentlicht: (2025) -
Online Robust Reinforcement Learning with General Function Approximation
von: Ghosh, Debamita, et al.
Veröffentlicht: (2025) -
ORVIT: Near-Optimal Online Distributionally Robust Reinforcement Learning
von: Ghosh, Debamita, et al.
Veröffentlicht: (2025) -
Bayesian Inverse Reinforcement Learning for Non-Markovian Rewards
von: Topper, Noah, et al.
Veröffentlicht: (2024)