Theoretical Barriers in Bellman-Based Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Pinon, Brieuc, Jungers, Raphaël, Delvenne, Jean-Charles |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Cantor-Kantorovich Metric Between Markov Decision Processes with Application to Transfer Learning
di: Banse, Adrien, et al.
Pubblicazione: (2024)
di: Banse, Adrien, et al.
Pubblicazione: (2024)
MICRO: Model-Based Offline Reinforcement Learning with a Conservative Bellman Operator
di: Liu, Xiao-Yin, et al.
Pubblicazione: (2023)
di: Liu, Xiao-Yin, et al.
Pubblicazione: (2023)
Random Wavelet Features for Graph Kernel Machines
di: de Bassompierre, Valentin, et al.
Pubblicazione: (2026)
di: de Bassompierre, Valentin, et al.
Pubblicazione: (2026)
Gradual Transition from Bellman Optimality Operator to Bellman Operator in Online Reinforcement Learning
di: Omura, Motoki, et al.
Pubblicazione: (2025)
di: Omura, Motoki, et al.
Pubblicazione: (2025)
Linear Bellman Completeness Suffices for Efficient Online Reinforcement Learning with Few Actions
di: Golowich, Noah, et al.
Pubblicazione: (2024)
di: Golowich, Noah, et al.
Pubblicazione: (2024)
Symmetric Q-learning: Reducing Skewness of Bellman Error in Online Reinforcement Learning
di: Omura, Motoki, et al.
Pubblicazione: (2024)
di: Omura, Motoki, et al.
Pubblicazione: (2024)
The Role of Inherent Bellman Error in Offline Reinforcement Learning with Linear Function Approximation
di: Golowich, Noah, et al.
Pubblicazione: (2024)
di: Golowich, Noah, et al.
Pubblicazione: (2024)
Iterated $Q$-Network: Beyond One-Step Bellman Updates in Deep Reinforcement Learning
di: Vincent, Théo, et al.
Pubblicazione: (2024)
di: Vincent, Théo, et al.
Pubblicazione: (2024)
A Generalized Projected Bellman Error for Off-policy Value Estimation in Reinforcement Learning
di: Patterson, Andrew, et al.
Pubblicazione: (2021)
di: Patterson, Andrew, et al.
Pubblicazione: (2021)
Path-Coupled Bellman Flows for Distributional Reinforcement Learning
di: Xu, Boyang, et al.
Pubblicazione: (2026)
di: Xu, Boyang, et al.
Pubblicazione: (2026)
Bellman Unbiasedness: Toward Provably Efficient Distributional Reinforcement Learning with General Value Function Approximation
di: Cho, Taehyun, et al.
Pubblicazione: (2024)
di: Cho, Taehyun, et al.
Pubblicazione: (2024)
Bellman Error Centering
di: Chen, Xingguo, et al.
Pubblicazione: (2025)
di: Chen, Xingguo, et al.
Pubblicazione: (2025)
Information-Theoretic State Variable Selection for Reinforcement Learning
di: Westphal, Charles, et al.
Pubblicazione: (2024)
di: Westphal, Charles, et al.
Pubblicazione: (2024)
Parameterized Projected Bellman Operator
di: Vincent, Théo, et al.
Pubblicazione: (2023)
di: Vincent, Théo, et al.
Pubblicazione: (2023)
Impoola: The Power of Average Pooling for Image-Based Deep Reinforcement Learning
di: Trumpp, Raphael, et al.
Pubblicazione: (2025)
di: Trumpp, Raphael, et al.
Pubblicazione: (2025)
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective
di: Zhao, Lei, et al.
Pubblicazione: (2023)
di: Zhao, Lei, et al.
Pubblicazione: (2023)
Bellman operator convergence enhancements in reinforcement learning algorithms
di: Kadurha, David Krame, et al.
Pubblicazione: (2025)
di: Kadurha, David Krame, et al.
Pubblicazione: (2025)
Cooperative Backdoor Attack in Decentralized Reinforcement Learning with Theoretical Guarantee
di: Gao, Mengtong, et al.
Pubblicazione: (2024)
di: Gao, Mengtong, et al.
Pubblicazione: (2024)
A Theoretical Understanding of Gradient Bias in Meta-Reinforcement Learning
di: Feng, Xidong, et al.
Pubblicazione: (2021)
di: Feng, Xidong, et al.
Pubblicazione: (2021)
Adaptive Regularization of Representation Rank as an Implicit Constraint of Bellman Equation
di: He, Qiang, et al.
Pubblicazione: (2024)
di: He, Qiang, et al.
Pubblicazione: (2024)
Game-Theoretic Robust Reinforcement Learning Handles Temporally-Coupled Perturbations
di: Liang, Yongyuan, et al.
Pubblicazione: (2023)
di: Liang, Yongyuan, et al.
Pubblicazione: (2023)
Theoretical Analysis of Meta Reinforcement Learning: Generalization Bounds and Convergence Guarantees
di: Wang, Cangqing, et al.
Pubblicazione: (2024)
di: Wang, Cangqing, et al.
Pubblicazione: (2024)
CAPSULE: Control-Theoretic Action Perturbations for Safe Uncertainty-Aware Reinforcement Learning
di: Narava, Rahul, et al.
Pubblicazione: (2026)
di: Narava, Rahul, et al.
Pubblicazione: (2026)
Constrained Reinforcement Learning with Smoothed Log Barrier Function
di: Zhang, Baohe, et al.
Pubblicazione: (2024)
di: Zhang, Baohe, et al.
Pubblicazione: (2024)
Multi-Objective Reinforcement Learning with Max-Min Criterion: A Game-Theoretic Approach
di: Byeon, Woohyeon, et al.
Pubblicazione: (2025)
di: Byeon, Woohyeon, et al.
Pubblicazione: (2025)
Transfer of Reinforcement Learning-Based Controllers from Model- to Hardware-in-the-Loop
di: Picerno, Mario, et al.
Pubblicazione: (2023)
di: Picerno, Mario, et al.
Pubblicazione: (2023)
When Do Skills Help Reinforcement Learning? A Theoretical Analysis of Temporal Abstractions
di: Li, Zhening, et al.
Pubblicazione: (2024)
di: Li, Zhening, et al.
Pubblicazione: (2024)
RL-STaR: Theoretical Analysis of Reinforcement Learning Frameworks for Self-Taught Reasoner
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
State-Constrained Offline Reinforcement Learning
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
OCSVM-Guided Representation Learning for Unsupervised Anomaly Detection
di: Pinon, Nicolas, et al.
Pubblicazione: (2025)
di: Pinon, Nicolas, et al.
Pubblicazione: (2025)
Using Large Language Models to Automate and Expedite Reinforcement Learning with Reward Machine
di: Alsadat, Shayan Meshkat, et al.
Pubblicazione: (2024)
di: Alsadat, Shayan Meshkat, et al.
Pubblicazione: (2024)
Reward Redistribution for CVaR MDPs using a Bellman Operator on L-infinity
di: Muni, Aneri, et al.
Pubblicazione: (2026)
di: Muni, Aneri, et al.
Pubblicazione: (2026)
Uncertainty-Based Smooth Policy Regularisation for Reinforcement Learning with Few Demonstrations
di: Zhu, Yujie, et al.
Pubblicazione: (2025)
di: Zhu, Yujie, et al.
Pubblicazione: (2025)
Trajectory Bellman Residual Minimization: A Simple Value-Based Method for LLM Reasoning
di: Yuan, Yurun, et al.
Pubblicazione: (2025)
di: Yuan, Yurun, et al.
Pubblicazione: (2025)
BarrierSteer: LLM Safety via Learning Barrier Steering
di: Tran, Thanh Q., et al.
Pubblicazione: (2026)
di: Tran, Thanh Q., et al.
Pubblicazione: (2026)
Improving Reinforcement Learning Efficiency with Auxiliary Tasks in Non-Visual Environments: A Comparison
di: Lange, Moritz, et al.
Pubblicazione: (2023)
di: Lange, Moritz, et al.
Pubblicazione: (2023)
Understanding the theoretical properties of projected Bellman equation, linear Q-learning, and approximate value iteration
di: Lim, Han-Dong, et al.
Pubblicazione: (2025)
di: Lim, Han-Dong, et al.
Pubblicazione: (2025)
Provably Invincible Adversarial Attacks on Reinforcement Learning Systems: A Rate-Distortion Information-Theoretic Approach
di: Lu, Ziqing, et al.
Pubblicazione: (2025)
di: Lu, Ziqing, et al.
Pubblicazione: (2025)
Energy-Based Transfer for Reinforcement Learning
di: Deng, Zeyun, et al.
Pubblicazione: (2025)
di: Deng, Zeyun, et al.
Pubblicazione: (2025)
Kernel-Based Learning of Safety Barriers
di: Schön, Oliver, et al.
Pubblicazione: (2026)
di: Schön, Oliver, et al.
Pubblicazione: (2026)
Documenti analoghi
-
A Cantor-Kantorovich Metric Between Markov Decision Processes with Application to Transfer Learning
di: Banse, Adrien, et al.
Pubblicazione: (2024) -
MICRO: Model-Based Offline Reinforcement Learning with a Conservative Bellman Operator
di: Liu, Xiao-Yin, et al.
Pubblicazione: (2023) -
Random Wavelet Features for Graph Kernel Machines
di: de Bassompierre, Valentin, et al.
Pubblicazione: (2026) -
Gradual Transition from Bellman Optimality Operator to Bellman Operator in Online Reinforcement Learning
di: Omura, Motoki, et al.
Pubblicazione: (2025) -
Linear Bellman Completeness Suffices for Efficient Online Reinforcement Learning with Few Actions
di: Golowich, Noah, et al.
Pubblicazione: (2024)