Bellman operator convergence enhancements in reinforcement learning algorithms
Fuente:
arXiv
Salvato in:
| Autori principali: | Kadurha, David Krame, Moutouo, Domini Jocema Leko, Gaba, Yae Ulrich |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Topological Foundations of Reinforcement Learning
di: Kadurha, David Krame
Pubblicazione: (2024)
di: Kadurha, David Krame
Pubblicazione: (2024)
An advantage based policy transfer algorithm for reinforcement learning with measures of transferability
di: Alam, Md Ferdous, et al.
Pubblicazione: (2023)
di: Alam, Md Ferdous, et al.
Pubblicazione: (2023)
Found-RL: foundation model-enhanced reinforcement learning for autonomous driving
di: Qu, Yansong, et al.
Pubblicazione: (2026)
di: Qu, Yansong, et al.
Pubblicazione: (2026)
Convergence of a model-free entropy-regularized inverse reinforcement learning algorithm
di: Renard, Titouan, et al.
Pubblicazione: (2024)
di: Renard, Titouan, et al.
Pubblicazione: (2024)
Bellman Error Centering
di: Chen, Xingguo, et al.
Pubblicazione: (2025)
di: Chen, Xingguo, et al.
Pubblicazione: (2025)
Symmetric Q-learning: Reducing Skewness of Bellman Error in Online Reinforcement Learning
di: Omura, Motoki, et al.
Pubblicazione: (2024)
di: Omura, Motoki, et al.
Pubblicazione: (2024)
Transformers converge to invariant algorithmic cores
di: Schiffman, Joshua S.
Pubblicazione: (2026)
di: Schiffman, Joshua S.
Pubblicazione: (2026)
Trust Region Preference Approximation: A simple and stable reinforcement learning algorithm for LLM reasoning
di: Su, Xuerui, et al.
Pubblicazione: (2025)
di: Su, Xuerui, et al.
Pubblicazione: (2025)
FBFL: A Field-Based Coordination Approach for Data Heterogeneity in Federated Learning
di: Domini, Davide, et al.
Pubblicazione: (2025)
di: Domini, Davide, et al.
Pubblicazione: (2025)
Parameterized Projected Bellman Operator
di: Vincent, Théo, et al.
Pubblicazione: (2023)
di: Vincent, Théo, et al.
Pubblicazione: (2023)
Solving the flexible job-shop scheduling problem through an enhanced deep reinforcement learning approach
di: Echeverria, Imanol, et al.
Pubblicazione: (2023)
di: Echeverria, Imanol, et al.
Pubblicazione: (2023)
From paper to benchmark: agentic, framework-based reproduction of under-specified methods in machine health intelligence
di: Theiler, Raffael, et al.
Pubblicazione: (2026)
di: Theiler, Raffael, et al.
Pubblicazione: (2026)
Understanding the theoretical properties of projected Bellman equation, linear Q-learning, and approximate value iteration
di: Lim, Han-Dong, et al.
Pubblicazione: (2025)
di: Lim, Han-Dong, et al.
Pubblicazione: (2025)
Improving Long-Tailed Object Detection with Balanced Group Softmax and Metric Learning
di: Gaba, Satyam
Pubblicazione: (2025)
di: Gaba, Satyam
Pubblicazione: (2025)
Gradual Transition from Bellman Optimality Operator to Bellman Operator in Online Reinforcement Learning
di: Omura, Motoki, et al.
Pubblicazione: (2025)
di: Omura, Motoki, et al.
Pubblicazione: (2025)
Normalization and effective learning rates in reinforcement learning
di: Lyle, Clare, et al.
Pubblicazione: (2024)
di: Lyle, Clare, et al.
Pubblicazione: (2024)
Proximity-based Self-Federated Learning
di: Domini, Davide, et al.
Pubblicazione: (2024)
di: Domini, Davide, et al.
Pubblicazione: (2024)
Theoretical Barriers in Bellman-Based Reinforcement Learning
di: Pinon, Brieuc, et al.
Pubblicazione: (2025)
di: Pinon, Brieuc, et al.
Pubblicazione: (2025)
Curriculum reinforcement learning with measurable task representation learning
di: Wen, Yongyan, et al.
Pubblicazione: (2026)
di: Wen, Yongyan, et al.
Pubblicazione: (2026)
Optimization of geological carbon storage operations with multimodal latent dynamic model and deep reinforcement learning
di: Wang, Zhongzheng, et al.
Pubblicazione: (2024)
di: Wang, Zhongzheng, et al.
Pubblicazione: (2024)
Deep Generative Models for Synthetic Financial Data: Applications to Portfolio and Risk Modeling
di: Hounwanou, Christophe D., et al.
Pubblicazione: (2025)
di: Hounwanou, Christophe D., et al.
Pubblicazione: (2025)
BenchRL-QAS: Benchmarking reinforcement learning algorithms for quantum architecture search
di: Ikhtiarudin, Azhar, et al.
Pubblicazione: (2025)
di: Ikhtiarudin, Azhar, et al.
Pubblicazione: (2025)
Adaptive Regularization of Representation Rank as an Implicit Constraint of Bellman Equation
di: He, Qiang, et al.
Pubblicazione: (2024)
di: He, Qiang, et al.
Pubblicazione: (2024)
Counterfactual experience augmented off-policy reinforcement learning
di: Lee, Sunbowen, et al.
Pubblicazione: (2025)
di: Lee, Sunbowen, et al.
Pubblicazione: (2025)
Causal prompting model-based offline reinforcement learning
di: Yu, Xuehui, et al.
Pubblicazione: (2024)
di: Yu, Xuehui, et al.
Pubblicazione: (2024)
Deep reinforcement learning with time-scale invariant memory
di: Kabir, Md Rysul, et al.
Pubblicazione: (2024)
di: Kabir, Md Rysul, et al.
Pubblicazione: (2024)
Delayed homomorphic reinforcement learning for environments with delayed feedback
di: Lee, Jongsoo, et al.
Pubblicazione: (2026)
di: Lee, Jongsoo, et al.
Pubblicazione: (2026)
Offline reinforcement learning for job-shop scheduling problems
di: Echeverria, Imanol, et al.
Pubblicazione: (2024)
di: Echeverria, Imanol, et al.
Pubblicazione: (2024)
Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning
di: Zhao, Hanyang, et al.
Pubblicazione: (2024)
di: Zhao, Hanyang, et al.
Pubblicazione: (2024)
Leveraging weights signals -- Predicting and improving generalizability in reinforcement learning
di: Moulin, Olivier, et al.
Pubblicazione: (2025)
di: Moulin, Olivier, et al.
Pubblicazione: (2025)
Dynamic feature selection in medical predictive monitoring by reinforcement learning
di: Chen, Yutong, et al.
Pubblicazione: (2024)
di: Chen, Yutong, et al.
Pubblicazione: (2024)
Economic span selection of bridge based on deep reinforcement learning
di: Zhang, Leye, et al.
Pubblicazione: (2024)
di: Zhang, Leye, et al.
Pubblicazione: (2024)
Not all tokens are needed(NAT): token efficient reinforcement learning
di: Sang, Hejian, et al.
Pubblicazione: (2026)
di: Sang, Hejian, et al.
Pubblicazione: (2026)
Linear Bellman Completeness Suffices for Efficient Online Reinforcement Learning with Few Actions
di: Golowich, Noah, et al.
Pubblicazione: (2024)
di: Golowich, Noah, et al.
Pubblicazione: (2024)
MICRO: Model-Based Offline Reinforcement Learning with a Conservative Bellman Operator
di: Liu, Xiao-Yin, et al.
Pubblicazione: (2023)
di: Liu, Xiao-Yin, et al.
Pubblicazione: (2023)
The Role of Inherent Bellman Error in Offline Reinforcement Learning with Linear Function Approximation
di: Golowich, Noah, et al.
Pubblicazione: (2024)
di: Golowich, Noah, et al.
Pubblicazione: (2024)
An efficient deep reinforcement learning environment for flexible job-shop scheduling
di: Wu, Xinquan, et al.
Pubblicazione: (2025)
di: Wu, Xinquan, et al.
Pubblicazione: (2025)
Emergent temporal abstractions in autoregressive models enable hierarchical reinforcement learning
di: Kobayashi, Seijin, et al.
Pubblicazione: (2025)
di: Kobayashi, Seijin, et al.
Pubblicazione: (2025)
On the consistency of hyper-parameter selection in value-based deep reinforcement learning
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2024)
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2024)
CAREL: Instruction-guided reinforcement learning with cross-modal auxiliary objectives
di: Saghafian, Armin, et al.
Pubblicazione: (2024)
di: Saghafian, Armin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Topological Foundations of Reinforcement Learning
di: Kadurha, David Krame
Pubblicazione: (2024) -
An advantage based policy transfer algorithm for reinforcement learning with measures of transferability
di: Alam, Md Ferdous, et al.
Pubblicazione: (2023) -
Found-RL: foundation model-enhanced reinforcement learning for autonomous driving
di: Qu, Yansong, et al.
Pubblicazione: (2026) -
Convergence of a model-free entropy-regularized inverse reinforcement learning algorithm
di: Renard, Titouan, et al.
Pubblicazione: (2024) -
Bellman Error Centering
di: Chen, Xingguo, et al.
Pubblicazione: (2025)