OBLR-PO: A Theoretical Framework for Stable Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Zixun, Sheng, Jiayi, Zheng, Zeyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM Reasoning
di: Yang, Shenzhi, et al.
Pubblicazione: (2025)
di: Yang, Shenzhi, et al.
Pubblicazione: (2025)
A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values
di: Beechey, Daniel, et al.
Pubblicazione: (2025)
di: Beechey, Daniel, et al.
Pubblicazione: (2025)
Category-Theoretical and Topos-Theoretical Frameworks in Machine Learning: A Survey
di: Jia, Yiyang, et al.
Pubblicazione: (2024)
di: Jia, Yiyang, et al.
Pubblicazione: (2024)
A Unified Information-Theoretic Framework for Meta-Learning Generalization
di: Wen, Wen, et al.
Pubblicazione: (2025)
di: Wen, Wen, et al.
Pubblicazione: (2025)
Closing the Loop: A Control-Theoretic Framework for Provably Stable Time Series Forecasting with LLMs
di: Zhang, Xingyu, et al.
Pubblicazione: (2026)
di: Zhang, Xingyu, et al.
Pubblicazione: (2026)
Learning to Think: Information-Theoretic Reinforcement Fine-Tuning for LLMs
di: Wang, Jingyao, et al.
Pubblicazione: (2025)
di: Wang, Jingyao, et al.
Pubblicazione: (2025)
Towards an Information Theoretic Framework of Context-Based Offline Meta-Reinforcement Learning
di: Li, Lanqing, et al.
Pubblicazione: (2024)
di: Li, Lanqing, et al.
Pubblicazione: (2024)
GenPO: Generative Diffusion Models Meet On-Policy Reinforcement Learning
di: Ding, Shutong, et al.
Pubblicazione: (2025)
di: Ding, Shutong, et al.
Pubblicazione: (2025)
Functional Scaling Laws in Kernel Regression: Loss Dynamics and Learning Rate Schedules
di: Li, Binghui, et al.
Pubblicazione: (2025)
di: Li, Binghui, et al.
Pubblicazione: (2025)
MARS: A Meta-Adaptive Reinforcement Learning Framework for Risk-Aware Multi-Agent Portfolio Management
di: Chen, Jiayi, et al.
Pubblicazione: (2025)
di: Chen, Jiayi, et al.
Pubblicazione: (2025)
Game-Theoretic Robust Reinforcement Learning Handles Temporally-Coupled Perturbations
di: Liang, Yongyuan, et al.
Pubblicazione: (2023)
di: Liang, Yongyuan, et al.
Pubblicazione: (2023)
A Unified and Stable Risk Minimization Framework for Weakly Supervised Learning with Theoretical Guarantees
di: Zhang, Miao, et al.
Pubblicazione: (2025)
di: Zhang, Miao, et al.
Pubblicazione: (2025)
Reinforcement-Learning Portfolio Allocation with Dynamic Embedding of Market Information
di: He, Jinghai, et al.
Pubblicazione: (2025)
di: He, Jinghai, et al.
Pubblicazione: (2025)
Stable Heterogeneous Treatment Effect Estimation across Out-of-Distribution Populations
di: Zhang, Yuling, et al.
Pubblicazione: (2024)
di: Zhang, Yuling, et al.
Pubblicazione: (2024)
Unity RL Playground: A Versatile Reinforcement Learning Framework for Mobile Robots
di: Ye, Linqi, et al.
Pubblicazione: (2025)
di: Ye, Linqi, et al.
Pubblicazione: (2025)
Stable Gradients for Stable Learning at Scale in Deep Reinforcement Learning
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
A Game-Theoretic Spatio-Temporal Reinforcement Learning Framework for Collaborative Public Resource Allocation
di: Lei, Songxin, et al.
Pubblicazione: (2025)
di: Lei, Songxin, et al.
Pubblicazione: (2025)
Toward Information Theoretic Active Inverse Reinforcement Learning
di: Bajgar, Ondrej, et al.
Pubblicazione: (2024)
di: Bajgar, Ondrej, et al.
Pubblicazione: (2024)
Hypercube Policy Regularization Framework for Offline Reinforcement Learning
di: Shen, Yi, et al.
Pubblicazione: (2024)
di: Shen, Yi, et al.
Pubblicazione: (2024)
Information-Theoretic Generalization Bounds of Replay-based Continual Learning
di: Wen, Wen, et al.
Pubblicazione: (2025)
di: Wen, Wen, et al.
Pubblicazione: (2025)
SoftPipe: A Soft-Guided Reinforcement Learning Framework for Automated Data Preparation
di: Chang, Jing, et al.
Pubblicazione: (2025)
di: Chang, Jing, et al.
Pubblicazione: (2025)
RL-STaR: Theoretical Analysis of Reinforcement Learning Frameworks for Self-Taught Reasoner
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem
di: Gao, Lei, et al.
Pubblicazione: (2025)
di: Gao, Lei, et al.
Pubblicazione: (2025)
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective
di: Zhao, Lei, et al.
Pubblicazione: (2023)
di: Zhao, Lei, et al.
Pubblicazione: (2023)
ExPO: Unlocking Hard Reasoning with Self-Explanation-Guided Reinforcement Learning
di: Zhou, Ruiyang, et al.
Pubblicazione: (2025)
di: Zhou, Ruiyang, et al.
Pubblicazione: (2025)
An Information-Theoretic Analysis of OOD Generalization in Meta-Reinforcement Learning
di: Liu, Xingtu
Pubblicazione: (2025)
di: Liu, Xingtu
Pubblicazione: (2025)
Theoretical Study of Conflict-Avoidant Multi-Objective Reinforcement Learning
di: Wang, Yudan, et al.
Pubblicazione: (2024)
di: Wang, Yudan, et al.
Pubblicazione: (2024)
Revisiting Bisimulation Metric for Robust Representations in Reinforcement Learning
di: Zhang, Leiji, et al.
Pubblicazione: (2025)
di: Zhang, Leiji, et al.
Pubblicazione: (2025)
Purification Of Contaminated Convolutional Neural Networks Via Robust Recovery: An Approach with Theoretical Guarantee in One-Hidden-Layer Case
di: Lu, Hanxiao, et al.
Pubblicazione: (2024)
di: Lu, Hanxiao, et al.
Pubblicazione: (2024)
A2PO: Towards Effective Offline Reinforcement Learning from an Advantage-aware Perspective
di: Qing, Yunpeng, et al.
Pubblicazione: (2024)
di: Qing, Yunpeng, et al.
Pubblicazione: (2024)
Theoretical Barriers in Bellman-Based Reinforcement Learning
di: Pinon, Brieuc, et al.
Pubblicazione: (2025)
di: Pinon, Brieuc, et al.
Pubblicazione: (2025)
AGILE: A Novel Reinforcement Learning Framework of LLM Agents
di: Feng, Peiyuan, et al.
Pubblicazione: (2024)
di: Feng, Peiyuan, et al.
Pubblicazione: (2024)
A Theoretical Framework for Modular Learning of Robust Generative Models
di: Cortes, Corinna, et al.
Pubblicazione: (2026)
di: Cortes, Corinna, et al.
Pubblicazione: (2026)
A Robust Quantile Huber Loss With Interpretable Parameter Adjustment In Distributional Reinforcement Learning
di: Malekzadeh, Parvin, et al.
Pubblicazione: (2024)
di: Malekzadeh, Parvin, et al.
Pubblicazione: (2024)
Towards a Reward-Free Reinforcement Learning Framework for Vehicle Control
di: Yang, Jielong, et al.
Pubblicazione: (2025)
di: Yang, Jielong, et al.
Pubblicazione: (2025)
A General Control-Theoretic Approach for Reinforcement Learning: Theory and Algorithms
di: Chen, Weiqin, et al.
Pubblicazione: (2024)
di: Chen, Weiqin, et al.
Pubblicazione: (2024)
RankSEG-RMA: An Efficient Segmentation Algorithm via Reciprocal Moment Approximation
di: Wang, Zixun, et al.
Pubblicazione: (2025)
di: Wang, Zixun, et al.
Pubblicazione: (2025)
A Theoretical Understanding of Gradient Bias in Meta-Reinforcement Learning
di: Feng, Xidong, et al.
Pubblicazione: (2021)
di: Feng, Xidong, et al.
Pubblicazione: (2021)
Dr. MAS: Stable Reinforcement Learning for Multi-Agent LLM Systems
di: Feng, Lang, et al.
Pubblicazione: (2026)
di: Feng, Lang, et al.
Pubblicazione: (2026)
Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts
di: Zhang, Di, et al.
Pubblicazione: (2025)
di: Zhang, Di, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM Reasoning
di: Yang, Shenzhi, et al.
Pubblicazione: (2025) -
A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values
di: Beechey, Daniel, et al.
Pubblicazione: (2025) -
Category-Theoretical and Topos-Theoretical Frameworks in Machine Learning: A Survey
di: Jia, Yiyang, et al.
Pubblicazione: (2024) -
A Unified Information-Theoretic Framework for Meta-Learning Generalization
di: Wen, Wen, et al.
Pubblicazione: (2025) -
Closing the Loop: A Control-Theoretic Framework for Provably Stable Time Series Forecasting with LLMs
di: Zhang, Xingyu, et al.
Pubblicazione: (2026)