AdamO: A Collapse-Suppressed Optimizer for Offline RL
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qiao, Nan, Yue, Sheng, Wang, Shuning, Ren, Ju |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Less is More: Clustered Cross-Covariance Control for Offline RL
par: Qiao, Nan, et autres
Publié: (2026)
par: Qiao, Nan, et autres
Publié: (2026)
FOVA: Offline Federated Reinforcement Learning with Mixed-Quality Data
par: Qiao, Nan, et autres
Publié: (2025)
par: Qiao, Nan, et autres
Publié: (2025)
FORLER: Federated Offline Reinforcement Learning with Q-Ensemble and Actor Rectification
par: Qiao, Nan, et autres
Publié: (2026)
par: Qiao, Nan, et autres
Publié: (2026)
Federated Offline Policy Optimization with Dual Regularization
par: Yue, Sheng, et autres
Publié: (2024)
par: Yue, Sheng, et autres
Publié: (2024)
Fat-to-Thin Policy Optimization: Offline RL with Sparse Policies
par: Zhu, Lingwei, et autres
Publié: (2025)
par: Zhu, Lingwei, et autres
Publié: (2025)
OLLIE: Imitation Learning from Offline Pretraining to Online Finetuning
par: Yue, Sheng, et autres
Publié: (2024)
par: Yue, Sheng, et autres
Publié: (2024)
How to Leverage Diverse Demonstrations in Offline Imitation Learning
par: Yue, Sheng, et autres
Publié: (2024)
par: Yue, Sheng, et autres
Publié: (2024)
Decoupled Prioritized Resampling for Offline RL
par: Yue, Yang, et autres
Publié: (2023)
par: Yue, Yang, et autres
Publié: (2023)
Dual Alignment Maximin Optimization for Offline Model-based RL
par: Zhou, Chi, et autres
Publié: (2025)
par: Zhou, Chi, et autres
Publié: (2025)
Cloud-Edge Collaborative Large Models for Robust Photovoltaic Power Forecasting
par: Qiao, Nan, et autres
Publié: (2026)
par: Qiao, Nan, et autres
Publié: (2026)
Optimistic Critic Reconstruction and Constrained Fine-Tuning for General Offline-to-Online RL
par: Luo, Qin-Wen, et autres
Publié: (2024)
par: Luo, Qin-Wen, et autres
Publié: (2024)
Learning to Trust Bellman Updates: Selective State-Adaptive Regularization for Offline RL
par: Luo, Qin-Wen, et autres
Publié: (2025)
par: Luo, Qin-Wen, et autres
Publié: (2025)
Scaling Offline Model-Based RL via Jointly-Optimized World-Action Model Pretraining
par: Cheng, Jie, et autres
Publié: (2024)
par: Cheng, Jie, et autres
Publié: (2024)
Inference Time Policy Optimization for Offline RL with Differentiable World Models
par: Deb, Rohan, et autres
Publié: (2026)
par: Deb, Rohan, et autres
Publié: (2026)
RAGEN-2: Reasoning Collapse in Agentic RL
par: Wang, Zihan, et autres
Publié: (2026)
par: Wang, Zihan, et autres
Publié: (2026)
Making Offline RL Online: Collaborative World Models for Offline Visual Reinforcement Learning
par: Wang, Qi, et autres
Publié: (2023)
par: Wang, Qi, et autres
Publié: (2023)
Adam on Local Time: Addressing Nonstationarity in RL with Relative Adam Timesteps
par: Ellis, Benjamin, et autres
Publié: (2024)
par: Ellis, Benjamin, et autres
Publié: (2024)
Offline RL by Reward-Weighted Fine-Tuning for Conversation Optimization
par: Mukherjee, Subhojyoti, et autres
Publié: (2025)
par: Mukherjee, Subhojyoti, et autres
Publié: (2025)
Improving Offline RL by Blending Heuristics
par: Geng, Sinong, et autres
Publié: (2023)
par: Geng, Sinong, et autres
Publié: (2023)
Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models
par: Zhang, Hongyin, et autres
Publié: (2025)
par: Zhang, Hongyin, et autres
Publié: (2025)
Augmenting Offline RL with Unlabeled Data
par: Wang, Zhao, et autres
Publié: (2024)
par: Wang, Zhao, et autres
Publié: (2024)
When Are RL Hyperparameters Benign? A Study in Offline Goal-Conditioned RL
par: Töpperwien, Jan Malte, et autres
Publié: (2026)
par: Töpperwien, Jan Malte, et autres
Publié: (2026)
Diffusion Models as Optimizers for Efficient Planning in Offline RL
par: Huang, Renming, et autres
Publié: (2024)
par: Huang, Renming, et autres
Publié: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
Reinformer: Max-Return Sequence Modeling for Offline RL
par: Zhuang, Zifeng, et autres
Publié: (2024)
par: Zhuang, Zifeng, et autres
Publié: (2024)
Budgeting Counterfactual for Offline RL
par: Liu, Yao, et autres
Publié: (2023)
par: Liu, Yao, et autres
Publié: (2023)
DISA: Offline Importance Sampling for Distribution-Matching LLM-RL
par: Wang, Shaobo, et autres
Publié: (2026)
par: Wang, Shaobo, et autres
Publié: (2026)
Are Expressive Models Truly Necessary for Offline RL?
par: Wang, Guan, et autres
Publié: (2024)
par: Wang, Guan, et autres
Publié: (2024)
Query-Dependent Prompt Evaluation and Optimization with Offline Inverse RL
par: Sun, Hao, et autres
Publié: (2023)
par: Sun, Hao, et autres
Publié: (2023)
A Tractable Inference Perspective of Offline RL
par: Liu, Xuejie, et autres
Publié: (2023)
par: Liu, Xuejie, et autres
Publié: (2023)
Enhancing Offline Model-Based RL via Active Model Selection: A Bayesian Optimization Perspective
par: Yang, Yu-Wei, et autres
Publié: (2025)
par: Yang, Yu-Wei, et autres
Publié: (2025)
Selective Uncertainty Propagation in Offline RL
par: Krishnamurthy, Sanath Kumar, et autres
Publié: (2023)
par: Krishnamurthy, Sanath Kumar, et autres
Publié: (2023)
On Suppressing Range of Adaptive Stepsizes of Adam to Improve Generalisation Performance
par: Zhang, Guoqiang
Publié: (2023)
par: Zhang, Guoqiang
Publié: (2023)
Model-based Offline RL via Robust Value-Aware Model Learning with Implicitly Differentiable Adaptive Weighting
par: Qiao, Zhongjian, et autres
Publié: (2026)
par: Qiao, Zhongjian, et autres
Publié: (2026)
SCOPE-RL: A Python Library for Offline Reinforcement Learning and Off-Policy Evaluation
par: Kiyohara, Haruka, et autres
Publié: (2023)
par: Kiyohara, Haruka, et autres
Publié: (2023)
Algorithmic Guarantees for Distilling Supervised and Offline RL Datasets
par: Gupta, Aaryan, et autres
Publié: (2025)
par: Gupta, Aaryan, et autres
Publié: (2025)
Offline RL via Feature-Occupancy Gradient Ascent
par: Neu, Gergely, et autres
Publié: (2024)
par: Neu, Gergely, et autres
Publié: (2024)
An Empirical Study on the Effectiveness of Incorporating Offline RL As Online RL Subroutines
par: Su, Jianhai, et autres
Publié: (2025)
par: Su, Jianhai, et autres
Publié: (2025)
Policy Agnostic RL: Offline RL and Online RL Fine-Tuning of Any Class and Backbone
par: Mark, Max Sobol, et autres
Publié: (2024)
par: Mark, Max Sobol, et autres
Publié: (2024)
Design Considerations in Offline Preference-based RL
par: Agarwal, Alekh, et autres
Publié: (2025)
par: Agarwal, Alekh, et autres
Publié: (2025)
Documents similaires
-
Less is More: Clustered Cross-Covariance Control for Offline RL
par: Qiao, Nan, et autres
Publié: (2026) -
FOVA: Offline Federated Reinforcement Learning with Mixed-Quality Data
par: Qiao, Nan, et autres
Publié: (2025) -
FORLER: Federated Offline Reinforcement Learning with Q-Ensemble and Actor Rectification
par: Qiao, Nan, et autres
Publié: (2026) -
Federated Offline Policy Optimization with Dual Regularization
par: Yue, Sheng, et autres
Publié: (2024) -
Fat-to-Thin Policy Optimization: Offline RL with Sparse Policies
par: Zhu, Lingwei, et autres
Publié: (2025)