Salvato in:
| Autori principali: | Chen, Jiayu, Xu, Le, Venugopal, Aravind, Schneider, Jeff |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2505.13709 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bayes Adaptive Monte Carlo Tree Search for Offline Model-based Reinforcement Learning
di: Chen, Jiayu, et al.
Pubblicazione: (2024)
di: Chen, Jiayu, et al.
Pubblicazione: (2024)
Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
di: Xu, Le, et al.
Pubblicazione: (2025)
di: Xu, Le, et al.
Pubblicazione: (2025)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
di: Venugopal, Aravind, et al.
Pubblicazione: (2026)
di: Venugopal, Aravind, et al.
Pubblicazione: (2026)
Deep Generative Models for Offline Policy Learning: Tutorial, Survey, and Perspectives on Future Directions
di: Chen, Jiayu, et al.
Pubblicazione: (2024)
di: Chen, Jiayu, et al.
Pubblicazione: (2024)
Latent Policy Steering with Embodiment-Agnostic Pretrained World Models
di: Wang, Yiqi, et al.
Pubblicazione: (2025)
di: Wang, Yiqi, et al.
Pubblicazione: (2025)
Permutation Equivariant Model-based Offline Reinforcement Learning for Auto-bidding
di: Mou, Zhiyu, et al.
Pubblicazione: (2025)
di: Mou, Zhiyu, et al.
Pubblicazione: (2025)
LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning
di: Zhang, Hanping, et al.
Pubblicazione: (2025)
di: Zhang, Hanping, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Generative Trajectory Policies
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2025)
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2025)
Constrained Latent Action Policies for Model-Based Offline Reinforcement Learning
di: Alles, Marvin, et al.
Pubblicazione: (2024)
di: Alles, Marvin, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning and Sequence Modeling for Downlink Link Adaptation
di: Peri, Samuele, et al.
Pubblicazione: (2024)
di: Peri, Samuele, et al.
Pubblicazione: (2024)
Adversarial Policy Optimization for Offline Preference-based Reinforcement Learning
di: Kang, Hyungkyu, et al.
Pubblicazione: (2025)
di: Kang, Hyungkyu, et al.
Pubblicazione: (2025)
OffSim: Offline Simulator for Model-based Offline Inverse Reinforcement Learning
di: Ahn, Woo-Jin, et al.
Pubblicazione: (2025)
di: Ahn, Woo-Jin, et al.
Pubblicazione: (2025)
Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning
di: Qian, Fuyuan, et al.
Pubblicazione: (2026)
di: Qian, Fuyuan, et al.
Pubblicazione: (2026)
Model-based Offline Quantum Reinforcement Learning
di: Eisenmann, Simon, et al.
Pubblicazione: (2024)
di: Eisenmann, Simon, et al.
Pubblicazione: (2024)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning
di: Ding, Zihan, et al.
Pubblicazione: (2024)
di: Ding, Zihan, et al.
Pubblicazione: (2024)
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
di: Nguyen, Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Thanh, et al.
Pubblicazione: (2024)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
BECAUSE: Bilinear Causal Representation for Generalizable Offline Model-based Reinforcement Learning
di: Lin, Haohong, et al.
Pubblicazione: (2024)
di: Lin, Haohong, et al.
Pubblicazione: (2024)
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
di: Hu, Jifeng, et al.
Pubblicazione: (2025)
di: Hu, Jifeng, et al.
Pubblicazione: (2025)
Diffusion Policies creating a Trust Region for Offline Reinforcement Learning
di: Chen, Tianyu, et al.
Pubblicazione: (2024)
di: Chen, Tianyu, et al.
Pubblicazione: (2024)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
Policy-Based Trajectory Clustering in Offline Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2025)
di: Hu, Hao, et al.
Pubblicazione: (2025)
Evaluation-Time Policy Switching for Offline Reinforcement Learning
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2025)
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2025)
An Offline Adaptation Framework for Constrained Multi-Objective Reinforcement Learning
di: Lin, Qian, et al.
Pubblicazione: (2024)
di: Lin, Qian, et al.
Pubblicazione: (2024)
Policy-regularized Offline Multi-objective Reinforcement Learning
di: Lin, Qian, et al.
Pubblicazione: (2024)
di: Lin, Qian, et al.
Pubblicazione: (2024)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
DITTO: Offline Imitation Learning with World Models
di: DeMoss, Branton, et al.
Pubblicazione: (2023)
di: DeMoss, Branton, et al.
Pubblicazione: (2023)
Real-World Offline Reinforcement Learning from Vision Language Model Feedback
di: Venkataraman, Sreyas, et al.
Pubblicazione: (2024)
di: Venkataraman, Sreyas, et al.
Pubblicazione: (2024)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
di: Zhang, Liyu, et al.
Pubblicazione: (2024)
di: Zhang, Liyu, et al.
Pubblicazione: (2024)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Universal Horizon Models
di: Chung, Hojun, et al.
Pubblicazione: (2026)
di: Chung, Hojun, et al.
Pubblicazione: (2026)
Minimax Optimal and Computationally Efficient Algorithms for Distributionally Robust Offline Reinforcement Learning
di: Liu, Zhishuai, et al.
Pubblicazione: (2024)
di: Liu, Zhishuai, et al.
Pubblicazione: (2024)
DmC: Nearest Neighbor Guidance Diffusion Model for Offline Cross-domain Reinforcement Learning
di: Van, Linh Le Pham, et al.
Pubblicazione: (2025)
di: Van, Linh Le Pham, et al.
Pubblicazione: (2025)
GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models
di: Wang, Mianchu, et al.
Pubblicazione: (2023)
di: Wang, Mianchu, et al.
Pubblicazione: (2023)
DAWM: Diffusion Action World Models for Offline Reinforcement Learning via Action-Inferred Transitions
di: Li, Zongyue, et al.
Pubblicazione: (2025)
di: Li, Zongyue, et al.
Pubblicazione: (2025)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
di: Yang, Rui, et al.
Pubblicazione: (2023)
di: Yang, Rui, et al.
Pubblicazione: (2023)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Bayes Adaptive Monte Carlo Tree Search for Offline Model-based Reinforcement Learning
di: Chen, Jiayu, et al.
Pubblicazione: (2024) -
Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
di: Xu, Le, et al.
Pubblicazione: (2025) -
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
di: Venugopal, Aravind, et al.
Pubblicazione: (2026) -
Deep Generative Models for Offline Policy Learning: Tutorial, Survey, and Perspectives on Future Directions
di: Chen, Jiayu, et al.
Pubblicazione: (2024) -
Latent Policy Steering with Embodiment-Agnostic Pretrained World Models
di: Wang, Yiqi, et al.
Pubblicazione: (2025)