SUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Qiao, Zhongjian, Lyu, Jiafei, Jiao, Kechen, Liu, Qi, Li, Xiu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Mind the Model, Not the Agent: The Primacy Bias in Model-based RL
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2023)
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2023)
Efficient Cross-Domain Offline Reinforcement Learning with Dynamics- and Value-Aligned Data Filtering
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025)
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025)
Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025)
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025)
SEABO: A Simple Search-Based Method for Offline Imitation Learning
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024)
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024)
Unifying Value Alignment and Assignment in Cross-Domain Offline Reinforcement Learning with Heterogeneous Datasets
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2026)
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2026)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
von: Lyu, Jiafei, et al.
Veröffentlicht: (2022)
von: Lyu, Jiafei, et al.
Veröffentlicht: (2022)
Model-based Offline RL via Robust Value-Aware Model Learning with Implicitly Differentiable Adaptive Weighting
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2026)
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2026)
Cross-Domain Offline Policy Adaptation via Selective Transition Correction
von: Yan, Mengbei, et al.
Veröffentlicht: (2026)
von: Yan, Mengbei, et al.
Veröffentlicht: (2026)
Sample-Efficient Policy Constraint Offline Deep Reinforcement Learning based on Sample Filtering
von: Chen, Yuanhao, et al.
Veröffentlicht: (2025)
von: Chen, Yuanhao, et al.
Veröffentlicht: (2025)
Temporal Difference Learning with Constrained Initial Representations
von: Lyu, Jiafei, et al.
Veröffentlicht: (2026)
von: Lyu, Jiafei, et al.
Veröffentlicht: (2026)
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
von: Liu, Zeyuan, et al.
Veröffentlicht: (2025)
von: Liu, Zeyuan, et al.
Veröffentlicht: (2025)
Understanding What Affects the Generalization Gap in Visual Reinforcement Learning: Theory and Empirical Evidence
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024)
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024)
A Two-stage Reinforcement Learning-based Approach for Multi-entity Task Allocation
von: Gong, Aicheng, et al.
Veröffentlicht: (2024)
von: Gong, Aicheng, et al.
Veröffentlicht: (2024)
PROF: An LLM-based Reward Code Preference Optimization Framework for Offline Imitation Learning
von: Sun, Shengjie, et al.
Veröffentlicht: (2025)
von: Sun, Shengjie, et al.
Veröffentlicht: (2025)
A Large Language Model-Driven Reward Design Framework via Dynamic Feedback for Reinforcement Learning
von: Sun, Shengjie, et al.
Veröffentlicht: (2024)
von: Sun, Shengjie, et al.
Veröffentlicht: (2024)
Deterministic Uncertainty Propagation for Improved Model-Based Offline Reinforcement Learning
von: Akgül, Abdullah, et al.
Veröffentlicht: (2024)
von: Akgül, Abdullah, et al.
Veröffentlicht: (2024)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
von: Gao, Xiancheng, et al.
Veröffentlicht: (2025)
von: Gao, Xiancheng, et al.
Veröffentlicht: (2025)
PEARL: Zero-shot Cross-task Preference Alignment and Robust Reward Learning for Robotic Manipulation
von: Liu, Runze, et al.
Veröffentlicht: (2023)
von: Liu, Runze, et al.
Veröffentlicht: (2023)
CDSA: Conservative Denoising Score-based Algorithm for Offline Reinforcement Learning
von: Liu, Zeyuan, et al.
Veröffentlicht: (2024)
von: Liu, Zeyuan, et al.
Veröffentlicht: (2024)
Exploration and Anti-Exploration with Distributional Random Network Distillation
von: Yang, Kai, et al.
Veröffentlicht: (2024)
von: Yang, Kai, et al.
Veröffentlicht: (2024)
KAN v.s. MLP for Offline Reinforcement Learning
von: Guo, Haihong, et al.
Veröffentlicht: (2024)
von: Guo, Haihong, et al.
Veröffentlicht: (2024)
Model-Based Reinforcement Learning with Double Oracle Efficiency in Policy Optimization and Offline Estimation
von: Hu, Haichen, et al.
Veröffentlicht: (2026)
von: Hu, Haichen, et al.
Veröffentlicht: (2026)
VLP: Vision-Language Preference Learning for Embodied Manipulation
von: Liu, Runze, et al.
Veröffentlicht: (2025)
von: Liu, Runze, et al.
Veröffentlicht: (2025)
Uncertainty-Aware Robotic World Model Makes Offline Model-Based Reinforcement Learning Work on Real Robots
von: Li, Chenhao, et al.
Veröffentlicht: (2025)
von: Li, Chenhao, et al.
Veröffentlicht: (2025)
Novelty-Guided Data Reuse for Efficient and Diversified Multi-Agent Reinforcement Learning
von: Chen, Yangkun, et al.
Veröffentlicht: (2024)
von: Chen, Yangkun, et al.
Veröffentlicht: (2024)
Offline Model-Based Reinforcement Learning with Anti-Exploration
von: Srinivasan, Padmanaba, et al.
Veröffentlicht: (2024)
von: Srinivasan, Padmanaba, et al.
Veröffentlicht: (2024)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
von: Guo, Yihong, et al.
Veröffentlicht: (2025)
von: Guo, Yihong, et al.
Veröffentlicht: (2025)
ODRL: A Benchmark for Off-Dynamics Reinforcement Learning
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024)
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024)
Efficient and Uncertainty-Aware Diffusion Framework for Offline-to-Online Reinforcement Learning
von: Bui, Ha Manh, et al.
Veröffentlicht: (2026)
von: Bui, Ha Manh, et al.
Veröffentlicht: (2026)
MICRO: Model-Based Offline Reinforcement Learning with a Conservative Bellman Operator
von: Liu, Xiao-Yin, et al.
Veröffentlicht: (2023)
von: Liu, Xiao-Yin, et al.
Veröffentlicht: (2023)
The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
von: Sims, Anya, et al.
Veröffentlicht: (2024)
von: Sims, Anya, et al.
Veröffentlicht: (2024)
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation
von: Cao, Hongye, et al.
Veröffentlicht: (2025)
von: Cao, Hongye, et al.
Veröffentlicht: (2025)
DiffCPS: Diffusion Model based Constrained Policy Search for Offline Reinforcement Learning
von: He, Longxiang, et al.
Veröffentlicht: (2023)
von: He, Longxiang, et al.
Veröffentlicht: (2023)
Cross-Domain Policy Adaptation by Capturing Representation Mismatch
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024)
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024)
Model-Based Offline Reinforcement Learning with Reliability-Guaranteed Sequence Modeling
von: He, Shenghong
Veröffentlicht: (2025)
von: He, Shenghong
Veröffentlicht: (2025)
Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach
von: Pan, Minting, et al.
Veröffentlicht: (2025)
von: Pan, Minting, et al.
Veröffentlicht: (2025)
Making Offline RL Online: Collaborative World Models for Offline Visual Reinforcement Learning
von: Wang, Qi, et al.
Veröffentlicht: (2023)
von: Wang, Qi, et al.
Veröffentlicht: (2023)
Long-Horizon Model-Based Offline Reinforcement Learning Without Explicit Conservatism
von: Ni, Tianwei, et al.
Veröffentlicht: (2025)
von: Ni, Tianwei, et al.
Veröffentlicht: (2025)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2025)
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2025)
Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions
von: Xu, Yinglun, et al.
Veröffentlicht: (2023)
von: Xu, Yinglun, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Mind the Model, Not the Agent: The Primacy Bias in Model-based RL
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2023) -
Efficient Cross-Domain Offline Reinforcement Learning with Dynamics- and Value-Aligned Data Filtering
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025) -
Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025) -
SEABO: A Simple Search-Based Method for Offline Imitation Learning
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024) -
Unifying Value Alignment and Assignment in Cross-Domain Offline Reinforcement Learning with Heterogeneous Datasets
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2026)