Learning from Sparse Offline Datasets via Conservative Density Estimation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Cen, Zhepeng, Liu, Zuxin, Wang, Zitong, Yao, Yihang, Lam, Henry, Zhao, Ding |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Behavior Injection: Preparing Language Models for Reinforcement Learning
von: Cen, Zhepeng, et al.
Veröffentlicht: (2025)
von: Cen, Zhepeng, et al.
Veröffentlicht: (2025)
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
von: Yao, Yihang, et al.
Veröffentlicht: (2023)
von: Yao, Yihang, et al.
Veröffentlicht: (2023)
Feasibility Consistent Representation Learning for Safe Reinforcement Learning
von: Cen, Zhepeng, et al.
Veröffentlicht: (2024)
von: Cen, Zhepeng, et al.
Veröffentlicht: (2024)
Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization
von: Yao, Yihang, et al.
Veröffentlicht: (2026)
von: Yao, Yihang, et al.
Veröffentlicht: (2026)
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
von: Lin, Haohong, et al.
Veröffentlicht: (2023)
von: Lin, Haohong, et al.
Veröffentlicht: (2023)
OASIS: Conditional Distribution Shaping for Offline Safe Reinforcement Learning
von: Yao, Yihang, et al.
Veröffentlicht: (2024)
von: Yao, Yihang, et al.
Veröffentlicht: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
von: Jiang, Li, et al.
Veröffentlicht: (2023)
von: Jiang, Li, et al.
Veröffentlicht: (2023)
EXTRACT: Efficient Policy Learning by Extracting Transferable Robot Skills from Offline Data
von: Zhang, Jesse, et al.
Veröffentlicht: (2024)
von: Zhang, Jesse, et al.
Veröffentlicht: (2024)
Dataset Distillation for Offline Reinforcement Learning
von: Light, Jonathan, et al.
Veröffentlicht: (2024)
von: Light, Jonathan, et al.
Veröffentlicht: (2024)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
von: Lyu, Jiafei, et al.
Veröffentlicht: (2022)
von: Lyu, Jiafei, et al.
Veröffentlicht: (2022)
TAIL: Task-specific Adapters for Imitation Learning with Large Pretrained Models
von: Liu, Zuxin, et al.
Veröffentlicht: (2023)
von: Liu, Zuxin, et al.
Veröffentlicht: (2023)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
von: Wu, Kun, et al.
Veröffentlicht: (2024)
von: Wu, Kun, et al.
Veröffentlicht: (2024)
Mildly Conservative Regularized Evaluation for Offline Reinforcement Learning
von: Chen, Haohui, et al.
Veröffentlicht: (2025)
von: Chen, Haohui, et al.
Veröffentlicht: (2025)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
von: Yang, Yiqin, et al.
Veröffentlicht: (2026)
von: Yang, Yiqin, et al.
Veröffentlicht: (2026)
In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
von: Tu, Songjun, et al.
Veröffentlicht: (2024)
von: Tu, Songjun, et al.
Veröffentlicht: (2024)
MICRO: Model-Based Offline Reinforcement Learning with a Conservative Bellman Operator
von: Liu, Xiao-Yin, et al.
Veröffentlicht: (2023)
von: Liu, Xiao-Yin, et al.
Veröffentlicht: (2023)
CROP: Conservative Reward for Model-based Offline Policy Optimization
von: Li, Hao, et al.
Veröffentlicht: (2023)
von: Li, Hao, et al.
Veröffentlicht: (2023)
Offline Reinforcement Learning from Datasets with Structured Non-Stationarity
von: Ackermann, Johannes, et al.
Veröffentlicht: (2024)
von: Ackermann, Johannes, et al.
Veröffentlicht: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
von: Zhang, Tianle, et al.
Veröffentlicht: (2024)
von: Zhang, Tianle, et al.
Veröffentlicht: (2024)
MOSAIC: Module Discovery via Sparse Additive Identifiable Causal Learning for Scientific Time Series
von: Fan, Shicheng, et al.
Veröffentlicht: (2026)
von: Fan, Shicheng, et al.
Veröffentlicht: (2026)
DARE: Difficulty-Adaptive Reinforcement Learning with Co-Evolved Difficulty Estimation
von: Zhou, Yang, et al.
Veröffentlicht: (2026)
von: Zhou, Yang, et al.
Veröffentlicht: (2026)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
von: Liu, Zeyuan, et al.
Veröffentlicht: (2025)
von: Liu, Zeyuan, et al.
Veröffentlicht: (2025)
BECAUSE: Bilinear Causal Representation for Generalizable Offline Model-based Reinforcement Learning
von: Lin, Haohong, et al.
Veröffentlicht: (2024)
von: Lin, Haohong, et al.
Veröffentlicht: (2024)
Black-Box Optimization From Small Offline Datasets via Meta Learning with Synthetic Tasks
von: Fadhel, Azza, et al.
Veröffentlicht: (2026)
von: Fadhel, Azza, et al.
Veröffentlicht: (2026)
Hokoff: Real Game Dataset from Honor of Kings and its Offline Reinforcement Learning Benchmarks
von: Qu, Yun, et al.
Veröffentlicht: (2024)
von: Qu, Yun, et al.
Veröffentlicht: (2024)
Sparse-Reg: Improving Sample Complexity in Offline Reinforcement Learning using Sparsity
von: Arnob, Samin Yeasar, et al.
Veröffentlicht: (2025)
von: Arnob, Samin Yeasar, et al.
Veröffentlicht: (2025)
Budgeting Counterfactual for Offline RL
von: Liu, Yao, et al.
Veröffentlicht: (2023)
von: Liu, Yao, et al.
Veröffentlicht: (2023)
Robotic Manipulation Datasets for Offline Compositional Reinforcement Learning
von: Hussing, Marcel, et al.
Veröffentlicht: (2023)
von: Hussing, Marcel, et al.
Veröffentlicht: (2023)
COSBO: Conservative Offline Simulation-Based Policy Optimization
von: Kargar, Eshagh, et al.
Veröffentlicht: (2024)
von: Kargar, Eshagh, et al.
Veröffentlicht: (2024)
Listwise Reward Estimation for Offline Preference-based Reinforcement Learning
von: Choi, Heewoong, et al.
Veröffentlicht: (2024)
von: Choi, Heewoong, et al.
Veröffentlicht: (2024)
An Efficient Sparse Fine-Tuning with Low Quantization Error via Neural Network Pruning
von: Li, Cen-Jhih, et al.
Veröffentlicht: (2025)
von: Li, Cen-Jhih, et al.
Veröffentlicht: (2025)
A Dual Approach to Imitation Learning from Observations with Offline Datasets
von: Sikchi, Harshit, et al.
Veröffentlicht: (2024)
von: Sikchi, Harshit, et al.
Veröffentlicht: (2024)
BAFFLE: Hiding Backdoors in Offline Reinforcement Learning Datasets
von: Gong, Chen, et al.
Veröffentlicht: (2022)
von: Gong, Chen, et al.
Veröffentlicht: (2022)
Continual Offline Reinforcement Learning via Diffusion-based Dual Generative Replay
von: Liu, Jinmei, et al.
Veröffentlicht: (2024)
von: Liu, Jinmei, et al.
Veröffentlicht: (2024)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
von: Liu, Wenhui, et al.
Veröffentlicht: (2025)
von: Liu, Wenhui, et al.
Veröffentlicht: (2025)
Offline Imitation of Badminton Player Behavior via Experiential Contexts and Brownian Motion
von: Wang, Kuang-Da, et al.
Veröffentlicht: (2024)
von: Wang, Kuang-Da, et al.
Veröffentlicht: (2024)
MallowsPO: Fine-Tune Your LLM with Preference Dispersions
von: Chen, Haoxian, et al.
Veröffentlicht: (2024)
von: Chen, Haoxian, et al.
Veröffentlicht: (2024)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
von: Yang, Letian, et al.
Veröffentlicht: (2026)
von: Yang, Letian, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Behavior Injection: Preparing Language Models for Reinforcement Learning
von: Cen, Zhepeng, et al.
Veröffentlicht: (2025) -
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
von: Yao, Yihang, et al.
Veröffentlicht: (2023) -
Feasibility Consistent Representation Learning for Safe Reinforcement Learning
von: Cen, Zhepeng, et al.
Veröffentlicht: (2024) -
Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization
von: Yao, Yihang, et al.
Veröffentlicht: (2026) -
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
von: Lin, Haohong, et al.
Veröffentlicht: (2023)