OASIS: Conditional Distribution Shaping for Offline Safe Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yao, Yihang, Cen, Zhepeng, Ding, Wenhao, Lin, Haohong, Liu, Shiqi, Zhang, Tingnan, Yu, Wenhao, Zhao, Ding |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
von: Yao, Yihang, et al.
Veröffentlicht: (2023)
von: Yao, Yihang, et al.
Veröffentlicht: (2023)
Feasibility Consistent Representation Learning for Safe Reinforcement Learning
von: Cen, Zhepeng, et al.
Veröffentlicht: (2024)
von: Cen, Zhepeng, et al.
Veröffentlicht: (2024)
Behavior Injection: Preparing Language Models for Reinforcement Learning
von: Cen, Zhepeng, et al.
Veröffentlicht: (2025)
von: Cen, Zhepeng, et al.
Veröffentlicht: (2025)
Learning from Sparse Offline Datasets via Conservative Density Estimation
von: Cen, Zhepeng, et al.
Veröffentlicht: (2024)
von: Cen, Zhepeng, et al.
Veröffentlicht: (2024)
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
von: Lin, Haohong, et al.
Veröffentlicht: (2023)
von: Lin, Haohong, et al.
Veröffentlicht: (2023)
BECAUSE: Bilinear Causal Representation for Generalizable Offline Model-based Reinforcement Learning
von: Lin, Haohong, et al.
Veröffentlicht: (2024)
von: Lin, Haohong, et al.
Veröffentlicht: (2024)
Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization
von: Yao, Yihang, et al.
Veröffentlicht: (2026)
von: Yao, Yihang, et al.
Veröffentlicht: (2026)
QuietPaw: Learning Quadrupedal Locomotion with Versatile Noise Preference Alignment
von: Zhang, Yuyou, et al.
Veröffentlicht: (2025)
von: Zhang, Yuyou, et al.
Veröffentlicht: (2025)
Query-Centric Diffusion Policy for Generalizable Robotic Assembly
von: Xu, Ziyi, et al.
Veröffentlicht: (2025)
von: Xu, Ziyi, et al.
Veröffentlicht: (2025)
Learning Multi-Agent Loco-Manipulation for Long-Horizon Quadrupedal Pushing
von: Feng, Yuming, et al.
Veröffentlicht: (2024)
von: Feng, Yuming, et al.
Veröffentlicht: (2024)
Privacy Risks in Reinforcement Learning for Household Robots
von: Li, Miao, et al.
Veröffentlicht: (2023)
von: Li, Miao, et al.
Veröffentlicht: (2023)
Generalize by Touching: Tactile Ensemble Skill Transfer for Robotic Furniture Assembly
von: Lin, Haohong, et al.
Veröffentlicht: (2024)
von: Lin, Haohong, et al.
Veröffentlicht: (2024)
Unveiling Markov Heads in Pretrained Language Models for Offline Reinforcement Learning
von: Zhao, Wenhao, et al.
Veröffentlicht: (2024)
von: Zhao, Wenhao, et al.
Veröffentlicht: (2024)
Estimation and Inference in Distributional Reinforcement Learning
von: Zhang, Liangyu, et al.
Veröffentlicht: (2023)
von: Zhang, Liangyu, et al.
Veröffentlicht: (2023)
Meta-DT: Offline Meta-RL as Conditional Sequence Modeling with World Model Disentanglement
von: Wang, Zhi, et al.
Veröffentlicht: (2024)
von: Wang, Zhi, et al.
Veröffentlicht: (2024)
Extreme Value Policy Optimization for Safe Reinforcement Learning
von: Gao, Shiqing, et al.
Veröffentlicht: (2026)
von: Gao, Shiqing, et al.
Veröffentlicht: (2026)
Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition
von: Qiao, Dan, et al.
Veröffentlicht: (2025)
von: Qiao, Dan, et al.
Veröffentlicht: (2025)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
von: Su, Huikang, et al.
Veröffentlicht: (2025)
von: Su, Huikang, et al.
Veröffentlicht: (2025)
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
von: Guo, Zijian, et al.
Veröffentlicht: (2024)
von: Guo, Zijian, et al.
Veröffentlicht: (2024)
Tailored Primitive Initialization is the Secret Key to Reinforcement Learning
von: Yao, Yihang, et al.
Veröffentlicht: (2025)
von: Yao, Yihang, et al.
Veröffentlicht: (2025)
Offline Reinforcement Learning with Imbalanced Datasets
von: Jiang, Li, et al.
Veröffentlicht: (2023)
von: Jiang, Li, et al.
Veröffentlicht: (2023)
Soft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement Learning
von: Wang, Shudong, et al.
Veröffentlicht: (2025)
von: Wang, Shudong, et al.
Veröffentlicht: (2025)
Safe Offline Reinforcement Learning with Real-Time Budget Constraints
von: Lin, Qian, et al.
Veröffentlicht: (2023)
von: Lin, Qian, et al.
Veröffentlicht: (2023)
Beyond Hard Constraints: Budget-Conditioned Reachability For Safe Offline Reinforcement Learning
von: Brahmanage, Janaka Chathuranga, et al.
Veröffentlicht: (2026)
von: Brahmanage, Janaka Chathuranga, et al.
Veröffentlicht: (2026)
CO-RFT: Efficient Fine-Tuning of Vision-Language-Action Models through Chunked Offline Reinforcement Learning
von: Huang, Dongchi, et al.
Veröffentlicht: (2025)
von: Huang, Dongchi, et al.
Veröffentlicht: (2025)
CrashAgent: Crash Scenario Generation via Multi-modal Reasoning
von: Li, Miao, et al.
Veröffentlicht: (2025)
von: Li, Miao, et al.
Veröffentlicht: (2025)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
von: Zheng, Yinan, et al.
Veröffentlicht: (2024)
von: Zheng, Yinan, et al.
Veröffentlicht: (2024)
Online Optimization for Offline Safe Reinforcement Learning
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
Adversarially Trained Weighted Actor-Critic for Safe Offline Reinforcement Learning
von: Wei, Honghao, et al.
Veröffentlicht: (2024)
von: Wei, Honghao, et al.
Veröffentlicht: (2024)
LexiSafe: Offline Safe Reinforcement Learning with Lexicographic Safety-Reward Hierarchy
von: Yang, Hsin-Jung, et al.
Veröffentlicht: (2026)
von: Yang, Hsin-Jung, et al.
Veröffentlicht: (2026)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
Mean-Field Diffuser: Scaling Offline MARL to Thousands of Agents
von: Li, Wenhao, et al.
Veröffentlicht: (2026)
von: Li, Wenhao, et al.
Veröffentlicht: (2026)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026)
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026)
Two-Stage Generative Model for Intracranial Aneurysm Meshes with Morphological Marker Conditioning
von: Ding, Wenhao, et al.
Veröffentlicht: (2025)
von: Ding, Wenhao, et al.
Veröffentlicht: (2025)
Group Distributionally Robust Optimization-Driven Reinforcement Learning for LLM Reasoning
von: Panaganti, Kishan, et al.
Veröffentlicht: (2026)
von: Panaganti, Kishan, et al.
Veröffentlicht: (2026)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
von: Chen, Rufeng, et al.
Veröffentlicht: (2026)
von: Chen, Rufeng, et al.
Veröffentlicht: (2026)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
von: Zhang, Tianle, et al.
Veröffentlicht: (2024)
von: Zhang, Tianle, et al.
Veröffentlicht: (2024)
CS-GBA: A Critical Sample-based Gradient-guided Backdoor Attack for Offline Reinforcement Learning
von: Zhao, Yuanjie, et al.
Veröffentlicht: (2026)
von: Zhao, Yuanjie, et al.
Veröffentlicht: (2026)
ReCode: Updating Code API Knowledge with Reinforcement Learning
von: Wu, Haoze, et al.
Veröffentlicht: (2025)
von: Wu, Haoze, et al.
Veröffentlicht: (2025)
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
von: Yan, Runze, et al.
Veröffentlicht: (2025)
von: Yan, Runze, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
von: Yao, Yihang, et al.
Veröffentlicht: (2023) -
Feasibility Consistent Representation Learning for Safe Reinforcement Learning
von: Cen, Zhepeng, et al.
Veröffentlicht: (2024) -
Behavior Injection: Preparing Language Models for Reinforcement Learning
von: Cen, Zhepeng, et al.
Veröffentlicht: (2025) -
Learning from Sparse Offline Datasets via Conservative Density Estimation
von: Cen, Zhepeng, et al.
Veröffentlicht: (2024) -
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
von: Lin, Haohong, et al.
Veröffentlicht: (2023)