OASIS: Conditional Distribution Shaping for Offline Safe Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Yao, Yihang, Cen, Zhepeng, Ding, Wenhao, Lin, Haohong, Liu, Shiqi, Zhang, Tingnan, Yu, Wenhao, Zhao, Ding |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
di: Yao, Yihang, et al.
Pubblicazione: (2023)
di: Yao, Yihang, et al.
Pubblicazione: (2023)
Feasibility Consistent Representation Learning for Safe Reinforcement Learning
di: Cen, Zhepeng, et al.
Pubblicazione: (2024)
di: Cen, Zhepeng, et al.
Pubblicazione: (2024)
Behavior Injection: Preparing Language Models for Reinforcement Learning
di: Cen, Zhepeng, et al.
Pubblicazione: (2025)
di: Cen, Zhepeng, et al.
Pubblicazione: (2025)
Learning from Sparse Offline Datasets via Conservative Density Estimation
di: Cen, Zhepeng, et al.
Pubblicazione: (2024)
di: Cen, Zhepeng, et al.
Pubblicazione: (2024)
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
di: Lin, Haohong, et al.
Pubblicazione: (2023)
di: Lin, Haohong, et al.
Pubblicazione: (2023)
BECAUSE: Bilinear Causal Representation for Generalizable Offline Model-based Reinforcement Learning
di: Lin, Haohong, et al.
Pubblicazione: (2024)
di: Lin, Haohong, et al.
Pubblicazione: (2024)
Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization
di: Yao, Yihang, et al.
Pubblicazione: (2026)
di: Yao, Yihang, et al.
Pubblicazione: (2026)
QuietPaw: Learning Quadrupedal Locomotion with Versatile Noise Preference Alignment
di: Zhang, Yuyou, et al.
Pubblicazione: (2025)
di: Zhang, Yuyou, et al.
Pubblicazione: (2025)
Query-Centric Diffusion Policy for Generalizable Robotic Assembly
di: Xu, Ziyi, et al.
Pubblicazione: (2025)
di: Xu, Ziyi, et al.
Pubblicazione: (2025)
Learning Multi-Agent Loco-Manipulation for Long-Horizon Quadrupedal Pushing
di: Feng, Yuming, et al.
Pubblicazione: (2024)
di: Feng, Yuming, et al.
Pubblicazione: (2024)
Privacy Risks in Reinforcement Learning for Household Robots
di: Li, Miao, et al.
Pubblicazione: (2023)
di: Li, Miao, et al.
Pubblicazione: (2023)
Generalize by Touching: Tactile Ensemble Skill Transfer for Robotic Furniture Assembly
di: Lin, Haohong, et al.
Pubblicazione: (2024)
di: Lin, Haohong, et al.
Pubblicazione: (2024)
Unveiling Markov Heads in Pretrained Language Models for Offline Reinforcement Learning
di: Zhao, Wenhao, et al.
Pubblicazione: (2024)
di: Zhao, Wenhao, et al.
Pubblicazione: (2024)
Estimation and Inference in Distributional Reinforcement Learning
di: Zhang, Liangyu, et al.
Pubblicazione: (2023)
di: Zhang, Liangyu, et al.
Pubblicazione: (2023)
Meta-DT: Offline Meta-RL as Conditional Sequence Modeling with World Model Disentanglement
di: Wang, Zhi, et al.
Pubblicazione: (2024)
di: Wang, Zhi, et al.
Pubblicazione: (2024)
Extreme Value Policy Optimization for Safe Reinforcement Learning
di: Gao, Shiqing, et al.
Pubblicazione: (2026)
di: Gao, Shiqing, et al.
Pubblicazione: (2026)
Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition
di: Qiao, Dan, et al.
Pubblicazione: (2025)
di: Qiao, Dan, et al.
Pubblicazione: (2025)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
di: Su, Huikang, et al.
Pubblicazione: (2025)
di: Su, Huikang, et al.
Pubblicazione: (2025)
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
di: Guo, Zijian, et al.
Pubblicazione: (2024)
di: Guo, Zijian, et al.
Pubblicazione: (2024)
Tailored Primitive Initialization is the Secret Key to Reinforcement Learning
di: Yao, Yihang, et al.
Pubblicazione: (2025)
di: Yao, Yihang, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Imbalanced Datasets
di: Jiang, Li, et al.
Pubblicazione: (2023)
di: Jiang, Li, et al.
Pubblicazione: (2023)
Soft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement Learning
di: Wang, Shudong, et al.
Pubblicazione: (2025)
di: Wang, Shudong, et al.
Pubblicazione: (2025)
Safe Offline Reinforcement Learning with Real-Time Budget Constraints
di: Lin, Qian, et al.
Pubblicazione: (2023)
di: Lin, Qian, et al.
Pubblicazione: (2023)
Beyond Hard Constraints: Budget-Conditioned Reachability For Safe Offline Reinforcement Learning
di: Brahmanage, Janaka Chathuranga, et al.
Pubblicazione: (2026)
di: Brahmanage, Janaka Chathuranga, et al.
Pubblicazione: (2026)
CO-RFT: Efficient Fine-Tuning of Vision-Language-Action Models through Chunked Offline Reinforcement Learning
di: Huang, Dongchi, et al.
Pubblicazione: (2025)
di: Huang, Dongchi, et al.
Pubblicazione: (2025)
CrashAgent: Crash Scenario Generation via Multi-modal Reasoning
di: Li, Miao, et al.
Pubblicazione: (2025)
di: Li, Miao, et al.
Pubblicazione: (2025)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
Online Optimization for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2025)
di: Chemingui, Yassine, et al.
Pubblicazione: (2025)
Adversarially Trained Weighted Actor-Critic for Safe Offline Reinforcement Learning
di: Wei, Honghao, et al.
Pubblicazione: (2024)
di: Wei, Honghao, et al.
Pubblicazione: (2024)
LexiSafe: Offline Safe Reinforcement Learning with Lexicographic Safety-Reward Hierarchy
di: Yang, Hsin-Jung, et al.
Pubblicazione: (2026)
di: Yang, Hsin-Jung, et al.
Pubblicazione: (2026)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
di: Liu, Zongkai, et al.
Pubblicazione: (2024)
di: Liu, Zongkai, et al.
Pubblicazione: (2024)
Mean-Field Diffuser: Scaling Offline MARL to Thousands of Agents
di: Li, Wenhao, et al.
Pubblicazione: (2026)
di: Li, Wenhao, et al.
Pubblicazione: (2026)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
di: Venugopal, Aravind, et al.
Pubblicazione: (2026)
di: Venugopal, Aravind, et al.
Pubblicazione: (2026)
Two-Stage Generative Model for Intracranial Aneurysm Meshes with Morphological Marker Conditioning
di: Ding, Wenhao, et al.
Pubblicazione: (2025)
di: Ding, Wenhao, et al.
Pubblicazione: (2025)
Group Distributionally Robust Optimization-Driven Reinforcement Learning for LLM Reasoning
di: Panaganti, Kishan, et al.
Pubblicazione: (2026)
di: Panaganti, Kishan, et al.
Pubblicazione: (2026)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
di: Chen, Rufeng, et al.
Pubblicazione: (2026)
di: Chen, Rufeng, et al.
Pubblicazione: (2026)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
CS-GBA: A Critical Sample-based Gradient-guided Backdoor Attack for Offline Reinforcement Learning
di: Zhao, Yuanjie, et al.
Pubblicazione: (2026)
di: Zhao, Yuanjie, et al.
Pubblicazione: (2026)
ReCode: Updating Code API Knowledge with Reinforcement Learning
di: Wu, Haoze, et al.
Pubblicazione: (2025)
di: Wu, Haoze, et al.
Pubblicazione: (2025)
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies
di: Yan, Runze, et al.
Pubblicazione: (2025)
di: Yan, Runze, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
di: Yao, Yihang, et al.
Pubblicazione: (2023) -
Feasibility Consistent Representation Learning for Safe Reinforcement Learning
di: Cen, Zhepeng, et al.
Pubblicazione: (2024) -
Behavior Injection: Preparing Language Models for Reinforcement Learning
di: Cen, Zhepeng, et al.
Pubblicazione: (2025) -
Learning from Sparse Offline Datasets via Conservative Density Estimation
di: Cen, Zhepeng, et al.
Pubblicazione: (2024) -
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
di: Lin, Haohong, et al.
Pubblicazione: (2023)