Epigraph-Guided Flow Matching for Safe and Performant Offline Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Tayal, Manan, Tayal, Mumuksh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
di: Tayal, Mumuksh, et al.
Pubblicazione: (2026)
di: Tayal, Mumuksh, et al.
Pubblicazione: (2026)
V-OCBF: Learning Safety Filters from Offline Data via Value-Guided Offline Control Barrier Functions
di: Tayal, Mumuksh, et al.
Pubblicazione: (2025)
di: Tayal, Mumuksh, et al.
Pubblicazione: (2025)
RISE: Robust Imitation through Stochastic Encoding
di: Tayal, Mumuksh, et al.
Pubblicazione: (2025)
di: Tayal, Mumuksh, et al.
Pubblicazione: (2025)
A Fixed Parameter Tractable Approach for Solving the Vertex Cover Problem in Polynomial Time Complexity
di: Tayal, Mumuksh
Pubblicazione: (2025)
di: Tayal, Mumuksh
Pubblicazione: (2025)
MAD-PINN: A Decentralized Physics-Informed Machine Learning Framework for Safe and Optimal Multi-Agent Control
di: Tayal, Manan, et al.
Pubblicazione: (2025)
di: Tayal, Manan, et al.
Pubblicazione: (2025)
A Physics-Informed Machine Learning Framework for Safe and Optimal Control of Autonomous Systems
di: Tayal, Manan, et al.
Pubblicazione: (2025)
di: Tayal, Manan, et al.
Pubblicazione: (2025)
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
BiRoDiff: Diffusion policies for bipedal robot locomotion on unseen terrains
di: Mothish, GVS, et al.
Pubblicazione: (2024)
di: Mothish, GVS, et al.
Pubblicazione: (2024)
Online Optimization for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2025)
di: Chemingui, Yassine, et al.
Pubblicazione: (2025)
Lyapunov-Guided Self-Alignment: Test-Time Adaptation for Offline Safe Reinforcement Learning
di: Han, Seungyub, et al.
Pubblicazione: (2026)
di: Han, Seungyub, et al.
Pubblicazione: (2026)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
di: Alles, Marvin, et al.
Pubblicazione: (2025)
di: Alles, Marvin, et al.
Pubblicazione: (2025)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2026)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2026)
Offline Safe Reinforcement Learning Using Trajectory Classification
di: Gong, Ze, et al.
Pubblicazione: (2024)
di: Gong, Ze, et al.
Pubblicazione: (2024)
Evaluating Multi-Instance DNN Inferencing on Multiple Accelerators of an Edge Device
di: Tayal, Mumuksh, et al.
Pubblicazione: (2025)
di: Tayal, Mumuksh, et al.
Pubblicazione: (2025)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
di: Chen, Rufeng, et al.
Pubblicazione: (2026)
di: Chen, Rufeng, et al.
Pubblicazione: (2026)
Constraint-Adaptive Policy Switching for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2024)
di: Chemingui, Yassine, et al.
Pubblicazione: (2024)
Entropy-Regularized Adjoint Matching for Offline Reinforcement Learning
di: Ghanem, Abdelghani, et al.
Pubblicazione: (2026)
di: Ghanem, Abdelghani, et al.
Pubblicazione: (2026)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
di: Su, Huikang, et al.
Pubblicazione: (2025)
di: Su, Huikang, et al.
Pubblicazione: (2025)
Flow Actor-Critic for Offline Reinforcement Learning
di: Chae, Jongseong, et al.
Pubblicazione: (2026)
di: Chae, Jongseong, et al.
Pubblicazione: (2026)
Reinforcement Learning by Guided Safe Exploration
di: Yang, Qisong, et al.
Pubblicazione: (2023)
di: Yang, Qisong, et al.
Pubblicazione: (2023)
Safe Offline Reinforcement Learning with Real-Time Budget Constraints
di: Lin, Qian, et al.
Pubblicazione: (2023)
di: Lin, Qian, et al.
Pubblicazione: (2023)
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
di: Guo, Zijian, et al.
Pubblicazione: (2024)
di: Guo, Zijian, et al.
Pubblicazione: (2024)
Offline Inverse Constrained Reinforcement Learning for Safe-Critical Decision Making in Healthcare
di: Fang, Nan, et al.
Pubblicazione: (2024)
di: Fang, Nan, et al.
Pubblicazione: (2024)
Neural Control Barrier Functions from Physics Informed Neural Networks
di: Agrawal, Shreenabh, et al.
Pubblicazione: (2025)
di: Agrawal, Shreenabh, et al.
Pubblicazione: (2025)
CP-NCBF: A Conformal Prediction-based Approach to Synthesize Verified Neural Control Barrier Functions
di: Tayal, Manan, et al.
Pubblicazione: (2025)
di: Tayal, Manan, et al.
Pubblicazione: (2025)
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
di: Hu, Jifeng, et al.
Pubblicazione: (2025)
di: Hu, Jifeng, et al.
Pubblicazione: (2025)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
Beyond Hard Constraints: Budget-Conditioned Reachability For Safe Offline Reinforcement Learning
di: Brahmanage, Janaka Chathuranga, et al.
Pubblicazione: (2026)
di: Brahmanage, Janaka Chathuranga, et al.
Pubblicazione: (2026)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
Controllable Flow Matching for Online Reinforcement Learning
di: Wang, Bin, et al.
Pubblicazione: (2025)
di: Wang, Bin, et al.
Pubblicazione: (2025)
Safe Legged Locomotion using Collision Cone Control Barrier Functions (C3BFs)
di: Tayal, Manan, et al.
Pubblicazione: (2023)
di: Tayal, Manan, et al.
Pubblicazione: (2023)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
FlowCritic: Bridging Value Estimation with Flow Matching in Reinforcement Learning
di: Zhong, Shan, et al.
Pubblicazione: (2025)
di: Zhong, Shan, et al.
Pubblicazione: (2025)
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning
di: Guo, Siyuan, et al.
Pubblicazione: (2023)
di: Guo, Siyuan, et al.
Pubblicazione: (2023)
Safe Deployment of Offline Reinforcement Learning via Input Convex Action Correction
di: Durkin, Alex, et al.
Pubblicazione: (2025)
di: Durkin, Alex, et al.
Pubblicazione: (2025)
SafeMIL: Learning Offline Safe Imitation Policy from Non-Preferred Trajectories
di: Burnwal, Returaj, et al.
Pubblicazione: (2025)
di: Burnwal, Returaj, et al.
Pubblicazione: (2025)
Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL
di: Zhang, Songyuan, et al.
Pubblicazione: (2025)
di: Zhang, Songyuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
di: Tayal, Mumuksh, et al.
Pubblicazione: (2026) -
V-OCBF: Learning Safety Filters from Offline Data via Value-Guided Offline Control Barrier Functions
di: Tayal, Mumuksh, et al.
Pubblicazione: (2025) -
RISE: Robust Imitation through Stochastic Encoding
di: Tayal, Mumuksh, et al.
Pubblicazione: (2025) -
A Fixed Parameter Tractable Approach for Solving the Vertex Cover Problem in Polynomial Time Complexity
di: Tayal, Mumuksh
Pubblicazione: (2025) -
MAD-PINN: A Decentralized Physics-Informed Machine Learning Framework for Safe and Optimal Multi-Agent Control
di: Tayal, Manan, et al.
Pubblicazione: (2025)