FAWAC: Feasibility Informed Advantage Weighted Regression for Persistent Safety in Offline Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Koirala, Prajwal, Jiang, Zhanhong, Sarkar, Soumik, Fleming, Cody |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Latent Safety-Constrained Policy Approach for Safe Offline Reinforcement Learning
by: Koirala, Prajwal, et al.
Published: (2024)
by: Koirala, Prajwal, et al.
Published: (2024)
LexiSafe: Offline Safe Reinforcement Learning with Lexicographic Safety-Reward Hierarchy
by: Yang, Hsin-Jung, et al.
Published: (2026)
by: Yang, Hsin-Jung, et al.
Published: (2026)
Solving Offline Reinforcement Learning with Decision Tree Regression
by: Koirala, Prajwal, et al.
Published: (2024)
by: Koirala, Prajwal, et al.
Published: (2024)
Neural CDEs as Correctors for Learned Time Series Models
by: Shahid, Muhammad Bilal, et al.
Published: (2025)
by: Shahid, Muhammad Bilal, et al.
Published: (2025)
Flow-Based Single-Step Completion for Efficient and Expressive Policy Learning
by: Koirala, Prajwal, et al.
Published: (2025)
by: Koirala, Prajwal, et al.
Published: (2025)
COOPO: Cyclic Offline-Online Policy Optimization Algorithm
by: Liu, Qisai, et al.
Published: (2026)
by: Liu, Qisai, et al.
Published: (2026)
F1tenth Autonomous Racing With Offline Reinforcement Learning Methods
by: Koirala, Prajwal, et al.
Published: (2024)
by: Koirala, Prajwal, et al.
Published: (2024)
Modular Diffusion Policy Training: Decoupling and Recombining Guidance and Diffusion for Offline RL
by: Chen, Zhaoyang, et al.
Published: (2025)
by: Chen, Zhaoyang, et al.
Published: (2025)
Asynchronous Training Schemes in Distributed Learning with Time Delay
by: Wang, Haoxiang, et al.
Published: (2022)
by: Wang, Haoxiang, et al.
Published: (2022)
Data-driven Kinematic Modeling in Soft Robots: System Identification and Uncertainty Quantification
by: Jiang, Zhanhong, et al.
Published: (2025)
by: Jiang, Zhanhong, et al.
Published: (2025)
LCLA: Language-Conditioned Latent Alignment for Vision-Language Navigation
by: Subedi, Nitesh, et al.
Published: (2026)
by: Subedi, Nitesh, et al.
Published: (2026)
Incorporating System-level Safety Requirements in Perception Models via Reinforcement Learning
by: Fan, Weisi, et al.
Published: (2024)
by: Fan, Weisi, et al.
Published: (2024)
TabQL: In-Context Q-Learning with Tabular Foundation Models
by: Liu, Qisai, et al.
Published: (2026)
by: Liu, Qisai, et al.
Published: (2026)
Active Advantage-Aligned Online Reinforcement Learning with Offline Data
by: Liu, Xuefeng, et al.
Published: (2025)
by: Liu, Xuefeng, et al.
Published: (2025)
Bidirectional Linear Recurrent Models for Sequence-Level Multisource Fusion
by: Liu, Qisai, et al.
Published: (2025)
by: Liu, Qisai, et al.
Published: (2025)
Balancing Utility and Privacy: Dynamically Private SGD with Random Projection
by: Jiang, Zhanhong, et al.
Published: (2025)
by: Jiang, Zhanhong, et al.
Published: (2025)
Taming OOD Actions for Offline Reinforcement Learning: An Advantage-Based Approach
by: Chen, Xuyang, et al.
Published: (2025)
by: Chen, Xuyang, et al.
Published: (2025)
Enhancing PPO with Trajectory-Aware Hybrid Policies
by: Liu, Qisai, et al.
Published: (2025)
by: Liu, Qisai, et al.
Published: (2025)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
by: Liu, Tenglong, et al.
Published: (2024)
by: Liu, Tenglong, et al.
Published: (2024)
ADKO: Agentic Decentralized Knowledge Optimization
by: Rillo, Lucas Nerone, et al.
Published: (2026)
by: Rillo, Lucas Nerone, et al.
Published: (2026)
DeCAF: Decentralized Consensus-And-Factorization for Low-Rank Adaptation of Foundation Models
by: Saadati, Nastaran, et al.
Published: (2025)
by: Saadati, Nastaran, et al.
Published: (2025)
Behavior Preference Regression for Offline Reinforcement Learning
by: Srinivasan, Padmanaba, et al.
Published: (2025)
by: Srinivasan, Padmanaba, et al.
Published: (2025)
Energy-Weighted Flow Matching for Offline Reinforcement Learning
by: Zhang, Shiyuan, et al.
Published: (2025)
by: Zhang, Shiyuan, et al.
Published: (2025)
Diffusion Self-Weighted Guidance for Offline Reinforcement Learning
by: Tagle, Augusto, et al.
Published: (2025)
by: Tagle, Augusto, et al.
Published: (2025)
Distributed Direct Preference Optimization
by: Jiang, Zhanhong
Published: (2026)
by: Jiang, Zhanhong
Published: (2026)
Can Pretrained Vision-Language Embeddings Alone Guide Robot Navigation?
by: Subedi, Nitesh, et al.
Published: (2025)
by: Subedi, Nitesh, et al.
Published: (2025)
Learning When to Act: Communication-Efficient Reinforcement Learning via Run-Time Assurance
by: Haroon, Adam, et al.
Published: (2026)
by: Haroon, Adam, et al.
Published: (2026)
Toward Faithful and Complete Answer Construction from a Single Document
by: Chen, Zhaoyang, et al.
Published: (2026)
by: Chen, Zhaoyang, et al.
Published: (2026)
FUSE: First-Order and Second-Order Unified SynthEsis in Stochastic Optimization
by: Jiang, Zhanhong, et al.
Published: (2025)
by: Jiang, Zhanhong, et al.
Published: (2025)
RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception
by: Waite, Joshua R., et al.
Published: (2025)
by: Waite, Joshua R., et al.
Published: (2025)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
by: Zheng, Yinan, et al.
Published: (2024)
by: Zheng, Yinan, et al.
Published: (2024)
CAWR: Corruption-Averse Advantage-Weighted Regression for Robust Policy Optimization
by: Hu, Ranting
Published: (2025)
by: Hu, Ranting
Published: (2025)
Adversarially Trained Weighted Actor-Critic for Safe Offline Reinforcement Learning
by: Wei, Honghao, et al.
Published: (2024)
by: Wei, Honghao, et al.
Published: (2024)
Path Learning with Trajectory Advantage Regression
by: Miyaguchi, Kohei
Published: (2025)
by: Miyaguchi, Kohei
Published: (2025)
Feasibility-Aware Pessimistic Estimation: Toward Long-Horizon Safety in Offline RL
by: Tao, Zhikun
Published: (2025)
by: Tao, Zhikun
Published: (2025)
Finer Behavioral Foundation Models via Auto-Regressive Features and Advantage Weighting
by: Cetin, Edoardo, et al.
Published: (2024)
by: Cetin, Edoardo, et al.
Published: (2024)
DIMAT: Decentralized Iterative Merging-And-Training for Deep Learning Models
by: Saadati, Nastaran, et al.
Published: (2024)
by: Saadati, Nastaran, et al.
Published: (2024)
HopCast: Calibration of Autoregressive Dynamics Models
by: Shahid, Muhammad Bilal, et al.
Published: (2025)
by: Shahid, Muhammad Bilal, et al.
Published: (2025)
A2PO: Towards Effective Offline Reinforcement Learning from an Advantage-aware Perspective
by: Qing, Yunpeng, et al.
Published: (2024)
by: Qing, Yunpeng, et al.
Published: (2024)
Sparsity-based Safety Conservatism for Constrained Offline Reinforcement Learning
by: Cho, Minjae, et al.
Published: (2024)
by: Cho, Minjae, et al.
Published: (2024)
Similar Items
-
Latent Safety-Constrained Policy Approach for Safe Offline Reinforcement Learning
by: Koirala, Prajwal, et al.
Published: (2024) -
LexiSafe: Offline Safe Reinforcement Learning with Lexicographic Safety-Reward Hierarchy
by: Yang, Hsin-Jung, et al.
Published: (2026) -
Solving Offline Reinforcement Learning with Decision Tree Regression
by: Koirala, Prajwal, et al.
Published: (2024) -
Neural CDEs as Correctors for Learned Time Series Models
by: Shahid, Muhammad Bilal, et al.
Published: (2025) -
Flow-Based Single-Step Completion for Efficient and Expressive Policy Learning
by: Koirala, Prajwal, et al.
Published: (2025)