Safe Domain Randomization via Uncertainty-Aware Out-of-Distribution Detection and Policy Adaptation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Danesh, Mohamad H., Wabartha, Maxime, Wu, Stanley, Pineau, Joelle, Lin, Hsiu-Chin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Contractive Diffusion Policies: Robust Action Diffusion via Contractive Score-Based Sampling with Differential Equations
par: Abyaneh, Amin, et autres
Publié: (2026)
par: Abyaneh, Amin, et autres
Publié: (2026)
Toward Hardware-Agnostic Quadrupedal World Models via Morphology Conditioning
par: Danesh, Mohamad H., et autres
Publié: (2026)
par: Danesh, Mohamad H., et autres
Publié: (2026)
Contractive Dynamical Imitation Policies for Efficient Out-of-Sample Recovery
par: Abyaneh, Amin, et autres
Publié: (2024)
par: Abyaneh, Amin, et autres
Publié: (2024)
Globally Stable Neural Imitation Policies
par: Abyaneh, Amin, et autres
Publié: (2024)
par: Abyaneh, Amin, et autres
Publié: (2024)
VOCALoco: Viability-Optimized Cost-aware Adaptive Locomotion
par: Wu, Stanley, et autres
Publié: (2025)
par: Wu, Stanley, et autres
Publié: (2025)
SLowRL: Safe Low-Rank Adaptation Reinforcement Learning for Locomotion
par: Daneshmand, Elham, et autres
Publié: (2026)
par: Daneshmand, Elham, et autres
Publié: (2026)
Safe Deep Policy Adaptation
par: Xiao, Wenli, et autres
Publié: (2023)
par: Xiao, Wenli, et autres
Publié: (2023)
Single-Shot Learning of Stable Dynamical Systems for Long-Horizon Manipulation Tasks
par: St-Aubin, Alexandre, et autres
Publié: (2024)
par: St-Aubin, Alexandre, et autres
Publié: (2024)
When to Act, Ask, or Learn: Uncertainty-Aware Policy Steering
par: Yuan, Jessie, et autres
Publié: (2026)
par: Yuan, Jessie, et autres
Publié: (2026)
Improving Generalization in Reinforcement Learning Training Regimes for Social Robot Navigation
par: Sigal, Adam, et autres
Publié: (2023)
par: Sigal, Adam, et autres
Publié: (2023)
In-Context Policy Adaptation via Cross-Domain Skill Diffusion
par: Yoo, Minjong, et autres
Publié: (2025)
par: Yoo, Minjong, et autres
Publié: (2025)
Uncertainty-Aware Deployment of Pre-trained Language-Conditioned Imitation Learning Policies
par: Wu, Bo, et autres
Publié: (2024)
par: Wu, Bo, et autres
Publié: (2024)
Safe Policy Exploration Improvement via Subgoals
par: Angulo, Brian, et autres
Publié: (2024)
par: Angulo, Brian, et autres
Publié: (2024)
Safe Exploration via Policy Priors
par: Wendl, Manuel, et autres
Publié: (2026)
par: Wendl, Manuel, et autres
Publié: (2026)
Domain Randomization via Entropy Maximization
par: Tiboni, Gabriele, et autres
Publié: (2023)
par: Tiboni, Gabriele, et autres
Publié: (2023)
Uncertainty-aware Latent Safety Filters for Avoiding Out-of-Distribution Failures
par: Seo, Junwon, et autres
Publié: (2025)
par: Seo, Junwon, et autres
Publié: (2025)
The Role of Domain Randomization in Training Diffusion Policies for Whole-Body Humanoid Control
par: Kaidanov, Oleg, et autres
Publié: (2024)
par: Kaidanov, Oleg, et autres
Publié: (2024)
Can We Detect Failures Without Failure Data? Uncertainty-Aware Runtime Failure Detection for Imitation Learning Policies
par: Xu, Chen, et autres
Publié: (2025)
par: Xu, Chen, et autres
Publié: (2025)
DADP: Domain Adaptive Diffusion Policy
par: Wang, Pengcheng, et autres
Publié: (2026)
par: Wang, Pengcheng, et autres
Publié: (2026)
FOSP: Fine-tuning Offline Safe Policy through World Models
par: Cao, Chenyang, et autres
Publié: (2024)
par: Cao, Chenyang, et autres
Publié: (2024)
Dynamic Aware: Adaptive Multi-Mode Out-of-Distribution Detection for Trajectory Prediction in Autonomous Vehicles
par: Guo, Tongfei, et autres
Publié: (2025)
par: Guo, Tongfei, et autres
Publié: (2025)
Handling Long-Term Safety and Uncertainty in Safe Reinforcement Learning
par: Günster, Jonas, et autres
Publié: (2024)
par: Günster, Jonas, et autres
Publié: (2024)
RAPT: Model-Predictive Out-of-Distribution Detection and Failure Diagnosis for Sim-to-Real Humanoid Robots
par: Munn, Humphrey, et autres
Publié: (2026)
par: Munn, Humphrey, et autres
Publié: (2026)
Learning Lyapunov-Stable Polynomial Dynamical Systems through Imitation
par: Abyaneh, Amin, et autres
Publié: (2023)
par: Abyaneh, Amin, et autres
Publié: (2023)
xTED: Cross-Domain Adaptation via Diffusion-Based Trajectory Editing
par: Niu, Haoyi, et autres
Publié: (2024)
par: Niu, Haoyi, et autres
Publié: (2024)
Policy Adaptation via Language Optimization: Decomposing Tasks for Few-Shot Imitation
par: Myers, Vivek, et autres
Publié: (2024)
par: Myers, Vivek, et autres
Publié: (2024)
Prompt-Driven Domain Adaptation for End-to-End Autonomous Driving via In-Context RL
par: Khurram, Aleesha, et autres
Publié: (2025)
par: Khurram, Aleesha, et autres
Publié: (2025)
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning
par: Ada, Suzan Ece, et autres
Publié: (2023)
par: Ada, Suzan Ece, et autres
Publié: (2023)
Score and Distribution Matching Policy: Advanced Accelerated Visuomotor Policies via Matched Distillation
par: Jia, Bofang, et autres
Publié: (2024)
par: Jia, Bofang, et autres
Publié: (2024)
Off-Policy Safe Reinforcement Learning with Constrained Optimistic Exploration
par: Li, Guopeng, et autres
Publié: (2026)
par: Li, Guopeng, et autres
Publié: (2026)
Uncertainty-Aware Trajectory Prediction via Rule-Regularized Heteroscedastic Deep Classification
par: Manas, Kumar, et autres
Publié: (2025)
par: Manas, Kumar, et autres
Publié: (2025)
LoopSR: Looping Sim-and-Real for Lifelong Policy Adaptation of Legged Robots
par: Wu, Peilin, et autres
Publié: (2024)
par: Wu, Peilin, et autres
Publié: (2024)
Statistical Guarantees for Offline Domain Randomization
par: Fickinger, Arnaud, et autres
Publié: (2025)
par: Fickinger, Arnaud, et autres
Publié: (2025)
Drift Q-Learning
par: Houssaini, Anas, et autres
Publié: (2026)
par: Houssaini, Anas, et autres
Publié: (2026)
Learning Safe Autonomous Driving Policies Using Predictive Safety Representations
par: Keswani, Mahesh, et autres
Publié: (2025)
par: Keswani, Mahesh, et autres
Publié: (2025)
Problem Space Transformations for Out-of-Distribution Generalisation in Behavioural Cloning
par: Doshi, Kiran, et autres
Publié: (2024)
par: Doshi, Kiran, et autres
Publié: (2024)
Digital Twin-based Out-of-Distribution Detection in Autonomous Vessels
par: Isaku, Erblin, et autres
Publié: (2025)
par: Isaku, Erblin, et autres
Publié: (2025)
Robust Adversarial Policy Optimization Under Dynamics Uncertainty
par: Kim, Mintae, et autres
Publié: (2026)
par: Kim, Mintae, et autres
Publié: (2026)
SATA: Safe and Adaptive Torque-Based Locomotion Policies Inspired by Animal Learning
par: Li, Peizhuo, et autres
Publié: (2025)
par: Li, Peizhuo, et autres
Publié: (2025)
Domains as Objectives: Domain-Uncertainty-Aware Policy Optimization through Explicit Multi-Domain Convex Coverage Set Learning
par: Ilboudo, Wendyam Eric Lionel, et autres
Publié: (2024)
par: Ilboudo, Wendyam Eric Lionel, et autres
Publié: (2024)
Documents similaires
-
Contractive Diffusion Policies: Robust Action Diffusion via Contractive Score-Based Sampling with Differential Equations
par: Abyaneh, Amin, et autres
Publié: (2026) -
Toward Hardware-Agnostic Quadrupedal World Models via Morphology Conditioning
par: Danesh, Mohamad H., et autres
Publié: (2026) -
Contractive Dynamical Imitation Policies for Efficient Out-of-Sample Recovery
par: Abyaneh, Amin, et autres
Publié: (2024) -
Globally Stable Neural Imitation Policies
par: Abyaneh, Amin, et autres
Publié: (2024) -
VOCALoco: Viability-Optimized Cost-aware Adaptive Locomotion
par: Wu, Stanley, et autres
Publié: (2025)