Salvato in:
| Autori principali: | Danesh, Mohamad H., Wabartha, Maxime, Wu, Stanley, Pineau, Joelle, Lin, Hsiu-Chin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2507.06111 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Contractive Diffusion Policies: Robust Action Diffusion via Contractive Score-Based Sampling with Differential Equations
di: Abyaneh, Amin, et al.
Pubblicazione: (2026)
di: Abyaneh, Amin, et al.
Pubblicazione: (2026)
Toward Hardware-Agnostic Quadrupedal World Models via Morphology Conditioning
di: Danesh, Mohamad H., et al.
Pubblicazione: (2026)
di: Danesh, Mohamad H., et al.
Pubblicazione: (2026)
Contractive Dynamical Imitation Policies for Efficient Out-of-Sample Recovery
di: Abyaneh, Amin, et al.
Pubblicazione: (2024)
di: Abyaneh, Amin, et al.
Pubblicazione: (2024)
Globally Stable Neural Imitation Policies
di: Abyaneh, Amin, et al.
Pubblicazione: (2024)
di: Abyaneh, Amin, et al.
Pubblicazione: (2024)
VOCALoco: Viability-Optimized Cost-aware Adaptive Locomotion
di: Wu, Stanley, et al.
Pubblicazione: (2025)
di: Wu, Stanley, et al.
Pubblicazione: (2025)
SLowRL: Safe Low-Rank Adaptation Reinforcement Learning for Locomotion
di: Daneshmand, Elham, et al.
Pubblicazione: (2026)
di: Daneshmand, Elham, et al.
Pubblicazione: (2026)
Safe Deep Policy Adaptation
di: Xiao, Wenli, et al.
Pubblicazione: (2023)
di: Xiao, Wenli, et al.
Pubblicazione: (2023)
Single-Shot Learning of Stable Dynamical Systems for Long-Horizon Manipulation Tasks
di: St-Aubin, Alexandre, et al.
Pubblicazione: (2024)
di: St-Aubin, Alexandre, et al.
Pubblicazione: (2024)
Improving Generalization in Reinforcement Learning Training Regimes for Social Robot Navigation
di: Sigal, Adam, et al.
Pubblicazione: (2023)
di: Sigal, Adam, et al.
Pubblicazione: (2023)
When to Act, Ask, or Learn: Uncertainty-Aware Policy Steering
di: Yuan, Jessie, et al.
Pubblicazione: (2026)
di: Yuan, Jessie, et al.
Pubblicazione: (2026)
In-Context Policy Adaptation via Cross-Domain Skill Diffusion
di: Yoo, Minjong, et al.
Pubblicazione: (2025)
di: Yoo, Minjong, et al.
Pubblicazione: (2025)
Uncertainty-Aware Deployment of Pre-trained Language-Conditioned Imitation Learning Policies
di: Wu, Bo, et al.
Pubblicazione: (2024)
di: Wu, Bo, et al.
Pubblicazione: (2024)
Safe Policy Exploration Improvement via Subgoals
di: Angulo, Brian, et al.
Pubblicazione: (2024)
di: Angulo, Brian, et al.
Pubblicazione: (2024)
Safe Exploration via Policy Priors
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
Uncertainty-aware Latent Safety Filters for Avoiding Out-of-Distribution Failures
di: Seo, Junwon, et al.
Pubblicazione: (2025)
di: Seo, Junwon, et al.
Pubblicazione: (2025)
Domain Randomization via Entropy Maximization
di: Tiboni, Gabriele, et al.
Pubblicazione: (2023)
di: Tiboni, Gabriele, et al.
Pubblicazione: (2023)
Drift Q-Learning
di: Houssaini, Anas, et al.
Pubblicazione: (2026)
di: Houssaini, Anas, et al.
Pubblicazione: (2026)
The Role of Domain Randomization in Training Diffusion Policies for Whole-Body Humanoid Control
di: Kaidanov, Oleg, et al.
Pubblicazione: (2024)
di: Kaidanov, Oleg, et al.
Pubblicazione: (2024)
Can We Detect Failures Without Failure Data? Uncertainty-Aware Runtime Failure Detection for Imitation Learning Policies
di: Xu, Chen, et al.
Pubblicazione: (2025)
di: Xu, Chen, et al.
Pubblicazione: (2025)
Learning Lyapunov-Stable Polynomial Dynamical Systems through Imitation
di: Abyaneh, Amin, et al.
Pubblicazione: (2023)
di: Abyaneh, Amin, et al.
Pubblicazione: (2023)
DADP: Domain Adaptive Diffusion Policy
di: Wang, Pengcheng, et al.
Pubblicazione: (2026)
di: Wang, Pengcheng, et al.
Pubblicazione: (2026)
Dynamic Aware: Adaptive Multi-Mode Out-of-Distribution Detection for Trajectory Prediction in Autonomous Vehicles
di: Guo, Tongfei, et al.
Pubblicazione: (2025)
di: Guo, Tongfei, et al.
Pubblicazione: (2025)
FOSP: Fine-tuning Offline Safe Policy through World Models
di: Cao, Chenyang, et al.
Pubblicazione: (2024)
di: Cao, Chenyang, et al.
Pubblicazione: (2024)
Handling Long-Term Safety and Uncertainty in Safe Reinforcement Learning
di: Günster, Jonas, et al.
Pubblicazione: (2024)
di: Günster, Jonas, et al.
Pubblicazione: (2024)
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning
di: Ada, Suzan Ece, et al.
Pubblicazione: (2023)
di: Ada, Suzan Ece, et al.
Pubblicazione: (2023)
RAPT: Model-Predictive Out-of-Distribution Detection and Failure Diagnosis for Sim-to-Real Humanoid Robots
di: Munn, Humphrey, et al.
Pubblicazione: (2026)
di: Munn, Humphrey, et al.
Pubblicazione: (2026)
xTED: Cross-Domain Adaptation via Diffusion-Based Trajectory Editing
di: Niu, Haoyi, et al.
Pubblicazione: (2024)
di: Niu, Haoyi, et al.
Pubblicazione: (2024)
Policy Adaptation via Language Optimization: Decomposing Tasks for Few-Shot Imitation
di: Myers, Vivek, et al.
Pubblicazione: (2024)
di: Myers, Vivek, et al.
Pubblicazione: (2024)
Off-Policy Safe Reinforcement Learning with Constrained Optimistic Exploration
di: Li, Guopeng, et al.
Pubblicazione: (2026)
di: Li, Guopeng, et al.
Pubblicazione: (2026)
LoopSR: Looping Sim-and-Real for Lifelong Policy Adaptation of Legged Robots
di: Wu, Peilin, et al.
Pubblicazione: (2024)
di: Wu, Peilin, et al.
Pubblicazione: (2024)
Prompt-Driven Domain Adaptation for End-to-End Autonomous Driving via In-Context RL
di: Khurram, Aleesha, et al.
Pubblicazione: (2025)
di: Khurram, Aleesha, et al.
Pubblicazione: (2025)
Score and Distribution Matching Policy: Advanced Accelerated Visuomotor Policies via Matched Distillation
di: Jia, Bofang, et al.
Pubblicazione: (2024)
di: Jia, Bofang, et al.
Pubblicazione: (2024)
Digital Twin-based Out-of-Distribution Detection in Autonomous Vessels
di: Isaku, Erblin, et al.
Pubblicazione: (2025)
di: Isaku, Erblin, et al.
Pubblicazione: (2025)
Uncertainty-Aware Trajectory Prediction via Rule-Regularized Heteroscedastic Deep Classification
di: Manas, Kumar, et al.
Pubblicazione: (2025)
di: Manas, Kumar, et al.
Pubblicazione: (2025)
Statistical Guarantees for Offline Domain Randomization
di: Fickinger, Arnaud, et al.
Pubblicazione: (2025)
di: Fickinger, Arnaud, et al.
Pubblicazione: (2025)
Learning Safe Autonomous Driving Policies Using Predictive Safety Representations
di: Keswani, Mahesh, et al.
Pubblicazione: (2025)
di: Keswani, Mahesh, et al.
Pubblicazione: (2025)
Problem Space Transformations for Out-of-Distribution Generalisation in Behavioural Cloning
di: Doshi, Kiran, et al.
Pubblicazione: (2024)
di: Doshi, Kiran, et al.
Pubblicazione: (2024)
Language-Enhanced Latent Representations for Out-of-Distribution Detection in Autonomous Driving
di: Mao, Zhenjiang, et al.
Pubblicazione: (2024)
di: Mao, Zhenjiang, et al.
Pubblicazione: (2024)
Robust Adversarial Policy Optimization Under Dynamics Uncertainty
di: Kim, Mintae, et al.
Pubblicazione: (2026)
di: Kim, Mintae, et al.
Pubblicazione: (2026)
SATA: Safe and Adaptive Torque-Based Locomotion Policies Inspired by Animal Learning
di: Li, Peizhuo, et al.
Pubblicazione: (2025)
di: Li, Peizhuo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Contractive Diffusion Policies: Robust Action Diffusion via Contractive Score-Based Sampling with Differential Equations
di: Abyaneh, Amin, et al.
Pubblicazione: (2026) -
Toward Hardware-Agnostic Quadrupedal World Models via Morphology Conditioning
di: Danesh, Mohamad H., et al.
Pubblicazione: (2026) -
Contractive Dynamical Imitation Policies for Efficient Out-of-Sample Recovery
di: Abyaneh, Amin, et al.
Pubblicazione: (2024) -
Globally Stable Neural Imitation Policies
di: Abyaneh, Amin, et al.
Pubblicazione: (2024) -
VOCALoco: Viability-Optimized Cost-aware Adaptive Locomotion
di: Wu, Stanley, et al.
Pubblicazione: (2025)