Continual Driving Policy Optimization with Closed-Loop Individualized Curricula
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Niu, Haoyi, Xu, Yizhou, Jiang, Xingjian, Hu, Jianming |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Comprehensive Survey of Cross-Domain Policy Transfer for Embodied Agents
par: Niu, Haoyi, et autres
Publié: (2024)
par: Niu, Haoyi, et autres
Publié: (2024)
H2O+: An Improved Framework for Hybrid Offline-and-Online RL with Dynamics Gaps
par: Niu, Haoyi, et autres
Publié: (2023)
par: Niu, Haoyi, et autres
Publié: (2023)
SEAL: Towards Safe Autonomous Driving via Skill-Enabled Adversary Learning for Closed-Loop Scenario Generation
par: Stoler, Benjamin, et autres
Publié: (2024)
par: Stoler, Benjamin, et autres
Publié: (2024)
RoaD: Rollouts as Demonstrations for Closed-Loop Supervised Fine-Tuning of Autonomous Driving Policies
par: Garcia-Cobo, Guillermo, et autres
Publié: (2025)
par: Garcia-Cobo, Guillermo, et autres
Publié: (2025)
DISCOVER: Automated Curricula for Sparse-Reward Reinforcement Learning
par: Diaz-Bone, Leander, et autres
Publié: (2025)
par: Diaz-Bone, Leander, et autres
Publié: (2025)
Closed Loop Dynamic Driving Data Mixture for Real-Synthetic Co-Training
par: Ruan, Hongzhi, et autres
Publié: (2026)
par: Ruan, Hongzhi, et autres
Publié: (2026)
Adaptive Diffusion Policy Optimization for Robotic Manipulation
par: Jiang, Huiyun, et autres
Publié: (2025)
par: Jiang, Huiyun, et autres
Publié: (2025)
Continual Model-Based Reinforcement Learning with Hypernetworks
par: Huang, Yizhou, et autres
Publié: (2020)
par: Huang, Yizhou, et autres
Publié: (2020)
Skill Expansion and Composition in Parameter Space
par: Liu, Tenglong, et autres
Publié: (2025)
par: Liu, Tenglong, et autres
Publié: (2025)
LearningFlow: Automated Policy Learning Workflow for Urban Driving with Large Language Models
par: Peng, Zengqi, et autres
Publié: (2025)
par: Peng, Zengqi, et autres
Publié: (2025)
Grasp-MPC: Closed-Loop Visual Grasping via Value-Guided Model Predictive Control
par: Yamada, Jun, et autres
Publié: (2025)
par: Yamada, Jun, et autres
Publié: (2025)
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
par: Lin, Haohong, et autres
Publié: (2023)
par: Lin, Haohong, et autres
Publié: (2023)
LoRD: Adapting Differentiable Driving Policies to Distribution Shifts
par: Diehl, Christopher, et autres
Publié: (2024)
par: Diehl, Christopher, et autres
Publié: (2024)
Absolute Policy Optimization
par: Zhao, Weiye, et autres
Publié: (2023)
par: Zhao, Weiye, et autres
Publié: (2023)
Evolutionary Policy Optimization
par: Wang, Jianren, et autres
Publié: (2025)
par: Wang, Jianren, et autres
Publié: (2025)
Reason--Imagine--Act: Closed-Loop LLM Decision Making with World Models for Autonomous Driving
par: Sun, Zhengqi, et autres
Publié: (2026)
par: Sun, Zhengqi, et autres
Publié: (2026)
Driving Through Uncertainty: Risk-Averse Control with LLM Commonsense for Autonomous Driving under Perception Deficits
par: Hu, Yuting, et autres
Publié: (2025)
par: Hu, Yuting, et autres
Publié: (2025)
Symbolic Imitation Learning: From Black-Box to Explainable Driving Policies
par: Sharifi, Iman, et autres
Publié: (2023)
par: Sharifi, Iman, et autres
Publié: (2023)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
par: Ma, Yunchang, et autres
Publié: (2025)
par: Ma, Yunchang, et autres
Publié: (2025)
World Models for Autonomous Driving: An Initial Survey
par: Guan, Yanchen, et autres
Publié: (2024)
par: Guan, Yanchen, et autres
Publié: (2024)
Guided Policy Optimization under Partial Observability
par: Li, Yueheng, et autres
Publié: (2025)
par: Li, Yueheng, et autres
Publié: (2025)
Extremum-Seeking Action Selection for Accelerating Policy Optimization
par: Chang, Ya-Chien, et autres
Publié: (2024)
par: Chang, Ya-Chien, et autres
Publié: (2024)
COSBO: Conservative Offline Simulation-Based Policy Optimization
par: Kargar, Eshagh, et autres
Publié: (2024)
par: Kargar, Eshagh, et autres
Publié: (2024)
Model-Based Policy Adaptation for Closed-Loop End-to-End Autonomous Driving
par: Lin, Haohong, et autres
Publié: (2025)
par: Lin, Haohong, et autres
Publié: (2025)
Are Expressive Models Truly Necessary for Offline RL?
par: Wang, Guan, et autres
Publié: (2024)
par: Wang, Guan, et autres
Publié: (2024)
Conditional Flow Matching for Continuous Anomaly Detection in Autonomous Driving on a Manifold-Aware Spectral Space
par: Guillen-Perez, Antonio
Publié: (2026)
par: Guillen-Perez, Antonio
Publié: (2026)
Continual Policy Distillation of Reinforcement Learning-based Controllers for Soft Robotic In-Hand Manipulation
par: Li, Lanpei, et autres
Publié: (2024)
par: Li, Lanpei, et autres
Publié: (2024)
Physics-informed Imitative Reinforcement Learning for Real-world Driving
par: Zhou, Hang, et autres
Publié: (2024)
par: Zhou, Hang, et autres
Publié: (2024)
Long and Short-Term Constraints Driven Safe Reinforcement Learning for Autonomous Driving
par: Hu, Xuemin, et autres
Publié: (2024)
par: Hu, Xuemin, et autres
Publié: (2024)
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
From Imitation to Exploration: End-to-end Autonomous Driving based on World Model
par: Li, Yueyuan, et autres
Publié: (2024)
par: Li, Yueyuan, et autres
Publié: (2024)
Bootstrapping Reinforcement Learning with Sub-optimal Policies for Autonomous Driving
par: Zhang, Zhihao, et autres
Publié: (2025)
par: Zhang, Zhihao, et autres
Publié: (2025)
Robotic World Model: A Neural Network Simulator for Robust Policy Optimization in Robotics
par: Li, Chenhao, et autres
Publié: (2025)
par: Li, Chenhao, et autres
Publié: (2025)
Reactive Diffusion Policy: Slow-Fast Visual-Tactile Policy Learning for Contact-Rich Manipulation
par: Xue, Han, et autres
Publié: (2025)
par: Xue, Han, et autres
Publié: (2025)
NDST: Neural Driving Style Transfer for Human-Like Vision-Based Autonomous Driving
par: Kim, Donghyun, et autres
Publié: (2024)
par: Kim, Donghyun, et autres
Publié: (2024)
BehaviorGPT: Smart Agent Simulation for Autonomous Driving with Next-Patch Prediction
par: Zhou, Zikang, et autres
Publié: (2024)
par: Zhou, Zikang, et autres
Publié: (2024)
TRANSIC: Sim-to-Real Policy Transfer by Learning from Online Correction
par: Jiang, Yunfan, et autres
Publié: (2024)
par: Jiang, Yunfan, et autres
Publié: (2024)
Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization
par: Alon, Yoav, et autres
Publié: (2020)
par: Alon, Yoav, et autres
Publié: (2020)
Self-Discovered Intention-aware Transformer for Multi-modal Vehicle Trajectory Prediction
par: Liu, Diyi, et autres
Publié: (2026)
par: Liu, Diyi, et autres
Publié: (2026)
Leveraging Sub-Optimal Data for Human-in-the-Loop Reinforcement Learning
par: Muslimani, Calarina, et autres
Publié: (2024)
par: Muslimani, Calarina, et autres
Publié: (2024)
Documents similaires
-
A Comprehensive Survey of Cross-Domain Policy Transfer for Embodied Agents
par: Niu, Haoyi, et autres
Publié: (2024) -
H2O+: An Improved Framework for Hybrid Offline-and-Online RL with Dynamics Gaps
par: Niu, Haoyi, et autres
Publié: (2023) -
SEAL: Towards Safe Autonomous Driving via Skill-Enabled Adversary Learning for Closed-Loop Scenario Generation
par: Stoler, Benjamin, et autres
Publié: (2024) -
RoaD: Rollouts as Demonstrations for Closed-Loop Supervised Fine-Tuning of Autonomous Driving Policies
par: Garcia-Cobo, Guillermo, et autres
Publié: (2025) -
DISCOVER: Automated Curricula for Sparse-Reward Reinforcement Learning
par: Diaz-Bone, Leander, et autres
Publié: (2025)