MTDrive: Multi-turn Interactive Reinforcement Learning for Autonomous Driving
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Xidong, Guo, Mingyu, Xu, Chenchao, Li, Bailin, Zhu, Wenjing, Zou, Yangang, Chen, Rui, Wang, Zehuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ScoRe-Flow: Complete Distributional Control via Score-Based Reinforcement Learning for Flow Matching
di: Qiu, Xiaotian, et al.
Pubblicazione: (2026)
di: Qiu, Xiaotian, et al.
Pubblicazione: (2026)
CaMeRL: Collision-Aware and Memory-Enhanced Reinforcement Learning for UAV Navigation in Multi-Scale Obstacle Environments
di: Hong, Hong, et al.
Pubblicazione: (2026)
di: Hong, Hong, et al.
Pubblicazione: (2026)
Affordance-Aware Interactive Decision-Making and Execution for Ambiguous Instructions
di: Xu, Hengxuan, et al.
Pubblicazione: (2026)
di: Xu, Hengxuan, et al.
Pubblicazione: (2026)
Magnet-Based Soft Robotic Skin Using a 3D-Printed Multi-Lattice Structure and CNN-Based Tactile Super-Resolution
di: Bang, Yunseong, et al.
Pubblicazione: (2026)
di: Bang, Yunseong, et al.
Pubblicazione: (2026)
Preventing Robotic Jailbreaking via Multimodal Domain Adaptation
di: Marchiori, Francesco, et al.
Pubblicazione: (2025)
di: Marchiori, Francesco, et al.
Pubblicazione: (2025)
DRAE: Dynamic Retrieval-Augmented Expert Networks for Lifelong Learning and Task Adaptation in Robotics
di: Long, Yayu, et al.
Pubblicazione: (2025)
di: Long, Yayu, et al.
Pubblicazione: (2025)
Selective Progress-Aware Querying for Human-in-the-Loop Reinforcement Learning
di: Muraleedharan, Anujith, et al.
Pubblicazione: (2025)
di: Muraleedharan, Anujith, et al.
Pubblicazione: (2025)
Dream to Fly: Model-Based Reinforcement Learning for Vision-Based Drone Flight
di: Romero, Angel, et al.
Pubblicazione: (2025)
di: Romero, Angel, et al.
Pubblicazione: (2025)
Predictive Traffic Rule Compliance using Reinforcement Learning
di: Huang, Yanliang, et al.
Pubblicazione: (2025)
di: Huang, Yanliang, et al.
Pubblicazione: (2025)
Curb Your Attention: Causal Attention Gating for Robust Trajectory Prediction in Autonomous Driving
di: Ahmadi, Ehsan, et al.
Pubblicazione: (2024)
di: Ahmadi, Ehsan, et al.
Pubblicazione: (2024)
CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion
di: Römer, Ralf, et al.
Pubblicazione: (2026)
di: Römer, Ralf, et al.
Pubblicazione: (2026)
Tactile-Proprioceptive Sensor Fusion for Contact Wrench Estimation in Whole-Body Physical Human-Robot Interaction
di: Min, Junha, et al.
Pubblicazione: (2026)
di: Min, Junha, et al.
Pubblicazione: (2026)
Conservative Bias in Multi-Teacher Learning: Why Agents Prefer Low-Reward Advisors
di: Mesto, Maher, et al.
Pubblicazione: (2025)
di: Mesto, Maher, et al.
Pubblicazione: (2025)
WayFASTER: a Self-Supervised Traversability Prediction for Increased Navigation Awareness
di: Gasparino, Mateus Valverde, et al.
Pubblicazione: (2024)
di: Gasparino, Mateus Valverde, et al.
Pubblicazione: (2024)
Imitation learning for sim-to-real transfer of robotic cutting policies based on residual Gaussian process disturbance force model
di: Hathaway, Jamie, et al.
Pubblicazione: (2023)
di: Hathaway, Jamie, et al.
Pubblicazione: (2023)
End-to-end example-based sim-to-real RL policy transfer based on neural stylisation with application to robotic cutting
di: Hathaway, Jamie, et al.
Pubblicazione: (2026)
di: Hathaway, Jamie, et al.
Pubblicazione: (2026)
CRLLK: Constrained Reinforcement Learning for Lane Keeping in Autonomous Driving
di: Gao, Xinwei, et al.
Pubblicazione: (2025)
di: Gao, Xinwei, et al.
Pubblicazione: (2025)
LiloDriver: A Lifelong Learning Framework for Closed-loop Motion Planning in Long-tail Autonomous Driving Scenarios
di: Yao, Huaiyuan, et al.
Pubblicazione: (2025)
di: Yao, Huaiyuan, et al.
Pubblicazione: (2025)
When Does Adaptive Guidance Help? Belief-Aware Privileged Distillation for Autonomous Driving Under Partial Observability
di: Haklidir, Mehmet
Pubblicazione: (2026)
di: Haklidir, Mehmet
Pubblicazione: (2026)
Atomic-Probe Governance for Skill Updates in Compositional Robot Policies
di: Qin, Xue, et al.
Pubblicazione: (2026)
di: Qin, Xue, et al.
Pubblicazione: (2026)
LLM-Guided Task- and Affordance-Level Exploration in Reinforcement Learning
di: Luijkx, Jelle, et al.
Pubblicazione: (2025)
di: Luijkx, Jelle, et al.
Pubblicazione: (2025)
Improving Agent Behaviors with RL Fine-tuning for Autonomous Driving
di: Peng, Zhenghao, et al.
Pubblicazione: (2024)
di: Peng, Zhenghao, et al.
Pubblicazione: (2024)
LANGTRAJ: Diffusion Model and Dataset for Language-Conditioned Trajectory Simulation
di: Chang, Wei-Jer, et al.
Pubblicazione: (2025)
di: Chang, Wei-Jer, et al.
Pubblicazione: (2025)
Positive-Only Drifting Policy Optimization
di: Zhang, Qi
Pubblicazione: (2026)
di: Zhang, Qi
Pubblicazione: (2026)
Energy-Efficient Quadruped Locomotion with Compliant Feet
di: Pal, Pramod, et al.
Pubblicazione: (2026)
di: Pal, Pramod, et al.
Pubblicazione: (2026)
Pure Planning to Pure Policies and In Between with a Recursive Tree Planner
di: Redlich, A. Norman
Pubblicazione: (2024)
di: Redlich, A. Norman
Pubblicazione: (2024)
Robo-CSK-Organizer: Commonsense Knowledge to Organize Detected Objects for Multipurpose Robots
di: Hidalgo, Rafael, et al.
Pubblicazione: (2024)
di: Hidalgo, Rafael, et al.
Pubblicazione: (2024)
Physics-Informed Policy Optimization via Analytic Dynamics Regularization
di: Chandra, Namai, et al.
Pubblicazione: (2026)
di: Chandra, Namai, et al.
Pubblicazione: (2026)
How VLAs Fail Differently: Black-Box Action Monitoring Reveals Architecture-Specific Failure Signatures
di: Gupta, Krishnam
Pubblicazione: (2026)
di: Gupta, Krishnam
Pubblicazione: (2026)
PhAIL: A Real-Robot VLA Benchmark and Distributional Methodology
di: Arkhangelskiy, Sergey
Pubblicazione: (2026)
di: Arkhangelskiy, Sergey
Pubblicazione: (2026)
Sim-to-reality adaptation for Deep Reinforcement Learning applied to an underwater docking application
di: Chaarani, Alaaeddine, et al.
Pubblicazione: (2026)
di: Chaarani, Alaaeddine, et al.
Pubblicazione: (2026)
Newtonian and Lagrangian Neural Networks: A Comparison Towards Efficient Inverse Dynamics Identification
di: Trinh, Minh, et al.
Pubblicazione: (2025)
di: Trinh, Minh, et al.
Pubblicazione: (2025)
Simulation-Based Counterfactual Causal Discovery on Real World Driver Behaviour
di: Howard, Rhys, et al.
Pubblicazione: (2023)
di: Howard, Rhys, et al.
Pubblicazione: (2023)
Decentralized Aerial Manipulation of a Cable-Suspended Load using Multi-Agent Reinforcement Learning
di: Zeng, Jack, et al.
Pubblicazione: (2025)
di: Zeng, Jack, et al.
Pubblicazione: (2025)
SaiVLA-0: Cerebrum--Pons--Cerebellum Tripartite Architecture for Compute-Aware Vision-Language-Action
di: Shi, Xiang, et al.
Pubblicazione: (2026)
di: Shi, Xiang, et al.
Pubblicazione: (2026)
Reinforcement Learning-Based Energy-Aware Coverage Path Planning for Precision Agriculture
di: Wu, Beining, et al.
Pubblicazione: (2026)
di: Wu, Beining, et al.
Pubblicazione: (2026)
ZAPS-DA: Zero-Phase Action Policy Smoothing with Decoupled Actor for Continuous Control in Reinforcement Learning
di: Shamass, Faiq
Pubblicazione: (2026)
di: Shamass, Faiq
Pubblicazione: (2026)
Towards a Robust Soft Baby Robot With Rich Interaction Ability for Advanced Machine Learning Algorithms
di: Alhakami, Mohannad, et al.
Pubblicazione: (2024)
di: Alhakami, Mohannad, et al.
Pubblicazione: (2024)
RoboGrind: Intuitive and Interactive Surface Treatment with Industrial Robots
di: Alt, Benjamin, et al.
Pubblicazione: (2024)
di: Alt, Benjamin, et al.
Pubblicazione: (2024)
Differentiable Model Predictive Safety for Heterogeneous Mobility at Urban Intersections
di: Song, Wenzhe, et al.
Pubblicazione: (2026)
di: Song, Wenzhe, et al.
Pubblicazione: (2026)
Documenti analoghi
-
ScoRe-Flow: Complete Distributional Control via Score-Based Reinforcement Learning for Flow Matching
di: Qiu, Xiaotian, et al.
Pubblicazione: (2026) -
CaMeRL: Collision-Aware and Memory-Enhanced Reinforcement Learning for UAV Navigation in Multi-Scale Obstacle Environments
di: Hong, Hong, et al.
Pubblicazione: (2026) -
Affordance-Aware Interactive Decision-Making and Execution for Ambiguous Instructions
di: Xu, Hengxuan, et al.
Pubblicazione: (2026) -
Magnet-Based Soft Robotic Skin Using a 3D-Printed Multi-Lattice Structure and CNN-Based Tactile Super-Resolution
di: Bang, Yunseong, et al.
Pubblicazione: (2026) -
Preventing Robotic Jailbreaking via Multimodal Domain Adaptation
di: Marchiori, Francesco, et al.
Pubblicazione: (2025)