PlannerRFT: Reinforcing Diffusion Planners through Closed-Loop and Sample-Efficient Fine-Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Hongchen, Li, Tianyu, Yang, Jiazhi, Tian, Haochen, Wang, Caojun, Shi, Lei, Shang, Mingyang, Lin, Zengrong, Wu, Gaoqiang, Hao, Zhihui, Lang, Xianpeng, Hu, Jia, Li, Hongyang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reinforced Refinement with Self-Aware Expansion for End-to-End Autonomous Driving
par: Liu, Haochen, et autres
Publié: (2025)
par: Liu, Haochen, et autres
Publié: (2025)
A Diffusion-Refined Planner with Reinforcement Learning Priors for Confined-Space Parking
par: Jiang, Mingyang, et autres
Publié: (2025)
par: Jiang, Mingyang, et autres
Publié: (2025)
Hindsight Planner: A Closed-Loop Few-Shot Planner for Embodied Instruction Following
par: Yang, Yuxiao, et autres
Publié: (2024)
par: Yang, Yuxiao, et autres
Publié: (2024)
Evaluating Uncertainty-based Failure Detection for Closed-Loop LLM Planners
par: Zheng, Zhi, et autres
Publié: (2024)
par: Zheng, Zhi, et autres
Publié: (2024)
Visual-RFT: Visual Reinforcement Fine-Tuning
par: Liu, Ziyu, et autres
Publié: (2025)
par: Liu, Ziyu, et autres
Publié: (2025)
SAH-Drive: A Scenario-Aware Hybrid Planner for Closed-Loop Vehicle Trajectory Generation
par: Fan, Yuqi, et autres
Publié: (2025)
par: Fan, Yuqi, et autres
Publié: (2025)
Generalizing Motion Planners with Mixture of Experts for Autonomous Driving
par: Sun, Qiao, et autres
Publié: (2024)
par: Sun, Qiao, et autres
Publié: (2024)
EVLP:Learning Unified Embodied Vision-Language Planner with Reinforced Supervised Fine-Tuning
par: Cai, Xinyan, et autres
Publié: (2025)
par: Cai, Xinyan, et autres
Publié: (2025)
Mesh-RFT: Enhancing Mesh Generation via Fine-grained Reinforcement Fine-Tuning
par: Liu, Jian, et autres
Publié: (2025)
par: Liu, Jian, et autres
Publié: (2025)
SanD-Planner: Sample-Efficient Diffusion Planner in B-Spline Space for Robust Local Navigation
par: Wang, Jincheng, et autres
Publié: (2026)
par: Wang, Jincheng, et autres
Publié: (2026)
WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving
par: Yang, Pengxuan, et autres
Publié: (2025)
par: Yang, Pengxuan, et autres
Publié: (2025)
Preference Aligned Diffusion Planner for Quadrupedal Locomotion Control
par: Yuan, Xinyi, et autres
Publié: (2024)
par: Yuan, Xinyi, et autres
Publié: (2024)
Reinforcement Learning for Adaptive Planner Parameter Tuning: A Perspective on Hierarchical Architecture
par: Wangtao, Lu, et autres
Publié: (2025)
par: Wangtao, Lu, et autres
Publié: (2025)
CorrectionPlanner: Self-Correction Planner with Reinforcement Learning in Autonomous Driving
par: Guo, Yihong, et autres
Publié: (2026)
par: Guo, Yihong, et autres
Publié: (2026)
Resisting Stochastic Risks in Diffusion Planners with the Trajectory Aggregation Tree
par: Feng, Lang, et autres
Publié: (2024)
par: Feng, Lang, et autres
Publié: (2024)
HOPE: A Reinforcement Learning-based Hybrid Policy Path Planner for Diverse Parking Scenarios
par: Jiang, Mingyang, et autres
Publié: (2024)
par: Jiang, Mingyang, et autres
Publié: (2024)
Beyond Dense Futures: World Models as Structured Planners for Robotic Manipulation
par: Jin, Minghao, et autres
Publié: (2026)
par: Jin, Minghao, et autres
Publié: (2026)
SoRFT: Issue Resolving with Subtask-oriented Reinforced Fine-Tuning
par: Ma, Zexiong, et autres
Publié: (2025)
par: Ma, Zexiong, et autres
Publié: (2025)
MotionRFT: Unified Reinforcement Fine-Tuning for Text-to-Motion Generation
par: Tan, Xiaofeng, et autres
Publié: (2026)
par: Tan, Xiaofeng, et autres
Publié: (2026)
DreamPlan: Efficient Reinforcement Fine-Tuning of Vision-Language Planners via Video World Models
par: Jia, Emily Yue-Ting, et autres
Publié: (2026)
par: Jia, Emily Yue-Ting, et autres
Publié: (2026)
DIP: Dynamic In-Context Planner For Diffusion Language Models
par: Li, Yang, et autres
Publié: (2026)
par: Li, Yang, et autres
Publié: (2026)
CoPlanner: An Interactive Motion Planner with Contingency-Aware Diffusion for Autonomous Driving
par: Zhong, Ruiguo, et autres
Publié: (2025)
par: Zhong, Ruiguo, et autres
Publié: (2025)
Tree-Guided Diffusion Planner
par: Jeon, Hyeonseong, et autres
Publié: (2025)
par: Jeon, Hyeonseong, et autres
Publié: (2025)
FusionPlanner: A Multi-task Motion Planner for Mining Trucks via Multi-sensor Fusion
par: Teng, Siyu, et autres
Publié: (2023)
par: Teng, Siyu, et autres
Publié: (2023)
Exposing the Copycat Problem of Imitation-based Planner: A Novel Closed-Loop Simulator, Causal Benchmark and Joint IL-RL Baseline
par: Zhou, Hui, et autres
Publié: (2025)
par: Zhou, Hui, et autres
Publié: (2025)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
par: Tan, Huajie, et autres
Publié: (2025)
par: Tan, Huajie, et autres
Publié: (2025)
ConsistentRFT: Reducing Visual Hallucinations in Flow-based Reinforcement Fine-Tuning
par: Tan, Xiaofeng, et autres
Publié: (2026)
par: Tan, Xiaofeng, et autres
Publié: (2026)
HiCRISP: An LLM-based Hierarchical Closed-Loop Robotic Intelligent Self-Correction Planner
par: Ming, Chenlin, et autres
Publié: (2023)
par: Ming, Chenlin, et autres
Publié: (2023)
What Makes a Good Diffusion Planner for Decision Making?
par: Lu, Haofei, et autres
Publié: (2025)
par: Lu, Haofei, et autres
Publié: (2025)
VLA-RFT: Vision-Language-Action Reinforcement Fine-tuning with Verified Rewards in World Simulators
par: Li, Hengtao, et autres
Publié: (2025)
par: Li, Hengtao, et autres
Publié: (2025)
CO-RFT: Efficient Fine-Tuning of Vision-Language-Action Models through Chunked Offline Reinforcement Learning
par: Huang, Dongchi, et autres
Publié: (2025)
par: Huang, Dongchi, et autres
Publié: (2025)
Pose-RFT: Enhancing MLLMs for 3D Pose Generation via Hybrid Action Reinforcement Fine-Tuning
par: Li, Bao, et autres
Publié: (2025)
par: Li, Bao, et autres
Publié: (2025)
Off-dynamics Conditional Diffusion Planners
par: Ng, Wen Zheng Terence, et autres
Publié: (2024)
par: Ng, Wen Zheng Terence, et autres
Publié: (2024)
ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy
par: Chen, Yuhui, et autres
Publié: (2025)
par: Chen, Yuhui, et autres
Publié: (2025)
RL-OGM-Parking: Lidar OGM-Based Hybrid Reinforcement Learning Planner for Autonomous Parking
par: Wang, Zhitao, et autres
Publié: (2025)
par: Wang, Zhitao, et autres
Publié: (2025)
TRUST-Planner: Topology-guided Robust Trajectory Planner for AAVs with Uncertain Obstacle Spatial-temporal Avoidance
par: Li, Junzhi, et autres
Publié: (2025)
par: Li, Junzhi, et autres
Publié: (2025)
Robot Local Planner: A Periodic Sampling-Based Motion Planner with Minimal Waypoints for Home Environments
par: Takeshita, Keisuke, et autres
Publié: (2026)
par: Takeshita, Keisuke, et autres
Publié: (2026)
DrPlanner: Diagnosis and Repair of Motion Planners for Automated Vehicles Using Large Language Models
par: Lin, Yuanfei, et autres
Publié: (2024)
par: Lin, Yuanfei, et autres
Publié: (2024)
VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-Tuning
par: Wang, Qi, et autres
Publié: (2025)
par: Wang, Qi, et autres
Publié: (2025)
Trinity-RFT: A General-Purpose and Unified Framework for Reinforcement Fine-Tuning of Large Language Models
par: Pan, Xuchen, et autres
Publié: (2025)
par: Pan, Xuchen, et autres
Publié: (2025)
Documents similaires
-
Reinforced Refinement with Self-Aware Expansion for End-to-End Autonomous Driving
par: Liu, Haochen, et autres
Publié: (2025) -
A Diffusion-Refined Planner with Reinforcement Learning Priors for Confined-Space Parking
par: Jiang, Mingyang, et autres
Publié: (2025) -
Hindsight Planner: A Closed-Loop Few-Shot Planner for Embodied Instruction Following
par: Yang, Yuxiao, et autres
Publié: (2024) -
Evaluating Uncertainty-based Failure Detection for Closed-Loop LLM Planners
par: Zheng, Zhi, et autres
Publié: (2024) -
Visual-RFT: Visual Reinforcement Fine-Tuning
par: Liu, Ziyu, et autres
Publié: (2025)