Pure Planning to Pure Policies and In Between with a Recursive Tree Planner
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Redlich, A. Norman |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Positive-Only Drifting Policy Optimization
par: Zhang, Qi
Publié: (2026)
par: Zhang, Qi
Publié: (2026)
Physics-Informed Policy Optimization via Analytic Dynamics Regularization
par: Chandra, Namai, et autres
Publié: (2026)
par: Chandra, Namai, et autres
Publié: (2026)
LANGTRAJ: Diffusion Model and Dataset for Language-Conditioned Trajectory Simulation
par: Chang, Wei-Jer, et autres
Publié: (2025)
par: Chang, Wei-Jer, et autres
Publié: (2025)
How VLAs Fail Differently: Black-Box Action Monitoring Reveals Architecture-Specific Failure Signatures
par: Gupta, Krishnam
Publié: (2026)
par: Gupta, Krishnam
Publié: (2026)
Tactile-Proprioceptive Sensor Fusion for Contact Wrench Estimation in Whole-Body Physical Human-Robot Interaction
par: Min, Junha, et autres
Publié: (2026)
par: Min, Junha, et autres
Publié: (2026)
Machine Learning Based Path Planning for Improved Rover Navigation (Pre-Print Version)
par: Abcouwer, Neil, et autres
Publié: (2020)
par: Abcouwer, Neil, et autres
Publié: (2020)
DiffSim2Real: Deploying Quadrupedal Locomotion Policies Purely Trained in Differentiable Simulation
par: Bagajo, Joshua, et autres
Publié: (2024)
par: Bagajo, Joshua, et autres
Publié: (2024)
Newtonian and Lagrangian Neural Networks: A Comparison Towards Efficient Inverse Dynamics Identification
par: Trinh, Minh, et autres
Publié: (2025)
par: Trinh, Minh, et autres
Publié: (2025)
Reinforcement Learning-Based Energy-Aware Coverage Path Planning for Precision Agriculture
par: Wu, Beining, et autres
Publié: (2026)
par: Wu, Beining, et autres
Publié: (2026)
ZAPS-DA: Zero-Phase Action Policy Smoothing with Decoupled Actor for Continuous Control in Reinforcement Learning
par: Shamass, Faiq
Publié: (2026)
par: Shamass, Faiq
Publié: (2026)
CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion
par: Römer, Ralf, et autres
Publié: (2026)
par: Römer, Ralf, et autres
Publié: (2026)
Graph Neural Network Based Action Ranking for Planning
par: Mangannavar, Rajesh, et autres
Publié: (2024)
par: Mangannavar, Rajesh, et autres
Publié: (2024)
Magnet-Based Soft Robotic Skin Using a 3D-Printed Multi-Lattice Structure and CNN-Based Tactile Super-Resolution
par: Bang, Yunseong, et autres
Publié: (2026)
par: Bang, Yunseong, et autres
Publié: (2026)
A Framework for Neurosymbolic Robot Action Planning using Large Language Models
par: Capitanelli, Alessio, et autres
Publié: (2023)
par: Capitanelli, Alessio, et autres
Publié: (2023)
CaMeRL: Collision-Aware and Memory-Enhanced Reinforcement Learning for UAV Navigation in Multi-Scale Obstacle Environments
par: Hong, Hong, et autres
Publié: (2026)
par: Hong, Hong, et autres
Publié: (2026)
Preventing Robotic Jailbreaking via Multimodal Domain Adaptation
par: Marchiori, Francesco, et autres
Publié: (2025)
par: Marchiori, Francesco, et autres
Publié: (2025)
DRAE: Dynamic Retrieval-Augmented Expert Networks for Lifelong Learning and Task Adaptation in Robotics
par: Long, Yayu, et autres
Publié: (2025)
par: Long, Yayu, et autres
Publié: (2025)
Affordance-Aware Interactive Decision-Making and Execution for Ambiguous Instructions
par: Xu, Hengxuan, et autres
Publié: (2026)
par: Xu, Hengxuan, et autres
Publié: (2026)
ScoRe-Flow: Complete Distributional Control via Score-Based Reinforcement Learning for Flow Matching
par: Qiu, Xiaotian, et autres
Publié: (2026)
par: Qiu, Xiaotian, et autres
Publié: (2026)
Towards a Robust Soft Baby Robot With Rich Interaction Ability for Advanced Machine Learning Algorithms
par: Alhakami, Mohannad, et autres
Publié: (2024)
par: Alhakami, Mohannad, et autres
Publié: (2024)
MEReQ: Max-Ent Residual-Q Inverse RL for Sample-Efficient Alignment from Intervention
par: Chen, Yuxin, et autres
Publié: (2024)
par: Chen, Yuxin, et autres
Publié: (2024)
SPACeR: Self-Play Anchoring with Centralized Reference Models
par: Chang, Wei-Jer, et autres
Publié: (2025)
par: Chang, Wei-Jer, et autres
Publié: (2025)
SaiVLA-0: Cerebrum--Pons--Cerebellum Tripartite Architecture for Compute-Aware Vision-Language-Action
par: Shi, Xiang, et autres
Publié: (2026)
par: Shi, Xiang, et autres
Publié: (2026)
When Does Adaptive Guidance Help? Belief-Aware Privileged Distillation for Autonomous Driving Under Partial Observability
par: Haklidir, Mehmet
Publié: (2026)
par: Haklidir, Mehmet
Publié: (2026)
CUPID: Curating Data your Robot Loves with Influence Functions
par: Agia, Christopher, et autres
Publié: (2025)
par: Agia, Christopher, et autres
Publié: (2025)
MTDrive: Multi-turn Interactive Reinforcement Learning for Autonomous Driving
par: Li, Xidong, et autres
Publié: (2026)
par: Li, Xidong, et autres
Publié: (2026)
Curb Your Attention: Causal Attention Gating for Robust Trajectory Prediction in Autonomous Driving
par: Ahmadi, Ehsan, et autres
Publié: (2024)
par: Ahmadi, Ehsan, et autres
Publié: (2024)
Atomic-Probe Governance for Skill Updates in Compositional Robot Policies
par: Qin, Xue, et autres
Publié: (2026)
par: Qin, Xue, et autres
Publié: (2026)
Failure Prediction at Runtime for Generative Robot Policies
par: Römer, Ralf, et autres
Publié: (2025)
par: Römer, Ralf, et autres
Publié: (2025)
Unpacking Failure Modes of Generative Policies: Runtime Monitoring of Consistency and Progress
par: Agia, Christopher, et autres
Publié: (2024)
par: Agia, Christopher, et autres
Publié: (2024)
WayFASTER: a Self-Supervised Traversability Prediction for Increased Navigation Awareness
par: Gasparino, Mateus Valverde, et autres
Publié: (2024)
par: Gasparino, Mateus Valverde, et autres
Publié: (2024)
The Shortcomings of Force-from-Motion in Robot Learning
par: Aljalbout, Elie, et autres
Publié: (2024)
par: Aljalbout, Elie, et autres
Publié: (2024)
RoboPack: Learning Tactile-Informed Dynamics Models for Dense Packing
par: Ai, Bo, et autres
Publié: (2024)
par: Ai, Bo, et autres
Publié: (2024)
The State of Robot Motion Generation
par: Bekris, Kostas E., et autres
Publié: (2024)
par: Bekris, Kostas E., et autres
Publié: (2024)
Building Minimal and Reusable Causal State Abstractions for Reinforcement Learning
par: Wang, Zizhao, et autres
Publié: (2024)
par: Wang, Zizhao, et autres
Publié: (2024)
An Automatic Ground Collision Avoidance System with Reinforcement Learning
par: Sevgili, Seyyid Osman, et autres
Publié: (2026)
par: Sevgili, Seyyid Osman, et autres
Publié: (2026)
Autopilot-Preserving Residual Q-Learning with HJB-Inspired Finite-Action Risk Filtering for Fixed-Wing UAV Command Supervision
par: Iscan, Mehmet, et autres
Publié: (2026)
par: Iscan, Mehmet, et autres
Publié: (2026)
The Reality Gap in Robotics: Challenges, Solutions, and Best Practices
par: Aljalbout, Elie, et autres
Publié: (2025)
par: Aljalbout, Elie, et autres
Publié: (2025)
Achieving Scalable Robot Autonomy via neurosymbolic planning using lightweight local LLM
par: Attolino, Nicholas, et autres
Publié: (2025)
par: Attolino, Nicholas, et autres
Publié: (2025)
Cost-Aware Diffusion Active Search
par: Banerjee, Arundhati, et autres
Publié: (2026)
par: Banerjee, Arundhati, et autres
Publié: (2026)
Documents similaires
-
Positive-Only Drifting Policy Optimization
par: Zhang, Qi
Publié: (2026) -
Physics-Informed Policy Optimization via Analytic Dynamics Regularization
par: Chandra, Namai, et autres
Publié: (2026) -
LANGTRAJ: Diffusion Model and Dataset for Language-Conditioned Trajectory Simulation
par: Chang, Wei-Jer, et autres
Publié: (2025) -
How VLAs Fail Differently: Black-Box Action Monitoring Reveals Architecture-Specific Failure Signatures
par: Gupta, Krishnam
Publié: (2026) -
Tactile-Proprioceptive Sensor Fusion for Contact Wrench Estimation in Whole-Body Physical Human-Robot Interaction
par: Min, Junha, et autres
Publié: (2026)