CueLearner: Bootstrapping and local policy adaptation from relative feedback
Fuente:
arXiv
Salvato in:
| Autori principali: | Schiavi, Giulio, Cramariuc, Andrei, Ott, Lionel, Siegwart, Roland |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pretraining in Actor-Critic Reinforcement Learning for Robot Locomotion
di: Fan, Jiale, et al.
Pubblicazione: (2025)
di: Fan, Jiale, et al.
Pubblicazione: (2025)
Waverider: Leveraging Hierarchical, Multi-Resolution Maps for Efficient and Reactive Obstacle Avoidance
di: Reijgwart, Victor, et al.
Pubblicazione: (2024)
di: Reijgwart, Victor, et al.
Pubblicazione: (2024)
Whole-body End-Effector Pose Tracking
di: Portela, Tifanny, et al.
Pubblicazione: (2024)
di: Portela, Tifanny, et al.
Pubblicazione: (2024)
Efficient Hierarchical Any-Angle Path Planning on Multi-Resolution 3D Grids
di: Reijgwart, Victor, et al.
Pubblicazione: (2026)
di: Reijgwart, Victor, et al.
Pubblicazione: (2026)
Task Adaptation in Industrial Human-Robot Interaction: Leveraging Riemannian Motion Policies
di: Allenspach, Mike, et al.
Pubblicazione: (2024)
di: Allenspach, Mike, et al.
Pubblicazione: (2024)
Bootstrap Off-policy with World Model
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
Under pressure: learning-based analog gauge reading in the wild
di: Reitsma, Maurits, et al.
Pubblicazione: (2024)
di: Reitsma, Maurits, et al.
Pubblicazione: (2024)
Automatic Extension of a Symbolic Mobile Manipulation Skill Set
di: Förster, Julian, et al.
Pubblicazione: (2020)
di: Förster, Julian, et al.
Pubblicazione: (2020)
Obstacle-Avoidant Leader Following with a Quadruped Robot
di: Scheidemann, Carmen, et al.
Pubblicazione: (2024)
di: Scheidemann, Carmen, et al.
Pubblicazione: (2024)
Learning Affordances from Interactive Exploration using an Object-level Map
di: Wulkop, Paula, et al.
Pubblicazione: (2025)
di: Wulkop, Paula, et al.
Pubblicazione: (2025)
NeuSurfEmb: A Complete Pipeline for Dense Correspondence-based 6D Object Pose Estimation without CAD Models
di: Milano, Francesco, et al.
Pubblicazione: (2024)
di: Milano, Francesco, et al.
Pubblicazione: (2024)
WindSeer: Real-time volumetric wind prediction over complex terrain aboard a small UAV
di: Achermann, Florian, et al.
Pubblicazione: (2024)
di: Achermann, Florian, et al.
Pubblicazione: (2024)
Trinity: Unifying Class-Agnostic Terrain and Semantic Segmentation for Unstructured Outdoor Environments by Leveraging Synthetic Data
di: Müller, Marcus G, et al.
Pubblicazione: (2026)
di: Müller, Marcus G, et al.
Pubblicazione: (2026)
Learning coordinated badminton skills for legged manipulators
di: Ma, Yuntao, et al.
Pubblicazione: (2025)
di: Ma, Yuntao, et al.
Pubblicazione: (2025)
Learning Nonverbal Cues in Multiparty Social Interactions for Robotic Facilitators
di: Martin-Ozimek, Antonio Lech, et al.
Pubblicazione: (2025)
di: Martin-Ozimek, Antonio Lech, et al.
Pubblicazione: (2025)
RL Token: Bootstrapping Online RL with Vision-Language-Action Models
di: Xu, Charles, et al.
Pubblicazione: (2026)
di: Xu, Charles, et al.
Pubblicazione: (2026)
Bootstrapped Model Predictive Control
di: Wang, Yuhang, et al.
Pubblicazione: (2025)
di: Wang, Yuhang, et al.
Pubblicazione: (2025)
Flattening Hierarchies with Policy Bootstrapping
di: Zhou, John L., et al.
Pubblicazione: (2025)
di: Zhou, John L., et al.
Pubblicazione: (2025)
GraspQP: Differentiable Optimization of Force Closure for Diverse and Robust Dexterous Grasping
di: Zurbrügg, René, et al.
Pubblicazione: (2025)
di: Zurbrügg, René, et al.
Pubblicazione: (2025)
Robot Arm Control via Cognitive Map Learners
di: McDonald, Nathan, et al.
Pubblicazione: (2026)
di: McDonald, Nathan, et al.
Pubblicazione: (2026)
DexEvolve: Evolutionary Optimization for Robust and Diverse Dexterous Grasp Synthesis
di: Zurbrügg, René, et al.
Pubblicazione: (2026)
di: Zurbrügg, René, et al.
Pubblicazione: (2026)
Cybathlon -- Legged Mobile Assistance for Quadriplegics
di: Scheidemann, Carmen, et al.
Pubblicazione: (2024)
di: Scheidemann, Carmen, et al.
Pubblicazione: (2024)
VIRUS-NeRF -- Vision, InfraRed and UltraSonic based Neural Radiance Fields
di: Schmid, Nicolaj, et al.
Pubblicazione: (2024)
di: Schmid, Nicolaj, et al.
Pubblicazione: (2024)
Vintix II: Decision Pre-Trained Transformer is a Scalable In-Context Reinforcement Learner
di: Polubarov, Andrei, et al.
Pubblicazione: (2026)
di: Polubarov, Andrei, et al.
Pubblicazione: (2026)
Act-Observe-Rewrite: Multimodal Coding Agents as In-Context Policy Learners for Robot Manipulation
di: Kumar, Vaishak
Pubblicazione: (2026)
di: Kumar, Vaishak
Pubblicazione: (2026)
Task-conditioned adaptation of visual features in multi-task policy learning
di: Marza, Pierre, et al.
Pubblicazione: (2024)
di: Marza, Pierre, et al.
Pubblicazione: (2024)
Predicting the Intention to Interact with a Service Robot:the Role of Gaze Cues
di: Arreghini, Simone, et al.
Pubblicazione: (2024)
di: Arreghini, Simone, et al.
Pubblicazione: (2024)
Simple Recipe Works: Vision-Language-Action Models are Natural Continual Learners with Reinforcement Learning
di: Hu, Jiaheng, et al.
Pubblicazione: (2026)
di: Hu, Jiaheng, et al.
Pubblicazione: (2026)
Learning-based adaption of robotic friction models
di: Scholl, Philipp, et al.
Pubblicazione: (2023)
di: Scholl, Philipp, et al.
Pubblicazione: (2023)
Vision Language Models are In-Context Value Learners
di: Ma, Yecheng Jason, et al.
Pubblicazione: (2024)
di: Ma, Yecheng Jason, et al.
Pubblicazione: (2024)
BLAZER: Bootstrapping LLM-based Manipulation Agents with Zero-Shot Data Generation
di: Das, Rocktim Jyoti, et al.
Pubblicazione: (2025)
di: Das, Rocktim Jyoti, et al.
Pubblicazione: (2025)
Accelerating Model-Based Reinforcement Learning using Non-Linear Trajectory Optimization
di: Calì, Marco, et al.
Pubblicazione: (2025)
di: Calì, Marco, et al.
Pubblicazione: (2025)
Accelerating trajectory optimization with Sobolev-trained diffusion policies
di: Hellard, Théotime Le, et al.
Pubblicazione: (2026)
di: Hellard, Théotime Le, et al.
Pubblicazione: (2026)
A Data-Based Architecture for Flight Test without Test Points
di: Harp, D. Isaiah, et al.
Pubblicazione: (2025)
di: Harp, D. Isaiah, et al.
Pubblicazione: (2025)
Lifelong Learner: Discovering Versatile Neural Solvers for Vehicle Routing Problems
di: Feng, Shaodi, et al.
Pubblicazione: (2025)
di: Feng, Shaodi, et al.
Pubblicazione: (2025)
AcL: Action Learner for Fault-Tolerant Quadruped Locomotion Control
di: Xu, Tianyu, et al.
Pubblicazione: (2025)
di: Xu, Tianyu, et al.
Pubblicazione: (2025)
ClevrSkills: Compositional Language and Visual Reasoning in Robotics
di: Haresh, Sanjay, et al.
Pubblicazione: (2024)
di: Haresh, Sanjay, et al.
Pubblicazione: (2024)
CGGM: A conditional graph generation model with adaptive sparsity for node anomaly detection in IoT networks
di: Li, Munan, et al.
Pubblicazione: (2024)
di: Li, Munan, et al.
Pubblicazione: (2024)
Bootstrapping Reinforcement Learning with Sub-optimal Policies for Autonomous Driving
di: Zhang, Zhihao, et al.
Pubblicazione: (2025)
di: Zhang, Zhihao, et al.
Pubblicazione: (2025)
Bootstrapping Reinforcement Learning with Imitation for Vision-Based Agile Flight
di: Xing, Jiaxu, et al.
Pubblicazione: (2024)
di: Xing, Jiaxu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Pretraining in Actor-Critic Reinforcement Learning for Robot Locomotion
di: Fan, Jiale, et al.
Pubblicazione: (2025) -
Waverider: Leveraging Hierarchical, Multi-Resolution Maps for Efficient and Reactive Obstacle Avoidance
di: Reijgwart, Victor, et al.
Pubblicazione: (2024) -
Whole-body End-Effector Pose Tracking
di: Portela, Tifanny, et al.
Pubblicazione: (2024) -
Efficient Hierarchical Any-Angle Path Planning on Multi-Resolution 3D Grids
di: Reijgwart, Victor, et al.
Pubblicazione: (2026) -
Task Adaptation in Industrial Human-Robot Interaction: Leveraging Riemannian Motion Policies
di: Allenspach, Mike, et al.
Pubblicazione: (2024)