DAPPER: Discriminability-Aware Policy-to-Policy Preference-Based Reinforcement Learning for Query-Efficient Robot Skill Acquisition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kadokawa, Yuki, Frey, Jonas, Miki, Takahiro, Matsubara, Takamitsu, Hutter, Marco |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Progressive-Resolution Policy Distillation: Leveraging Coarse-Resolution Simulations for Time-Efficient Fine-Resolution Policy Learning
par: Kadokawa, Yuki, et autres
Publié: (2024)
par: Kadokawa, Yuki, et autres
Publié: (2024)
Robust Iterative Value Conversion: Deep Reinforcement Learning for Neurochip-driven Edge Robots
par: Kadokawa, Yuki, et autres
Publié: (2024)
par: Kadokawa, Yuki, et autres
Publié: (2024)
Prolonging Tool Life: Learning Skillful Use of General-purpose Tools through Lifespan-guided Reinforcement Learning
par: Wu, Po-Yen, et autres
Publié: (2025)
par: Wu, Po-Yen, et autres
Publié: (2025)
Learning Risk-Aware Quadrupedal Locomotion using Distributional Reinforcement Learning
par: Schneider, Lukas, et autres
Publié: (2023)
par: Schneider, Lukas, et autres
Publié: (2023)
Learning Quiet Walking for a Small Home Robot
par: Watanabe, Ryo, et autres
Publié: (2025)
par: Watanabe, Ryo, et autres
Publié: (2025)
DeReCo: Decoupling Representation and Coordination Learning for Object-Adaptive Decentralized Multi-Robot Cooperative Transport
par: Shibata, Kazuki, et autres
Publié: (2026)
par: Shibata, Kazuki, et autres
Publié: (2026)
Robust Sim-to-Real Cloth Untangling through Reduced-Resolution Observations via Adaptive Force-Difference Quantization
par: Tsurumine, Yoshihisa, et autres
Publié: (2026)
par: Tsurumine, Yoshihisa, et autres
Publié: (2026)
MEM: Multi-Modal Elevation Mapping for Robotics and Learning
par: Erni, Gian, et autres
Publié: (2023)
par: Erni, Gian, et autres
Publié: (2023)
Reinforcement Learning of Flexible Policies for Symbolic Instructions with Adjustable Mapping Specifications
par: Hatanaka, Wataru, et autres
Publié: (2025)
par: Hatanaka, Wataru, et autres
Publié: (2025)
ViSA: Visited-State Augmentation for Generalized Goal-Space Contrastive Reinforcement Learning
par: Nakamura, Issa, et autres
Publié: (2026)
par: Nakamura, Issa, et autres
Publié: (2026)
CoLF: Learning Consistent Leader-Follower Policies for Vision-Language-Guided Multi-Robot Cooperative Transport
par: Despature, Joachim Yann, et autres
Publié: (2026)
par: Despature, Joachim Yann, et autres
Publié: (2026)
Task-priority Intermediated Hierarchical Distributed Policies: Reinforcement Learning of Adaptive Multi-robot Cooperative Transport
par: Naito, Yusei, et autres
Publié: (2024)
par: Naito, Yusei, et autres
Publié: (2024)
Identifying Terrain Physical Parameters from Vision -- Towards Physical-Parameter-Aware Locomotion and Navigation
par: Chen, Jiaqi, et autres
Publié: (2024)
par: Chen, Jiaqi, et autres
Publié: (2024)
Domains as Objectives: Domain-Uncertainty-Aware Policy Optimization through Explicit Multi-Domain Convex Coverage Set Learning
par: Ilboudo, Wendyam Eric Lionel, et autres
Publié: (2024)
par: Ilboudo, Wendyam Eric Lionel, et autres
Publié: (2024)
Composite Gaussian Processes Flows for Learning Discontinuous Multimodal Policies
par: Wang, Shu-yuan, et autres
Publié: (2025)
par: Wang, Shu-yuan, et autres
Publié: (2025)
Motion Priors Reimagined: Adapting Flat-Terrain Skills for Complex Quadruped Mobility
par: Zhang, Zewei, et autres
Publié: (2025)
par: Zhang, Zewei, et autres
Publié: (2025)
Learned Perceptive Forward Dynamics Model for Safe and Platform-aware Robotic Navigation
par: Roth, Pascal, et autres
Publié: (2025)
par: Roth, Pascal, et autres
Publié: (2025)
Leveraging Demonstrator-perceived Precision for Safe Interactive Imitation Learning of Clearance-limited Tasks
par: Oh, Hanbit, et autres
Publié: (2024)
par: Oh, Hanbit, et autres
Publié: (2024)
Learning to walk in confined spaces using 3D representation
par: Miki, Takahiro, et autres
Publié: (2024)
par: Miki, Takahiro, et autres
Publié: (2024)
EnQuery: Ensemble Policies for Diverse Query-Generation in Preference Alignment of Robot Navigation
par: de Heuvel, Jorge, et autres
Publié: (2024)
par: de Heuvel, Jorge, et autres
Publié: (2024)
Uncertainty-Aware Robotic World Model Makes Offline Model-Based Reinforcement Learning Work on Real Robots
par: Li, Chenhao, et autres
Publié: (2025)
par: Li, Chenhao, et autres
Publié: (2025)
Reinforcement Learning of Multi-robot Task Allocation for Multi-object Transportation with Infeasible Tasks
par: Shida, Yuma, et autres
Publié: (2024)
par: Shida, Yuma, et autres
Publié: (2024)
Cost-Aware Query Policies in Active Learning for Efficient Autonomous Robotic Exploration
par: Akins, Sapphira, et autres
Publié: (2024)
par: Akins, Sapphira, et autres
Publié: (2024)
Symmetry Considerations for Learning Task Symmetric Robot Policies
par: Mittal, Mayank, et autres
Publié: (2024)
par: Mittal, Mayank, et autres
Publié: (2024)
Task-Relevant and Irrelevant Region-Aware Augmentation for Generalizable Vision-Based Imitation Learning in Agricultural Manipulation
par: Hattori, Shun, et autres
Publié: (2026)
par: Hattori, Shun, et autres
Publié: (2026)
Incipient Slip Detection by Vibration Injection into Soft Sensor
par: Komeno, Naoto, et autres
Publié: (2024)
par: Komeno, Naoto, et autres
Publié: (2024)
Kleinkram: Open Robotic Data Management
par: Püntener, Cyrill, et autres
Publié: (2025)
par: Püntener, Cyrill, et autres
Publié: (2025)
Efficient Model-Based Reinforcement Learning for Robot Control via Online Optimization
par: Nan, Fang, et autres
Publié: (2025)
par: Nan, Fang, et autres
Publié: (2025)
Feasibility-aware Imitation Learning from Observation with Multimodal Feedback
par: Takahashi, Kei, et autres
Publié: (2026)
par: Takahashi, Kei, et autres
Publié: (2026)
DecompGrind: A Decomposition Framework for Robotic Grinding via Cutting-Surface Planning and Contact-Force Adaptation
par: Araki, Shunsuke, et autres
Publié: (2026)
par: Araki, Shunsuke, et autres
Publié: (2026)
Learning Robust Autonomous Navigation and Locomotion for Wheeled-Legged Robots
par: Lee, Joonho, et autres
Publié: (2024)
par: Lee, Joonho, et autres
Publié: (2024)
Learning to Open and Traverse Doors with a Legged Manipulator
par: Zhang, Mike, et autres
Publié: (2024)
par: Zhang, Mike, et autres
Publié: (2024)
ASBI: Leveraging Informative Real-World Data for Active Black-Box Simulator Tuning
par: Kim, Gahee, et autres
Publié: (2025)
par: Kim, Gahee, et autres
Publié: (2025)
BEAC: Imitating Complex Exploration and Task-oriented Behaviors for Invisible Object Nonprehensile Manipulation
par: Tahara, Hirotaka, et autres
Publié: (2025)
par: Tahara, Hirotaka, et autres
Publié: (2025)
Robotic World Model: A Neural Network Simulator for Robust Policy Optimization in Robotics
par: Li, Chenhao, et autres
Publié: (2025)
par: Li, Chenhao, et autres
Publié: (2025)
Efficient Language-instructed Skill Acquisition via Reward-Policy Co-Evolution
par: Huang, Changxin, et autres
Publié: (2024)
par: Huang, Changxin, et autres
Publié: (2024)
Foundational Policy Acquisition via Multitask Learning for Motor Skill Generation
par: Yamamori, Satoshi, et autres
Publié: (2023)
par: Yamamori, Satoshi, et autres
Publié: (2023)
Less Is More: Scalable Visual Navigation from Limited Data
par: Inglin, Yves, et autres
Publié: (2026)
par: Inglin, Yves, et autres
Publié: (2026)
Where Do We Look When We Teach? Analyzing Human Gaze Behavior Across Demonstration Devices in Robot Imitation Learning
par: Ishida, Yutaro, et autres
Publié: (2025)
par: Ishida, Yutaro, et autres
Publié: (2025)
Feasibility-aware Imitation Learning from Observations through a Hand-mounted Demonstration Interface
par: Takahashi, Kei, et autres
Publié: (2025)
par: Takahashi, Kei, et autres
Publié: (2025)
Documents similaires
-
Progressive-Resolution Policy Distillation: Leveraging Coarse-Resolution Simulations for Time-Efficient Fine-Resolution Policy Learning
par: Kadokawa, Yuki, et autres
Publié: (2024) -
Robust Iterative Value Conversion: Deep Reinforcement Learning for Neurochip-driven Edge Robots
par: Kadokawa, Yuki, et autres
Publié: (2024) -
Prolonging Tool Life: Learning Skillful Use of General-purpose Tools through Lifespan-guided Reinforcement Learning
par: Wu, Po-Yen, et autres
Publié: (2025) -
Learning Risk-Aware Quadrupedal Locomotion using Distributional Reinforcement Learning
par: Schneider, Lukas, et autres
Publié: (2023) -
Learning Quiet Walking for a Small Home Robot
par: Watanabe, Ryo, et autres
Publié: (2025)