Training People to Reward Robots
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Endong, Zhu, Yuqing, Howard, Matthew |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Using Machine Teaching to Boost Novices' Robot Teaching Skill
par: Zhu, Yuqing, et autres
Publié: (2024)
par: Zhu, Yuqing, et autres
Publié: (2024)
Efficient Continual Adaptation of Pretrained Robotic Policy with Online Meta-Learned Adapters
par: Zhu, Ruiqi, et autres
Publié: (2025)
par: Zhu, Ruiqi, et autres
Publié: (2025)
Reward Training Wheels: Adaptive Auxiliary Rewards for Robotics Reinforcement Learning
par: Wang, Linji, et autres
Publié: (2025)
par: Wang, Linji, et autres
Publié: (2025)
Learning Locomotion on Complex Terrain for Quadrupedal Robots with Foot Position Maps and Stability Rewards
par: Hwang, Matthew, et autres
Publié: (2026)
par: Hwang, Matthew, et autres
Publié: (2026)
Keyframe-Guided Structured Rewards for Reinforcement Learning in Long-Horizon Laboratory Robotics
par: Qiu, Yibo, et autres
Publié: (2026)
par: Qiu, Yibo, et autres
Publié: (2026)
RoboReward: General-Purpose Vision-Language Reward Models for Robotics
par: Lee, Tony, et autres
Publié: (2026)
par: Lee, Tony, et autres
Publié: (2026)
ELEMENTAL: Interactive Learning from Demonstrations and Vision-Language Models for Reward Design in Robotics
par: Chen, Letian, et autres
Publié: (2024)
par: Chen, Letian, et autres
Publié: (2024)
On-Robot Reinforcement Learning with Goal-Contrastive Rewards
par: Biza, Ondrej, et autres
Publié: (2024)
par: Biza, Ondrej, et autres
Publié: (2024)
Exercise Specialists Evaluation of Robot-led Physical Therapy for People with Parkinsons Disease
par: Lamsey, Matthew, et autres
Publié: (2025)
par: Lamsey, Matthew, et autres
Publié: (2025)
STRIDE: Automating Reward Design, Deep Reinforcement Learning Training and Feedback Optimization in Humanoid Robotics Locomotion
par: Wu, Zhenwei, et autres
Publié: (2025)
par: Wu, Zhenwei, et autres
Publié: (2025)
Uncertainty-Aware Multi-Robot Task Allocation With Strongly Coupled Inter-Robot Rewards
par: Rossano, Ben, et autres
Publié: (2025)
par: Rossano, Ben, et autres
Publié: (2025)
Reward Machine Inference for Robotic Manipulation
par: Baert, Mattijs, et autres
Publié: (2024)
par: Baert, Mattijs, et autres
Publié: (2024)
Beyond Pixels: Learning Invariant Rewards for Real-World Robotics From a Few Demonstrations
par: Xu, Tengye, et autres
Publié: (2026)
par: Xu, Tengye, et autres
Publié: (2026)
Training-free Generation of Temporally Consistent Rewards from VLMs
par: Zhao, Yinuo, et autres
Publié: (2025)
par: Zhao, Yinuo, et autres
Publié: (2025)
Unidirectional Human-Robot-Human Physical Interaction for Gait Training
par: Amato, Lorenzo, et autres
Publié: (2024)
par: Amato, Lorenzo, et autres
Publié: (2024)
SuPLE: Robot Learning with Lyapunov Rewards
par: Nguyen, Phu, et autres
Publié: (2024)
par: Nguyen, Phu, et autres
Publié: (2024)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
par: Ishihara, Yu, et autres
Publié: (2025)
par: Ishihara, Yu, et autres
Publié: (2025)
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
par: Wu, Yanru, et autres
Publié: (2026)
par: Wu, Yanru, et autres
Publié: (2026)
HALO: Human Preference Aligned Offline Reward Learning for Robot Navigation
par: Seneviratne, Gershom, et autres
Publié: (2025)
par: Seneviratne, Gershom, et autres
Publié: (2025)
Reinforced Embodied Planning with Verifiable Reward for Real-World Robotic Manipulation
par: Bo, Zitong, et autres
Publié: (2025)
par: Bo, Zitong, et autres
Publié: (2025)
SARM: Stage-Aware Reward Modeling for Long Horizon Robot Manipulation
par: Chen, Qianzhong, et autres
Publié: (2025)
par: Chen, Qianzhong, et autres
Publié: (2025)
Influence-Based Reward Modulation for Implicit Communication in Human-Robot Interaction
par: Jiang, Haoyang, et autres
Publié: (2024)
par: Jiang, Haoyang, et autres
Publié: (2024)
Kinodynamic Motion Planning for Mobile Robot Navigation across Inconsistent World Models
par: Damm, Eric R., et autres
Publié: (2025)
par: Damm, Eric R., et autres
Publié: (2025)
Understanding Expectations for a Robotic Guide Dog for Visually Impaired People
par: Kim, J. Taery, et autres
Publié: (2025)
par: Kim, J. Taery, et autres
Publié: (2025)
RoboScape-R: Unified Reward-Observation World Models for Generalizable Robotics Training via RL
par: Tang, Yinzhou, et autres
Publié: (2025)
par: Tang, Yinzhou, et autres
Publié: (2025)
Robo-Dopamine: General Process Reward Modeling for High-Precision Robotic Manipulation
par: Tan, Huajie, et autres
Publié: (2025)
par: Tan, Huajie, et autres
Publié: (2025)
Hi-WM: Human-in-the-World-Model for Scalable Robot Post-Training
par: Li, Yaxuan, et autres
Publié: (2026)
par: Li, Yaxuan, et autres
Publié: (2026)
Generalized Task-Driven Design of Soft Robots via Reduced-Order FEM-based Surrogate Modeling
par: Yao, Yao, et autres
Publié: (2026)
par: Yao, Yao, et autres
Publié: (2026)
Following Is All You Need: Robot Crowd Navigation Using People As Planners
par: Liao, Yuwen, et autres
Publié: (2025)
par: Liao, Yuwen, et autres
Publié: (2025)
Will People Enjoy a Robot Trainer? A Case Study with Snoopie the Pacerbot
par: Du, Maximilian, et autres
Publié: (2026)
par: Du, Maximilian, et autres
Publié: (2026)
The Un-Kidnappable Robot: Acoustic Localization of Sneaking People
par: Yang, Mengyu, et autres
Publié: (2023)
par: Yang, Mengyu, et autres
Publié: (2023)
Phantom: Training Robots Without Robots Using Only Human Videos
par: Lepert, Marion, et autres
Publié: (2025)
par: Lepert, Marion, et autres
Publié: (2025)
Video2Reward: Generating Reward Function from Videos for Legged Robot Behavior Learning
par: Zeng, Runhao, et autres
Publié: (2024)
par: Zeng, Runhao, et autres
Publié: (2024)
IRL-VLA: Training an Vision-Language-Action Policy via Reward World Model
par: Jiang, Anqing, et autres
Publié: (2025)
par: Jiang, Anqing, et autres
Publié: (2025)
Generalization in Deep Reinforcement Learning for Robotic Navigation by Reward Shaping
par: Miranda, Victor R. F., et autres
Publié: (2022)
par: Miranda, Victor R. F., et autres
Publié: (2022)
Oh F**k! How Do People Feel about Robots that Leverage Profanity?
par: Shippy, Madison R., et autres
Publié: (2025)
par: Shippy, Madison R., et autres
Publié: (2025)
Gesture-Based Robot Control Integrating Mm-wave Radar and Behavior Trees
par: Song, Yuqing, et autres
Publié: (2025)
par: Song, Yuqing, et autres
Publié: (2025)
Actor-Critic for Continuous Action Chunks: A Reinforcement Learning Framework for Long-Horizon Robotic Manipulation with Sparse Reward
par: Yang, Jiarui, et autres
Publié: (2025)
par: Yang, Jiarui, et autres
Publié: (2025)
Robotic Scene Cloning:Advancing Zero-Shot Robotic Scene Adaptation in Manipulation via Visual Prompt Editing
par: Huang, Binyuan, et autres
Publié: (2026)
par: Huang, Binyuan, et autres
Publié: (2026)
AtomVLA: Scalable Post-Training for Robotic Manipulation via Predictive Latent World Models
par: Sun, Xiaoquan, et autres
Publié: (2026)
par: Sun, Xiaoquan, et autres
Publié: (2026)
Documents similaires
-
Using Machine Teaching to Boost Novices' Robot Teaching Skill
par: Zhu, Yuqing, et autres
Publié: (2024) -
Efficient Continual Adaptation of Pretrained Robotic Policy with Online Meta-Learned Adapters
par: Zhu, Ruiqi, et autres
Publié: (2025) -
Reward Training Wheels: Adaptive Auxiliary Rewards for Robotics Reinforcement Learning
par: Wang, Linji, et autres
Publié: (2025) -
Learning Locomotion on Complex Terrain for Quadrupedal Robots with Foot Position Maps and Stability Rewards
par: Hwang, Matthew, et autres
Publié: (2026) -
Keyframe-Guided Structured Rewards for Reinforcement Learning in Long-Horizon Laboratory Robotics
par: Qiu, Yibo, et autres
Publié: (2026)