SuPLE: Robot Learning with Lyapunov Rewards
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nguyen, Phu, Polani, Daniel, Tiomkin, Stas |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Decentralized Traffic Flow Optimization Through Intrinsic Motivation
par: Papala, Himaja, et autres
Publié: (2025)
par: Papala, Himaja, et autres
Publié: (2025)
Acoustic Wave Manipulation Through Sparse Robotic Actuation
par: Shah, Tristan, et autres
Publié: (2025)
par: Shah, Tristan, et autres
Publié: (2025)
Multi-Agent Empowerment and Emergence of Complex Behavior in Groups
par: Shah, Tristan, et autres
Publié: (2026)
par: Shah, Tristan, et autres
Publié: (2026)
Learning telic-controllable state representations
par: Amir, Nadav, et autres
Publié: (2024)
par: Amir, Nadav, et autres
Publié: (2024)
Emergence of Physical Intelligence via Controllable Information Production
par: Shah, Tristan, et autres
Publié: (2026)
par: Shah, Tristan, et autres
Publié: (2026)
Bootstrapped Reward Shaping
par: Adamczyk, Jacob, et autres
Publié: (2025)
par: Adamczyk, Jacob, et autres
Publié: (2025)
Average-Reward Soft Actor-Critic
par: Adamczyk, Jacob, et autres
Publié: (2025)
par: Adamczyk, Jacob, et autres
Publié: (2025)
Reward Training Wheels: Adaptive Auxiliary Rewards for Robotics Reinforcement Learning
par: Wang, Linji, et autres
Publié: (2025)
par: Wang, Linji, et autres
Publié: (2025)
Goals and the Structure of Experience
par: Amir, Nadav, et autres
Publié: (2025)
par: Amir, Nadav, et autres
Publié: (2025)
HALO: Learning Human-Robot Collaboration via Heterogeneous-Agent Lyapunov Policy Optimization
par: Zhang, Hao, et autres
Publié: (2026)
par: Zhang, Hao, et autres
Publié: (2026)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
par: Ishihara, Yu, et autres
Publié: (2025)
par: Ishihara, Yu, et autres
Publié: (2025)
CLIP-Motion: Learning Reward Functions for Robotic Actions Using Consecutive Observations
par: Dang, Xuzhe, et autres
Publié: (2023)
par: Dang, Xuzhe, et autres
Publié: (2023)
Boosting Soft Q-Learning by Bounding
par: Adamczyk, Jacob, et autres
Publié: (2024)
par: Adamczyk, Jacob, et autres
Publié: (2024)
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
par: Wu, Yanru, et autres
Publié: (2026)
par: Wu, Yanru, et autres
Publié: (2026)
Learning Reward for Robot Skills Using Large Language Models via Self-Alignment
par: Zeng, Yuwei, et autres
Publié: (2024)
par: Zeng, Yuwei, et autres
Publié: (2024)
Automated Hybrid Reward Scheduling via Large Language Models for Robotic Skill Learning
par: Huang, Changxin, et autres
Publié: (2025)
par: Huang, Changxin, et autres
Publié: (2025)
EVAL: EigenVector-based Average-reward Learning
par: Adamczyk, Jacob, et autres
Publié: (2025)
par: Adamczyk, Jacob, et autres
Publié: (2025)
Robot Policy Learning with Temporal Optimal Transport Reward
par: Fu, Yuwei, et autres
Publié: (2024)
par: Fu, Yuwei, et autres
Publié: (2024)
Stage-Wise Reward Shaping for Acrobatic Robots: A Constrained Multi-Objective Reinforcement Learning Approach
par: Kim, Dohyeong, et autres
Publié: (2024)
par: Kim, Dohyeong, et autres
Publié: (2024)
Actor-Critic for Continuous Action Chunks: A Reinforcement Learning Framework for Long-Horizon Robotic Manipulation with Sparse Reward
par: Yang, Jiarui, et autres
Publié: (2025)
par: Yang, Jiarui, et autres
Publié: (2025)
ManeuverNet: A Soft Actor-Critic Framework for Precise Maneuvering of Double-Ackermann-Steering Robots with Optimized Reward Functions
par: Deflesselle, Kohio, et autres
Publié: (2026)
par: Deflesselle, Kohio, et autres
Publié: (2026)
Learning to Recover: Dynamic Reward Shaping with Wheel-Leg Coordination for Fallen Robots
par: Deng, Boyuan, et autres
Publié: (2025)
par: Deng, Boyuan, et autres
Publié: (2025)
Confidence-Controlled Exploration: Efficient Sparse-Reward Policy Learning for Robot Navigation
par: Patel, Bhrij, et autres
Publié: (2023)
par: Patel, Bhrij, et autres
Publié: (2023)
EvoNav: Evolutionary Reward Function Design for Robot Navigation with Large Language Models
par: Zhao, Zhikai, et autres
Publié: (2026)
par: Zhao, Zhikai, et autres
Publié: (2026)
Representation Alignment from Human Feedback for Cross-Embodiment Reward Learning from Mixed-Quality Demonstrations
par: Mattson, Connor, et autres
Publié: (2024)
par: Mattson, Connor, et autres
Publié: (2024)
RoboAlign-R1: Distilled Multimodal Reward Alignment for Robot Video World Models
par: Wu, Hao, et autres
Publié: (2026)
par: Wu, Hao, et autres
Publié: (2026)
EVA: Aligning Video World Models with Executable Robot Actions via Inverse Dynamics Rewards
par: Wang, Ruixiang, et autres
Publié: (2026)
par: Wang, Ruixiang, et autres
Publié: (2026)
RobotKeyframing: Learning Locomotion with High-Level Objectives via Mixture of Dense and Sparse Rewards
par: Zargarbashi, Fatemeh, et autres
Publié: (2024)
par: Zargarbashi, Fatemeh, et autres
Publié: (2024)
ARCap: Collecting High-quality Human Demonstrations for Robot Learning with Augmented Reality Feedback
par: Chen, Sirui, et autres
Publié: (2024)
par: Chen, Sirui, et autres
Publié: (2024)
Multi-Resolution Diffusion for Privacy-Sensitive Recommender Systems
par: Lilienthal, Derek, et autres
Publié: (2023)
par: Lilienthal, Derek, et autres
Publié: (2023)
TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics
par: Chen, Shirui, et autres
Publié: (2026)
par: Chen, Shirui, et autres
Publié: (2026)
Not Only Rewards But Also Constraints: Applications on Legged Robot Locomotion
par: Kim, Yunho, et autres
Publié: (2023)
par: Kim, Yunho, et autres
Publié: (2023)
Reward-Centered ReST-MCTS: A Robust Decision-Making Framework for Robotic Manipulation in High Uncertainty Environments
par: Wang, Xibai
Publié: (2025)
par: Wang, Xibai
Publié: (2025)
OPAL: Encoding Causal Understanding of Physical Systems for Robot Learning
par: Tcheurekdjian, Daniel, et autres
Publié: (2025)
par: Tcheurekdjian, Daniel, et autres
Publié: (2025)
Weather-Robust Cross-View Geo-Localization via Prototype-Based Semantic Part Discovery
par: Tran, Chi-Nguyen, et autres
Publié: (2026)
par: Tran, Chi-Nguyen, et autres
Publié: (2026)
Robot Air Hockey: A Manipulation Testbed for Robot Learning with Reinforcement Learning
par: Chuck, Caleb, et autres
Publié: (2024)
par: Chuck, Caleb, et autres
Publié: (2024)
Reward Learning from Suboptimal Demonstrations with Applications in Surgical Electrocautery
par: Karimi, Zohre, et autres
Publié: (2024)
par: Karimi, Zohre, et autres
Publié: (2024)
Neural-Network-Driven Reward Prediction as a Heuristic: Advancing Q-Learning for Mobile Robot Path Planning
par: Ji, Yiming, et autres
Publié: (2024)
par: Ji, Yiming, et autres
Publié: (2024)
Causally Robust Reward Learning from Reason-Augmented Preference Feedback
par: Hwang, Minjune, et autres
Publié: (2026)
par: Hwang, Minjune, et autres
Publié: (2026)
CaRL: Learning Scalable Planning Policies with Simple Rewards
par: Jaeger, Bernhard, et autres
Publié: (2025)
par: Jaeger, Bernhard, et autres
Publié: (2025)
Documents similaires
-
Decentralized Traffic Flow Optimization Through Intrinsic Motivation
par: Papala, Himaja, et autres
Publié: (2025) -
Acoustic Wave Manipulation Through Sparse Robotic Actuation
par: Shah, Tristan, et autres
Publié: (2025) -
Multi-Agent Empowerment and Emergence of Complex Behavior in Groups
par: Shah, Tristan, et autres
Publié: (2026) -
Learning telic-controllable state representations
par: Amir, Nadav, et autres
Publié: (2024) -
Emergence of Physical Intelligence via Controllable Information Production
par: Shah, Tristan, et autres
Publié: (2026)