The intrinsic motivation of reinforcement and imitation learning for sequential tasks
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Nguyen, Sao Mai |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
D-Shape: Demonstration-Shaped Reinforcement Learning via Goal Conditioning
par: Wang, Caroline, et autres
Publié: (2022)
par: Wang, Caroline, et autres
Publié: (2022)
Explaining Bayesian Optimization by Shapley Values Facilitates Human-AI Collaboration
par: Rodemann, Julian, et autres
Publié: (2024)
par: Rodemann, Julian, et autres
Publié: (2024)
ASkDAgger: Active Skill-level Data Aggregation for Interactive Imitation Learning
par: Luijkx, Jelle, et autres
Publié: (2025)
par: Luijkx, Jelle, et autres
Publié: (2025)
Bi3: A Biplatform, Bicultural, Biperson Dataset for Social Robot Navigation
par: Stratton, Andrew, et autres
Publié: (2026)
par: Stratton, Andrew, et autres
Publié: (2026)
MEReQ: Max-Ent Residual-Q Inverse RL for Sample-Efficient Alignment from Intervention
par: Chen, Yuxin, et autres
Publié: (2024)
par: Chen, Yuxin, et autres
Publié: (2024)
Towards a Robust Soft Baby Robot With Rich Interaction Ability for Advanced Machine Learning Algorithms
par: Alhakami, Mohannad, et autres
Publié: (2024)
par: Alhakami, Mohannad, et autres
Publié: (2024)
SPACeR: Self-Play Anchoring with Centralized Reference Models
par: Chang, Wei-Jer, et autres
Publié: (2025)
par: Chang, Wei-Jer, et autres
Publié: (2025)
SaiVLA-0: Cerebrum--Pons--Cerebellum Tripartite Architecture for Compute-Aware Vision-Language-Action
par: Shi, Xiang, et autres
Publié: (2026)
par: Shi, Xiang, et autres
Publié: (2026)
When Does Adaptive Guidance Help? Belief-Aware Privileged Distillation for Autonomous Driving Under Partial Observability
par: Haklidir, Mehmet
Publié: (2026)
par: Haklidir, Mehmet
Publié: (2026)
CUPID: Curating Data your Robot Loves with Influence Functions
par: Agia, Christopher, et autres
Publié: (2025)
par: Agia, Christopher, et autres
Publié: (2025)
MTDrive: Multi-turn Interactive Reinforcement Learning for Autonomous Driving
par: Li, Xidong, et autres
Publié: (2026)
par: Li, Xidong, et autres
Publié: (2026)
Domain-Specific Fine-Tuning of Large Language Models for Interactive Robot Programming
par: Alt, Benjamin, et autres
Publié: (2023)
par: Alt, Benjamin, et autres
Publié: (2023)
Learning to Generate Pointing Gestures in Situated Embodied Conversational Agents
par: Deichler, Anna, et autres
Publié: (2025)
par: Deichler, Anna, et autres
Publié: (2025)
Mixed-Initiative Dialog for Human-Robot Collaborative Manipulation
par: Yu, Albert, et autres
Publié: (2025)
par: Yu, Albert, et autres
Publié: (2025)
Interactive Groupwise Comparison for Reinforcement Learning from Human Feedback
par: Kompatscher, Jan, et autres
Publié: (2025)
par: Kompatscher, Jan, et autres
Publié: (2025)
The Shortcomings of Force-from-Motion in Robot Learning
par: Aljalbout, Elie, et autres
Publié: (2024)
par: Aljalbout, Elie, et autres
Publié: (2024)
RoboPack: Learning Tactile-Informed Dynamics Models for Dense Packing
par: Ai, Bo, et autres
Publié: (2024)
par: Ai, Bo, et autres
Publié: (2024)
The State of Robot Motion Generation
par: Bekris, Kostas E., et autres
Publié: (2024)
par: Bekris, Kostas E., et autres
Publié: (2024)
Building Minimal and Reusable Causal State Abstractions for Reinforcement Learning
par: Wang, Zizhao, et autres
Publié: (2024)
par: Wang, Zizhao, et autres
Publié: (2024)
A Framework for Neurosymbolic Robot Action Planning using Large Language Models
par: Capitanelli, Alessio, et autres
Publié: (2023)
par: Capitanelli, Alessio, et autres
Publié: (2023)
The Reality Gap in Robotics: Challenges, Solutions, and Best Practices
par: Aljalbout, Elie, et autres
Publié: (2025)
par: Aljalbout, Elie, et autres
Publié: (2025)
Achieving Scalable Robot Autonomy via neurosymbolic planning using lightweight local LLM
par: Attolino, Nicholas, et autres
Publié: (2025)
par: Attolino, Nicholas, et autres
Publié: (2025)
Cost-Aware Diffusion Active Search
par: Banerjee, Arundhati, et autres
Publié: (2026)
par: Banerjee, Arundhati, et autres
Publié: (2026)
Robo-CSK-Organizer: Commonsense Knowledge to Organize Detected Objects for Multipurpose Robots
par: Hidalgo, Rafael, et autres
Publié: (2024)
par: Hidalgo, Rafael, et autres
Publié: (2024)
Predictive Traffic Rule Compliance using Reinforcement Learning
par: Huang, Yanliang, et autres
Publié: (2025)
par: Huang, Yanliang, et autres
Publié: (2025)
Energy-Efficient Quadruped Locomotion with Compliant Feet
par: Pal, Pramod, et autres
Publié: (2026)
par: Pal, Pramod, et autres
Publié: (2026)
Conservative Bias in Multi-Teacher Learning: Why Agents Prefer Low-Reward Advisors
par: Mesto, Maher, et autres
Publié: (2025)
par: Mesto, Maher, et autres
Publié: (2025)
Atomic-Probe Governance for Skill Updates in Compositional Robot Policies
par: Qin, Xue, et autres
Publié: (2026)
par: Qin, Xue, et autres
Publié: (2026)
Pure Planning to Pure Policies and In Between with a Recursive Tree Planner
par: Redlich, A. Norman
Publié: (2024)
par: Redlich, A. Norman
Publié: (2024)
LANGTRAJ: Diffusion Model and Dataset for Language-Conditioned Trajectory Simulation
par: Chang, Wei-Jer, et autres
Publié: (2025)
par: Chang, Wei-Jer, et autres
Publié: (2025)
Positive-Only Drifting Policy Optimization
par: Zhang, Qi
Publié: (2026)
par: Zhang, Qi
Publié: (2026)
Physics-Informed Policy Optimization via Analytic Dynamics Regularization
par: Chandra, Namai, et autres
Publié: (2026)
par: Chandra, Namai, et autres
Publié: (2026)
How VLAs Fail Differently: Black-Box Action Monitoring Reveals Architecture-Specific Failure Signatures
par: Gupta, Krishnam
Publié: (2026)
par: Gupta, Krishnam
Publié: (2026)
Tactile-Proprioceptive Sensor Fusion for Contact Wrench Estimation in Whole-Body Physical Human-Robot Interaction
par: Min, Junha, et autres
Publié: (2026)
par: Min, Junha, et autres
Publié: (2026)
Altered Thoughts, Altered Actions: Probing Chain-of-Thought Vulnerabilities in VLA Robotic Manipulation
par: Trinh, Tuan Duong, et autres
Publié: (2026)
par: Trinh, Tuan Duong, et autres
Publié: (2026)
Simulation-Based Counterfactual Causal Discovery on Real World Driver Behaviour
par: Howard, Rhys, et autres
Publié: (2023)
par: Howard, Rhys, et autres
Publié: (2023)
Towards Context-Aware Human-like Pointing Gestures with RL Motion Imitation
par: Deichler, Anna, et autres
Publié: (2025)
par: Deichler, Anna, et autres
Publié: (2025)
Cortex 2.0: Grounding World Models in Real-World Industrial Deployment
par: Aida, Adriana, et autres
Publié: (2026)
par: Aida, Adriana, et autres
Publié: (2026)
Unpacking Failure Modes of Generative Policies: Runtime Monitoring of Consistency and Progress
par: Agia, Christopher, et autres
Publié: (2024)
par: Agia, Christopher, et autres
Publié: (2024)
Failure Prediction at Runtime for Generative Robot Policies
par: Römer, Ralf, et autres
Publié: (2025)
par: Römer, Ralf, et autres
Publié: (2025)
Documents similaires
-
D-Shape: Demonstration-Shaped Reinforcement Learning via Goal Conditioning
par: Wang, Caroline, et autres
Publié: (2022) -
Explaining Bayesian Optimization by Shapley Values Facilitates Human-AI Collaboration
par: Rodemann, Julian, et autres
Publié: (2024) -
ASkDAgger: Active Skill-level Data Aggregation for Interactive Imitation Learning
par: Luijkx, Jelle, et autres
Publié: (2025) -
Bi3: A Biplatform, Bicultural, Biperson Dataset for Social Robot Navigation
par: Stratton, Andrew, et autres
Publié: (2026) -
MEReQ: Max-Ent Residual-Q Inverse RL for Sample-Efficient Alignment from Intervention
par: Chen, Yuxin, et autres
Publié: (2024)