Human-Aligned Skill Discovery: Balancing Behaviour Exploration and Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hussonnois, Maxence, Karimpanal, Thommen George, Rana, Santu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating Model-Agnostic Meta-Learning on MetaWorld ML10 Benchmark: Fast Adaptation in Robotic Manipulation Tasks
par: Atamuradov, Sanjar
Publié: (2025)
par: Atamuradov, Sanjar
Publié: (2025)
Autonomous Multi-Robot Infrastructure for AI-Enabled Healthcare Delivery and Diagnostics
par: Kalaivanan, Nakhul, et autres
Publié: (2025)
par: Kalaivanan, Nakhul, et autres
Publié: (2025)
Connectivity-Aware Representations for Constrained Motion Planning via Multi-Scale Contrastive Learning
par: Jeon, Suhyun, et autres
Publié: (2026)
par: Jeon, Suhyun, et autres
Publié: (2026)
FT-NCFM: An Influence-Aware Data Distillation Framework for Efficient VLA Models
par: Chen, Kewei, et autres
Publié: (2025)
par: Chen, Kewei, et autres
Publié: (2025)
ATAAT: Adaptive Threat-Aware Adversarial Tuning Framework against Backdoor Attacks on Vision-Language-Action Models
par: Chen, Kewei, et autres
Publié: (2026)
par: Chen, Kewei, et autres
Publié: (2026)
LiloDriver: A Lifelong Learning Framework for Closed-loop Motion Planning in Long-tail Autonomous Driving Scenarios
par: Yao, Huaiyuan, et autres
Publié: (2025)
par: Yao, Huaiyuan, et autres
Publié: (2025)
Beyond Motion Imitation: Is Human Motion Data Alone Sufficient to Explain Gait Control and Biomechanics?
par: Liu, Xinyi, et autres
Publié: (2026)
par: Liu, Xinyi, et autres
Publié: (2026)
Towards Context-Aware Human-like Pointing Gestures with RL Motion Imitation
par: Deichler, Anna, et autres
Publié: (2025)
par: Deichler, Anna, et autres
Publié: (2025)
Analyzing the Impact of Multimodal Perception on Sample Complexity and Optimization Landscapes in Imitation Learning
par: Abuelsamen, Luai, et autres
Publié: (2025)
par: Abuelsamen, Luai, et autres
Publié: (2025)
Flex: End-to-End Text-Instructed Visual Navigation from Foundation Model Features
par: Chahine, Makram, et autres
Publié: (2024)
par: Chahine, Makram, et autres
Publié: (2024)
ASkDAgger: Active Skill-level Data Aggregation for Interactive Imitation Learning
par: Luijkx, Jelle, et autres
Publié: (2025)
par: Luijkx, Jelle, et autres
Publié: (2025)
Emergence of Goal-Directed Behaviors via Active Inference with Self-Prior
par: Kim, Dongmin, et autres
Publié: (2025)
par: Kim, Dongmin, et autres
Publié: (2025)
Active Inference with a Self-Prior in the Mirror-Mark Task
par: Kim, Dongmin, et autres
Publié: (2026)
par: Kim, Dongmin, et autres
Publié: (2026)
ElasticFlow: One-Step Physics-Consistent Policy with Elastic Time Horizons for Language-Guided Manipulation
par: Chen, Kewei, et autres
Publié: (2026)
par: Chen, Kewei, et autres
Publié: (2026)
LLM-Guided Task- and Affordance-Level Exploration in Reinforcement Learning
par: Luijkx, Jelle, et autres
Publié: (2025)
par: Luijkx, Jelle, et autres
Publié: (2025)
A Survey of Sim-to-Real Methods in RL: Progress, Prospects and Challenges with Foundation Models
par: Da, Longchao, et autres
Publié: (2025)
par: Da, Longchao, et autres
Publié: (2025)
SoMA: A Real-to-Sim Neural Simulator for Robotic Soft-body Manipulation
par: Huang, Mu, et autres
Publié: (2026)
par: Huang, Mu, et autres
Publié: (2026)
RoboMoRe: LLM-based Robot Co-design via Joint Optimization of Morphology and Reward
par: Fang, Jiawei, et autres
Publié: (2025)
par: Fang, Jiawei, et autres
Publié: (2025)
Coupling Tensor Trains with Graph of Convex Sets: Effective Compression, Exploration, and Planning in the C-Space
par: Reinerth, Gerhard, et autres
Publié: (2026)
par: Reinerth, Gerhard, et autres
Publié: (2026)
Think, Act, Learn: A Framework for Autonomous Robotic Agents using Closed-Loop Large Language Models
par: Menon, Anjali R., et autres
Publié: (2025)
par: Menon, Anjali R., et autres
Publié: (2025)
Mitigating Covariate Shift in Imitation Learning for Autonomous Vehicles Using Latent Space Generative World Models
par: Popov, Alexander, et autres
Publié: (2024)
par: Popov, Alexander, et autres
Publié: (2024)
ExpReS-VLA: Specializing Vision-Language-Action Models Through Experience Replay and Retrieval
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
SemanticFeels: Semantic Labeling during In-Hand Manipulation
par: Khalil, Anas Al Shikh, et autres
Publié: (2026)
par: Khalil, Anas Al Shikh, et autres
Publié: (2026)
Autonomous Oil Spill Response Through Liquid Neural Trajectory Modeling and Coordinated Marine Robotics
par: Kuzmenko, Hadas C., et autres
Publié: (2025)
par: Kuzmenko, Hadas C., et autres
Publié: (2025)
Generating Realistic Safety-Critical Scenarios for Vehicle-Pedestrian Interactions
par: Pu, Qingwen, et autres
Publié: (2026)
par: Pu, Qingwen, et autres
Publié: (2026)
Altered Thoughts, Altered Actions: Probing Chain-of-Thought Vulnerabilities in VLA Robotic Manipulation
par: Trinh, Tuan Duong, et autres
Publié: (2026)
par: Trinh, Tuan Duong, et autres
Publié: (2026)
To Whom are You Talking? A Deep Learning Model to Endow Social Robots with Addressee Estimation Skills
par: Mazzola, Carlo, et autres
Publié: (2023)
par: Mazzola, Carlo, et autres
Publié: (2023)
CulinaryCut-VLAP: A Vision-Language-Action-Physics Framework for Food Cutting via a Force-Aware Material Point Method
par: Koh, Hyunseo, et autres
Publié: (2026)
par: Koh, Hyunseo, et autres
Publié: (2026)
Learning to Generate Pointing Gestures in Situated Embodied Conversational Agents
par: Deichler, Anna, et autres
Publié: (2025)
par: Deichler, Anna, et autres
Publié: (2025)
Inducing Causal World Models in LLMs for Zero-Shot Physical Reasoning
par: Sharma, Aditya, et autres
Publié: (2025)
par: Sharma, Aditya, et autres
Publié: (2025)
Muscle Synergy Priors Enhance Biomechanical Fidelity in Predictive Musculoskeletal Locomotion Simulation
par: Park, Ilseung, et autres
Publié: (2026)
par: Park, Ilseung, et autres
Publié: (2026)
RoboGrind: Intuitive and Interactive Surface Treatment with Industrial Robots
par: Alt, Benjamin, et autres
Publié: (2024)
par: Alt, Benjamin, et autres
Publié: (2024)
Toward Trusted Onboard AI: Advancing Small Satellite Operations using Reinforcement Learning
par: Whitney, Cannon, et autres
Publié: (2025)
par: Whitney, Cannon, et autres
Publié: (2025)
R-AIF: Solving Sparse-Reward Robotic Tasks from Pixels with Active Inference and World Models
par: Nguyen, Viet Dung, et autres
Publié: (2024)
par: Nguyen, Viet Dung, et autres
Publié: (2024)
Adaptive Exploration for Latent-State Bandits
par: Jin, Jikai, et autres
Publié: (2026)
par: Jin, Jikai, et autres
Publié: (2026)
What do we learn from a large-scale study of pre-trained visual representations in sim and real environments?
par: Silwal, Sneha, et autres
Publié: (2023)
par: Silwal, Sneha, et autres
Publié: (2023)
Improving Efficiency of Sampling-based Motion Planning via Message-Passing Monte Carlo
par: Chahine, Makram, et autres
Publié: (2024)
par: Chahine, Makram, et autres
Publié: (2024)
Opinion: Towards Unified Expressive Policy Optimization for Robust Robot Learning
par: Huang, Haidong, et autres
Publié: (2025)
par: Huang, Haidong, et autres
Publié: (2025)
Learning to Walk in Costume: Adversarial Motion Priors for Aesthetically Constrained Humanoids
par: Alvarez, Arturo Flores, et autres
Publié: (2025)
par: Alvarez, Arturo Flores, et autres
Publié: (2025)
Learning coordinated badminton skills for legged manipulators
par: Ma, Yuntao, et autres
Publié: (2025)
par: Ma, Yuntao, et autres
Publié: (2025)
Documents similaires
-
Evaluating Model-Agnostic Meta-Learning on MetaWorld ML10 Benchmark: Fast Adaptation in Robotic Manipulation Tasks
par: Atamuradov, Sanjar
Publié: (2025) -
Autonomous Multi-Robot Infrastructure for AI-Enabled Healthcare Delivery and Diagnostics
par: Kalaivanan, Nakhul, et autres
Publié: (2025) -
Connectivity-Aware Representations for Constrained Motion Planning via Multi-Scale Contrastive Learning
par: Jeon, Suhyun, et autres
Publié: (2026) -
FT-NCFM: An Influence-Aware Data Distillation Framework for Efficient VLA Models
par: Chen, Kewei, et autres
Publié: (2025) -
ATAAT: Adaptive Threat-Aware Adversarial Tuning Framework against Backdoor Attacks on Vision-Language-Action Models
par: Chen, Kewei, et autres
Publié: (2026)