On the benefits of pixel-based hierarchical policies for task generalization
Fuente:
arXiv
Salvato in:
| Autori principali: | Cristea-Platon, Tudor, Mazoure, Bogdan, Susskind, Josh, Talbott, Walter |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Large Language Models as Generalizable Policies for Embodied Tasks
di: Szot, Andrew, et al.
Pubblicazione: (2023)
di: Szot, Andrew, et al.
Pubblicazione: (2023)
Dynamic planning in hierarchical active inference
di: Priorelli, Matteo, et al.
Pubblicazione: (2024)
di: Priorelli, Matteo, et al.
Pubblicazione: (2024)
Improving generalization of robot locomotion policies via Sharpness-Aware Reinforcement Learning
di: Bochem, Severin, et al.
Pubblicazione: (2024)
di: Bochem, Severin, et al.
Pubblicazione: (2024)
From Demonstrations to Rewards: Test-Time Prompt Optimization for VLM Reward Models
di: Gumbsch, Christian, et al.
Pubblicazione: (2026)
di: Gumbsch, Christian, et al.
Pubblicazione: (2026)
Leveraging LLMs for reward function design in reinforcement learning control tasks
di: Cardenoso, Franklin, et al.
Pubblicazione: (2025)
di: Cardenoso, Franklin, et al.
Pubblicazione: (2025)
Correspondence learning between morphologically different robots via task demonstrations
di: Aktas, Hakan, et al.
Pubblicazione: (2023)
di: Aktas, Hakan, et al.
Pubblicazione: (2023)
Less is more -- the Dispatcher/ Executor principle for multi-task Reinforcement Learning
di: Riedmiller, Martin, et al.
Pubblicazione: (2023)
di: Riedmiller, Martin, et al.
Pubblicazione: (2023)
GRACE: A Language Model Framework for Explainable Inverse Reinforcement Learning
di: Sapora, Silvia, et al.
Pubblicazione: (2025)
di: Sapora, Silvia, et al.
Pubblicazione: (2025)
RoboGPT: an intelligent agent of making embodied long-term decisions for daily instruction tasks
di: Chen, Yaran, et al.
Pubblicazione: (2023)
di: Chen, Yaran, et al.
Pubblicazione: (2023)
Bootstrap Off-policy with World Model
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
Knowledge capture, adaptation and composition (KCAC): A framework for cross-task curriculum learning in robotic manipulation
di: Wang, Xinrui, et al.
Pubblicazione: (2025)
di: Wang, Xinrui, et al.
Pubblicazione: (2025)
Deep Dive into Model-free Reinforcement Learning for Biological and Robotic Systems: Theory and Practice
di: Jiao, Yusheng, et al.
Pubblicazione: (2024)
di: Jiao, Yusheng, et al.
Pubblicazione: (2024)
ClustRecNet: A Novel End-to-End Deep Learning Framework for Clustering Algorithm Recommendation
di: Bakhtyari, Mohammadreza, et al.
Pubblicazione: (2025)
di: Bakhtyari, Mohammadreza, et al.
Pubblicazione: (2025)
WindSeer: Real-time volumetric wind prediction over complex terrain aboard a small UAV
di: Achermann, Florian, et al.
Pubblicazione: (2024)
di: Achermann, Florian, et al.
Pubblicazione: (2024)
Adapting Critic Match Loss Landscape Visualization to Off-policy Reinforcement Learning
di: Liu, Jingyi, et al.
Pubblicazione: (2026)
di: Liu, Jingyi, et al.
Pubblicazione: (2026)
Streaming Flow Policy: Simplifying diffusion/flow-matching policies by treating action trajectories as flow trajectories
di: Jiang, Sunshine, et al.
Pubblicazione: (2025)
di: Jiang, Sunshine, et al.
Pubblicazione: (2025)
Subwords as Skills: Tokenization for Sparse-Reward Reinforcement Learning
di: Yunis, David, et al.
Pubblicazione: (2023)
di: Yunis, David, et al.
Pubblicazione: (2023)
Leveraging Analytic Gradients in Provably Safe Reinforcement Learning
di: Walter, Tim, et al.
Pubblicazione: (2025)
di: Walter, Tim, et al.
Pubblicazione: (2025)
Enabling robots to follow abstract instructions and complete complex dynamic tasks
di: Mon-Williams, Ruaridh, et al.
Pubblicazione: (2024)
di: Mon-Williams, Ruaridh, et al.
Pubblicazione: (2024)
Reinforcement Learning Within the Classical Robotics Stack: A Case Study in Robot Soccer
di: Labiosa, Adam, et al.
Pubblicazione: (2024)
di: Labiosa, Adam, et al.
Pubblicazione: (2024)
Simplicial Embeddings Improve Sample Efficiency in Actor-Critic Agents
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2025)
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2025)
INRFlow: Flow Matching for INRs in Ambient Space
di: Wang, Yuyang, et al.
Pubblicazione: (2024)
di: Wang, Yuyang, et al.
Pubblicazione: (2024)
Rating-based Reinforcement Learning
di: White, Devin, et al.
Pubblicazione: (2023)
di: White, Devin, et al.
Pubblicazione: (2023)
Arnold: a generalist muscle transformer policy
di: Chiappa, Alberto Silvio, et al.
Pubblicazione: (2025)
di: Chiappa, Alberto Silvio, et al.
Pubblicazione: (2025)
MILE: Model-based Intervention Learning
di: Korkmaz, Yigit, et al.
Pubblicazione: (2025)
di: Korkmaz, Yigit, et al.
Pubblicazione: (2025)
Efficient Non-Parametric Uncertainty Quantification for Black-Box Large Language Models and Decision Planning
di: Tsai, Yao-Hung Hubert, et al.
Pubblicazione: (2024)
di: Tsai, Yao-Hung Hubert, et al.
Pubblicazione: (2024)
EMOTION: Expressive Motion Sequence Generation for Humanoid Robots with In-Context Learning
di: Huang, Peide, et al.
Pubblicazione: (2024)
di: Huang, Peide, et al.
Pubblicazione: (2024)
Research on Autonomous Robots Navigation based on Reinforcement Learning
di: Wang, Zixiang, et al.
Pubblicazione: (2024)
di: Wang, Zixiang, et al.
Pubblicazione: (2024)
GSAVS: Gaussian Splatting-based Autonomous Vehicle Simulator
di: Wilson, Rami
Pubblicazione: (2024)
di: Wilson, Rami
Pubblicazione: (2024)
Tactile-based Object Retrieval From Granular Media
di: Xu, Jingxi, et al.
Pubblicazione: (2024)
di: Xu, Jingxi, et al.
Pubblicazione: (2024)
Learning-based Autonomous Oversteer Control and Collision Avoidance
di: Lee, Seokjun, et al.
Pubblicazione: (2025)
di: Lee, Seokjun, et al.
Pubblicazione: (2025)
Residual Reward Models for Preference-based Reinforcement Learning
di: Cao, Chenyang, et al.
Pubblicazione: (2025)
di: Cao, Chenyang, et al.
Pubblicazione: (2025)
RIME: Robust Preference-based Reinforcement Learning with Noisy Preferences
di: Cheng, Jie, et al.
Pubblicazione: (2024)
di: Cheng, Jie, et al.
Pubblicazione: (2024)
Innate-Values-driven Reinforcement Learning based Cognitive Modeling
di: Yang, Qin
Pubblicazione: (2024)
di: Yang, Qin
Pubblicazione: (2024)
A Generalized Acquisition Function for Preference-based Reward Learning
di: Ellis, Evan, et al.
Pubblicazione: (2024)
di: Ellis, Evan, et al.
Pubblicazione: (2024)
Simulation-based reinforcement learning for real-world autonomous driving
di: Osiński, Błażej, et al.
Pubblicazione: (2019)
di: Osiński, Błażej, et al.
Pubblicazione: (2019)
COLLAGE: Adaptive Fusion-based Retrieval for Augmented Policy Learning
di: Kumar, Sateesh, et al.
Pubblicazione: (2025)
di: Kumar, Sateesh, et al.
Pubblicazione: (2025)
Ark: An Open-source Python-based Framework for Robot Learning
di: Dierking, Magnus, et al.
Pubblicazione: (2025)
di: Dierking, Magnus, et al.
Pubblicazione: (2025)
Flow-based Domain Randomization for Learning and Sequencing Robotic Skills
di: Curtis, Aidan, et al.
Pubblicazione: (2025)
di: Curtis, Aidan, et al.
Pubblicazione: (2025)
MASP: Scalable GNN-based Planning for Multi-Agent Navigation
di: Yang, Xinyi, et al.
Pubblicazione: (2023)
di: Yang, Xinyi, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Large Language Models as Generalizable Policies for Embodied Tasks
di: Szot, Andrew, et al.
Pubblicazione: (2023) -
Dynamic planning in hierarchical active inference
di: Priorelli, Matteo, et al.
Pubblicazione: (2024) -
Improving generalization of robot locomotion policies via Sharpness-Aware Reinforcement Learning
di: Bochem, Severin, et al.
Pubblicazione: (2024) -
From Demonstrations to Rewards: Test-Time Prompt Optimization for VLM Reward Models
di: Gumbsch, Christian, et al.
Pubblicazione: (2026) -
Leveraging LLMs for reward function design in reinforcement learning control tasks
di: Cardenoso, Franklin, et al.
Pubblicazione: (2025)