Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own
Fuente:
arXiv
Salvato in:
| Autori principali: | Ye, Weirui, Zhang, Yunsheng, Weng, Haoyang, Gu, Xianfan, Wang, Shengjie, Zhang, Tong, Wang, Mengchen, Abbeel, Pieter, Gao, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Seer: Language Instructed Video Prediction with Latent Diffusion Models
di: Gu, Xianfan, et al.
Pubblicazione: (2023)
di: Gu, Xianfan, et al.
Pubblicazione: (2023)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
ERA: Transforming VLMs into Embodied Agents via Embodied Prior Learning and Online Reinforcement Learning
di: Chen, Hanyang, et al.
Pubblicazione: (2025)
di: Chen, Hanyang, et al.
Pubblicazione: (2025)
EfficientZero V2: Mastering Discrete and Continuous Control with Limited Data
di: Wang, Shengjie, et al.
Pubblicazione: (2024)
di: Wang, Shengjie, et al.
Pubblicazione: (2024)
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
di: Ye, Weirui, et al.
Pubblicazione: (2025)
di: Ye, Weirui, et al.
Pubblicazione: (2025)
Reward-Conditioned Reinforcement Learning
di: Nauman, Michal, et al.
Pubblicazione: (2026)
di: Nauman, Michal, et al.
Pubblicazione: (2026)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
di: Lee, Vint, et al.
Pubblicazione: (2023)
di: Lee, Vint, et al.
Pubblicazione: (2023)
DiCache: Let Diffusion Model Determine Its Own Cache
di: Bu, Jiazi, et al.
Pubblicazione: (2025)
di: Bu, Jiazi, et al.
Pubblicazione: (2025)
Cooperative Inverse Reinforcement Learning
di: Hadfield-Menell, Dylan, et al.
Pubblicazione: (2016)
di: Hadfield-Menell, Dylan, et al.
Pubblicazione: (2016)
Let Confucian Philosophy Speak on Its Own Terms
di: Jing Liu, et al.
Pubblicazione: (2024)
di: Jing Liu, et al.
Pubblicazione: (2024)
Accelerating Reinforcement Learning with Value-Conditional State Entropy Exploration
di: Kim, Dongyoung, et al.
Pubblicazione: (2023)
di: Kim, Dongyoung, et al.
Pubblicazione: (2023)
Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings
di: Frans, Kevin, et al.
Pubblicazione: (2024)
di: Frans, Kevin, et al.
Pubblicazione: (2024)
Learning Manipulation Skills through Robot Chain-of-Thought with Sparse Failure Guidance
di: Zhang, Kaifeng, et al.
Pubblicazione: (2024)
di: Zhang, Kaifeng, et al.
Pubblicazione: (2024)
Offline Imitation Learning Through Graph Search and Retrieval
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2024)
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2024)
Embodied-R: Collaborative Framework for Activating Embodied Spatial Reasoning in Foundation Models via Reinforcement Learning
di: Zhao, Baining, et al.
Pubblicazione: (2025)
di: Zhao, Baining, et al.
Pubblicazione: (2025)
R-Meshfusion: Reinforcement Learning Powered Sparse-View Mesh Reconstruction with Diffusion Priors
di: Wang, Haoyang, et al.
Pubblicazione: (2025)
di: Wang, Haoyang, et al.
Pubblicazione: (2025)
Scaling Tasks, Not Samples: Mastering Humanoid Control through Multi-Task Model-Based Reinforcement Learning
di: Liu, Shaohuai, et al.
Pubblicazione: (2026)
di: Liu, Shaohuai, et al.
Pubblicazione: (2026)
Memo: Training Memory-Efficient Embodied Agents with Reinforcement Learning
di: Gupta, Gunshi, et al.
Pubblicazione: (2025)
di: Gupta, Gunshi, et al.
Pubblicazione: (2025)
When Does Non-Uniform Replay Matter in Reinforcement Learning?
di: Korniak, Michal, et al.
Pubblicazione: (2026)
di: Korniak, Michal, et al.
Pubblicazione: (2026)
Prior Reinforce: Mastering Agile Tasks with Limited Trials
di: Hu, Yihang, et al.
Pubblicazione: (2025)
di: Hu, Yihang, et al.
Pubblicazione: (2025)
Efficient Reinforcement Learning with Large Language Model Priors
di: Yan, Xue, et al.
Pubblicazione: (2024)
di: Yan, Xue, et al.
Pubblicazione: (2024)
Let the Kids Choose Their Own Books.
di: Osgood, Thelma S.
Pubblicazione: (1979)
di: Osgood, Thelma S.
Pubblicazione: (1979)
ESearch-R1: Learning Cost-Aware MLLM Agents for Interactive Embodied Search via Reinforcement Learning
di: Zhou, Weijie, et al.
Pubblicazione: (2025)
di: Zhou, Weijie, et al.
Pubblicazione: (2025)
A Stable Whitening Optimizer for Efficient Neural Network Training
di: Frans, Kevin, et al.
Pubblicazione: (2025)
di: Frans, Kevin, et al.
Pubblicazione: (2025)
The Image as Its Own Reward: Reinforcement Learning with Adversarial Reward for Image Generation
di: Mao, Weijia, et al.
Pubblicazione: (2025)
di: Mao, Weijia, et al.
Pubblicazione: (2025)
Reinforcement Learning for Versatile, Dynamic, and Robust Bipedal Locomotion Control
di: Li, Zhongyu, et al.
Pubblicazione: (2024)
di: Li, Zhongyu, et al.
Pubblicazione: (2024)
HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents
di: X, Tencent Robotics, et al.
Pubblicazione: (2026)
di: X, Tencent Robotics, et al.
Pubblicazione: (2026)
Corruption-Robust Offline Reinforcement Learning with General Function Approximation
di: Ye, Chenlu, et al.
Pubblicazione: (2023)
di: Ye, Chenlu, et al.
Pubblicazione: (2023)
Object-centric 3D Motion Field for Robot Learning from Human Videos
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2025)
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2025)
Mixture of Physical Priors Adapter for Parameter-Efficient Fine-Tuning
di: Wang, Zhaozhi, et al.
Pubblicazione: (2024)
di: Wang, Zhaozhi, et al.
Pubblicazione: (2024)
P‐8.4: Error Analysis and Calibration Method for Lenticular Grating in Three‐Dimensional Display
di: Xianfan Wang, et al.
Pubblicazione: (2025)
di: Xianfan Wang, et al.
Pubblicazione: (2025)
Towards Robust Model-Based Reinforcement Learning Against Adversarial Corruption
di: Ye, Chenlu, et al.
Pubblicazione: (2024)
di: Ye, Chenlu, et al.
Pubblicazione: (2024)
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
di: Yang, Guang, et al.
Pubblicazione: (2025)
di: Yang, Guang, et al.
Pubblicazione: (2025)
ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation
di: Heng, Liang, et al.
Pubblicazione: (2025)
di: Heng, Liang, et al.
Pubblicazione: (2025)
Personalized Path Recourse for Reinforcement Learning Agents
di: Hong, Dat, et al.
Pubblicazione: (2023)
di: Hong, Dat, et al.
Pubblicazione: (2023)
Every Question Has Its Own Value: Reinforcement Learning with Explicit Human Values
di: Yu, Dian, et al.
Pubblicazione: (2025)
di: Yu, Dian, et al.
Pubblicazione: (2025)
TreeGRPO: Tree-Advantage GRPO for Online RL Post-Training of Diffusion Models
di: Ding, Zheng, et al.
Pubblicazione: (2025)
di: Ding, Zheng, et al.
Pubblicazione: (2025)
FastTD3: Simple, Fast, and Capable Reinforcement Learning for Humanoid Control
di: Seo, Younggyo, et al.
Pubblicazione: (2025)
di: Seo, Younggyo, et al.
Pubblicazione: (2025)
Logarithmic Regret for Online KL-Regularized Reinforcement Learning
di: Zhao, Heyang, et al.
Pubblicazione: (2025)
di: Zhao, Heyang, et al.
Pubblicazione: (2025)
Learning a Diffusion Model Policy from Rewards via Q-Score Matching
di: Psenka, Michael, et al.
Pubblicazione: (2023)
di: Psenka, Michael, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Seer: Language Instructed Video Prediction with Latent Diffusion Models
di: Gu, Xianfan, et al.
Pubblicazione: (2023) -
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
di: Seo, Younggyo, et al.
Pubblicazione: (2024) -
ERA: Transforming VLMs into Embodied Agents via Embodied Prior Learning and Online Reinforcement Learning
di: Chen, Hanyang, et al.
Pubblicazione: (2025) -
EfficientZero V2: Mastering Discrete and Continuous Control with Limited Data
di: Wang, Shengjie, et al.
Pubblicazione: (2024) -
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
di: Ye, Weirui, et al.
Pubblicazione: (2025)