Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ye, Weirui, Zhang, Yunsheng, Weng, Haoyang, Gu, Xianfan, Wang, Shengjie, Zhang, Tong, Wang, Mengchen, Abbeel, Pieter, Gao, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Seer: Language Instructed Video Prediction with Latent Diffusion Models
par: Gu, Xianfan, et autres
Publié: (2023)
par: Gu, Xianfan, et autres
Publié: (2023)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
par: Seo, Younggyo, et autres
Publié: (2024)
par: Seo, Younggyo, et autres
Publié: (2024)
ERA: Transforming VLMs into Embodied Agents via Embodied Prior Learning and Online Reinforcement Learning
par: Chen, Hanyang, et autres
Publié: (2025)
par: Chen, Hanyang, et autres
Publié: (2025)
EfficientZero V2: Mastering Discrete and Continuous Control with Limited Data
par: Wang, Shengjie, et autres
Publié: (2024)
par: Wang, Shengjie, et autres
Publié: (2024)
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
par: Ye, Weirui, et autres
Publié: (2025)
par: Ye, Weirui, et autres
Publié: (2025)
Reward-Conditioned Reinforcement Learning
par: Nauman, Michal, et autres
Publié: (2026)
par: Nauman, Michal, et autres
Publié: (2026)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
par: Lee, Vint, et autres
Publié: (2023)
par: Lee, Vint, et autres
Publié: (2023)
DiCache: Let Diffusion Model Determine Its Own Cache
par: Bu, Jiazi, et autres
Publié: (2025)
par: Bu, Jiazi, et autres
Publié: (2025)
Cooperative Inverse Reinforcement Learning
par: Hadfield-Menell, Dylan, et autres
Publié: (2016)
par: Hadfield-Menell, Dylan, et autres
Publié: (2016)
Let Confucian Philosophy Speak on Its Own Terms
par: Jing Liu, et autres
Publié: (2024)
par: Jing Liu, et autres
Publié: (2024)
Accelerating Reinforcement Learning with Value-Conditional State Entropy Exploration
par: Kim, Dongyoung, et autres
Publié: (2023)
par: Kim, Dongyoung, et autres
Publié: (2023)
Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings
par: Frans, Kevin, et autres
Publié: (2024)
par: Frans, Kevin, et autres
Publié: (2024)
Learning Manipulation Skills through Robot Chain-of-Thought with Sparse Failure Guidance
par: Zhang, Kaifeng, et autres
Publié: (2024)
par: Zhang, Kaifeng, et autres
Publié: (2024)
Offline Imitation Learning Through Graph Search and Retrieval
par: Yin, Zhao-Heng, et autres
Publié: (2024)
par: Yin, Zhao-Heng, et autres
Publié: (2024)
Embodied-R: Collaborative Framework for Activating Embodied Spatial Reasoning in Foundation Models via Reinforcement Learning
par: Zhao, Baining, et autres
Publié: (2025)
par: Zhao, Baining, et autres
Publié: (2025)
R-Meshfusion: Reinforcement Learning Powered Sparse-View Mesh Reconstruction with Diffusion Priors
par: Wang, Haoyang, et autres
Publié: (2025)
par: Wang, Haoyang, et autres
Publié: (2025)
Scaling Tasks, Not Samples: Mastering Humanoid Control through Multi-Task Model-Based Reinforcement Learning
par: Liu, Shaohuai, et autres
Publié: (2026)
par: Liu, Shaohuai, et autres
Publié: (2026)
Memo: Training Memory-Efficient Embodied Agents with Reinforcement Learning
par: Gupta, Gunshi, et autres
Publié: (2025)
par: Gupta, Gunshi, et autres
Publié: (2025)
When Does Non-Uniform Replay Matter in Reinforcement Learning?
par: Korniak, Michal, et autres
Publié: (2026)
par: Korniak, Michal, et autres
Publié: (2026)
Prior Reinforce: Mastering Agile Tasks with Limited Trials
par: Hu, Yihang, et autres
Publié: (2025)
par: Hu, Yihang, et autres
Publié: (2025)
Efficient Reinforcement Learning with Large Language Model Priors
par: Yan, Xue, et autres
Publié: (2024)
par: Yan, Xue, et autres
Publié: (2024)
Let the Kids Choose Their Own Books.
par: Osgood, Thelma S.
Publié: (1979)
par: Osgood, Thelma S.
Publié: (1979)
ESearch-R1: Learning Cost-Aware MLLM Agents for Interactive Embodied Search via Reinforcement Learning
par: Zhou, Weijie, et autres
Publié: (2025)
par: Zhou, Weijie, et autres
Publié: (2025)
A Stable Whitening Optimizer for Efficient Neural Network Training
par: Frans, Kevin, et autres
Publié: (2025)
par: Frans, Kevin, et autres
Publié: (2025)
The Image as Its Own Reward: Reinforcement Learning with Adversarial Reward for Image Generation
par: Mao, Weijia, et autres
Publié: (2025)
par: Mao, Weijia, et autres
Publié: (2025)
Reinforcement Learning for Versatile, Dynamic, and Robust Bipedal Locomotion Control
par: Li, Zhongyu, et autres
Publié: (2024)
par: Li, Zhongyu, et autres
Publié: (2024)
HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents
par: X, Tencent Robotics, et autres
Publié: (2026)
par: X, Tencent Robotics, et autres
Publié: (2026)
Corruption-Robust Offline Reinforcement Learning with General Function Approximation
par: Ye, Chenlu, et autres
Publié: (2023)
par: Ye, Chenlu, et autres
Publié: (2023)
Object-centric 3D Motion Field for Robot Learning from Human Videos
par: Yin, Zhao-Heng, et autres
Publié: (2025)
par: Yin, Zhao-Heng, et autres
Publié: (2025)
Mixture of Physical Priors Adapter for Parameter-Efficient Fine-Tuning
par: Wang, Zhaozhi, et autres
Publié: (2024)
par: Wang, Zhaozhi, et autres
Publié: (2024)
P‐8.4: Error Analysis and Calibration Method for Lenticular Grating in Three‐Dimensional Display
par: Xianfan Wang, et autres
Publié: (2025)
par: Xianfan Wang, et autres
Publié: (2025)
Towards Robust Model-Based Reinforcement Learning Against Adversarial Corruption
par: Ye, Chenlu, et autres
Publié: (2024)
par: Ye, Chenlu, et autres
Publié: (2024)
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
par: Yang, Guang, et autres
Publié: (2025)
par: Yang, Guang, et autres
Publié: (2025)
ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation
par: Heng, Liang, et autres
Publié: (2025)
par: Heng, Liang, et autres
Publié: (2025)
Personalized Path Recourse for Reinforcement Learning Agents
par: Hong, Dat, et autres
Publié: (2023)
par: Hong, Dat, et autres
Publié: (2023)
Every Question Has Its Own Value: Reinforcement Learning with Explicit Human Values
par: Yu, Dian, et autres
Publié: (2025)
par: Yu, Dian, et autres
Publié: (2025)
TreeGRPO: Tree-Advantage GRPO for Online RL Post-Training of Diffusion Models
par: Ding, Zheng, et autres
Publié: (2025)
par: Ding, Zheng, et autres
Publié: (2025)
FastTD3: Simple, Fast, and Capable Reinforcement Learning for Humanoid Control
par: Seo, Younggyo, et autres
Publié: (2025)
par: Seo, Younggyo, et autres
Publié: (2025)
Logarithmic Regret for Online KL-Regularized Reinforcement Learning
par: Zhao, Heyang, et autres
Publié: (2025)
par: Zhao, Heyang, et autres
Publié: (2025)
Learning a Diffusion Model Policy from Rewards via Q-Score Matching
par: Psenka, Michael, et autres
Publié: (2023)
par: Psenka, Michael, et autres
Publié: (2023)
Documents similaires
-
Seer: Language Instructed Video Prediction with Latent Diffusion Models
par: Gu, Xianfan, et autres
Publié: (2023) -
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
par: Seo, Younggyo, et autres
Publié: (2024) -
ERA: Transforming VLMs into Embodied Agents via Embodied Prior Learning and Online Reinforcement Learning
par: Chen, Hanyang, et autres
Publié: (2025) -
EfficientZero V2: Mastering Discrete and Continuous Control with Limited Data
par: Wang, Shengjie, et autres
Publié: (2024) -
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
par: Ye, Weirui, et autres
Publié: (2025)