PWM: Policy Learning with Multi-Task World Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Georgiev, Ignat, Giridhar, Varun, Hansen, Nicklas, Garg, Animesh |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Adaptive Horizon Actor-Critic for Policy Learning in Contact-Rich Differentiable Simulation
par: Georgiev, Ignat, et autres
Publié: (2024)
par: Georgiev, Ignat, et autres
Publié: (2024)
CLIMB: Language-Guided Continual Learning for Task Planning with Iterative Model Building
par: Byrnes, Walker, et autres
Publié: (2024)
par: Byrnes, Walker, et autres
Publié: (2024)
ReinforceGen: Hybrid Skill Policies with Automated Data Generation and Reinforcement Learning
par: Zhou, Zihan, et autres
Publié: (2025)
par: Zhou, Zihan, et autres
Publié: (2025)
TD-MPC2: Scalable, Robust World Models for Continuous Control
par: Hansen, Nicklas, et autres
Publié: (2023)
par: Hansen, Nicklas, et autres
Publié: (2023)
MoDem-V2: Visuo-Motor World Models for Real-World Robot Manipulation
par: Lancaster, Patrick, et autres
Publié: (2023)
par: Lancaster, Patrick, et autres
Publié: (2023)
Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection
par: Anwar, Abrar, et autres
Publié: (2025)
par: Anwar, Abrar, et autres
Publié: (2025)
QMP: Q-switch Mixture of Policies for Multi-Task Behavior Sharing
par: Zhang, Grace, et autres
Publié: (2023)
par: Zhang, Grace, et autres
Publié: (2023)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
par: Pan, Minting, et autres
Publié: (2023)
par: Pan, Minting, et autres
Publié: (2023)
COBALT: Crowdsourcing Robot Learning via Cloud-Based Teleoperation with Smartphones
par: Agarwal, Ayush, et autres
Publié: (2026)
par: Agarwal, Ayush, et autres
Publié: (2026)
Projected Task-Specific Layers for Multi-Task Reinforcement Learning
par: Roberts, Josselin Somerville, et autres
Publié: (2023)
par: Roberts, Josselin Somerville, et autres
Publié: (2023)
Latent Policy Steering with Embodiment-Agnostic Pretrained World Models
par: Wang, Yiqi, et autres
Publié: (2025)
par: Wang, Yiqi, et autres
Publié: (2025)
Efficient Multi-Task Reinforcement Learning via Task-Specific Action Correction
par: Feng, Jinyuan, et autres
Publié: (2024)
par: Feng, Jinyuan, et autres
Publié: (2024)
Deep Active Inference with Diffusion Policy and Multiple Timescale World Model for Real-World Exploration and Navigation
par: Yokozawa, Riko, et autres
Publié: (2025)
par: Yokozawa, Riko, et autres
Publié: (2025)
RoCoDA: Counterfactual Data Augmentation for Data-Efficient Robot Learning from Demonstrations
par: Ameperosa, Ezra, et autres
Publié: (2024)
par: Ameperosa, Ezra, et autres
Publié: (2024)
DrS: Learning Reusable Dense Rewards for Multi-Stage Tasks
par: Mu, Tongzhou, et autres
Publié: (2024)
par: Mu, Tongzhou, et autres
Publié: (2024)
Knowledge-Guided Manipulation Using Multi-Task Reinforcement Learning
par: Narendra, Aditya, et autres
Publié: (2026)
par: Narendra, Aditya, et autres
Publié: (2026)
SPIRE: Synergistic Planning, Imitation, and Reinforcement Learning for Long-Horizon Manipulation
par: Zhou, Zihan, et autres
Publié: (2024)
par: Zhou, Zihan, et autres
Publié: (2024)
Robotic World Model: A Neural Network Simulator for Robust Policy Optimization in Robotics
par: Li, Chenhao, et autres
Publié: (2025)
par: Li, Chenhao, et autres
Publié: (2025)
Towards Interpretable Foundation Models of Robot Behavior: A Task Specific Policy Generation Approach
par: Sheidlower, Isaac, et autres
Publié: (2024)
par: Sheidlower, Isaac, et autres
Publié: (2024)
TOPPO: Rethinking PPO for Multi-Task Reinforcement Learning with Critic Balancing
par: Li, Yuanpeng, et autres
Publié: (2026)
par: Li, Yuanpeng, et autres
Publié: (2026)
Imagination Policy: Using Generative Point Cloud Models for Learning Manipulation Policies
par: Huang, Haojie, et autres
Publié: (2024)
par: Huang, Haojie, et autres
Publié: (2024)
WARPD: World model Assisted Reactive Policy Diffusion
par: Hegde, Shashank, et autres
Publié: (2024)
par: Hegde, Shashank, et autres
Publié: (2024)
Enhancing Robot Navigation Policies with Task-Specific Uncertainty Managements
par: Puthumanaillam, Gokul, et autres
Publié: (2025)
par: Puthumanaillam, Gokul, et autres
Publié: (2025)
Learning World Models for Unconstrained Goal Navigation
par: Duan, Yuanlin, et autres
Publié: (2024)
par: Duan, Yuanlin, et autres
Publié: (2024)
Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization
par: Alon, Yoav, et autres
Publié: (2020)
par: Alon, Yoav, et autres
Publié: (2020)
Few-Shot Task Learning through Inverse Generative Modeling
par: Netanyahu, Aviv, et autres
Publié: (2024)
par: Netanyahu, Aviv, et autres
Publié: (2024)
Data-Efficient Hierarchical Goal-Conditioned Reinforcement Learning via Normalizing Flows
par: Garg, Shaswat, et autres
Publié: (2026)
par: Garg, Shaswat, et autres
Publié: (2026)
DiffSim2Real: Deploying Quadrupedal Locomotion Policies Purely Trained in Differentiable Simulation
par: Bagajo, Joshua, et autres
Publié: (2024)
par: Bagajo, Joshua, et autres
Publié: (2024)
TAIL: Task-specific Adapters for Imitation Learning with Large Pretrained Models
par: Liu, Zuxin, et autres
Publié: (2023)
par: Liu, Zuxin, et autres
Publié: (2023)
Unsupervised Skill Discovery as Exploration for Learning Agile Locomotion
par: Rho, Seungeun, et autres
Publié: (2025)
par: Rho, Seungeun, et autres
Publié: (2025)
Multi-Modal Manipulation via Multi-Modal Policy Consensus
par: Chen, Haonan, et autres
Publié: (2025)
par: Chen, Haonan, et autres
Publié: (2025)
LearningFlow: Automated Policy Learning Workflow for Urban Driving with Large Language Models
par: Peng, Zengqi, et autres
Publié: (2025)
par: Peng, Zengqi, et autres
Publié: (2025)
Scalable Multi-Task Learning through Spiking Neural Networks with Adaptive Task-Switching Policy for Intelligent Autonomous Agents
par: Putra, Rachmad Vidya Wicaksana, et autres
Publié: (2025)
par: Putra, Rachmad Vidya Wicaksana, et autres
Publié: (2025)
Adapt3R: Adaptive 3D Scene Representation for Domain Transfer in Imitation Learning
par: Wilcox, Albert, et autres
Publié: (2025)
par: Wilcox, Albert, et autres
Publié: (2025)
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
par: Ye, Weirui, et autres
Publié: (2025)
par: Ye, Weirui, et autres
Publié: (2025)
Policy Decorator: Model-Agnostic Online Refinement for Large Policy Model
par: Yuan, Xiu, et autres
Publié: (2024)
par: Yuan, Xiu, et autres
Publié: (2024)
Putting the Iterative Training of Decision Trees to the Test on a Real-World Robotic Task
par: Engelhardt, Raphael C., et autres
Publié: (2024)
par: Engelhardt, Raphael C., et autres
Publié: (2024)
Semantic World Models
par: Berg, Jacob, et autres
Publié: (2025)
par: Berg, Jacob, et autres
Publié: (2025)
Real-World Offline Reinforcement Learning from Vision Language Model Feedback
par: Venkataraman, Sreyas, et autres
Publié: (2024)
par: Venkataraman, Sreyas, et autres
Publié: (2024)
DreamGen: Unlocking Generalization in Robot Learning through Video World Models
par: Jang, Joel, et autres
Publié: (2025)
par: Jang, Joel, et autres
Publié: (2025)
Documents similaires
-
Adaptive Horizon Actor-Critic for Policy Learning in Contact-Rich Differentiable Simulation
par: Georgiev, Ignat, et autres
Publié: (2024) -
CLIMB: Language-Guided Continual Learning for Task Planning with Iterative Model Building
par: Byrnes, Walker, et autres
Publié: (2024) -
ReinforceGen: Hybrid Skill Policies with Automated Data Generation and Reinforcement Learning
par: Zhou, Zihan, et autres
Publié: (2025) -
TD-MPC2: Scalable, Robust World Models for Continuous Control
par: Hansen, Nicklas, et autres
Publié: (2023) -
MoDem-V2: Visuo-Motor World Models for Real-World Robot Manipulation
par: Lancaster, Patrick, et autres
Publié: (2023)