Efficient Reinforcement Learning by Guiding Generalist World Models with Non-Curated Data
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Yi, Scannell, Aidan, Zhao, Wenshuai, Hou, Yuxin, Cui, Tianyu, Chen, Le, Büchler, Dieter, Solin, Arno, Kannala, Juho, Pajarinen, Joni |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
iQRL -- Implicitly Quantized Representations for Sample-efficient Reinforcement Learning
di: Scannell, Aidan, et al.
Pubblicazione: (2024)
di: Scannell, Aidan, et al.
Pubblicazione: (2024)
Optimistic Multi-Agent Policy Gradient
di: Zhao, Wenshuai, et al.
Pubblicazione: (2023)
di: Zhao, Wenshuai, et al.
Pubblicazione: (2023)
Sparsely Supervised Diffusion
di: Zhao, Wenshuai, et al.
Pubblicazione: (2026)
di: Zhao, Wenshuai, et al.
Pubblicazione: (2026)
Discrete Codebook World Models for Continuous Control
di: Scannell, Aidan, et al.
Pubblicazione: (2025)
di: Scannell, Aidan, et al.
Pubblicazione: (2025)
Function-space Parameterization of Neural Networks for Sequential Learning
di: Scannell, Aidan, et al.
Pubblicazione: (2024)
di: Scannell, Aidan, et al.
Pubblicazione: (2024)
Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
Entropy Regularized Task Representation Learning for Offline Meta-Reinforcement Learning
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
Grouped Discrete Representation Guides Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
Slot Attention with Re-Initialization and Self-Distillation
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
Contextual Latent World Models for Offline Meta Reinforcement Learning
di: Nakheai, Mohammadreza, et al.
Pubblicazione: (2026)
di: Nakheai, Mohammadreza, et al.
Pubblicazione: (2026)
Point Tracking Improves World Action Models
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
Latent-Compressed Variational Autoencoder for Video Diffusion Models
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
RP1M: A Large-Scale Motion Dataset for Piano Playing with Bi-Manual Dexterous Robot Hands
di: Zhao, Yi, et al.
Pubblicazione: (2024)
di: Zhao, Yi, et al.
Pubblicazione: (2024)
Multi-Scale Fusion for Object Representation
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
Grouped Discrete Representation for Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
Predicting Video Slot Attention Queries from Random Slot-Feature Pairs
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
Internalizing Temporal Consistency in Video Object-Centric Learning without Explicit Regularization
di: Zhao, Rongzhen, et al.
Pubblicazione: (2026)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2026)
Smoothing Slot Attention Iterations and Recurrences
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
Vector-Quantized Vision Foundation Models for Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
Organized Grouped Discrete Representation for Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
Dexterous Robotic Piano Playing at Scale
di: Chen, Le, et al.
Pubblicazione: (2025)
di: Chen, Le, et al.
Pubblicazione: (2025)
Cycle Consistency in Video Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2026)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2026)
PAWS: Perception of Articulation in the Wild at Scale from Egocentric Videos
di: Wang, Yihao, et al.
Pubblicazione: (2026)
di: Wang, Yihao, et al.
Pubblicazione: (2026)
Sources of Uncertainty in 3D Scene Reconstruction
di: Klasson, Marcus, et al.
Pubblicazione: (2024)
di: Klasson, Marcus, et al.
Pubblicazione: (2024)
Continuous Monte Carlo Graph Search
di: Kujanpää, Kalle, et al.
Pubblicazione: (2022)
di: Kujanpää, Kalle, et al.
Pubblicazione: (2022)
Learning Progress Driven Multi-Agent Curriculum
di: Zhao, Wenshuai, et al.
Pubblicazione: (2022)
di: Zhao, Wenshuai, et al.
Pubblicazione: (2022)
Closed-Loop Vision-Language Planning for Multi-Agent Coordination
di: Li, Zhiyuan, et al.
Pubblicazione: (2025)
di: Li, Zhiyuan, et al.
Pubblicazione: (2025)
Bi-Level Motion Imitation for Humanoid Robots
di: Zhao, Wenshuai, et al.
Pubblicazione: (2024)
di: Zhao, Wenshuai, et al.
Pubblicazione: (2024)
Backpropagation Through Agents
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
AgentMixer: Multi-Agent Correlated Policy Factorization
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
FIORD: A Fisheye Indoor-Outdoor Dataset with LIDAR Ground Truth for 3D Scene Reconstruction and Benchmarking
di: Gunes, Ulas, et al.
Pubblicazione: (2025)
di: Gunes, Ulas, et al.
Pubblicazione: (2025)
HybVIO: Pushing the Limits of Real-time Visual-inertial Odometry
di: Seiskari, Otto, et al.
Pubblicazione: (2021)
di: Seiskari, Otto, et al.
Pubblicazione: (2021)
DeSplat: Decomposed Gaussian Splatting for Distractor-Free Rendering
di: Wang, Yihao, et al.
Pubblicazione: (2024)
di: Wang, Yihao, et al.
Pubblicazione: (2024)
Hierarchical Reinforcement Learning with Uncertainty-Guided Diffusional Subgoals
di: Wang, Vivienne Huiling, et al.
Pubblicazione: (2025)
di: Wang, Vivienne Huiling, et al.
Pubblicazione: (2025)
Manipulate-to-Navigate: Reinforcement Learning with Visual Affordances and Manipulability Priors
di: Zhang, Yuying, et al.
Pubblicazione: (2025)
di: Zhang, Yuying, et al.
Pubblicazione: (2025)
Rethinking Temporal Consistency in Video Object-Centric Learning: From Prediction to Correspondence
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
Generative World Modelling for Humanoids: 1X World Model Challenge Technical Report
di: Mereu, Riccardo, et al.
Pubblicazione: (2025)
di: Mereu, Riccardo, et al.
Pubblicazione: (2025)
Gaussian Splatting on the Move: Blur and Rolling Shutter Compensation for Natural Camera Motion
di: Seiskari, Otto, et al.
Pubblicazione: (2024)
di: Seiskari, Otto, et al.
Pubblicazione: (2024)
Reachability Weighted Offline Goal-conditioned Resampling
di: Yang, Wenyan, et al.
Pubblicazione: (2025)
di: Yang, Wenyan, et al.
Pubblicazione: (2025)
Bridging the Embodiment Gap: Disentangled Cross-Embodiment Video Editing
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
iQRL -- Implicitly Quantized Representations for Sample-efficient Reinforcement Learning
di: Scannell, Aidan, et al.
Pubblicazione: (2024) -
Optimistic Multi-Agent Policy Gradient
di: Zhao, Wenshuai, et al.
Pubblicazione: (2023) -
Sparsely Supervised Diffusion
di: Zhao, Wenshuai, et al.
Pubblicazione: (2026) -
Discrete Codebook World Models for Continuous Control
di: Scannell, Aidan, et al.
Pubblicazione: (2025) -
Function-space Parameterization of Neural Networks for Sequential Learning
di: Scannell, Aidan, et al.
Pubblicazione: (2024)