Foundation Policies with Hilbert Representations
Fuente:
arXiv
Guardado en:
| Autores principales: | Park, Seohong, Kreiman, Tobias, Levine, Sergey |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
METRA: Scalable Unsupervised RL with Metric-Aware Abstraction
por: Park, Seohong, et al.
Publicado: (2023)
por: Park, Seohong, et al.
Publicado: (2023)
Decoupled Q-Chunking
por: Li, Qiyang, et al.
Publicado: (2025)
por: Li, Qiyang, et al.
Publicado: (2025)
HIQL: Offline Goal-Conditioned RL with Latent States as Actions
por: Park, Seohong, et al.
Publicado: (2023)
por: Park, Seohong, et al.
Publicado: (2023)
Dual Goal Representations
por: Park, Seohong, et al.
Publicado: (2025)
por: Park, Seohong, et al.
Publicado: (2025)
Flow Q-Learning
por: Park, Seohong, et al.
Publicado: (2025)
por: Park, Seohong, et al.
Publicado: (2025)
Scalable Offline Model-Based RL with Action Chunks
por: Park, Kwanyoung, et al.
Publicado: (2025)
por: Park, Kwanyoung, et al.
Publicado: (2025)
Real-Time Execution of Action Chunking Flow Policies
por: Black, Kevin, et al.
Publicado: (2025)
por: Black, Kevin, et al.
Publicado: (2025)
RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning
por: Xu, Charles, et al.
Publicado: (2024)
por: Xu, Charles, et al.
Publicado: (2024)
Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings
por: Frans, Kevin, et al.
Publicado: (2024)
por: Frans, Kevin, et al.
Publicado: (2024)
Is Value Learning Really the Main Bottleneck in Offline RL?
por: Park, Seohong, et al.
Publicado: (2024)
por: Park, Seohong, et al.
Publicado: (2024)
OGBench: Benchmarking Offline Goal-Conditioned RL
por: Park, Seohong, et al.
Publicado: (2024)
por: Park, Seohong, et al.
Publicado: (2024)
Transitive RL: Value Learning via Divide and Conquer
por: Park, Seohong, et al.
Publicado: (2025)
por: Park, Seohong, et al.
Publicado: (2025)
Intention-Conditioned Flow Occupancy Models
por: Zheng, Chongyi, et al.
Publicado: (2025)
por: Zheng, Chongyi, et al.
Publicado: (2025)
RACER: Epistemic Risk-Sensitive RL Enables Fast Driving with Fewer Crashes
por: Stachowicz, Kyle, et al.
Publicado: (2024)
por: Stachowicz, Kyle, et al.
Publicado: (2024)
Q-learning with Adjoint Matching
por: Li, Qiyang, et al.
Publicado: (2026)
por: Li, Qiyang, et al.
Publicado: (2026)
Posterior Behavioral Cloning: Pretraining BC Policies for Efficient RL Finetuning
por: Wagenmaker, Andrew, et al.
Publicado: (2025)
por: Wagenmaker, Andrew, et al.
Publicado: (2025)
Reinforcement Learning with Action Chunking
por: Li, Qiyang, et al.
Publicado: (2025)
por: Li, Qiyang, et al.
Publicado: (2025)
Steering Your Diffusion Policy with Latent Space Reinforcement Learning
por: Wagenmaker, Andrew, et al.
Publicado: (2025)
por: Wagenmaker, Andrew, et al.
Publicado: (2025)
Horizon Reduction Makes RL Scalable
por: Park, Seohong, et al.
Publicado: (2025)
por: Park, Seohong, et al.
Publicado: (2025)
GHIL-Glue: Hierarchical Control with Filtered Subgoal Images
por: Hatch, Kyle B., et al.
Publicado: (2024)
por: Hatch, Kyle B., et al.
Publicado: (2024)
RAPTOR: A Foundation Policy for Quadrotor Control
por: Eschmann, Jonas, et al.
Publicado: (2025)
por: Eschmann, Jonas, et al.
Publicado: (2025)
Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation
por: Feng, Yunhai, et al.
Publicado: (2025)
por: Feng, Yunhai, et al.
Publicado: (2025)
KALIE: Fine-Tuning Vision-Language Models for Open-World Manipulation without Robot Data
por: Tang, Grace, et al.
Publicado: (2024)
por: Tang, Grace, et al.
Publicado: (2024)
Drifting Field Policy: A One-Step Generative Policy via Wasserstein Gradient Flow
por: Koo, Juil, et al.
Publicado: (2026)
por: Koo, Juil, et al.
Publicado: (2026)
Toward Accurate Long-Horizon Robotic Manipulation: Language-to-Action with Foundation Models via Scene Graphs
por: Dinesh, Sushil Samuel, et al.
Publicado: (2025)
por: Dinesh, Sushil Samuel, et al.
Publicado: (2025)
Towards Interpretable Foundation Models of Robot Behavior: A Task Specific Policy Generation Approach
por: Sheidlower, Isaac, et al.
Publicado: (2024)
por: Sheidlower, Isaac, et al.
Publicado: (2024)
PEEK: Guiding and Minimal Image Representations for Zero-Shot Generalization of Robot Manipulation Policies
por: Zhang, Jesse, et al.
Publicado: (2025)
por: Zhang, Jesse, et al.
Publicado: (2025)
Yell At Your Robot: Improving On-the-Fly from Language Corrections
por: Shi, Lucy Xiaoyang, et al.
Publicado: (2024)
por: Shi, Lucy Xiaoyang, et al.
Publicado: (2024)
Premier-TACO is a Few-Shot Policy Learner: Pretraining Multitask Representation via Temporal Action-Driven Contrastive Loss
por: Zheng, Ruijie, et al.
Publicado: (2024)
por: Zheng, Ruijie, et al.
Publicado: (2024)
Language Guided Skill Discovery
por: Rho, Seungeun, et al.
Publicado: (2024)
por: Rho, Seungeun, et al.
Publicado: (2024)
An Interactive Agent Foundation Model
por: Durante, Zane, et al.
Publicado: (2024)
por: Durante, Zane, et al.
Publicado: (2024)
Online Foundation Model Selection in Robotics
por: Li, Po-han, et al.
Publicado: (2024)
por: Li, Po-han, et al.
Publicado: (2024)
Fast Adaptation with Behavioral Foundation Models
por: Sikchi, Harshit, et al.
Publicado: (2025)
por: Sikchi, Harshit, et al.
Publicado: (2025)
Policy Decorator: Model-Agnostic Online Refinement for Large Policy Model
por: Yuan, Xiu, et al.
Publicado: (2024)
por: Yuan, Xiu, et al.
Publicado: (2024)
Policy-Guided Diffusion
por: Jackson, Matthew Thomas, et al.
Publicado: (2024)
por: Jackson, Matthew Thomas, et al.
Publicado: (2024)
Evolutionary Policy Optimization
por: Wang, Jianren, et al.
Publicado: (2025)
por: Wang, Jianren, et al.
Publicado: (2025)
Absolute Policy Optimization
por: Zhao, Weiye, et al.
Publicado: (2023)
por: Zhao, Weiye, et al.
Publicado: (2023)
Imagination Policy: Using Generative Point Cloud Models for Learning Manipulation Policies
por: Huang, Haojie, et al.
Publicado: (2024)
por: Huang, Haojie, et al.
Publicado: (2024)
Rethinking Policy Diversity in Ensemble Policy Gradient in Large-Scale Reinforcement Learning
por: Shitanda, Naoki, et al.
Publicado: (2026)
por: Shitanda, Naoki, et al.
Publicado: (2026)
Ensembling Prioritized Hybrid Policies for Multi-agent Pathfinding
por: Tang, Huijie, et al.
Publicado: (2024)
por: Tang, Huijie, et al.
Publicado: (2024)
Ejemplares similares
-
METRA: Scalable Unsupervised RL with Metric-Aware Abstraction
por: Park, Seohong, et al.
Publicado: (2023) -
Decoupled Q-Chunking
por: Li, Qiyang, et al.
Publicado: (2025) -
HIQL: Offline Goal-Conditioned RL with Latent States as Actions
por: Park, Seohong, et al.
Publicado: (2023) -
Dual Goal Representations
por: Park, Seohong, et al.
Publicado: (2025) -
Flow Q-Learning
por: Park, Seohong, et al.
Publicado: (2025)