Learning to Look: Seeking Information for Decision Making via Policy Factorization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dass, Shivin, Hu, Jiaheng, Abbatematteo, Ben, Stone, Peter, Martín-Martín, Roberto |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TeleMoMa: A Modular and Versatile Teleoperation System for Mobile Manipulation
par: Dass, Shivin, et autres
Publié: (2024)
par: Dass, Shivin, et autres
Publié: (2024)
Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes
par: Tang, Chen, et autres
Publié: (2024)
par: Tang, Chen, et autres
Publié: (2024)
COLLAGE: Adaptive Fusion-based Retrieval for Augmented Policy Learning
par: Kumar, Sateesh, et autres
Publié: (2025)
par: Kumar, Sateesh, et autres
Publié: (2025)
Model-Based Runtime Monitoring with Interactive Imitation Learning
par: Liu, Huihan, et autres
Publié: (2023)
par: Liu, Huihan, et autres
Publié: (2023)
DataMIL: Selecting Data for Robot Imitation Learning with Datamodels
par: Dass, Shivin, et autres
Publié: (2025)
par: Dass, Shivin, et autres
Publié: (2025)
Disentangled Unsupervised Skill Discovery for Efficient Hierarchical Reinforcement Learning
par: Hu, Jiaheng, et autres
Publié: (2024)
par: Hu, Jiaheng, et autres
Publié: (2024)
SLAC: Simulation-Pretrained Latent Action Space for Whole-Body Real-World RL
par: Hu, Jiaheng, et autres
Publié: (2025)
par: Hu, Jiaheng, et autres
Publié: (2025)
Mash, Spread, Slice! Learning to Manipulate Object States via Visual Spatial Progress
par: Mandikal, Priyanka, et autres
Publié: (2025)
par: Mandikal, Priyanka, et autres
Publié: (2025)
SkiLD: Unsupervised Skill Discovery Guided by Factor Interactions
par: Wang, Zizhao, et autres
Publié: (2024)
par: Wang, Zizhao, et autres
Publié: (2024)
Learning Memory Mechanisms for Decision Making through Demonstrations
par: Yue, William, et autres
Publié: (2024)
par: Yue, William, et autres
Publié: (2024)
Simple Recipe Works: Vision-Language-Action Models are Natural Continual Learners with Reinforcement Learning
par: Hu, Jiaheng, et autres
Publié: (2026)
par: Hu, Jiaheng, et autres
Publié: (2026)
FLaRe: Achieving Masterful and Adaptive Robot Policies with Large-Scale Reinforcement Learning Fine-Tuning
par: Hu, Jiaheng, et autres
Publié: (2024)
par: Hu, Jiaheng, et autres
Publié: (2024)
RoboArena: Distributed Real-World Evaluation of Generalist Robot Policies
par: Atreya, Pranav, et autres
Publié: (2025)
par: Atreya, Pranav, et autres
Publié: (2025)
Large-Language-Model-Guided State Estimation for Partially Observable Task and Motion Planning
par: Kim, Yoonwoo, et autres
Publié: (2026)
par: Kim, Yoonwoo, et autres
Publié: (2026)
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
par: Yang, Shunpeng, et autres
Publié: (2026)
par: Yang, Shunpeng, et autres
Publié: (2026)
Fourier Controller Networks for Real-Time Decision-Making in Embodied Learning
par: Tan, Hengkai, et autres
Publié: (2024)
par: Tan, Hengkai, et autres
Publié: (2024)
Practice Makes Perfect: Planning to Learn Skill Parameter Policies
par: Kumar, Nishanth, et autres
Publié: (2024)
par: Kumar, Nishanth, et autres
Publié: (2024)
Dyna-LfLH: Learning Agile Navigation in Dynamic Environments from Learned Hallucination
par: Ghani, Saad Abdul, et autres
Publié: (2024)
par: Ghani, Saad Abdul, et autres
Publié: (2024)
ScrewMimic: Bimanual Imitation from Human Videos with Screw Space Projection
par: Bahety, Arpit, et autres
Publié: (2024)
par: Bahety, Arpit, et autres
Publié: (2024)
SafeMimic: Towards Safe and Autonomous Human-to-Robot Imitation for Mobile Manipulation
par: Bahety, Arpit, et autres
Publié: (2025)
par: Bahety, Arpit, et autres
Publié: (2025)
Dexterous Legged Locomotion in Confined 3D Spaces with Reinforcement Learning
par: Xu, Zifan, et autres
Publié: (2024)
par: Xu, Zifan, et autres
Publié: (2024)
Factored Latent Action World Models
par: Wang, Zizhao, et autres
Publié: (2026)
par: Wang, Zizhao, et autres
Publié: (2026)
Extremum-Seeking Action Selection for Accelerating Policy Optimization
par: Chang, Ya-Chien, et autres
Publié: (2024)
par: Chang, Ya-Chien, et autres
Publié: (2024)
Using Surprise Index for Competency Assessment in Autonomous Decision-Making
par: Ratheesh, Akash, et autres
Publié: (2023)
par: Ratheesh, Akash, et autres
Publié: (2023)
Diffusion Policy through Conditional Proximal Policy Optimization
par: Liu, Ben, et autres
Publié: (2026)
par: Liu, Ben, et autres
Publié: (2026)
DexTouch: Learning to Seek and Manipulate Objects with Tactile Dexterity
par: Lee, Kang-Won, et autres
Publié: (2024)
par: Lee, Kang-Won, et autres
Publié: (2024)
Scenario-Based Hierarchical Reinforcement Learning for Automated Driving Decision Making
par: Abdelhamid, M. Youssef, et autres
Publié: (2025)
par: Abdelhamid, M. Youssef, et autres
Publié: (2025)
Scalable Decision-Making in Stochastic Environments through Learned Temporal Abstraction
par: Luo, Baiting, et autres
Publié: (2025)
par: Luo, Baiting, et autres
Publié: (2025)
Robot Fleet Learning via Policy Merging
par: Wang, Lirui, et autres
Publié: (2023)
par: Wang, Lirui, et autres
Publié: (2023)
Autonomous Vehicle Decision-Making Framework for Considering Malicious Behavior at Unsignalized Intersections
par: Li, Qing, et autres
Publié: (2024)
par: Li, Qing, et autres
Publié: (2024)
Skill Generalization with Verbs
par: Ma, Rachel, et autres
Publié: (2024)
par: Ma, Rachel, et autres
Publié: (2024)
RoboSSM: Scalable In-context Imitation Learning via State-Space Models
par: Yoo, Youngju, et autres
Publié: (2025)
par: Yoo, Youngju, et autres
Publié: (2025)
Demystifying the Physics of Deep Reinforcement Learning-Based Autonomous Vehicle Decision-Making
par: Wan, Hanxi, et autres
Publié: (2024)
par: Wan, Hanxi, et autres
Publié: (2024)
When Should a Robot Think? Resource-Aware Reasoning via Reinforcement Learning for Embodied Robotic Decision-Making
par: Liu, Jun, et autres
Publié: (2026)
par: Liu, Jun, et autres
Publié: (2026)
Learning to Plan, Planning to Learn: Adaptive Hierarchical RL-MPC for Sample-Efficient Decision Making
par: Hori, Toshiaki, et autres
Publié: (2025)
par: Hori, Toshiaki, et autres
Publié: (2025)
Policy Decorator: Model-Agnostic Online Refinement for Large Policy Model
par: Yuan, Xiu, et autres
Publié: (2024)
par: Yuan, Xiu, et autres
Publié: (2024)
Deformable Cluster Manipulation via Whole-Arm Policy Learning
par: Jacob, Jayadeep, et autres
Publié: (2025)
par: Jacob, Jayadeep, et autres
Publié: (2025)
Deep Reinforcement Learning for Robotic Manipulation under Distribution Shift with Bounded Extremum Seeking
par: Saxena, Shaifalee, et autres
Publié: (2026)
par: Saxena, Shaifalee, et autres
Publié: (2026)
Optimizing Sensor Redundancy in Sequential Decision-Making Problems
par: Nüßlein, Jonas, et autres
Publié: (2024)
par: Nüßlein, Jonas, et autres
Publié: (2024)
PrivilegedDreamer: Explicit Imagination of Privileged Information for Rapid Adaptation of Learned Policies
par: Byrd, Morgan, et autres
Publié: (2025)
par: Byrd, Morgan, et autres
Publié: (2025)
Documents similaires
-
TeleMoMa: A Modular and Versatile Teleoperation System for Mobile Manipulation
par: Dass, Shivin, et autres
Publié: (2024) -
Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes
par: Tang, Chen, et autres
Publié: (2024) -
COLLAGE: Adaptive Fusion-based Retrieval for Augmented Policy Learning
par: Kumar, Sateesh, et autres
Publié: (2025) -
Model-Based Runtime Monitoring with Interactive Imitation Learning
par: Liu, Huihan, et autres
Publié: (2023) -
DataMIL: Selecting Data for Robot Imitation Learning with Datamodels
par: Dass, Shivin, et autres
Publié: (2025)