SIME: Enhancing Policy Self-Improvement with Modal-level Exploration
Fuente:
arXiv
Salvato in:
| Autori principali: | Jin, Yang, Lv, Jun, Yu, Wenye, Fang, Hongjie, Li, Yong-Lu, Lu, Cewu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SOE: Sample-Efficient Robot Policy Self-Improvement via On-Manifold Exploration
di: Jin, Yang, et al.
Pubblicazione: (2025)
di: Jin, Yang, et al.
Pubblicazione: (2025)
DiffGen: Robot Demonstration Generation via Differentiable Physics Simulation, Differentiable Rendering, and Vision-Language Model
di: Jin, Yang, et al.
Pubblicazione: (2024)
di: Jin, Yang, et al.
Pubblicazione: (2024)
ImplicitRDP: An End-to-End Visual-Force Diffusion Policy with Structural Slow-Fast Learning
di: Chen, Wendi, et al.
Pubblicazione: (2025)
di: Chen, Wendi, et al.
Pubblicazione: (2025)
RoboPocket: Improve Robot Policies Instantly with Your Phone
di: Fang, Junjie, et al.
Pubblicazione: (2026)
di: Fang, Junjie, et al.
Pubblicazione: (2026)
Reactive Diffusion Policy: Slow-Fast Visual-Tactile Policy Learning for Contact-Rich Manipulation
di: Xue, Han, et al.
Pubblicazione: (2025)
di: Xue, Han, et al.
Pubblicazione: (2025)
Multi-Modal Manipulation via Multi-Modal Policy Consensus
di: Chen, Haonan, et al.
Pubblicazione: (2025)
di: Chen, Haonan, et al.
Pubblicazione: (2025)
Unsupervised Learning of Efficient Exploration: Pre-training Adaptive Policies via Self-Imposed Goals
di: Pappalardo, Octavio
Pubblicazione: (2026)
di: Pappalardo, Octavio
Pubblicazione: (2026)
Guided Policy Optimization under Partial Observability
di: Li, Yueheng, et al.
Pubblicazione: (2025)
di: Li, Yueheng, et al.
Pubblicazione: (2025)
Self-evolved Imitation Learning in Simulated World
di: Ye, Yifan, et al.
Pubblicazione: (2025)
di: Ye, Yifan, et al.
Pubblicazione: (2025)
Safe Exploration via Policy Priors
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
Human-Agent Joint Learning for Efficient Robot Manipulation Skill Acquisition
di: Luo, Shengcheng, et al.
Pubblicazione: (2024)
di: Luo, Shengcheng, et al.
Pubblicazione: (2024)
Dense Policy: Bidirectional Autoregressive Learning of Actions
di: Su, Yue, et al.
Pubblicazione: (2025)
di: Su, Yue, et al.
Pubblicazione: (2025)
ImaginationPolicy: Towards Generalizable, Precise and Reliable End-to-End Policy for Robotic Manipulation
di: Lu, Dekun, et al.
Pubblicazione: (2025)
di: Lu, Dekun, et al.
Pubblicazione: (2025)
TMRL: Diffusion Timestep-Modulated Pretraining Enables Exploration for Efficient Policy Finetuning
di: Hong, Matthew M., et al.
Pubblicazione: (2026)
di: Hong, Matthew M., et al.
Pubblicazione: (2026)
Confidence-Controlled Exploration: Efficient Sparse-Reward Policy Learning for Robot Navigation
di: Patel, Bhrij, et al.
Pubblicazione: (2023)
di: Patel, Bhrij, et al.
Pubblicazione: (2023)
Task Assignment and Exploration Optimization for Low Altitude UAV Rescue via Generative AI Enhanced Multi-agent Reinforcement Learning
di: Tang, Xin, et al.
Pubblicazione: (2025)
di: Tang, Xin, et al.
Pubblicazione: (2025)
Policy-Guided Diffusion
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)
Articulated Object Manipulation using Online Axis Estimation with SAM2-Based Tracking
di: Wang, Xi, et al.
Pubblicazione: (2024)
di: Wang, Xi, et al.
Pubblicazione: (2024)
SPAARS: Safer RL Policy Alignment through Abstract Exploration and Refined Exploitation of Action Space
di: K, Swaminathan S, et al.
Pubblicazione: (2026)
di: K, Swaminathan S, et al.
Pubblicazione: (2026)
Enhanced Importance Sampling through Latent Space Exploration in Normalizing Flows
di: Kruse, Liam A., et al.
Pubblicazione: (2025)
di: Kruse, Liam A., et al.
Pubblicazione: (2025)
Deep Active Inference with Diffusion Policy and Multiple Timescale World Model for Real-World Exploration and Navigation
di: Yokozawa, Riko, et al.
Pubblicazione: (2025)
di: Yokozawa, Riko, et al.
Pubblicazione: (2025)
Policy Decorator: Model-Agnostic Online Refinement for Large Policy Model
di: Yuan, Xiu, et al.
Pubblicazione: (2024)
di: Yuan, Xiu, et al.
Pubblicazione: (2024)
Optimal Control-Based Baseline for Guided Exploration in Policy Gradient Methods
di: Lyu, Xubo, et al.
Pubblicazione: (2020)
di: Lyu, Xubo, et al.
Pubblicazione: (2020)
From Imitation to Exploration: End-to-end Autonomous Driving based on World Model
di: Li, Yueyuan, et al.
Pubblicazione: (2024)
di: Li, Yueyuan, et al.
Pubblicazione: (2024)
Mission-driven Exploration for Accelerated Deep Reinforcement Learning with Temporal Logic Task Specifications
di: Wang, Jun, et al.
Pubblicazione: (2023)
di: Wang, Jun, et al.
Pubblicazione: (2023)
Enhancing Robot Navigation Policies with Task-Specific Uncertainty Managements
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2025)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2025)
Dexterous Manipulation Based on Prior Dexterous Grasp Pose Knowledge
di: Yan, Hengxu, et al.
Pubblicazione: (2024)
di: Yan, Hengxu, et al.
Pubblicazione: (2024)
CAML: Collaborative Auxiliary Modality Learning for Multi-Agent Systems
di: Liu, Rui, et al.
Pubblicazione: (2025)
di: Liu, Rui, et al.
Pubblicazione: (2025)
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
di: Nguyen, Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Thanh, et al.
Pubblicazione: (2024)
Enhancing Hardware Fault Tolerance in Machines with Reinforcement Learning Policy Gradient Algorithms
di: Schoepp, Sheila, et al.
Pubblicazione: (2024)
di: Schoepp, Sheila, et al.
Pubblicazione: (2024)
DiffClone: Enhanced Behaviour Cloning in Robotics with Diffusion-Driven Policy Learning
di: Mani, Sabariswaran, et al.
Pubblicazione: (2024)
di: Mani, Sabariswaran, et al.
Pubblicazione: (2024)
Adaptive Diffusion Policy Optimization for Robotic Manipulation
di: Jiang, Huiyun, et al.
Pubblicazione: (2025)
di: Jiang, Huiyun, et al.
Pubblicazione: (2025)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
GBC: Generalized Behavior-Cloning Framework for Whole-Body Humanoid Imitation
di: Yao, Yifei, et al.
Pubblicazione: (2025)
di: Yao, Yifei, et al.
Pubblicazione: (2025)
Absolute Policy Optimization
di: Zhao, Weiye, et al.
Pubblicazione: (2023)
di: Zhao, Weiye, et al.
Pubblicazione: (2023)
World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry
di: Liu, Yuejiang, et al.
Pubblicazione: (2026)
di: Liu, Yuejiang, et al.
Pubblicazione: (2026)
LearningFlow: Automated Policy Learning Workflow for Urban Driving with Large Language Models
di: Peng, Zengqi, et al.
Pubblicazione: (2025)
di: Peng, Zengqi, et al.
Pubblicazione: (2025)
Revisiting Safe Exploration in Safe Reinforcement learning
di: Eckel, David, et al.
Pubblicazione: (2024)
di: Eckel, David, et al.
Pubblicazione: (2024)
Exploring CausalWorld: Enhancing robotic manipulation via knowledge transfer and curriculum learning
di: Wang, Xinrui, et al.
Pubblicazione: (2024)
di: Wang, Xinrui, et al.
Pubblicazione: (2024)
Human-Aware Robot Navigation via Reinforcement Learning with Hindsight Experience Replay and Curriculum Learning
di: Li, Keyu, et al.
Pubblicazione: (2021)
di: Li, Keyu, et al.
Pubblicazione: (2021)
Documenti analoghi
-
SOE: Sample-Efficient Robot Policy Self-Improvement via On-Manifold Exploration
di: Jin, Yang, et al.
Pubblicazione: (2025) -
DiffGen: Robot Demonstration Generation via Differentiable Physics Simulation, Differentiable Rendering, and Vision-Language Model
di: Jin, Yang, et al.
Pubblicazione: (2024) -
ImplicitRDP: An End-to-End Visual-Force Diffusion Policy with Structural Slow-Fast Learning
di: Chen, Wendi, et al.
Pubblicazione: (2025) -
RoboPocket: Improve Robot Policies Instantly with Your Phone
di: Fang, Junjie, et al.
Pubblicazione: (2026) -
Reactive Diffusion Policy: Slow-Fast Visual-Tactile Policy Learning for Contact-Rich Manipulation
di: Xue, Han, et al.
Pubblicazione: (2025)