Retrieve-Augmented Generation for Speeding up Diffusion Policy without Additional Training
Fuente:
arXiv
Guardado en:
| Autores principales: | Odonchimed, Sodtavilan, Matsushima, Tatsuya, Holk, Simon, Iwasawa, Yusuke, Matsuo, Yutaka |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GenORM: Generalizable One-shot Rope Manipulation with Parameter-Aware Policy
por: Kuroki, So, et al.
Publicado: (2023)
por: Kuroki, So, et al.
Publicado: (2023)
SPARK: Graph-Based Online Semantic Integration System for Robot Task Planning
por: Shirasaka, Mimo, et al.
Publicado: (2025)
por: Shirasaka, Mimo, et al.
Publicado: (2025)
A Comprehensive Survey on Physical Risk Control in the Era of Foundation Model-enabled Robotics
por: Kojima, Takeshi, et al.
Publicado: (2025)
por: Kojima, Takeshi, et al.
Publicado: (2025)
Leave No Observation Behind: Real-time Correction for VLA Action Chunks
por: Sendai, Kohei, et al.
Publicado: (2025)
por: Sendai, Kohei, et al.
Publicado: (2025)
Conditional Diffusion Models for Semantic 3D Brain MRI Synthesis
por: Dorjsembe, Zolnamar, et al.
Publicado: (2023)
por: Dorjsembe, Zolnamar, et al.
Publicado: (2023)
Collective Intelligence for 2D Push Manipulations with Mobile Robots
por: Kuroki, So, et al.
Publicado: (2022)
por: Kuroki, So, et al.
Publicado: (2022)
PREDILECT: Preferences Delineated with Zero-Shot Language-based Reasoning in Reinforcement Learning
por: Holk, Simon, et al.
Publicado: (2024)
por: Holk, Simon, et al.
Publicado: (2024)
Bridging Lottery Ticket and Grokking: Understanding Grokking from Inner Structure of Networks
por: Minegishi, Gouki, et al.
Publicado: (2023)
por: Minegishi, Gouki, et al.
Publicado: (2023)
Does "Do Differentiable Simulators Give Better Policy Gradients?'' Give Better Policy Gradients?
por: Onoda, Ku, et al.
Publicado: (2026)
por: Onoda, Ku, et al.
Publicado: (2026)
GenDOM: Generalizable One-shot Deformable Object Manipulation with Parameter-Aware Policy
por: Kuroki, So, et al.
Publicado: (2023)
por: Kuroki, So, et al.
Publicado: (2023)
Language Models Do Hard Arithmetic Tasks Easily and Hardly Do Easy Arithmetic Tasks
por: Gambardella, Andrew, et al.
Publicado: (2024)
por: Gambardella, Andrew, et al.
Publicado: (2024)
Continuous Reasoning for Vision-Language-Action
por: Wu, Yueh-Hua, et al.
Publicado: (2026)
por: Wu, Yueh-Hua, et al.
Publicado: (2026)
Zipping the Thought: When and How Compressed Reasoning Data Works in LLM Post-Training
por: Matsutani, Kohsei, et al.
Publicado: (2026)
por: Matsutani, Kohsei, et al.
Publicado: (2026)
Towards Empirical Interpretation of Internal Circuits and Properties in Grokked Transformers on Modular Polynomials
por: Furuta, Hiroki, et al.
Publicado: (2024)
por: Furuta, Hiroki, et al.
Publicado: (2024)
Residual Koopman Spectral Profiling for Predicting and Preventing Transformer Training Instability
por: Kim, Bum Jun, et al.
Publicado: (2026)
por: Kim, Bum Jun, et al.
Publicado: (2026)
C-voting: Confidence-Based Test-Time Voting without Explicit Energy Functions
por: Kubo, Kenji, et al.
Publicado: (2026)
por: Kubo, Kenji, et al.
Publicado: (2026)
$\infty$-MoE: Generalizing Mixture of Experts to Infinite Experts
por: Takashiro, Shota, et al.
Publicado: (2026)
por: Takashiro, Shota, et al.
Publicado: (2026)
R2-Dreamer: Redundancy-Reduced World Models without Decoders or Augmentation
por: Morihira, Naoki, et al.
Publicado: (2026)
por: Morihira, Naoki, et al.
Publicado: (2026)
Inconsistent Tokenizations Cause Language Models to be Perplexed by Japanese Grammar
por: Gambardella, Andrew, et al.
Publicado: (2025)
por: Gambardella, Andrew, et al.
Publicado: (2025)
Rethinking Evaluation of Sparse Autoencoders through the Representation of Polysemous Words
por: Minegishi, Gouki, et al.
Publicado: (2025)
por: Minegishi, Gouki, et al.
Publicado: (2025)
Real-Time Operator Takeover for Visuomotor Diffusion Policy Training
por: Moletta, Marco, et al.
Publicado: (2025)
por: Moletta, Marco, et al.
Publicado: (2025)
Training-Free Imitation Learning with Closed-Form Diffusion Policies
por: Mishra, Raghav, et al.
Publicado: (2026)
por: Mishra, Raghav, et al.
Publicado: (2026)
FLoRA: Sample-Efficient Preference-based RL via Low-Rank Style Adaptation of Reward Functions
por: Marta, Daniel, et al.
Publicado: (2025)
por: Marta, Daniel, et al.
Publicado: (2025)
Robustifying a Policy in Multi-Agent RL with Diverse Cooperative Behaviors and Adversarial Style Sampling for Assistive Tasks
por: Osa, Takayuki, et al.
Publicado: (2024)
por: Osa, Takayuki, et al.
Publicado: (2024)
COLLAGE: Adaptive Fusion-based Retrieval for Augmented Policy Learning
por: Kumar, Sateesh, et al.
Publicado: (2025)
por: Kumar, Sateesh, et al.
Publicado: (2025)
STRAP: Robot Sub-Trajectory Retrieval for Augmented Policy Learning
por: Memmel, Marius, et al.
Publicado: (2024)
por: Memmel, Marius, et al.
Publicado: (2024)
Speeding up 6-DoF Grasp Sampling with Quality-Diversity
por: Huber, Johann, et al.
Publicado: (2024)
por: Huber, Johann, et al.
Publicado: (2024)
Mini Diffuser: Fast Multi-task Diffusion Policy Training Using Two-level Mini-batches
por: Hu, Yutong, et al.
Publicado: (2025)
por: Hu, Yutong, et al.
Publicado: (2025)
The Role of Domain Randomization in Training Diffusion Policies for Whole-Body Humanoid Control
por: Kaidanov, Oleg, et al.
Publicado: (2024)
por: Kaidanov, Oleg, et al.
Publicado: (2024)
Unlocking Noise-Resistant Vision: Key Architectural Secrets for Robust Models
por: Kim, Bum Jun, et al.
Publicado: (2025)
por: Kim, Bum Jun, et al.
Publicado: (2025)
Diffusion Policy Policy Optimization
por: Ren, Allen Z., et al.
Publicado: (2024)
por: Ren, Allen Z., et al.
Publicado: (2024)
Variable-Speed Teaching-Playback as Real-World Data Augmentation for Imitation Learning
por: Masuya, Nozomu, et al.
Publicado: (2024)
por: Masuya, Nozomu, et al.
Publicado: (2024)
Understanding Emergent Misalignment via Feature Superposition Geometry
por: Minegishi, Gouki, et al.
Publicado: (2026)
por: Minegishi, Gouki, et al.
Publicado: (2026)
Equivariant Diffusion Policy
por: Wang, Dian, et al.
Publicado: (2024)
por: Wang, Dian, et al.
Publicado: (2024)
One-Step Diffusion Policy: Fast Visuomotor Policies via Diffusion Distillation
por: Wang, Zhendong, et al.
Publicado: (2024)
por: Wang, Zhendong, et al.
Publicado: (2024)
QuadNorm: Resolution-Robust Normalization for Neural Operators
por: Kim, Bum Jun, et al.
Publicado: (2026)
por: Kim, Bum Jun, et al.
Publicado: (2026)
Diffusion Policy through Conditional Proximal Policy Optimization
por: Liu, Ben, et al.
Publicado: (2026)
por: Liu, Ben, et al.
Publicado: (2026)
Rethinking Policy Diversity in Ensemble Policy Gradient in Large-Scale Reinforcement Learning
por: Shitanda, Naoki, et al.
Publicado: (2026)
por: Shitanda, Naoki, et al.
Publicado: (2026)
Dichotomous Diffusion Policy Optimization
por: Liang, Ruiming, et al.
Publicado: (2025)
por: Liang, Ruiming, et al.
Publicado: (2025)
WorldPack: Compressed Memory Improves Spatial Consistency in Video World Modeling
por: Oshima, Yuta, et al.
Publicado: (2025)
por: Oshima, Yuta, et al.
Publicado: (2025)
Ejemplares similares
-
GenORM: Generalizable One-shot Rope Manipulation with Parameter-Aware Policy
por: Kuroki, So, et al.
Publicado: (2023) -
SPARK: Graph-Based Online Semantic Integration System for Robot Task Planning
por: Shirasaka, Mimo, et al.
Publicado: (2025) -
A Comprehensive Survey on Physical Risk Control in the Era of Foundation Model-enabled Robotics
por: Kojima, Takeshi, et al.
Publicado: (2025) -
Leave No Observation Behind: Real-time Correction for VLA Action Chunks
por: Sendai, Kohei, et al.
Publicado: (2025) -
Conditional Diffusion Models for Semantic 3D Brain MRI Synthesis
por: Dorjsembe, Zolnamar, et al.
Publicado: (2023)