From Imitation to Refinement -- Residual RL for Precise Assembly
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ankile, Lars, Simeonov, Anthony, Shenfeld, Idan, Torne, Marcel, Agrawal, Pulkit |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
JUICER: Data-Efficient Imitation Learning for Robotic Assembly
par: Ankile, Lars, et autres
Publié: (2024)
par: Ankile, Lars, et autres
Publié: (2024)
Robot Learning with Super-Linear Scaling
par: Torne, Marcel, et autres
Publié: (2024)
par: Torne, Marcel, et autres
Publié: (2024)
Reconciling Reality through Simulation: A Real-to-Sim-to-Real Approach for Robust Manipulation
par: Torne, Marcel, et autres
Publié: (2024)
par: Torne, Marcel, et autres
Publié: (2024)
RL's Razor: Why Online Reinforcement Learning Forgets Less
par: Shenfeld, Idan, et autres
Publié: (2025)
par: Shenfeld, Idan, et autres
Publié: (2025)
Diffusion Policy Policy Optimization
par: Ren, Allen Z., et autres
Publié: (2024)
par: Ren, Allen Z., et autres
Publié: (2024)
Residual Off-Policy RL for Finetuning Behavior Cloning Policies
par: Ankile, Lars, et autres
Publié: (2025)
par: Ankile, Lars, et autres
Publié: (2025)
Self-Distillation Enables Continual Learning
par: Shenfeld, Idan, et autres
Publié: (2026)
par: Shenfeld, Idan, et autres
Publié: (2026)
Language Model Personalization via Reward Factorization
par: Shenfeld, Idan, et autres
Publié: (2025)
par: Shenfeld, Idan, et autres
Publié: (2025)
Automatic Environment Shaping is the Next Frontier in RL
par: Park, Younghyo, et autres
Publié: (2024)
par: Park, Younghyo, et autres
Publié: (2024)
TGRL: An Algorithm for Teacher Guided Reinforcement Learning
par: Shenfeld, Idan, et autres
Publié: (2023)
par: Shenfeld, Idan, et autres
Publié: (2023)
DexHub and DART: Towards Internet Scale Robot Data Collection
par: Park, Younghyo, et autres
Publié: (2024)
par: Park, Younghyo, et autres
Publié: (2024)
Learn Where Outcomes Diverge: Efficient VLA RL via Probabilistic Chunk Masking
par: Bagaria, Vaidehi, et autres
Publié: (2026)
par: Bagaria, Vaidehi, et autres
Publié: (2026)
Value Augmented Sampling for Language Model Alignment and Personalization
par: Han, Seungwook, et autres
Publié: (2024)
par: Han, Seungwook, et autres
Publié: (2024)
Refined Policy Distillation: From VLA Generalists to RL Experts
par: Jülg, Tobias, et autres
Publié: (2025)
par: Jülg, Tobias, et autres
Publié: (2025)
Efficient Diffusion Transformer Policies with Mixture of Expert Denoisers for Multitask Learning
par: Reuss, Moritz, et autres
Publié: (2024)
par: Reuss, Moritz, et autres
Publié: (2024)
Learning Long-Context Diffusion Policies via Past-Token Prediction
par: Torne, Marcel, et autres
Publié: (2025)
par: Torne, Marcel, et autres
Publié: (2025)
Bridging the Sim-to-Real Gap for Athletic Loco-Manipulation
par: Fey, Nolan, et autres
Publié: (2025)
par: Fey, Nolan, et autres
Publié: (2025)
SoftMimic: Learning Compliant Whole-body Control from Examples
par: Margolis, Gabriel B., et autres
Publié: (2025)
par: Margolis, Gabriel B., et autres
Publié: (2025)
Dual RL: Unification and New Methods for Reinforcement and Imitation Learning
par: Sikchi, Harshit, et autres
Publié: (2023)
par: Sikchi, Harshit, et autres
Publié: (2023)
GR-RL: Going Dexterous and Precise for Long-Horizon Robotic Manipulation
par: Li, Yunfei, et autres
Publié: (2025)
par: Li, Yunfei, et autres
Publié: (2025)
Vegetable Peeling: A Case Study in Constrained Dexterous Manipulation
par: Chen, Tao, et autres
Publié: (2024)
par: Chen, Tao, et autres
Publié: (2024)
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
ROER: Regularized Optimal Experience Replay
par: Li, Changling, et autres
Publié: (2024)
par: Li, Changling, et autres
Publié: (2024)
Aligning Robot and Human Representations
par: Bobu, Andreea, et autres
Publié: (2023)
par: Bobu, Andreea, et autres
Publié: (2023)
ViSaRL: Visual Reinforcement Learning Guided by Human Saliency
par: Liang, Anthony, et autres
Publié: (2024)
par: Liang, Anthony, et autres
Publié: (2024)
Learning Force Control for Legged Manipulation
par: Portela, Tifanny, et autres
Publié: (2024)
par: Portela, Tifanny, et autres
Publié: (2024)
VT-Refine: Learning Bimanual Assembly with Visuo-Tactile Feedback via Simulation Fine-Tuning
par: Huang, Binghao, et autres
Publié: (2025)
par: Huang, Binghao, et autres
Publié: (2025)
Sample-Efficient Expert Query Control in Active Imitation Learning via Conformal Prediction
par: Firouzkouhi, Arad, et autres
Publié: (2025)
par: Firouzkouhi, Arad, et autres
Publié: (2025)
Few-Shot Task Learning through Inverse Generative Modeling
par: Netanyahu, Aviv, et autres
Publié: (2024)
par: Netanyahu, Aviv, et autres
Publié: (2024)
Hovering Flight of Soft-Actuated Insect-Scale Micro Aerial Vehicles using Deep Reinforcement Learning
par: Hsiao, Yi-Hsuan, et autres
Publié: (2025)
par: Hsiao, Yi-Hsuan, et autres
Publié: (2025)
Robotic Imitation of Human Actions
par: Spisak, Josua, et autres
Publié: (2024)
par: Spisak, Josua, et autres
Publié: (2024)
Action-Constrained Imitation Learning
par: Yeh, Chia-Han, et autres
Publié: (2025)
par: Yeh, Chia-Han, et autres
Publié: (2025)
Physics Encoded Blocks in Residual Neural Network Architectures for Digital Twin Models
par: Zia, Muhammad Saad, et autres
Publié: (2024)
par: Zia, Muhammad Saad, et autres
Publié: (2024)
Globally Stable Neural Imitation Policies
par: Abyaneh, Amin, et autres
Publié: (2024)
par: Abyaneh, Amin, et autres
Publié: (2024)
An Introduction to Deep Reinforcement and Imitation Learning
par: Santana, Pedro
Publié: (2025)
par: Santana, Pedro
Publié: (2025)
SPAARS: Safer RL Policy Alignment through Abstract Exploration and Refined Exploitation of Action Space
par: K, Swaminathan S, et autres
Publié: (2026)
par: K, Swaminathan S, et autres
Publié: (2026)
From Prior to Pro: Efficient Skill Mastery via Distribution Contractive RL Finetuning
par: Sun, Zhanyi, et autres
Publié: (2026)
par: Sun, Zhanyi, et autres
Publié: (2026)
RL Token: Bootstrapping Online RL with Vision-Language-Action Models
par: Xu, Charles, et autres
Publié: (2026)
par: Xu, Charles, et autres
Publié: (2026)
Phase-Amplitude Reduction-Based Imitation Learning
par: Yamamori, Satoshi, et autres
Publié: (2024)
par: Yamamori, Satoshi, et autres
Publié: (2024)
MaIL: Improving Imitation Learning with Mamba
par: Jia, Xiaogang, et autres
Publié: (2024)
par: Jia, Xiaogang, et autres
Publié: (2024)
Documents similaires
-
JUICER: Data-Efficient Imitation Learning for Robotic Assembly
par: Ankile, Lars, et autres
Publié: (2024) -
Robot Learning with Super-Linear Scaling
par: Torne, Marcel, et autres
Publié: (2024) -
Reconciling Reality through Simulation: A Real-to-Sim-to-Real Approach for Robust Manipulation
par: Torne, Marcel, et autres
Publié: (2024) -
RL's Razor: Why Online Reinforcement Learning Forgets Less
par: Shenfeld, Idan, et autres
Publié: (2025) -
Diffusion Policy Policy Optimization
par: Ren, Allen Z., et autres
Publié: (2024)