Enregistré dans:
| Auteurs principaux: | Bagaria, Vaidehi, Grampurohit, Nikshep, Verma, Pulkit |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2605.16154 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
par: Li, Haozhan, et autres
Publié: (2025)
par: Li, Haozhan, et autres
Publié: (2025)
Automatic Environment Shaping is the Next Frontier in RL
par: Park, Younghyo, et autres
Publié: (2024)
par: Park, Younghyo, et autres
Publié: (2024)
From Imitation to Refinement -- Residual RL for Precise Assembly
par: Ankile, Lars, et autres
Publié: (2024)
par: Ankile, Lars, et autres
Publié: (2024)
JUICER: Data-Efficient Imitation Learning for Robotic Assembly
par: Ankile, Lars, et autres
Publié: (2024)
par: Ankile, Lars, et autres
Publié: (2024)
Refined Policy Distillation: From VLA Generalists to RL Experts
par: Jülg, Tobias, et autres
Publié: (2025)
par: Jülg, Tobias, et autres
Publié: (2025)
Efficient Diffusion Transformer Policies with Mixture of Expert Denoisers for Multitask Learning
par: Reuss, Moritz, et autres
Publié: (2024)
par: Reuss, Moritz, et autres
Publié: (2024)
PointPatchRL -- Masked Reconstruction Improves Reinforcement Learning on Point Clouds
par: Gyenes, Balázs, et autres
Publié: (2024)
par: Gyenes, Balázs, et autres
Publié: (2024)
Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models
par: Zhang, Hongyin, et autres
Publié: (2025)
par: Zhang, Hongyin, et autres
Publié: (2025)
Rapidly Adapting Policies to the Real World via Simulation-Guided Fine-Tuning
par: Yin, Patrick, et autres
Publié: (2025)
par: Yin, Patrick, et autres
Publié: (2025)
Reinforcement Learning with Action Chunking
par: Li, Qiyang, et autres
Publié: (2025)
par: Li, Qiyang, et autres
Publié: (2025)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
par: Gireesh, Nandiraju, et autres
Publié: (2026)
par: Gireesh, Nandiraju, et autres
Publié: (2026)
CO-RFT: Efficient Fine-Tuning of Vision-Language-Action Models through Chunked Offline Reinforcement Learning
par: Huang, Dongchi, et autres
Publié: (2025)
par: Huang, Dongchi, et autres
Publié: (2025)
Improving Generative Behavior Cloning via Self-Guidance and Adaptive Chunking
par: So, Junhyuk, et autres
Publié: (2025)
par: So, Junhyuk, et autres
Publié: (2025)
cVLA: Towards Efficient Camera-Space VLAs
par: Argus, Max, et autres
Publié: (2025)
par: Argus, Max, et autres
Publié: (2025)
SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows
par: Yang, Chenyu, et autres
Publié: (2026)
par: Yang, Chenyu, et autres
Publié: (2026)
Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning
par: Lee, Sungyoung, et autres
Publié: (2026)
par: Lee, Sungyoung, et autres
Publié: (2026)
Data-Efficient Task Generalization via Probabilistic Model-based Meta Reinforcement Learning
par: Bhardwaj, Arjun, et autres
Publié: (2023)
par: Bhardwaj, Arjun, et autres
Publié: (2023)
Decoupled Q-Chunking
par: Li, Qiyang, et autres
Publié: (2025)
par: Li, Qiyang, et autres
Publié: (2025)
SimVLA: A Simple VLA Baseline for Robotic Manipulation
par: Luo, Yuankai, et autres
Publié: (2026)
par: Luo, Yuankai, et autres
Publié: (2026)
AsyncVLA: An Asynchronous VLA for Fast and Robust Navigation on the Edge
par: Hirose, Noriaki, et autres
Publié: (2026)
par: Hirose, Noriaki, et autres
Publié: (2026)
HyperVLA: Efficient Inference in Vision-Language-Action Models via Hypernetworks
par: Xiong, Zheng, et autres
Publié: (2025)
par: Xiong, Zheng, et autres
Publié: (2025)
Smoother Action Chunking Flow Policy via Prior-Corrected Orthogonal Trust-Region Guidance
par: Fang, Kai, et autres
Publié: (2026)
par: Fang, Kai, et autres
Publié: (2026)
SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics
par: Shukor, Mustafa, et autres
Publié: (2025)
par: Shukor, Mustafa, et autres
Publié: (2025)
ProgVLA: Progress-Aware Robot Manipulation Skill Learning
par: Kim, Seungsu, et autres
Publié: (2026)
par: Kim, Seungsu, et autres
Publié: (2026)
$π^{*}_{0.6}$: a VLA That Learns From Experience
par: Intelligence, Physical, et autres
Publié: (2025)
par: Intelligence, Physical, et autres
Publié: (2025)
Bi-VLA: Bilateral Control-Based Imitation Learning via Vision-Language Fusion for Action Generation
par: Kobayashi, Masato, et autres
Publié: (2025)
par: Kobayashi, Masato, et autres
Publié: (2025)
From Prior to Pro: Efficient Skill Mastery via Distribution Contractive RL Finetuning
par: Sun, Zhanyi, et autres
Publié: (2026)
par: Sun, Zhanyi, et autres
Publié: (2026)
Dual-Granularity Contrastive Reward via Generated Episodic Guidance for Efficient Embodied RL
par: Liu, Xin, et autres
Publié: (2026)
par: Liu, Xin, et autres
Publié: (2026)
Bidirectional Decoding: Improving Action Chunking via Guided Test-Time Sampling
par: Liu, Yuejiang, et autres
Publié: (2024)
par: Liu, Yuejiang, et autres
Publié: (2024)
SoftMimic: Learning Compliant Whole-body Control from Examples
par: Margolis, Gabriel B., et autres
Publié: (2025)
par: Margolis, Gabriel B., et autres
Publié: (2025)
ACSAC: Adaptive Chunk Size Actor-Critic with Causal Transformer Q-Network
par: Chen, Qian, et autres
Publié: (2026)
par: Chen, Qian, et autres
Publié: (2026)
TwinVLA: Data-Efficient Bimanual Manipulation with Twin Single-Arm Vision-Language-Action Models
par: Im, Hokyun, et autres
Publié: (2025)
par: Im, Hokyun, et autres
Publié: (2025)
Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models
par: Jin, Ruofan, et autres
Publié: (2026)
par: Jin, Ruofan, et autres
Publié: (2026)
FLoRA: Sample-Efficient Preference-based RL via Low-Rank Style Adaptation of Reward Functions
par: Marta, Daniel, et autres
Publié: (2025)
par: Marta, Daniel, et autres
Publié: (2025)
Instructing Robots by Sketching: Learning from Demonstration via Probabilistic Diagrammatic Teaching
par: Zhi, Weiming, et autres
Publié: (2023)
par: Zhi, Weiming, et autres
Publié: (2023)
CRL-VLA: Continual Vision-Language-Action Learning
par: Zeng, Qixin, et autres
Publié: (2026)
par: Zeng, Qixin, et autres
Publié: (2026)
Understanding Multimodal Failure in Action-Chunking Behavioral Cloning
par: Mazza, Lorenzo, et autres
Publié: (2026)
par: Mazza, Lorenzo, et autres
Publié: (2026)
Real-Time Execution of Action Chunking Flow Policies
par: Black, Kevin, et autres
Publié: (2025)
par: Black, Kevin, et autres
Publié: (2025)
Anticipation-VLA: Solving Long-Horizon Embodied Tasks via Anticipation-based Subgoal Generation
par: Zhang, Zhilong, et autres
Publié: (2026)
par: Zhang, Zhilong, et autres
Publié: (2026)
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
Documents similaires
-
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
par: Li, Haozhan, et autres
Publié: (2025) -
Automatic Environment Shaping is the Next Frontier in RL
par: Park, Younghyo, et autres
Publié: (2024) -
From Imitation to Refinement -- Residual RL for Precise Assembly
par: Ankile, Lars, et autres
Publié: (2024) -
JUICER: Data-Efficient Imitation Learning for Robotic Assembly
par: Ankile, Lars, et autres
Publié: (2024) -
Refined Policy Distillation: From VLA Generalists to RL Experts
par: Jülg, Tobias, et autres
Publié: (2025)