SEAR: Sample Efficient Action Chunking Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nagy, C. F. Maximilian, Celik, Onur, Gospodinov, Emiliyan, Seligmann, Florian, Liao, Weiran, Kaushik, Aryan, Neumann, Gerhard |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Adaptive World Models: Learning Behaviors by Latent Imagination Under Non-Stationarity
par: Gospodinov, Emiliyan, et autres
Publié: (2024)
par: Gospodinov, Emiliyan, et autres
Publié: (2024)
Chunking the Critic: A Transformer-based Soft Actor-Critic with N-Step Returns
par: Tian, Dong, et autres
Publié: (2025)
par: Tian, Dong, et autres
Publié: (2025)
Acquiring Diverse Skills using Curriculum Reinforcement Learning with Mixture of Experts
par: Celik, Onur, et autres
Publié: (2024)
par: Celik, Onur, et autres
Publié: (2024)
PointMapPolicy: Structured Point Cloud Processing for Multi-Modal Imitation Learning
par: Jia, Xiaogang, et autres
Publié: (2025)
par: Jia, Xiaogang, et autres
Publié: (2025)
Reinforcement Learning with Action Chunking
par: Li, Qiyang, et autres
Publié: (2025)
par: Li, Qiyang, et autres
Publié: (2025)
DIME:Diffusion-Based Maximum Entropy Reinforcement Learning
par: Celik, Onur, et autres
Publié: (2025)
par: Celik, Onur, et autres
Publié: (2025)
Bidirectional Decoding: Improving Action Chunking via Guided Test-Time Sampling
par: Liu, Yuejiang, et autres
Publié: (2024)
par: Liu, Yuejiang, et autres
Publié: (2024)
Efficient Off-Policy Learning for High-Dimensional Action Spaces
par: Otto, Fabian, et autres
Publié: (2024)
par: Otto, Fabian, et autres
Publié: (2024)
CO-RFT: Efficient Fine-Tuning of Vision-Language-Action Models through Chunked Offline Reinforcement Learning
par: Huang, Dongchi, et autres
Publié: (2025)
par: Huang, Dongchi, et autres
Publié: (2025)
MuTT: A Multimodal Trajectory Transformer for Robot Skills
par: Kienle, Claudius, et autres
Publié: (2024)
par: Kienle, Claudius, et autres
Publié: (2024)
Variational Distillation of Diffusion Policies into Mixture of Experts
par: Zhou, Hongyi, et autres
Publié: (2024)
par: Zhou, Hongyi, et autres
Publié: (2024)
SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows
par: Yang, Chenyu, et autres
Publié: (2026)
par: Yang, Chenyu, et autres
Publié: (2026)
Adaptive Action Chunking via Multi-Chunk Q Value Estimation
par: Shin, Yongjae, et autres
Publié: (2026)
par: Shin, Yongjae, et autres
Publié: (2026)
MaIL: Improving Imitation Learning with Mamba
par: Jia, Xiaogang, et autres
Publié: (2024)
par: Jia, Xiaogang, et autres
Publié: (2024)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
par: Gireesh, Nandiraju, et autres
Publié: (2026)
par: Gireesh, Nandiraju, et autres
Publié: (2026)
Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behavioral Uncertainty
par: Aryan, Prakash, et autres
Publié: (2026)
par: Aryan, Prakash, et autres
Publié: (2026)
Optimizing ZX-Diagrams with Deep Reinforcement Learning
par: Nägele, Maximilian, et autres
Publié: (2023)
par: Nägele, Maximilian, et autres
Publié: (2023)
Integrating Human Knowledge Through Action Masking in Reinforcement Learning for Operations Research
par: Stappert, Mirko, et autres
Publié: (2025)
par: Stappert, Mirko, et autres
Publié: (2025)
Sample-Efficient Bayesian Optimization with Transfer Learning for Heterogeneous Search Spaces
par: Deshwal, Aryan, et autres
Publié: (2024)
par: Deshwal, Aryan, et autres
Publié: (2024)
PointPatchRL -- Masked Reconstruction Improves Reinforcement Learning on Point Clouds
par: Gyenes, Balázs, et autres
Publié: (2024)
par: Gyenes, Balázs, et autres
Publié: (2024)
Underdamped Diffusion Bridges with Applications to Sampling
par: Blessing, Denis, et autres
Publié: (2025)
par: Blessing, Denis, et autres
Publié: (2025)
Equivariant Action Sampling for Reinforcement Learning and Planning
par: Zhao, Linfeng, et autres
Publié: (2024)
par: Zhao, Linfeng, et autres
Publié: (2024)
TROLL: Trust Regions improve Reinforcement Learning for Large Language Models
par: Becker, Philipp, et autres
Publié: (2025)
par: Becker, Philipp, et autres
Publié: (2025)
Scalable Offline Model-Based RL with Action Chunks
par: Park, Kwanyoung, et autres
Publié: (2025)
par: Park, Kwanyoung, et autres
Publié: (2025)
BEAST: Efficient Tokenization of B-Splines Encoded Action Sequences for Imitation Learning
par: Zhou, Hongyi, et autres
Publié: (2025)
par: Zhou, Hongyi, et autres
Publié: (2025)
A Risk-Aware Reinforcement Learning Reward for Financial Trading
par: Srivastava, Uditansh, et autres
Publié: (2025)
par: Srivastava, Uditansh, et autres
Publié: (2025)
Understanding Multimodal Failure in Action-Chunking Behavioral Cloning
par: Mazza, Lorenzo, et autres
Publié: (2026)
par: Mazza, Lorenzo, et autres
Publié: (2026)
Real-Time Execution of Action Chunking Flow Policies
par: Black, Kevin, et autres
Publié: (2025)
par: Black, Kevin, et autres
Publié: (2025)
Reinforcement Learning-based Knowledge Distillation with LLM-as-a-Judge
par: Shen, Yiyang, et autres
Publié: (2026)
par: Shen, Yiyang, et autres
Publié: (2026)
MoRe-ERL: Learning Motion Residuals using Episodic Reinforcement Learning
par: Huang, Xi, et autres
Publié: (2025)
par: Huang, Xi, et autres
Publié: (2025)
KalMamba: Towards Efficient Probabilistic State Space Models for RL under Uncertainty
par: Becker, Philipp, et autres
Publié: (2024)
par: Becker, Philipp, et autres
Publié: (2024)
Solving the Paint Shop Problem with Flexible Management of Multi-Lane Buffers Using Reinforcement Learning and Action Masking
par: Stappert, Mirko, et autres
Publié: (2025)
par: Stappert, Mirko, et autres
Publié: (2025)
Sample Efficient Reinforcement Learning by Automatically Learning to Compose Subtasks
par: Han, Shuai, et autres
Publié: (2024)
par: Han, Shuai, et autres
Publié: (2024)
Chunk-Guided Q-Learning
par: Song, Gwanwoo, et autres
Publié: (2026)
par: Song, Gwanwoo, et autres
Publié: (2026)
Coreset-Based Task Selection for Sample-Efficient Meta-Reinforcement Learning
par: Zhan, Donglin, et autres
Publié: (2025)
par: Zhan, Donglin, et autres
Publié: (2025)
TOP-ERL: Transformer-based Off-Policy Episodic Reinforcement Learning
par: Li, Ge, et autres
Publié: (2024)
par: Li, Ge, et autres
Publié: (2024)
PNAct: Crafting Backdoor Attacks in Safe Reinforcement Learning
par: Guo, Weiran, et autres
Publié: (2025)
par: Guo, Weiran, et autres
Publié: (2025)
From Generative to Episodic: Sample-Efficient Replicable Reinforcement Learning
par: Hopkins, Max, et autres
Publié: (2025)
par: Hopkins, Max, et autres
Publié: (2025)
Provably Sample-Efficient Robust Reinforcement Learning with Average Reward
par: Roch, Zachary, et autres
Publié: (2025)
par: Roch, Zachary, et autres
Publié: (2025)
AutoChunk: Automated Activation Chunk for Memory-Efficient Long Sequence Inference
par: Zhao, Xuanlei, et autres
Publié: (2024)
par: Zhao, Xuanlei, et autres
Publié: (2024)
Documents similaires
-
Adaptive World Models: Learning Behaviors by Latent Imagination Under Non-Stationarity
par: Gospodinov, Emiliyan, et autres
Publié: (2024) -
Chunking the Critic: A Transformer-based Soft Actor-Critic with N-Step Returns
par: Tian, Dong, et autres
Publié: (2025) -
Acquiring Diverse Skills using Curriculum Reinforcement Learning with Mixture of Experts
par: Celik, Onur, et autres
Publié: (2024) -
PointMapPolicy: Structured Point Cloud Processing for Multi-Modal Imitation Learning
par: Jia, Xiaogang, et autres
Publié: (2025) -
Reinforcement Learning with Action Chunking
par: Li, Qiyang, et autres
Publié: (2025)