Understanding Behavior Cloning with Action Quantization
Fuente:
arXiv
Guardado en:
| Autores principales: | Cao, Haoqun, Xie, Tengyang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Understanding Multimodal Failure in Action-Chunking Behavioral Cloning
por: Mazza, Lorenzo, et al.
Publicado: (2026)
por: Mazza, Lorenzo, et al.
Publicado: (2026)
Accelerating Convergence in Bayesian Few-Shot Classification
por: Ke, Tianjun, et al.
Publicado: (2024)
por: Ke, Tianjun, et al.
Publicado: (2024)
Score Matching for Estimating Finite Point Processes
por: Cao, Haoqun, et al.
Publicado: (2025)
por: Cao, Haoqun, et al.
Publicado: (2025)
Offline Reinforcement Learning in Large State Spaces: Algorithms and Guarantees
por: Jiang, Nan, et al.
Publicado: (2025)
por: Jiang, Nan, et al.
Publicado: (2025)
Is Score Matching Suitable for Estimating Point Processes?
por: Cao, Haoqun, et al.
Publicado: (2024)
por: Cao, Haoqun, et al.
Publicado: (2024)
Revisiting Logistic-softmax Likelihood in Bayesian Meta-Learning for Few-Shot Classification
por: Ke, Tianjun, et al.
Publicado: (2023)
por: Ke, Tianjun, et al.
Publicado: (2023)
Breaking the Capability Ceiling of LLM Post-Training by Reintroducing Markov States
por: Yuan, Yurun, et al.
Publicado: (2026)
por: Yuan, Yurun, et al.
Publicado: (2026)
Reinforce LLM Reasoning through Multi-Agent Reflection
por: Yuan, Yurun, et al.
Publicado: (2025)
por: Yuan, Yurun, et al.
Publicado: (2025)
Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning
por: Dong, Jinzong, et al.
Publicado: (2026)
por: Dong, Jinzong, et al.
Publicado: (2026)
Do We Need to Verify Step by Step? Rethinking Process Supervision from a Theoretical Perspective
por: Jia, Zeyu, et al.
Publicado: (2025)
por: Jia, Zeyu, et al.
Publicado: (2025)
Is Behavior Cloning All You Need? Understanding Horizon in Imitation Learning
por: Foster, Dylan J., et al.
Publicado: (2024)
por: Foster, Dylan J., et al.
Publicado: (2024)
Action Chunking and Exploratory Data Collection Yield Exponential Improvements in Behavior Cloning for Continuous Control
por: Zhang, Thomas T., et al.
Publicado: (2025)
por: Zhang, Thomas T., et al.
Publicado: (2025)
Diffusion Model-Augmented Behavioral Cloning
por: Chen, Shang-Fu, et al.
Publicado: (2023)
por: Chen, Shang-Fu, et al.
Publicado: (2023)
POLCA: Stochastic Generative Optimization with LLM
por: Ren, Xuanfei, et al.
Publicado: (2026)
por: Ren, Xuanfei, et al.
Publicado: (2026)
Interactive and Hybrid Imitation Learning: Provably Beating Behavior Cloning
por: Li, Yichen, et al.
Publicado: (2024)
por: Li, Yichen, et al.
Publicado: (2024)
Dataset Poisoning Attacks on Behavioral Cloning Policies
por: Kalra, Akansha, et al.
Publicado: (2025)
por: Kalra, Akansha, et al.
Publicado: (2025)
Robust Behavior Cloning Via Global Lipschitz Regularization
por: Wu, Shili, et al.
Publicado: (2025)
por: Wu, Shili, et al.
Publicado: (2025)
Pragmatic Policy Development via Interpretable Behavior Cloning
por: Matsson, Anton, et al.
Publicado: (2025)
por: Matsson, Anton, et al.
Publicado: (2025)
Self-Predictive Representations for Combinatorial Generalization in Behavioral Cloning
por: Lawson, Daniel, et al.
Publicado: (2025)
por: Lawson, Daniel, et al.
Publicado: (2025)
Residual Off-Policy RL for Finetuning Behavior Cloning Policies
por: Ankile, Lars, et al.
Publicado: (2025)
por: Ankile, Lars, et al.
Publicado: (2025)
Harnessing Density Ratios for Online Reinforcement Learning
por: Amortila, Philip, et al.
Publicado: (2024)
por: Amortila, Philip, et al.
Publicado: (2024)
Self-Play with Adversarial Critic: Provable and Scalable Offline Alignment for Language Models
por: Ji, Xiang, et al.
Publicado: (2024)
por: Ji, Xiang, et al.
Publicado: (2024)
Outcome-Based Online Reinforcement Learning: Algorithms and Fundamental Limits
por: Chen, Fan, et al.
Publicado: (2025)
por: Chen, Fan, et al.
Publicado: (2025)
Behavior Cloning of MPC for 3-DOF Robotic Manipulators
por: Guegan, Theo, et al.
Publicado: (2026)
por: Guegan, Theo, et al.
Publicado: (2026)
EBGAN-MDN: An Energy-Based Adversarial Framework for Multi-Modal Behavior Cloning
por: Li, Yixiao, et al.
Publicado: (2025)
por: Li, Yixiao, et al.
Publicado: (2025)
When Does Predictive Inverse Dynamics Outperform Behavior Cloning?
por: Schäfer, Lukas, et al.
Publicado: (2026)
por: Schäfer, Lukas, et al.
Publicado: (2026)
Improving Generative Behavior Cloning via Self-Guidance and Adaptive Chunking
por: So, Junhyuk, et al.
Publicado: (2025)
por: So, Junhyuk, et al.
Publicado: (2025)
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
por: Liu, Shirong, et al.
Publicado: (2024)
por: Liu, Shirong, et al.
Publicado: (2024)
Interpretable Preferences via Multi-Objective Reward Modeling and Mixture-of-Experts
por: Wang, Haoxiang, et al.
Publicado: (2024)
por: Wang, Haoxiang, et al.
Publicado: (2024)
Videos are Sample-Efficient Supervisions: Behavior Cloning from Videos via Latent Representations
por: Liu, Xin, et al.
Publicado: (2025)
por: Liu, Xin, et al.
Publicado: (2025)
Cross-Domain Policy Transfer by Representation Alignment via Multi-Domain Behavioral Cloning
por: Watahiki, Hayato, et al.
Publicado: (2024)
por: Watahiki, Hayato, et al.
Publicado: (2024)
Rethinking Latent Redundancy in Behavior Cloning: An Information Bottleneck Approach for Robot Manipulation
por: Bai, Shuanghao, et al.
Publicado: (2025)
por: Bai, Shuanghao, et al.
Publicado: (2025)
Fine-tuning Behavioral Cloning Policies with Preference-Based Reinforcement Learning
por: Macuglia, Maël, et al.
Publicado: (2025)
por: Macuglia, Maël, et al.
Publicado: (2025)
Quantization-Free Autoregressive Action Transformer
por: Sheebaelhamd, Ziyad, et al.
Publicado: (2025)
por: Sheebaelhamd, Ziyad, et al.
Publicado: (2025)
Posterior Behavioral Cloning: Pretraining BC Policies for Efficient RL Finetuning
por: Wagenmaker, Andrew, et al.
Publicado: (2025)
por: Wagenmaker, Andrew, et al.
Publicado: (2025)
GBC: Generalized Behavior-Cloning Framework for Whole-Body Humanoid Imitation
por: Yao, Yifei, et al.
Publicado: (2025)
por: Yao, Yifei, et al.
Publicado: (2025)
DyQ-VLA: Temporal-Dynamic-Aware Quantization for Embodied Vision-Language-Action Models
por: Zheng, Zihao, et al.
Publicado: (2026)
por: Zheng, Zihao, et al.
Publicado: (2026)
Trajectory Bellman Residual Minimization: A Simple Value-Based Method for LLM Reasoning
por: Yuan, Yurun, et al.
Publicado: (2025)
por: Yuan, Yurun, et al.
Publicado: (2025)
Density-Ratio Weighted Behavioral Cloning: Learning Control Policies from Corrupted Datasets
por: Pandian, Shriram Karpoora Sundara, et al.
Publicado: (2025)
por: Pandian, Shriram Karpoora Sundara, et al.
Publicado: (2025)
Using Implicit Behavior Cloning and Dynamic Movement Primitive to Facilitate Reinforcement Learning for Robot Motion Planning
por: Zhang, Zengjie, et al.
Publicado: (2023)
por: Zhang, Zengjie, et al.
Publicado: (2023)
Ejemplares similares
-
Understanding Multimodal Failure in Action-Chunking Behavioral Cloning
por: Mazza, Lorenzo, et al.
Publicado: (2026) -
Accelerating Convergence in Bayesian Few-Shot Classification
por: Ke, Tianjun, et al.
Publicado: (2024) -
Score Matching for Estimating Finite Point Processes
por: Cao, Haoqun, et al.
Publicado: (2025) -
Offline Reinforcement Learning in Large State Spaces: Algorithms and Guarantees
por: Jiang, Nan, et al.
Publicado: (2025) -
Is Score Matching Suitable for Estimating Point Processes?
por: Cao, Haoqun, et al.
Publicado: (2024)