OAT: Ordered Action Tokenization
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Chaoqi, Han, Xiaoshen, Gao, Jiawei, Zhao, Yue, Chen, Haonan, Du, Yilun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multi-Modal Manipulation via Multi-Modal Policy Consensus
por: Chen, Haonan, et al.
Publicado: (2025)
por: Chen, Haonan, et al.
Publicado: (2025)
Localized Graph-Based Neural Dynamics Models for Terrain Manipulation
por: Liu, Chaoqi, et al.
Publicado: (2025)
por: Liu, Chaoqi, et al.
Publicado: (2025)
Grounding Video Models to Actions through Goal Conditioned Exploration
por: Luo, Yunhao, et al.
Publicado: (2024)
por: Luo, Yunhao, et al.
Publicado: (2024)
Autoregressive Action Sequence Learning for Robotic Manipulation
por: Zhang, Xinyu, et al.
Publicado: (2024)
por: Zhang, Xinyu, et al.
Publicado: (2024)
World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry
por: Liu, Yuejiang, et al.
Publicado: (2026)
por: Liu, Yuejiang, et al.
Publicado: (2026)
Solving New Tasks by Adapting Internet Video Knowledge
por: Luo, Calvin, et al.
Publicado: (2025)
por: Luo, Calvin, et al.
Publicado: (2025)
AdaWorld: Learning Adaptable World Models with Latent Actions
por: Gao, Shenyuan, et al.
Publicado: (2025)
por: Gao, Shenyuan, et al.
Publicado: (2025)
Select before Act: Spatially Decoupled Action Repetition for Continuous Control
por: Nie, Buqing, et al.
Publicado: (2025)
por: Nie, Buqing, et al.
Publicado: (2025)
Plan First, Diffuse Later: Extrinsic Graph Guidance for Long-Horizon Diffusion Planning
por: Hassidof, Yaniv, et al.
Publicado: (2026)
por: Hassidof, Yaniv, et al.
Publicado: (2026)
Flexible Multitask Learning with Factorized Diffusion Policy
por: Liu, Chaoqi, et al.
Publicado: (2025)
por: Liu, Chaoqi, et al.
Publicado: (2025)
Generative Trajectory Stitching through Diffusion Composition
por: Luo, Yunhao, et al.
Publicado: (2025)
por: Luo, Yunhao, et al.
Publicado: (2025)
CRL-VLA: Continual Vision-Language-Action Learning
por: Zeng, Qixin, et al.
Publicado: (2026)
por: Zeng, Qixin, et al.
Publicado: (2026)
villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models
por: Chen, Xiaoyu, et al.
Publicado: (2025)
por: Chen, Xiaoyu, et al.
Publicado: (2025)
Deconfounded Lifelong Learning for Autonomous Driving via Dynamic Knowledge Spaces
por: Du, Jiayuan, et al.
Publicado: (2026)
por: Du, Jiayuan, et al.
Publicado: (2026)
Extremum-Seeking Action Selection for Accelerating Policy Optimization
por: Chang, Ya-Chien, et al.
Publicado: (2024)
por: Chang, Ya-Chien, et al.
Publicado: (2024)
Bidirectional Decoding: Improving Action Chunking via Guided Test-Time Sampling
por: Liu, Yuejiang, et al.
Publicado: (2024)
por: Liu, Yuejiang, et al.
Publicado: (2024)
Compositional Generative Modeling: A Single Model is Not All You Need
por: Du, Yilun, et al.
Publicado: (2024)
por: Du, Yilun, et al.
Publicado: (2024)
Tool-as-Interface: Learning Robot Policies from Observing Human Tool Use
por: Chen, Haonan, et al.
Publicado: (2025)
por: Chen, Haonan, et al.
Publicado: (2025)
Few-Shot Task Learning through Inverse Generative Modeling
por: Netanyahu, Aviv, et al.
Publicado: (2024)
por: Netanyahu, Aviv, et al.
Publicado: (2024)
Hybrid Diffusion for Simultaneous Symbolic and Continuous Planning
por: Høeg, Sigmund Hennum, et al.
Publicado: (2025)
por: Høeg, Sigmund Hennum, et al.
Publicado: (2025)
AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models
por: Jiang, Yuhua, et al.
Publicado: (2025)
por: Jiang, Yuhua, et al.
Publicado: (2025)
Learning Long-Context Diffusion Policies via Past-Token Prediction
por: Torne, Marcel, et al.
Publicado: (2025)
por: Torne, Marcel, et al.
Publicado: (2025)
Equivariant Action Sampling for Reinforcement Learning and Planning
por: Zhao, Linfeng, et al.
Publicado: (2024)
por: Zhao, Linfeng, et al.
Publicado: (2024)
Pretrained Vision-Language-Action Models are Surprisingly Resistant to Forgetting in Continual Learning
por: Liu, Huihan, et al.
Publicado: (2026)
por: Liu, Huihan, et al.
Publicado: (2026)
UniVLA: Learning to Act Anywhere with Task-centric Latent Actions
por: Bu, Qingwen, et al.
Publicado: (2025)
por: Bu, Qingwen, et al.
Publicado: (2025)
TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics
por: Chen, Shirui, et al.
Publicado: (2026)
por: Chen, Shirui, et al.
Publicado: (2026)
Dual Action Policy for Robust Sim-to-Real Reinforcement Learning
por: Terence, Ng Wen Zheng, et al.
Publicado: (2024)
por: Terence, Ng Wen Zheng, et al.
Publicado: (2024)
Subwords as Skills: Tokenization for Sparse-Reward Reinforcement Learning
por: Yunis, David, et al.
Publicado: (2023)
por: Yunis, David, et al.
Publicado: (2023)
Behavior Generation with Latent Actions
por: Lee, Seungjae, et al.
Publicado: (2024)
por: Lee, Seungjae, et al.
Publicado: (2024)
Reinforcement Learning with Action Chunking
por: Li, Qiyang, et al.
Publicado: (2025)
por: Li, Qiyang, et al.
Publicado: (2025)
Learning Human-Like RL Agents Through Trajectory Optimization With Action Quantization
por: Guo, Jian-Ting, et al.
Publicado: (2025)
por: Guo, Jian-Ting, et al.
Publicado: (2025)
Efficient Multi-Task Reinforcement Learning via Task-Specific Action Correction
por: Feng, Jinyuan, et al.
Publicado: (2024)
por: Feng, Jinyuan, et al.
Publicado: (2024)
ExACT: An End-to-End Autonomous Excavator System Using Action Chunking With Transformers
por: Chen, Liangliang, et al.
Publicado: (2024)
por: Chen, Liangliang, et al.
Publicado: (2024)
Continuous Reasoning for Vision-Language-Action
por: Wu, Yueh-Hua, et al.
Publicado: (2026)
por: Wu, Yueh-Hua, et al.
Publicado: (2026)
Unsupervised Learning of Effective Actions in Robotics
por: Zaric, Marko, et al.
Publicado: (2024)
por: Zaric, Marko, et al.
Publicado: (2024)
DeeR-VLA: Dynamic Inference of Multimodal Large Language Models for Efficient Robot Execution
por: Yue, Yang, et al.
Publicado: (2024)
por: Yue, Yang, et al.
Publicado: (2024)
DeepThinkVLA: Enhancing Reasoning Capability of Vision-Language-Action Models
por: Yin, Cheng, et al.
Publicado: (2025)
por: Yin, Cheng, et al.
Publicado: (2025)
Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail
por: NVIDIA, et al.
Publicado: (2025)
por: NVIDIA, et al.
Publicado: (2025)
RoboAct-CLIP: Video-Driven Pre-training of Atomic Action Understanding for Robotics
por: Zhang, Zhiyuan, et al.
Publicado: (2025)
por: Zhang, Zhiyuan, et al.
Publicado: (2025)
Do What You Say: Steering Vision-Language-Action Models via Runtime Reasoning-Action Alignment Verification
por: Wu, Yilin, et al.
Publicado: (2025)
por: Wu, Yilin, et al.
Publicado: (2025)
Ejemplares similares
-
Multi-Modal Manipulation via Multi-Modal Policy Consensus
por: Chen, Haonan, et al.
Publicado: (2025) -
Localized Graph-Based Neural Dynamics Models for Terrain Manipulation
por: Liu, Chaoqi, et al.
Publicado: (2025) -
Grounding Video Models to Actions through Goal Conditioned Exploration
por: Luo, Yunhao, et al.
Publicado: (2024) -
Autoregressive Action Sequence Learning for Robotic Manipulation
por: Zhang, Xinyu, et al.
Publicado: (2024) -
World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry
por: Liu, Yuejiang, et al.
Publicado: (2026)