MMaDA-VLA: Large Diffusion Vision-Language-Action Model with Unified Multi-Modal Instruction and Generation

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Liu, Yang, Ding, Pengxiang, Jiang, Tengyue, Wang, Xudong, Song, Wenxuan, Lin, Minghui, Zhao, Han, Zhang, Hongyin, Zhuang, Zifeng, Zhao, Wei, Huang, Siteng, Shi, Jinkui, Wang, Donglin
Format: Preprint
Published: 2026
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!