Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Wang, Qiuyue, Li, Mingsheng, Guan, Jian, Ye, Jinhui, Xie, Sicheng, Liu, Yitao, Chen, Junhao, Liang, Zhixuan, Zhang, Jie, Hu, Xintong, Huang, Xuhong, Lin, Pei, Lin, Junyang, Liu, Dayiheng, Bai, Shuai, Zhou, Jingren, Zhang, Jiazhao, Yuan, Haoqi, Zhou, Gengze, Yin, Hang, Wang, Ye, Huang, Yiyang, Lei, Zixing, Peng, Wujian, Chen, Delin, Zheng, Yingming, Fan, Jingyang, Zhuang, Xianwei, Zhou, Xin, Li, Haoyang, Chen, Anzhe, Zhang, Tong, Liu, Xuejing, Sun, Yuchong, Chen, Ruizhe, Li, Zhaohai, Lü, Chenxu, Yang, Zhibo, Yu, Tao, Chen, Xionghui
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares