Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Qiuyue, Li, Mingsheng, Guan, Jian, Ye, Jinhui, Xie, Sicheng, Liu, Yitao, Chen, Junhao, Liang, Zhixuan, Zhang, Jie, Hu, Xintong, Huang, Xuhong, Lin, Pei, Lin, Junyang, Liu, Dayiheng, Bai, Shuai, Zhou, Jingren, Zhang, Jiazhao, Yuan, Haoqi, Zhou, Gengze, Yin, Hang, Wang, Ye, Huang, Yiyang, Lei, Zixing, Peng, Wujian, Chen, Delin, Zheng, Yingming, Fan, Jingyang, Zhuang, Xianwei, Zhou, Xin, Li, Haoyang, Chen, Anzhe, Zhang, Tong, Liu, Xuejing, Sun, Yuchong, Chen, Ruizhe, Li, Zhaohai, Lü, Chenxu, Yang, Zhibo, Yu, Tao, Chen, Xionghui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking
por: Li, Mingxin, et al.
Publicado: (2026)
por: Li, Mingxin, et al.
Publicado: (2026)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
por: Zhang, Yanzhao, et al.
Publicado: (2025)
por: Zhang, Yanzhao, et al.
Publicado: (2025)
Qwen3-VL Technical Report
por: Bai, Shuai, et al.
Publicado: (2025)
por: Bai, Shuai, et al.
Publicado: (2025)
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
por: Wang, Peng, et al.
Publicado: (2024)
por: Wang, Peng, et al.
Publicado: (2024)
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
por: Yang, An, et al.
Publicado: (2024)
por: Yang, An, et al.
Publicado: (2024)
Qwen-Image Technical Report
por: Wu, Chenfei, et al.
Publicado: (2025)
por: Wu, Chenfei, et al.
Publicado: (2025)
Toward Embodiment Equivariant Vision-Language-Action Policy
por: Chen, Anzhe, et al.
Publicado: (2025)
por: Chen, Anzhe, et al.
Publicado: (2025)
Qwen2 Technical Report
por: Yang, An, et al.
Publicado: (2024)
por: Yang, An, et al.
Publicado: (2024)
Think-on-Process: Dynamic Process Generation for Collaborative Development of Multi-Agent System
por: Lin, Leilei, et al.
Publicado: (2024)
por: Lin, Leilei, et al.
Publicado: (2024)
Qwen-Image-2.0 Technical Report
por: Zhao, Bing, et al.
Publicado: (2026)
por: Zhao, Bing, et al.
Publicado: (2026)
Qwen-Image-Layered: Towards Inherent Editability via Layer Decomposition
por: Yin, Shengming, et al.
Publicado: (2025)
por: Yin, Shengming, et al.
Publicado: (2025)
Qwen2.5-VL Technical Report
por: Bai, Shuai, et al.
Publicado: (2025)
por: Bai, Shuai, et al.
Publicado: (2025)
Qwen3-Omni Technical Report
por: Xu, Jin, et al.
Publicado: (2025)
por: Xu, Jin, et al.
Publicado: (2025)
Qwen3Guard Technical Report
por: Zhao, Haiquan, et al.
Publicado: (2025)
por: Zhao, Haiquan, et al.
Publicado: (2025)
Qwen2.5-Coder Technical Report
por: Hui, Binyuan, et al.
Publicado: (2024)
por: Hui, Binyuan, et al.
Publicado: (2024)
Qwen3 Technical Report
por: Yang, An, et al.
Publicado: (2025)
por: Yang, An, et al.
Publicado: (2025)
QwenLong-L1.5: Post-Training Recipe for Long-Context Reasoning and Memory Management
por: Shen, Weizhou, et al.
Publicado: (2025)
por: Shen, Weizhou, et al.
Publicado: (2025)
Qwen2.5 Technical Report
por: Qwen, et al.
Publicado: (2024)
por: Qwen, et al.
Publicado: (2024)
ProcessBench: Identifying Process Errors in Mathematical Reasoning
por: Zheng, Chujie, et al.
Publicado: (2024)
por: Zheng, Chujie, et al.
Publicado: (2024)
The Lessons of Developing Process Reward Models in Mathematical Reasoning
por: Zhang, Zhenru, et al.
Publicado: (2025)
por: Zhang, Zhenru, et al.
Publicado: (2025)
Qwen2.5-1M Technical Report
por: Yang, An, et al.
Publicado: (2025)
por: Yang, An, et al.
Publicado: (2025)
Qwen3-ASR Technical Report
por: Shi, Xian, et al.
Publicado: (2026)
por: Shi, Xian, et al.
Publicado: (2026)
MAO: A Framework for Process Model Generation with Multi-Agent Orchestration
por: Lin, Leilei, et al.
Publicado: (2024)
por: Lin, Leilei, et al.
Publicado: (2024)
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
por: Deng, Boyi, et al.
Publicado: (2026)
por: Deng, Boyi, et al.
Publicado: (2026)
Qwen3-Coder-Next Technical Report
por: Cao, Ruisheng, et al.
Publicado: (2026)
por: Cao, Ruisheng, et al.
Publicado: (2026)
Sub‐1 nm High‐Entropy Materials for Electrochemical Applications
por: Qiuyue Chen, et al.
Publicado: (2026)
por: Qiuyue Chen, et al.
Publicado: (2026)
Qwen2-Audio Technical Report
por: Chu, Yunfei, et al.
Publicado: (2024)
por: Chu, Yunfei, et al.
Publicado: (2024)
Cross-Embodiment Dexterous Grasping with Reinforcement Learning
por: Yuan, Haoqi, et al.
Publicado: (2024)
por: Yuan, Haoqi, et al.
Publicado: (2024)
Ferromagnetic polar metals via epitaxial strain: a case study of SrCoO$_3$
por: Liu, Zhiwei, et al.
Publicado: (2024)
por: Liu, Zhiwei, et al.
Publicado: (2024)
Chain of Execution Supervision Promotes General Reasoning in Large Language Models
por: Chen, Nuo, et al.
Publicado: (2025)
por: Chen, Nuo, et al.
Publicado: (2025)
Qwen3-TTS Technical Report
por: Hu, Hangrui, et al.
Publicado: (2026)
por: Hu, Hangrui, et al.
Publicado: (2026)
G-DReaM: Graph-conditioned Diffusion Retargeting across Multiple Embodiments
por: Cao, Zhefeng, et al.
Publicado: (2025)
por: Cao, Zhefeng, et al.
Publicado: (2025)
Pediatric Chronic Monteggia Fractures: Insights From a Comprehensive Review
por: Gengze Li, et al.
Publicado: (2025)
por: Gengze Li, et al.
Publicado: (2025)
Tunable Lens Driven by Electrohydrodynamic Pumping
por: Xuejing Liu, et al.
Publicado: (2024)
por: Xuejing Liu, et al.
Publicado: (2024)
Designing Algorithms Empowered by Language Models: An Analytical Framework, Case Studies, and Insights
por: Chen, Yanxi, et al.
Publicado: (2024)
por: Chen, Yanxi, et al.
Publicado: (2024)
Qwen-Image-VAE-2.0 Technical Report
por: Zhang, Zekai, et al.
Publicado: (2026)
por: Zhang, Zekai, et al.
Publicado: (2026)
Compositional Text-to-Image Generation Via Region-aware Bimodal Direct Preference Optimization
por: Liu, Zhuohan, et al.
Publicado: (2026)
por: Liu, Zhuohan, et al.
Publicado: (2026)
FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies
por: Hu, Xintong, et al.
Publicado: (2026)
por: Hu, Xintong, et al.
Publicado: (2026)
QwenStyle: Content-Preserving Style Transfer with Qwen-Image-Edit
por: Zhang, Shiwen, et al.
Publicado: (2026)
por: Zhang, Shiwen, et al.
Publicado: (2026)
Modular Layout Synthesis (MLS): Front-end Code via Structure Normalization and Constrained Generation
por: Liu, Chong, et al.
Publicado: (2025)
por: Liu, Chong, et al.
Publicado: (2025)
Ejemplares similares
-
Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking
por: Li, Mingxin, et al.
Publicado: (2026) -
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
por: Zhang, Yanzhao, et al.
Publicado: (2025) -
Qwen3-VL Technical Report
por: Bai, Shuai, et al.
Publicado: (2025) -
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
por: Wang, Peng, et al.
Publicado: (2024) -
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
por: Yang, An, et al.
Publicado: (2024)