Qwen3-VL Technical Report
Fuente:
arXiv
Saved in:
| Main Authors: | Bai, Shuai, Cai, Yuxuan, Chen, Ruizhe, Chen, Keqin, Chen, Xionghui, Cheng, Zesen, Deng, Lianghao, Ding, Wei, Gao, Chang, Ge, Chunjiang, Ge, Wenbin, Guo, Zhifang, Huang, Qidong, Huang, Jie, Huang, Fei, Hui, Binyuan, Jiang, Shutong, Li, Zhaohai, Li, Mingsheng, Li, Mei, Li, Kaixin, Lin, Zicheng, Lin, Junyang, Liu, Xuejing, Liu, Jiawei, Liu, Chenglong, Liu, Yang, Liu, Dayiheng, Liu, Shixuan, Lu, Dunjie, Luo, Ruilin, Lv, Chenxu, Men, Rui, Meng, Lingchen, Ren, Xuancheng, Ren, Xingzhang, Song, Sibo, Sun, Yuchong, Tang, Jun, Tu, Jianhong, Wan, Jianqiang, Wang, Peng, Wang, Pengfei, Wang, Qiuyue, Wang, Yuxuan, Xie, Tianbao, Xu, Yiheng, Xu, Haiyang, Xu, Jin, Yang, Zhibo, Yang, Mingkun, Yang, Jianxin, Yang, An, Yu, Bowen, Zhang, Fei, Zhang, Hang, Zhang, Xi, Zheng, Bo, Zhong, Humen, Zhou, Jingren, Zhou, Fan, Zhou, Jing, Zhu, Yuanzhi, Zhu, Ke |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Qwen2.5-Coder Technical Report
by: Hui, Binyuan, et al.
Published: (2024)
by: Hui, Binyuan, et al.
Published: (2024)
Qwen3 Technical Report
by: Yang, An, et al.
Published: (2025)
by: Yang, An, et al.
Published: (2025)
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
by: Deng, Boyi, et al.
Published: (2026)
by: Deng, Boyi, et al.
Published: (2026)
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
by: Yang, An, et al.
Published: (2024)
by: Yang, An, et al.
Published: (2024)
Qwen2 Technical Report
by: Yang, An, et al.
Published: (2024)
by: Yang, An, et al.
Published: (2024)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
by: Zhang, Yanzhao, et al.
Published: (2025)
by: Zhang, Yanzhao, et al.
Published: (2025)
Qwen2.5 Technical Report
by: Qwen, et al.
Published: (2024)
by: Qwen, et al.
Published: (2024)
Qwen2.5-VL Technical Report
by: Bai, Shuai, et al.
Published: (2025)
by: Bai, Shuai, et al.
Published: (2025)
Platypus: A Generalized Specialist Model for Reading Text in Various Forms
by: Wang, Peng, et al.
Published: (2024)
by: Wang, Peng, et al.
Published: (2024)
Qwen2.5-1M Technical Report
by: Yang, An, et al.
Published: (2025)
by: Yang, An, et al.
Published: (2025)
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
by: Wang, Peng, et al.
Published: (2024)
by: Wang, Peng, et al.
Published: (2024)
Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking
by: Li, Mingxin, et al.
Published: (2026)
by: Li, Mingxin, et al.
Published: (2026)
Qwen3-Omni Technical Report
by: Xu, Jin, et al.
Published: (2025)
by: Xu, Jin, et al.
Published: (2025)
The Missing Piece in Pre-trained Model Evaluation: Reward-Guided Decoding Unlocks Task-Oriented Behavior Without Parameter Updates
by: Wang, Shaobo, et al.
Published: (2026)
by: Wang, Shaobo, et al.
Published: (2026)
Reasoning Like an Economist: Post-Training on Economic Problems Induces Strategic Generalization in LLMs
by: Zhou, Yufa, et al.
Published: (2025)
by: Zhou, Yufa, et al.
Published: (2025)
An Empirical Study of Parameter Efficient Fine-tuning on Vision-Language Pre-train Model
by: Tian, Yuxin, et al.
Published: (2024)
by: Tian, Yuxin, et al.
Published: (2024)
Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
by: Wang, Qiuyue, et al.
Published: (2026)
by: Wang, Qiuyue, et al.
Published: (2026)
OPUS: Towards Efficient and Principled Data Selection in Large Language Model Pre-training in Every Iteration
by: Wang, Shaobo, et al.
Published: (2026)
by: Wang, Shaobo, et al.
Published: (2026)
Qwen-Image Technical Report
by: Wu, Chenfei, et al.
Published: (2025)
by: Wu, Chenfei, et al.
Published: (2025)
Qwen3Guard Technical Report
by: Zhao, Haiquan, et al.
Published: (2025)
by: Zhao, Haiquan, et al.
Published: (2025)
QwenLong-L1.5: Post-Training Recipe for Long-Context Reasoning and Memory Management
by: Shen, Weizhou, et al.
Published: (2025)
by: Shen, Weizhou, et al.
Published: (2025)
OccuBench: Evaluating AI Agents on Real-World Professional Tasks via Language Environment Simulation
by: Hu, Xiaomeng, et al.
Published: (2026)
by: Hu, Xiaomeng, et al.
Published: (2026)
Winning the Pruning Gamble: A Unified Approach to Joint Sample and Token Pruning for Efficient Supervised Fine-Tuning
by: Wang, Shaobo, et al.
Published: (2025)
by: Wang, Shaobo, et al.
Published: (2025)
Morphotropic Phase Boundary in Graft Poly(Vinylidene Fluoride‐ co ‐Tetrafluoroethylene) With High Curie Temperature
by: Zekai Fei, et al.
Published: (2026)
by: Zekai Fei, et al.
Published: (2026)
WorldPM: Scaling Human Preference Modeling
by: Wang, Binghai, et al.
Published: (2025)
by: Wang, Binghai, et al.
Published: (2025)
Evaluating Uplift Modeling under Structural Biases: Insights into Metric Stability and Model Robustness
by: Yang, Yuxuan, et al.
Published: (2026)
by: Yang, Yuxuan, et al.
Published: (2026)
Rethinking LLM Evaluation: Can We Evaluate LLMs with 200x Less Data?
by: Wang, Shaobo, et al.
Published: (2025)
by: Wang, Shaobo, et al.
Published: (2025)
XNet v2: Fewer Limitations, Better Results and Greater Universality
by: Zhou, Yanfeng, et al.
Published: (2024)
by: Zhou, Yanfeng, et al.
Published: (2024)
MEDIC: Zero-shot Music Editing with Disentangled Inversion Control
by: Liu, Huadai, et al.
Published: (2024)
by: Liu, Huadai, et al.
Published: (2024)
Co-GRPO: Co-Optimized Group Relative Policy Optimization for Masked Diffusion Model
by: Zhou, Renping, et al.
Published: (2025)
by: Zhou, Renping, et al.
Published: (2025)
VL-Reader: Vision and Language Reconstructor is an Effective Scene Text Recognizer
by: Zhong, Humen, et al.
Published: (2024)
by: Zhong, Humen, et al.
Published: (2024)
engGNN: A Dual-Graph Neural Network for Omics-Based Disease Classification and Feature Selection
by: Yang, Tiantian, et al.
Published: (2026)
by: Yang, Tiantian, et al.
Published: (2026)
On the Role of Attention Heads in Large Language Model Safety
by: Zhou, Zhenhong, et al.
Published: (2024)
by: Zhou, Zhenhong, et al.
Published: (2024)
A Fiber‐Optic Surface‐Enhanced Raman Scattering (SERS) Probe for Sensitive Endotoxin Detection with Reduced Limulus Amebocyte Lysate (LAL) Consumption
by: Zesen Li, et al.
Published: (2026)
by: Zesen Li, et al.
Published: (2026)
Comparative Study of Large Language Models on Chinese Film Script Continuation: An Empirical Analysis Based on GPT-5.2 and Qwen-Max
by: Cao, Yuxuan, et al.
Published: (2026)
by: Cao, Yuxuan, et al.
Published: (2026)
Iterative Forward Tuning Boosts In-Context Learning in Language Models
by: Yang, Jiaxi, et al.
Published: (2023)
by: Yang, Jiaxi, et al.
Published: (2023)
Qwen-Image-2.0 Technical Report
by: Zhao, Bing, et al.
Published: (2026)
by: Zhao, Bing, et al.
Published: (2026)
One-Shot Learning as Instruction Data Prospector for Large Language Models
by: Li, Yunshui, et al.
Published: (2023)
by: Li, Yunshui, et al.
Published: (2023)
“Back‐to‐Back” Radial Layered Skeleton Converging Heat Flow to Assist in Thermal Conduction of Aramid Nanofibers/Graphene Phase Change Composite Materials
by: Jun Tong, et al.
Published: (2024)
by: Jun Tong, et al.
Published: (2024)
Cross-modal Ship Re-Identification via Optical and SAR Imagery: A Novel Dataset and Method
by: Wang, Han, et al.
Published: (2025)
by: Wang, Han, et al.
Published: (2025)
Similar Items
-
Qwen2.5-Coder Technical Report
by: Hui, Binyuan, et al.
Published: (2024) -
Qwen3 Technical Report
by: Yang, An, et al.
Published: (2025) -
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
by: Deng, Boyi, et al.
Published: (2026) -
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
by: Yang, An, et al.
Published: (2024) -
Qwen2 Technical Report
by: Yang, An, et al.
Published: (2024)