Qwen3 Technical Report
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, An, Li, Anfeng, Yang, Baosong, Zhang, Beichen, Hui, Binyuan, Zheng, Bo, Yu, Bowen, Gao, Chang, Huang, Chengen, Lv, Chenxu, Zheng, Chujie, Liu, Dayiheng, Zhou, Fan, Huang, Fei, Hu, Feng, Ge, Hao, Wei, Haoran, Lin, Huan, Tang, Jialong, Yang, Jian, Tu, Jianhong, Zhang, Jianwei, Yang, Jianxin, Yang, Jiaxi, Zhou, Jing, Zhou, Jingren, Lin, Junyang, Dang, Kai, Bao, Keqin, Yang, Kexin, Yu, Le, Deng, Lianghao, Li, Mei, Xue, Mingfeng, Li, Mingze, Zhang, Pei, Wang, Peng, Zhu, Qin, Men, Rui, Gao, Ruize, Liu, Shixuan, Luo, Shuang, Li, Tianhao, Tang, Tianyi, Yin, Wenbiao, Ren, Xingzhang, Wang, Xinyu, Zhang, Xinyu, Ren, Xuancheng, Fan, Yang, Su, Yang, Zhang, Yichang, Zhang, Yinger, Wan, Yu, Liu, Yuqiong, Wang, Zekun, Cui, Zeyu, Zhang, Zhenru, Zhou, Zhipeng, Qiu, Zihan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Qwen2.5 Technical Report
por: Qwen, et al.
Publicado: (2024)
por: Qwen, et al.
Publicado: (2024)
Qwen2.5-Coder Technical Report
por: Hui, Binyuan, et al.
Publicado: (2024)
por: Hui, Binyuan, et al.
Publicado: (2024)
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
por: Yang, An, et al.
Publicado: (2024)
por: Yang, An, et al.
Publicado: (2024)
Qwen2 Technical Report
por: Yang, An, et al.
Publicado: (2024)
por: Yang, An, et al.
Publicado: (2024)
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
por: Deng, Boyi, et al.
Publicado: (2026)
por: Deng, Boyi, et al.
Publicado: (2026)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
por: Zhang, Yanzhao, et al.
Publicado: (2025)
por: Zhang, Yanzhao, et al.
Publicado: (2025)
WorldPM: Scaling Human Preference Modeling
por: Wang, Binghai, et al.
Publicado: (2025)
por: Wang, Binghai, et al.
Publicado: (2025)
Qwen3-Omni Technical Report
por: Xu, Jin, et al.
Publicado: (2025)
por: Xu, Jin, et al.
Publicado: (2025)
Qwen3-ASR Technical Report
por: Shi, Xian, et al.
Publicado: (2026)
por: Shi, Xian, et al.
Publicado: (2026)
START: Self-taught Reasoner with Tools
por: Li, Chengpeng, et al.
Publicado: (2025)
por: Li, Chengpeng, et al.
Publicado: (2025)
Qwen3Guard Technical Report
por: Zhao, Haiquan, et al.
Publicado: (2025)
por: Zhao, Haiquan, et al.
Publicado: (2025)
Qwen3-VL Technical Report
por: Bai, Shuai, et al.
Publicado: (2025)
por: Bai, Shuai, et al.
Publicado: (2025)
CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings
por: Quan, Shanghaoran, et al.
Publicado: (2025)
por: Quan, Shanghaoran, et al.
Publicado: (2025)
ProcessBench: Identifying Process Errors in Mathematical Reasoning
por: Zheng, Chujie, et al.
Publicado: (2024)
por: Zheng, Chujie, et al.
Publicado: (2024)
The Lessons of Developing Process Reward Models in Mathematical Reasoning
por: Zhang, Zhenru, et al.
Publicado: (2025)
por: Zhang, Zhenru, et al.
Publicado: (2025)
Qwen2.5-1M Technical Report
por: Yang, An, et al.
Publicado: (2025)
por: Yang, An, et al.
Publicado: (2025)
Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking
por: Li, Mingxin, et al.
Publicado: (2026)
por: Li, Mingxin, et al.
Publicado: (2026)
CultureSynth: A Hierarchical Taxonomy-Guided and Retrieval-Augmented Framework for Cultural Question-Answer Synthesis
por: Zhang, Xinyu, et al.
Publicado: (2025)
por: Zhang, Xinyu, et al.
Publicado: (2025)
Towards Cross-lingual Values Judgment: A Consensus-Pluralism Perspective
por: Chen, Yukun, et al.
Publicado: (2026)
por: Chen, Yukun, et al.
Publicado: (2026)
Revealing Behavioral Plasticity in Large Language Models: A Token-Conditional Perspective
por: Mao, Liyuan, et al.
Publicado: (2026)
por: Mao, Liyuan, et al.
Publicado: (2026)
Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning
por: Wang, Shenzhi, et al.
Publicado: (2025)
por: Wang, Shenzhi, et al.
Publicado: (2025)
Qwen3-TTS Technical Report
por: Hu, Hangrui, et al.
Publicado: (2026)
por: Hu, Hangrui, et al.
Publicado: (2026)
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
por: Wang, Peng, et al.
Publicado: (2024)
por: Wang, Peng, et al.
Publicado: (2024)
Reasoning Like an Economist: Post-Training on Economic Problems Induces Strategic Generalization in LLMs
por: Zhou, Yufa, et al.
Publicado: (2025)
por: Zhou, Yufa, et al.
Publicado: (2025)
Real-Time Glottis Detection Framework via Spatial-decoupled Feature Learning for Nasal Transnasal Intubation
por: Liu, Jinyu, et al.
Publicado: (2026)
por: Liu, Jinyu, et al.
Publicado: (2026)
Responses of Soil Extracellular Enzymes to N and P Additions Vary Between Temperate and Subtropical Forests
por: Siqin Zhang, et al.
Publicado: (2025)
por: Siqin Zhang, et al.
Publicado: (2025)
Blade‐Coated Scintillation Films with High Spatial Resolution Enabled through Solvent Engineering
por: Xiaoya Ding, et al.
Publicado: (2026)
por: Xiaoya Ding, et al.
Publicado: (2026)
Combinatorial Optimization with Automated Graph Neural Networks
por: Liu, Yang, et al.
Publicado: (2024)
por: Liu, Yang, et al.
Publicado: (2024)
Application of Vision-Language Model to Pedestrians Behavior and Scene Understanding in Autonomous Driving
por: Gao, Haoxiang, et al.
Publicado: (2025)
por: Gao, Haoxiang, et al.
Publicado: (2025)
An Empirical Study of Parameter Efficient Fine-tuning on Vision-Language Pre-train Model
por: Tian, Yuxin, et al.
Publicado: (2024)
por: Tian, Yuxin, et al.
Publicado: (2024)
The Missing Piece in Pre-trained Model Evaluation: Reward-Guided Decoding Unlocks Task-Oriented Behavior Without Parameter Updates
por: Wang, Shaobo, et al.
Publicado: (2026)
por: Wang, Shaobo, et al.
Publicado: (2026)
The singular anisotropic Adams' type inequality in $\mathbb{R}^n$
por: Zhang, Tao, et al.
Publicado: (2025)
por: Zhang, Tao, et al.
Publicado: (2025)
Support Recovery and $\ell_2$-Error Bound for Sparse Regression with Quadratic Measurements via Weakly-Convex-Concave Regularization
por: Fan, Jun, et al.
Publicado: (2026)
por: Fan, Jun, et al.
Publicado: (2026)
Efficient Visual Fault Detection for Freight Train via Neural Architecture Search with Data Volume Robustness
por: Zhang, Yang, et al.
Publicado: (2024)
por: Zhang, Yang, et al.
Publicado: (2024)
Itchy zosteriform erythema in the thoracic region in a 30‐year‐old man
por: Yang Yang, et al.
Publicado: (2024)
por: Yang Yang, et al.
Publicado: (2024)
Qwen3-Coder-Next Technical Report
por: Cao, Ruisheng, et al.
Publicado: (2026)
por: Cao, Ruisheng, et al.
Publicado: (2026)
OPUS: Towards Efficient and Principled Data Selection in Large Language Model Pre-training in Every Iteration
por: Wang, Shaobo, et al.
Publicado: (2026)
por: Wang, Shaobo, et al.
Publicado: (2026)
Macromolecular Solvent‐Based Durable Gel With Self‐Bonding and Adhesive for Long‐Lasting Flexible Electronics
por: Xinyu Zhang, et al.
Publicado: (2025)
por: Xinyu Zhang, et al.
Publicado: (2025)
SyncTrack: Rhythmic Stability and Synchronization in Multi-Track Music Generation
por: Wang, Hongrui, et al.
Publicado: (2026)
por: Wang, Hongrui, et al.
Publicado: (2026)
SWI / SNF Chromatin Remodelling Complex in Hepatic Physiology: Mechanistic Insights Into Development, Homeostasis and Pathogenesis
por: Rui Li, et al.
Publicado: (2026)
por: Rui Li, et al.
Publicado: (2026)
Ejemplares similares
-
Qwen2.5 Technical Report
por: Qwen, et al.
Publicado: (2024) -
Qwen2.5-Coder Technical Report
por: Hui, Binyuan, et al.
Publicado: (2024) -
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
por: Yang, An, et al.
Publicado: (2024) -
Qwen2 Technical Report
por: Yang, An, et al.
Publicado: (2024) -
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
por: Deng, Boyi, et al.
Publicado: (2026)