Qwen2 Technical Report
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, An, Yang, Baosong, Hui, Binyuan, Zheng, Bo, Yu, Bowen, Zhou, Chang, Li, Chengpeng, Li, Chengyuan, Liu, Dayiheng, Huang, Fei, Dong, Guanting, Wei, Haoran, Lin, Huan, Tang, Jialong, Wang, Jialin, Yang, Jian, Tu, Jianhong, Zhang, Jianwei, Ma, Jianxin, Yang, Jianxin, Xu, Jin, Zhou, Jingren, Bai, Jinze, He, Jinzheng, Lin, Junyang, Dang, Kai, Lu, Keming, Chen, Keqin, Yang, Kexin, Li, Mei, Xue, Mingfeng, Ni, Na, Zhang, Pei, Wang, Peng, Peng, Ru, Men, Rui, Gao, Ruize, Lin, Runji, Wang, Shijie, Bai, Shuai, Tan, Sinan, Zhu, Tianhang, Li, Tianhao, Liu, Tianyu, Ge, Wenbin, Deng, Xiaodong, Zhou, Xiaohuan, Ren, Xingzhang, Zhang, Xinyu, Wei, Xipin, Ren, Xuancheng, Liu, Xuejing, Fan, Yang, Yao, Yang, Zhang, Yichang, Wan, Yu, Chu, Yunfei, Liu, Yuqiong, Cui, Zeyu, Zhang, Zhenru, Guo, Zhifang, Fan, Zhihao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Qwen2.5 Technical Report
di: Qwen, et al.
Pubblicazione: (2024)
di: Qwen, et al.
Pubblicazione: (2024)
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
di: Yang, An, et al.
Pubblicazione: (2024)
di: Yang, An, et al.
Pubblicazione: (2024)
Qwen2.5-Coder Technical Report
di: Hui, Binyuan, et al.
Pubblicazione: (2024)
di: Hui, Binyuan, et al.
Pubblicazione: (2024)
Qwen3 Technical Report
di: Yang, An, et al.
Pubblicazione: (2025)
di: Yang, An, et al.
Pubblicazione: (2025)
Qwen3-Omni Technical Report
di: Xu, Jin, et al.
Pubblicazione: (2025)
di: Xu, Jin, et al.
Pubblicazione: (2025)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
di: Zhang, Yanzhao, et al.
Pubblicazione: (2025)
di: Zhang, Yanzhao, et al.
Pubblicazione: (2025)
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
di: Wang, Peng, et al.
Pubblicazione: (2024)
di: Wang, Peng, et al.
Pubblicazione: (2024)
Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking
di: Li, Mingxin, et al.
Pubblicazione: (2026)
di: Li, Mingxin, et al.
Pubblicazione: (2026)
WorldPM: Scaling Human Preference Modeling
di: Wang, Binghai, et al.
Pubblicazione: (2025)
di: Wang, Binghai, et al.
Pubblicazione: (2025)
Qwen3-VL Technical Report
di: Bai, Shuai, et al.
Pubblicazione: (2025)
di: Bai, Shuai, et al.
Pubblicazione: (2025)
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
di: Deng, Boyi, et al.
Pubblicazione: (2026)
di: Deng, Boyi, et al.
Pubblicazione: (2026)
START: Self-taught Reasoner with Tools
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings
di: Quan, Shanghaoran, et al.
Pubblicazione: (2025)
di: Quan, Shanghaoran, et al.
Pubblicazione: (2025)
ProcessBench: Identifying Process Errors in Mathematical Reasoning
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
The Lessons of Developing Process Reward Models in Mathematical Reasoning
di: Zhang, Zhenru, et al.
Pubblicazione: (2025)
di: Zhang, Zhenru, et al.
Pubblicazione: (2025)
Qwen2-Audio Technical Report
di: Chu, Yunfei, et al.
Pubblicazione: (2024)
di: Chu, Yunfei, et al.
Pubblicazione: (2024)
Disentangling Reasoning Tokens and Boilerplate Tokens For Language Model Fine-tuning
di: Ye, Ziang, et al.
Pubblicazione: (2024)
di: Ye, Ziang, et al.
Pubblicazione: (2024)
An Empirical Study of Parameter Efficient Fine-tuning on Vision-Language Pre-train Model
di: Tian, Yuxin, et al.
Pubblicazione: (2024)
di: Tian, Yuxin, et al.
Pubblicazione: (2024)
Qwen2.5-1M Technical Report
di: Yang, An, et al.
Pubblicazione: (2025)
di: Yang, An, et al.
Pubblicazione: (2025)
Qwen3-ASR Technical Report
di: Shi, Xian, et al.
Pubblicazione: (2026)
di: Shi, Xian, et al.
Pubblicazione: (2026)
Qwen3Guard Technical Report
di: Zhao, Haiquan, et al.
Pubblicazione: (2025)
di: Zhao, Haiquan, et al.
Pubblicazione: (2025)
Qwen2.5-Omni Technical Report
di: Xu, Jin, et al.
Pubblicazione: (2025)
di: Xu, Jin, et al.
Pubblicazione: (2025)
Qwen-Image Technical Report
di: Wu, Chenfei, et al.
Pubblicazione: (2025)
di: Wu, Chenfei, et al.
Pubblicazione: (2025)
Can Large Language Models Always Solve Easy Problems if They Can Solve Harder Ones?
di: Yang, Zhe, et al.
Pubblicazione: (2024)
di: Yang, Zhe, et al.
Pubblicazione: (2024)
Reasoning Like an Economist: Post-Training on Economic Problems Induces Strategic Generalization in LLMs
di: Zhou, Yufa, et al.
Pubblicazione: (2025)
di: Zhou, Yufa, et al.
Pubblicazione: (2025)
Multidimensional effects of history, neighborhood, and proximity on urban land growth: A dynamic spatiotemporal rolling prediction model (STRM)
di: Yingjian Ren, et al.
Pubblicazione: (2024)
di: Yingjian Ren, et al.
Pubblicazione: (2024)
Qwen3-Coder-Next Technical Report
di: Cao, Ruisheng, et al.
Pubblicazione: (2026)
di: Cao, Ruisheng, et al.
Pubblicazione: (2026)
Qwen3-TTS Technical Report
di: Hu, Hangrui, et al.
Pubblicazione: (2026)
di: Hu, Hangrui, et al.
Pubblicazione: (2026)
RAG4ITOps: A Supervised Fine-Tunable and Comprehensive RAG Framework for IT Operations and Maintenance
di: Zhang, Tianyang, et al.
Pubblicazione: (2024)
di: Zhang, Tianyang, et al.
Pubblicazione: (2024)
Evaluating and Aligning CodeLLMs on Human Preference
di: Yang, Jian, et al.
Pubblicazione: (2024)
di: Yang, Jian, et al.
Pubblicazione: (2024)
Bimetallic MIL‐88/Polyaniline Hybrid Hollow Structure: In‐situ Synthesis and Enhanced Oxygen Evolution Reaction at High Current Densities
di: Ying Liu, et al.
Pubblicazione: (2024)
di: Ying Liu, et al.
Pubblicazione: (2024)
Combinatorial Optimization with Automated Graph Neural Networks
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
A Dynamic LLM-Powered Agent Network for Task-Oriented Agent Collaboration
di: Liu, Zijun, et al.
Pubblicazione: (2023)
di: Liu, Zijun, et al.
Pubblicazione: (2023)
Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning
di: Wang, Shenzhi, et al.
Pubblicazione: (2025)
di: Wang, Shenzhi, et al.
Pubblicazione: (2025)
The Missing Piece in Pre-trained Model Evaluation: Reward-Guided Decoding Unlocks Task-Oriented Behavior Without Parameter Updates
di: Wang, Shaobo, et al.
Pubblicazione: (2026)
di: Wang, Shaobo, et al.
Pubblicazione: (2026)
Language Models can Self-Lengthen to Generate Long Texts
di: Quan, Shanghaoran, et al.
Pubblicazione: (2024)
di: Quan, Shanghaoran, et al.
Pubblicazione: (2024)
Equivariant Hypergraph Diffusion for Crystal Structure Prediction
di: Liu, Yang, et al.
Pubblicazione: (2025)
di: Liu, Yang, et al.
Pubblicazione: (2025)
Real-Time Glottis Detection Framework via Spatial-decoupled Feature Learning for Nasal Transnasal Intubation
di: Liu, Jinyu, et al.
Pubblicazione: (2026)
di: Liu, Jinyu, et al.
Pubblicazione: (2026)
Online Merging Optimizers for Boosting Rewards and Mitigating Tax in Alignment
di: Lu, Keming, et al.
Pubblicazione: (2024)
di: Lu, Keming, et al.
Pubblicazione: (2024)
Shifts in Small Fish Community Caused by Coral Cover Variation at a Remote Reef in the South China Sea.
di: Ling, Daxiao, et al.
Pubblicazione: (2026)
di: Ling, Daxiao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Qwen2.5 Technical Report
di: Qwen, et al.
Pubblicazione: (2024) -
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
di: Yang, An, et al.
Pubblicazione: (2024) -
Qwen2.5-Coder Technical Report
di: Hui, Binyuan, et al.
Pubblicazione: (2024) -
Qwen3 Technical Report
di: Yang, An, et al.
Pubblicazione: (2025) -
Qwen3-Omni Technical Report
di: Xu, Jin, et al.
Pubblicazione: (2025)