ChuXin: 1.6B Technical Report
Fuente:
arXiv
Saved in:
| Main Authors: | Zhuang, Xiaomin, Jiang, Yufan, He, Qiaozhi, Wu, Zhihua |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Code Comparison Tuning for Code Large Language Models
by: Jiang, Yufan, et al.
Published: (2024)
by: Jiang, Yufan, et al.
Published: (2024)
Exploring Scaling Laws for Local SGD in Large Language Model Training
by: He, Qiaozhi, et al.
Published: (2024)
by: He, Qiaozhi, et al.
Published: (2024)
RecycleGPT: An Autoregressive Language Model with Recyclable Module
by: Jiang, Yufan, et al.
Published: (2023)
by: Jiang, Yufan, et al.
Published: (2023)
Efficient LLM Inference with Kcache
by: He, Qiaozhi, et al.
Published: (2024)
by: He, Qiaozhi, et al.
Published: (2024)
Stable LM 2 1.6B Technical Report
by: Bellagente, Marco, et al.
Published: (2024)
by: Bellagente, Marco, et al.
Published: (2024)
Megrez2 Technical Report
by: Li, Boxun, et al.
Published: (2025)
by: Li, Boxun, et al.
Published: (2025)
Breeze-7B Technical Report
by: Hsu, Chan-Jan, et al.
Published: (2024)
by: Hsu, Chan-Jan, et al.
Published: (2024)
ZAYA1-8B Technical Report
by: Washbourne, Robert, et al.
Published: (2026)
by: Washbourne, Robert, et al.
Published: (2026)
ChuLo: Chunk-Level Key Information Representation for Long Document Understanding
by: Li, Yan, et al.
Published: (2024)
by: Li, Yan, et al.
Published: (2024)
Qwen2.5-1M Technical Report
by: Yang, An, et al.
Published: (2025)
by: Yang, An, et al.
Published: (2025)
KAT-Coder Technical Report
by: Zhan, Zizheng, et al.
Published: (2025)
by: Zhan, Zizheng, et al.
Published: (2025)
DNA 1.0 Technical Report
by: Lee, Jungyup, et al.
Published: (2025)
by: Lee, Jungyup, et al.
Published: (2025)
WiNGPT-3.0 Technical Report
by: Zhuang, Boqin, et al.
Published: (2025)
by: Zhuang, Boqin, et al.
Published: (2025)
Multi-Modal Multi-Granularity Tokenizer for Chu Bamboo Slip Scripts
by: Chen, Yingfa, et al.
Published: (2024)
by: Chen, Yingfa, et al.
Published: (2024)
Aquila2 Technical Report
by: Zhang, Bo-Wen, et al.
Published: (2024)
by: Zhang, Bo-Wen, et al.
Published: (2024)
Qwen3Guard Technical Report
by: Zhao, Haiquan, et al.
Published: (2025)
by: Zhao, Haiquan, et al.
Published: (2025)
Spoken Language Identification with Pre-trained Models and Margin Loss
by: Fang, Zhihua, et al.
Published: (2026)
by: Fang, Zhihua, et al.
Published: (2026)
Ruyi2.5 Technical Report
by: Song, Huan, et al.
Published: (2026)
by: Song, Huan, et al.
Published: (2026)
Megrez-Omni Technical Report
by: Li, Boxun, et al.
Published: (2025)
by: Li, Boxun, et al.
Published: (2025)
Xmodel-LM Technical Report
by: Wang, Yichuan, et al.
Published: (2024)
by: Wang, Yichuan, et al.
Published: (2024)
LexPro-1.0 Technical Report
by: Chen, Haotian, et al.
Published: (2025)
by: Chen, Haotian, et al.
Published: (2025)
HY-MT1.5 Technical Report
by: Zheng, Mao, et al.
Published: (2025)
by: Zheng, Mao, et al.
Published: (2025)
RecGPT Technical Report
by: Yi, Chao, et al.
Published: (2025)
by: Yi, Chao, et al.
Published: (2025)
dots.llm1 Technical Report
by: Huo, Bi, et al.
Published: (2025)
by: Huo, Bi, et al.
Published: (2025)
KAT-V1: Kwai-AutoThink Technical Report
by: Zhan, Zizheng, et al.
Published: (2025)
by: Zhan, Zizheng, et al.
Published: (2025)
Nyonic Technical Report
by: Tian, Junfeng, et al.
Published: (2024)
by: Tian, Junfeng, et al.
Published: (2024)
Salamandra Technical Report
by: Gonzalez-Agirre, Aitor, et al.
Published: (2025)
by: Gonzalez-Agirre, Aitor, et al.
Published: (2025)
Llamion Technical Report
by: Yang, Kisu, et al.
Published: (2026)
by: Yang, Kisu, et al.
Published: (2026)
MiMo-VL Technical Report
by: Core Team, et al.
Published: (2025)
by: Core Team, et al.
Published: (2025)
Tele-FLM Technical Report
by: Li, Xiang, et al.
Published: (2024)
by: Li, Xiang, et al.
Published: (2024)
Mano Technical Report
by: Fu, Tianyu, et al.
Published: (2025)
by: Fu, Tianyu, et al.
Published: (2025)
ERNIE 5.0 Technical Report
by: Wang, Haifeng, et al.
Published: (2026)
by: Wang, Haifeng, et al.
Published: (2026)
Falcon2-11B Technical Report
by: Malartic, Quentin, et al.
Published: (2024)
by: Malartic, Quentin, et al.
Published: (2024)
H2O-Danube-1.8B Technical Report
by: Singer, Philipp, et al.
Published: (2024)
by: Singer, Philipp, et al.
Published: (2024)
RecGPT-V2 Technical Report
by: Yi, Chao, et al.
Published: (2025)
by: Yi, Chao, et al.
Published: (2025)
UserGPT Technical Report
by: Xuan, Yunyi, et al.
Published: (2026)
by: Xuan, Yunyi, et al.
Published: (2026)
Step-DeepResearch Technical Report
by: Hu, Chen, et al.
Published: (2025)
by: Hu, Chen, et al.
Published: (2025)
Transfer Learning Enhanced Single-choice Decision for Multi-choice Question Answering
by: Cui, Chenhao, et al.
Published: (2024)
by: Cui, Chenhao, et al.
Published: (2024)
Hermes 3 Technical Report
by: Teknium, Ryan, et al.
Published: (2024)
by: Teknium, Ryan, et al.
Published: (2024)
LokiLM: Technical Report
by: Kiefel, Justin, et al.
Published: (2024)
by: Kiefel, Justin, et al.
Published: (2024)
Similar Items
-
Code Comparison Tuning for Code Large Language Models
by: Jiang, Yufan, et al.
Published: (2024) -
Exploring Scaling Laws for Local SGD in Large Language Model Training
by: He, Qiaozhi, et al.
Published: (2024) -
RecycleGPT: An Autoregressive Language Model with Recyclable Module
by: Jiang, Yufan, et al.
Published: (2023) -
Efficient LLM Inference with Kcache
by: He, Qiaozhi, et al.
Published: (2024) -
Stable LM 2 1.6B Technical Report
by: Bellagente, Marco, et al.
Published: (2024)