Xmodel-LM Technical Report
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yichuan, Liu, Yang, Yan, Yu, Wang, Qun, Huang, Xucheng, Jiang, Ling |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Xmodel-2 Technical Report
di: Qun, Wang, et al.
Pubblicazione: (2024)
di: Qun, Wang, et al.
Pubblicazione: (2024)
Xmodel-VLM: A Simple Baseline for Multimodal Vision Language Model
di: Xu, Wanting, et al.
Pubblicazione: (2024)
di: Xu, Wanting, et al.
Pubblicazione: (2024)
InternLM2 Technical Report
di: Cai, Zheng, et al.
Pubblicazione: (2024)
di: Cai, Zheng, et al.
Pubblicazione: (2024)
Xmodel-1.5: An 1B-scale Multilingual LLM
di: Qun, Wang, et al.
Pubblicazione: (2024)
di: Qun, Wang, et al.
Pubblicazione: (2024)
MindFlow: Revolutionizing E-commerce Customer Support with Multimodal LLM Agents
di: Gong, Ming, et al.
Pubblicazione: (2025)
di: Gong, Ming, et al.
Pubblicazione: (2025)
Tele-FLM Technical Report
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
Qwen2 Technical Report
di: Yang, An, et al.
Pubblicazione: (2024)
di: Yang, An, et al.
Pubblicazione: (2024)
MOSS-TTS Technical Report
di: Gong, Yitian, et al.
Pubblicazione: (2026)
di: Gong, Yitian, et al.
Pubblicazione: (2026)
Sigma-MoE-Tiny Technical Report
di: Hu, Qingguo, et al.
Pubblicazione: (2025)
di: Hu, Qingguo, et al.
Pubblicazione: (2025)
TeleChat Technical Report
di: He, Zhongjiang, et al.
Pubblicazione: (2024)
di: He, Zhongjiang, et al.
Pubblicazione: (2024)
PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization
di: Wang, Yidong, et al.
Pubblicazione: (2023)
di: Wang, Yidong, et al.
Pubblicazione: (2023)
DeepSeek-V3 Technical Report
di: DeepSeek-AI, et al.
Pubblicazione: (2024)
di: DeepSeek-AI, et al.
Pubblicazione: (2024)
MiMo-V2-Flash Technical Report
di: Core Team, et al.
Pubblicazione: (2026)
di: Core Team, et al.
Pubblicazione: (2026)
IQuest-Coder-V1 Technical Report
di: Yang, Jian, et al.
Pubblicazione: (2026)
di: Yang, Jian, et al.
Pubblicazione: (2026)
QZhou-Embedding Technical Report
di: Yu, Peng, et al.
Pubblicazione: (2025)
di: Yu, Peng, et al.
Pubblicazione: (2025)
Fish Audio S2 Technical Report
di: Liao, Shijia, et al.
Pubblicazione: (2026)
di: Liao, Shijia, et al.
Pubblicazione: (2026)
Phi-4 Technical Report
di: Abdin, Marah, et al.
Pubblicazione: (2024)
di: Abdin, Marah, et al.
Pubblicazione: (2024)
Xmodel-2.5: 1.3B Data-Efficient Reasoning SLM
di: Liu, Yang, et al.
Pubblicazione: (2025)
di: Liu, Yang, et al.
Pubblicazione: (2025)
VibeVoice Technical Report
di: Peng, Zhiliang, et al.
Pubblicazione: (2025)
di: Peng, Zhiliang, et al.
Pubblicazione: (2025)
PonderLM: Pretraining Language Models to Ponder in Continuous Space
di: Zeng, Boyi, et al.
Pubblicazione: (2025)
di: Zeng, Boyi, et al.
Pubblicazione: (2025)
Skywork Open Reasoner 1 Technical Report
di: He, Jujie, et al.
Pubblicazione: (2025)
di: He, Jujie, et al.
Pubblicazione: (2025)
SudoLM: Learning Access Control of Parametric Knowledge with Authorization Alignment
di: Liu, Qin, et al.
Pubblicazione: (2024)
di: Liu, Qin, et al.
Pubblicazione: (2024)
Yi-Lightning Technical Report
di: Wake, Alan, et al.
Pubblicazione: (2024)
di: Wake, Alan, et al.
Pubblicazione: (2024)
PlatoLM: Teaching LLMs in Multi-Round Dialogue via a User Simulator
di: Kong, Chuyi, et al.
Pubblicazione: (2023)
di: Kong, Chuyi, et al.
Pubblicazione: (2023)
LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models
di: Han, Chi, et al.
Pubblicazione: (2023)
di: Han, Chi, et al.
Pubblicazione: (2023)
GPT-4 Technical Report
di: OpenAI, et al.
Pubblicazione: (2023)
di: OpenAI, et al.
Pubblicazione: (2023)
Empowering Large Language Models for Textual Data Augmentation
di: Li, Yichuan, et al.
Pubblicazione: (2024)
di: Li, Yichuan, et al.
Pubblicazione: (2024)
dots.llm1 Technical Report
di: Huo, Bi, et al.
Pubblicazione: (2025)
di: Huo, Bi, et al.
Pubblicazione: (2025)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
di: Zhu, Lianghui, et al.
Pubblicazione: (2023)
di: Zhu, Lianghui, et al.
Pubblicazione: (2023)
K-EXAONE Technical Report
di: Choi, Eunbi, et al.
Pubblicazione: (2026)
di: Choi, Eunbi, et al.
Pubblicazione: (2026)
Gemma 3 Technical Report
di: Gemma Team, et al.
Pubblicazione: (2025)
di: Gemma Team, et al.
Pubblicazione: (2025)
Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning
di: Li, Ang, et al.
Pubblicazione: (2025)
di: Li, Ang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Xmodel-2 Technical Report
di: Qun, Wang, et al.
Pubblicazione: (2024) -
Xmodel-VLM: A Simple Baseline for Multimodal Vision Language Model
di: Xu, Wanting, et al.
Pubblicazione: (2024) -
InternLM2 Technical Report
di: Cai, Zheng, et al.
Pubblicazione: (2024) -
Xmodel-1.5: An 1B-scale Multilingual LLM
di: Qun, Wang, et al.
Pubblicazione: (2024) -
MindFlow: Revolutionizing E-commerce Customer Support with Multimodal LLM Agents
di: Gong, Ming, et al.
Pubblicazione: (2025)