Xmodel-1.5: An 1B-scale Multilingual LLM
Fuente:
arXiv
Guardado en:
| Autores principales: | Qun, Wang, Yang, Liu, Qingquan, Lin, Ling, Jiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Xmodel-LM Technical Report
por: Wang, Yichuan, et al.
Publicado: (2024)
por: Wang, Yichuan, et al.
Publicado: (2024)
Xmodel-2 Technical Report
por: Qun, Wang, et al.
Publicado: (2024)
por: Qun, Wang, et al.
Publicado: (2024)
Xmodel-2.5: 1.3B Data-Efficient Reasoning SLM
por: Liu, Yang, et al.
Publicado: (2025)
por: Liu, Yang, et al.
Publicado: (2025)
Gamayun's Path to Multilingual Mastery: Cost-Efficient Training of a 1.5B-Parameter LLM
por: Podolskiy, Alexander, et al.
Publicado: (2025)
por: Podolskiy, Alexander, et al.
Publicado: (2025)
Xmodel-VLM: A Simple Baseline for Multimodal Vision Language Model
por: Xu, Wanting, et al.
Publicado: (2024)
por: Xu, Wanting, et al.
Publicado: (2024)
JustRL: Scaling a 1.5B LLM with a Simple RL Recipe
por: He, Bingxiang, et al.
Publicado: (2025)
por: He, Bingxiang, et al.
Publicado: (2025)
OFA: A Framework of Initializing Unseen Subword Embeddings for Efficient Large-scale Multilingual Continued Pretraining
por: Liu, Yihong, et al.
Publicado: (2023)
por: Liu, Yihong, et al.
Publicado: (2023)
How Reliable is Multilingual LLM-as-a-Judge?
por: Fu, Xiyan, et al.
Publicado: (2025)
por: Fu, Xiyan, et al.
Publicado: (2025)
Beyond Translation: LLM-Based Data Generation for Multilingual Fact-Checking
por: Chung, Yi-Ling, et al.
Publicado: (2025)
por: Chung, Yi-Ling, et al.
Publicado: (2025)
Evaluating Scoring Bias in LLM-as-a-Judge
por: Li, Qingquan, et al.
Publicado: (2025)
por: Li, Qingquan, et al.
Publicado: (2025)
Benchmarking LLM Guardrails in Handling Multilingual Toxicity
por: Yang, Yahan, et al.
Publicado: (2024)
por: Yang, Yahan, et al.
Publicado: (2024)
Seed-X: Building Strong Multilingual Translation LLM with 7B Parameters
por: Cheng, Shanbo, et al.
Publicado: (2025)
por: Cheng, Shanbo, et al.
Publicado: (2025)
System-1.5 Reasoning: Traversal in Language and Latent Spaces with Dynamic Shortcuts
por: Wang, Xiaoqiang, et al.
Publicado: (2025)
por: Wang, Xiaoqiang, et al.
Publicado: (2025)
Beyond Benchmarking: A New Paradigm for Evaluation and Assessment of Large Language Models
por: Liu, Jin, et al.
Publicado: (2024)
por: Liu, Jin, et al.
Publicado: (2024)
Multilingual Prompting for Improving LLM Generation Diversity
por: Wang, Qihan, et al.
Publicado: (2025)
por: Wang, Qihan, et al.
Publicado: (2025)
HY-MT1.5 Technical Report
por: Zheng, Mao, et al.
Publicado: (2025)
por: Zheng, Mao, et al.
Publicado: (2025)
GPTKB v1.5: A Massive Knowledge Base for Exploring Factual LLM Knowledge
por: Hu, Yujia, et al.
Publicado: (2025)
por: Hu, Yujia, et al.
Publicado: (2025)
Align Once, Benefit Multilingually: Enforcing Multilingual Consistency for LLM Safety Alignment
por: Bu, Yuyan, et al.
Publicado: (2026)
por: Bu, Yuyan, et al.
Publicado: (2026)
Seed1.5-Thinking: Advancing Superb Reasoning Models with Reinforcement Learning
por: Seed, ByteDance, et al.
Publicado: (2025)
por: Seed, ByteDance, et al.
Publicado: (2025)
Marco-LLM: Bridging Languages via Massive Multilingual Training for Cross-Lingual Enhancement
por: Ming, Lingfeng, et al.
Publicado: (2024)
por: Ming, Lingfeng, et al.
Publicado: (2024)
MM1.5: Methods, Analysis & Insights from Multimodal LLM Fine-tuning
por: Zhang, Haotian, et al.
Publicado: (2024)
por: Zhang, Haotian, et al.
Publicado: (2024)
ToolFlow: Boosting LLM Tool-Calling Through Natural and Coherent Dialogue Synthesis
por: Wang, Zezhong, et al.
Publicado: (2024)
por: Wang, Zezhong, et al.
Publicado: (2024)
Multilingual Sentence-T5: Scalable Sentence Encoders for Multilingual Applications
por: Yano, Chihiro, et al.
Publicado: (2024)
por: Yano, Chihiro, et al.
Publicado: (2024)
MrGuard: A Multilingual Reasoning Guardrail for Universal LLM Safety
por: Yang, Yahan, et al.
Publicado: (2025)
por: Yang, Yahan, et al.
Publicado: (2025)
EuroLLM: Multilingual Language Models for Europe
por: Martins, Pedro Henrique, et al.
Publicado: (2024)
por: Martins, Pedro Henrique, et al.
Publicado: (2024)
Test Set Quality in Multilingual LLM Evaluation
por: Kranti, Chalamalasetti, et al.
Publicado: (2025)
por: Kranti, Chalamalasetti, et al.
Publicado: (2025)
Could Thinking Multilingually Empower LLM Reasoning?
por: Gao, Changjiang, et al.
Publicado: (2025)
por: Gao, Changjiang, et al.
Publicado: (2025)
Checklist Engineering Empowers Multilingual LLM Judges
por: Mohammadkhani, Mohammad Ghiasvand, et al.
Publicado: (2025)
por: Mohammadkhani, Mohammad Ghiasvand, et al.
Publicado: (2025)
Disentangling Language Roles in Multilingual LLM Task Execution
por: Zhan, Qishi, et al.
Publicado: (2026)
por: Zhan, Qishi, et al.
Publicado: (2026)
OMGEval: An Open Multilingual Generative Evaluation Benchmark for Large Language Models
por: Liu, Yang, et al.
Publicado: (2024)
por: Liu, Yang, et al.
Publicado: (2024)
ECom-Bench: Can LLM Agent Resolve Real-World E-commerce Customer Support Issues?
por: Wang, Haoxin, et al.
Publicado: (2025)
por: Wang, Haoxin, et al.
Publicado: (2025)
Multilingual E5 Text Embeddings: A Technical Report
por: Wang, Liang, et al.
Publicado: (2024)
por: Wang, Liang, et al.
Publicado: (2024)
DARWIN 1.5: Large Language Models as Materials Science Adapted Learners
por: Xie, Tong, et al.
Publicado: (2024)
por: Xie, Tong, et al.
Publicado: (2024)
PMMT: Preference Alignment in Multilingual Machine Translation via LLM Distillation
por: Sun, Shuqiao, et al.
Publicado: (2024)
por: Sun, Shuqiao, et al.
Publicado: (2024)
Mimir: Large-scale Multilingual Concept Modeling
por: Musacchio, Elio, et al.
Publicado: (2026)
por: Musacchio, Elio, et al.
Publicado: (2026)
Kuwain 1.5B: An Arabic SLM via Language Injection
por: Hennara, Khalil, et al.
Publicado: (2025)
por: Hennara, Khalil, et al.
Publicado: (2025)
SAEMark: Steering Personalized Multilingual LLM Watermarks with Sparse Autoencoders
por: Yu, Zhuohao, et al.
Publicado: (2025)
por: Yu, Zhuohao, et al.
Publicado: (2025)
MindFlow: Revolutionizing E-commerce Customer Support with Multimodal LLM Agents
por: Gong, Ming, et al.
Publicado: (2025)
por: Gong, Ming, et al.
Publicado: (2025)
EXECUTE: A Multilingual Benchmark for LLM Token Understanding
por: Edman, Lukas, et al.
Publicado: (2025)
por: Edman, Lukas, et al.
Publicado: (2025)
Leveraging LLM For Synchronizing Information Across Multilingual Tables
por: Khincha, Siddharth, et al.
Publicado: (2025)
por: Khincha, Siddharth, et al.
Publicado: (2025)
Ejemplares similares
-
Xmodel-LM Technical Report
por: Wang, Yichuan, et al.
Publicado: (2024) -
Xmodel-2 Technical Report
por: Qun, Wang, et al.
Publicado: (2024) -
Xmodel-2.5: 1.3B Data-Efficient Reasoning SLM
por: Liu, Yang, et al.
Publicado: (2025) -
Gamayun's Path to Multilingual Mastery: Cost-Efficient Training of a 1.5B-Parameter LLM
por: Podolskiy, Alexander, et al.
Publicado: (2025) -
Xmodel-VLM: A Simple Baseline for Multimodal Vision Language Model
por: Xu, Wanting, et al.
Publicado: (2024)