EMMA-500: Enhancing Massively Multilingual Adaptation of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Ji, Shaoxiong, Li, Zihao, Paavola, Jaakko, Lin, Peiqin, Chen, Pinzhen, O'Brien, Dayyán, Luo, Hengyu, Schütze, Hinrich, Tiedemann, Jörg, Haddow, Barry |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Massively Multilingual Adaptation of Large Language Models Using Bilingual Translation Data
di: Ji, Shaoxiong, et al.
Pubblicazione: (2025)
di: Ji, Shaoxiong, et al.
Pubblicazione: (2025)
MaLA-500: Massive Language Adaptation of Large Language Models
di: Lin, Peiqin, et al.
Pubblicazione: (2024)
di: Lin, Peiqin, et al.
Pubblicazione: (2024)
DocHPLT: A Massively Multilingual Document-Level Translation Dataset
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
MatheMagic: Generating Dynamic Mathematics Benchmarks Robust to Memorization
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
Rethinking Multilingual Continual Pretraining: Data Mixing for Adapting LLMs Across Languages and Resources
di: Li, Zihao, et al.
Pubblicazione: (2025)
di: Li, Zihao, et al.
Pubblicazione: (2025)
Monolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
di: Chen, Pinzhen, et al.
Pubblicazione: (2024)
di: Chen, Pinzhen, et al.
Pubblicazione: (2024)
A Recipe of Parallel Corpora Exploitation for Multilingual Large Language Models
di: Lin, Peiqin, et al.
Pubblicazione: (2024)
di: Lin, Peiqin, et al.
Pubblicazione: (2024)
How Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOM
di: Ji, Shaoxiong, et al.
Pubblicazione: (2024)
di: Ji, Shaoxiong, et al.
Pubblicazione: (2024)
Model-Based Quality Assessment for Massively Multilingual Parallel Data
di: Ibrahim, Abdelaziz M. A., et al.
Pubblicazione: (2026)
di: Ibrahim, Abdelaziz M. A., et al.
Pubblicazione: (2026)
OFA: A Framework of Initializing Unseen Subword Embeddings for Efficient Large-scale Multilingual Continued Pretraining
di: Liu, Yihong, et al.
Pubblicazione: (2023)
di: Liu, Yihong, et al.
Pubblicazione: (2023)
Context and System Fusion in Post-ASR Emotion Recognition with Large Language Models
di: Stepachev, Pavel, et al.
Pubblicazione: (2024)
di: Stepachev, Pavel, et al.
Pubblicazione: (2024)
GlotEval: A Test Suite for Massively Multilingual Evaluation of Large Language Models
di: Luo, Hengyu, et al.
Pubblicazione: (2025)
di: Luo, Hengyu, et al.
Pubblicazione: (2025)
Iterative Translation Refinement with Large Language Models
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
di: Bogoychev, Nikolay, et al.
Pubblicazione: (2023)
di: Bogoychev, Nikolay, et al.
Pubblicazione: (2023)
A Comparison of Language Modeling and Translation as Multilingual Pretraining Objectives
di: Li, Zihao, et al.
Pubblicazione: (2024)
di: Li, Zihao, et al.
Pubblicazione: (2024)
Test-Time Scaling of Reasoning Models for Machine Translation
di: Li, Zihao, et al.
Pubblicazione: (2025)
di: Li, Zihao, et al.
Pubblicazione: (2025)
XAMPLER: Learning to Retrieve Cross-Lingual In-Context Examples
di: Lin, Peiqin, et al.
Pubblicazione: (2024)
di: Lin, Peiqin, et al.
Pubblicazione: (2024)
mPLM-Sim: Better Cross-Lingual Similarity and Transfer in Multilingual Pretrained Language Models
di: Lin, Peiqin, et al.
Pubblicazione: (2023)
di: Lin, Peiqin, et al.
Pubblicazione: (2023)
Can Machine Translation Bridge Multilingual Pretraining and Cross-lingual Transfer Learning?
di: Ji, Shaoxiong, et al.
Pubblicazione: (2024)
di: Ji, Shaoxiong, et al.
Pubblicazione: (2024)
Evaluating Contextually Mediated Factual Recall in Multilingual Large Language Models
di: Liu, Yihong, et al.
Pubblicazione: (2026)
di: Liu, Yihong, et al.
Pubblicazione: (2026)
Quality or Quantity? On Data Scale and Diversity in Adapting Large Language Models for Low-Resource Translation
di: Iyer, Vivek, et al.
Pubblicazione: (2024)
di: Iyer, Vivek, et al.
Pubblicazione: (2024)
An Expanded Massive Multilingual Dataset for High-Performance Language Technologies (HPLT)
di: Burchell, Laurie, et al.
Pubblicazione: (2025)
di: Burchell, Laurie, et al.
Pubblicazione: (2025)
Fine-Tuning Large Language Models to Translate: Will a Touch of Noisy Data in Misaligned Languages Suffice?
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
HPLT 3.0: Very Large-Scale Multilingual Resources for LLMs and MT. Mono- and Bi-lingual Data, Multilingual Evaluation, and Pre-Trained Models
di: Oepen, Stephan, et al.
Pubblicazione: (2025)
di: Oepen, Stephan, et al.
Pubblicazione: (2025)
Understanding In-Context Machine Translation for Low-Resource Languages: A Case Study on Manchu
di: Pei, Renhao, et al.
Pubblicazione: (2025)
di: Pei, Renhao, et al.
Pubblicazione: (2025)
Pitfalls and Outlooks in Using COMET
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
Multilingual Retrieval-Augmented Generation for Knowledge-Intensive Task
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
MAMMOTH: Massively Multilingual Modular Open Translation @ Helsinki
di: Mickus, Timothee, et al.
Pubblicazione: (2024)
di: Mickus, Timothee, et al.
Pubblicazione: (2024)
Large Reasoning Models Are (Not Yet) Multilingual Latent Reasoners
di: Liu, Yihong, et al.
Pubblicazione: (2026)
di: Liu, Yihong, et al.
Pubblicazione: (2026)
Breaking the Script Barrier in Multilingual Pre-Trained Language Models with Transliteration-Based Post-Training Alignment
di: Xhelili, Orgest, et al.
Pubblicazione: (2024)
di: Xhelili, Orgest, et al.
Pubblicazione: (2024)
Demystifying Multilingual Chain-of-Thought in Process Reward Modeling
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
Evaluating Robustness of Large Language Models Against Multilingual Typographical Errors
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025)
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025)
Crosslingual On-Policy Self-Distillation for Multilingual Reasoning
di: Liu, Yihong, et al.
Pubblicazione: (2026)
di: Liu, Yihong, et al.
Pubblicazione: (2026)
When Does Monolingual Data Help Multilingual Translation: The Role of Domain and Model Scale
di: Baziotis, Christos, et al.
Pubblicazione: (2023)
di: Baziotis, Christos, et al.
Pubblicazione: (2023)
A New Massive Multilingual Dataset for High-Performance Language Technologies
di: de Gibert, Ona, et al.
Pubblicazione: (2024)
di: de Gibert, Ona, et al.
Pubblicazione: (2024)
TransliCo: A Contrastive Learning Framework to Address the Script Barrier in Multilingual Pretrained Language Models
di: Liu, Yihong, et al.
Pubblicazione: (2024)
di: Liu, Yihong, et al.
Pubblicazione: (2024)
TransMI: A Framework to Create Strong Baselines from Multilingual Pretrained Language Models for Transliterated Data
di: Liu, Yihong, et al.
Pubblicazione: (2024)
di: Liu, Yihong, et al.
Pubblicazione: (2024)
LangSAMP: Language-Script Aware Multilingual Pretraining
di: Liu, Yihong, et al.
Pubblicazione: (2024)
di: Liu, Yihong, et al.
Pubblicazione: (2024)
Mechanistic Understanding and Mitigation of Language Confusion in English-Centric Large Language Models
di: Nie, Ercong, et al.
Pubblicazione: (2025)
di: Nie, Ercong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Massively Multilingual Adaptation of Large Language Models Using Bilingual Translation Data
di: Ji, Shaoxiong, et al.
Pubblicazione: (2025) -
MaLA-500: Massive Language Adaptation of Large Language Models
di: Lin, Peiqin, et al.
Pubblicazione: (2024) -
DocHPLT: A Massively Multilingual Document-Level Translation Dataset
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025) -
MatheMagic: Generating Dynamic Mathematics Benchmarks Robust to Memorization
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025) -
Rethinking Multilingual Continual Pretraining: Data Mixing for Adapting LLMs Across Languages and Resources
di: Li, Zihao, et al.
Pubblicazione: (2025)