Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Pinzhen, Yu, Simon, Guo, Zhicheng, Haddow, Barry |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Iterative Translation Refinement with Large Language Models
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023)
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023)
Monolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023)
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023)
Multilingual Instruction Tuning With Just a Pinch of Multilinguality
von: Shaham, Uri, et al.
Veröffentlicht: (2024)
von: Shaham, Uri, et al.
Veröffentlicht: (2024)
Multilingual Retrieval-Augmented Generation for Knowledge-Intensive Task
von: Ranaldi, Leonardo, et al.
Veröffentlicht: (2025)
von: Ranaldi, Leonardo, et al.
Veröffentlicht: (2025)
How Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOM
von: Ji, Shaoxiong, et al.
Veröffentlicht: (2024)
von: Ji, Shaoxiong, et al.
Veröffentlicht: (2024)
MatheMagic: Generating Dynamic Mathematics Benchmarks Robust to Memorization
von: O'Brien, Dayyán, et al.
Veröffentlicht: (2025)
von: O'Brien, Dayyán, et al.
Veröffentlicht: (2025)
Just Go Parallel: Improving the Multilingual Capabilities of Large Language Models
von: Qorib, Muhammad Reza, et al.
Veröffentlicht: (2025)
von: Qorib, Muhammad Reza, et al.
Veröffentlicht: (2025)
Context and System Fusion in Post-ASR Emotion Recognition with Large Language Models
von: Stepachev, Pavel, et al.
Veröffentlicht: (2024)
von: Stepachev, Pavel, et al.
Veröffentlicht: (2024)
Fine-Tuning Large Language Models to Translate: Will a Touch of Noisy Data in Misaligned Languages Suffice?
von: Zhu, Dawei, et al.
Veröffentlicht: (2024)
von: Zhu, Dawei, et al.
Veröffentlicht: (2024)
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
von: Bogoychev, Nikolay, et al.
Veröffentlicht: (2023)
von: Bogoychev, Nikolay, et al.
Veröffentlicht: (2023)
Parrot: Multilingual Visual Instruction Tuning
von: Sun, Hai-Long, et al.
Veröffentlicht: (2024)
von: Sun, Hai-Long, et al.
Veröffentlicht: (2024)
EMMA-500: Enhancing Massively Multilingual Adaptation of Large Language Models
von: Ji, Shaoxiong, et al.
Veröffentlicht: (2024)
von: Ji, Shaoxiong, et al.
Veröffentlicht: (2024)
Generalizing From Short to Long: Effective Data Synthesis for Long-Context Instruction Tuning
von: Zhu, Wenhao, et al.
Veröffentlicht: (2025)
von: Zhu, Wenhao, et al.
Veröffentlicht: (2025)
Aya Dataset: An Open-Access Collection for Multilingual Instruction Tuning
von: Singh, Shivalika, et al.
Veröffentlicht: (2024)
von: Singh, Shivalika, et al.
Veröffentlicht: (2024)
Beyond Bilingual Transfer: Multilingual Code-Switching in Instruction Tuning
von: Asano, Shunta, et al.
Veröffentlicht: (2026)
von: Asano, Shunta, et al.
Veröffentlicht: (2026)
M-IFEval: Multilingual Instruction-Following Evaluation
von: Dussolle, Antoine, et al.
Veröffentlicht: (2025)
von: Dussolle, Antoine, et al.
Veröffentlicht: (2025)
Exploring Polyglot Harmony: On Multilingual Data Allocation for Large Language Models Pretraining
von: Guo, Ping, et al.
Veröffentlicht: (2025)
von: Guo, Ping, et al.
Veröffentlicht: (2025)
How do Large Language Models Handle Multilingualism?
von: Zhao, Yiran, et al.
Veröffentlicht: (2024)
von: Zhao, Yiran, et al.
Veröffentlicht: (2024)
Evaluation Methodology for Large Language Models for Multilingual Document Question and Answer
von: Kahana, Adar, et al.
Veröffentlicht: (2024)
von: Kahana, Adar, et al.
Veröffentlicht: (2024)
Evaluating the Elementary Multilingual Capabilities of Large Language Models with MultiQ
von: Holtermann, Carolin, et al.
Veröffentlicht: (2024)
von: Holtermann, Carolin, et al.
Veröffentlicht: (2024)
Indic-TunedLens: Interpreting Multilingual Models in Indian Languages
von: Panchal, Mihir, et al.
Veröffentlicht: (2026)
von: Panchal, Mihir, et al.
Veröffentlicht: (2026)
DocHPLT: A Massively Multilingual Document-Level Translation Dataset
von: O'Brien, Dayyán, et al.
Veröffentlicht: (2025)
von: O'Brien, Dayyán, et al.
Veröffentlicht: (2025)
The Roles of English in Evaluating Multilingual Language Models
von: Poelman, Wessel, et al.
Veröffentlicht: (2024)
von: Poelman, Wessel, et al.
Veröffentlicht: (2024)
All Languages Matter: On the Multilingual Safety of Large Language Models
von: Wang, Wenxuan, et al.
Veröffentlicht: (2023)
von: Wang, Wenxuan, et al.
Veröffentlicht: (2023)
Multilingual Collaborative Defense for Large Language Models
von: Li, Hongliang, et al.
Veröffentlicht: (2025)
von: Li, Hongliang, et al.
Veröffentlicht: (2025)
Do Large Language Models Have an English Accent? Evaluating and Improving the Naturalness of Multilingual LLMs
von: Guo, Yanzhu, et al.
Veröffentlicht: (2024)
von: Guo, Yanzhu, et al.
Veröffentlicht: (2024)
When Bad Data Leads to Good Models
von: Li, Kenneth, et al.
Veröffentlicht: (2025)
von: Li, Kenneth, et al.
Veröffentlicht: (2025)
MoZIP: A Multilingual Benchmark to Evaluate Large Language Models in Intellectual Property
von: Ni, Shiwen, et al.
Veröffentlicht: (2024)
von: Ni, Shiwen, et al.
Veröffentlicht: (2024)
SUTRA: Scalable Multilingual Language Model Architecture
von: Bendale, Abhijit, et al.
Veröffentlicht: (2024)
von: Bendale, Abhijit, et al.
Veröffentlicht: (2024)
MaXIFE: Multilingual and Cross-lingual Instruction Following Evaluation
von: Liu, Yile, et al.
Veröffentlicht: (2025)
von: Liu, Yile, et al.
Veröffentlicht: (2025)
Multilingual Training and Evaluation Resources for Vision-Language Models
von: Baiamonte, Daniela, et al.
Veröffentlicht: (2026)
von: Baiamonte, Daniela, et al.
Veröffentlicht: (2026)
Evaluating the Limits of Large Language Models in Multilingual Legal Reasoning
von: Ioannou, Antreas, et al.
Veröffentlicht: (2025)
von: Ioannou, Antreas, et al.
Veröffentlicht: (2025)
Multilingual Performance Biases of Large Language Models in Education
von: Gupta, Vansh, et al.
Veröffentlicht: (2025)
von: Gupta, Vansh, et al.
Veröffentlicht: (2025)
BayLing 2: A Multilingual Large Language Model with Efficient Language Alignment
von: Zhang, Shaolei, et al.
Veröffentlicht: (2024)
von: Zhang, Shaolei, et al.
Veröffentlicht: (2024)
The Heap: A Contamination-Free Multilingual Code Dataset for Evaluating Large Language Models
von: Katzy, Jonathan, et al.
Veröffentlicht: (2025)
von: Katzy, Jonathan, et al.
Veröffentlicht: (2025)
Quality or Quantity? On Data Scale and Diversity in Adapting Large Language Models for Low-Resource Translation
von: Iyer, Vivek, et al.
Veröffentlicht: (2024)
von: Iyer, Vivek, et al.
Veröffentlicht: (2024)
MTQ-Eval: Multilingual Text Quality Evaluation for Language Models
von: Pokharel, Rhitabrat, et al.
Veröffentlicht: (2025)
von: Pokharel, Rhitabrat, et al.
Veröffentlicht: (2025)
Multilingual Medical Reasoning for Question Answering with Large Language Models
von: Ferrazzi, Pietro, et al.
Veröffentlicht: (2025)
von: Ferrazzi, Pietro, et al.
Veröffentlicht: (2025)
mEdIT: Multilingual Text Editing via Instruction Tuning
von: Raheja, Vipul, et al.
Veröffentlicht: (2024)
von: Raheja, Vipul, et al.
Veröffentlicht: (2024)
Mitigating Multilingual Hallucination in Large Vision-Language Models
von: Qu, Xiaoye, et al.
Veröffentlicht: (2024)
von: Qu, Xiaoye, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Iterative Translation Refinement with Large Language Models
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023) -
Monolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023) -
Multilingual Instruction Tuning With Just a Pinch of Multilinguality
von: Shaham, Uri, et al.
Veröffentlicht: (2024) -
Multilingual Retrieval-Augmented Generation for Knowledge-Intensive Task
von: Ranaldi, Leonardo, et al.
Veröffentlicht: (2025) -
How Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOM
von: Ji, Shaoxiong, et al.
Veröffentlicht: (2024)