Monolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Pinzhen, Ji, Shaoxiong, Bogoychev, Nikolay, Kutuzov, Andrey, Haddow, Barry, Heafield, Kenneth |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Iterative Translation Refinement with Large Language Models
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023)
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
von: Chen, Pinzhen, et al.
Veröffentlicht: (2024)
von: Chen, Pinzhen, et al.
Veröffentlicht: (2024)
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
von: Bogoychev, Nikolay, et al.
Veröffentlicht: (2023)
von: Bogoychev, Nikolay, et al.
Veröffentlicht: (2023)
How Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOM
von: Ji, Shaoxiong, et al.
Veröffentlicht: (2024)
von: Ji, Shaoxiong, et al.
Veröffentlicht: (2024)
MatheMagic: Generating Dynamic Mathematics Benchmarks Robust to Memorization
von: O'Brien, Dayyán, et al.
Veröffentlicht: (2025)
von: O'Brien, Dayyán, et al.
Veröffentlicht: (2025)
Multilingual Retrieval-Augmented Generation for Knowledge-Intensive Task
von: Ranaldi, Leonardo, et al.
Veröffentlicht: (2025)
von: Ranaldi, Leonardo, et al.
Veröffentlicht: (2025)
The Scandinavian Embedding Benchmarks: Comprehensive Assessment of Multilingual and Monolingual Text Embedding
von: Enevoldsen, Kenneth, et al.
Veröffentlicht: (2024)
von: Enevoldsen, Kenneth, et al.
Veröffentlicht: (2024)
Generalizing From Short to Long: Effective Data Synthesis for Long-Context Instruction Tuning
von: Zhu, Wenhao, et al.
Veröffentlicht: (2025)
von: Zhu, Wenhao, et al.
Veröffentlicht: (2025)
When Does Monolingual Data Help Multilingual Translation: The Role of Domain and Model Scale
von: Baziotis, Christos, et al.
Veröffentlicht: (2023)
von: Baziotis, Christos, et al.
Veröffentlicht: (2023)
Towards Better Monolingual Japanese Retrievers with Multi-Vector Models
von: Clavié, Benjamin
Veröffentlicht: (2023)
von: Clavié, Benjamin
Veröffentlicht: (2023)
Context and System Fusion in Post-ASR Emotion Recognition with Large Language Models
von: Stepachev, Pavel, et al.
Veröffentlicht: (2024)
von: Stepachev, Pavel, et al.
Veröffentlicht: (2024)
Multilingual Information Retrieval with a Monolingual Knowledge Base
von: Zhuang, Yingying, et al.
Veröffentlicht: (2025)
von: Zhuang, Yingying, et al.
Veröffentlicht: (2025)
Comparing Explanation Faithfulness between Multilingual and Monolingual Fine-tuned Language Models
von: Zhao, Zhixue, et al.
Veröffentlicht: (2024)
von: Zhao, Zhixue, et al.
Veröffentlicht: (2024)
EMMA-500: Enhancing Massively Multilingual Adaptation of Large Language Models
von: Ji, Shaoxiong, et al.
Veröffentlicht: (2024)
von: Ji, Shaoxiong, et al.
Veröffentlicht: (2024)
Fluent Alignment with Disfluent Judges: Post-training for Lower-resource Languages
von: Samuel, David, et al.
Veröffentlicht: (2025)
von: Samuel, David, et al.
Veröffentlicht: (2025)
Multilingual Instruction Tuning With Just a Pinch of Multilinguality
von: Shaham, Uri, et al.
Veröffentlicht: (2024)
von: Shaham, Uri, et al.
Veröffentlicht: (2024)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
von: Mastrokostas, Charalampos, et al.
Veröffentlicht: (2026)
von: Mastrokostas, Charalampos, et al.
Veröffentlicht: (2026)
Aya Dataset: An Open-Access Collection for Multilingual Instruction Tuning
von: Singh, Shivalika, et al.
Veröffentlicht: (2024)
von: Singh, Shivalika, et al.
Veröffentlicht: (2024)
Beyond Bilingual Transfer: Multilingual Code-Switching in Instruction Tuning
von: Asano, Shunta, et al.
Veröffentlicht: (2026)
von: Asano, Shunta, et al.
Veröffentlicht: (2026)
Generics are puzzling. Can language models find the missing piece?
von: Calderón, Gustavo Cilleruelo, et al.
Veröffentlicht: (2024)
von: Calderón, Gustavo Cilleruelo, et al.
Veröffentlicht: (2024)
Fine-Tuning Large Language Models to Translate: Will a Touch of Noisy Data in Misaligned Languages Suffice?
von: Zhu, Dawei, et al.
Veröffentlicht: (2024)
von: Zhu, Dawei, et al.
Veröffentlicht: (2024)
DocHPLT: A Massively Multilingual Document-Level Translation Dataset
von: O'Brien, Dayyán, et al.
Veröffentlicht: (2025)
von: O'Brien, Dayyán, et al.
Veröffentlicht: (2025)
Bilingual Adaptation of Monolingual Foundation Models
von: Gosal, Gurpreet, et al.
Veröffentlicht: (2024)
von: Gosal, Gurpreet, et al.
Veröffentlicht: (2024)
Parrot: Multilingual Visual Instruction Tuning
von: Sun, Hai-Long, et al.
Veröffentlicht: (2024)
von: Sun, Hai-Long, et al.
Veröffentlicht: (2024)
Distilling Monolingual and Crosslingual Word-in-Context Representations
von: Arase, Yuki, et al.
Veröffentlicht: (2024)
von: Arase, Yuki, et al.
Veröffentlicht: (2024)
Team QUST at SemEval-2024 Task 8: A Comprehensive Study of Monolingual and Multilingual Approaches for Detecting AI-generated Text
von: Xu, Xiaoman, et al.
Veröffentlicht: (2024)
von: Xu, Xiaoman, et al.
Veröffentlicht: (2024)
MultiLoKo: a multilingual local knowledge benchmark for LLMs spanning 31 languages
von: Hupkes, Dieuwke, et al.
Veröffentlicht: (2025)
von: Hupkes, Dieuwke, et al.
Veröffentlicht: (2025)
mEdIT: Multilingual Text Editing via Instruction Tuning
von: Raheja, Vipul, et al.
Veröffentlicht: (2024)
von: Raheja, Vipul, et al.
Veröffentlicht: (2024)
Instruction Embedding: Latent Representations of Instructions Towards Task Identification
von: Li, Yiwei, et al.
Veröffentlicht: (2024)
von: Li, Yiwei, et al.
Veröffentlicht: (2024)
Instruction Tuning With Loss Over Instructions
von: Shi, Zhengyan, et al.
Veröffentlicht: (2024)
von: Shi, Zhengyan, et al.
Veröffentlicht: (2024)
Learning From Mistakes Makes LLM Better Reasoner
von: An, Shengnan, et al.
Veröffentlicht: (2023)
von: An, Shengnan, et al.
Veröffentlicht: (2023)
Introducing cosmosGPT: Monolingual Training for Turkish Language Models
von: Kesgin, H. Toprak, et al.
Veröffentlicht: (2024)
von: Kesgin, H. Toprak, et al.
Veröffentlicht: (2024)
Pitfalls and Outlooks in Using COMET
von: Zouhar, Vilém, et al.
Veröffentlicht: (2024)
von: Zouhar, Vilém, et al.
Veröffentlicht: (2024)
Kakugo: Distillation of Low-Resource Languages into Small Language Models
von: Devine, Peter, et al.
Veröffentlicht: (2026)
von: Devine, Peter, et al.
Veröffentlicht: (2026)
NorEval: A Norwegian Language Understanding and Generation Evaluation Benchmark
von: Mikhailov, Vladislav, et al.
Veröffentlicht: (2025)
von: Mikhailov, Vladislav, et al.
Veröffentlicht: (2025)
M-IFEval: Multilingual Instruction-Following Evaluation
von: Dussolle, Antoine, et al.
Veröffentlicht: (2025)
von: Dussolle, Antoine, et al.
Veröffentlicht: (2025)
Exploring Linguistic Properties of Monolingual BERTs with Typological Classification among Languages
von: Ruzzetti, Elena Sofia, et al.
Veröffentlicht: (2023)
von: Ruzzetti, Elena Sofia, et al.
Veröffentlicht: (2023)
UrduLM: A Resource-Efficient Monolingual Urdu Language Model
von: Ali, Syed Muhammad, et al.
Veröffentlicht: (2026)
von: Ali, Syed Muhammad, et al.
Veröffentlicht: (2026)
XL-Suite: Cross-Lingual Synthetic Training and Evaluation Data for Open-Ended Generation
von: Iyer, Vivek, et al.
Veröffentlicht: (2025)
von: Iyer, Vivek, et al.
Veröffentlicht: (2025)
Eliciting Better Multilingual Structured Reasoning from LLMs through Code
von: Li, Bryan, et al.
Veröffentlicht: (2024)
von: Li, Bryan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Iterative Translation Refinement with Large Language Models
von: Chen, Pinzhen, et al.
Veröffentlicht: (2023) -
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
von: Chen, Pinzhen, et al.
Veröffentlicht: (2024) -
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
von: Bogoychev, Nikolay, et al.
Veröffentlicht: (2023) -
How Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOM
von: Ji, Shaoxiong, et al.
Veröffentlicht: (2024) -
MatheMagic: Generating Dynamic Mathematics Benchmarks Robust to Memorization
von: O'Brien, Dayyán, et al.
Veröffentlicht: (2025)