Fine-Tuning Large Language Models to Translate: Will a Touch of Noisy Data in Misaligned Languages Suffice?
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Dawei, Chen, Pinzhen, Zhang, Miaoran, Haddow, Barry, Shen, Xiaoyu, Klakow, Dietrich |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Iterative Translation Refinement with Large Language Models
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
di: Chen, Pinzhen, et al.
Pubblicazione: (2024)
di: Chen, Pinzhen, et al.
Pubblicazione: (2024)
Context and System Fusion in Post-ASR Emotion Recognition with Large Language Models
di: Stepachev, Pavel, et al.
Pubblicazione: (2024)
di: Stepachev, Pavel, et al.
Pubblicazione: (2024)
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
di: Bogoychev, Nikolay, et al.
Pubblicazione: (2023)
di: Bogoychev, Nikolay, et al.
Pubblicazione: (2023)
A Preference-driven Paradigm for Enhanced Translation with Large Language Models
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
Quality or Quantity? On Data Scale and Diversity in Adapting Large Language Models for Low-Resource Translation
di: Iyer, Vivek, et al.
Pubblicazione: (2024)
di: Iyer, Vivek, et al.
Pubblicazione: (2024)
Human Speech Perception in Noise: Can Large Language Models Paraphrase to Improve It?
di: Chingacham, Anupama, et al.
Pubblicazione: (2024)
di: Chingacham, Anupama, et al.
Pubblicazione: (2024)
HBO: Hierarchical Balancing Optimization for Fine-Tuning Large Language Models
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
Exploring the Effectiveness and Consistency of Task Selection in Intermediate-Task Transfer Learning
di: Lin, Pin-Jie, et al.
Pubblicazione: (2024)
di: Lin, Pin-Jie, et al.
Pubblicazione: (2024)
AAdaM at SemEval-2024 Task 1: Augmentation and Adaptation for Multilingual Semantic Textual Relatedness
di: Zhang, Miaoran, et al.
Pubblicazione: (2024)
di: Zhang, Miaoran, et al.
Pubblicazione: (2024)
Monolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
DocHPLT: A Massively Multilingual Document-Level Translation Dataset
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
MatheMagic: Generating Dynamic Mathematics Benchmarks Robust to Memorization
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
Fine-tuning Large Language Models with Sequential Instructions
di: Hu, Hanxu, et al.
Pubblicazione: (2024)
di: Hu, Hanxu, et al.
Pubblicazione: (2024)
EMMA-500: Enhancing Massively Multilingual Adaptation of Large Language Models
di: Ji, Shaoxiong, et al.
Pubblicazione: (2024)
di: Ji, Shaoxiong, et al.
Pubblicazione: (2024)
Bridging the Language Gaps in Large Language Models with Inference-Time Cross-Lingual Intervention
di: Wang, Weixuan, et al.
Pubblicazione: (2024)
di: Wang, Weixuan, et al.
Pubblicazione: (2024)
The Impact of Demonstrations on Multilingual In-Context Learning: A Multidimensional Analysis
di: Zhang, Miaoran, et al.
Pubblicazione: (2024)
di: Zhang, Miaoran, et al.
Pubblicazione: (2024)
Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics
di: Al-Khalili, Zena, et al.
Pubblicazione: (2025)
di: Al-Khalili, Zena, et al.
Pubblicazione: (2025)
Pitfalls and Outlooks in Using COMET
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
When Does Monolingual Data Help Multilingual Translation: The Role of Domain and Model Scale
di: Baziotis, Christos, et al.
Pubblicazione: (2023)
di: Baziotis, Christos, et al.
Pubblicazione: (2023)
How Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOM
di: Ji, Shaoxiong, et al.
Pubblicazione: (2024)
di: Ji, Shaoxiong, et al.
Pubblicazione: (2024)
Assessing "Implicit" Retrieval Robustness of Large Language Models
di: Shen, Xiaoyu, et al.
Pubblicazione: (2024)
di: Shen, Xiaoyu, et al.
Pubblicazione: (2024)
To Preserve or To Compress: An In-Depth Study of Connector Selection in Multimodal Large Language Models
di: Lin, Junyan, et al.
Pubblicazione: (2024)
di: Lin, Junyan, et al.
Pubblicazione: (2024)
Improving Semantic Understanding in Speech Language Models via Brain-tuning
di: Moussa, Omer, et al.
Pubblicazione: (2024)
di: Moussa, Omer, et al.
Pubblicazione: (2024)
Utilizing Multimodal Data for Edge Case Robust Call-sign Recognition and Understanding
di: Blatt, Alexander, et al.
Pubblicazione: (2024)
di: Blatt, Alexander, et al.
Pubblicazione: (2024)
The Effect of Language Diversity When Fine-Tuning Large Language Models for Translation
di: Stap, David, et al.
Pubblicazione: (2025)
di: Stap, David, et al.
Pubblicazione: (2025)
Self-Checker: Plug-and-Play Modules for Fact-Checking with Large Language Models
di: Li, Miaoran, et al.
Pubblicazione: (2023)
di: Li, Miaoran, et al.
Pubblicazione: (2023)
Unveiling the Key Factors for Distilling Chain-of-Thought Reasoning
di: Chen, Xinghao, et al.
Pubblicazione: (2025)
di: Chen, Xinghao, et al.
Pubblicazione: (2025)
How Multilingual Are Large Language Models Fine-Tuned for Translation?
di: Richburg, Aquia, et al.
Pubblicazione: (2024)
di: Richburg, Aquia, et al.
Pubblicazione: (2024)
Fine-Grained and Multi-Dimensional Metrics for Document-Level Machine Translation
di: Sun, Yirong, et al.
Pubblicazione: (2024)
di: Sun, Yirong, et al.
Pubblicazione: (2024)
Robust Pronoun Fidelity with English LLMs: Are they Reasoning, Repeating, or Just Biased?
di: Gautam, Vagrant, et al.
Pubblicazione: (2024)
di: Gautam, Vagrant, et al.
Pubblicazione: (2024)
Compact Speech Translation Models via Discrete Speech Units Pretraining
di: Lam, Tsz Kin, et al.
Pubblicazione: (2024)
di: Lam, Tsz Kin, et al.
Pubblicazione: (2024)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
AfriMTEB and AfriE5: Benchmarking and Adapting Text Embedding Models for African Languages
di: Uemura, Kosei, et al.
Pubblicazione: (2025)
di: Uemura, Kosei, et al.
Pubblicazione: (2025)
Improving Multilingual Retrieval-Augmented Language Models through Dialectic Reasoning Argumentations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
Kakugo: Distillation of Low-Resource Languages into Small Language Models
di: Devine, Peter, et al.
Pubblicazione: (2026)
di: Devine, Peter, et al.
Pubblicazione: (2026)
HFT: Half Fine-Tuning for Large Language Models
di: Hui, Tingfeng, et al.
Pubblicazione: (2024)
di: Hui, Tingfeng, et al.
Pubblicazione: (2024)
The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models
di: Chen, Yanjun, et al.
Pubblicazione: (2024)
di: Chen, Yanjun, et al.
Pubblicazione: (2024)
Automated Data Curation for Robust Language Model Fine-Tuning
di: Chen, Jiuhai, et al.
Pubblicazione: (2024)
di: Chen, Jiuhai, et al.
Pubblicazione: (2024)
Prosody in Cascade and Direct Speech-to-Text Translation: a case study on Korean Wh-Phrases
di: Zhou, Giulio, et al.
Pubblicazione: (2024)
di: Zhou, Giulio, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Iterative Translation Refinement with Large Language Models
di: Chen, Pinzhen, et al.
Pubblicazione: (2023) -
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
di: Chen, Pinzhen, et al.
Pubblicazione: (2024) -
Context and System Fusion in Post-ASR Emotion Recognition with Large Language Models
di: Stepachev, Pavel, et al.
Pubblicazione: (2024) -
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
di: Bogoychev, Nikolay, et al.
Pubblicazione: (2023) -
A Preference-driven Paradigm for Enhanced Translation with Large Language Models
di: Zhu, Dawei, et al.
Pubblicazione: (2024)