The Fine-Tuning Paradox: Boosting Translation Quality Without Sacrificing LLM Abilities
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Stap, David, Hasler, Eva, Byrne, Bill, Monz, Christof, Tran, Ke |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Effect of Language Diversity When Fine-Tuning Large Language Models for Translation
par: Stap, David, et autres
Publié: (2025)
par: Stap, David, et autres
Publié: (2025)
Can LLMs Really Learn to Translate a Low-Resource Language from One Grammar Book?
par: Aycock, Seth, et autres
Publié: (2024)
par: Aycock, Seth, et autres
Publié: (2024)
How Far Can 100 Samples Go? Unlocking Overall Zero-Shot Multilingual Translation via Tiny Multi-Parallel Data
par: Wu, Di, et autres
Publié: (2024)
par: Wu, Di, et autres
Publié: (2024)
Calibrating Translation Decoding with Quality Estimation on LLMs
par: Wu, Di, et autres
Publié: (2025)
par: Wu, Di, et autres
Publié: (2025)
A Preference-driven Paradigm for Enhanced Translation with Large Language Models
par: Zhu, Dawei, et autres
Publié: (2024)
par: Zhu, Dawei, et autres
Publié: (2024)
Remedy: Learning Machine Translation Evaluation from Human Preferences with Reward Modeling
par: Tan, Shaomu, et autres
Publié: (2025)
par: Tan, Shaomu, et autres
Publié: (2025)
Analyzing and Improving Cross-lingual Knowledge Transfer for Machine Translation
par: Stap, David
Publié: (2026)
par: Stap, David
Publié: (2026)
Please Translate Again: Two Simple Experiments on Whether Human-Like Reasoning Helps Translation
par: Wu, Di, et autres
Publié: (2025)
par: Wu, Di, et autres
Publié: (2025)
Beyond Shared Vocabulary: Increasing Representational Word Similarities across Languages for Multilingual Machine Translation
par: Wu, Di, et autres
Publié: (2023)
par: Wu, Di, et autres
Publié: (2023)
Disentangling the Roles of Target-Side Transfer and Regularization in Multilingual Machine Translation
par: Meng, Yan, et autres
Publié: (2024)
par: Meng, Yan, et autres
Publié: (2024)
ReasonXL: Shifting LLM Reasoning Language Without Sacrificing Performance
par: Gurgurov, Daniil, et autres
Publié: (2026)
par: Gurgurov, Daniil, et autres
Publié: (2026)
What Does LLM Refinement Actually Improve? A Systematic Study on Document-Level Literary Translation
par: Tan, Shaomu, et autres
Publié: (2026)
par: Tan, Shaomu, et autres
Publié: (2026)
How to Learn in a Noisy World? Self-Correcting the Real-World Data Noise in Machine Translation
par: Meng, Yan, et autres
Publié: (2024)
par: Meng, Yan, et autres
Publié: (2024)
On the Evaluation Practices in Multilingual NLP: Can Machine Translation Offer an Alternative to Human Translations?
par: Choenni, Rochelle, et autres
Publié: (2024)
par: Choenni, Rochelle, et autres
Publié: (2024)
IKUN for WMT24 General MT Task: LLMs Are here for Multilingual Machine Translation
par: Liao, Baohao, et autres
Publié: (2024)
par: Liao, Baohao, et autres
Publié: (2024)
Is It a Free Lunch for Removing Outliers during Pretraining?
par: Liao, Baohao, et autres
Publié: (2024)
par: Liao, Baohao, et autres
Publié: (2024)
Analyzing the Evaluation of Cross-Lingual Knowledge Transfer in Multilingual Language Models
par: Rajaee, Sara, et autres
Publié: (2024)
par: Rajaee, Sara, et autres
Publié: (2024)
3-in-1: 2D Rotary Adaptation for Efficient Finetuning, Efficient Batching and Composability
par: Liao, Baohao, et autres
Publié: (2024)
par: Liao, Baohao, et autres
Publié: (2024)
Control the Temperature: Selective Sampling for Diverse and High-Quality LLM Outputs
par: Troshin, Sergey, et autres
Publié: (2025)
par: Troshin, Sergey, et autres
Publié: (2025)
Exploring Fine-Tuning for In-Context Retrieval and Efficient KV-Caching in Long-Context Language Models
par: Molfese, Francesco Maria, et autres
Publié: (2026)
par: Molfese, Francesco Maria, et autres
Publié: (2026)
Neuron Specialization: Leveraging intrinsic task modularity for multilingual machine translation
par: Tan, Shaomu, et autres
Publié: (2024)
par: Tan, Shaomu, et autres
Publié: (2024)
Improving Translation Quality by Selecting Better Data for LLM Fine-Tuning: A Comparative Analysis
par: de Mello, Felipe Ribeiro Fujita, et autres
Publié: (2025)
par: de Mello, Felipe Ribeiro Fujita, et autres
Publié: (2025)
The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models
par: Chen, Xinyi, et autres
Publié: (2024)
par: Chen, Xinyi, et autres
Publié: (2024)
Boosting LLM Translation Skills without General Ability Loss via Rationale Distillation
par: Wu, Junhong, et autres
Publié: (2024)
par: Wu, Junhong, et autres
Publié: (2024)
Remedy-R: Generative Reasoning for Machine Translation Evaluation without Error Annotations
par: Tan, Shaomu, et autres
Publié: (2025)
par: Tan, Shaomu, et autres
Publié: (2025)
CITI: Enhancing Tool Utilizing Ability in Large Language Models without Sacrificing General Performance
par: Hao, Yupu, et autres
Publié: (2024)
par: Hao, Yupu, et autres
Publié: (2024)
Direct Preference Optimization for Neural Machine Translation with Minimum Bayes Risk Decoding
par: Yang, Guangyu, et autres
Publié: (2023)
par: Yang, Guangyu, et autres
Publié: (2023)
Do Language Models Reason Across Languages?
par: Meng, Yan, et autres
Publié: (2026)
par: Meng, Yan, et autres
Publié: (2026)
PreFLMR: Scaling Up Fine-Grained Late-Interaction Multi-modal Retrievers
par: Lin, Weizhe, et autres
Publié: (2024)
par: Lin, Weizhe, et autres
Publié: (2024)
When Contextual Inference Fails: Cancelability in Interactive Instruction Following
par: Bila, Natalia, et autres
Publié: (2026)
par: Bila, Natalia, et autres
Publié: (2026)
Communicating with Speakers and Listeners of Different Pragmatic Levels
par: Naszadi, Kata, et autres
Publié: (2024)
par: Naszadi, Kata, et autres
Publié: (2024)
Improving LLM Abilities in Idiomatic Translation
par: Donthi, Sundesh, et autres
Publié: (2024)
par: Donthi, Sundesh, et autres
Publié: (2024)
ECCO: Can We Improve Model-Generated Code Efficiency Without Sacrificing Functional Correctness?
par: Waghjale, Siddhant, et autres
Publié: (2024)
par: Waghjale, Siddhant, et autres
Publié: (2024)
ApiQ: Finetuning of 2-Bit Quantized Large Language Model
par: Liao, Baohao, et autres
Publié: (2024)
par: Liao, Baohao, et autres
Publié: (2024)
Best-of-L: Cross-Lingual Reward Modeling for Mathematical Reasoning
par: Rajaee, Sara, et autres
Publié: (2025)
par: Rajaee, Sara, et autres
Publié: (2025)
FineMedLM-o1: Enhancing Medical Knowledge Reasoning Ability of LLM from Supervised Fine-Tuning to Test-Time Training
par: Yu, Hongzhou, et autres
Publié: (2025)
par: Yu, Hongzhou, et autres
Publié: (2025)
Order-Independence Without Fine Tuning
par: McIlroy-Young, Reid, et autres
Publié: (2024)
par: McIlroy-Young, Reid, et autres
Publié: (2024)
What Does Neuro Mean to Cardio? Investigating the Role of Clinical Specialty Data in Medical LLMs
par: Yan, Xinlan, et autres
Publié: (2025)
par: Yan, Xinlan, et autres
Publié: (2025)
On the Limits of Model Merging for Multilinguality in Pre-Training
par: Aycock, Seth, et autres
Publié: (2026)
par: Aycock, Seth, et autres
Publié: (2026)
From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning
par: Li, Ming, et autres
Publié: (2023)
par: Li, Ming, et autres
Publié: (2023)
Documents similaires
-
The Effect of Language Diversity When Fine-Tuning Large Language Models for Translation
par: Stap, David, et autres
Publié: (2025) -
Can LLMs Really Learn to Translate a Low-Resource Language from One Grammar Book?
par: Aycock, Seth, et autres
Publié: (2024) -
How Far Can 100 Samples Go? Unlocking Overall Zero-Shot Multilingual Translation via Tiny Multi-Parallel Data
par: Wu, Di, et autres
Publié: (2024) -
Calibrating Translation Decoding with Quality Estimation on LLMs
par: Wu, Di, et autres
Publié: (2025) -
A Preference-driven Paradigm for Enhanced Translation with Large Language Models
par: Zhu, Dawei, et autres
Publié: (2024)