Fine-Tuned Machine Translation Metrics Struggle in Unseen Domains
Fuente:
arXiv
Salvato in:
| Autori principali: | Zouhar, Vilém, Ding, Shuoyang, Currey, Anna, Badeka, Tatyana, Wang, Jenyuan, Thompson, Brian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Quality and Quantity of Machine Translation References for Automatic Metrics
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
Unsupervised Word-level Quality Estimation for Machine Translation Through the Lens of Annotators (Dis)agreement
di: Sarti, Gabriele, et al.
Pubblicazione: (2025)
di: Sarti, Gabriele, et al.
Pubblicazione: (2025)
Stolen Subwords: Importance of Vocabularies for Machine Translation Model Stealing
di: Zouhar, Vilém
Pubblicazione: (2024)
di: Zouhar, Vilém
Pubblicazione: (2024)
How to Engage Your Readers? Generating Guiding Questions to Promote Active Reading
di: Cui, Peng, et al.
Pubblicazione: (2024)
di: Cui, Peng, et al.
Pubblicazione: (2024)
AI-Assisted Human Evaluation of Machine Translation
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
Tuning LLMs with Contrastive Alignment Instructions for Machine Translation in Unseen, Low-resource Languages
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2024)
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2024)
When LLMs Benchmark Themselves: Deconstructing Self-Bias in Automated Evaluation
di: Xu, Wenda, et al.
Pubblicazione: (2025)
di: Xu, Wenda, et al.
Pubblicazione: (2025)
Pearmut: Human Evaluation of Translation Made Trivial
di: Zouhar, Vilém, et al.
Pubblicazione: (2026)
di: Zouhar, Vilém, et al.
Pubblicazione: (2026)
Multilingual Performance Biases of Large Language Models in Education
di: Gupta, Vansh, et al.
Pubblicazione: (2025)
di: Gupta, Vansh, et al.
Pubblicazione: (2025)
Fine-Grained and Multi-Dimensional Metrics for Document-Level Machine Translation
di: Sun, Yirong, et al.
Pubblicazione: (2024)
di: Sun, Yirong, et al.
Pubblicazione: (2024)
A Bayesian Optimization Approach to Machine Translation Reranking
di: Cheng, Julius, et al.
Pubblicazione: (2024)
di: Cheng, Julius, et al.
Pubblicazione: (2024)
Estimating Machine Translation Difficulty
di: Proietti, Lorenzo, et al.
Pubblicazione: (2025)
di: Proietti, Lorenzo, et al.
Pubblicazione: (2025)
MetaMetrics-MT: Tuning Meta-Metrics for Machine Translation via Human Preference Calibration
di: Anugraha, David, et al.
Pubblicazione: (2024)
di: Anugraha, David, et al.
Pubblicazione: (2024)
Hearing to Translate: The Effectiveness of Speech Modality Integration into LLMs
di: Papi, Sara, et al.
Pubblicazione: (2025)
di: Papi, Sara, et al.
Pubblicazione: (2025)
RAG-QA Arena: Evaluating Domain Robustness for Long-form Retrieval Augmented Question Answering
di: Han, Rujun, et al.
Pubblicazione: (2024)
di: Han, Rujun, et al.
Pubblicazione: (2024)
COMET-poly: Machine Translation Metric Grounded in Other Candidates
di: Züfle, Maike, et al.
Pubblicazione: (2025)
di: Züfle, Maike, et al.
Pubblicazione: (2025)
Textual Similarity as a Key Metric in Machine Translation Quality Estimation
di: Sun, Kun, et al.
Pubblicazione: (2024)
di: Sun, Kun, et al.
Pubblicazione: (2024)
Fine-Tuned Language Models for Domain-Specific Summarization and Tagging
di: Wang, Jun, et al.
Pubblicazione: (2025)
di: Wang, Jun, et al.
Pubblicazione: (2025)
Beyond Correlation: Interpretable Evaluation of Machine Translation Metrics
di: Perrella, Stefano, et al.
Pubblicazione: (2024)
di: Perrella, Stefano, et al.
Pubblicazione: (2024)
A Shocking Amount of the Web is Machine Translated: Insights from Multi-Way Parallelism
di: Thompson, Brian, et al.
Pubblicazione: (2024)
di: Thompson, Brian, et al.
Pubblicazione: (2024)
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
di: Ni, Jingwei, et al.
Pubblicazione: (2025)
di: Ni, Jingwei, et al.
Pubblicazione: (2025)
AnyTaskTune: Advanced Domain-Specific Solutions through Task-Fine-Tuning
di: Cui, Jiaxi, et al.
Pubblicazione: (2024)
di: Cui, Jiaxi, et al.
Pubblicazione: (2024)
Evaluating Optimal Reference Translations
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
Guardians of the Machine Translation Meta-Evaluation: Sentinel Metrics Fall In!
di: Perrella, Stefano, et al.
Pubblicazione: (2024)
di: Perrella, Stefano, et al.
Pubblicazione: (2024)
Adding Chocolate to Mint: Mitigating Metric Interference in Machine Translation
di: Pombal, José, et al.
Pubblicazione: (2025)
di: Pombal, José, et al.
Pubblicazione: (2025)
LQM: Linguistically Motivated Multidimensional Quality Metrics for Machine Translation
di: Magdy, Samar M., et al.
Pubblicazione: (2026)
di: Magdy, Samar M., et al.
Pubblicazione: (2026)
Navigating the Metrics Maze: Reconciling Score Magnitudes and Accuracies
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
Improved Supervised Fine-Tuning for Large Language Models to Mitigate Catastrophic Forgetting
di: Ding, Fei, et al.
Pubblicazione: (2025)
di: Ding, Fei, et al.
Pubblicazione: (2025)
Fine-Tuning LLMs for Low-Resource Dialect Translation: The Case of Lebanese
di: Yakhni, Silvana, et al.
Pubblicazione: (2025)
di: Yakhni, Silvana, et al.
Pubblicazione: (2025)
From Scratch to Fine-Tuned: A Comparative Study of Transformer Training Strategies for Legal Machine Translation
di: Barman, Amit, et al.
Pubblicazione: (2025)
di: Barman, Amit, et al.
Pubblicazione: (2025)
Fine-Tuning Medical Language Models for Enhanced Long-Contextual Understanding and Domain Expertise
di: Yang, Qimin, et al.
Pubblicazione: (2024)
di: Yang, Qimin, et al.
Pubblicazione: (2024)
Improving Statistical Significance in Human Evaluation of Automatic Metrics via Soft Pairwise Accuracy
di: Thompson, Brian, et al.
Pubblicazione: (2024)
di: Thompson, Brian, et al.
Pubblicazione: (2024)
Trainable Reference-Based Evaluation Metric for Identifying Quality of English-Gujarati Machine Translation System
di: Joshi, Nisheeth, et al.
Pubblicazione: (2025)
di: Joshi, Nisheeth, et al.
Pubblicazione: (2025)
Adapting LLMs for the Medical Domain in Portuguese: A Study on Fine-Tuning and Model Evaluation
di: Paiola, Pedro Henrique, et al.
Pubblicazione: (2024)
di: Paiola, Pedro Henrique, et al.
Pubblicazione: (2024)
VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation
di: Pan, Jingheng, et al.
Pubblicazione: (2026)
di: Pan, Jingheng, et al.
Pubblicazione: (2026)
Natural Language Fine-Tuning
di: Liu, Jia, et al.
Pubblicazione: (2024)
di: Liu, Jia, et al.
Pubblicazione: (2024)
Improving Low-Resource Translation with Dictionary-Guided Fine-Tuning and RL: A Spanish-to-Wayuunaiki Study
di: Mosquera, Manuel, et al.
Pubblicazione: (2025)
di: Mosquera, Manuel, et al.
Pubblicazione: (2025)
How Important is `Perfect' English for Machine Translation Prompts?
di: Schmidtová, Patrícia, et al.
Pubblicazione: (2025)
di: Schmidtová, Patrícia, et al.
Pubblicazione: (2025)
Building Accurate Translation-Tailored LLMs with Language Aware Instruction Tuning
di: Zan, Changtong, et al.
Pubblicazione: (2024)
di: Zan, Changtong, et al.
Pubblicazione: (2024)
Domain-Adaptation through Synthetic Data: Fine-Tuning Large Language Models for German Law
di: Bashir, Ali Hamza, et al.
Pubblicazione: (2026)
di: Bashir, Ali Hamza, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Quality and Quantity of Machine Translation References for Automatic Metrics
di: Zouhar, Vilém, et al.
Pubblicazione: (2024) -
Unsupervised Word-level Quality Estimation for Machine Translation Through the Lens of Annotators (Dis)agreement
di: Sarti, Gabriele, et al.
Pubblicazione: (2025) -
Stolen Subwords: Importance of Vocabularies for Machine Translation Model Stealing
di: Zouhar, Vilém
Pubblicazione: (2024) -
How to Engage Your Readers? Generating Guiding Questions to Promote Active Reading
di: Cui, Peng, et al.
Pubblicazione: (2024) -
AI-Assisted Human Evaluation of Machine Translation
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)