Preliminary Ranking of WMT25 General Machine Translation Systems
Fuente:
arXiv
Salvato in:
| Autori principali: | Kocmi, Tom, Avramidis, Eleftherios, Bawden, Rachel, Bojar, Ondřej, Dranch, Konstantin, Dvorkovich, Anton, Dukanov, Sergey, Fedorova, Natalia, Fishel, Mark, Freitag, Markus, Gowda, Thamme, Grundkiewicz, Roman, Haddow, Barry, Karpinska, Marzena, Koehn, Philipp, Lakougna, Howard, Lundin, Jessica, Murray, Kenton, Nagata, Masaaki, Perrella, Stefano, Proietti, Lorenzo, Popel, Martin, Popović, Maja, Riley, Parker, Shmatova, Mariya, Steingrímsson, Steinþór, Yankovskaya, Lisa, Zouhar, Vilém |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Preliminary WMT24 Ranking of General MT Systems and LLMs
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
Error Span Annotation: A Balanced Approach for Human Evaluation of Machine Translation
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
Evaluating Optimal Reference Translations
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
Pearmut: Human Evaluation of Translation Made Trivial
di: Zouhar, Vilém, et al.
Pubblicazione: (2026)
di: Zouhar, Vilém, et al.
Pubblicazione: (2026)
Quality and Quantity of Machine Translation References for Automatic Metrics
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
Estimating Machine Translation Difficulty
di: Proietti, Lorenzo, et al.
Pubblicazione: (2025)
di: Proietti, Lorenzo, et al.
Pubblicazione: (2025)
Cogs in a Machine, Doing What They're Meant to Do -- The AMI Submission to the WMT24 General Translation Task
di: Jasonarson, Atli, et al.
Pubblicazione: (2024)
di: Jasonarson, Atli, et al.
Pubblicazione: (2024)
AI-Assisted Human Evaluation of Machine Translation
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
Multimodal Shannon Game with Images
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
Navigating the Metrics Maze: Reconciling Score Magnitudes and Accuracies
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
Stolen Subwords: Importance of Vocabularies for Machine Translation Model Stealing
di: Zouhar, Vilém
Pubblicazione: (2024)
di: Zouhar, Vilém
Pubblicazione: (2024)
Pitfalls and Outlooks in Using COMET
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
Killing Two Flies with One Stone: An Attempt to Break LLMs Using English->Icelandic Idioms and Proper Names
di: Ármannsson, Bjarki, et al.
Pubblicazione: (2024)
di: Ármannsson, Bjarki, et al.
Pubblicazione: (2024)
PyMarian: Fast Neural Machine Translation and Evaluation in Python
di: Gowda, Thamme, et al.
Pubblicazione: (2024)
di: Gowda, Thamme, et al.
Pubblicazione: (2024)
Distributional Properties of Subword Regularization
di: Cognetta, Marco, et al.
Pubblicazione: (2024)
di: Cognetta, Marco, et al.
Pubblicazione: (2024)
How to Select Datapoints for Efficient Human Evaluation of NLG Models?
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
AutoTutor meets Large Language Models: A Language Model Tutor with Rich Pedagogy and Guardrails
di: Chowdhury, Sankalan Pal, et al.
Pubblicazione: (2024)
di: Chowdhury, Sankalan Pal, et al.
Pubblicazione: (2024)
Who Benchmarks the Benchmarks? A Case Study of LLM Evaluation in Icelandic
di: Ingimundarson, Finnur Ágúst, et al.
Pubblicazione: (2026)
di: Ingimundarson, Finnur Ágúst, et al.
Pubblicazione: (2026)
How Uncertainty Estimation Scales with Sampling in Reasoning Models
di: Del, Maksym, et al.
Pubblicazione: (2026)
di: Del, Maksym, et al.
Pubblicazione: (2026)
Biased Tales: Cultural and Topic Bias in Generating Children's Stories
di: Rooein, Donya, et al.
Pubblicazione: (2025)
di: Rooein, Donya, et al.
Pubblicazione: (2025)
Unsupervised Word-level Quality Estimation for Machine Translation Through the Lens of Annotators (Dis)agreement
di: Sarti, Gabriele, et al.
Pubblicazione: (2025)
di: Sarti, Gabriele, et al.
Pubblicazione: (2025)
A Bayesian Optimization Approach to Machine Translation Reranking
di: Cheng, Julius, et al.
Pubblicazione: (2024)
di: Cheng, Julius, et al.
Pubblicazione: (2024)
How to Engage Your Readers? Generating Guiding Questions to Promote Active Reading
di: Cui, Peng, et al.
Pubblicazione: (2024)
di: Cui, Peng, et al.
Pubblicazione: (2024)
Two Counterexamples to Tokenization and the Noiseless Channel
di: Cognetta, Marco, et al.
Pubblicazione: (2024)
di: Cognetta, Marco, et al.
Pubblicazione: (2024)
CafGa: Customizing Feature Attributions to Explain Language Models
di: Boyle, Alan, et al.
Pubblicazione: (2025)
di: Boyle, Alan, et al.
Pubblicazione: (2025)
NEXT-GENERATION INTELLIGENT AUDIT: INNOVATIVE TRANSFORMATION AND STRATEGIC EVOLUTION OF FINANCIAL CONTROL THROUGH AI, XAI, AND AUTONOMOUS DIGITAL PLATFORMS
di: Popel, Serhii
Pubblicazione: (2025)
di: Popel, Serhii
Pubblicazione: (2025)
When LLMs Benchmark Themselves: Deconstructing Self-Bias in Automated Evaluation
di: Xu, Wenda, et al.
Pubblicazione: (2025)
di: Xu, Wenda, et al.
Pubblicazione: (2025)
Findings of the WMT 2024 Shared Task on Discourse-Level Literary Translation
di: Wang, Longyue, et al.
Pubblicazione: (2024)
di: Wang, Longyue, et al.
Pubblicazione: (2024)
Multilingual Performance Biases of Large Language Models in Education
di: Gupta, Vansh, et al.
Pubblicazione: (2025)
di: Gupta, Vansh, et al.
Pubblicazione: (2025)
WMT24++: Expanding the Language Coverage of WMT24 to 55 Languages & Dialects
di: Deutsch, Daniel, et al.
Pubblicazione: (2025)
di: Deutsch, Daniel, et al.
Pubblicazione: (2025)
Rediseño de imagen corporativa / Catharine Fishel
di: Fishel, Catharine
di: Fishel, Catharine
Error Norm Truncation: Robust Training in the Presence of Data Noise for Text Generation Models
di: Li, Tianjian, et al.
Pubblicazione: (2023)
di: Li, Tianjian, et al.
Pubblicazione: (2023)
Fine-Tuned Machine Translation Metrics Struggle in Unseen Domains
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
Early-Exit and Instant Confidence Translation Quality Estimation
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
Information and Digital Literacies: A Review of Concepts.
di: Bawden, David
Pubblicazione: (2001)
di: Bawden, David
Pubblicazione: (2001)
Revisión de los conceptos de alfabetización informacional y alfabetización digital
di: David Bawden
Pubblicazione: (2002)
di: David Bawden
Pubblicazione: (2002)
RELIC: Investigating Large Language Model Responses using Self-Consistency
di: Cheng, Furui, et al.
Pubblicazione: (2023)
di: Cheng, Furui, et al.
Pubblicazione: (2023)
QE4PE: Word-level Quality Estimation for Human Post-Editing
di: Sarti, Gabriele, et al.
Pubblicazione: (2025)
di: Sarti, Gabriele, et al.
Pubblicazione: (2025)
Deformations of pullback foliations
di: Perrella, Pablo
Pubblicazione: (2024)
di: Perrella, Pablo
Pubblicazione: (2024)
Closed orbits of MHD equilibria with orientation-reversing symmetry
di: Perrella, David
Pubblicazione: (2024)
di: Perrella, David
Pubblicazione: (2024)
Documenti analoghi
-
Preliminary WMT24 Ranking of General MT Systems and LLMs
di: Kocmi, Tom, et al.
Pubblicazione: (2024) -
Error Span Annotation: A Balanced Approach for Human Evaluation of Machine Translation
di: Kocmi, Tom, et al.
Pubblicazione: (2024) -
Evaluating Optimal Reference Translations
di: Zouhar, Vilém, et al.
Pubblicazione: (2023) -
Pearmut: Human Evaluation of Translation Made Trivial
di: Zouhar, Vilém, et al.
Pubblicazione: (2026) -
Quality and Quantity of Machine Translation References for Automatic Metrics
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)