Quality and Quantity of Machine Translation References for Automatic Metrics
Fuente:
arXiv
Salvato in:
| Autori principali: | Zouhar, Vilém, Bojar, Ondřej |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Evaluating Optimal Reference Translations
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
Multimodal Shannon Game with Images
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
Stolen Subwords: Importance of Vocabularies for Machine Translation Model Stealing
di: Zouhar, Vilém
Pubblicazione: (2024)
di: Zouhar, Vilém
Pubblicazione: (2024)
AI-Assisted Human Evaluation of Machine Translation
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
Pearmut: Human Evaluation of Translation Made Trivial
di: Zouhar, Vilém, et al.
Pubblicazione: (2026)
di: Zouhar, Vilém, et al.
Pubblicazione: (2026)
End-to-end Automatic Speech Recognition and Speech Translation: Integration of Speech Foundational Models and LLMs
di: Luu, Nam, et al.
Pubblicazione: (2025)
di: Luu, Nam, et al.
Pubblicazione: (2025)
Unsupervised Word-level Quality Estimation for Machine Translation Through the Lens of Annotators (Dis)agreement
di: Sarti, Gabriele, et al.
Pubblicazione: (2025)
di: Sarti, Gabriele, et al.
Pubblicazione: (2025)
Fine-Tuned Machine Translation Metrics Struggle in Unseen Domains
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
A Bayesian Optimization Approach to Machine Translation Reranking
di: Cheng, Julius, et al.
Pubblicazione: (2024)
di: Cheng, Julius, et al.
Pubblicazione: (2024)
Estimating Machine Translation Difficulty
di: Proietti, Lorenzo, et al.
Pubblicazione: (2025)
di: Proietti, Lorenzo, et al.
Pubblicazione: (2025)
Prompting LLMs: Length Control for Isometric Machine Translation
di: Javorský, Dávid, et al.
Pubblicazione: (2025)
di: Javorský, Dávid, et al.
Pubblicazione: (2025)
COMET-poly: Machine Translation Metric Grounded in Other Candidates
di: Züfle, Maike, et al.
Pubblicazione: (2025)
di: Züfle, Maike, et al.
Pubblicazione: (2025)
Navigating the Metrics Maze: Reconciling Score Magnitudes and Accuracies
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
Early-Exit and Instant Confidence Translation Quality Estimation
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
Better Late Than Never: Meta-Evaluation of Latency Metrics for Simultaneous Speech-to-Text Translation
di: Polák, Peter, et al.
Pubblicazione: (2025)
di: Polák, Peter, et al.
Pubblicazione: (2025)
Continuous Rating as Reliable Human Evaluation of Simultaneous Speech Translation
di: Javorský, Dávid, et al.
Pubblicazione: (2022)
di: Javorský, Dávid, et al.
Pubblicazione: (2022)
How Important is `Perfect' English for Machine Translation Prompts?
di: Schmidtová, Patrícia, et al.
Pubblicazione: (2025)
di: Schmidtová, Patrícia, et al.
Pubblicazione: (2025)
Long-Form End-to-End Speech Translation via Latent Alignment Segmentation
di: Polák, Peter, et al.
Pubblicazione: (2023)
di: Polák, Peter, et al.
Pubblicazione: (2023)
Evaluating the IWSLT2023 Speech Translation Tasks: Human Annotations, Automatic Metrics, and Segmentation
di: Sperber, Matthias, et al.
Pubblicazione: (2024)
di: Sperber, Matthias, et al.
Pubblicazione: (2024)
Distributional Properties of Subword Regularization
di: Cognetta, Marco, et al.
Pubblicazione: (2024)
di: Cognetta, Marco, et al.
Pubblicazione: (2024)
How to Select Datapoints for Efficient Human Evaluation of NLG Models?
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
Understanding the role of FFNs in driving multilingual behaviour in LLMs
di: Bhattacharya, Sunit, et al.
Pubblicazione: (2024)
di: Bhattacharya, Sunit, et al.
Pubblicazione: (2024)
Finetuning LLMs for EvaCun 2025 token prediction shared task
di: Jon, Josef, et al.
Pubblicazione: (2025)
di: Jon, Josef, et al.
Pubblicazione: (2025)
Intrinsic vs. Extrinsic Evaluation of Czech Sentence Embeddings: Semantic Relevance Doesn't Help with MT Evaluation
di: Barančíková, Petra, et al.
Pubblicazione: (2025)
di: Barančíková, Petra, et al.
Pubblicazione: (2025)
Error Span Annotation: A Balanced Approach for Human Evaluation of Machine Translation
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
AutoTutor meets Large Language Models: A Language Model Tutor with Rich Pedagogy and Guardrails
di: Chowdhury, Sankalan Pal, et al.
Pubblicazione: (2024)
di: Chowdhury, Sankalan Pal, et al.
Pubblicazione: (2024)
Generating Difficult-to-Translate Texts
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
Findings of the Third Automatic Minuting (AutoMin) Challenge
di: Shinde, Kartik, et al.
Pubblicazione: (2025)
di: Shinde, Kartik, et al.
Pubblicazione: (2025)
Overview of the Sensemaking Task at the ELOQUENT 2025 Lab: LLMs as Teachers, Students and Evaluators
di: Šindelář, Pavel, et al.
Pubblicazione: (2025)
di: Šindelář, Pavel, et al.
Pubblicazione: (2025)
Two Counterexamples to Tokenization and the Noiseless Channel
di: Cognetta, Marco, et al.
Pubblicazione: (2024)
di: Cognetta, Marco, et al.
Pubblicazione: (2024)
Biased Tales: Cultural and Topic Bias in Generating Children's Stories
di: Rooein, Donya, et al.
Pubblicazione: (2025)
di: Rooein, Donya, et al.
Pubblicazione: (2025)
MockConf: A Student Interpretation Dataset: Analysis, Word- and Span-level Alignment and Baselines
di: Javorský, Dávid, et al.
Pubblicazione: (2025)
di: Javorský, Dávid, et al.
Pubblicazione: (2025)
ParCzech4Speech: A New Speech Corpus Derived from Czech Parliamentary Data
di: Stankov, Vladislav, et al.
Pubblicazione: (2025)
di: Stankov, Vladislav, et al.
Pubblicazione: (2025)
How to Engage Your Readers? Generating Guiding Questions to Promote Active Reading
di: Cui, Peng, et al.
Pubblicazione: (2024)
di: Cui, Peng, et al.
Pubblicazione: (2024)
Can Automatic Metrics Assess High-Quality Translations?
di: Agrawal, Sweta, et al.
Pubblicazione: (2024)
di: Agrawal, Sweta, et al.
Pubblicazione: (2024)
QE4PE: Word-level Quality Estimation for Human Post-Editing
di: Sarti, Gabriele, et al.
Pubblicazione: (2025)
di: Sarti, Gabriele, et al.
Pubblicazione: (2025)
How "Real" is Your Real-Time Simultaneous Speech-to-Text Translation System?
di: Papi, Sara, et al.
Pubblicazione: (2024)
di: Papi, Sara, et al.
Pubblicazione: (2024)
Evaluating Automatic Metrics with Incremental Machine Translation Systems
di: Wu, Guojun, et al.
Pubblicazione: (2024)
di: Wu, Guojun, et al.
Pubblicazione: (2024)
Preliminary Ranking of WMT25 General Machine Translation Systems
di: Kocmi, Tom, et al.
Pubblicazione: (2025)
di: Kocmi, Tom, et al.
Pubblicazione: (2025)
LLMs as Span Annotators: A Comparative Study of LLMs and Humans
di: Kasner, Zdeněk, et al.
Pubblicazione: (2025)
di: Kasner, Zdeněk, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Evaluating Optimal Reference Translations
di: Zouhar, Vilém, et al.
Pubblicazione: (2023) -
Multimodal Shannon Game with Images
di: Zouhar, Vilém, et al.
Pubblicazione: (2023) -
Stolen Subwords: Importance of Vocabularies for Machine Translation Model Stealing
di: Zouhar, Vilém
Pubblicazione: (2024) -
AI-Assisted Human Evaluation of Machine Translation
di: Zouhar, Vilém, et al.
Pubblicazione: (2024) -
Pearmut: Human Evaluation of Translation Made Trivial
di: Zouhar, Vilém, et al.
Pubblicazione: (2026)