Fine-Grained and Multi-Dimensional Metrics for Document-Level Machine Translation
Fuente:
arXiv
Guardado en:
| Autores principales: | Sun, Yirong, Zhu, Dawei, Chen, Yanjun, Xiao, Erjia, Chen, Xinghao, Shen, Xiaoyu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models
por: Chen, Yanjun, et al.
Publicado: (2024)
por: Chen, Yanjun, et al.
Publicado: (2024)
Automatic Evaluation Metrics for Document-level Translation: Overview, Challenges and Trends
por: GUO, Jiaxin, et al.
Publicado: (2025)
por: GUO, Jiaxin, et al.
Publicado: (2025)
Fine-Tuned Machine Translation Metrics Struggle in Unseen Domains
por: Zouhar, Vilém, et al.
Publicado: (2024)
por: Zouhar, Vilém, et al.
Publicado: (2024)
MultiJustice: A Chinese Dataset for Multi-Party, Multi-Charge Legal Prediction
por: Wang, Xiao, et al.
Publicado: (2025)
por: Wang, Xiao, et al.
Publicado: (2025)
Align-then-Slide: A complete evaluation framework for Ultra-Long Document-Level Machine Translation
por: Guo, Jiaxin, et al.
Publicado: (2025)
por: Guo, Jiaxin, et al.
Publicado: (2025)
LLaSO: A Foundational Framework for Reproducible Research in Large Language and Speech Model
por: Sun, Yirong, et al.
Publicado: (2025)
por: Sun, Yirong, et al.
Publicado: (2025)
Textual Similarity as a Key Metric in Machine Translation Quality Estimation
por: Sun, Kun, et al.
Publicado: (2024)
por: Sun, Kun, et al.
Publicado: (2024)
DelTA: An Online Document-Level Translation Agent Based on Multi-Level Memory
por: Wang, Yutong, et al.
Publicado: (2024)
por: Wang, Yutong, et al.
Publicado: (2024)
Beyond Semantics: Measuring Fine-Grained Emotion Preservation in Small Language Model-Based Machine Translation
por: Wisniewski, Dawid, et al.
Publicado: (2026)
por: Wisniewski, Dawid, et al.
Publicado: (2026)
Beyond Correlation: Interpretable Evaluation of Machine Translation Metrics
por: Perrella, Stefano, et al.
Publicado: (2024)
por: Perrella, Stefano, et al.
Publicado: (2024)
Beyond Global Emotion: Fine-Grained Emotional Speech Synthesis with Dynamic Word-Level Modulation
por: Wang, Sirui, et al.
Publicado: (2025)
por: Wang, Sirui, et al.
Publicado: (2025)
UniSumEval: Towards Unified, Fine-Grained, Multi-Dimensional Summarization Evaluation for LLMs
por: Lee, Yuho, et al.
Publicado: (2024)
por: Lee, Yuho, et al.
Publicado: (2024)
Guardians of the Machine Translation Meta-Evaluation: Sentinel Metrics Fall In!
por: Perrella, Stefano, et al.
Publicado: (2024)
por: Perrella, Stefano, et al.
Publicado: (2024)
Adding Chocolate to Mint: Mitigating Metric Interference in Machine Translation
por: Pombal, José, et al.
Publicado: (2025)
por: Pombal, José, et al.
Publicado: (2025)
LQM: Linguistically Motivated Multidimensional Quality Metrics for Machine Translation
por: Magdy, Samar M., et al.
Publicado: (2026)
por: Magdy, Samar M., et al.
Publicado: (2026)
Span-Level Machine Translation Meta-Evaluation
por: Perrella, Stefano, et al.
Publicado: (2026)
por: Perrella, Stefano, et al.
Publicado: (2026)
Towards Fine-Grained Code-Switch Speech Translation with Semantic Space Alignment
por: Gao, Yan, et al.
Publicado: (2025)
por: Gao, Yan, et al.
Publicado: (2025)
From Calculation to Adjudication: Examining LLM judges on Mathematical Reasoning Tasks
por: Stephan, Andreas, et al.
Publicado: (2024)
por: Stephan, Andreas, et al.
Publicado: (2024)
Enhancing Document-Level Machine Translation via Filtered Synthetic Corpora and Two-Stage LLM Adaptation
por: Kim, Ireh, et al.
Publicado: (2026)
por: Kim, Ireh, et al.
Publicado: (2026)
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
por: Pang, Jinlong, et al.
Publicado: (2025)
por: Pang, Jinlong, et al.
Publicado: (2025)
Multi-Party Supervised Fine-tuning of Language Models for Multi-Party Dialogue Generation
por: Wang, Xiaoyu, et al.
Publicado: (2024)
por: Wang, Xiaoyu, et al.
Publicado: (2024)
Examining the Metrics for Document-Level Claim Extraction in Czech and Slovak
por: Makaiova, Lucia, et al.
Publicado: (2025)
por: Makaiova, Lucia, et al.
Publicado: (2025)
Integrating Chain-of-Thought for Multimodal Alignment: A Study on 3D Vision-Language Learning
por: Chen, Yanjun, et al.
Publicado: (2025)
por: Chen, Yanjun, et al.
Publicado: (2025)
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
por: Qu, Changle, et al.
Publicado: (2026)
por: Qu, Changle, et al.
Publicado: (2026)
Pi-SQL: Enhancing Text-to-SQL with Fine-Grained Guidance from Pivot Programming Languages
por: chi, Yongdong, et al.
Publicado: (2025)
por: chi, Yongdong, et al.
Publicado: (2025)
Hybrid OCR-LLM Framework for Enterprise-Scale Document Information Extraction Under Copy-heavy Task
por: Wang, Zilong, et al.
Publicado: (2025)
por: Wang, Zilong, et al.
Publicado: (2025)
Interplay of Machine Translation, Diacritics, and Diacritization
por: Chen, Wei-Rui, et al.
Publicado: (2024)
por: Chen, Wei-Rui, et al.
Publicado: (2024)
Fine-Grained Detection of AI-Generated Text Using Sentence-Level Segmentation
por: Teja, Lekkala Sai, et al.
Publicado: (2025)
por: Teja, Lekkala Sai, et al.
Publicado: (2025)
Mind the Generation Process: Fine-Grained Confidence Estimation During LLM Generation
por: Han, Jinyi, et al.
Publicado: (2025)
por: Han, Jinyi, et al.
Publicado: (2025)
Audio ControlNet for Fine-Grained Audio Generation and Editing
por: Zhu, Haina, et al.
Publicado: (2026)
por: Zhu, Haina, et al.
Publicado: (2026)
InFi-Check: Interpretable and Fine-Grained Fact-Checking of LLMs
por: Bai, Yuzhuo, et al.
Publicado: (2026)
por: Bai, Yuzhuo, et al.
Publicado: (2026)
Trainable Reference-Based Evaluation Metric for Identifying Quality of English-Gujarati Machine Translation System
por: Joshi, Nisheeth, et al.
Publicado: (2025)
por: Joshi, Nisheeth, et al.
Publicado: (2025)
PartialFormer: Modeling Part Instead of Whole for Machine Translation
por: Zheng, Tong, et al.
Publicado: (2023)
por: Zheng, Tong, et al.
Publicado: (2023)
MetaMetrics-MT: Tuning Meta-Metrics for Machine Translation via Human Preference Calibration
por: Anugraha, David, et al.
Publicado: (2024)
por: Anugraha, David, et al.
Publicado: (2024)
LCS: A Language Converter Strategy for Zero-Shot Neural Machine Translation
por: Sun, Zengkui, et al.
Publicado: (2024)
por: Sun, Zengkui, et al.
Publicado: (2024)
SKA-Bench: A Fine-Grained Benchmark for Evaluating Structured Knowledge Understanding of LLMs
por: Liu, Zhiqiang, et al.
Publicado: (2025)
por: Liu, Zhiqiang, et al.
Publicado: (2025)
FB-Bench: A Fine-Grained Multi-Task Benchmark for Evaluating LLMs' Responsiveness to Human Feedback
por: Li, Youquan, et al.
Publicado: (2024)
por: Li, Youquan, et al.
Publicado: (2024)
Contextual Refinement of Translations: Large Language Models for Sentence and Document-Level Post-Editing
por: Koneru, Sai, et al.
Publicado: (2023)
por: Koneru, Sai, et al.
Publicado: (2023)
A Positive-Unlabeled Metric Learning Framework for Document-Level Relation Extraction with Incomplete Labeling
por: Wang, Ye, et al.
Publicado: (2023)
por: Wang, Ye, et al.
Publicado: (2023)
Recycling Failures: Salvaging Exploration in RLVR via Fine-Grained Off-Policy Guidance
por: Ren, Yanwei, et al.
Publicado: (2026)
por: Ren, Yanwei, et al.
Publicado: (2026)
Ejemplares similares
-
The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models
por: Chen, Yanjun, et al.
Publicado: (2024) -
Automatic Evaluation Metrics for Document-level Translation: Overview, Challenges and Trends
por: GUO, Jiaxin, et al.
Publicado: (2025) -
Fine-Tuned Machine Translation Metrics Struggle in Unseen Domains
por: Zouhar, Vilém, et al.
Publicado: (2024) -
MultiJustice: A Chinese Dataset for Multi-Party, Multi-Charge Legal Prediction
por: Wang, Xiao, et al.
Publicado: (2025) -
Align-then-Slide: A complete evaluation framework for Ultra-Long Document-Level Machine Translation
por: Guo, Jiaxin, et al.
Publicado: (2025)