Beyond Scalar Scores: Reinforcement Learning for Error-Aware Quality Estimation of Machine Translation
Fuente:
arXiv
Salvato in:
| Autori principali: | Sindhujan, Archchana, Koushik, Girish A., Qian, Shenbin, Kanojia, Diptesh, Orăsan, Constantin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
When LLMs Struggle: Reference-less Translation Evaluation for Low-resource Languages
di: Sindhujan, Archchana, et al.
Pubblicazione: (2025)
di: Sindhujan, Archchana, et al.
Pubblicazione: (2025)
ALOPE: Adaptive Layer Optimization for Translation Quality Estimation using Large Language Models
di: Sindhujan, Archchana, et al.
Pubblicazione: (2025)
di: Sindhujan, Archchana, et al.
Pubblicazione: (2025)
What do Large Language Models Need for Machine Translation Evaluation?
di: Qian, Shenbin, et al.
Pubblicazione: (2024)
di: Qian, Shenbin, et al.
Pubblicazione: (2024)
Are Large Language Models State-of-the-art Quality Estimators for Machine Translation of User-generated Content?
di: Qian, Shenbin, et al.
Pubblicazione: (2024)
di: Qian, Shenbin, et al.
Pubblicazione: (2024)
Automatically Generating Chinese Homophone Words to Probe Machine Translation Estimation Systems
di: Qian, Shenbin, et al.
Pubblicazione: (2025)
di: Qian, Shenbin, et al.
Pubblicazione: (2025)
Domain-Specific Quality Estimation for Machine Translation in Low-Resource Scenarios
di: Gurav, Namrata Patil, et al.
Pubblicazione: (2026)
di: Gurav, Namrata Patil, et al.
Pubblicazione: (2026)
A Multi-task Learning Framework for Evaluating Machine Translation of Emotion-loaded User-generated Content
di: Qian, Shenbin, et al.
Pubblicazione: (2024)
di: Qian, Shenbin, et al.
Pubblicazione: (2024)
The Mind's Eye: A Multi-Faceted Reward Framework for Guiding Visual Metaphor Generation
di: Koushik, Girish A., et al.
Pubblicazione: (2025)
di: Koushik, Girish A., et al.
Pubblicazione: (2025)
NEAR$^2$: A Nested Embedding Approach to Efficient Product Retrieval and Ranking
di: Qian, Shenbin, et al.
Pubblicazione: (2025)
di: Qian, Shenbin, et al.
Pubblicazione: (2025)
Google Translate Error Analysis for Mental Healthcare Information: Evaluating Accuracy, Comprehensibility, and Implications for Multilingual Healthcare Communication
di: Delfani, Jaleh, et al.
Pubblicazione: (2024)
di: Delfani, Jaleh, et al.
Pubblicazione: (2024)
Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content
di: Koushik, Girish A., et al.
Pubblicazione: (2025)
di: Koushik, Girish A., et al.
Pubblicazione: (2025)
TRACE: Textual Relevance Augmentation and Contextual Encoding for Multimodal Hate Detection
di: Koushik, Girish A., et al.
Pubblicazione: (2025)
di: Koushik, Girish A., et al.
Pubblicazione: (2025)
Cyber Risks of Machine Translation Critical Errors : Arabic Mental Health Tweets as a Case Study
di: Saadany, Hadeel, et al.
Pubblicazione: (2024)
di: Saadany, Hadeel, et al.
Pubblicazione: (2024)
Cyberbullying Detection via Aggression-Enhanced Prompting
di: Saeid, Aisha, et al.
Pubblicazione: (2025)
di: Saeid, Aisha, et al.
Pubblicazione: (2025)
Parameter-Efficient Quality Estimation via Frozen Recursive Models
di: Abubacar, Umar, et al.
Pubblicazione: (2026)
di: Abubacar, Umar, et al.
Pubblicazione: (2026)
Giving the Old a Fresh Spin: Quality Estimation-Assisted Constrained Decoding for Automatic Post-Editing
di: Deoghare, Sourabh, et al.
Pubblicazione: (2025)
di: Deoghare, Sourabh, et al.
Pubblicazione: (2025)
Why do Large Language Models Fail in Low-resource Translation? Unraveling the Token Dynamics of Large Language Models for Machine Translation
di: Qian, Shenbin, et al.
Pubblicazione: (2026)
di: Qian, Shenbin, et al.
Pubblicazione: (2026)
Edit Distances and Their Applications to Downstream Tasks in Research and Commercial Contexts
di: Carmo, Félix do, et al.
Pubblicazione: (2024)
di: Carmo, Félix do, et al.
Pubblicazione: (2024)
Together We Can: Multilingual Automatic Post-Editing for Low-Resource Languages
di: Deoghare, Sourabh, et al.
Pubblicazione: (2024)
di: Deoghare, Sourabh, et al.
Pubblicazione: (2024)
Experiences from Creating a Benchmark for Sentiment Classification for Varieties of English
di: Srirag, Dipankar, et al.
Pubblicazione: (2024)
di: Srirag, Dipankar, et al.
Pubblicazione: (2024)
Integrating automatic speech recognition into remote healthcare interpreting: A pilot study of its impact on interpreting quality
di: Tan, Shiyi, et al.
Pubblicazione: (2025)
di: Tan, Shiyi, et al.
Pubblicazione: (2025)
Benchmarking terminology building capabilities of ChatGPT on an English-Russian Fashion Corpus
di: Bezobrazova, Anastasiia, et al.
Pubblicazione: (2024)
di: Bezobrazova, Anastasiia, et al.
Pubblicazione: (2024)
BESSTIE: A Benchmark for Sentiment and Sarcasm Classification for Varieties of English
di: Srirag, Dipankar, et al.
Pubblicazione: (2024)
di: Srirag, Dipankar, et al.
Pubblicazione: (2024)
GCDance: Genre-Controlled Music-Driven 3D Full Body Dance Generation
di: Liu, Xinran, et al.
Pubblicazione: (2025)
di: Liu, Xinran, et al.
Pubblicazione: (2025)
A Survey of Multimodal Sarcasm Detection
di: Farabi, Shafkat, et al.
Pubblicazione: (2024)
di: Farabi, Shafkat, et al.
Pubblicazione: (2024)
Centrality-aware Product Retrieval and Ranking
di: Saadany, Hadeel, et al.
Pubblicazione: (2024)
di: Saadany, Hadeel, et al.
Pubblicazione: (2024)
Connecting Ideas in 'Lower-Resource' Scenarios: NLP for National Varieties, Creoles and Other Low-resource Scenarios
di: Joshi, Aditya, et al.
Pubblicazione: (2024)
di: Joshi, Aditya, et al.
Pubblicazione: (2024)
Human-Centred Evaluation of Text-to-Image Generation Models for Self-expression of Mental Distress: A Dataset Based on GPT-4o
di: He, Sui, et al.
Pubblicazione: (2025)
di: He, Sui, et al.
Pubblicazione: (2025)
Guiding In-Context Learning of LLMs through Quality Estimation for Machine Translation
di: Sharami, Javad Pourmostafa Roshan, et al.
Pubblicazione: (2024)
di: Sharami, Javad Pourmostafa Roshan, et al.
Pubblicazione: (2024)
Natural Language Processing for Dialects of a Language: A Survey
di: Joshi, Aditya, et al.
Pubblicazione: (2024)
di: Joshi, Aditya, et al.
Pubblicazione: (2024)
NeoAMT: Neologism-Aware Agentic Machine Translation with Reinforcement Learning
di: Miao, Zhongtao, et al.
Pubblicazione: (2026)
di: Miao, Zhongtao, et al.
Pubblicazione: (2026)
Large Language Models as Annotators for Machine Translation Quality Estimation
di: Wang, Sidi, et al.
Pubblicazione: (2026)
di: Wang, Sidi, et al.
Pubblicazione: (2026)
MUNIChus: Multilingual News Image Captioning Benchmark
di: Chen, Yuji, et al.
Pubblicazione: (2026)
di: Chen, Yuji, et al.
Pubblicazione: (2026)
QUEST: Quality-Aware Metropolis-Hastings Sampling for Machine Translation
di: Faria, Gonçalo R. A., et al.
Pubblicazione: (2024)
di: Faria, Gonçalo R. A., et al.
Pubblicazione: (2024)
Mismatching-Aware Unsupervised Translation Quality Estimation For Low-Resource Languages
di: Azadi, Fatemeh, et al.
Pubblicazione: (2022)
di: Azadi, Fatemeh, et al.
Pubblicazione: (2022)
Watching the Watchers: Exposing Gender Disparities in Machine Translation Quality Estimation
di: Zaranis, Emmanouil, et al.
Pubblicazione: (2024)
di: Zaranis, Emmanouil, et al.
Pubblicazione: (2024)
Alleviating Distribution Shift in Synthetic Data for Machine Translation Quality Estimation
di: Geng, Xiang, et al.
Pubblicazione: (2025)
di: Geng, Xiang, et al.
Pubblicazione: (2025)
Natural Language Reinforcement Learning
di: Feng, Xidong, et al.
Pubblicazione: (2024)
di: Feng, Xidong, et al.
Pubblicazione: (2024)
Non-Linear Scoring Model for Translation Quality Evaluation
di: Gladkoff, Serge, et al.
Pubblicazione: (2025)
di: Gladkoff, Serge, et al.
Pubblicazione: (2025)
Quality-Aware Translation Models: Efficient Generation and Quality Estimation in a Single Model
di: Tomani, Christian, et al.
Pubblicazione: (2023)
di: Tomani, Christian, et al.
Pubblicazione: (2023)
Documenti analoghi
-
When LLMs Struggle: Reference-less Translation Evaluation for Low-resource Languages
di: Sindhujan, Archchana, et al.
Pubblicazione: (2025) -
ALOPE: Adaptive Layer Optimization for Translation Quality Estimation using Large Language Models
di: Sindhujan, Archchana, et al.
Pubblicazione: (2025) -
What do Large Language Models Need for Machine Translation Evaluation?
di: Qian, Shenbin, et al.
Pubblicazione: (2024) -
Are Large Language Models State-of-the-art Quality Estimators for Machine Translation of User-generated Content?
di: Qian, Shenbin, et al.
Pubblicazione: (2024) -
Automatically Generating Chinese Homophone Words to Probe Machine Translation Estimation Systems
di: Qian, Shenbin, et al.
Pubblicazione: (2025)