Fine-Grained Reward Optimization for Machine Translation using Error Severity Mappings
Fuente:
arXiv
Salvato in:
| Autori principali: | Ramos, Miguel Moura, Almeida, Tomás, Vareta, Daniel, Azevedo, Filipe, Agrawal, Sweta, Fernandes, Patrick, Martins, André F. T. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multilingual Contextualization of Large Language Models for Document-Level Machine Translation
di: Ramos, Miguel Moura, et al.
Pubblicazione: (2025)
di: Ramos, Miguel Moura, et al.
Pubblicazione: (2025)
Is Context Helpful for Chat Translation Evaluation?
di: Agrawal, Sweta, et al.
Pubblicazione: (2024)
di: Agrawal, Sweta, et al.
Pubblicazione: (2024)
Aligning Neural Machine Translation Models: Human Feedback in Training and Inference
di: Ramos, Miguel Moura, et al.
Pubblicazione: (2023)
di: Ramos, Miguel Moura, et al.
Pubblicazione: (2023)
A Context-aware Framework for Translation-mediated Conversations
di: Pombal, José, et al.
Pubblicazione: (2024)
di: Pombal, José, et al.
Pubblicazione: (2024)
Do LLMs Understand Your Translations? Evaluating Paragraph-level MT with Question Answering
di: Fernandes, Patrick, et al.
Pubblicazione: (2025)
di: Fernandes, Patrick, et al.
Pubblicazione: (2025)
Watching the Watchers: Exposing Gender Disparities in Machine Translation Quality Estimation
di: Zaranis, Emmanouil, et al.
Pubblicazione: (2024)
di: Zaranis, Emmanouil, et al.
Pubblicazione: (2024)
Can Automatic Metrics Assess High-Quality Translations?
di: Agrawal, Sweta, et al.
Pubblicazione: (2024)
di: Agrawal, Sweta, et al.
Pubblicazione: (2024)
Modeling User Preferences with Automatic Metrics: Creating a High-Quality Preference Dataset for Machine Translation
di: Agrawal, Sweta, et al.
Pubblicazione: (2024)
di: Agrawal, Sweta, et al.
Pubblicazione: (2024)
Translate Smart, not Hard: Cascaded Translation Systems with Quality-Aware Deferral
di: Farinhas, António, et al.
Pubblicazione: (2025)
di: Farinhas, António, et al.
Pubblicazione: (2025)
QUEST: Quality-Aware Metropolis-Hastings Sampling for Machine Translation
di: Faria, Gonçalo R. A., et al.
Pubblicazione: (2024)
di: Faria, Gonçalo R. A., et al.
Pubblicazione: (2024)
xTower: A Multilingual LLM for Explaining and Correcting Translation Errors
di: Treviso, Marcos, et al.
Pubblicazione: (2024)
di: Treviso, Marcos, et al.
Pubblicazione: (2024)
Déjà Vu: Multilingual LLM Evaluation through the Lens of Machine Translation Evaluation
di: Kreutzer, Julia, et al.
Pubblicazione: (2025)
di: Kreutzer, Julia, et al.
Pubblicazione: (2025)
Combining On-Policy Optimization and Distillation for Long-Context Reasoning in Large Language Models
di: Ramos, Miguel Moura, et al.
Pubblicazione: (2026)
di: Ramos, Miguel Moura, et al.
Pubblicazione: (2026)
Do Text Simplification Systems Preserve Meaning? A Human Evaluation via Reading Comprehension
di: Agrawal, Sweta, et al.
Pubblicazione: (2023)
di: Agrawal, Sweta, et al.
Pubblicazione: (2023)
Tower: An Open Multilingual Large Language Model for Translation-Related Tasks
di: Alves, Duarte M., et al.
Pubblicazione: (2024)
di: Alves, Duarte M., et al.
Pubblicazione: (2024)
Optimization Landscapes Learned: Proxy Networks Boost Convergence in Physics-based Inverse Problems
di: Goyal, Girnar, et al.
Pubblicazione: (2025)
di: Goyal, Girnar, et al.
Pubblicazione: (2025)
CRPO: Confidence-Reward Driven Preference Optimization for Machine Translation
di: Cui, Guofeng, et al.
Pubblicazione: (2025)
di: Cui, Guofeng, et al.
Pubblicazione: (2025)
Fine-Grained and Multi-Dimensional Metrics for Document-Level Machine Translation
di: Sun, Yirong, et al.
Pubblicazione: (2024)
di: Sun, Yirong, et al.
Pubblicazione: (2024)
Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models
di: Li, Zhikai, et al.
Pubblicazione: (2026)
di: Li, Zhikai, et al.
Pubblicazione: (2026)
Rare but Severe Neural Machine Translation Errors Induced by Minimal Deletion: An Empirical Study on Chinese and English
di: Shi, Ruikang, et al.
Pubblicazione: (2022)
di: Shi, Ruikang, et al.
Pubblicazione: (2022)
Toward a Brazilian Research Agenda in Quantum Software Engineering: A Systematic Mapping Study
di: Fernandes, Filipe, et al.
Pubblicazione: (2025)
di: Fernandes, Filipe, et al.
Pubblicazione: (2025)
Rethinking Cross-lingual Alignment: Balancing Transfer and Cultural Erasure in Multilingual LLMs
di: Han, HyoJung, et al.
Pubblicazione: (2025)
di: Han, HyoJung, et al.
Pubblicazione: (2025)
CropVLM: Learning to Zoom for Fine-Grained Vision-Language Perception
di: Carvalho, Miguel, et al.
Pubblicazione: (2025)
di: Carvalho, Miguel, et al.
Pubblicazione: (2025)
Factores de no adhesión al tratamiento de la hipertensión arterial
di: André Almeida Moura
Pubblicazione: (2016)
di: André Almeida Moura
Pubblicazione: (2016)
Analyzing Context Contributions in LLM-based Machine Translation
di: Zaranis, Emmanouil, et al.
Pubblicazione: (2024)
di: Zaranis, Emmanouil, et al.
Pubblicazione: (2024)
Beyond Single-Reward: Multi-Pair, Multi-Perspective Preference Optimization for Machine Translation
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
Speech Recognition Model Improves Text-to-Speech Synthesis using Fine-Grained Reward
di: Wang, Guansu, et al.
Pubblicazione: (2025)
di: Wang, Guansu, et al.
Pubblicazione: (2025)
Translation Errors Significantly Impact Low-Resource Languages in Cross-Lingual Learning
di: Agrawal, Ashish Sunil, et al.
Pubblicazione: (2024)
di: Agrawal, Ashish Sunil, et al.
Pubblicazione: (2024)
When LLMs Benchmark Themselves: Deconstructing Self-Bias in Automated Evaluation
di: Xu, Wenda, et al.
Pubblicazione: (2025)
di: Xu, Wenda, et al.
Pubblicazione: (2025)
How Effective are State Space Models for Machine Translation?
di: Pitorro, Hugo, et al.
Pubblicazione: (2024)
di: Pitorro, Hugo, et al.
Pubblicazione: (2024)
Which cycling environment appears safer? Learning cycling safety perceptions from pairwise image comparisons
di: Costa, Miguel, et al.
Pubblicazione: (2024)
di: Costa, Miguel, et al.
Pubblicazione: (2024)
GRRM: Group Relative Reward Modeling for Machine Translation
di: Yang, Sen, et al.
Pubblicazione: (2026)
di: Yang, Sen, et al.
Pubblicazione: (2026)
SRUM: Fine-Grained Self-Rewarding for Unified Multimodal Models
di: Jin, Weiyang, et al.
Pubblicazione: (2025)
di: Jin, Weiyang, et al.
Pubblicazione: (2025)
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
di: Zhang, Chen Bo Calvin, et al.
Pubblicazione: (2024)
di: Zhang, Chen Bo Calvin, et al.
Pubblicazione: (2024)
Fine-Grained Unambiguous Measurements
di: Buzet, Quentin, et al.
Pubblicazione: (2025)
di: Buzet, Quentin, et al.
Pubblicazione: (2025)
A CONSTRUÇÃO INSTITUCIONAL DA POLÍTICA COMERCIAL BRASILEIRA: A CÂMARA DE COMÉRCIO EXTERIOR (CAMEX) NO GOVERNO CARDOSO
di: Ivan Filipe de Almeida Lopes Fernandes
Pubblicazione: (2013)
di: Ivan Filipe de Almeida Lopes Fernandes
Pubblicazione: (2013)
A importância do crescimento econômico local na escolha do chefe do Executivo no Brasil
di: Ivan Filipe de Almeida Lopes Fernandes
Pubblicazione: (2017)
di: Ivan Filipe de Almeida Lopes Fernandes
Pubblicazione: (2017)
FRACTAL: Fine-Grained Scoring from Aggregate Text Labels
di: Makhija, Yukti, et al.
Pubblicazione: (2024)
di: Makhija, Yukti, et al.
Pubblicazione: (2024)
Beyond Semantics: Measuring Fine-Grained Emotion Preservation in Small Language Model-Based Machine Translation
di: Wisniewski, Dawid, et al.
Pubblicazione: (2026)
di: Wisniewski, Dawid, et al.
Pubblicazione: (2026)
The Perils of Optimizing Learned Reward Functions: Low Training Error Does Not Guarantee Low Regret
di: Fluri, Lukas, et al.
Pubblicazione: (2024)
di: Fluri, Lukas, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Multilingual Contextualization of Large Language Models for Document-Level Machine Translation
di: Ramos, Miguel Moura, et al.
Pubblicazione: (2025) -
Is Context Helpful for Chat Translation Evaluation?
di: Agrawal, Sweta, et al.
Pubblicazione: (2024) -
Aligning Neural Machine Translation Models: Human Feedback in Training and Inference
di: Ramos, Miguel Moura, et al.
Pubblicazione: (2023) -
A Context-aware Framework for Translation-mediated Conversations
di: Pombal, José, et al.
Pubblicazione: (2024) -
Do LLMs Understand Your Translations? Evaluating Paragraph-level MT with Question Answering
di: Fernandes, Patrick, et al.
Pubblicazione: (2025)