Reinforcement Learning for Edit-Based Non-Autoregressive Neural Machine Translation
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Hao, Morimura, Tetsuro, Honda, Ukyo, Kawahara, Daisuke |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the True Distribution Approximation of Minimum Bayes-Risk Decoding
di: Ohashi, Atsumoto, et al.
Pubblicazione: (2024)
di: Ohashi, Atsumoto, et al.
Pubblicazione: (2024)
Generating Diverse and High-Quality Texts by Minimum Bayes Risk Decoding
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
Model-Based Minimum Bayes Risk Decoding for Text Generation
di: Jinnai, Yuu, et al.
Pubblicazione: (2023)
di: Jinnai, Yuu, et al.
Pubblicazione: (2023)
Exploring Explanations Improves the Robustness of In-Context Learning
di: Honda, Ukyo, et al.
Pubblicazione: (2025)
di: Honda, Ukyo, et al.
Pubblicazione: (2025)
Toward LLMs Beyond English-Centric Development
di: Takase, Sho, et al.
Pubblicazione: (2026)
di: Takase, Sho, et al.
Pubblicazione: (2026)
Distilling Many-Shot In-Context Learning into a Cheat Sheet
di: Honda, Ukyo, et al.
Pubblicazione: (2025)
di: Honda, Ukyo, et al.
Pubblicazione: (2025)
Annotation-Efficient Language Model Alignment via Diverse and Representative Response Texts
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
Kanbun-LM: Reading and Translating Classical Chinese in Japanese Methods by Language Models
di: Wang, Hao, et al.
Pubblicazione: (2023)
di: Wang, Hao, et al.
Pubblicazione: (2023)
Does Self-Consistency Improve the Recall of Encyclopedic Knowledge?
di: Hoshino, Sho, et al.
Pubblicazione: (2026)
di: Hoshino, Sho, et al.
Pubblicazione: (2026)
Revisiting the Capacity Gap in Chain-of-Thought Distillation from a Practical Perspective
di: Kajitsuka, Tokio, et al.
Pubblicazione: (2026)
di: Kajitsuka, Tokio, et al.
Pubblicazione: (2026)
Multilingual Non-Autoregressive Machine Translation without Knowledge Distillation
di: Huang, Chenyang, et al.
Pubblicazione: (2025)
di: Huang, Chenyang, et al.
Pubblicazione: (2025)
Exploring the Relationship Between Diversity and Quality in Ad Text Generation
di: Aoki, Yoichi, et al.
Pubblicazione: (2025)
di: Aoki, Yoichi, et al.
Pubblicazione: (2025)
Not Eliminate but Aggregate: Post-Hoc Control over Mixture-of-Experts to Address Shortcut Shifts in Natural Language Understanding
di: Honda, Ukyo, et al.
Pubblicazione: (2024)
di: Honda, Ukyo, et al.
Pubblicazione: (2024)
Shared Latent Space by Both Languages in Non-Autoregressive Neural Machine Translation
di: Heo, DongNyeong, et al.
Pubblicazione: (2023)
di: Heo, DongNyeong, et al.
Pubblicazione: (2023)
On the Information Redundancy in Non-Autoregressive Translation
di: Wang, Zhihao, et al.
Pubblicazione: (2024)
di: Wang, Zhihao, et al.
Pubblicazione: (2024)
Regularized Best-of-N Sampling with Minimum Bayes Risk Objective for Language Model Alignment
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
di: Jinnai, Yuu, et al.
Pubblicazione: (2024)
A Single Linear Layer Yields Task-Adapted Low-Rank Matrices
di: Kim, Hwichan, et al.
Pubblicazione: (2024)
di: Kim, Hwichan, et al.
Pubblicazione: (2024)
Theoretical Guarantees for Minimum Bayes Risk Decoding
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
FaithCAMERA: Construction of a Faithful Dataset for Ad Text Generation
di: Kato, Akihiko, et al.
Pubblicazione: (2024)
di: Kato, Akihiko, et al.
Pubblicazione: (2024)
PEGRL: Improving Machine Translation by Post-Editing Guided Reinforcement Learning
di: Shen, Yunzhi, et al.
Pubblicazione: (2026)
di: Shen, Yunzhi, et al.
Pubblicazione: (2026)
Filtered Direct Preference Optimization
di: Morimura, Tetsuro, et al.
Pubblicazione: (2024)
di: Morimura, Tetsuro, et al.
Pubblicazione: (2024)
Should We Respect LLMs? A Cross-Lingual Study on the Influence of Prompt Politeness on LLM Performance
di: Yin, Ziqi, et al.
Pubblicazione: (2024)
di: Yin, Ziqi, et al.
Pubblicazione: (2024)
RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation
di: Li, Tianjiao, et al.
Pubblicazione: (2025)
di: Li, Tianjiao, et al.
Pubblicazione: (2025)
Learning to Translate Ambiguous Terminology by Preference Optimization on Post-Edits
di: Berger, Nathaniel, et al.
Pubblicazione: (2025)
di: Berger, Nathaniel, et al.
Pubblicazione: (2025)
Evaluation of Best-of-N Sampling Strategies for Language Model Alignment
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
Leveraging Diverse Modeling Contexts with Collaborating Learning for Neural Machine Translation
di: Liao, Yusheng, et al.
Pubblicazione: (2024)
di: Liao, Yusheng, et al.
Pubblicazione: (2024)
On the Shortcut Learning in Multilingual Neural Machine Translation
di: Wang, Wenxuan, et al.
Pubblicazione: (2024)
di: Wang, Wenxuan, et al.
Pubblicazione: (2024)
HiEdit: Lifelong Model Editing with Hierarchical Reinforcement Learning
di: Wang, Yangfan, et al.
Pubblicazione: (2026)
di: Wang, Yangfan, et al.
Pubblicazione: (2026)
Evaluating Multimodal Large Language Models on Vertically Written Japanese Text
di: Sasagawa, Keito, et al.
Pubblicazione: (2025)
di: Sasagawa, Keito, et al.
Pubblicazione: (2025)
Faster Machine Translation Ensembling with Reinforcement Learning and Competitive Correction
di: Prasad, Kritarth, et al.
Pubblicazione: (2025)
di: Prasad, Kritarth, et al.
Pubblicazione: (2025)
Structured Document Translation via Format Reinforcement Learning
di: Song, Haiyue, et al.
Pubblicazione: (2025)
di: Song, Haiyue, et al.
Pubblicazione: (2025)
Guiding Large Language Models to Post-Edit Machine Translation with Error Annotations
di: Ki, Dayeon, et al.
Pubblicazione: (2024)
di: Ki, Dayeon, et al.
Pubblicazione: (2024)
Non-Fluent Synthetic Target-Language Data Improve Neural Machine Translation
di: Sánchez-Cartagena, Víctor M., et al.
Pubblicazione: (2024)
di: Sánchez-Cartagena, Víctor M., et al.
Pubblicazione: (2024)
Minority-Aware Satisfaction Estimation in Dialogue Systems via Preference-Adaptive Reinforcement Learning
di: Fu, Yahui, et al.
Pubblicazione: (2025)
di: Fu, Yahui, et al.
Pubblicazione: (2025)
EditGRPO: Reinforcement Learning with Post-Rollout Edits for Clinically Accurate Chest X-Ray Report Generation
di: Zhang, Kai, et al.
Pubblicazione: (2025)
di: Zhang, Kai, et al.
Pubblicazione: (2025)
Traveling Across Languages: Benchmarking Cross-Lingual Consistency in Multimodal LLMs
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
On Temperature-Constrained Non-Deterministic Machine Translation: Potential and Evaluation
di: Wang, Weichuan, et al.
Pubblicazione: (2026)
di: Wang, Weichuan, et al.
Pubblicazione: (2026)
The Box is in the Pen: Evaluating Commonsense Reasoning in Neural Machine Translation
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
Evaluating Structural Generalization in Neural Machine Translation
di: Kumon, Ryoma, et al.
Pubblicazione: (2024)
di: Kumon, Ryoma, et al.
Pubblicazione: (2024)
Beyond Scalar Scores: Reinforcement Learning for Error-Aware Quality Estimation of Machine Translation
di: Sindhujan, Archchana, et al.
Pubblicazione: (2026)
di: Sindhujan, Archchana, et al.
Pubblicazione: (2026)
Documenti analoghi
-
On the True Distribution Approximation of Minimum Bayes-Risk Decoding
di: Ohashi, Atsumoto, et al.
Pubblicazione: (2024) -
Generating Diverse and High-Quality Texts by Minimum Bayes Risk Decoding
di: Jinnai, Yuu, et al.
Pubblicazione: (2024) -
Model-Based Minimum Bayes Risk Decoding for Text Generation
di: Jinnai, Yuu, et al.
Pubblicazione: (2023) -
Exploring Explanations Improves the Robustness of In-Context Learning
di: Honda, Ukyo, et al.
Pubblicazione: (2025) -
Toward LLMs Beyond English-Centric Development
di: Takase, Sho, et al.
Pubblicazione: (2026)