Ladder: A Model-Agnostic Framework Boosting LLM-based Machine Translation to the Next Level
Fuente:
arXiv
Salvato in:
| Autori principali: | Feng, Zhaopeng, Chen, Ruizhe, Zhang, Yan, Meng, Zijie, Liu, Zuozhu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
MT-RewardTree: A Comprehensive Framework for Advancing LLM-Based Machine Translation via Reward Modeling
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
TEaR: Improving LLM-based Machine Translation with Systematic Self-Refinement
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024)
Learnable Privacy Neurons Localization in Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
M-MAD: Multidimensional Multi-Agent Debate for Advanced Machine Translation Evaluation
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
PAD: Personalized Alignment of LLMs at Decoding-Time
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
EC-Guide: A Comprehensive E-Commerce Guide for Instruction Tuning and Quantization
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024)
DCR: Divide-and-Conquer Reasoning for Multi-choice Question Answering with LLMs
di: Meng, Zijie, et al.
Pubblicazione: (2024)
di: Meng, Zijie, et al.
Pubblicazione: (2024)
GenTranslate: Large Language Models are Generative Multilingual Speech and Machine Translators
di: Hu, Yuchen, et al.
Pubblicazione: (2024)
di: Hu, Yuchen, et al.
Pubblicazione: (2024)
Disentangling the Roles of Target-Side Transfer and Regularization in Multilingual Machine Translation
di: Meng, Yan, et al.
Pubblicazione: (2024)
di: Meng, Yan, et al.
Pubblicazione: (2024)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2024)
di: Shao, Chenze, et al.
Pubblicazione: (2024)
DentalBench: Benchmarking and Advancing LLMs Capability for Bilingual Dentistry Understanding
di: Zhu, Hengchuan, et al.
Pubblicazione: (2025)
di: Zhu, Hengchuan, et al.
Pubblicazione: (2025)
NextLocLLM: Location Semantics Modeling and Coordinate-Based Next Location Prediction with LLMs
di: Liu, Shuai, et al.
Pubblicazione: (2024)
di: Liu, Shuai, et al.
Pubblicazione: (2024)
DynamicNER: A Dynamic, Multilingual, and Fine-Grained Dataset for LLM-based Named Entity Recognition
di: Luo, Hanjun, et al.
Pubblicazione: (2024)
di: Luo, Hanjun, et al.
Pubblicazione: (2024)
Understanding and Mitigating the Uncertainty in Zero-Shot Translation
di: Wang, Wenxuan, et al.
Pubblicazione: (2022)
di: Wang, Wenxuan, et al.
Pubblicazione: (2022)
Identifying and Mitigating Social Bias Knowledge in Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
Critical Tokens Matter: Token-Level Contrastive Estimation Enhances LLM's Reasoning Capability
di: Lin, Zicheng, et al.
Pubblicazione: (2024)
di: Lin, Zicheng, et al.
Pubblicazione: (2024)
RecMem: Recurrence-based Memory Consolidation for Efficient and Effective Long-Running LLM Agents
di: Dai, Zijie, et al.
Pubblicazione: (2026)
di: Dai, Zijie, et al.
Pubblicazione: (2026)
LASA: Language-Agnostic Semantic Alignment at the Semantic Bottleneck for LLM Safety
di: Yang, Junxiao, et al.
Pubblicazione: (2026)
di: Yang, Junxiao, et al.
Pubblicazione: (2026)
Improving Machine Translation with Human Feedback: An Exploration of Quality Estimation as a Reward Model
di: He, Zhiwei, et al.
Pubblicazione: (2024)
di: He, Zhiwei, et al.
Pubblicazione: (2024)
On the Shortcut Learning in Multilingual Neural Machine Translation
di: Wang, Wenxuan, et al.
Pubblicazione: (2024)
di: Wang, Wenxuan, et al.
Pubblicazione: (2024)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
di: Wei, Jianhui, et al.
Pubblicazione: (2025)
di: Wei, Jianhui, et al.
Pubblicazione: (2025)
Many-to-English Machine Translation Tools, Data, and Pretrained Models
di: Gowda, Thamme, et al.
Pubblicazione: (2021)
di: Gowda, Thamme, et al.
Pubblicazione: (2021)
Masked Diffusion Models are Secretly Time-Agnostic Masked Models and Exploit Inaccurate Categorical Sampling
di: Zheng, Kaiwen, et al.
Pubblicazione: (2024)
di: Zheng, Kaiwen, et al.
Pubblicazione: (2024)
AgentMove: A Large Language Model based Agentic Framework for Zero-shot Next Location Prediction
di: Feng, Jie, et al.
Pubblicazione: (2024)
di: Feng, Jie, et al.
Pubblicazione: (2024)
Steering Large Language Models for Machine Translation Personalization
di: Scalena, Daniel, et al.
Pubblicazione: (2025)
di: Scalena, Daniel, et al.
Pubblicazione: (2025)
On Translating Technical Terminology: A Translation Workflow for Machine-Translated Acronyms
di: Yue, Richard, et al.
Pubblicazione: (2024)
di: Yue, Richard, et al.
Pubblicazione: (2024)
SPC: Evolving Self-Play Critic via Adversarial Games for LLM Reasoning
di: Chen, Jiaqi, et al.
Pubblicazione: (2025)
di: Chen, Jiaqi, et al.
Pubblicazione: (2025)
Integrating Pre-trained Language Model into Neural Machine Translation
di: Hwang, Soon-Jae, et al.
Pubblicazione: (2023)
di: Hwang, Soon-Jae, et al.
Pubblicazione: (2023)
Prismatic Synthesis: Gradient-based Data Diversification Boosts Generalization in LLM Reasoning
di: Jung, Jaehun, et al.
Pubblicazione: (2025)
di: Jung, Jaehun, et al.
Pubblicazione: (2025)
Anchored Answers: Unravelling Positional Bias in GPT-2's Multiple-Choice Questions
di: Li, Ruizhe, et al.
Pubblicazione: (2024)
di: Li, Ruizhe, et al.
Pubblicazione: (2024)
LaCache: Ladder-Shaped KV Caching for Efficient Long-Context Modeling of Large Language Models
di: Shi, Dachuan, et al.
Pubblicazione: (2025)
di: Shi, Dachuan, et al.
Pubblicazione: (2025)
Beyond Next Word Prediction: Developing Comprehensive Evaluation Frameworks for measuring LLM performance on real world applications
di: Agrawal, Vishakha, et al.
Pubblicazione: (2025)
di: Agrawal, Vishakha, et al.
Pubblicazione: (2025)
Investigating Multi-Pivot Ensembling with Massively Multilingual Machine Translation Models
di: Mohammadshahi, Alireza, et al.
Pubblicazione: (2023)
di: Mohammadshahi, Alireza, et al.
Pubblicazione: (2023)
DepthCharge: A Domain-Agnostic Framework for Measuring Depth-Dependent Knowledge in Large Language Models
di: Sheppert, Alexander
Pubblicazione: (2026)
di: Sheppert, Alexander
Pubblicazione: (2026)
Documenti analoghi
-
MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025) -
MT-RewardTree: A Comprehensive Framework for Advancing LLM-Based Machine Translation via Reward Modeling
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025) -
TEaR: Improving LLM-based Machine Translation with Systematic Self-Refinement
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024) -
Learnable Privacy Neurons Localization in Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2024) -
MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)