Integrating Pre-trained Language Model into Neural Machine Translation
Fuente:
arXiv
Salvato in:
| Autori principali: | Hwang, Soon-Jae, Jeong, Chang-Sung |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Aligning Pre-trained Models for Spoken Language Translation
di: Sedláček, Šimon, et al.
Pubblicazione: (2024)
di: Sedláček, Šimon, et al.
Pubblicazione: (2024)
Machine Unlearning of Pre-trained Large Language Models
di: Yao, Jin, et al.
Pubblicazione: (2024)
di: Yao, Jin, et al.
Pubblicazione: (2024)
Sequence-to-Sequence Spanish Pre-trained Language Models
di: Araujo, Vladimir, et al.
Pubblicazione: (2023)
di: Araujo, Vladimir, et al.
Pubblicazione: (2023)
Investigating Data Contamination for Pre-training Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2024)
di: Jiang, Minhao, et al.
Pubblicazione: (2024)
Automated Multi-Language to English Machine Translation Using Generative Pre-Trained Transformers
di: Pelofske, Elijah, et al.
Pubblicazione: (2024)
di: Pelofske, Elijah, et al.
Pubblicazione: (2024)
Efficient Real-time Refinement of Language Model Text Generation
di: Ko, Joonho, et al.
Pubblicazione: (2025)
di: Ko, Joonho, et al.
Pubblicazione: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
di: Song, Weixi, et al.
Pubblicazione: (2023)
di: Song, Weixi, et al.
Pubblicazione: (2023)
Simple and Scalable Strategies to Continually Pre-train Large Language Models
di: Ibrahim, Adam, et al.
Pubblicazione: (2024)
di: Ibrahim, Adam, et al.
Pubblicazione: (2024)
Pre-training Limited Memory Language Models with Internal and External Knowledge
di: Zhao, Linxi, et al.
Pubblicazione: (2025)
di: Zhao, Linxi, et al.
Pubblicazione: (2025)
Steering Large Language Models for Machine Translation Personalization
di: Scalena, Daniel, et al.
Pubblicazione: (2025)
di: Scalena, Daniel, et al.
Pubblicazione: (2025)
Scaling Smart: Accelerating Large Language Model Pre-training with Small Model Initialization
di: Samragh, Mohammad, et al.
Pubblicazione: (2024)
di: Samragh, Mohammad, et al.
Pubblicazione: (2024)
HiFloat4 Format for Language Model Pre-training on Ascend NPUs
di: Taghian, Mehran, et al.
Pubblicazione: (2026)
di: Taghian, Mehran, et al.
Pubblicazione: (2026)
CDGP: Automatic Cloze Distractor Generation based on Pre-trained Language Model
di: Chiang, Shang-Hsuan, et al.
Pubblicazione: (2024)
di: Chiang, Shang-Hsuan, et al.
Pubblicazione: (2024)
Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning
di: Xia, Mengzhou, et al.
Pubblicazione: (2023)
di: Xia, Mengzhou, et al.
Pubblicazione: (2023)
Pre-trained Language Models Improve the Few-shot Prompt Ability of Decision Transformer
di: Yang, Yu, et al.
Pubblicazione: (2024)
di: Yang, Yu, et al.
Pubblicazione: (2024)
ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data
di: Chen, Tong, et al.
Pubblicazione: (2025)
di: Chen, Tong, et al.
Pubblicazione: (2025)
Evaluating Gender Bias Transfer between Pre-trained and Prompt-Adapted Language Models
di: Mackraz, Natalie, et al.
Pubblicazione: (2024)
di: Mackraz, Natalie, et al.
Pubblicazione: (2024)
Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models
di: Park, Jungwoo, et al.
Pubblicazione: (2025)
di: Park, Jungwoo, et al.
Pubblicazione: (2025)
Context-Aware Membership Inference Attacks against Pre-trained Large Language Models
di: Chang, Hongyan, et al.
Pubblicazione: (2024)
di: Chang, Hongyan, et al.
Pubblicazione: (2024)
Does Pre-trained Language Model Actually Infer Unseen Links in Knowledge Graph Completion?
di: Sakai, Yusuke, et al.
Pubblicazione: (2023)
di: Sakai, Yusuke, et al.
Pubblicazione: (2023)
MemoryPrompt: A Light Wrapper to Improve Context Tracking in Pre-trained Language Models
di: Rakotonirina, Nathanaël Carraz, et al.
Pubblicazione: (2024)
di: Rakotonirina, Nathanaël Carraz, et al.
Pubblicazione: (2024)
Recycling the Web: A Method to Enhance Pre-training Data Quality and Quantity for Language Models
di: Nguyen, Thao, et al.
Pubblicazione: (2025)
di: Nguyen, Thao, et al.
Pubblicazione: (2025)
PhoneLM:an Efficient and Capable Small Language Model Family through Principled Pre-training
di: Yi, Rongjie, et al.
Pubblicazione: (2024)
di: Yi, Rongjie, et al.
Pubblicazione: (2024)
ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
Self-generated Replay Memories for Continual Neural Machine Translation
di: Resta, Michele, et al.
Pubblicazione: (2024)
di: Resta, Michele, et al.
Pubblicazione: (2024)
Dementia-R1: Reinforced Pretraining and Reasoning from Unstructured Clinical Notes for Real-World Dementia Prognosis
di: Kim, Choonghan, et al.
Pubblicazione: (2026)
di: Kim, Choonghan, et al.
Pubblicazione: (2026)
AutoML-Agent: A Multi-Agent LLM Framework for Full-Pipeline AutoML
di: Trirat, Patara, et al.
Pubblicazione: (2024)
di: Trirat, Patara, et al.
Pubblicazione: (2024)
CoLoR-Filter: Conditional Loss Reduction Filtering for Targeted Language Model Pre-training
di: Brandfonbrener, David, et al.
Pubblicazione: (2024)
di: Brandfonbrener, David, et al.
Pubblicazione: (2024)
Comparing Pre-trained Human Language Models: Is it Better with Human Context as Groups, Individual Traits, or Both?
di: Soni, Nikita, et al.
Pubblicazione: (2024)
di: Soni, Nikita, et al.
Pubblicazione: (2024)
Aurora-M: Open Source Continual Pre-training for Multilingual Language and Code
di: Nakamura, Taishi, et al.
Pubblicazione: (2024)
di: Nakamura, Taishi, et al.
Pubblicazione: (2024)
Can General-Purpose Large Language Models Generalize to English-Thai Machine Translation ?
di: Chiaranaipanich, Jirat, et al.
Pubblicazione: (2024)
di: Chiaranaipanich, Jirat, et al.
Pubblicazione: (2024)
When Thoughts Meet Facts: Reusable Reasoning for Long-Context LMs
di: Jeong, Soyeong, et al.
Pubblicazione: (2025)
di: Jeong, Soyeong, et al.
Pubblicazione: (2025)
Qalb: Largest State-of-the-Art Urdu Large Language Model for 230M Speakers with Systematic Continued Pre-training
di: Hassan, Muhammad Taimoor, et al.
Pubblicazione: (2026)
di: Hassan, Muhammad Taimoor, et al.
Pubblicazione: (2026)
On Translating Technical Terminology: A Translation Workflow for Machine-Translated Acronyms
di: Yue, Richard, et al.
Pubblicazione: (2024)
di: Yue, Richard, et al.
Pubblicazione: (2024)
Deconstructing Pre-training: Knowledge Attribution Analysis in MoE and Dense Models
di: Wang, Bo, et al.
Pubblicazione: (2026)
di: Wang, Bo, et al.
Pubblicazione: (2026)
Non-instructional Fine-tuning: Enabling Instruction-Following Capabilities in Pre-trained Language Models without Instruction-Following Data
di: Xie, Juncheng, et al.
Pubblicazione: (2024)
di: Xie, Juncheng, et al.
Pubblicazione: (2024)
Many-to-English Machine Translation Tools, Data, and Pretrained Models
di: Gowda, Thamme, et al.
Pubblicazione: (2021)
di: Gowda, Thamme, et al.
Pubblicazione: (2021)
CASE: Efficient Curricular Data Pre-training for Building Assistive Psychology Expert Models
di: Harne, Sarthak, et al.
Pubblicazione: (2024)
di: Harne, Sarthak, et al.
Pubblicazione: (2024)
SlimQwen: Exploring the Pruning and Distillation in Large MoE Model Pre-training
di: Tang, Shengkun, et al.
Pubblicazione: (2026)
di: Tang, Shengkun, et al.
Pubblicazione: (2026)
Chain of Retrieval: Multi-Aspect Iterative Search Expansion and Post-Order Search Aggregation for Full Paper Retrieval
di: Park, Sangwoo, et al.
Pubblicazione: (2025)
di: Park, Sangwoo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Aligning Pre-trained Models for Spoken Language Translation
di: Sedláček, Šimon, et al.
Pubblicazione: (2024) -
Machine Unlearning of Pre-trained Large Language Models
di: Yao, Jin, et al.
Pubblicazione: (2024) -
Sequence-to-Sequence Spanish Pre-trained Language Models
di: Araujo, Vladimir, et al.
Pubblicazione: (2023) -
Investigating Data Contamination for Pre-training Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2024) -
Automated Multi-Language to English Machine Translation Using Generative Pre-Trained Transformers
di: Pelofske, Elijah, et al.
Pubblicazione: (2024)