Enhancing Translation Accuracy of Large Language Models through Continual Pre-Training on Parallel Data
Fuente:
arXiv
Guardado en:
| Autores principales: | Kondo, Minato, Utsuro, Takehito, Nagata, Masaaki |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
BiMax: Bidirectional MaxSim Score for Document-Level Alignment
por: Wang, Xiaotian, et al.
Publicado: (2025)
por: Wang, Xiaotian, et al.
Publicado: (2025)
Embedded Topic Models Enhanced by Wikification
por: Shibuya, Takashi, et al.
Publicado: (2024)
por: Shibuya, Takashi, et al.
Publicado: (2024)
Good/Evil Reputation Judgment of Celebrities by LLMs via Retrieval Augmented Generation
por: Tsuchida, Rikuto, et al.
Publicado: (2025)
por: Tsuchida, Rikuto, et al.
Publicado: (2025)
Retrieval-Augmented Simulacra: Generative Agents for Up-to-date and Knowledge-Adaptive Simulations
por: Shimadzu, Hikaru, et al.
Publicado: (2025)
por: Shimadzu, Hikaru, et al.
Publicado: (2025)
JaParaPat: A Large-Scale Japanese-English Parallel Patent Application Corpus
por: Nagata, Masaaki, et al.
Publicado: (2025)
por: Nagata, Masaaki, et al.
Publicado: (2025)
Improving Language Models Trained on Translated Data with Continual Pre-Training and Dictionary Learning Analysis
por: Boughorbel, Sabri, et al.
Publicado: (2024)
por: Boughorbel, Sabri, et al.
Publicado: (2024)
Policy-based Sentence Simplification: Replacing Parallel Corpora with LLM-as-a-Judge
por: Wu, Xuanxin, et al.
Publicado: (2025)
por: Wu, Xuanxin, et al.
Publicado: (2025)
A Japanese-Chinese Parallel Corpus Using Crowdsourcing for Web Mining
por: Nagata, Masaaki, et al.
Publicado: (2024)
por: Nagata, Masaaki, et al.
Publicado: (2024)
Word Alignment as Preference for Machine Translation
por: Wu, Qiyu, et al.
Publicado: (2024)
por: Wu, Qiyu, et al.
Publicado: (2024)
Case-Based Decision-Theoretic Decoding with Quality Memories
por: Deguchi, Hiroyuki, et al.
Publicado: (2025)
por: Deguchi, Hiroyuki, et al.
Publicado: (2025)
NeoAMT: Neologism-Aware Agentic Machine Translation with Reinforcement Learning
por: Miao, Zhongtao, et al.
Publicado: (2026)
por: Miao, Zhongtao, et al.
Publicado: (2026)
How Do Large Language Models Learn Concepts During Continual Pre-Training?
por: Yao, Barry Menglong, et al.
Publicado: (2026)
por: Yao, Barry Menglong, et al.
Publicado: (2026)
Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training
por: Zhuang, Yuchen, et al.
Publicado: (2025)
por: Zhuang, Yuchen, et al.
Publicado: (2025)
Learning Dynamics in Continual Pre-Training for Large Language Models
por: Wang, Xingjin, et al.
Publicado: (2025)
por: Wang, Xingjin, et al.
Publicado: (2025)
Synthetic Pre-Pre-Training Improves Language Model Robustness to Noisy Pre-Training Data
por: Guo, Xu, et al.
Publicado: (2026)
por: Guo, Xu, et al.
Publicado: (2026)
Trans-Zero: Self-Play Incentivizes Large Language Models for Multilingual Translation Without Parallel Data
por: Zou, Wei, et al.
Publicado: (2025)
por: Zou, Wei, et al.
Publicado: (2025)
Exploring Forgetting in Large Language Model Pre-Training
por: Liao, Chonghua, et al.
Publicado: (2024)
por: Liao, Chonghua, et al.
Publicado: (2024)
Large Language Model Empowered Recommendation Meets All-domain Continual Pre-Training
por: Ma, Haokai, et al.
Publicado: (2025)
por: Ma, Haokai, et al.
Publicado: (2025)
D-CPT Law: Domain-specific Continual Pre-Training Scaling Law for Large Language Models
por: Que, Haoran, et al.
Publicado: (2024)
por: Que, Haoran, et al.
Publicado: (2024)
Construction of Domain-specified Japanese Large Language Model for Finance through Continual Pre-training
por: Hirano, Masanori, et al.
Publicado: (2024)
por: Hirano, Masanori, et al.
Publicado: (2024)
Exploiting Domain-Specific Parallel Data on Multilingual Language Models for Low-resource Language Translation
por: Ranathungaa, Surangika, et al.
Publicado: (2024)
por: Ranathungaa, Surangika, et al.
Publicado: (2024)
Revisiting Replay and Gradient Alignment for Continual Pre-Training of Large Language Models
por: Abbes, Istabrak, et al.
Publicado: (2025)
por: Abbes, Istabrak, et al.
Publicado: (2025)
ConcEPT: Concept-Enhanced Pre-Training for Language Models
por: Wang, Xintao, et al.
Publicado: (2024)
por: Wang, Xintao, et al.
Publicado: (2024)
Self-Translate-Train: Enhancing Cross-Lingual Transfer of Large Language Models via Inherent Capability
por: Ri, Ryokan, et al.
Publicado: (2024)
por: Ri, Ryokan, et al.
Publicado: (2024)
Domain-Adaptive Continued Pre-Training of Small Language Models
por: Faroz, Salman
Publicado: (2025)
por: Faroz, Salman
Publicado: (2025)
From Babble to Words: Pre-Training Language Models on Continuous Streams of Phonemes
por: Goriely, Zébulon, et al.
Publicado: (2024)
por: Goriely, Zébulon, et al.
Publicado: (2024)
Machine Translation Meta Evaluation through Translation Accuracy Challenge Sets
por: Moghe, Nikita, et al.
Publicado: (2024)
por: Moghe, Nikita, et al.
Publicado: (2024)
A Comparative Study of Translation Bias and Accuracy in Multilingual Large Language Models for Cross-Language Claim Verification
por: Singhal, Aryan, et al.
Publicado: (2024)
por: Singhal, Aryan, et al.
Publicado: (2024)
Detecting Bias and Enhancing Diagnostic Accuracy in Large Language Models for Healthcare
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024)
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024)
Examining Forgetting in Continual Pre-training of Aligned Large Language Models
por: Li, Chen-An, et al.
Publicado: (2024)
por: Li, Chen-An, et al.
Publicado: (2024)
Enhancing Training Data Attribution for Large Language Models with Fitting Error Consideration
por: Wu, Kangxi, et al.
Publicado: (2024)
por: Wu, Kangxi, et al.
Publicado: (2024)
Better Generalizing to Unseen Concepts: An Evaluation Framework and An LLM-Based Auto-Labeled Pipeline for Biomedical Concept Recognition
por: Liu, Shanshan, et al.
Publicado: (2026)
por: Liu, Shanshan, et al.
Publicado: (2026)
Argument Mining as a Text-to-Text Generation Task
por: Kawarada, Masayuki, et al.
Publicado: (2026)
por: Kawarada, Masayuki, et al.
Publicado: (2026)
Enhancing Document-level Translation of Large Language Model via Translation Mixed-instructions
por: Li, Yachao, et al.
Publicado: (2024)
por: Li, Yachao, et al.
Publicado: (2024)
Continual Pre-Training for Cross-Lingual LLM Adaptation: Enhancing Japanese Language Capabilities
por: Fujii, Kazuki, et al.
Publicado: (2024)
por: Fujii, Kazuki, et al.
Publicado: (2024)
From Curated Data to Scalable Models: Continual Pre-training of Dense and MoE Large Language Models for Tibetan
por: Yang, Lei, et al.
Publicado: (2025)
por: Yang, Lei, et al.
Publicado: (2025)
Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models
por: Zhang, Jingyang, et al.
Publicado: (2024)
por: Zhang, Jingyang, et al.
Publicado: (2024)
Synthesize-on-Graph: Knowledgeable Synthetic Data Generation for Continue Pre-training of Large Language Models
por: Ma, Shengjie, et al.
Publicado: (2025)
por: Ma, Shengjie, et al.
Publicado: (2025)
DACP: Domain-Adaptive Continual Pre-Training of Large Language Models for Phone Conversation Summarization
por: Fu, Xue-Yong, et al.
Publicado: (2025)
por: Fu, Xue-Yong, et al.
Publicado: (2025)
Efficient Continual Pre-training for Building Domain Specific Large Language Models
por: Xie, Yong, et al.
Publicado: (2023)
por: Xie, Yong, et al.
Publicado: (2023)
Ejemplares similares
-
BiMax: Bidirectional MaxSim Score for Document-Level Alignment
por: Wang, Xiaotian, et al.
Publicado: (2025) -
Embedded Topic Models Enhanced by Wikification
por: Shibuya, Takashi, et al.
Publicado: (2024) -
Good/Evil Reputation Judgment of Celebrities by LLMs via Retrieval Augmented Generation
por: Tsuchida, Rikuto, et al.
Publicado: (2025) -
Retrieval-Augmented Simulacra: Generative Agents for Up-to-date and Knowledge-Adaptive Simulations
por: Shimadzu, Hikaru, et al.
Publicado: (2025) -
JaParaPat: A Large-Scale Japanese-English Parallel Patent Application Corpus
por: Nagata, Masaaki, et al.
Publicado: (2025)