MuCPT: Music-related Natural Language Model Continued Pretraining
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tian, Kai, Mao, Yirong, Bi, Wendong, Wang, Hanjie, Wenhui, Que |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
WeMusic-Agent: Efficient Conversational Music Recommendation via Knowledge Internalization and Agentic Boundary Learning
par: Bi, Wendong, et autres
Publié: (2025)
par: Bi, Wendong, et autres
Publié: (2025)
PMC-InterCPT: Rethinking Biomedical Interleaved Data for Multimodal Continued Pretraining
par: Zhu, Guanghao, et autres
Publié: (2026)
par: Zhu, Guanghao, et autres
Publié: (2026)
D-CPT Law: Domain-specific Continual Pre-Training Scaling Law for Large Language Models
par: Que, Haoran, et autres
Publié: (2024)
par: Que, Haoran, et autres
Publié: (2024)
The Generalization Ridge: Information Flow in Natural Language Generation
par: Chang, Ruidi, et autres
Publié: (2025)
par: Chang, Ruidi, et autres
Publié: (2025)
MuChoMusic: Evaluating Music Understanding in Multimodal Audio-Language Models
par: Weck, Benno, et autres
Publié: (2024)
par: Weck, Benno, et autres
Publié: (2024)
COPU: Conformal Prediction for Uncertainty Quantification in Natural Language Generation
par: Wang, Sean, et autres
Publié: (2025)
par: Wang, Sean, et autres
Publié: (2025)
MuRating: A High Quality Data Selecting Approach to Multilingual Large Language Model Pretraining
par: Chen, Zhixun, et autres
Publié: (2025)
par: Chen, Zhixun, et autres
Publié: (2025)
Learning Distribution-Wise Control in Representation Space for Language Models
par: Deng, Chunyuan, et autres
Publié: (2025)
par: Deng, Chunyuan, et autres
Publié: (2025)
Steering Information Utility in Key-Value Memory for Language Model Post-Training
par: Deng, Chunyuan, et autres
Publié: (2025)
par: Deng, Chunyuan, et autres
Publié: (2025)
Retrieval as Reasoning: Self-Evolving Agent-Native Retrieval via LLM-Wiki
par: Ming, Haoliang, et autres
Publié: (2026)
par: Ming, Haoliang, et autres
Publié: (2026)
AuthTrace: Diagnosing Evidence Construction in Thematically Dense Single-Author Corpora
par: Wu, Xiaoqing, et autres
Publié: (2026)
par: Wu, Xiaoqing, et autres
Publié: (2026)
Investigating Continual Pretraining in Large Language Models: Insights and Implications
par: Yıldız, Çağatay, et autres
Publié: (2024)
par: Yıldız, Çağatay, et autres
Publié: (2024)
PonderLM: Pretraining Language Models to Ponder in Continuous Space
par: Zeng, Boyi, et autres
Publié: (2025)
par: Zeng, Boyi, et autres
Publié: (2025)
Reuse, Don't Retrain: A Recipe for Continued Pretraining of Language Models
par: Parmar, Jupinder, et autres
Publié: (2024)
par: Parmar, Jupinder, et autres
Publié: (2024)
MuLan: A Study of Fact Mutability in Language Models
par: Fierro, Constanza, et autres
Publié: (2024)
par: Fierro, Constanza, et autres
Publié: (2024)
Spherical Steering: Geometry-Aware Activation Rotation for Language Models
par: You, Zejia, et autres
Publié: (2026)
par: You, Zejia, et autres
Publié: (2026)
PRISM: Preference Refinement via Implicit Scene Modeling for 3D Vision-Language Preference-Based Reinforcement Learning
par: Sun, Yirong, et autres
Publié: (2025)
par: Sun, Yirong, et autres
Publié: (2025)
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
par: Chen, Hanjie, et autres
Publié: (2024)
par: Chen, Hanjie, et autres
Publié: (2024)
A Tutorial on the Pretrain-Finetune Paradigm for Natural Language Processing
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
MLP Memory: A Retriever-Pretrained Memory for Large Language Models
par: Wei, Rubin, et autres
Publié: (2025)
par: Wei, Rubin, et autres
Publié: (2025)
Semantic Flow Regularization: Teaching LLMs to Generate Diverse Yet Coherent Responses
par: Peng, Kerui, et autres
Publié: (2026)
par: Peng, Kerui, et autres
Publié: (2026)
MemCog: From Memory-as-Tool to Memory-as-Cognition in Conversational Agents
par: Li, Zihan, et autres
Publié: (2026)
par: Li, Zihan, et autres
Publié: (2026)
From Babbling to Fluency: Evaluating the Evolution of Language Models in Terms of Human Language Acquisition
par: Yang, Qiyuan, et autres
Publié: (2024)
par: Yang, Qiyuan, et autres
Publié: (2024)
Will the Real Linda Please Stand up...to Large Language Models? Examining the Representativeness Heuristic in LLMs
par: Wang, Pengda, et autres
Publié: (2024)
par: Wang, Pengda, et autres
Publié: (2024)
Emergent Abilities of Large Language Models under Continued Pretraining for Language Adaptation
par: Elhady, Ahmed, et autres
Publié: (2025)
par: Elhady, Ahmed, et autres
Publié: (2025)
LLM Pretraining with Continuous Concepts
par: Tack, Jihoon, et autres
Publié: (2025)
par: Tack, Jihoon, et autres
Publié: (2025)
A Causal Language Modeling Detour Improves Encoder Continued Pretraining
par: Touchent, Rian, et autres
Publié: (2026)
par: Touchent, Rian, et autres
Publié: (2026)
AF Adapter: Continual Pretraining for Building Chinese Biomedical Language Model
par: Yan, Yongyu, et autres
Publié: (2022)
par: Yan, Yongyu, et autres
Publié: (2022)
MuLan: Adapting Multilingual Diffusion Models for Hundreds of Languages with Negligible Cost
par: Xing, Sen, et autres
Publié: (2024)
par: Xing, Sen, et autres
Publié: (2024)
MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages
par: Han, Wenhan, et autres
Publié: (2025)
par: Han, Wenhan, et autres
Publié: (2025)
Progressive Residual Warmup for Language Model Pretraining
par: Chen, Tianhao, et autres
Publié: (2026)
par: Chen, Tianhao, et autres
Publié: (2026)
Efficient Domain-adaptive Continual Pretraining for the Process Industry in the German Language
par: Zhukova, Anastasia, et autres
Publié: (2025)
par: Zhukova, Anastasia, et autres
Publié: (2025)
VisualSpeech: Enhancing Prosody Modeling in TTS Using Video
par: Que, Shumin, et autres
Publié: (2025)
par: Que, Shumin, et autres
Publié: (2025)
Pretraining Language Models Using Translationese
par: Doshi, Meet, et autres
Publié: (2024)
par: Doshi, Meet, et autres
Publié: (2024)
Geographic Adaptation of Pretrained Language Models
par: Hofmann, Valentin, et autres
Publié: (2022)
par: Hofmann, Valentin, et autres
Publié: (2022)
Language Models are Symbolic Learners in Arithmetic
par: Deng, Chunyuan, et autres
Publié: (2024)
par: Deng, Chunyuan, et autres
Publié: (2024)
Set the Clock: Temporal Alignment of Pretrained Language Models
par: Zhao, Bowen, et autres
Publié: (2024)
par: Zhao, Bowen, et autres
Publié: (2024)
Memory Decoder: A Pretrained, Plug-and-Play Memory for Large Language Models
par: Cao, Jiaqi, et autres
Publié: (2025)
par: Cao, Jiaqi, et autres
Publié: (2025)
QCSE: A Pretrained Quantum Context-Sensitive Word Embedding for Natural Language Processing
par: Varmantchaonala, Charles M., et autres
Publié: (2025)
par: Varmantchaonala, Charles M., et autres
Publié: (2025)
Temporal Entailment Pretraining for Clinical Language Models over EHR Data
par: Tanaka, Tatsunori, et autres
Publié: (2025)
par: Tanaka, Tatsunori, et autres
Publié: (2025)
Documents similaires
-
WeMusic-Agent: Efficient Conversational Music Recommendation via Knowledge Internalization and Agentic Boundary Learning
par: Bi, Wendong, et autres
Publié: (2025) -
PMC-InterCPT: Rethinking Biomedical Interleaved Data for Multimodal Continued Pretraining
par: Zhu, Guanghao, et autres
Publié: (2026) -
D-CPT Law: Domain-specific Continual Pre-Training Scaling Law for Large Language Models
par: Que, Haoran, et autres
Publié: (2024) -
The Generalization Ridge: Information Flow in Natural Language Generation
par: Chang, Ruidi, et autres
Publié: (2025) -
MuChoMusic: Evaluating Music Understanding in Multimodal Audio-Language Models
par: Weck, Benno, et autres
Publié: (2024)