On the Effectiveness of Incremental Training of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Miles Q., Fung, Benjamin C. M., Huang, Shih-Chia |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Training Dynamics of a 1.7B LLaMa Model: A Data-Efficient Approach
par: Li, Miles Q., et autres
Publié: (2024)
par: Li, Miles Q., et autres
Publié: (2024)
Security Concerns for Large Language Models: A Survey
par: Li, Miles Q., et autres
Publié: (2025)
par: Li, Miles Q., et autres
Publié: (2025)
Leveraging Large Language Models for Rare Disease Named Entity Recognition
par: Xi, Nan Miles, et autres
Publié: (2025)
par: Xi, Nan Miles, et autres
Publié: (2025)
Investigating Hallucinations in Pruned Large Language Models for Abstractive Summarization
par: Chrysostomou, George, et autres
Publié: (2023)
par: Chrysostomou, George, et autres
Publié: (2023)
Generative Large Language Models Trained for Detecting Errors in Radiology Reports
par: Sun, Cong, et autres
Publié: (2025)
par: Sun, Cong, et autres
Publié: (2025)
Large Language Models Are Effective Human Annotation Assistants, But Not Good Independent Annotators
par: Gu, Feng, et autres
Publié: (2025)
par: Gu, Feng, et autres
Publié: (2025)
Collaboration among Multiple Large Language Models for Medical Question Answering
par: Shang, Kexin, et autres
Publié: (2025)
par: Shang, Kexin, et autres
Publié: (2025)
Measuring Political Bias in Large Language Models: What Is Said and How It Is Said
par: Bang, Yejin, et autres
Publié: (2024)
par: Bang, Yejin, et autres
Publié: (2024)
Classifying Cancer Stage with Open-Source Clinical Large Language Models
par: Chang, Chia-Hsuan, et autres
Publié: (2024)
par: Chang, Chia-Hsuan, et autres
Publié: (2024)
Systematic Analysis for Pretrained Language Model Priming for Parameter-Efficient Fine-tuning
par: Huang, Shih-Cheng, et autres
Publié: (2022)
par: Huang, Shih-Cheng, et autres
Publié: (2022)
Evolving Subnetwork Training for Large Language Models
par: Li, Hanqi, et autres
Publié: (2024)
par: Li, Hanqi, et autres
Publié: (2024)
LLMatDesign: Autonomous Materials Discovery with Large Language Models
par: Jia, Shuyi, et autres
Publié: (2024)
par: Jia, Shuyi, et autres
Publié: (2024)
Training Large Language Models to Predict Clinical Events
par: Turtel, Benjamin, et autres
Publié: (2026)
par: Turtel, Benjamin, et autres
Publié: (2026)
Delusions of Large Language Models
par: Xu, Hongshen, et autres
Publié: (2025)
par: Xu, Hongshen, et autres
Publié: (2025)
Pruning Large Language Models with Semi-Structural Adaptive Sparse Training
par: Huang, Weiyu, et autres
Publié: (2024)
par: Huang, Weiyu, et autres
Publié: (2024)
Fine-grained Stateful Knowledge Exploration: Effective and Efficient Graph Retrieval with Large Language Models
par: Tao, Dehao, et autres
Publié: (2024)
par: Tao, Dehao, et autres
Publié: (2024)
Post-Training Large Language Models via Reinforcement Learning from Self-Feedback
par: van Niekerk, Carel, et autres
Publié: (2025)
par: van Niekerk, Carel, et autres
Publié: (2025)
TL-Training: A Task-Feature-Based Framework for Training Large Language Models in Tool Use
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
Token-Level Uncertainty-Aware Objective for Language Model Post-Training
par: Liu, Tingkai, et autres
Publié: (2025)
par: Liu, Tingkai, et autres
Publié: (2025)
EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models
par: Wang, Chengyu, et autres
Publié: (2025)
par: Wang, Chengyu, et autres
Publié: (2025)
High-Dimension Human Value Representation in Large Language Models
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
Online Training of Large Language Models: Learn while chatting
par: Liang, Juhao, et autres
Publié: (2024)
par: Liang, Juhao, et autres
Publié: (2024)
Towards Incremental Learning in Large Language Models: A Critical Review
par: Jovanovic, Mladjan, et autres
Publié: (2024)
par: Jovanovic, Mladjan, et autres
Publié: (2024)
Is Child-Directed Speech Effective Training Data for Language Models?
par: Feng, Steven Y., et autres
Publié: (2024)
par: Feng, Steven Y., et autres
Publié: (2024)
LLM-A*: Large Language Model Enhanced Incremental Heuristic Search on Path Planning
par: Meng, Silin, et autres
Publié: (2024)
par: Meng, Silin, et autres
Publié: (2024)
ConfTuner: Training Large Language Models to Express Their Confidence Verbally
par: Li, Yibo, et autres
Publié: (2025)
par: Li, Yibo, et autres
Publié: (2025)
GlitchProber: Advancing Effective Detection and Mitigation of Glitch Tokens in Large Language Models
par: Zhang, Zhibo, et autres
Publié: (2024)
par: Zhang, Zhibo, et autres
Publié: (2024)
Sparsity Induction for Accurate Post-Training Pruning of Large Language Models
par: Jiang, Minhao, et autres
Publié: (2026)
par: Jiang, Minhao, et autres
Publié: (2026)
Training-Free Activation Sparsity in Large Language Models
par: Liu, James, et autres
Publié: (2024)
par: Liu, James, et autres
Publié: (2024)
MentalArena: Self-play Training of Language Models for Diagnosis and Treatment of Mental Health Disorders
par: Li, Cheng, et autres
Publié: (2024)
par: Li, Cheng, et autres
Publié: (2024)
Using Reinforcement Learning to Train Large Language Models to Explain Human Decisions
par: Zhu, Jian-Qiao, et autres
Publié: (2025)
par: Zhu, Jian-Qiao, et autres
Publié: (2025)
Reviewing Clinical Knowledge in Medical Large Language Models: Training and Beyond
par: Li, Qiyuan, et autres
Publié: (2025)
par: Li, Qiyuan, et autres
Publié: (2025)
Sparse Feature Coactivation Reveals Causal Semantic Modules in Large Language Models
par: Deng, Ruixuan, et autres
Publié: (2025)
par: Deng, Ruixuan, et autres
Publié: (2025)
Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models
par: Kim, Seungduk, et autres
Publié: (2024)
par: Kim, Seungduk, et autres
Publié: (2024)
Systematic Characterization of the Effectiveness of Alignment in Large Language Models for Categorical Decisions
par: Kohane, Isaac
Publié: (2024)
par: Kohane, Isaac
Publié: (2024)
Cequel: Cost-Effective Querying of Large Language Models for Text Clustering
par: Wang, Hongtao, et autres
Publié: (2025)
par: Wang, Hongtao, et autres
Publié: (2025)
The Effectiveness of Large Language Models in Transforming Unstructured Text to Standardized Formats
par: Brach, William, et autres
Publié: (2025)
par: Brach, William, et autres
Publié: (2025)
Aggressive Post-Training Compression on Extremely Large Language Models
par: Zhang, Zining, et autres
Publié: (2024)
par: Zhang, Zining, et autres
Publié: (2024)
Reversing Large Language Models for Efficient Training and Fine-Tuning
par: Gal, Eshed, et autres
Publié: (2025)
par: Gal, Eshed, et autres
Publié: (2025)
Data Management For Training Large Language Models: A Survey
par: Wang, Zige, et autres
Publié: (2023)
par: Wang, Zige, et autres
Publié: (2023)
Documents similaires
-
Training Dynamics of a 1.7B LLaMa Model: A Data-Efficient Approach
par: Li, Miles Q., et autres
Publié: (2024) -
Security Concerns for Large Language Models: A Survey
par: Li, Miles Q., et autres
Publié: (2025) -
Leveraging Large Language Models for Rare Disease Named Entity Recognition
par: Xi, Nan Miles, et autres
Publié: (2025) -
Investigating Hallucinations in Pruned Large Language Models for Abstractive Summarization
par: Chrysostomou, George, et autres
Publié: (2023) -
Generative Large Language Models Trained for Detecting Errors in Radiology Reports
par: Sun, Cong, et autres
Publié: (2025)