Exploring Continual Fine-Tuning for Enhancing Language Ability in Large Language Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Aggarwal, Divyanshu, Damle, Sankarshan, Goyal, Navin, Lokam, Satya, Sitaram, Sunayana |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring Pretraining via Active Forgetting for Improving Cross Lingual Transfer for Decoder Language Models
par: Aggarwal, Divyanshu, et autres
Publié: (2024)
par: Aggarwal, Divyanshu, et autres
Publié: (2024)
MAPLE: Multilingual Evaluation of Parameter Efficient Finetuning of Large Language Models
par: Aggarwal, Divyanshu, et autres
Publié: (2024)
par: Aggarwal, Divyanshu, et autres
Publié: (2024)
CurLL: A Developmental Framework to Evaluate Continual Learning in Language Models
par: Kalyan, Pavan, et autres
Publié: (2025)
par: Kalyan, Pavan, et autres
Publié: (2025)
Improving Self Consistency in LLMs through Probabilistic Tokenization
par: Sathe, Ashutosh, et autres
Publié: (2024)
par: Sathe, Ashutosh, et autres
Publié: (2024)
M5 -- A Diverse Benchmark to Assess the Performance of Large Multimodal Models Across Multilingual and Multicultural Vision-Language Tasks
par: Schneider, Florian, et autres
Publié: (2024)
par: Schneider, Florian, et autres
Publié: (2024)
MEGAVERSE: Benchmarking Large Language Models Across Languages, Modalities, Models and Tasks
par: Ahuja, Sanchit, et autres
Publié: (2023)
par: Ahuja, Sanchit, et autres
Publié: (2023)
A Unified Framework and Dataset for Assessing Societal Bias in Vision-Language Models
par: Sathe, Ashutosh, et autres
Publié: (2024)
par: Sathe, Ashutosh, et autres
Publié: (2024)
MS-HuBERT: Mitigating Pre-training and Inference Mismatch in Masked Language Modelling methods for learning Speech Representations
par: Yadav, Hemant, et autres
Publié: (2024)
par: Yadav, Hemant, et autres
Publié: (2024)
CultureLLM: Incorporating Cultural Differences into Large Language Models
par: Li, Cheng, et autres
Publié: (2024)
par: Li, Cheng, et autres
Publié: (2024)
UPDESH: Synthesizing Grounded Instruction Tuning Data for 13 Indic Languages
par: Chitale, Pranjal A., et autres
Publié: (2025)
par: Chitale, Pranjal A., et autres
Publié: (2025)
Contamination Report for Multilingual Benchmarks
par: Ahuja, Sanchit, et autres
Publié: (2024)
par: Ahuja, Sanchit, et autres
Publié: (2024)
Are Large Language Model-based Evaluators the Solution to Scaling Up Multilingual Evaluation?
par: Hada, Rishav, et autres
Publié: (2023)
par: Hada, Rishav, et autres
Publié: (2023)
HEALTH-PARIKSHA: Assessing RAG Models for Health Chatbots in Real-World Multilingual Settings
par: Gumma, Varun, et autres
Publié: (2024)
par: Gumma, Varun, et autres
Publié: (2024)
Speech Representation Learning Revisited: The Necessity of Separate Learnable Parameters and Robust Data Augmentation
par: Yadav, Hemant, et autres
Publié: (2024)
par: Yadav, Hemant, et autres
Publié: (2024)
JOOCI: a Framework for Learning Comprehensive Speech Representations
par: Yadav, Hemant, et autres
Publié: (2024)
par: Yadav, Hemant, et autres
Publié: (2024)
sPhinX: Sample Efficient Multilingual Instruction Fine-Tuning Through N-shot Guided Prompting
par: Ahuja, Sanchit, et autres
Publié: (2024)
par: Ahuja, Sanchit, et autres
Publié: (2024)
DOSA: A Dataset of Social Artifacts from Different Indian Geographical Subcultures
par: Seth, Agrima, et autres
Publié: (2024)
par: Seth, Agrima, et autres
Publié: (2024)
MAFIA: Multi-Adapter Fused Inclusive LanguAge Models
par: Jain, Prachi, et autres
Publié: (2024)
par: Jain, Prachi, et autres
Publié: (2024)
Overtrained Language Models Are Harder to Fine-Tune
par: Springer, Jacob Mitchell, et autres
Publié: (2025)
par: Springer, Jacob Mitchell, et autres
Publié: (2025)
Analyzing Crowdfunding of Public Projects Under Dynamic Beliefs
par: Damle, Sankarshan, et autres
Publié: (2024)
par: Damle, Sankarshan, et autres
Publié: (2024)
HFT: Half Fine-Tuning for Large Language Models
par: Hui, Tingfeng, et autres
Publié: (2024)
par: Hui, Tingfeng, et autres
Publié: (2024)
PARIKSHA: A Large-Scale Investigation of Human-LLM Evaluator Agreement on Multilingual and Multi-Cultural Data
par: Watts, Ishaan, et autres
Publié: (2024)
par: Watts, Ishaan, et autres
Publié: (2024)
When Fine-Tuning Fails: Lessons from MS MARCO Passage Ranking
par: Pande, Manu, et autres
Publié: (2025)
par: Pande, Manu, et autres
Publié: (2025)
Efficient Continual Pre-training for Building Domain Specific Large Language Models
par: Xie, Yong, et autres
Publié: (2023)
par: Xie, Yong, et autres
Publié: (2023)
Memorization in Fine-Tuned Large Language Models
par: Savine, Danil
Publié: (2025)
par: Savine, Danil
Publié: (2025)
Enhancing Large Language Model Reasoning via Selective Critical Token Fine-Tuning
par: Ruan, Zhiwen, et autres
Publié: (2025)
par: Ruan, Zhiwen, et autres
Publié: (2025)
Emergent Abilities of Large Language Models under Continued Pretraining for Language Adaptation
par: Elhady, Ahmed, et autres
Publié: (2025)
par: Elhady, Ahmed, et autres
Publié: (2025)
Fluent but Foreign: Even Regional LLMs Lack Cultural Alignment
par: Agarwal, Dhruv, et autres
Publié: (2025)
par: Agarwal, Dhruv, et autres
Publié: (2025)
The Effect of Language Diversity When Fine-Tuning Large Language Models for Translation
par: Stap, David, et autres
Publié: (2025)
par: Stap, David, et autres
Publié: (2025)
GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models
par: Ruan, Zhiwen, et autres
Publié: (2026)
par: Ruan, Zhiwen, et autres
Publié: (2026)
METAL: Towards Multilingual Meta-Evaluation
par: Hada, Rishav, et autres
Publié: (2024)
par: Hada, Rishav, et autres
Publié: (2024)
Unveiling the Generalization Power of Fine-Tuned Large Language Models
par: Yang, Haoran, et autres
Publié: (2024)
par: Yang, Haoran, et autres
Publié: (2024)
Dynamics of Instruction Fine-Tuning for Chinese Large Language Models
par: Song, Chiyu, et autres
Publié: (2023)
par: Song, Chiyu, et autres
Publié: (2023)
Safety-Aware Fine-Tuning of Large Language Models
par: Choi, Hyeong Kyu, et autres
Publié: (2024)
par: Choi, Hyeong Kyu, et autres
Publié: (2024)
Phased Instruction Fine-Tuning for Large Language Models
par: Pang, Wei, et autres
Publié: (2024)
par: Pang, Wei, et autres
Publié: (2024)
Dissecting Fine-Tuning Unlearning in Large Language Models
par: Hong, Yihuai, et autres
Publié: (2024)
par: Hong, Yihuai, et autres
Publié: (2024)
Hyperbolic Fine-Tuning for Large Language Models
par: Yang, Menglin, et autres
Publié: (2024)
par: Yang, Menglin, et autres
Publié: (2024)
Parameter-Efficient Fine-Tuning of Large Language Models using Semantic Knowledge Tuning
par: Prottasha, Nusrat Jahan, et autres
Publié: (2024)
par: Prottasha, Nusrat Jahan, et autres
Publié: (2024)
Teaching LLMs to Abstain across Languages via Multilingual Feedback
par: Feng, Shangbin, et autres
Publié: (2024)
par: Feng, Shangbin, et autres
Publié: (2024)
The Astonishing Ability of Large Language Models to Parse Jabberwockified Language
par: Lupyan, Gary, et autres
Publié: (2026)
par: Lupyan, Gary, et autres
Publié: (2026)
Documents similaires
-
Exploring Pretraining via Active Forgetting for Improving Cross Lingual Transfer for Decoder Language Models
par: Aggarwal, Divyanshu, et autres
Publié: (2024) -
MAPLE: Multilingual Evaluation of Parameter Efficient Finetuning of Large Language Models
par: Aggarwal, Divyanshu, et autres
Publié: (2024) -
CurLL: A Developmental Framework to Evaluate Continual Learning in Language Models
par: Kalyan, Pavan, et autres
Publié: (2025) -
Improving Self Consistency in LLMs through Probabilistic Tokenization
par: Sathe, Ashutosh, et autres
Publié: (2024) -
M5 -- A Diverse Benchmark to Assess the Performance of Large Multimodal Models Across Multilingual and Multicultural Vision-Language Tasks
par: Schneider, Florian, et autres
Publié: (2024)