Salvato in:
| Autori principali: | Jindal, Ashvini Kumar, Rajpoot, Pawan Kumar, Parikh, Ankur |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2403.02247 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
NeurIPS 2023 LLM Efficiency Fine-tuning Competition
di: Saroufim, Mark, et al.
Pubblicazione: (2025)
di: Saroufim, Mark, et al.
Pubblicazione: (2025)
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
di: Han, Yifu, et al.
Pubblicazione: (2025)
di: Han, Yifu, et al.
Pubblicazione: (2025)
TIFIN India at SemEval-2025: Harnessing Translation to Overcome Multilingual IR Challenges in Fact-Checked Claim Retrieval
di: Devadiga, Prasanna, et al.
Pubblicazione: (2025)
di: Devadiga, Prasanna, et al.
Pubblicazione: (2025)
Multilingual Conversational AI for Financial Assistance: Bridging Language Barriers in Indian FinTech
di: Hazarika, Bharatdeep, et al.
Pubblicazione: (2025)
di: Hazarika, Bharatdeep, et al.
Pubblicazione: (2025)
Integrating gender inclusivity into large language models via instruction tuning
di: Wróblewska, Alina, et al.
Pubblicazione: (2025)
di: Wróblewska, Alina, et al.
Pubblicazione: (2025)
MAIN: Mutual Alignment Is Necessary for instruction tuning
di: Yang, Fanyi, et al.
Pubblicazione: (2025)
di: Yang, Fanyi, et al.
Pubblicazione: (2025)
RandLoRA: Full-rank parameter-efficient fine-tuning of large models
di: Albert, Paul, et al.
Pubblicazione: (2025)
di: Albert, Paul, et al.
Pubblicazione: (2025)
Evolution of meta's llama models and parameter-efficient fine-tuning of large language models: a survey
di: Abdullah, Abdulhady Abas, et al.
Pubblicazione: (2025)
di: Abdullah, Abdulhady Abas, et al.
Pubblicazione: (2025)
More than Just Statistical Recurrence: Human and Machine Unsupervised Learning of Māori Word Segmentation across Morphological Processes
di: Varatharaj, Ashvini, et al.
Pubblicazione: (2024)
di: Varatharaj, Ashvini, et al.
Pubblicazione: (2024)
Zero-shot cross-lingual transfer in instruction tuning of large language models
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
LayerNorm: A key component in parameter-efficient fine-tuning
di: ValizadehAslani, Taha, et al.
Pubblicazione: (2024)
di: ValizadehAslani, Taha, et al.
Pubblicazione: (2024)
Task-conditioned probing of instruction-tuned multimodal LLMs: Region-specific brain alignment patterns under naturalistic stimuli
di: Oota, Subba Reddy, et al.
Pubblicazione: (2025)
di: Oota, Subba Reddy, et al.
Pubblicazione: (2025)
Multi-task retriever fine-tuning for domain-specific and efficient RAG
di: Béchard, Patrice, et al.
Pubblicazione: (2025)
di: Béchard, Patrice, et al.
Pubblicazione: (2025)
Do as I do (Safely): Mitigating Task-Specific Fine-tuning Risks in Large Language Models
di: Eiras, Francisco, et al.
Pubblicazione: (2024)
di: Eiras, Francisco, et al.
Pubblicazione: (2024)
Improving embedding with contrastive fine-tuning on small datasets with expert-augmented scores
di: Lu, Jun, et al.
Pubblicazione: (2024)
di: Lu, Jun, et al.
Pubblicazione: (2024)
PETapter: Leveraging PET-style classification heads for modular few-shot parameter-efficient fine-tuning
di: Rieger, Jonas, et al.
Pubblicazione: (2024)
di: Rieger, Jonas, et al.
Pubblicazione: (2024)
Complexity-aware fine-tuning
di: Goncharov, Andrey, et al.
Pubblicazione: (2025)
di: Goncharov, Andrey, et al.
Pubblicazione: (2025)
T-curator: a trust based curation tool for LOD logs
di: Lanasri, Dihia
Pubblicazione: (2024)
di: Lanasri, Dihia
Pubblicazione: (2024)
Integrating curation into scientific publishing to train AI models
di: Abreu-Vicente, Jorge, et al.
Pubblicazione: (2023)
di: Abreu-Vicente, Jorge, et al.
Pubblicazione: (2023)
Reasoning-Guided Claim Normalization for Noisy Multilingual Social Media Posts
di: Sharma, Manan, et al.
Pubblicazione: (2025)
di: Sharma, Manan, et al.
Pubblicazione: (2025)
Immunization against harmful fine-tuning attacks
di: Rosati, Domenic, et al.
Pubblicazione: (2024)
di: Rosati, Domenic, et al.
Pubblicazione: (2024)
Temporal fine-tuning for early risk detection
di: Thompson, Horacio, et al.
Pubblicazione: (2025)
di: Thompson, Horacio, et al.
Pubblicazione: (2025)
TheBlueScrubs-v1, a comprehensive curated medical dataset derived from the internet
di: Felipe, Luis, et al.
Pubblicazione: (2025)
di: Felipe, Luis, et al.
Pubblicazione: (2025)
Comparison between parameter-efficient techniques and full fine-tuning: A case study on multilingual news article classification
di: Razuvayevskaya, Olesya, et al.
Pubblicazione: (2023)
di: Razuvayevskaya, Olesya, et al.
Pubblicazione: (2023)
Rethinking harmless refusals when fine-tuning foundation models
di: Pop, Florin, et al.
Pubblicazione: (2024)
di: Pop, Florin, et al.
Pubblicazione: (2024)
ParaRev: Building a dataset for Scientific Paragraph Revision annotated with revision instruction
di: Jourdan, Léane, et al.
Pubblicazione: (2025)
di: Jourdan, Léane, et al.
Pubblicazione: (2025)
Deep literature reviews: an application of fine-tuned language models to migration research
di: Iacus, Stefano M., et al.
Pubblicazione: (2025)
di: Iacus, Stefano M., et al.
Pubblicazione: (2025)
Labeling supervised fine-tuning data with the scaling law
di: Kong, Huanjun
Pubblicazione: (2024)
di: Kong, Huanjun
Pubblicazione: (2024)
The representation landscape of few-shot learning and fine-tuning in large language models
di: Doimo, Diego, et al.
Pubblicazione: (2024)
di: Doimo, Diego, et al.
Pubblicazione: (2024)
How does fine-tuning improve sensorimotor representations in large language models?
di: Wu, Minghua, et al.
Pubblicazione: (2026)
di: Wu, Minghua, et al.
Pubblicazione: (2026)
MNAFT: modality neuron-aware fine-tuning of multimodal large language models for image translation
di: Li, Bo, et al.
Pubblicazione: (2026)
di: Li, Bo, et al.
Pubblicazione: (2026)
Minor SFT loss for LLM fine-tune to increase performance and reduce model deviation
di: Xie, Shiming, et al.
Pubblicazione: (2024)
di: Xie, Shiming, et al.
Pubblicazione: (2024)
Automated scoring of the Ambiguous Intentions Hostility Questionnaire using fine-tuned large language models
di: Lyu, Y., et al.
Pubblicazione: (2025)
di: Lyu, Y., et al.
Pubblicazione: (2025)
Retention analysis of edited knowledge after fine-tuning
di: Wen, Fufang, et al.
Pubblicazione: (2025)
di: Wen, Fufang, et al.
Pubblicazione: (2025)
Replaying pre-training data improves fine-tuning
di: Kotha, Suhas, et al.
Pubblicazione: (2026)
di: Kotha, Suhas, et al.
Pubblicazione: (2026)
Understanding the effects of language-specific class imbalance in multilingual fine-tuning
di: Jung, Vincent, et al.
Pubblicazione: (2024)
di: Jung, Vincent, et al.
Pubblicazione: (2024)
Improving LLM-based Ontology Matching with fine-tuning on synthetic data
di: Sousa, Guilherme, et al.
Pubblicazione: (2025)
di: Sousa, Guilherme, et al.
Pubblicazione: (2025)
Building English ASR model with regional language support
di: Agrawal, Purvi, et al.
Pubblicazione: (2025)
di: Agrawal, Purvi, et al.
Pubblicazione: (2025)
BadLlama: cheaply removing safety fine-tuning from Llama 2-Chat 13B
di: Gade, Pranav, et al.
Pubblicazione: (2023)
di: Gade, Pranav, et al.
Pubblicazione: (2023)
Watch the Weights: Unsupervised monitoring and control of fine-tuned LLMs
di: Zhong, Ziqian, et al.
Pubblicazione: (2025)
di: Zhong, Ziqian, et al.
Pubblicazione: (2025)
Documenti analoghi
-
NeurIPS 2023 LLM Efficiency Fine-tuning Competition
di: Saroufim, Mark, et al.
Pubblicazione: (2025) -
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
di: Han, Yifu, et al.
Pubblicazione: (2025) -
TIFIN India at SemEval-2025: Harnessing Translation to Overcome Multilingual IR Challenges in Fact-Checked Claim Retrieval
di: Devadiga, Prasanna, et al.
Pubblicazione: (2025) -
Multilingual Conversational AI for Financial Assistance: Bridging Language Barriers in Indian FinTech
di: Hazarika, Bharatdeep, et al.
Pubblicazione: (2025) -
Integrating gender inclusivity into large language models via instruction tuning
di: Wróblewska, Alina, et al.
Pubblicazione: (2025)