Fine-tuning large language models for domain adaptation: Exploration of training strategies, scaling, model merging and synergistic capabilities
Fuente:
arXiv
Salvato in:
| Autori principali: | Lu, Wei, Luu, Rachel K., Buehler, Markus J. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Agentic Deep Graph Reasoning Yields Self-Organizing Knowledge Networks
di: Buehler, Markus J.
Pubblicazione: (2025)
di: Buehler, Markus J.
Pubblicazione: (2025)
In-situ graph reasoning and knowledge expansion using Graph-PReFLexOR
di: Buehler, Markus J.
Pubblicazione: (2025)
di: Buehler, Markus J.
Pubblicazione: (2025)
Fine-tuning of lightweight large language models for sentiment classification on heterogeneous financial textual data
di: Amorin, Alvaro Paredes, et al.
Pubblicazione: (2025)
di: Amorin, Alvaro Paredes, et al.
Pubblicazione: (2025)
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)
Graph-Aware Isomorphic Attention for Adaptive Dynamics in Transformers
di: Buehler, Markus J.
Pubblicazione: (2025)
di: Buehler, Markus J.
Pubblicazione: (2025)
StatLLaMA: Multi-Stage training for domain-optimized statistical large language models
di: Zeng, Jing-Yi, et al.
Pubblicazione: (2025)
di: Zeng, Jing-Yi, et al.
Pubblicazione: (2025)
BeamPERL: Parameter-Efficient RL with Verifiable Rewards Specializes Compact LLMs for Structured Beam Mechanics Reasoning
di: Hage, Tarjei Paule, et al.
Pubblicazione: (2026)
di: Hage, Tarjei Paule, et al.
Pubblicazione: (2026)
Higher-Order Knowledge Representations for Agentic Scientific Reasoning
di: Stewart, Isabella A., et al.
Pubblicazione: (2026)
di: Stewart, Isabella A., et al.
Pubblicazione: (2026)
ProtAgents: Protein discovery via large language model multi-agent collaborations combining physics and machine learning
di: Ghafarollahi, A., et al.
Pubblicazione: (2024)
di: Ghafarollahi, A., et al.
Pubblicazione: (2024)
Reshaping MOFs text mining with a dynamic multi-agents framework of large language model
di: Lin, Zuhong, et al.
Pubblicazione: (2025)
di: Lin, Zuhong, et al.
Pubblicazione: (2025)
PRefLexOR: Preference-based Recursive Language Modeling for Exploratory Optimization of Reasoning and Agentic Thinking
di: Buehler, Markus J.
Pubblicazione: (2024)
di: Buehler, Markus J.
Pubblicazione: (2024)
How does fine-tuning improve sensorimotor representations in large language models?
di: Wu, Minghua, et al.
Pubblicazione: (2026)
di: Wu, Minghua, et al.
Pubblicazione: (2026)
Zero-shot cross-lingual transfer in instruction tuning of large language models
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
Learning the rules of peptide self-assembly through data mining with large language models
di: Yang, Zhenze, et al.
Pubblicazione: (2024)
di: Yang, Zhenze, et al.
Pubblicazione: (2024)
Accelerating Scientific Discovery with Generative Knowledge Extraction, Graph-Based Representation, and Multimodal Intelligent Graph Reasoning
di: Buehler, Markus J.
Pubblicazione: (2024)
di: Buehler, Markus J.
Pubblicazione: (2024)
Facilitating large language model Russian adaptation with Learned Embedding Propagation
di: Tikhomirov, Mikhail, et al.
Pubblicazione: (2024)
di: Tikhomirov, Mikhail, et al.
Pubblicazione: (2024)
Evolution of meta's llama models and parameter-efficient fine-tuning of large language models: a survey
di: Abdullah, Abdulhady Abas, et al.
Pubblicazione: (2025)
di: Abdullah, Abdulhady Abas, et al.
Pubblicazione: (2025)
Evidence of interrelated cognitive-like capabilities in large language models: Indications of artificial general intelligence or achievement?
di: Ilić, David, et al.
Pubblicazione: (2023)
di: Ilić, David, et al.
Pubblicazione: (2023)
ClinicalGPT-R1: Pushing reasoning capability of generalist disease diagnosis with large language model
di: Lan, Wuyang, et al.
Pubblicazione: (2025)
di: Lan, Wuyang, et al.
Pubblicazione: (2025)
TelcoLM: collecting data, adapting, and benchmarking language models for the telecommunication domain
di: Barboule, Camille, et al.
Pubblicazione: (2024)
di: Barboule, Camille, et al.
Pubblicazione: (2024)
Bringing legal knowledge to the public by constructing a legal question bank using large-scale pre-trained language model
di: Yuan, Mingruo, et al.
Pubblicazione: (2025)
di: Yuan, Mingruo, et al.
Pubblicazione: (2025)
Self-Revising Discovery Systems for Science: A Categorical Framework for Agentic Artificial Intelligence
di: Wang, Fiona Y., et al.
Pubblicazione: (2026)
di: Wang, Fiona Y., et al.
Pubblicazione: (2026)
SciAgents: Automating scientific discovery through multi-agent intelligent graph reasoning
di: Ghafarollahi, Alireza, et al.
Pubblicazione: (2024)
di: Ghafarollahi, Alireza, et al.
Pubblicazione: (2024)
Emergent effects of scaling on the functional hierarchies within large language models
di: Bogdan, Paul C.
Pubblicazione: (2025)
di: Bogdan, Paul C.
Pubblicazione: (2025)
Auxiliary task demands mask the capabilities of smaller language models
di: Hu, Jennifer, et al.
Pubblicazione: (2024)
di: Hu, Jennifer, et al.
Pubblicazione: (2024)
Dissociating language and thought in large language models
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
Large language models in healthcare and medical domain: A review
di: Nazi, Zabir Al, et al.
Pubblicazione: (2023)
di: Nazi, Zabir Al, et al.
Pubblicazione: (2023)
Fine-tuning multilingual language models in Twitter/X sentiment analysis: a study on Eastern-European V4 languages
di: Filip, Tomáš, et al.
Pubblicazione: (2024)
di: Filip, Tomáš, et al.
Pubblicazione: (2024)
WizardLM: Empowering large pre-trained language models to follow complex instructions
di: Xu, Can, et al.
Pubblicazione: (2023)
di: Xu, Can, et al.
Pubblicazione: (2023)
Metaphor identification using large language models: A comparison of RAG, prompt engineering, and fine-tuning
di: Fuoli, Matteo, et al.
Pubblicazione: (2025)
di: Fuoli, Matteo, et al.
Pubblicazione: (2025)
Post-training makes large language models less human-like
di: Binz, Marcel, et al.
Pubblicazione: (2026)
di: Binz, Marcel, et al.
Pubblicazione: (2026)
Assessment and manipulation of latent constructs in pre-trained language models using psychometric scales
di: Reuben, Maor, et al.
Pubblicazione: (2024)
di: Reuben, Maor, et al.
Pubblicazione: (2024)
Generative Artificial Intelligence Extracts Structure-Function Relationships from Plants for New Materials
di: Luu, Rachel K., et al.
Pubblicazione: (2025)
di: Luu, Rachel K., et al.
Pubblicazione: (2025)
DepressLLM: Interpretable domain-adapted language model for depression detection from real-world narratives
di: Moon, Sehwan, et al.
Pubblicazione: (2025)
di: Moon, Sehwan, et al.
Pubblicazione: (2025)
On the attribution of confidence to large language models
di: Keeling, Geoff, et al.
Pubblicazione: (2024)
di: Keeling, Geoff, et al.
Pubblicazione: (2024)
A dataset and benchmark for hospital course summarization with adapted large language models
di: Aali, Asad, et al.
Pubblicazione: (2024)
di: Aali, Asad, et al.
Pubblicazione: (2024)
Can large language models assist choice modelling? Insights into prompting strategies and current models capabilities
di: Sfeir, Georges, et al.
Pubblicazione: (2025)
di: Sfeir, Georges, et al.
Pubblicazione: (2025)
Evaluating large language models in medical applications: a survey
di: Chen, Xiaolan, et al.
Pubblicazione: (2024)
di: Chen, Xiaolan, et al.
Pubblicazione: (2024)
Long-form factuality in large language models
di: Wei, Jerry, et al.
Pubblicazione: (2024)
di: Wei, Jerry, et al.
Pubblicazione: (2024)
Disentangling generalization and memorization in large language models using chess
di: Pleiss, Leonard S., et al.
Pubblicazione: (2026)
di: Pleiss, Leonard S., et al.
Pubblicazione: (2026)
Documenti analoghi
-
Agentic Deep Graph Reasoning Yields Self-Organizing Knowledge Networks
di: Buehler, Markus J.
Pubblicazione: (2025) -
In-situ graph reasoning and knowledge expansion using Graph-PReFLexOR
di: Buehler, Markus J.
Pubblicazione: (2025) -
Fine-tuning of lightweight large language models for sentiment classification on heterogeneous financial textual data
di: Amorin, Alvaro Paredes, et al.
Pubblicazione: (2025) -
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025) -
Graph-Aware Isomorphic Attention for Adaptive Dynamics in Transformers
di: Buehler, Markus J.
Pubblicazione: (2025)