StatLLaMA: Multi-Stage training for domain-optimized statistical large language models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zeng, Jing-Yi, Huang, Guan-Hua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning
di: Xia, Mengzhou, et al.
Pubblicazione: (2023)
di: Xia, Mengzhou, et al.
Pubblicazione: (2023)
Me LLaMA: Foundation Large Language Models for Medical Applications
di: Xie, Qianqian, et al.
Pubblicazione: (2024)
di: Xie, Qianqian, et al.
Pubblicazione: (2024)
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
di: Zhao, Jun, et al.
Pubblicazione: (2024)
di: Zhao, Jun, et al.
Pubblicazione: (2024)
How Vocabulary Sharing Facilitates Multilingualism in LLaMA?
di: Yuan, Fei, et al.
Pubblicazione: (2023)
di: Yuan, Fei, et al.
Pubblicazione: (2023)
Fine-tuning large language models for domain adaptation: Exploration of training strategies, scaling, model merging and synergistic capabilities
di: Lu, Wei, et al.
Pubblicazione: (2024)
di: Lu, Wei, et al.
Pubblicazione: (2024)
LLaMAs Have Feelings Too: Unveiling Sentiment and Emotion Representations in LLaMA Models Through Probing
di: Di Palma, Dario, et al.
Pubblicazione: (2025)
di: Di Palma, Dario, et al.
Pubblicazione: (2025)
BanglaLlama: LLaMA for Bangla Language
di: Zehady, Abdullah Khan, et al.
Pubblicazione: (2024)
di: Zehady, Abdullah Khan, et al.
Pubblicazione: (2024)
Multi-round jailbreak attack on large language models
di: Zhou, Yihua, et al.
Pubblicazione: (2024)
di: Zhou, Yihua, et al.
Pubblicazione: (2024)
WizardLM: Empowering large pre-trained language models to follow complex instructions
di: Xu, Can, et al.
Pubblicazione: (2023)
di: Xu, Can, et al.
Pubblicazione: (2023)
ChatGPT vs Gemini vs LLaMA on Multilingual Sentiment Analysis
di: Buscemi, Alessio, et al.
Pubblicazione: (2024)
di: Buscemi, Alessio, et al.
Pubblicazione: (2024)
LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning
di: Zhang, Di, et al.
Pubblicazione: (2024)
di: Zhang, Di, et al.
Pubblicazione: (2024)
Dissociating language and thought in large language models
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
Post-training makes large language models less human-like
di: Binz, Marcel, et al.
Pubblicazione: (2026)
di: Binz, Marcel, et al.
Pubblicazione: (2026)
The impact of fine tuning in LLaMA on hallucinations for named entity extraction in legal documentation
di: Vargas, Francisco, et al.
Pubblicazione: (2025)
di: Vargas, Francisco, et al.
Pubblicazione: (2025)
Streamlining evidence based clinical recommendations with large language models
di: Li, Dubai, et al.
Pubblicazione: (2025)
di: Li, Dubai, et al.
Pubblicazione: (2025)
Empowering Smaller Models: Tuning LLaMA and Gemma with Chain-of-Thought for Ukrainian Exam Tasks
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)
On the attribution of confidence to large language models
di: Keeling, Geoff, et al.
Pubblicazione: (2024)
di: Keeling, Geoff, et al.
Pubblicazione: (2024)
MusiScene: Leveraging MU-LLaMA for Scene Imagination and Enhanced Video Background Music Generation
di: Izzati, Fathinah, et al.
Pubblicazione: (2025)
di: Izzati, Fathinah, et al.
Pubblicazione: (2025)
Metamorphic Testing for Fairness Evaluation in Large Language Models: Identifying Intersectional Bias in LLaMA and GPT
di: Reddy, Harishwar, et al.
Pubblicazione: (2025)
di: Reddy, Harishwar, et al.
Pubblicazione: (2025)
LLaSE-G1: Incentivizing Generalization Capability for LLaMA-based Speech Enhancement
di: Kang, Boyi, et al.
Pubblicazione: (2025)
di: Kang, Boyi, et al.
Pubblicazione: (2025)
Advanced Natural-based interaction for the ITAlian language: LLaMAntino-3-ANITA
di: Polignano, Marco, et al.
Pubblicazione: (2024)
di: Polignano, Marco, et al.
Pubblicazione: (2024)
Resource-Efficient Fine-Tuning of LLaMA-3.2-3B for Medical Chain-of-Thought Reasoning
di: Mansha, Imran
Pubblicazione: (2025)
di: Mansha, Imran
Pubblicazione: (2025)
Does Tone Change the Answer? Evaluating Prompt Politeness Effects on Modern LLMs: GPT, Gemini, and LLaMA
di: Cai, Hanyu, et al.
Pubblicazione: (2025)
di: Cai, Hanyu, et al.
Pubblicazione: (2025)
Principled Instructions Are All You Need for Questioning LLaMA-1/2, GPT-3.5/4
di: Bsharat, Sondos Mahmoud, et al.
Pubblicazione: (2023)
di: Bsharat, Sondos Mahmoud, et al.
Pubblicazione: (2023)
Long-form factuality in large language models
di: Wei, Jerry, et al.
Pubblicazione: (2024)
di: Wei, Jerry, et al.
Pubblicazione: (2024)
Uncovering inequalities in new knowledge learning by large language models across different languages
di: Wang, Chenglong, et al.
Pubblicazione: (2025)
di: Wang, Chenglong, et al.
Pubblicazione: (2025)
Bringing legal knowledge to the public by constructing a legal question bank using large-scale pre-trained language model
di: Yuan, Mingruo, et al.
Pubblicazione: (2025)
di: Yuan, Mingruo, et al.
Pubblicazione: (2025)
Large language models in healthcare and medical domain: A review
di: Nazi, Zabir Al, et al.
Pubblicazione: (2023)
di: Nazi, Zabir Al, et al.
Pubblicazione: (2023)
Quantifying non deterministic drift in large language models
di: Nicholson, Claire
Pubblicazione: (2026)
di: Nicholson, Claire
Pubblicazione: (2026)
Can large language models build causal graphs?
di: Long, Stephanie, et al.
Pubblicazione: (2023)
di: Long, Stephanie, et al.
Pubblicazione: (2023)
Response: Emergent analogical reasoning in large language models
di: Hodel, Damian, et al.
Pubblicazione: (2023)
di: Hodel, Damian, et al.
Pubblicazione: (2023)
The 20 questions game to distinguish large language models
di: Richardeau, Gurvan, et al.
Pubblicazione: (2024)
di: Richardeau, Gurvan, et al.
Pubblicazione: (2024)
Representation in large language models
di: Yetman, Cameron
Pubblicazione: (2025)
di: Yetman, Cameron
Pubblicazione: (2025)
MindScope: Exploring cognitive biases in large language models through Multi-Agent Systems
di: Xie, Zhentao, et al.
Pubblicazione: (2024)
di: Xie, Zhentao, et al.
Pubblicazione: (2024)
LLaMA-Excitor: General Instruction Tuning via Indirect Feature Interaction
di: Zou, Bo, et al.
Pubblicazione: (2024)
di: Zou, Bo, et al.
Pubblicazione: (2024)
LLaMA-E: Empowering E-commerce Authoring with Object-Interleaved Instruction Following
di: Shi, Kaize, et al.
Pubblicazione: (2023)
di: Shi, Kaize, et al.
Pubblicazione: (2023)
Failure of contextual invariance in large language models
di: Kumar, Sagar, et al.
Pubblicazione: (2026)
di: Kumar, Sagar, et al.
Pubblicazione: (2026)
Emission-GPT: A domain-specific language model agent for knowledge retrieval, emission inventory and data analysis
di: Ye, Jiashu, et al.
Pubblicazione: (2025)
di: Ye, Jiashu, et al.
Pubblicazione: (2025)
A survey of textual cyber abuse detection using cutting-edge language models and large language models
di: Diaz-Garcia, Jose A., et al.
Pubblicazione: (2025)
di: Diaz-Garcia, Jose A., et al.
Pubblicazione: (2025)
Re-evaluating Theory of Mind evaluation in large language models
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning
di: Xia, Mengzhou, et al.
Pubblicazione: (2023) -
Me LLaMA: Foundation Large Language Models for Medical Applications
di: Xie, Qianqian, et al.
Pubblicazione: (2024) -
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
di: Zhao, Jun, et al.
Pubblicazione: (2024) -
How Vocabulary Sharing Facilitates Multilingualism in LLaMA?
di: Yuan, Fei, et al.
Pubblicazione: (2023) -
Fine-tuning large language models for domain adaptation: Exploration of training strategies, scaling, model merging and synergistic capabilities
di: Lu, Wei, et al.
Pubblicazione: (2024)