Rethinking Data: Towards Better Performing Domain-Specific Small Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Nazarov, Boris, Frolova, Darya, Lubarsky, Yackov, Gaissinski, Alexei, Kisilev, Pavel |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Building Domain-Specific Small Language Models via Guided Data Generation
by: Kumar, Aman, et al.
Published: (2025)
by: Kumar, Aman, et al.
Published: (2025)
Cross-Domain Content Generation with Domain-Specific Small Language Models
by: Maloo, Ankit, et al.
Published: (2024)
by: Maloo, Ankit, et al.
Published: (2024)
Attention Condensation via Sparsity Induced Regularized Training
by: Sason, Eli, et al.
Published: (2025)
by: Sason, Eli, et al.
Published: (2025)
The Rosetta Paradox: Domain-Specific Performance Inversions in Large Language Models
by: Jha, Basab, et al.
Published: (2024)
by: Jha, Basab, et al.
Published: (2024)
Timo: Towards Better Temporal Reasoning for Language Models
by: Su, Zhaochen, et al.
Published: (2024)
by: Su, Zhaochen, et al.
Published: (2024)
RAFT: Adapting Language Model to Domain Specific RAG
by: Zhang, Tianjun, et al.
Published: (2024)
by: Zhang, Tianjun, et al.
Published: (2024)
Mentor-KD: Making Small Language Models Better Multi-step Reasoners
by: Lee, Hojae, et al.
Published: (2024)
by: Lee, Hojae, et al.
Published: (2024)
CausalEval: Towards Better Causal Reasoning in Language Models
by: Yu, Longxuan, et al.
Published: (2024)
by: Yu, Longxuan, et al.
Published: (2024)
Fine-Tuned Language Models for Domain-Specific Summarization and Tagging
by: Wang, Jun, et al.
Published: (2025)
by: Wang, Jun, et al.
Published: (2025)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
by: Lee, Jooyoung, et al.
Published: (2024)
by: Lee, Jooyoung, et al.
Published: (2024)
Improving Large Models with Small models: Lower Costs and Better Performance
by: Chen, Dong, et al.
Published: (2024)
by: Chen, Dong, et al.
Published: (2024)
Towards Text-free Graph Foundation Models: Rethinking Multi-Domain Graph Contrastive Learning
by: Zhao, Zihao, et al.
Published: (2025)
by: Zhao, Zihao, et al.
Published: (2025)
Rethinking Scale: Deployment Trade-offs of Small Language Models under Agent Paradigms
by: Wang, Xinlin, et al.
Published: (2026)
by: Wang, Xinlin, et al.
Published: (2026)
Towards Better Generalization in Open-Domain Question Answering by Mitigating Context Memorization
by: Zhang, Zixuan, et al.
Published: (2024)
by: Zhang, Zixuan, et al.
Published: (2024)
Small Language Model as Data Prospector for Large Language Model
by: Ni, Shiwen, et al.
Published: (2024)
by: Ni, Shiwen, et al.
Published: (2024)
Domain-Specific Data Generation Framework for RAG Adaptation
by: Tian, Chris Xing, et al.
Published: (2025)
by: Tian, Chris Xing, et al.
Published: (2025)
PharmaGPT: Domain-Specific Large Language Models for Bio-Pharmaceutical and Chemistry
by: Chen, Linqing, et al.
Published: (2024)
by: Chen, Linqing, et al.
Published: (2024)
DSG-KD: Knowledge Distillation from Domain-Specific to General Language Models
by: Cho, Sangyeon, et al.
Published: (2024)
by: Cho, Sangyeon, et al.
Published: (2024)
Evaluating ChatGPT on Nuclear Domain-Specific Data
by: Anwar, Muhammad, et al.
Published: (2024)
by: Anwar, Muhammad, et al.
Published: (2024)
Chain-of-Rank: Enhancing Large Language Models for Domain-Specific RAG in Edge Device
by: Lee, Juntae, et al.
Published: (2025)
by: Lee, Juntae, et al.
Published: (2025)
Adaptive Consensus Gradients Aggregation for Scaled Distributed Training
by: Choukroun, Yoni, et al.
Published: (2024)
by: Choukroun, Yoni, et al.
Published: (2024)
The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models
by: Chen, Yanjun, et al.
Published: (2024)
by: Chen, Yanjun, et al.
Published: (2024)
Readability $\ne$ Learnability: Rethinking the Role of Simplicity in Training Small Language Models
by: Lee, Ivan, et al.
Published: (2025)
by: Lee, Ivan, et al.
Published: (2025)
Performance Trade-offs of Optimizing Small Language Models for E-Commerce
by: Licardo, Josip Tomo, et al.
Published: (2025)
by: Licardo, Josip Tomo, et al.
Published: (2025)
Improving Phishing Email Detection Performance of Small Large Language Models
by: Lin, Zijie, et al.
Published: (2025)
by: Lin, Zijie, et al.
Published: (2025)
Is Training Data Quality or Quantity More Impactful to Small Language Model Performance?
by: Sajith, Aryan, et al.
Published: (2024)
by: Sajith, Aryan, et al.
Published: (2024)
PlaSma: Making Small Language Models Better Procedural Knowledge Models for (Counterfactual) Planning
by: Brahman, Faeze, et al.
Published: (2023)
by: Brahman, Faeze, et al.
Published: (2023)
Not-Just-Scaling Laws: Towards a Better Understanding of the Downstream Impact of Language Model Design Decisions
by: Liu, Emmy, et al.
Published: (2025)
by: Liu, Emmy, et al.
Published: (2025)
Towards Better Multi-task Learning: A Framework for Optimizing Dataset Combinations in Large Language Models
by: Zhan, Zaifu, et al.
Published: (2024)
by: Zhan, Zaifu, et al.
Published: (2024)
Sensitivity of Small Language Models to Fine-tuning Data Contamination
by: Scaria, Nicy, et al.
Published: (2025)
by: Scaria, Nicy, et al.
Published: (2025)
Towards Better Monolingual Japanese Retrievers with Multi-Vector Models
by: Clavié, Benjamin
Published: (2023)
by: Clavié, Benjamin
Published: (2023)
SLearnLLM: A Self-Learning Framework for Efficient Domain-Specific Adaptation of Large Language Models
by: Liu, Xiang, et al.
Published: (2025)
by: Liu, Xiang, et al.
Published: (2025)
TianHui: A Domain-Specific Large Language Model for Diverse Traditional Chinese Medicine Scenarios
by: Yin, Ji, et al.
Published: (2025)
by: Yin, Ji, et al.
Published: (2025)
Designing Domain-Specific Large Language Models: The Critical Role of Fine-Tuning in Public Opinion Simulation
by: Lin, Haocheng
Published: (2024)
by: Lin, Haocheng
Published: (2024)
Towards Reasoning Ability of Small Language Models
by: Srivastava, Gaurav, et al.
Published: (2025)
by: Srivastava, Gaurav, et al.
Published: (2025)
Toward Cybersecurity-Expert Small Language Models
by: Levi, Matan, et al.
Published: (2025)
by: Levi, Matan, et al.
Published: (2025)
Evaluating Small Language Models for News Summarization: Implications and Factors Influencing Performance
by: Xu, Borui, et al.
Published: (2025)
by: Xu, Borui, et al.
Published: (2025)
Domain-Adapted Small Language Models for Reliable Clinical Triage
by: Aljohani, Manar, et al.
Published: (2026)
by: Aljohani, Manar, et al.
Published: (2026)
Towards Efficient CoT Distillation: Self-Guided Rationale Selector for Better Performance with Fewer Rationales
by: Yan, Jianzhi, et al.
Published: (2025)
by: Yan, Jianzhi, et al.
Published: (2025)
Abstraction-of-Thought Makes Language Models Better Reasoners
by: Hong, Ruixin, et al.
Published: (2024)
by: Hong, Ruixin, et al.
Published: (2024)
Similar Items
-
Building Domain-Specific Small Language Models via Guided Data Generation
by: Kumar, Aman, et al.
Published: (2025) -
Cross-Domain Content Generation with Domain-Specific Small Language Models
by: Maloo, Ankit, et al.
Published: (2024) -
Attention Condensation via Sparsity Induced Regularized Training
by: Sason, Eli, et al.
Published: (2025) -
The Rosetta Paradox: Domain-Specific Performance Inversions in Large Language Models
by: Jha, Basab, et al.
Published: (2024) -
Timo: Towards Better Temporal Reasoning for Language Models
by: Su, Zhaochen, et al.
Published: (2024)