Efficiently Building a Domain-Specific Large Language Model from Scratch: A Case Study of a Classical Chinese Large Language Model
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Shen, Hu, Renfen, Wang, Lijun |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Deep Associations, High Creativity: A Simple yet Effective Metric for Evaluating Large Language Models
by: Qiu, Ziliang, et al.
Published: (2025)
by: Qiu, Ziliang, et al.
Published: (2025)
Does Visual Grounding Enhance the Understanding of Embodied Knowledge in Large Language Models?
by: Yang, Zhihui, et al.
Published: (2025)
by: Yang, Zhihui, et al.
Published: (2025)
Efficient Continual Pre-training for Building Domain Specific Large Language Models
by: Xie, Yong, et al.
Published: (2023)
by: Xie, Yong, et al.
Published: (2023)
WenyanGPT: A Large Language Model for Classical Chinese Tasks
by: Yao, Xinyu, et al.
Published: (2025)
by: Yao, Xinyu, et al.
Published: (2025)
Reformulating Domain Adaptation of Large Language Models as Adapt-Retrieve-Revise: A Case Study on Chinese Legal Domain
by: wan, Zhen, et al.
Published: (2023)
by: wan, Zhen, et al.
Published: (2023)
SLearnLLM: A Self-Learning Framework for Efficient Domain-Specific Adaptation of Large Language Models
by: Liu, Xiang, et al.
Published: (2025)
by: Liu, Xiang, et al.
Published: (2025)
Capabilities and Evaluation Biases of Large Language Models in Classical Chinese Poetry Generation: A Case Study on Tang Poetry
by: Ma, Bolei, et al.
Published: (2025)
by: Ma, Bolei, et al.
Published: (2025)
ConsistentChat: Building Skeleton-Guided Consistent Multi-Turn Dialogues for Large Language Models from Scratch
by: Chen, Jiawei, et al.
Published: (2025)
by: Chen, Jiawei, et al.
Published: (2025)
MMNeuron: Discovering Neuron-Level Domain-Specific Interpretation in Multimodal Large Language Model
by: Huo, Jiahao, et al.
Published: (2024)
by: Huo, Jiahao, et al.
Published: (2024)
Building Dialogue Understanding Models for Low-resource Language Indonesian from Scratch
by: Di, Donglin, et al.
Published: (2024)
by: Di, Donglin, et al.
Published: (2024)
CRE-LLM: A Domain-Specific Chinese Relation Extraction Framework with Fine-tuned Large Language Model
by: Shi, Zhengpeng, et al.
Published: (2024)
by: Shi, Zhengpeng, et al.
Published: (2024)
TianHui: A Domain-Specific Large Language Model for Diverse Traditional Chinese Medicine Scenarios
by: Yin, Ji, et al.
Published: (2025)
by: Yin, Ji, et al.
Published: (2025)
Injecting Domain-Specific Knowledge into Large Language Models: A Comprehensive Survey
by: Song, Zirui, et al.
Published: (2025)
by: Song, Zirui, et al.
Published: (2025)
Classic4Children: Adapting Chinese Literary Classics for Children with Large Language Model
by: Chen, Jiali, et al.
Published: (2025)
by: Chen, Jiali, et al.
Published: (2025)
FinEval: A Chinese Financial Domain Knowledge Evaluation Benchmark for Large Language Models
by: Guo, Xin, et al.
Published: (2023)
by: Guo, Xin, et al.
Published: (2023)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
by: Fan, Yuchun, et al.
Published: (2025)
by: Fan, Yuchun, et al.
Published: (2025)
BLADE: Enhancing Black-box Large Language Models with Small Domain-Specific Models
by: Li, Haitao, et al.
Published: (2024)
by: Li, Haitao, et al.
Published: (2024)
PharmaGPT: Domain-Specific Large Language Models for Bio-Pharmaceutical and Chemistry
by: Chen, Linqing, et al.
Published: (2024)
by: Chen, Linqing, et al.
Published: (2024)
Enhancing Large Language Models with Domain-Specific Knowledge: The Case in Topological Materials
by: Xu, HuangChao, et al.
Published: (2024)
by: Xu, HuangChao, et al.
Published: (2024)
MiningGPT -- A Domain-Specific Large Language Model for the Mining Industry
by: Demartini, Kurukulasooriya Fernando ana Gianluca
Published: (2024)
by: Demartini, Kurukulasooriya Fernando ana Gianluca
Published: (2024)
TongGu: Mastering Classical Chinese Understanding with Knowledge-Grounded Large Language Models
by: Cao, Jiahuan, et al.
Published: (2024)
by: Cao, Jiahuan, et al.
Published: (2024)
ChineseSafe: A Chinese Benchmark for Evaluating Safety in Large Language Models
by: Zhang, Hengxiang, et al.
Published: (2024)
by: Zhang, Hengxiang, et al.
Published: (2024)
Creative Convergence or Imitation? Genre-Specific Homogeneity in LLM-Generated Chinese Literature
by: Ma, Yuanchi, et al.
Published: (2026)
by: Ma, Yuanchi, et al.
Published: (2026)
C$^{3}$Bench: A Comprehensive Classical Chinese Understanding Benchmark for Large Language Models
by: Cao, Jiahuan, et al.
Published: (2024)
by: Cao, Jiahuan, et al.
Published: (2024)
Engineering A Large Language Model From Scratch
by: Oketunji, Abiodun Finbarrs
Published: (2024)
by: Oketunji, Abiodun Finbarrs
Published: (2024)
SafeLLM: Domain-Specific Safety Monitoring for Large Language Models: A Case Study of Offshore Wind Maintenance
by: Walker, Connor, et al.
Published: (2024)
by: Walker, Connor, et al.
Published: (2024)
Building Guardrails for Large Language Models
by: Dong, Yi, et al.
Published: (2024)
by: Dong, Yi, et al.
Published: (2024)
Cheems: A Practical Guidance for Building and Evaluating Chinese Reward Models from Scratch
by: Wen, Xueru, et al.
Published: (2025)
by: Wen, Xueru, et al.
Published: (2025)
DDK: Distilling Domain Knowledge for Efficient Large Language Models
by: Liu, Jiaheng, et al.
Published: (2024)
by: Liu, Jiaheng, et al.
Published: (2024)
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
by: Chen, Andong, et al.
Published: (2024)
by: Chen, Andong, et al.
Published: (2024)
Evaluating Large Language Model with Knowledge Oriented Language Specific Simple Question Answering
by: Jiang, Bowen, et al.
Published: (2025)
by: Jiang, Bowen, et al.
Published: (2025)
Chinese SimpleQA: A Chinese Factuality Evaluation for Large Language Models
by: He, Yancheng, et al.
Published: (2024)
by: He, Yancheng, et al.
Published: (2024)
OpenHuEval: Evaluating Large Language Model on Hungarian Specifics
by: Yang, Haote, et al.
Published: (2025)
by: Yang, Haote, et al.
Published: (2025)
Supervised Fine Tuning of Large Language Models for Domain Specific Knowledge Graph Construction:A Case Study on Hunan's Historical Celebrities
by: Hao, Junjie, et al.
Published: (2025)
by: Hao, Junjie, et al.
Published: (2025)
Beyond Agreement: Diagnosing the Rationale Alignment of Automated Essay Scoring Methods based on Linguistically-informed Counterfactuals
by: Wang, Yupei, et al.
Published: (2024)
by: Wang, Yupei, et al.
Published: (2024)
On Relation-Specific Neurons in Large Language Models
by: Liu, Yihong, et al.
Published: (2025)
by: Liu, Yihong, et al.
Published: (2025)
A Chinese Dataset for Evaluating the Safeguards in Large Language Models
by: Wang, Yuxia, et al.
Published: (2024)
by: Wang, Yuxia, et al.
Published: (2024)
The Rosetta Paradox: Domain-Specific Performance Inversions in Large Language Models
by: Jha, Basab, et al.
Published: (2024)
by: Jha, Basab, et al.
Published: (2024)
INSEva: A Comprehensive Chinese Benchmark for Large Language Models in Insurance
by: Chen, Shisong, et al.
Published: (2025)
by: Chen, Shisong, et al.
Published: (2025)
Small Language Models as Effective Guides for Large Language Models in Chinese Relation Extraction
by: Tang, Xuemei, et al.
Published: (2024)
by: Tang, Xuemei, et al.
Published: (2024)
Similar Items
-
Deep Associations, High Creativity: A Simple yet Effective Metric for Evaluating Large Language Models
by: Qiu, Ziliang, et al.
Published: (2025) -
Does Visual Grounding Enhance the Understanding of Embodied Knowledge in Large Language Models?
by: Yang, Zhihui, et al.
Published: (2025) -
Efficient Continual Pre-training for Building Domain Specific Large Language Models
by: Xie, Yong, et al.
Published: (2023) -
WenyanGPT: A Large Language Model for Classical Chinese Tasks
by: Yao, Xinyu, et al.
Published: (2025) -
Reformulating Domain Adaptation of Large Language Models as Adapt-Retrieve-Revise: A Case Study on Chinese Legal Domain
by: wan, Zhen, et al.
Published: (2023)