HUKUKBERT: Domain-Specific Language Model for Turkish Law
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Öztürk, Mehmet Utku, Türkoğlu, Tansu, Buz-Yalug, Buse |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
E-TSL: A Continuous Educational Turkish Sign Language Dataset with Baseline Methods
par: Öztürk, Şükrü, et autres
Publié: (2024)
par: Öztürk, Şükrü, et autres
Publié: (2024)
VBART: The Turkish LLM
par: Turker, Meliksah, et autres
Publié: (2024)
par: Turker, Meliksah, et autres
Publié: (2024)
VNLP: Turkish NLP Package
par: Turker, Meliksah, et autres
Publié: (2024)
par: Turker, Meliksah, et autres
Publié: (2024)
Compression Scaling Laws:Unifying Sparsity and Quantization
par: Frantar, Elias, et autres
Publié: (2025)
par: Frantar, Elias, et autres
Publié: (2025)
A Hybrid Protocol for Large-Scale Semantic Dataset Generation in Low-Resource Languages: The Turkish Semantic Relations Corpus
par: Tosun, Ebubekir, et autres
Publié: (2026)
par: Tosun, Ebubekir, et autres
Publié: (2026)
Merging Language and Domain Specific Models: The Impact on Technical Vocabulary Acquisition
par: Rousset, Thibault, et autres
Publié: (2025)
par: Rousset, Thibault, et autres
Publié: (2025)
Scaling BERT Models for Turkish Automatic Punctuation and Capitalization Correction
par: Saoud, Abdulkader, et autres
Publié: (2024)
par: Saoud, Abdulkader, et autres
Publié: (2024)
EpilepsyLLM: Domain-Specific Large Language Model Fine-tuned with Epilepsy Medical Knowledge
par: Zhao, Xuyang, et autres
Publié: (2024)
par: Zhao, Xuyang, et autres
Publié: (2024)
Beyond Cosine Similarity: Taming Semantic Drift and Antonym Intrusion in a 15-Million Node Turkish Synonym Graph
par: Tosun, Ebubekir, et autres
Publié: (2026)
par: Tosun, Ebubekir, et autres
Publié: (2026)
Mortgage Language Model: Domain-Adaptive Pretraining with Residual Instruction, Alignment Tuning, and Task-Specific Routing
par: Jain, Manish, et autres
Publié: (2025)
par: Jain, Manish, et autres
Publié: (2025)
Parallel Scaling Law for Language Models
par: Chen, Mouxiang, et autres
Publié: (2025)
par: Chen, Mouxiang, et autres
Publié: (2025)
Scaling Laws for Multilingual Language Models
par: He, Yifei, et autres
Publié: (2024)
par: He, Yifei, et autres
Publié: (2024)
Performance Law of Large Language Models
par: Wu, Chuhan, et autres
Publié: (2024)
par: Wu, Chuhan, et autres
Publié: (2024)
The Journey Matters: Average Parameter Count over Pre-training Unifies Sparse and Dense Scaling Laws
par: Jin, Tian, et autres
Publié: (2025)
par: Jin, Tian, et autres
Publié: (2025)
Enhancing Large Language Models with Domain-Specific Knowledge: The Case in Topological Materials
par: Xu, HuangChao, et autres
Publié: (2024)
par: Xu, HuangChao, et autres
Publié: (2024)
Domain-Specific Pruning of Large Mixture-of-Experts Models with Few-shot Demonstrations
par: Dong, Zican, et autres
Publié: (2025)
par: Dong, Zican, et autres
Publié: (2025)
Scaling Laws for Upcycling Mixture-of-Experts Language Models
par: Liew, Seng Pei, et autres
Publié: (2025)
par: Liew, Seng Pei, et autres
Publié: (2025)
Scaling Laws for Discriminative Classification in Large Language Models
par: Wyatte, Dean, et autres
Publié: (2024)
par: Wyatte, Dean, et autres
Publié: (2024)
Optimizing Large Language Models for Turkish: New Methodologies in Corpus Selection and Training
par: Kesgin, H. Toprak, et autres
Publié: (2024)
par: Kesgin, H. Toprak, et autres
Publié: (2024)
TURNA: A Turkish Encoder-Decoder Language Model for Enhanced Understanding and Generation
par: Uludoğan, Gökçe, et autres
Publié: (2024)
par: Uludoğan, Gökçe, et autres
Publié: (2024)
Beyond Early-Token Bias: Model-Specific and Language-Specific Position Effects in Multilingual LLMs
par: Menschikov, Mikhail, et autres
Publié: (2025)
par: Menschikov, Mikhail, et autres
Publié: (2025)
Scaling Laws for Post Training Quantized Large Language Models
par: Xu, Zifei, et autres
Publié: (2024)
par: Xu, Zifei, et autres
Publié: (2024)
Scaling Law for Language Models Training Considering Batch Size
par: Shuai, Xian, et autres
Publié: (2024)
par: Shuai, Xian, et autres
Publié: (2024)
Scaling Laws for Downstream Task Performance of Large Language Models
par: Isik, Berivan, et autres
Publié: (2024)
par: Isik, Berivan, et autres
Publié: (2024)
Task-Specific Efficiency Analysis: When Small Language Models Outperform Large Language Models
par: Cao, Jinghan, et autres
Publié: (2026)
par: Cao, Jinghan, et autres
Publié: (2026)
RoBERTurk: Adjusting RoBERTa for Turkish
par: Tas, Nuri
Publié: (2024)
par: Tas, Nuri
Publié: (2024)
Bridging the Bosphorus: Advancing Turkish Large Language Models through Strategies for Low-Resource Language Adaptation and Benchmarking
par: Acikgoz, Emre Can, et autres
Publié: (2024)
par: Acikgoz, Emre Can, et autres
Publié: (2024)
Beyond Chinchilla-Optimal: Accounting for Inference in Language Model Scaling Laws
par: Sardana, Nikhil, et autres
Publié: (2023)
par: Sardana, Nikhil, et autres
Publié: (2023)
Exploring Scaling Laws for Local SGD in Large Language Model Training
par: He, Qiaozhi, et autres
Publié: (2024)
par: He, Qiaozhi, et autres
Publié: (2024)
Multi-Faceted Question Complexity Estimation Targeting Topic Domain-Specificity
par: R, Sujay, et autres
Publié: (2024)
par: R, Sujay, et autres
Publié: (2024)
Advancing Semantic Caching for LLMs with Domain-Specific Embeddings and Synthetic Data
par: Gill, Waris, et autres
Publié: (2025)
par: Gill, Waris, et autres
Publié: (2025)
Lightweight Conceptual Dictionary Learning for Text Classification Using Information Compression
par: Wan, Li, et autres
Publié: (2024)
par: Wan, Li, et autres
Publié: (2024)
LawLLM: Law Large Language Model for the US Legal System
par: Shu, Dong, et autres
Publié: (2024)
par: Shu, Dong, et autres
Publié: (2024)
FiMI: A Domain-Specific Language Model for Indian Finance Ecosystem
par: Kathar, Aboli, et autres
Publié: (2026)
par: Kathar, Aboli, et autres
Publié: (2026)
Enhancing Domain-Specific Encoder Models with LLM-Generated Data: How to Leverage Ontologies, and How to Do Without Them
par: Brinner, Marc, et autres
Publié: (2025)
par: Brinner, Marc, et autres
Publié: (2025)
Optimal Splitting of Language Models from Mixtures to Specialized Domains
par: Seto, Skyler, et autres
Publié: (2026)
par: Seto, Skyler, et autres
Publié: (2026)
Domain-Adaptive Continued Pre-Training of Small Language Models
par: Faroz, Salman
Publié: (2025)
par: Faroz, Salman
Publié: (2025)
A Domain-Specific Language for LLM-Driven Trigger Generation in Multimodal Data Collection
par: Reis, Philipp, et autres
Publié: (2026)
par: Reis, Philipp, et autres
Publié: (2026)
Power-Law Decay Loss for Large Language Model Finetuning: A Theory Perspective
par: Shao, Jintian
Publié: (2025)
par: Shao, Jintian
Publié: (2025)
Can Language Models Discover Scaling Laws?
par: Lin, Haowei, et autres
Publié: (2025)
par: Lin, Haowei, et autres
Publié: (2025)
Documents similaires
-
E-TSL: A Continuous Educational Turkish Sign Language Dataset with Baseline Methods
par: Öztürk, Şükrü, et autres
Publié: (2024) -
VBART: The Turkish LLM
par: Turker, Meliksah, et autres
Publié: (2024) -
VNLP: Turkish NLP Package
par: Turker, Meliksah, et autres
Publié: (2024) -
Compression Scaling Laws:Unifying Sparsity and Quantization
par: Frantar, Elias, et autres
Publié: (2025) -
A Hybrid Protocol for Large-Scale Semantic Dataset Generation in Low-Resource Languages: The Turkish Semantic Relations Corpus
par: Tosun, Ebubekir, et autres
Publié: (2026)