SnakModel: Lessons Learned from Training an Open Danish Large Language Model
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Mike, Müller-Eberstein, Max, Bassignana, Elisa, van der Goot, Rob |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DaKultur: Evaluating the Cultural Awareness of Language Models for Danish with Native Speakers
by: Müller-Eberstein, Max, et al.
Published: (2025)
by: Müller-Eberstein, Max, et al.
Published: (2025)
Can Humans Identify Domains?
by: Barrett, Maria, et al.
Published: (2024)
by: Barrett, Maria, et al.
Published: (2024)
NLPnorth @ TalentCLEF 2025: Comparing Discriminative, Contrastive, and Prompt-Based Methods for Job Title and Skill Matching
by: Zhang, Mike, et al.
Published: (2025)
by: Zhang, Mike, et al.
Published: (2025)
Do Large Language Models Adapt to Language Variation across Socioeconomic Status?
by: Bassignana, Elisa, et al.
Published: (2026)
by: Bassignana, Elisa, et al.
Published: (2026)
From Smør-re-brød to Subwords: Training LLMs on Danish, One Morpheme at a Time
by: Kildeberg, Mikkel Wildner, et al.
Published: (2025)
by: Kildeberg, Mikkel Wildner, et al.
Published: (2025)
Entity Linking in the Job Market Domain
by: Zhang, Mike, et al.
Published: (2024)
by: Zhang, Mike, et al.
Published: (2024)
Big City Bias: Evaluating the Impact of Metropolitan Size on Computational Job Market Abilities of Language Models
by: Campanella, Charlie, et al.
Published: (2024)
by: Campanella, Charlie, et al.
Published: (2024)
Do Syntactic Categories Help in Developmentally Motivated Curriculum Learning for Language Models?
by: Güven, Arzu Burcu, et al.
Published: (2025)
by: Güven, Arzu Burcu, et al.
Published: (2025)
Deep Learning-based Computational Job Market Analysis: A Survey on Skill Extraction and Classification from Job Postings
by: Senger, Elena, et al.
Published: (2024)
by: Senger, Elena, et al.
Published: (2024)
When Meanings Meet: Investigating the Emergence and Quality of Shared Concept Spaces during Multilingual Language Model Training
by: Körner, Felicia, et al.
Published: (2026)
by: Körner, Felicia, et al.
Published: (2026)
How to Encode Domain Information in Relation Classification
by: Bassignana, Elisa, et al.
Published: (2024)
by: Bassignana, Elisa, et al.
Published: (2024)
PolyPythias: Stability and Outliers across Fifty Language Model Pre-Training Runs
by: van der Wal, Oskar, et al.
Published: (2025)
by: van der Wal, Oskar, et al.
Published: (2025)
NNOSE: Nearest Neighbor Occupational Skill Extraction
by: Zhang, Mike, et al.
Published: (2024)
by: Zhang, Mike, et al.
Published: (2024)
The Language of Attachment: Modeling Attachment Dynamics in Psychotherapy
by: Bredgaard, Frederik, et al.
Published: (2025)
by: Bredgaard, Frederik, et al.
Published: (2025)
KARRIEREWEGE: A Large Scale Career Path Prediction Dataset
by: Senger, Elena, et al.
Published: (2024)
by: Senger, Elena, et al.
Published: (2024)
EEVEE: An Easy Annotation Tool for Natural Language Processing
by: Sorensen, Axel, et al.
Published: (2024)
by: Sorensen, Axel, et al.
Published: (2024)
data2lang2vec: Data Driven Typological Features Completion
by: Amirzadeh, Hamidreza, et al.
Published: (2024)
by: Amirzadeh, Hamidreza, et al.
Published: (2024)
The AI Gap: How Socioeconomic Status Affects Language Technology Interactions
by: Bassignana, Elisa, et al.
Published: (2025)
by: Bassignana, Elisa, et al.
Published: (2025)
Crossing Domains without Labels: Distant Supervision for Term Extraction
by: Senger, Elena, et al.
Published: (2025)
by: Senger, Elena, et al.
Published: (2025)
Traces of Social Competence in Large Language Models
by: Kouwenhoven, Tom, et al.
Published: (2026)
by: Kouwenhoven, Tom, et al.
Published: (2026)
Analysing Differences in Persuasive Language in LLM-Generated Text: Uncovering Stereotypical Gender Patterns
by: Pauli, Amalie Brogaard, et al.
Published: (2026)
by: Pauli, Amalie Brogaard, et al.
Published: (2026)
Agentic Large Language Models, a survey
by: Plaat, Aske, et al.
Published: (2025)
by: Plaat, Aske, et al.
Published: (2025)
Inverse Reinforcement Learning Meets Large Language Model Post-Training: Basics, Advances, and Opportunities
by: Sun, Hao, et al.
Published: (2025)
by: Sun, Hao, et al.
Published: (2025)
Hypernetworks for Personalizing ASR to Atypical Speech
by: Müller-Eberstein, Max, et al.
Published: (2024)
by: Müller-Eberstein, Max, et al.
Published: (2024)
RedPajama: an Open Dataset for Training Large Language Models
by: Weber, Maurice, et al.
Published: (2024)
by: Weber, Maurice, et al.
Published: (2024)
Overreliance on AI in Information-seeking from Video Content
by: Møller, Anders Giovanni, et al.
Published: (2026)
by: Møller, Anders Giovanni, et al.
Published: (2026)
MultiLexNorm++: A Unified Benchmark and a Generative Model for Lexical Normalization for Asian Languages
by: Buaphet, Weerayut, et al.
Published: (2026)
by: Buaphet, Weerayut, et al.
Published: (2026)
Redefining Digital Health Interfaces with Large Language Models
by: Imrie, Fergus, et al.
Published: (2023)
by: Imrie, Fergus, et al.
Published: (2023)
Continuously Updating Digital Twins using Large Language Models
by: Amad, Harry, et al.
Published: (2025)
by: Amad, Harry, et al.
Published: (2025)
Curved Inference: Concern-Sensitive Geometry in Large Language Model Residual Streams
by: Manson, Rob
Published: (2025)
by: Manson, Rob
Published: (2025)
OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models
by: Huang, Siming, et al.
Published: (2024)
by: Huang, Siming, et al.
Published: (2024)
Typhoon-S: Minimal Open Post-Training for Sovereign Large Language Models
by: Pipatanakul, Kunat, et al.
Published: (2026)
by: Pipatanakul, Kunat, et al.
Published: (2026)
Post-Training Large Language Models via Reinforcement Learning from Self-Feedback
by: van Niekerk, Carel, et al.
Published: (2025)
by: van Niekerk, Carel, et al.
Published: (2025)
Reasoning Capabilities of Large Language Models. Lessons Learned from General Game Playing
by: Świechowski, Maciej, et al.
Published: (2026)
by: Świechowski, Maciej, et al.
Published: (2026)
The Hallucinations Leaderboard -- An Open Effort to Measure Hallucinations in Large Language Models
by: Hong, Giwon, et al.
Published: (2024)
by: Hong, Giwon, et al.
Published: (2024)
Training Language Models on Synthetic Edit Sequences Improves Code Synthesis
by: Piterbarg, Ulyana, et al.
Published: (2024)
by: Piterbarg, Ulyana, et al.
Published: (2024)
Corrective In-Context Learning: Evaluating Self-Correction in Large Language Models
by: Sanz-Guerrero, Mario, et al.
Published: (2025)
by: Sanz-Guerrero, Mario, et al.
Published: (2025)
Investigating the Role of Prompting and External Tools in Hallucination Rates of Large Language Models
by: Barkley, Liam, et al.
Published: (2024)
by: Barkley, Liam, et al.
Published: (2024)
Modifying Large Language Model Post-Training for Diverse Creative Writing
by: Chung, John Joon Young, et al.
Published: (2025)
by: Chung, John Joon Young, et al.
Published: (2025)
Can Large Language Models Act as Symbolic Reasoners?
by: Sullivan, Rob, et al.
Published: (2024)
by: Sullivan, Rob, et al.
Published: (2024)
Similar Items
-
DaKultur: Evaluating the Cultural Awareness of Language Models for Danish with Native Speakers
by: Müller-Eberstein, Max, et al.
Published: (2025) -
Can Humans Identify Domains?
by: Barrett, Maria, et al.
Published: (2024) -
NLPnorth @ TalentCLEF 2025: Comparing Discriminative, Contrastive, and Prompt-Based Methods for Job Title and Skill Matching
by: Zhang, Mike, et al.
Published: (2025) -
Do Large Language Models Adapt to Language Variation across Socioeconomic Status?
by: Bassignana, Elisa, et al.
Published: (2026) -
From Smør-re-brød to Subwords: Training LLMs on Danish, One Morpheme at a Time
by: Kildeberg, Mikkel Wildner, et al.
Published: (2025)