Small Languages, Big Models: A Study of Continual Training on Languages of Norway
Fuente:
arXiv
Saved in:
| Main Authors: | Samuel, David, Mikhailov, Vladislav, Velldal, Erik, Øvrelid, Lilja, Charpentier, Lucas Georges Gabriel, Kutuzov, Andrey, Oepen, Stephan |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Fluent Alignment with Disfluent Judges: Post-training for Lower-resource Languages
by: Samuel, David, et al.
Published: (2025)
by: Samuel, David, et al.
Published: (2025)
NorEval: A Norwegian Language Understanding and Generation Evaluation Benchmark
by: Mikhailov, Vladislav, et al.
Published: (2025)
by: Mikhailov, Vladislav, et al.
Published: (2025)
Compositional Generalization with Grounded Language Models
by: Wold, Sondre, et al.
Published: (2024)
by: Wold, Sondre, et al.
Published: (2024)
Benchmarking Abstractive Summarisation: A Dataset of Human-authored Summaries of Norwegian News Articles
by: Touileb, Samia, et al.
Published: (2025)
by: Touileb, Samia, et al.
Published: (2025)
A Collection of Question Answering Datasets for Norwegian
by: Mikhailov, Vladislav, et al.
Published: (2025)
by: Mikhailov, Vladislav, et al.
Published: (2025)
Event-based evaluation of abstractive news summarization
by: You, Huiling, et al.
Published: (2025)
by: You, Huiling, et al.
Published: (2025)
Entity-Level Sentiment: More than the Sum of Its Parts
by: Rønningstad, Egil, et al.
Published: (2024)
by: Rønningstad, Egil, et al.
Published: (2024)
Mixed Feelings: Cross-Domain Sentiment Classification of Patient Feedback
by: Rønningstad, Egil, et al.
Published: (2025)
by: Rønningstad, Egil, et al.
Published: (2025)
Dual-objective Language Models: Training Efficiency Without Overfitting
by: Samuel, David, et al.
Published: (2025)
by: Samuel, David, et al.
Published: (2025)
The Impact of Copyrighted Material on Large Language Models: A Norwegian Perspective
by: de la Rosa, Javier, et al.
Published: (2024)
by: de la Rosa, Javier, et al.
Published: (2024)
More Room for Language: Investigating the Effect of Retrieval on Language Models
by: Samuel, David, et al.
Published: (2024)
by: Samuel, David, et al.
Published: (2024)
It's Difficult to be Neutral -- Human and LLM-based Sentiment Annotation of Patient Comments
by: Mæhlum, Petter, et al.
Published: (2024)
by: Mæhlum, Petter, et al.
Published: (2024)
GPT or BERT: why not both?
by: Charpentier, Lucas Georges Gabriel, et al.
Published: (2024)
by: Charpentier, Lucas Georges Gabriel, et al.
Published: (2024)
Systematic Generalization in Language Models Scales with Information Entropy
by: Wold, Sondre, et al.
Published: (2025)
by: Wold, Sondre, et al.
Published: (2025)
A Systematic Survey of Semantic Role Labeling in the Era of Pretrained Language Models
by: Chen, Huiyao, et al.
Published: (2025)
by: Chen, Huiyao, et al.
Published: (2025)
Stronger Re-identification Attacks through Reasoning and Aggregation
by: Charpentier, Lucas Georges Gabriel, et al.
Published: (2025)
by: Charpentier, Lucas Georges Gabriel, et al.
Published: (2025)
Re-identification of De-identified Documents with Autoregressive Infilling
by: Charpentier, Lucas Georges Gabriel, et al.
Published: (2025)
by: Charpentier, Lucas Georges Gabriel, et al.
Published: (2025)
A New Massive Multilingual Dataset for High-Performance Language Technologies
by: de Gibert, Ona, et al.
Published: (2024)
by: de Gibert, Ona, et al.
Published: (2024)
HPLT 3.0: Very Large-Scale Multilingual Resources for LLMs and MT. Mono- and Bi-lingual Data, Multilingual Evaluation, and Pre-Trained Models
by: Oepen, Stephan, et al.
Published: (2025)
by: Oepen, Stephan, et al.
Published: (2025)
LUNA: A Framework for Language Understanding and Naturalness Assessment
by: Saidov, Marat, et al.
Published: (2024)
by: Saidov, Marat, et al.
Published: (2024)
OpenLID-v3: Improving the Precision of Closely Related Language Identification -- An Experience Report
by: Fedorova, Mariia, et al.
Published: (2026)
by: Fedorova, Mariia, et al.
Published: (2026)
DHPLT: large-scale multilingual diachronic corpora and word representations for semantic change modelling
by: Fedorova, Mariia, et al.
Published: (2026)
by: Fedorova, Mariia, et al.
Published: (2026)
Definition generation for lexical semantic change detection
by: Fedorova, Mariia, et al.
Published: (2024)
by: Fedorova, Mariia, et al.
Published: (2024)
An Expanded Massive Multilingual Dataset for High-Performance Language Technologies (HPLT)
by: Burchell, Laurie, et al.
Published: (2025)
by: Burchell, Laurie, et al.
Published: (2025)
SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model
by: Allal, Loubna Ben, et al.
Published: (2025)
by: Allal, Loubna Ben, et al.
Published: (2025)
Domain-Adaptive Continued Pre-Training of Small Language Models
by: Faroz, Salman
Published: (2025)
by: Faroz, Salman
Published: (2025)
A Family of Pretrained Transformer Language Models for Russian
by: Zmitrovich, Dmitry, et al.
Published: (2023)
by: Zmitrovich, Dmitry, et al.
Published: (2023)
Small Models, Big Impact: Efficient Corpus and Graph-Based Adaptation of Small Multilingual Language Models for Low-Resource Languages
by: Gurgurov, Daniil, et al.
Published: (2025)
by: Gurgurov, Daniil, et al.
Published: (2025)
Enriching Word Usage Graphs with Cluster Definitions
by: Fedorova, Mariia, et al.
Published: (2024)
by: Fedorova, Mariia, et al.
Published: (2024)
Explaining novel senses using definition generation with open language models
by: Fedorova, Mariia, et al.
Published: (2025)
by: Fedorova, Mariia, et al.
Published: (2025)
English as a Foreign Language University (EFL) Students’ Perception of Dictionary Use and Training
by: William Charpentier Jiménez
Published: (2023)
by: William Charpentier Jiménez
Published: (2023)
AIpom at SemEval-2024 Task 8: Detecting AI-produced Outputs in M4
by: Shirnin, Alexander, et al.
Published: (2024)
by: Shirnin, Alexander, et al.
Published: (2024)
REPA: Russian Error Types Annotation for Evaluating Text Generation and Judgment Capabilities
by: Pugachev, Alexander, et al.
Published: (2025)
by: Pugachev, Alexander, et al.
Published: (2025)
Papilusion at DAGPap24: Paper or Illusion? Detecting AI-generated Scientific Papers
by: Andreev, Nikita, et al.
Published: (2024)
by: Andreev, Nikita, et al.
Published: (2024)
AXOLOTL'24 Shared Task on Multilingual Explainable Semantic Change Modeling
by: Fedorova, Mariia, et al.
Published: (2024)
by: Fedorova, Mariia, et al.
Published: (2024)
How English as a Foreign Language (EFL) University Students Understand the Pronunciation of Adjectives Ending in -ed
by: William Charpentier Jiménez
Published: (2020)
by: William Charpentier Jiménez
Published: (2020)
A Study on Hidden Layer Distillation for Large Language Model Pre-Training
by: Guigon, Maxime, et al.
Published: (2026)
by: Guigon, Maxime, et al.
Published: (2026)
Post-Training Language Models for Continual Relation Extraction
by: Efeoglu, Sefika, et al.
Published: (2025)
by: Efeoglu, Sefika, et al.
Published: (2025)
Beemo: Benchmark of Expert-edited Machine-generated Outputs
by: Artemova, Ekaterina, et al.
Published: (2024)
by: Artemova, Ekaterina, et al.
Published: (2024)
Small Edits, Big Consequences: Telling Good from Bad Robustness in Large Language Models
by: Ismailov, Altynbek, et al.
Published: (2025)
by: Ismailov, Altynbek, et al.
Published: (2025)
Similar Items
-
Fluent Alignment with Disfluent Judges: Post-training for Lower-resource Languages
by: Samuel, David, et al.
Published: (2025) -
NorEval: A Norwegian Language Understanding and Generation Evaluation Benchmark
by: Mikhailov, Vladislav, et al.
Published: (2025) -
Compositional Generalization with Grounded Language Models
by: Wold, Sondre, et al.
Published: (2024) -
Benchmarking Abstractive Summarisation: A Dataset of Human-authored Summaries of Norwegian News Articles
by: Touileb, Samia, et al.
Published: (2025) -
A Collection of Question Answering Datasets for Norwegian
by: Mikhailov, Vladislav, et al.
Published: (2025)