Building a Strong Instruction Language Model for a Less-Resourced Language
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Vreš, Domen, Arčon, Tjaša, Petrič, Timotej, Vajda, Dario, Robnik-Šikonja, Marko, Bajec, Iztok Lebar |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving LLMs for Machine Translation Using Synthetic Preference Data
par: Vajda, Dario, et autres
Publié: (2025)
par: Vajda, Dario, et autres
Publié: (2025)
Generative Model for Less-Resourced Language with 1 billion parameters
par: Vreš, Domen, et autres
Publié: (2024)
par: Vreš, Domen, et autres
Publié: (2024)
Sarcasm Detection in a Less-Resourced Language
par: Đoković, Lazar, et autres
Publié: (2024)
par: Đoković, Lazar, et autres
Publié: (2024)
Evaluating Metalinguistic Knowledge in Large Language Models across the World's Languages
par: Arčon, Tjaša, et autres
Publié: (2026)
par: Arčon, Tjaša, et autres
Publié: (2026)
Large language models for folktale type automation based on motifs: Cinderella case study
par: Arčon, Tjaša, et autres
Publié: (2025)
par: Arčon, Tjaša, et autres
Publié: (2025)
Towards Corpus-Grounded Agentic LLMs for Multilingual Grammatical Analysis
par: Klemen, Matej, et autres
Publié: (2025)
par: Klemen, Matej, et autres
Publié: (2025)
Measuring Catastrophic Forgetting in Cross-Lingual Transfer Paradigms: Exploring Tuning Strategies
par: Koloski, Boshko, et autres
Publié: (2023)
par: Koloski, Boshko, et autres
Publié: (2023)
TT-XAI: Trustworthy Clinical Text Explanations via Keyword Distillation and LLM Reasoning
par: Miok, Kristian, et autres
Publié: (2025)
par: Miok, Kristian, et autres
Publié: (2025)
Incremental Graph Construction Enables Robust Spectral Clustering of Texts
par: Pranjić, Marko, et autres
Publié: (2026)
par: Pranjić, Marko, et autres
Publié: (2026)
Retrieval-augmented code completion for local projects using large language models
par: Hostnik, Marko, et autres
Publié: (2024)
par: Hostnik, Marko, et autres
Publié: (2024)
Review of Natural Language Processing in Pharmacology
par: Trajanov, Dimitar, et autres
Publié: (2022)
par: Trajanov, Dimitar, et autres
Publié: (2022)
Solving Word-Sense Disambiguation and Word-Sense Induction with Dictionary Examples
par: Škvorc, Tadej, et autres
Publié: (2025)
par: Škvorc, Tadej, et autres
Publié: (2025)
QFS-Composer: Query-focused summarization pipeline for less resourced languages
par: Đuranović, Vuk, et autres
Publié: (2026)
par: Đuranović, Vuk, et autres
Publié: (2026)
Teaching LLMs to See Graphs: Unifying Text and Structural Reasoning
par: Vajda, Dario
Publié: (2026)
par: Vajda, Dario
Publié: (2026)
Real-time News Story Identification
par: Škvorc, Tadej, et autres
Publié: (2025)
par: Škvorc, Tadej, et autres
Publié: (2025)
Challenges in Explaining Pretrained Clinical Text Classifiers
par: Miok, Kristian, et autres
Publié: (2026)
par: Miok, Kristian, et autres
Publié: (2026)
Are Compressed Language Models Less Subgroup Robust?
par: Gee, Leonidas, et autres
Publié: (2024)
par: Gee, Leonidas, et autres
Publié: (2024)
Neural spell-checker: Beyond words with synthetic data generation
par: Klemen, Matej, et autres
Publié: (2024)
par: Klemen, Matej, et autres
Publié: (2024)
LEGO: Language Model Building Blocks
par: Bhansali, Shrenik, et autres
Publié: (2024)
par: Bhansali, Shrenik, et autres
Publié: (2024)
Less is KEN: a Universal and Simple Non-Parametric Pruning Algorithm for Large Language Models
par: Mastromattei, Michele, et autres
Publié: (2024)
par: Mastromattei, Michele, et autres
Publié: (2024)
Pay Less Attention to Function Words for Free Robustness of Vision-Language Models
par: Tian, Qiwei, et autres
Publié: (2025)
par: Tian, Qiwei, et autres
Publié: (2025)
Less Diverse, Less Safe: The Indirect But Pervasive Risk of Test-Time Scaling in Large Language Models
par: Nahin, Shahriar Kabir, et autres
Publié: (2025)
par: Nahin, Shahriar Kabir, et autres
Publié: (2025)
Less but Better: Parameter-Efficient Fine-Tuning of Large Language Models for Personality Detection
par: Shen, Lingzhi, et autres
Publié: (2025)
par: Shen, Lingzhi, et autres
Publié: (2025)
MURI: High-Quality Instruction Tuning Datasets for Low-Resource Languages via Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2024)
par: Köksal, Abdullatif, et autres
Publié: (2024)
Less is More: Local Intrinsic Dimensions of Contextual Language Models
par: Ruppik, Benjamin Matthias, et autres
Publié: (2025)
par: Ruppik, Benjamin Matthias, et autres
Publié: (2025)
Evaluating Large Language Models at Evaluating Instruction Following
par: Zeng, Zhiyuan, et autres
Publié: (2023)
par: Zeng, Zhiyuan, et autres
Publié: (2023)
Compositional Instruction Following with Language Models and Reinforcement Learning
par: Cohen, Vanya, et autres
Publié: (2025)
par: Cohen, Vanya, et autres
Publié: (2025)
Shuttle Between the Instructions and the Parameters of Large Language Models
par: Sun, Wangtao, et autres
Publié: (2025)
par: Sun, Wangtao, et autres
Publié: (2025)
KInITVeraAI at SemEval-2023 Task 3: Simple yet Powerful Multilingual Fine-Tuning for Persuasion Techniques Detection
par: Hromadka, Timo, et autres
Publié: (2023)
par: Hromadka, Timo, et autres
Publié: (2023)
Learning Instruction-Following Policies through Open-Ended Instruction Relabeling with Large Language Models
par: Zhang, Zhicheng, et autres
Publié: (2025)
par: Zhang, Zhicheng, et autres
Publié: (2025)
Zero-to-Strong Generalization: Eliciting Strong Capabilities of Large Language Models Iteratively without Gold Labels
par: Liu, Chaoqun, et autres
Publié: (2024)
par: Liu, Chaoqun, et autres
Publié: (2024)
Investigating the Multilingual Calibration Effects of Language Model Instruction-Tuning
par: Huang, Jerry, et autres
Publié: (2026)
par: Huang, Jerry, et autres
Publié: (2026)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
par: Cao, Yihan, et autres
Publié: (2023)
par: Cao, Yihan, et autres
Publié: (2023)
Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models
par: Chen, Zixiang, et autres
Publié: (2024)
par: Chen, Zixiang, et autres
Publié: (2024)
AF Adapter: Continual Pretraining for Building Chinese Biomedical Language Model
par: Yan, Yongyu, et autres
Publié: (2022)
par: Yan, Yongyu, et autres
Publié: (2022)
On the Generalizability of "Competition of Mechanisms: Tracing How Language Models Handle Facts and Counterfactuals"
par: Dotsinski, Asen, et autres
Publié: (2025)
par: Dotsinski, Asen, et autres
Publié: (2025)
Large Language Models for Math Education in Low-Resource Languages: A Study in Sinhala and Tamil
par: Kishanthan, Sukumar, et autres
Publié: (2026)
par: Kishanthan, Sukumar, et autres
Publié: (2026)
Large Language Models can be Strong Self-Detoxifiers
par: Ko, Ching-Yun, et autres
Publié: (2024)
par: Ko, Ching-Yun, et autres
Publié: (2024)
Generalizing Large Language Model Usability Across Resource-Constrained
par: Tsai, Yun-Da
Publié: (2025)
par: Tsai, Yun-Da
Publié: (2025)
Kakugo: Distillation of Low-Resource Languages into Small Language Models
par: Devine, Peter, et autres
Publié: (2026)
par: Devine, Peter, et autres
Publié: (2026)
Documents similaires
-
Improving LLMs for Machine Translation Using Synthetic Preference Data
par: Vajda, Dario, et autres
Publié: (2025) -
Generative Model for Less-Resourced Language with 1 billion parameters
par: Vreš, Domen, et autres
Publié: (2024) -
Sarcasm Detection in a Less-Resourced Language
par: Đoković, Lazar, et autres
Publié: (2024) -
Evaluating Metalinguistic Knowledge in Large Language Models across the World's Languages
par: Arčon, Tjaša, et autres
Publié: (2026) -
Large language models for folktale type automation based on motifs: Cinderella case study
par: Arčon, Tjaša, et autres
Publié: (2025)