From Bytes to Borsch: Fine-Tuning Gemma and Mistral for the Ukrainian Language Representation
Fuente:
arXiv
Salvato in:
| Autori principali: | Kiulian, Artur, Polishko, Anton, Khandoga, Mykola, Chubych, Oryna, Connor, Jack, Ravishankar, Raghav, Shirawalmath, Adarsh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Benchmarking Multimodal Models for Ukrainian Language Understanding Across Academic and Cultural Domains
di: Paniv, Yurii, et al.
Pubblicazione: (2024)
di: Paniv, Yurii, et al.
Pubblicazione: (2024)
From English-Centric to Effective Bilingual: LLMs with Custom Tokenizers for Underrepresented Languages
di: Kiulian, Artur, et al.
Pubblicazione: (2024)
di: Kiulian, Artur, et al.
Pubblicazione: (2024)
Achieving Tokenizer Flexibility in Language Models through Heuristic Adaptation and Supertoken Learning
di: Sharthak, Shaurya, et al.
Pubblicazione: (2025)
di: Sharthak, Shaurya, et al.
Pubblicazione: (2025)
Beyond Uniform Credit: Causal Credit Assignment for Policy Optimization
di: Khandoga, Mykola, et al.
Pubblicazione: (2026)
di: Khandoga, Mykola, et al.
Pubblicazione: (2026)
Empowering Smaller Models: Tuning LLaMA and Gemma with Chain-of-Thought for Ukrainian Exam Tasks
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)
Benchmarking Llama2, Mistral, Gemma and GPT for Factuality, Toxicity, Bias and Propensity for Hallucinations
di: Nadeau, David, et al.
Pubblicazione: (2024)
di: Nadeau, David, et al.
Pubblicazione: (2024)
Towards Multilingual LLM Evaluation for Baltic and Nordic languages: A study on Lithuanian History
di: Kostiuk, Yevhen, et al.
Pubblicazione: (2025)
di: Kostiuk, Yevhen, et al.
Pubblicazione: (2025)
The Veln(ia)s is in the Details: Evaluating LLM Judgment on Latvian and Lithuanian Short Answer Matching
di: Kostiuk, Yevhen, et al.
Pubblicazione: (2025)
di: Kostiuk, Yevhen, et al.
Pubblicazione: (2025)
AlignTune: Modular Toolkit for Post-Training Alignment of Large Language Models
di: Lyngkhoi, R E Zera Marveen, et al.
Pubblicazione: (2026)
di: Lyngkhoi, R E Zera Marveen, et al.
Pubblicazione: (2026)
Introducing Super RAGs in Mistral 8x7B-v1
di: Thakur, Ayush, et al.
Pubblicazione: (2024)
di: Thakur, Ayush, et al.
Pubblicazione: (2024)
Multilevel Analysis of Cryptocurrency News using RAG Approach with Fine-Tuned Mistral Large Language Model
di: Pavlyshenko, Bohdan M.
Pubblicazione: (2025)
di: Pavlyshenko, Bohdan M.
Pubblicazione: (2025)
Vision-Language and Large Language Model Performance in Gastroenterology: GPT, Claude, Llama, Phi, Mistral, Gemma, and Quantized Models
di: Safavi-Naini, Seyed Amir Ahmad, et al.
Pubblicazione: (2024)
di: Safavi-Naini, Seyed Amir Ahmad, et al.
Pubblicazione: (2024)
Fine-Tuning Gemma-7B for Enhanced Sentiment Analysis of Financial News Headlines
di: Mo, Kangtong, et al.
Pubblicazione: (2024)
di: Mo, Kangtong, et al.
Pubblicazione: (2024)
Entropy of Ukrainian
di: Lavreniuk, Anton, et al.
Pubblicazione: (2026)
di: Lavreniuk, Anton, et al.
Pubblicazione: (2026)
An End-to-End Ukrainian RAG for Local Deployment. Optimized Hybrid Search and Lightweight Generation
di: Trokhymovych, Mykola, et al.
Pubblicazione: (2026)
di: Trokhymovych, Mykola, et al.
Pubblicazione: (2026)
Sovereign Large Language Models: Advantages, Strategy and Regulations
di: Bondarenko, Mykhailo, et al.
Pubblicazione: (2025)
di: Bondarenko, Mykhailo, et al.
Pubblicazione: (2025)
Fine-Tuning MedGemma for Clinical Captioning to Enhance Multimodal RAG over Malaysia CPGs
di: Zun, Lee Qi, et al.
Pubblicazione: (2025)
di: Zun, Lee Qi, et al.
Pubblicazione: (2025)
Fine Tuning Methods for Low-resource Languages
di: Bakkenes, Tim, et al.
Pubblicazione: (2025)
di: Bakkenes, Tim, et al.
Pubblicazione: (2025)
EmbeddingGemma: Powerful and Lightweight Text Representations
di: Vera, Henrique Schechter, et al.
Pubblicazione: (2025)
di: Vera, Henrique Schechter, et al.
Pubblicazione: (2025)
ChunkFT: Byte-Streamed Optimization for Memory-Efficient Full Fine-Tuning
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
BioMistral-NLU: Towards More Generalizable Medical Language Understanding through Instruction Tuning
di: Fu, Yujuan Velvin, et al.
Pubblicazione: (2024)
di: Fu, Yujuan Velvin, et al.
Pubblicazione: (2024)
ABBA-Adapters: Efficient and Expressive Fine-Tuning of Foundation Models
di: Singhal, Raghav, et al.
Pubblicazione: (2025)
di: Singhal, Raghav, et al.
Pubblicazione: (2025)
Qwen Goes Brrr: Off-the-Shelf RAG for Ukrainian Multi-Domain Document Understanding
di: Bazdyrev, Anton, et al.
Pubblicazione: (2026)
di: Bazdyrev, Anton, et al.
Pubblicazione: (2026)
Safety Subspaces are Not Linearly Distinct: A Fine-Tuning Case Study
di: Ponkshe, Kaustubh, et al.
Pubblicazione: (2025)
di: Ponkshe, Kaustubh, et al.
Pubblicazione: (2025)
Spivavtor: An Instruction Tuned Ukrainian Text Editing Model
di: Saini, Aman, et al.
Pubblicazione: (2024)
di: Saini, Aman, et al.
Pubblicazione: (2024)
CodeGemma: Open Code Models Based on Gemma
di: CodeGemma Team, et al.
Pubblicazione: (2024)
di: CodeGemma Team, et al.
Pubblicazione: (2024)
Russo-Ukrainian war disinformation detection in suspicious Telegram channels
di: Bazdyrev, Anton
Pubblicazione: (2025)
di: Bazdyrev, Anton
Pubblicazione: (2025)
ShieldGemma: Generative AI Content Moderation Based on Gemma
di: Zeng, Wenjun, et al.
Pubblicazione: (2024)
di: Zeng, Wenjun, et al.
Pubblicazione: (2024)
Beyond KL Divergence: Policy Optimization with Flexible Bregman Divergences for LLM Reasoning
di: Yuan, Rui, et al.
Pubblicazione: (2026)
di: Yuan, Rui, et al.
Pubblicazione: (2026)
FedEx-LoRA: Exact Aggregation for Federated and Efficient Fine-Tuning of Foundation Models
di: Singhal, Raghav, et al.
Pubblicazione: (2024)
di: Singhal, Raghav, et al.
Pubblicazione: (2024)
Beyond QA Pairs: Assessing Parameter-Efficient Fine-Tuning for Fact Embedding in LLMs
di: Ratnakar, Shivam, et al.
Pubblicazione: (2025)
di: Ratnakar, Shivam, et al.
Pubblicazione: (2025)
Evolution of wartime discourse on Telegram: A comparative study of Ukrainian and Russian policymakers' communication before and after Russia's full-scale invasion of Ukraine
di: Makhortykh, Mykola, et al.
Pubblicazione: (2025)
di: Makhortykh, Mykola, et al.
Pubblicazione: (2025)
Lisbon Computational Linguists at SemEval-2024 Task 2: Using A Mistral 7B Model and Data Augmentation
di: Guimarães, Artur, et al.
Pubblicazione: (2024)
di: Guimarães, Artur, et al.
Pubblicazione: (2024)
Large Malaysian Language Model Based on Mistral for Enhanced Local Language Understanding
di: Zolkepli, Husein, et al.
Pubblicazione: (2024)
di: Zolkepli, Husein, et al.
Pubblicazione: (2024)
From Macro to Micro: Probing Dataset Diversity in Language Model Fine-Tuning
di: Li, Haoyu, et al.
Pubblicazione: (2025)
di: Li, Haoyu, et al.
Pubblicazione: (2025)
Gemma 3 Technical Report
di: Gemma Team, et al.
Pubblicazione: (2025)
di: Gemma Team, et al.
Pubblicazione: (2025)
From Bytes to Ideas: Language Modeling with Autoregressive U-Nets
di: Videau, Mathurin, et al.
Pubblicazione: (2025)
di: Videau, Mathurin, et al.
Pubblicazione: (2025)
Natural Language Fine-Tuning
di: Liu, Jia, et al.
Pubblicazione: (2024)
di: Liu, Jia, et al.
Pubblicazione: (2024)
Gemma 2: Improving Open Language Models at a Practical Size
di: Gemma Team, et al.
Pubblicazione: (2024)
di: Gemma Team, et al.
Pubblicazione: (2024)
Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2
di: Lieberum, Tom, et al.
Pubblicazione: (2024)
di: Lieberum, Tom, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Benchmarking Multimodal Models for Ukrainian Language Understanding Across Academic and Cultural Domains
di: Paniv, Yurii, et al.
Pubblicazione: (2024) -
From English-Centric to Effective Bilingual: LLMs with Custom Tokenizers for Underrepresented Languages
di: Kiulian, Artur, et al.
Pubblicazione: (2024) -
Achieving Tokenizer Flexibility in Language Models through Heuristic Adaptation and Supertoken Learning
di: Sharthak, Shaurya, et al.
Pubblicazione: (2025) -
Beyond Uniform Credit: Causal Credit Assignment for Policy Optimization
di: Khandoga, Mykola, et al.
Pubblicazione: (2026) -
Empowering Smaller Models: Tuning LLaMA and Gemma with Chain-of-Thought for Ukrainian Exam Tasks
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)