Bridging the Bosphorus: Advancing Turkish Large Language Models through Strategies for Low-Resource Language Adaptation and Benchmarking
Fuente:
arXiv
Salvato in:
| Autori principali: | Acikgoz, Emre Can, Erdogan, Mete, Yuret, Deniz |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Neurocache: Efficient Vector Retrieval for Long-range Language Modeling
di: Safaya, Ali, et al.
Pubblicazione: (2024)
di: Safaya, Ali, et al.
Pubblicazione: (2024)
Hippocrates: An Open-Source Framework for Advancing Large Language Models in Healthcare
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2024)
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2024)
Efficient Large Language Model Inference with Neural Block Linearization
di: Erdogan, Mete, et al.
Pubblicazione: (2025)
di: Erdogan, Mete, et al.
Pubblicazione: (2025)
LoRA-Guard: Parameter-Efficient Guardrail Adaptation for Content Moderation of Large Language Models
di: Elesedy, Hayder, et al.
Pubblicazione: (2024)
di: Elesedy, Hayder, et al.
Pubblicazione: (2024)
Self-Improving LLM Agents at Test-Time
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
Large Multimodal Models for Low-Resource Languages: A Survey
di: Lupascu, Marian, et al.
Pubblicazione: (2025)
di: Lupascu, Marian, et al.
Pubblicazione: (2025)
Clustering-driven Memory Compression for On-device Large Language Models
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)
Bridging the Gap: Enhancing LLM Performance for Low-Resource African Languages with New Benchmarks, Fine-Tuning, and Cultural Adjustments
di: Alhanai, Tuka, et al.
Pubblicazione: (2024)
di: Alhanai, Tuka, et al.
Pubblicazione: (2024)
BLoB: Bayesian Low-Rank Adaptation by Backpropagation for Large Language Models
di: Wang, Yibin, et al.
Pubblicazione: (2024)
di: Wang, Yibin, et al.
Pubblicazione: (2024)
Few-Shot Cross-Lingual Transfer for Prompting Large Language Models in Low-Resource Languages
di: Toukmaji, Christopher
Pubblicazione: (2024)
di: Toukmaji, Christopher
Pubblicazione: (2024)
Optimizing Large Language Models for Turkish: New Methodologies in Corpus Selection and Training
di: Kesgin, H. Toprak, et al.
Pubblicazione: (2024)
di: Kesgin, H. Toprak, et al.
Pubblicazione: (2024)
Evaluating Quantized Large Language Models for Code Generation on Low-Resource Language Benchmarks
di: Nyamsuren, Enkhbold
Pubblicazione: (2024)
di: Nyamsuren, Enkhbold
Pubblicazione: (2024)
Efficient Compositional Multi-tasking for On-device Large Language Models
di: Bohdal, Ondrej, et al.
Pubblicazione: (2025)
di: Bohdal, Ondrej, et al.
Pubblicazione: (2025)
Kakugo: Distillation of Low-Resource Languages into Small Language Models
di: Devine, Peter, et al.
Pubblicazione: (2026)
di: Devine, Peter, et al.
Pubblicazione: (2026)
CoRA: Optimizing Low-Rank Adaptation with Common Subspace of Large Language Models
di: Xiao, Xiaojun, et al.
Pubblicazione: (2024)
di: Xiao, Xiaojun, et al.
Pubblicazione: (2024)
Benchmarking Benchmark Leakage in Large Language Models
di: Xu, Ruijie, et al.
Pubblicazione: (2024)
di: Xu, Ruijie, et al.
Pubblicazione: (2024)
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
di: Shenaj, Donald, et al.
Pubblicazione: (2025)
di: Shenaj, Donald, et al.
Pubblicazione: (2025)
Introducing L2M3, A Multilingual Medical Large Language Model to Advance Health Equity in Low-Resource Regions
di: Gangavarapu, Agasthya
Pubblicazione: (2024)
di: Gangavarapu, Agasthya
Pubblicazione: (2024)
A Multilingual Sentiment Lexicon for Low-Resource Language Translation using Large Languages Models and Explainable AI
di: Malinga, Melusi, et al.
Pubblicazione: (2024)
di: Malinga, Melusi, et al.
Pubblicazione: (2024)
LexC-Gen: Generating Data for Extremely Low-Resource Languages with Large Language Models and Bilingual Lexicons
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2024)
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2024)
AcquisitionSynthesis: Targeted Data Generation using Acquisition Functions
di: Agarwal, Ishika, et al.
Pubblicazione: (2026)
di: Agarwal, Ishika, et al.
Pubblicazione: (2026)
Walk the Talk? Measuring the Faithfulness of Large Language Model Explanations
di: Matton, Katie, et al.
Pubblicazione: (2025)
di: Matton, Katie, et al.
Pubblicazione: (2025)
The Limited Impact of Medical Adaptation of Large Language and Vision-Language Models
di: Jeong, Daniel P., et al.
Pubblicazione: (2024)
di: Jeong, Daniel P., et al.
Pubblicazione: (2024)
Data-driven Clustering and Merging of Adapters for On-device Large Language Models
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)
TharuChat: Bootstrapping Large Language Models for a Low-Resource Language via Synthetic Data and Human Validation
di: Panth, Prajwal, et al.
Pubblicazione: (2026)
di: Panth, Prajwal, et al.
Pubblicazione: (2026)
Error Broadcast and Decorrelation as a Potential Artificial and Natural Learning Mechanism
di: Erdogan, Mete, et al.
Pubblicazione: (2025)
di: Erdogan, Mete, et al.
Pubblicazione: (2025)
Scalable Bayesian Low-Rank Adaptation of Large Language Models via Stochastic Variational Subspace Inference
di: Samplawski, Colin, et al.
Pubblicazione: (2025)
di: Samplawski, Colin, et al.
Pubblicazione: (2025)
Medical Adaptation of Large Language and Vision-Language Models: Are We Making Progress?
di: Jeong, Daniel P., et al.
Pubblicazione: (2024)
di: Jeong, Daniel P., et al.
Pubblicazione: (2024)
LoRETTA: Low-Rank Economic Tensor-Train Adaptation for Ultra-Low-Parameter Fine-Tuning of Large Language Models
di: Yang, Yifan, et al.
Pubblicazione: (2024)
di: Yang, Yifan, et al.
Pubblicazione: (2024)
Small Language Models for Privacy-Preserving Clinical Information Extraction in Low-Resource Languages
di: Ghaffarzadeh-Esfahani, Mohammadreza, et al.
Pubblicazione: (2026)
di: Ghaffarzadeh-Esfahani, Mohammadreza, et al.
Pubblicazione: (2026)
ToolRL: Reward is All Tool Learning Needs
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
SMART: Self-Aware Agent for Tool Overuse Mitigation
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
RE-Adapt: Reverse Engineered Adaptation of Large Language Models
di: Fleshman, William, et al.
Pubblicazione: (2024)
di: Fleshman, William, et al.
Pubblicazione: (2024)
Emotion Classification in Low and Moderate Resource Languages
di: Tafreshi, Shabnam, et al.
Pubblicazione: (2024)
di: Tafreshi, Shabnam, et al.
Pubblicazione: (2024)
A Women's Health Benchmark for Large Language Models
di: Gruber, Victoria-Elisabeth, et al.
Pubblicazione: (2025)
di: Gruber, Victoria-Elisabeth, et al.
Pubblicazione: (2025)
Uncovering Competency Gaps in Large Language Models and Their Benchmarks
di: Bohacek, Maty, et al.
Pubblicazione: (2025)
di: Bohacek, Maty, et al.
Pubblicazione: (2025)
Exploring and Benchmarking the Planning Capabilities of Large Language Models
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
Generalizable and Stable Finetuning of Pretrained Language Models on Low-Resource Texts
di: Somayajula, Sai Ashish, et al.
Pubblicazione: (2024)
di: Somayajula, Sai Ashish, et al.
Pubblicazione: (2024)
Contrastive Decoding for Synthetic Data Generation in Low-Resource Language Modeling
di: Ulm, Jannek, et al.
Pubblicazione: (2025)
di: Ulm, Jannek, et al.
Pubblicazione: (2025)
TURNA: A Turkish Encoder-Decoder Language Model for Enhanced Understanding and Generation
di: Uludoğan, Gökçe, et al.
Pubblicazione: (2024)
di: Uludoğan, Gökçe, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Neurocache: Efficient Vector Retrieval for Long-range Language Modeling
di: Safaya, Ali, et al.
Pubblicazione: (2024) -
Hippocrates: An Open-Source Framework for Advancing Large Language Models in Healthcare
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2024) -
Efficient Large Language Model Inference with Neural Block Linearization
di: Erdogan, Mete, et al.
Pubblicazione: (2025) -
LoRA-Guard: Parameter-Efficient Guardrail Adaptation for Content Moderation of Large Language Models
di: Elesedy, Hayder, et al.
Pubblicazione: (2024) -
Self-Improving LLM Agents at Test-Time
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)