Guardado en:
| Autor principal: | Altinok, Duygu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.06942 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Introducing TrGLUE and SentiTurca: A Comprehensive Benchmark for Turkish General Language Understanding and Sentiment Analysis
por: Altinok, Duygu
Publicado: (2025)
por: Altinok, Duygu
Publicado: (2025)
Whispering Context: Distilling Syntax and Semantics for Long Speech Transcripts
por: Altinok, Duygu
Publicado: (2025)
por: Altinok, Duygu
Publicado: (2025)
Smooth Operators: LLMs Translating Imperfect Hints into Disfluency-Rich Transcripts
por: Altinok, Duygu
Publicado: (2025)
por: Altinok, Duygu
Publicado: (2025)
D-NLP at SemEval-2024 Task 2: Evaluating Clinical Inference Capabilities of Large Language Models
por: Altinok, Duygu
Publicado: (2024)
por: Altinok, Duygu
Publicado: (2024)
Evaluating Subword Tokenization: Alien Subword Composition and OOV Generalization Challenge
por: Batsuren, Khuyagbaatar, et al.
Publicado: (2024)
por: Batsuren, Khuyagbaatar, et al.
Publicado: (2024)
Boosting CTC-Based ASR Using LLM-Based Intermediate Loss Regularization
por: Altinok, Duygu
Publicado: (2025)
por: Altinok, Duygu
Publicado: (2025)
Mind the Gap: Entity-Preserved Context-Aware ASR Structured Transcriptions
por: Altinok, Duygu
Publicado: (2025)
por: Altinok, Duygu
Publicado: (2025)
Evaluating Morphological Compositional Generalization in Large Language Models
por: Ismayilzada, Mete, et al.
Publicado: (2024)
por: Ismayilzada, Mete, et al.
Publicado: (2024)
Token Alignment via Character Matching for Subword Completion
por: Athiwaratkun, Ben, et al.
Publicado: (2024)
por: Athiwaratkun, Ben, et al.
Publicado: (2024)
Scaling Laws with Vocabulary: Larger Models Deserve Larger Vocabularies
por: Tao, Chaofan, et al.
Publicado: (2024)
por: Tao, Chaofan, et al.
Publicado: (2024)
Understanding Subword Compositionality of Large Language Models
por: Peng, Qiwei, et al.
Publicado: (2025)
por: Peng, Qiwei, et al.
Publicado: (2025)
Team Ryu's Submission to SIGMORPHON 2024 Shared Task on Subword Tokenization
por: Li, Zilong
Publicado: (2024)
por: Li, Zilong
Publicado: (2024)
LGSE: Lexically Grounded Subword Embedding Initialization for Low-Resource Language Adaptation
por: Teklehaymanot, Hailay, et al.
Publicado: (2026)
por: Teklehaymanot, Hailay, et al.
Publicado: (2026)
Evaluating Modern Large Language Models on Low-Resource and Morphologically Rich Languages:A Cross-Lingual Benchmark Across Cantonese, Japanese, and Turkish
por: Xia, Chengxuan, et al.
Publicado: (2025)
por: Xia, Chengxuan, et al.
Publicado: (2025)
Understanding the Interplay of Scale, Data, and Bias in Language Models: A Case Study with BERT
por: Ali, Muhammad, et al.
Publicado: (2024)
por: Ali, Muhammad, et al.
Publicado: (2024)
Scaling LLM Pre-training with Vocabulary Curriculum
por: Yu, Fangyuan
Publicado: (2025)
por: Yu, Fangyuan
Publicado: (2025)
A Large-Scale Dataset and Citation Intent Classification in Turkish with LLMs
por: Karaca, Kemal Sami, et al.
Publicado: (2025)
por: Karaca, Kemal Sami, et al.
Publicado: (2025)
MoVoC: Morphology-Aware Subword Construction for Geez Script Languages
por: Teklehaymanot, Hailay Kidu, et al.
Publicado: (2025)
por: Teklehaymanot, Hailay Kidu, et al.
Publicado: (2025)
TurkBench: A Benchmark for Evaluating Turkish Large Language Models
por: Toraman, Çağrı, et al.
Publicado: (2026)
por: Toraman, Çağrı, et al.
Publicado: (2026)
Organic Data-Driven Approach for Turkish Grammatical Error Correction and LLMs
por: Ersoy, Asım, et al.
Publicado: (2024)
por: Ersoy, Asım, et al.
Publicado: (2024)
Scaling BERT Models for Turkish Automatic Punctuation and Capitalization Correction
por: Saoud, Abdulkader, et al.
Publicado: (2024)
por: Saoud, Abdulkader, et al.
Publicado: (2024)
TokDrift: When LLM Speaks in Subwords but Code Speaks in Grammar
por: Li, Yinxi, et al.
Publicado: (2025)
por: Li, Yinxi, et al.
Publicado: (2025)
Evaluating the Quality of Benchmark Datasets for Low-Resource Languages: A Case Study on Turkish
por: Cengiz, Ayşe Aysu, et al.
Publicado: (2025)
por: Cengiz, Ayşe Aysu, et al.
Publicado: (2025)
Context Aware Lemmatization and Morphological Tagging Method in Turkish
por: Sayallar, Cagri
Publicado: (2025)
por: Sayallar, Cagri
Publicado: (2025)
Optimal Embedding Learning Rate in LLMs: The Effect of Vocabulary Size
por: Hayou, Soufiane, et al.
Publicado: (2025)
por: Hayou, Soufiane, et al.
Publicado: (2025)
T-FREE: Subword Tokenizer-Free Generative LLMs via Sparse Representations for Memory-Efficient Embeddings
por: Deiseroth, Björn, et al.
Publicado: (2024)
por: Deiseroth, Björn, et al.
Publicado: (2024)
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
por: Shin, Haebin, et al.
Publicado: (2025)
por: Shin, Haebin, et al.
Publicado: (2025)
OCRTurk: A Comprehensive OCR Benchmark for Turkish
por: Yılmaz, Deniz, et al.
Publicado: (2026)
por: Yılmaz, Deniz, et al.
Publicado: (2026)
VBART: The Turkish LLM
por: Turker, Meliksah, et al.
Publicado: (2024)
por: Turker, Meliksah, et al.
Publicado: (2024)
Systematic Evaluation of the Quality of Synthetic Clinical Notes Rephrased by LLMs at Million-Note Scale
por: Liu, Jinghui, et al.
Publicado: (2026)
por: Liu, Jinghui, et al.
Publicado: (2026)
Evaluating LLMs for Zeolite Synthesis Event Extraction (ZSEE): A Systematic Analysis of Prompting Strategies
por: Rathore, Charan Prakash, et al.
Publicado: (2025)
por: Rathore, Charan Prakash, et al.
Publicado: (2025)
A Comprehensive Analysis of Static Word Embeddings for Turkish
por: Sarıtaş, Karahan, et al.
Publicado: (2024)
por: Sarıtaş, Karahan, et al.
Publicado: (2024)
VNLP: Turkish NLP Package
por: Turker, Meliksah, et al.
Publicado: (2024)
por: Turker, Meliksah, et al.
Publicado: (2024)
Un-considering Contextual Information: Assessing LLMs' Understanding of Indexical Elements
por: Oguz, Metehan, et al.
Publicado: (2025)
por: Oguz, Metehan, et al.
Publicado: (2025)
Benchmarking GPT-4 on Algorithmic Problems: A Systematic Evaluation of Prompting Strategies
por: Petruzzellis, Flavio, et al.
Publicado: (2024)
por: Petruzzellis, Flavio, et al.
Publicado: (2024)
Diffutron: A Masked Diffusion Language Model for Turkish Language
por: Kocabay, Şuayp Talha, et al.
Publicado: (2026)
por: Kocabay, Şuayp Talha, et al.
Publicado: (2026)
Evaluating Prompting Strategies and Large Language Models in Systematic Literature Review Screening: Relevance and Task-Stage Classification
por: Han, Binglan, et al.
Publicado: (2025)
por: Han, Binglan, et al.
Publicado: (2025)
Introducing cosmosGPT: Monolingual Training for Turkish Language Models
por: Kesgin, H. Toprak, et al.
Publicado: (2024)
por: Kesgin, H. Toprak, et al.
Publicado: (2024)
DVAGen: Dynamic Vocabulary Augmented Generation
por: Du, Wei, et al.
Publicado: (2025)
por: Du, Wei, et al.
Publicado: (2025)
Bridging the Bosphorus: Advancing Turkish Large Language Models through Strategies for Low-Resource Language Adaptation and Benchmarking
por: Acikgoz, Emre Can, et al.
Publicado: (2024)
por: Acikgoz, Emre Can, et al.
Publicado: (2024)
Ejemplares similares
-
Introducing TrGLUE and SentiTurca: A Comprehensive Benchmark for Turkish General Language Understanding and Sentiment Analysis
por: Altinok, Duygu
Publicado: (2025) -
Whispering Context: Distilling Syntax and Semantics for Long Speech Transcripts
por: Altinok, Duygu
Publicado: (2025) -
Smooth Operators: LLMs Translating Imperfect Hints into Disfluency-Rich Transcripts
por: Altinok, Duygu
Publicado: (2025) -
D-NLP at SemEval-2024 Task 2: Evaluating Clinical Inference Capabilities of Large Language Models
por: Altinok, Duygu
Publicado: (2024) -
Evaluating Subword Tokenization: Alien Subword Composition and OOV Generalization Challenge
por: Batsuren, Khuyagbaatar, et al.
Publicado: (2024)