Language and Speech Technology for Central Kurdish Varieties
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ahmadi, Sina, Jaff, Daban Q., Alam, Md Mahfuz Ibn, Anastasopoulos, Antonios |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Morphologically-Aware Dictionary-based Data Augmentation Technique for Machine Translation of Under-Represented Languages
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2024)
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2024)
CODET: A Benchmark for Contrastive Dialectal Evaluation of Machine Translation
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2023)
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2023)
A Case Study on Filtering for End-to-End Speech Translation
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2024)
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2024)
FLEURS-Kobani: Extending the FLEURS Dataset for Northern Kurdish
par: Jaff, Daban Q., et autres
Publié: (2026)
par: Jaff, Daban Q., et autres
Publié: (2026)
English to Central Kurdish Speech Translation: Corpus Creation, Evaluation, and Orthographic Standardization
par: Mohammadamini, Mohammad, et autres
Publié: (2026)
par: Mohammadamini, Mohammad, et autres
Publié: (2026)
From Consensus to Split Decisions: ABC-Stratified Sentiment in Holocaust Oral Histories
par: Jaff, Daban Q.
Publié: (2026)
par: Jaff, Daban Q.
Publié: (2026)
Dialectal Toxicity Detection: Evaluating LLM-as-a-Judge Consistency Across Language Varieties
par: Faisal, Fahim, et autres
Publié: (2024)
par: Faisal, Fahim, et autres
Publié: (2024)
GMU Systems for the IWSLT 2025 Low-Resource Speech Translation Shared Task
par: Meng, Chutong, et autres
Publié: (2025)
par: Meng, Chutong, et autres
Publié: (2025)
Robust Language Identification for Romansh Varieties
par: Model, Charlotte, et autres
Publié: (2026)
par: Model, Charlotte, et autres
Publié: (2026)
An Efficient Approach for Studying Cross-Lingual Transfer in Multilingual Language Models
par: Faisal, Fahim, et autres
Publié: (2024)
par: Faisal, Fahim, et autres
Publié: (2024)
Speaking of Language: Reflections on Metalanguage Research in NLP
par: Schneider, Nathan, et autres
Publié: (2026)
par: Schneider, Nathan, et autres
Publié: (2026)
Dialect Normalization using Large Language Models and Morphological Rules
par: Dimakis, Antonios, et autres
Publié: (2025)
par: Dimakis, Antonios, et autres
Publié: (2025)
Script-Agnostic Language Identification
par: Agarwal, Milind, et autres
Publié: (2024)
par: Agarwal, Milind, et autres
Publié: (2024)
Back to School: Translation Using Grammar Books
par: Hus, Jonathan, et autres
Publié: (2024)
par: Hus, Jonathan, et autres
Publié: (2024)
Metadata Conditioned Large Language Models for Localization
par: Mukherjee, Anjishnu, et autres
Publié: (2026)
par: Mukherjee, Anjishnu, et autres
Publié: (2026)
DIALECTBENCH: A NLP Benchmark for Dialects, Varieties, and Closely-Related Languages
par: Faisal, Fahim, et autres
Publié: (2024)
par: Faisal, Fahim, et autres
Publié: (2024)
mHumanEval -- A Multilingual Benchmark to Evaluate Large Language Models for Code Generation
par: Raihan, Nishat, et autres
Publié: (2024)
par: Raihan, Nishat, et autres
Publié: (2024)
Data-Augmentation-Based Dialectal Adaptation for LLMs
par: Faisal, Fahim, et autres
Publié: (2024)
par: Faisal, Fahim, et autres
Publié: (2024)
A Study on Scaling Up Multilingual News Framing Analysis
par: Akter, Syeda Sabrina, et autres
Publié: (2024)
par: Akter, Syeda Sabrina, et autres
Publié: (2024)
Safe Language Generation in the Limit
par: Anastasopoulos, Antonios, et autres
Publié: (2026)
par: Anastasopoulos, Antonios, et autres
Publié: (2026)
Gloss2Text: Sign Language Gloss translation using LLMs and Semantically Aware Label Smoothing
par: Fayyazsanavi, Pooya, et autres
Publié: (2024)
par: Fayyazsanavi, Pooya, et autres
Publié: (2024)
Crossroads of Continents: Automated Artifact Extraction for Cultural Adaptation with Large Multimodal Models
par: Mukherjee, Anjishnu, et autres
Publié: (2024)
par: Mukherjee, Anjishnu, et autres
Publié: (2024)
Developing a Mixed-Methods Pipeline for Community-Oriented Digitization of Kwak'wala Legacy Texts
par: Agarwal, Milind, et autres
Publié: (2025)
par: Agarwal, Milind, et autres
Publié: (2025)
Cross-Lingual Representation Alignment Through Contrastive Image-Caption Tuning
par: Krasner, Nathaniel, et autres
Publié: (2025)
par: Krasner, Nathaniel, et autres
Publié: (2025)
Automated Python Translation
par: Otten, Joshua, et autres
Publié: (2025)
par: Otten, Joshua, et autres
Publié: (2025)
TigerCoder: A Novel Suite of LLMs for Code Generation in Bangla
par: Raihan, Nishat, et autres
Publié: (2025)
par: Raihan, Nishat, et autres
Publié: (2025)
Lost in the Tower of Babel: The Adverse Effects of Incidental Multilingualism in LLMs
par: Mukherjee, Anjishnu, et autres
Publié: (2026)
par: Mukherjee, Anjishnu, et autres
Publié: (2026)
Urban Mobility Assessment Using LLMs
par: Bhandari, Prabin, et autres
Publié: (2024)
par: Bhandari, Prabin, et autres
Publié: (2024)
A Comprehensive Part-of-Speech Tagging to Standardize Central-Kurdish Language: A Research Guide for Kurdish Natural Language Processing Tasks
par: Sabr, Shadan Shukr, et autres
Publié: (2025)
par: Sabr, Shadan Shukr, et autres
Publié: (2025)
VIGNETTE: Socially Grounded Bias Evaluation for Vision-Language Models
par: Raj, Chahat, et autres
Publié: (2025)
par: Raj, Chahat, et autres
Publié: (2025)
BiasDora: Exploring Hidden Biased Associations in Vision-Language Models
par: Raj, Chahat, et autres
Publié: (2024)
par: Raj, Chahat, et autres
Publié: (2024)
Conversational Lexicography: Querying Lexicographic Data on Knowledge Graphs with SPARQL through Natural Language
par: Sennrich, Kilian, et autres
Publié: (2025)
par: Sennrich, Kilian, et autres
Publié: (2025)
Translation Asymmetry in LLMs as a Data Augmentation Factor: A Case Study for 6 Romansh Language Varieties
par: Vamvas, Jannis, et autres
Publié: (2026)
par: Vamvas, Jannis, et autres
Publié: (2026)
Are Language Models Borrowing-Blind? A Multilingual Evaluation of Loanword Identification across 10 Languages
par: Silva, Mérilin Sousa, et autres
Publié: (2025)
par: Silva, Mérilin Sousa, et autres
Publié: (2025)
Unlearning Climate Misinformation in Large Language Models
par: Fore, Michael, et autres
Publié: (2024)
par: Fore, Michael, et autres
Publié: (2024)
Talent or Luck? Evaluating Attribution Bias in Large Language Models
par: Raj, Chahat, et autres
Publié: (2025)
par: Raj, Chahat, et autres
Publié: (2025)
Speech Analysis of Language Varieties in Italy
par: La Quatra, Moreno, et autres
Publié: (2024)
par: La Quatra, Moreno, et autres
Publié: (2024)
CMULAB: An Open-Source Framework for Training and Deployment of Natural Language Processing Models
par: Sheikh, Zaid, et autres
Publié: (2024)
par: Sheikh, Zaid, et autres
Publié: (2024)
Extracting Lexical Features from Dialects via Interpretable Dialect Classifiers
par: Xie, Roy, et autres
Publié: (2024)
par: Xie, Roy, et autres
Publié: (2024)
The LLM Effect: Are Humans Truly Using LLMs, or Are They Being Influenced By Them Instead?
par: Choi, Alexander S., et autres
Publié: (2024)
par: Choi, Alexander S., et autres
Publié: (2024)
Documents similaires
-
A Morphologically-Aware Dictionary-based Data Augmentation Technique for Machine Translation of Under-Represented Languages
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2024) -
CODET: A Benchmark for Contrastive Dialectal Evaluation of Machine Translation
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2023) -
A Case Study on Filtering for End-to-End Speech Translation
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2024) -
FLEURS-Kobani: Extending the FLEURS Dataset for Northern Kurdish
par: Jaff, Daban Q., et autres
Publié: (2026) -
English to Central Kurdish Speech Translation: Corpus Creation, Evaluation, and Orthographic Standardization
par: Mohammadamini, Mohammad, et autres
Publié: (2026)