Mixat: A Data Set of Bilingual Emirati-English Speech
Fuente:
arXiv
Salvato in:
| Autori principali: | Ali, Maryam Al, Aldarmaki, Hanan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Automatic Restoration of Diacritics for Speech Data Sets
di: Shatnawi, Sara, et al.
Pubblicazione: (2023)
di: Shatnawi, Sara, et al.
Pubblicazione: (2023)
SparQLe: Speech Queries to Text Translation Through LLMs
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2025)
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2025)
Spoken Word2Vec: Learning Skipgram Embeddings from Speech
di: Sayeed, Mohammad Amaan, et al.
Pubblicazione: (2023)
di: Sayeed, Mohammad Amaan, et al.
Pubblicazione: (2023)
Personal Attribute Leakage in Federated Speech Models
di: Al-Ali, Hamdan, et al.
Pubblicazione: (2025)
di: Al-Ali, Hamdan, et al.
Pubblicazione: (2025)
Ramsa: A Large Sociolinguistically Rich Emirati Arabic Speech Corpus for ASR and TTS
di: Al-Sabbagh, Rania
Pubblicazione: (2026)
di: Al-Sabbagh, Rania
Pubblicazione: (2026)
Unrequited Emotions: Investigating the Gaps in Motivation and Practice in Speech Emotion Recognition Research
di: Wong, Taryn, et al.
Pubblicazione: (2026)
di: Wong, Taryn, et al.
Pubblicazione: (2026)
STTATTS: Unified Speech-To-Text And Text-To-Speech Model
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2024)
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2024)
Dialectal Coverage And Generalization in Arabic Speech Recognition
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2024)
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2024)
Code-Switching in End-to-End Automatic Speech Recognition: A Systematic Literature Review
di: Agro, Maha Tufail, et al.
Pubblicazione: (2025)
di: Agro, Maha Tufail, et al.
Pubblicazione: (2025)
Are LLMs Good Text Diacritizers? An Arabic and Yoruba Case Study
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025)
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025)
Morphemes Without Borders: Evaluating Root-Pattern Morphology in Arabic Tokenizers and LLMs
di: Alakeel, Yara, et al.
Pubblicazione: (2026)
di: Alakeel, Yara, et al.
Pubblicazione: (2026)
ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025)
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025)
Voice of a Continent: Mapping Africa's Speech Technology Frontier
di: Elmadany, AbdelRahim, et al.
Pubblicazione: (2025)
di: Elmadany, AbdelRahim, et al.
Pubblicazione: (2025)
Linear Semantic Segmentation for Low-Resource Spoken Dialects
di: Chirkunov, Kirill, et al.
Pubblicazione: (2026)
di: Chirkunov, Kirill, et al.
Pubblicazione: (2026)
Aligning Stuttered-Speech Research with End-User Needs: Scoping Review, Survey, and Guidelines
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2026)
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2026)
JEEM: Vision-Language Understanding in Four Arabic Dialects
di: Kadaoui, Karima, et al.
Pubblicazione: (2025)
di: Kadaoui, Karima, et al.
Pubblicazione: (2025)
Building a Non-native Speech Corpus Featuring Chinese-English Bilingual Children: Compilation and Rationale
di: Hung, Hiuchung, et al.
Pubblicazione: (2023)
di: Hung, Hiuchung, et al.
Pubblicazione: (2023)
gaHealth: An English-Irish Bilingual Corpus of Health Data
di: Lankford, Séamus, et al.
Pubblicazione: (2024)
di: Lankford, Séamus, et al.
Pubblicazione: (2024)
Chapter 5 English-Medium Instruction in Emirati Higher Education
di: Hopkyns, Sarah
Pubblicazione: (2023)
di: Hopkyns, Sarah
Pubblicazione: (2023)
NADI 2025: The First Multidialectal Arabic Speech Processing Shared Task
di: Talafha, Bashar, et al.
Pubblicazione: (2025)
di: Talafha, Bashar, et al.
Pubblicazione: (2025)
Clinical Annotations for Automatic Stuttering Severity Assessment
di: Valente, Ana Rita, et al.
Pubblicazione: (2025)
di: Valente, Ana Rita, et al.
Pubblicazione: (2025)
RelUNet: Relative Channel Fusion U-Net for Multichannel Speech Enhancement
di: Aldarmaki, Ibrahim, et al.
Pubblicazione: (2024)
di: Aldarmaki, Ibrahim, et al.
Pubblicazione: (2024)
RespondeoQA: a Benchmark for Bilingual Latin-English Question Answering
di: Hudspeth, Marisa, et al.
Pubblicazione: (2026)
di: Hudspeth, Marisa, et al.
Pubblicazione: (2026)
Qomhra: A Bilingual Irish and English Large Language Model
di: McInerney, Joseph, et al.
Pubblicazione: (2025)
di: McInerney, Joseph, et al.
Pubblicazione: (2025)
CroissantLLM: A Truly Bilingual French-English Language Model
di: Faysse, Manuel, et al.
Pubblicazione: (2024)
di: Faysse, Manuel, et al.
Pubblicazione: (2024)
Dólares or Dollars? Unraveling the Bilingual Prowess of Financial LLMs Between Spanish and English
di: Zhang, Xiao, et al.
Pubblicazione: (2024)
di: Zhang, Xiao, et al.
Pubblicazione: (2024)
BiST: A Gold Standard Bangla-English Bilingual Corpus for Sentence Structure and Tense Classification with Inter-Annotator Agreement
di: Shafi, Abdullah Al, et al.
Pubblicazione: (2026)
di: Shafi, Abdullah Al, et al.
Pubblicazione: (2026)
LLM-to-Speech: A Synthetic Data Pipeline for Training Dialectal Text-to-Speech Models
di: Khamis, Ahmed Khaled, et al.
Pubblicazione: (2026)
di: Khamis, Ahmed Khaled, et al.
Pubblicazione: (2026)
Setting up the Data Printer with Improved English to Ukrainian Machine Translation
di: Paniv, Yurii, et al.
Pubblicazione: (2024)
di: Paniv, Yurii, et al.
Pubblicazione: (2024)
Comparison of Multilingual and Bilingual Models for Satirical News Detection of Arabic and English
di: Abdalla, Omar W., et al.
Pubblicazione: (2024)
di: Abdalla, Omar W., et al.
Pubblicazione: (2024)
Loquacious Set: 25,000 Hours of Transcribed and Diverse English Speech Recognition Data for Research and Commercial Use
di: Parcollet, Titouan, et al.
Pubblicazione: (2025)
di: Parcollet, Titouan, et al.
Pubblicazione: (2025)
How Lexical is Bilingual Lexicon Induction?
di: Kohli, Harsh, et al.
Pubblicazione: (2024)
di: Kohli, Harsh, et al.
Pubblicazione: (2024)
Relation Extraction Capabilities of LLMs on Clinical Text: A Bilingual Evaluation for English and Turkish
di: Aidynkyzy, Aidana, et al.
Pubblicazione: (2026)
di: Aidynkyzy, Aidana, et al.
Pubblicazione: (2026)
Is Cross-Lingual Transfer in Bilingual Models Human-Like? A Study with Overlapping Word Forms in Dutch and English
di: Škrjanec, Iza, et al.
Pubblicazione: (2026)
di: Škrjanec, Iza, et al.
Pubblicazione: (2026)
From English-Centric to Effective Bilingual: LLMs with Custom Tokenizers for Underrepresented Languages
di: Kiulian, Artur, et al.
Pubblicazione: (2024)
di: Kiulian, Artur, et al.
Pubblicazione: (2024)
EmoHopeSpeech: An Annotated Dataset of Emotions and Hope Speech in English and Arabic
di: Zaghouani, Wajdi, et al.
Pubblicazione: (2025)
di: Zaghouani, Wajdi, et al.
Pubblicazione: (2025)
Assessing the Role of Data Quality in Training Bilingual Language Models
di: Seto, Skyler, et al.
Pubblicazione: (2025)
di: Seto, Skyler, et al.
Pubblicazione: (2025)
PEACH: A sentence-aligned Parallel English-Arabic Corpus for Healthcare
di: Al-Sabbagh, Rania
Pubblicazione: (2025)
di: Al-Sabbagh, Rania
Pubblicazione: (2025)
Code-Mixed Telugu-English Hate Speech Detection
di: Kakarla, Santhosh, et al.
Pubblicazione: (2025)
di: Kakarla, Santhosh, et al.
Pubblicazione: (2025)
StatBot.Swiss: Bilingual Open Data Exploration in Natural Language
di: Nooralahzadeh, Farhad, et al.
Pubblicazione: (2024)
di: Nooralahzadeh, Farhad, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Automatic Restoration of Diacritics for Speech Data Sets
di: Shatnawi, Sara, et al.
Pubblicazione: (2023) -
SparQLe: Speech Queries to Text Translation Through LLMs
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2025) -
Spoken Word2Vec: Learning Skipgram Embeddings from Speech
di: Sayeed, Mohammad Amaan, et al.
Pubblicazione: (2023) -
Personal Attribute Leakage in Federated Speech Models
di: Al-Ali, Hamdan, et al.
Pubblicazione: (2025) -
Ramsa: A Large Sociolinguistically Rich Emirati Arabic Speech Corpus for ASR and TTS
di: Al-Sabbagh, Rania
Pubblicazione: (2026)