A Multi-Dialectal Dataset for German Dialect ASR and Dialect-to-Standard Speech Translation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Blaschke, Verena, Winkler, Miriam, Förster, Constantin, Wenger-Glemser, Gabriele, Plank, Barbara |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Standard-to-Dialect Transfer Trends Differ across Text and Speech: A Case Study on Intent and Topic Classification in German Dialects
par: Blaschke, Verena, et autres
Publié: (2025)
par: Blaschke, Verena, et autres
Publié: (2025)
Dolphin-CN-Dialect: Where Chinese Dialects Matter
par: Meng, Yangyang, et autres
Publié: (2026)
par: Meng, Yangyang, et autres
Publié: (2026)
Cross-Dialect Text-To-Speech in Pitch-Accent Language Incorporating Multi-Dialect Phoneme-Level BERT
par: Yamauchi, Kazuki, et autres
Publié: (2024)
par: Yamauchi, Kazuki, et autres
Publié: (2024)
Performance Analysis of Speech Encoders for Low-Resource SLU and ASR in Tunisian Dialect
par: Mdhaffar, Salima, et autres
Publié: (2024)
par: Mdhaffar, Salima, et autres
Publié: (2024)
Dialectal Coverage And Generalization in Arabic Speech Recognition
par: Djanibekov, Amirbek, et autres
Publié: (2024)
par: Djanibekov, Amirbek, et autres
Publié: (2024)
RoDia: A New Dataset for Romanian Dialect Identification from Speech
par: Rotaru, Codrut, et autres
Publié: (2023)
par: Rotaru, Codrut, et autres
Publié: (2023)
Overcoming Data Scarcity in Multi-Dialectal Arabic ASR via Whisper Fine-Tuning
par: Özyilmaz, Ömer Tarik, et autres
Publié: (2025)
par: Özyilmaz, Ömer Tarik, et autres
Publié: (2025)
Towards Zero-Shot Text-To-Speech for Arabic Dialects
par: Doan, Khai Duy, et autres
Publié: (2024)
par: Doan, Khai Duy, et autres
Publié: (2024)
Mići Princ -- A Little Boy Teaching Speech Technologies the Chakavian Dialect
par: Ljubešić, Nikola, et autres
Publié: (2026)
par: Ljubešić, Nikola, et autres
Publié: (2026)
LinTO Audio and Textual Datasets to Train and Evaluate Automatic Speech Recognition in Tunisian Arabic Dialect
par: Naouara, Hedi, et autres
Publié: (2025)
par: Naouara, Hedi, et autres
Publié: (2025)
CAFE A Novel Code switching Dataset for Algerian Dialect French and English
par: Lachemat, Houssam Eddine-Othman, et autres
Publié: (2024)
par: Lachemat, Houssam Eddine-Othman, et autres
Publié: (2024)
Habibi: Laying the Open-Source Foundation of Unified-Dialectal Arabic Speech Synthesis
par: Chen, Yushen, et autres
Publié: (2026)
par: Chen, Yushen, et autres
Publié: (2026)
Evaluating Standard and Dialectal Frisian ASR: Multilingual Fine-tuning and Language Identification for Improved Low-resource Performance
par: Amooie, Reihaneh, et autres
Publié: (2025)
par: Amooie, Reihaneh, et autres
Publié: (2025)
Bailing-TTS: Chinese Dialectal Speech Synthesis Towards Human-like Spontaneous Representation
par: Di, Xinhan, et autres
Publié: (2024)
par: Di, Xinhan, et autres
Publié: (2024)
Exploring Energy-Based Models for Out-of-Distribution Detection in Dialect Identification
par: Hao, Yaqian, et autres
Publié: (2024)
par: Hao, Yaqian, et autres
Publié: (2024)
Voxlect: A Speech Foundation Model Benchmark for Modeling Dialects and Regional Languages Around the Globe
par: Feng, Tiantian, et autres
Publié: (2025)
par: Feng, Tiantian, et autres
Publié: (2025)
Identifying Primary Stress Across Related Languages and Dialects with Transformer-based Speech Encoder Models
par: Ljubešić, Nikola, et autres
Publié: (2025)
par: Ljubešić, Nikola, et autres
Publié: (2025)
Leveraging LLM and Self-Supervised Training Models for Speech Recognition in Chinese Dialects: A Comparative Analysis
par: Xu, Tianyi, et autres
Publié: (2025)
par: Xu, Tianyi, et autres
Publié: (2025)
PolySpeech-100: A Large-Scale Benchmark for Speech Understanding Across 100+ Languages and Dialects
par: Yang, Sicheng, et autres
Publié: (2026)
par: Yang, Sicheng, et autres
Publié: (2026)
VoxHakka: A Dialectally Diverse Multi-speaker Text-to-Speech System for Taiwanese Hakka
par: Chen, Li-Wei, et autres
Publié: (2024)
par: Chen, Li-Wei, et autres
Publié: (2024)
FMSD-TTS: Few-shot Multi-Speaker Multi-Dialect Text-to-Speech Synthesis for Ü-Tsang, Amdo and Kham Speech Dataset Generation
par: Liu, Yutong, et autres
Publié: (2025)
par: Liu, Yutong, et autres
Publié: (2025)
Cross-Dialect Bird Species Recognition with Dialect-Calibrated Augmentation
par: Ding, Jiani, et autres
Publié: (2025)
par: Ding, Jiani, et autres
Publié: (2025)
Voice Conversion Improves Cross-Domain Robustness for Spoken Arabic Dialect Identification
par: Abdullah, Badr M., et autres
Publié: (2025)
par: Abdullah, Badr M., et autres
Publié: (2025)
Efficient Dialect-Aware Modeling and Conditioning for Low-Resource Taiwanese Hakka Speech Processing
par: Peng, An-Ci, et autres
Publié: (2026)
par: Peng, An-Ci, et autres
Publié: (2026)
From Dialect Gaps to Identity Maps: Tackling Variability in Speaker Verification
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
Literary and Colloquial Tamil Dialect Identification
par: Nanmalar, M., et autres
Publié: (2024)
par: Nanmalar, M., et autres
Publié: (2024)
A Unified Denoising and Adaptation Framework for Self-Supervised Bengali Dialectal ASR
par: Biswas, Swadhin, et autres
Publié: (2025)
par: Biswas, Swadhin, et autres
Publié: (2025)
Hybrid Deep Learning and Signal Processing for Arabic Dialect Recognition in Low-Resource Settings
par: Al-Shwayyat, Ghazal, et autres
Publié: (2025)
par: Al-Shwayyat, Ghazal, et autres
Publié: (2025)
Unsupervised Out-of-Distribution Dialect Detection with Mahalanobis Distance
par: Das, Sourya Dipta, et autres
Publié: (2023)
par: Das, Sourya Dipta, et autres
Publié: (2023)
Improving Low-Resource Dialect Classification Using Retrieval-based Voice Conversion
par: Fischbach, Lea, et autres
Publié: (2025)
par: Fischbach, Lea, et autres
Publié: (2025)
WenetSpeech-Wu: Datasets, Benchmarks, and Models for a Unified Chinese Wu Dialect Speech Processing Ecosystem
par: Wang, Chengyou, et autres
Publié: (2026)
par: Wang, Chengyou, et autres
Publié: (2026)
DiaMoE-TTS: A Unified IPA-Based Dialect TTS Framework with Mixture-of-Experts and Parameter-Efficient Zero-Shot Adaptation
par: Chen, Ziqi, et autres
Publié: (2025)
par: Chen, Ziqi, et autres
Publié: (2025)
What Do Dialect Speakers Want? A Survey of Attitudes Towards Language Technology for German Dialects
par: Blaschke, Verena, et autres
Publié: (2024)
par: Blaschke, Verena, et autres
Publié: (2024)
Improving Dialectal Slot and Intent Detection with Auxiliary Tasks: A Multi-Dialectal Bavarian Case Study
par: Krückl, Xaver Maria, et autres
Publié: (2025)
par: Krückl, Xaver Maria, et autres
Publié: (2025)
Beyond Orthography: Automatic Recovery of Short Vowels and Dialectal Sounds in Arabic
par: Kheir, Yassine El, et autres
Publié: (2024)
par: Kheir, Yassine El, et autres
Publié: (2024)
Granary: Speech Recognition and Translation Dataset in 25 European Languages
par: Koluguri, Nithin Rao, et autres
Publié: (2025)
par: Koluguri, Nithin Rao, et autres
Publié: (2025)
DB3V: A Dialect Dominated Dataset of Bird Vocalisation for Cross-corpus Bird Species Recognition
par: Jing, Xin, et autres
Publié: (2024)
par: Jing, Xin, et autres
Publié: (2024)
TagSpeech: End-to-End Multi-Speaker ASR and Diarization with Fine-Grained Temporal Grounding
par: Huo, Mingyue, et autres
Publié: (2026)
par: Huo, Mingyue, et autres
Publié: (2026)
Literary and Colloquial Dialect Identification for Tamil using Acoustic Features
par: Nanmalar, M., et autres
Publié: (2024)
par: Nanmalar, M., et autres
Publié: (2024)
LibriheavyMix: A 20,000-Hour Dataset for Single-Channel Reverberant Multi-Talker Speech Separation, ASR and Speaker Diarization
par: Jin, Zengrui, et autres
Publié: (2024)
par: Jin, Zengrui, et autres
Publié: (2024)
Documents similaires
-
Standard-to-Dialect Transfer Trends Differ across Text and Speech: A Case Study on Intent and Topic Classification in German Dialects
par: Blaschke, Verena, et autres
Publié: (2025) -
Dolphin-CN-Dialect: Where Chinese Dialects Matter
par: Meng, Yangyang, et autres
Publié: (2026) -
Cross-Dialect Text-To-Speech in Pitch-Accent Language Incorporating Multi-Dialect Phoneme-Level BERT
par: Yamauchi, Kazuki, et autres
Publié: (2024) -
Performance Analysis of Speech Encoders for Low-Resource SLU and ASR in Tunisian Dialect
par: Mdhaffar, Salima, et autres
Publié: (2024) -
Dialectal Coverage And Generalization in Arabic Speech Recognition
par: Djanibekov, Amirbek, et autres
Publié: (2024)