WenetSpeech-Wu: Datasets, Benchmarks, and Models for a Unified Chinese Wu Dialect Speech Processing Ecosystem
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Chengyou, Shao, Mingchen, Hu, Jingbin, Zhu, Zeyu, Xue, Hongfei, Mu, Bingshen, Xu, Xin, Duan, Xingyi, Zhang, Binbin, Zhu, Pengcheng, Ding, Chuang, Zhang, Xiaojun, Bu, Hui, Xie, Lei |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
WenetSpeech-Chuan: A Large-Scale Sichuanese Corpus with Rich Annotation for Dialectal Speech Processing
by: Dai, Yuhang, et al.
Published: (2025)
by: Dai, Yuhang, et al.
Published: (2025)
WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation
by: Li, Longhao, et al.
Published: (2025)
by: Li, Longhao, et al.
Published: (2025)
WenetSpeech4TTS: A 12,800-hour Mandarin TTS Corpus for Large Speech Generation Model Benchmark
by: Ma, Linhan, et al.
Published: (2024)
by: Ma, Linhan, et al.
Published: (2024)
Towards Building Speech Large Language Models for Multitask Understanding in Low-Resource Languages
by: Shao, Mingchen, et al.
Published: (2025)
by: Shao, Mingchen, et al.
Published: (2025)
Seeing the Context: Rich Visual Context-Aware Speech Recognition via Multimodal Reasoning
by: Tian, Wenjie, et al.
Published: (2026)
by: Tian, Wenjie, et al.
Published: (2026)
Mixture of LoRA Experts with Multi-Modal and Multi-Granularity LLM Generative Error Correction for Accented Speech Recognition
by: Mu, Bingshen, et al.
Published: (2025)
by: Mu, Bingshen, et al.
Published: (2025)
Weakly Supervised Data Refinement and Flexible Sequence Compression for Efficient Thai LLM-based ASR
by: Shao, Mingchen, et al.
Published: (2025)
by: Shao, Mingchen, et al.
Published: (2025)
Summary on The Multilingual Conversational Speech Language Model Challenge: Datasets, Tasks, Baselines, and Methods
by: Mu, Bingshen, et al.
Published: (2025)
by: Mu, Bingshen, et al.
Published: (2025)
Towards Comprehensive Semantic Speech Embeddings for Chinese Dialects
by: Chang, Kalvin, et al.
Published: (2026)
by: Chang, Kalvin, et al.
Published: (2026)
Unveiling the Potential of LLM-Based ASR on Chinese Open-Source Datasets
by: Geng, Xuelong, et al.
Published: (2024)
by: Geng, Xuelong, et al.
Published: (2024)
UrduSpeech: A 156-Hour Urdu Speech Corpus with 12-Dimension Paralinguistic Annotations
by: Haq, Attia Nafees ul, et al.
Published: (2026)
by: Haq, Attia Nafees ul, et al.
Published: (2026)
Shuke Wu
Published: (2024)
Published: (2024)
Kamimuria nigrita Wu 1962
by: Zhang, Rui, et al.
Published: (2025)
by: Zhang, Rui, et al.
Published: (2025)
Dynamics of Baxter-Wu model
by: Tang, Chen, et al.
Published: (2025)
by: Tang, Chen, et al.
Published: (2025)
Findings of the 2024 Mandarin Stuttering Event Detection and Automatic Speech Recognition Challenge
by: Xue, Hongfei, et al.
Published: (2024)
by: Xue, Hongfei, et al.
Published: (2024)
Machine Translation Evaluation Benchmark for Wu Chinese: Workflow and Analysis
by: Yu, Hongjian, et al.
Published: (2024)
by: Yu, Hongjian, et al.
Published: (2024)
Ophichthus fasciatus Chu, Wu & Jin 1981
by: Ho, Hsuan-Ching, et al.
Published: (2015)
by: Ho, Hsuan-Ching, et al.
Published: (2015)
Premna confinis Wu, Fl.
by: Nehrish, Nisar, et al.
Published: (2025)
by: Nehrish, Nisar, et al.
Published: (2025)
On injectivity of Cohen-Wu homomorphism
by: Ionin, Vasily
Published: (2025)
by: Ionin, Vasily
Published: (2025)
dLLM-ASR: A Faster Diffusion LLM-based Framework for Speech Recognition
by: Tian, Wenjie, et al.
Published: (2026)
by: Tian, Wenjie, et al.
Published: (2026)
Calycina brevipes W. P. Wu
by: Luo, Le, et al.
Published: (2025)
by: Luo, Le, et al.
Published: (2025)
Yponomeuta zebra Sohn & Wu 2010
by: Liu, Haoyu, et al.
Published: (2026)
by: Liu, Haoyu, et al.
Published: (2026)
Strumigenys hispida Lin & Wu 1996
by: Tang, Kit Lam, et al.
Published: (2023)
by: Tang, Kit Lam, et al.
Published: (2023)
Ascoschoengastia spindalis Wen and Wu 1984
by: Nielsen, David H., et al.
Published: (2021)
by: Nielsen, David H., et al.
Published: (2021)
WuNeng: Hybrid State with Attention
by: Xiao, Liu, et al.
Published: (2025)
by: Xiao, Liu, et al.
Published: (2025)
The Wu relations in real algebraic geometry
by: Benoist, Olivier, et al.
Published: (2024)
by: Benoist, Olivier, et al.
Published: (2024)
FastTurn: Unifying Acoustic and Streaming Semantic Cues for Low-Latency and Robust Turn Detection
by: Wang, Chengyou, et al.
Published: (2026)
by: Wang, Chengyou, et al.
Published: (2026)
MMGER: Multi-modal and Multi-granularity Generative Error Correction with LLM for Joint Accent and Speech Recognition
by: Mu, Bingshen, et al.
Published: (2024)
by: Mu, Bingshen, et al.
Published: (2024)
Habibi: Laying the Open-Source Foundation of Unified-Dialectal Arabic Speech Synthesis
by: Chen, Yushen, et al.
Published: (2026)
by: Chen, Yushen, et al.
Published: (2026)
OSUM: Advancing Open Speech Understanding Models with Limited Resources in Academia
by: Geng, Xuelong, et al.
Published: (2025)
by: Geng, Xuelong, et al.
Published: (2025)
Hearing More with Less: Multi-Modal Retrieval-and-Selection Augmented Conversational LLM-Based ASR
by: Mu, Bingshen, et al.
Published: (2025)
by: Mu, Bingshen, et al.
Published: (2025)
Dangdai Zhongwén 2 = Contemporary Chinese 2 [Disco compacto] / compilador Zhongwei Wu
Published: (2003)
Published: (2003)
Dangdai Zhongwén 1 = Contemporary Chinese 1 [Disco compacto] / ompilador Zhongwei Wu
Published: (2003)
Published: (2003)
LLM-ForcedAligner: A Non-Autoregressive and Accurate LLM-Based Forced Aligner for Multilingual and Long-Form Speech
by: Mu, Bingshen, et al.
Published: (2026)
by: Mu, Bingshen, et al.
Published: (2026)
WuXing and Cl(6,6): 144 Pentads for a Unified Relational Physics
by: DE DOMINICIS, BRUNO
Published: (2026)
by: DE DOMINICIS, BRUNO
Published: (2026)
Allomantispa Liu, Wu, Winterton & Ohl 2015
by: Li, Hongyu, et al.
Published: (2020)
by: Li, Hongyu, et al.
Published: (2020)
Similar Items
-
WenetSpeech-Chuan: A Large-Scale Sichuanese Corpus with Rich Annotation for Dialectal Speech Processing
by: Dai, Yuhang, et al.
Published: (2025) -
WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation
by: Li, Longhao, et al.
Published: (2025) -
WenetSpeech4TTS: A 12,800-hour Mandarin TTS Corpus for Large Speech Generation Model Benchmark
by: Ma, Linhan, et al.
Published: (2024) -
Towards Building Speech Large Language Models for Multitask Understanding in Low-Resource Languages
by: Shao, Mingchen, et al.
Published: (2025) -
Seeing the Context: Rich Visual Context-Aware Speech Recognition via Multimodal Reasoning
by: Tian, Wenjie, et al.
Published: (2026)