WenetSpeech-Wu: Datasets, Benchmarks, and Models for a Unified Chinese Wu Dialect Speech Processing Ecosystem
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Chengyou, Shao, Mingchen, Hu, Jingbin, Zhu, Zeyu, Xue, Hongfei, Mu, Bingshen, Xu, Xin, Duan, Xingyi, Zhang, Binbin, Zhu, Pengcheng, Ding, Chuang, Zhang, Xiaojun, Bu, Hui, Xie, Lei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WenetSpeech-Chuan: A Large-Scale Sichuanese Corpus with Rich Annotation for Dialectal Speech Processing
di: Dai, Yuhang, et al.
Pubblicazione: (2025)
di: Dai, Yuhang, et al.
Pubblicazione: (2025)
WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation
di: Li, Longhao, et al.
Pubblicazione: (2025)
di: Li, Longhao, et al.
Pubblicazione: (2025)
WenetSpeech4TTS: A 12,800-hour Mandarin TTS Corpus for Large Speech Generation Model Benchmark
di: Ma, Linhan, et al.
Pubblicazione: (2024)
di: Ma, Linhan, et al.
Pubblicazione: (2024)
Towards Building Speech Large Language Models for Multitask Understanding in Low-Resource Languages
di: Shao, Mingchen, et al.
Pubblicazione: (2025)
di: Shao, Mingchen, et al.
Pubblicazione: (2025)
Seeing the Context: Rich Visual Context-Aware Speech Recognition via Multimodal Reasoning
di: Tian, Wenjie, et al.
Pubblicazione: (2026)
di: Tian, Wenjie, et al.
Pubblicazione: (2026)
Mixture of LoRA Experts with Multi-Modal and Multi-Granularity LLM Generative Error Correction for Accented Speech Recognition
di: Mu, Bingshen, et al.
Pubblicazione: (2025)
di: Mu, Bingshen, et al.
Pubblicazione: (2025)
Weakly Supervised Data Refinement and Flexible Sequence Compression for Efficient Thai LLM-based ASR
di: Shao, Mingchen, et al.
Pubblicazione: (2025)
di: Shao, Mingchen, et al.
Pubblicazione: (2025)
Summary on The Multilingual Conversational Speech Language Model Challenge: Datasets, Tasks, Baselines, and Methods
di: Mu, Bingshen, et al.
Pubblicazione: (2025)
di: Mu, Bingshen, et al.
Pubblicazione: (2025)
Towards Comprehensive Semantic Speech Embeddings for Chinese Dialects
di: Chang, Kalvin, et al.
Pubblicazione: (2026)
di: Chang, Kalvin, et al.
Pubblicazione: (2026)
Unveiling the Potential of LLM-Based ASR on Chinese Open-Source Datasets
di: Geng, Xuelong, et al.
Pubblicazione: (2024)
di: Geng, Xuelong, et al.
Pubblicazione: (2024)
UrduSpeech: A 156-Hour Urdu Speech Corpus with 12-Dimension Paralinguistic Annotations
di: Haq, Attia Nafees ul, et al.
Pubblicazione: (2026)
di: Haq, Attia Nafees ul, et al.
Pubblicazione: (2026)
Shuke Wu
Pubblicazione: (2024)
Pubblicazione: (2024)
Kamimuria nigrita Wu 1962
di: Zhang, Rui, et al.
Pubblicazione: (2025)
di: Zhang, Rui, et al.
Pubblicazione: (2025)
Dynamics of Baxter-Wu model
di: Tang, Chen, et al.
Pubblicazione: (2025)
di: Tang, Chen, et al.
Pubblicazione: (2025)
Findings of the 2024 Mandarin Stuttering Event Detection and Automatic Speech Recognition Challenge
di: Xue, Hongfei, et al.
Pubblicazione: (2024)
di: Xue, Hongfei, et al.
Pubblicazione: (2024)
Machine Translation Evaluation Benchmark for Wu Chinese: Workflow and Analysis
di: Yu, Hongjian, et al.
Pubblicazione: (2024)
di: Yu, Hongjian, et al.
Pubblicazione: (2024)
Ophichthus fasciatus Chu, Wu & Jin 1981
di: Ho, Hsuan-Ching, et al.
Pubblicazione: (2015)
di: Ho, Hsuan-Ching, et al.
Pubblicazione: (2015)
Premna confinis Wu, Fl.
di: Nehrish, Nisar, et al.
Pubblicazione: (2025)
di: Nehrish, Nisar, et al.
Pubblicazione: (2025)
On injectivity of Cohen-Wu homomorphism
di: Ionin, Vasily
Pubblicazione: (2025)
di: Ionin, Vasily
Pubblicazione: (2025)
dLLM-ASR: A Faster Diffusion LLM-based Framework for Speech Recognition
di: Tian, Wenjie, et al.
Pubblicazione: (2026)
di: Tian, Wenjie, et al.
Pubblicazione: (2026)
Calycina brevipes W. P. Wu
di: Luo, Le, et al.
Pubblicazione: (2025)
di: Luo, Le, et al.
Pubblicazione: (2025)
Yponomeuta zebra Sohn & Wu 2010
di: Liu, Haoyu, et al.
Pubblicazione: (2026)
di: Liu, Haoyu, et al.
Pubblicazione: (2026)
Strumigenys hispida Lin & Wu 1996
di: Tang, Kit Lam, et al.
Pubblicazione: (2023)
di: Tang, Kit Lam, et al.
Pubblicazione: (2023)
Ascoschoengastia spindalis Wen and Wu 1984
di: Nielsen, David H., et al.
Pubblicazione: (2021)
di: Nielsen, David H., et al.
Pubblicazione: (2021)
WuNeng: Hybrid State with Attention
di: Xiao, Liu, et al.
Pubblicazione: (2025)
di: Xiao, Liu, et al.
Pubblicazione: (2025)
The Wu relations in real algebraic geometry
di: Benoist, Olivier, et al.
Pubblicazione: (2024)
di: Benoist, Olivier, et al.
Pubblicazione: (2024)
FastTurn: Unifying Acoustic and Streaming Semantic Cues for Low-Latency and Robust Turn Detection
di: Wang, Chengyou, et al.
Pubblicazione: (2026)
di: Wang, Chengyou, et al.
Pubblicazione: (2026)
MMGER: Multi-modal and Multi-granularity Generative Error Correction with LLM for Joint Accent and Speech Recognition
di: Mu, Bingshen, et al.
Pubblicazione: (2024)
di: Mu, Bingshen, et al.
Pubblicazione: (2024)
Habibi: Laying the Open-Source Foundation of Unified-Dialectal Arabic Speech Synthesis
di: Chen, Yushen, et al.
Pubblicazione: (2026)
di: Chen, Yushen, et al.
Pubblicazione: (2026)
OSUM: Advancing Open Speech Understanding Models with Limited Resources in Academia
di: Geng, Xuelong, et al.
Pubblicazione: (2025)
di: Geng, Xuelong, et al.
Pubblicazione: (2025)
Hearing More with Less: Multi-Modal Retrieval-and-Selection Augmented Conversational LLM-Based ASR
di: Mu, Bingshen, et al.
Pubblicazione: (2025)
di: Mu, Bingshen, et al.
Pubblicazione: (2025)
Dangdai Zhongwén 2 = Contemporary Chinese 2 [Disco compacto] / compilador Zhongwei Wu
Pubblicazione: (2003)
Pubblicazione: (2003)
Dangdai Zhongwén 1 = Contemporary Chinese 1 [Disco compacto] / ompilador Zhongwei Wu
Pubblicazione: (2003)
Pubblicazione: (2003)
LLM-ForcedAligner: A Non-Autoregressive and Accurate LLM-Based Forced Aligner for Multilingual and Long-Form Speech
di: Mu, Bingshen, et al.
Pubblicazione: (2026)
di: Mu, Bingshen, et al.
Pubblicazione: (2026)
WuXing and Cl(6,6): 144 Pentads for a Unified Relational Physics
di: DE DOMINICIS, BRUNO
Pubblicazione: (2026)
di: DE DOMINICIS, BRUNO
Pubblicazione: (2026)
Allomantispa Liu, Wu, Winterton & Ohl 2015
di: Li, Hongyu, et al.
Pubblicazione: (2020)
di: Li, Hongyu, et al.
Pubblicazione: (2020)
Revisiting the Wu-Yang approach to magnetic charge
di: Gonuguntla, Siva Mythili, et al.
Pubblicazione: (2023)
di: Gonuguntla, Siva Mythili, et al.
Pubblicazione: (2023)
Formalizing Wu-Ritt Method in Lean 4
di: Xiao, Yuxuan, et al.
Pubblicazione: (2026)
di: Xiao, Yuxuan, et al.
Pubblicazione: (2026)
Songjiang, arte y romance / Wu Meiling
di: Wu Meiling
di: Wu Meiling
Songjiang, arte y romance / Wu Meiling
di: Wu Meiling
di: Wu Meiling
Documenti analoghi
-
WenetSpeech-Chuan: A Large-Scale Sichuanese Corpus with Rich Annotation for Dialectal Speech Processing
di: Dai, Yuhang, et al.
Pubblicazione: (2025) -
WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation
di: Li, Longhao, et al.
Pubblicazione: (2025) -
WenetSpeech4TTS: A 12,800-hour Mandarin TTS Corpus for Large Speech Generation Model Benchmark
di: Ma, Linhan, et al.
Pubblicazione: (2024) -
Towards Building Speech Large Language Models for Multitask Understanding in Low-Resource Languages
di: Shao, Mingchen, et al.
Pubblicazione: (2025) -
Seeing the Context: Rich Visual Context-Aware Speech Recognition via Multimodal Reasoning
di: Tian, Wenjie, et al.
Pubblicazione: (2026)