Analyzing phonetic structure of Mandarin using Audacity
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Xu, Shizheng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ChildMandarin: A Comprehensive Mandarin Speech Dataset for Young Children Aged 3-5
par: Zhou, Jiaming, et autres
Publié: (2024)
par: Zhou, Jiaming, et autres
Publié: (2024)
FGCL: Fine-grained Contrastive Learning For Mandarin Stuttering Event Detection
par: Jiang, Han, et autres
Publié: (2024)
par: Jiang, Han, et autres
Publié: (2024)
Findings of the 2024 Mandarin Stuttering Event Detection and Automatic Speech Recognition Challenge
par: Xue, Hongfei, et autres
Publié: (2024)
par: Xue, Hongfei, et autres
Publié: (2024)
EMALG: An Enhanced Mandarin Lombard Grid Corpus with Meaningful Sentences
par: Li, Baifeng, et autres
Publié: (2023)
par: Li, Baifeng, et autres
Publié: (2023)
Decoding Speaker-Normalized Pitch from EEG for Mandarin Perception
par: Chen, Jiaxin, et autres
Publié: (2025)
par: Chen, Jiaxin, et autres
Publié: (2025)
FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration
par: Xu, Kai-Tuo, et autres
Publié: (2025)
par: Xu, Kai-Tuo, et autres
Publié: (2025)
DOTA-ME-CS: Daily Oriented Text Audio-Mandarin English-Code Switching Dataset
par: Li, Yupei, et autres
Publié: (2025)
par: Li, Yupei, et autres
Publié: (2025)
Contextualization of ASR with LLM using phonetic retrieval-based augmentation
par: Lei, Zhihong, et autres
Publié: (2024)
par: Lei, Zhihong, et autres
Publié: (2024)
Investigation of Deep Neural Network Acoustic Modelling Approaches for Low Resource Accented Mandarin Speech Recognition
par: Xie, Xurong, et autres
Publié: (2022)
par: Xie, Xurong, et autres
Publié: (2022)
EffectiveASR: A Single-Step Non-Autoregressive Mandarin Speech Recognition Architecture with High Accuracy and Inference Speed
par: Zhuang, Ziyang, et autres
Publié: (2024)
par: Zhuang, Ziyang, et autres
Publié: (2024)
The role of audio-visual integration in the time course of phonetic encoding in self-supervised speech models
par: Wang, Yi, et autres
Publié: (2025)
par: Wang, Yi, et autres
Publié: (2025)
Analyzing and Mitigating Inconsistency in Discrete Audio Tokens for Neural Codec Language Models
par: Liu, Wenrui, et autres
Publié: (2024)
par: Liu, Wenrui, et autres
Publié: (2024)
An efficient text augmentation approach for contextualized Mandarin speech recognition
par: Zheng, Naijun, et autres
Publié: (2024)
par: Zheng, Naijun, et autres
Publié: (2024)
Pitch-Aware RNN-T for Mandarin Chinese Mispronunciation Detection and Diagnosis
par: Wang, Xintong, et autres
Publié: (2024)
par: Wang, Xintong, et autres
Publié: (2024)
AMNet: An Acoustic Model Network for Enhanced Mandarin Speech Synthesis
par: Cao, Yubing, et autres
Publié: (2025)
par: Cao, Yubing, et autres
Publié: (2025)
Multilingual Stutter Event Detection for English, German, and Mandarin Speech
par: Haas, Felix, et autres
Publié: (2026)
par: Haas, Felix, et autres
Publié: (2026)
MNV-17: A High-Quality Performative Mandarin Dataset for Nonverbal Vocalization Recognition in Speech
par: Mai, Jialong, et autres
Publié: (2025)
par: Mai, Jialong, et autres
Publié: (2025)
AS-70: A Mandarin stuttered speech dataset for automatic speech recognition and stuttering event detection
par: Gong, Rong, et autres
Publié: (2024)
par: Gong, Rong, et autres
Publié: (2024)
Building a Taiwanese Mandarin Spoken Language Model: A First Attempt
par: Yang, Chih-Kai, et autres
Publié: (2024)
par: Yang, Chih-Kai, et autres
Publié: (2024)
Advancing Speech Translation: A Corpus of Mandarin-English Conversational Telephone Speech
par: Wotherspoon, Shannon, et autres
Publié: (2024)
par: Wotherspoon, Shannon, et autres
Publié: (2024)
A Multiclass Acoustic Dataset and Interactive Tool for Analyzing Drone Signatures in Real-World Environments
par: Wang, Mia Y., et autres
Publié: (2025)
par: Wang, Mia Y., et autres
Publié: (2025)
A corpus-based investigation of pitch contours of monosyllabic words in conversational Taiwan Mandarin
par: Jin, Xiaoyun, et autres
Publié: (2024)
par: Jin, Xiaoyun, et autres
Publié: (2024)
ToxicTone: A Mandarin Audio Dataset Annotated for Toxicity and Toxic Utterance Tonality
par: Luo, Yu-Xiang, et autres
Publié: (2025)
par: Luo, Yu-Xiang, et autres
Publié: (2025)
Construction and Evaluation of Mandarin Multimodal Emotional Speech Database
par: Ting, Zhu, et autres
Publié: (2024)
par: Ting, Zhu, et autres
Publié: (2024)
Does Your Voice Assistant Remember? Analyzing Conversational Context Recall and Utilization in Voice Interaction Models
par: Kim, Heeseung, et autres
Publié: (2025)
par: Kim, Heeseung, et autres
Publié: (2025)
Listen, Analyze, and Adapt to Learn New Attacks: An Exemplar-Free Class Incremental Learning Method for Audio Deepfake Source Tracing
par: Xiao, Yang, et autres
Publié: (2025)
par: Xiao, Yang, et autres
Publié: (2025)
A Detailed Audio-Text Data Simulation Pipeline using Single-Event Sounds
par: Xu, Xuenan, et autres
Publié: (2024)
par: Xu, Xuenan, et autres
Publié: (2024)
CS-Dialogue: A 104-Hour Dataset of Spontaneous Mandarin-English Code-Switching Dialogues for Speech Recognition
par: Zhou, Jiaming, et autres
Publié: (2025)
par: Zhou, Jiaming, et autres
Publié: (2025)
Enhancing Zero-shot Audio Classification using Sound Attribute Knowledge from Large Language Models
par: Xu, Xuenan, et autres
Publié: (2024)
par: Xu, Xuenan, et autres
Publié: (2024)
Generating Symbolic Music from Natural Language Prompts using an LLM-Enhanced Dataset
par: Xu, Weihan, et autres
Publié: (2024)
par: Xu, Weihan, et autres
Publié: (2024)
Whisper-PMFA: Partial Multi-Scale Feature Aggregation for Speaker Verification using Whisper Models
par: Zhao, Yiyang, et autres
Publié: (2024)
par: Zhao, Yiyang, et autres
Publié: (2024)
Enhancing Pre-trained ASR System Fine-tuning for Dysarthric Speech Recognition using Adversarial Data Augmentation
par: Wang, Huimeng, et autres
Publié: (2024)
par: Wang, Huimeng, et autres
Publié: (2024)
The Arrow of Time in Music -- Revisiting the Temporal Structure of Music with Distinguishability and Unique Orientability as the Anchor Point
par: Xu, Qi
Publié: (2023)
par: Xu, Qi
Publié: (2023)
Accurate analysis of the pitch pulse-based magnitude/phase structure of natural vowels and assessment of three lightweight time/frequency voicing restoration methods
par: Ferreira, Aníbal J. S., et autres
Publié: (2025)
par: Ferreira, Aníbal J. S., et autres
Publié: (2025)
Robust DOA estimation using deep acoustic imaging
par: Roman, Adrian S., et autres
Publié: (2024)
par: Roman, Adrian S., et autres
Publié: (2024)
Towards HRTF Personalization using Denoising Diffusion Models
par: Sánchez, Juan Camilo Albarracín, et autres
Publié: (2025)
par: Sánchez, Juan Camilo Albarracín, et autres
Publié: (2025)
On the use of Performer and Agent Attention for Spoken Language Identification
par: dhiman, Jitendra Kumar, et autres
Publié: (2025)
par: dhiman, Jitendra Kumar, et autres
Publié: (2025)
Binaural Target Speaker Extraction using Individualized HRTF
par: Ellinson, Yoav, et autres
Publié: (2025)
par: Ellinson, Yoav, et autres
Publié: (2025)
Relative Transfer Matrix Estimator using Covariance Subtraction
par: Manamperi, Wageesha N., et autres
Publié: (2025)
par: Manamperi, Wageesha N., et autres
Publié: (2025)
Enhancing TTS Stability in Hebrew using Discrete Semantic Units
par: Zeldes, Ella, et autres
Publié: (2024)
par: Zeldes, Ella, et autres
Publié: (2024)
Documents similaires
-
ChildMandarin: A Comprehensive Mandarin Speech Dataset for Young Children Aged 3-5
par: Zhou, Jiaming, et autres
Publié: (2024) -
FGCL: Fine-grained Contrastive Learning For Mandarin Stuttering Event Detection
par: Jiang, Han, et autres
Publié: (2024) -
Findings of the 2024 Mandarin Stuttering Event Detection and Automatic Speech Recognition Challenge
par: Xue, Hongfei, et autres
Publié: (2024) -
EMALG: An Enhanced Mandarin Lombard Grid Corpus with Meaningful Sentences
par: Li, Baifeng, et autres
Publié: (2023) -
Decoding Speaker-Normalized Pitch from EEG for Mandarin Perception
par: Chen, Jiaxin, et autres
Publié: (2025)