Parameter Selection for Analyzing Conversations with Autism Spectrum Disorder
Fuente:
arXiv
Salvato in:
| Autori principali: | Chowdhury, Tahiya, Romero, Veronica, Stent, Amanda |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fast-VGAN: Lightweight Voice Conversion with Explicit Control of F0 and Duration Parameters
di: Abrassart, Mathilde, et al.
Pubblicazione: (2025)
di: Abrassart, Mathilde, et al.
Pubblicazione: (2025)
Exploring Speech Pattern Disorders in Autism using Machine Learning
di: Hu, Chuanbo, et al.
Pubblicazione: (2024)
di: Hu, Chuanbo, et al.
Pubblicazione: (2024)
Contrastive Learning with Spectrum Information Augmentation in Abnormal Sound Detection
di: Meng, Xinxin, et al.
Pubblicazione: (2025)
di: Meng, Xinxin, et al.
Pubblicazione: (2025)
Can We Trust Machine Learning? The Reliability of Features from Open-Source Speech Analysis Tools for Speech Modeling
di: Chowdhury, Tahiya, et al.
Pubblicazione: (2025)
di: Chowdhury, Tahiya, et al.
Pubblicazione: (2025)
EnCLAP++: Analyzing the EnCLAP Framework for Optimizing Automated Audio Captioning Performance
di: Kim, Jaeyeon, et al.
Pubblicazione: (2024)
di: Kim, Jaeyeon, et al.
Pubblicazione: (2024)
Unifying Speech Recognition, Synthesis and Conversion with Autoregressive Transformers
di: Cai, Runyuan, et al.
Pubblicazione: (2026)
di: Cai, Runyuan, et al.
Pubblicazione: (2026)
MulliVC: Multi-lingual Voice Conversion With Cycle Consistency
di: Huang, Jiawei, et al.
Pubblicazione: (2024)
di: Huang, Jiawei, et al.
Pubblicazione: (2024)
Convert and Speak: Zero-shot Accent Conversion with Minimum Supervision
di: Jia, Zhijun, et al.
Pubblicazione: (2024)
di: Jia, Zhijun, et al.
Pubblicazione: (2024)
Disentangled Dual-Branch Graph Learning for Conversational Emotion Recognition
di: Guo, Chengling, et al.
Pubblicazione: (2026)
di: Guo, Chengling, et al.
Pubblicazione: (2026)
Assessment of Personality Dimensions Across Situations Using Conversational Speech
di: Zhang, Alice, et al.
Pubblicazione: (2025)
di: Zhang, Alice, et al.
Pubblicazione: (2025)
Interpreting Pretrained Speech Models for Automatic Speech Assessment of Voice Disorders
di: Lau, Hok-Shing, et al.
Pubblicazione: (2024)
di: Lau, Hok-Shing, et al.
Pubblicazione: (2024)
SPA-SVC: Self-supervised Pitch Augmentation for Singing Voice Conversion
di: Bai, Bingsong, et al.
Pubblicazione: (2024)
di: Bai, Bingsong, et al.
Pubblicazione: (2024)
LHQ-SVC: Lightweight and High Quality Singing Voice Conversion Modeling
di: Huang, Yubo, et al.
Pubblicazione: (2024)
di: Huang, Yubo, et al.
Pubblicazione: (2024)
Advancing NAM-to-Speech Conversion with Novel Methods and the MultiNAM Dataset
di: Shah, Neil, et al.
Pubblicazione: (2024)
di: Shah, Neil, et al.
Pubblicazione: (2024)
Non-autoregressive real-time Accent Conversion model with voice cloning
di: Nechaev, Vladimir, et al.
Pubblicazione: (2024)
di: Nechaev, Vladimir, et al.
Pubblicazione: (2024)
EZ-VC: Easy Zero-shot Any-to-Any Voice Conversion
di: Joglekar, Advait, et al.
Pubblicazione: (2025)
di: Joglekar, Advait, et al.
Pubblicazione: (2025)
Multi-Speaker Conversational Audio Deepfake: Taxonomy, Dataset and Pilot Study
di: Ahmed, Alabi, et al.
Pubblicazione: (2026)
di: Ahmed, Alabi, et al.
Pubblicazione: (2026)
DiffCSS: Diverse and Expressive Conversational Speech Synthesis with Diffusion Models
di: wu, Weihao, et al.
Pubblicazione: (2025)
di: wu, Weihao, et al.
Pubblicazione: (2025)
SelfVC: Voice Conversion With Iterative Refinement using Self Transformations
di: Neekhara, Paarth, et al.
Pubblicazione: (2023)
di: Neekhara, Paarth, et al.
Pubblicazione: (2023)
From Words to Waves: Analyzing Concept Formation in Speech and Text-Based Foundation Models
di: Ersoy, Asım, et al.
Pubblicazione: (2025)
di: Ersoy, Asım, et al.
Pubblicazione: (2025)
Perceiver-Prompt: Flexible Speaker Adaptation in Whisper for Chinese Disordered Speech Recognition
di: Jiang, Yicong, et al.
Pubblicazione: (2024)
di: Jiang, Yicong, et al.
Pubblicazione: (2024)
A Framework for Synthetic Audio Conversations Generation using Large Language Models
di: Kyaw, Kaung Myat, et al.
Pubblicazione: (2024)
di: Kyaw, Kaung Myat, et al.
Pubblicazione: (2024)
ML-SAN: Multi-Level Speaker-Adaptive Network for Emotion Recognition in Conversations
di: Wang, Kexue, et al.
Pubblicazione: (2026)
di: Wang, Kexue, et al.
Pubblicazione: (2026)
Attention-based Interactive Disentangling Network for Instance-level Emotional Voice Conversion
di: Chen, Yun, et al.
Pubblicazione: (2023)
di: Chen, Yun, et al.
Pubblicazione: (2023)
Generative Adversarial Network based Voice Conversion: Techniques, Challenges, and Recent Advancements
di: Dhar, Sandipan, et al.
Pubblicazione: (2025)
di: Dhar, Sandipan, et al.
Pubblicazione: (2025)
Towards Better Disentanglement in Non-Autoregressive Zero-Shot Expressive Voice Conversion
di: Akti, Seymanur, et al.
Pubblicazione: (2025)
di: Akti, Seymanur, et al.
Pubblicazione: (2025)
Fast, High-Quality and Parameter-Efficient Articulatory Synthesis using Differentiable DSP
di: Liu, Yisi, et al.
Pubblicazione: (2024)
di: Liu, Yisi, et al.
Pubblicazione: (2024)
QR-VC: Leveraging Quantization Residuals for Linear Disentanglement in Zero-Shot Voice Conversion
di: Sim, Youngjun, et al.
Pubblicazione: (2024)
di: Sim, Youngjun, et al.
Pubblicazione: (2024)
Prosody-Adaptable Audio Codecs for Zero-Shot Voice Conversion via In-Context Learning
di: Zhao, Junchuan, et al.
Pubblicazione: (2025)
di: Zhao, Junchuan, et al.
Pubblicazione: (2025)
Defense Against Synthetic Speech: Real-Time Detection of RVC Voice Conversion Attacks
di: Chinchmalatpure, Prajwal, et al.
Pubblicazione: (2025)
di: Chinchmalatpure, Prajwal, et al.
Pubblicazione: (2025)
Density Adaptive Attention-based Speech Network: Enhancing Feature Understanding for Mental Health Disorders
di: Ioannides, Georgios, et al.
Pubblicazione: (2024)
di: Ioannides, Georgios, et al.
Pubblicazione: (2024)
Zero-Shot Voice Conversion via Content-Aware Timbre Ensemble and Conditional Flow Matching
di: Pan, Yu, et al.
Pubblicazione: (2024)
di: Pan, Yu, et al.
Pubblicazione: (2024)
vec2wav 2.0: Advancing Voice Conversion via Discrete Token Vocoders
di: Guo, Yiwei, et al.
Pubblicazione: (2024)
di: Guo, Yiwei, et al.
Pubblicazione: (2024)
USM-VC: Mitigating Timbre Leakage with Universal Semantic Mapping Residual Block for Voice Conversion
di: Li, Na, et al.
Pubblicazione: (2025)
di: Li, Na, et al.
Pubblicazione: (2025)
MD-ViSCo: A Unified Model for Multi-Directional Vital Sign Waveform Conversion
di: Meyer, Franck, et al.
Pubblicazione: (2025)
di: Meyer, Franck, et al.
Pubblicazione: (2025)
Discl-VC: Disentangled Discrete Tokens and In-Context Learning for Controllable Zero-Shot Voice Conversion
di: Wang, Kaidi, et al.
Pubblicazione: (2025)
di: Wang, Kaidi, et al.
Pubblicazione: (2025)
EmoAttack: Utilizing Emotional Voice Conversion for Speech Backdoor Attacks on Deep Speech Classification Models
di: Yao, Wenhan, et al.
Pubblicazione: (2024)
di: Yao, Wenhan, et al.
Pubblicazione: (2024)
Improving Pronunciation and Accent Conversion through Knowledge Distillation And Synthetic Ground-Truth from Native TTS
di: Nguyen, Tuan Nam, et al.
Pubblicazione: (2024)
di: Nguyen, Tuan Nam, et al.
Pubblicazione: (2024)
JEN-1 DreamStyler: Customized Musical Concept Learning via Pivotal Parameters Tuning
di: Chen, Boyu, et al.
Pubblicazione: (2024)
di: Chen, Boyu, et al.
Pubblicazione: (2024)
Collective Learning Mechanism based Optimal Transport Generative Adversarial Network for Non-parallel Voice Conversion
di: Dhar, Sandipan, et al.
Pubblicazione: (2025)
di: Dhar, Sandipan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Fast-VGAN: Lightweight Voice Conversion with Explicit Control of F0 and Duration Parameters
di: Abrassart, Mathilde, et al.
Pubblicazione: (2025) -
Exploring Speech Pattern Disorders in Autism using Machine Learning
di: Hu, Chuanbo, et al.
Pubblicazione: (2024) -
Contrastive Learning with Spectrum Information Augmentation in Abnormal Sound Detection
di: Meng, Xinxin, et al.
Pubblicazione: (2025) -
Can We Trust Machine Learning? The Reliability of Features from Open-Source Speech Analysis Tools for Speech Modeling
di: Chowdhury, Tahiya, et al.
Pubblicazione: (2025) -
EnCLAP++: Analyzing the EnCLAP Framework for Optimizing Automated Audio Captioning Performance
di: Kim, Jaeyeon, et al.
Pubblicazione: (2024)