Cross-lingual Alzheimer's Disease detection based on paralinguistic and pre-trained features
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Xuchu, Pu, Yu, Li, Jinpeng, Zhang, Wei-Qiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Whisper's Recognition Performance for Under-Represented Language Kazakh Leveraging Unpaired Speech and Text
di: Li, Jinpeng, et al.
Pubblicazione: (2024)
di: Li, Jinpeng, et al.
Pubblicazione: (2024)
Integrating Pause Information with Word Embeddings in Language Models for Alzheimer's Disease Detection from Spontaneous Speech
di: Pu, Yu, et al.
Pubblicazione: (2025)
di: Pu, Yu, et al.
Pubblicazione: (2025)
Adapting Self-Supervised Speech Representations for Cross-lingual Dysarthria Detection in Parkinson's Disease
di: Hernandez, Abner, et al.
Pubblicazione: (2026)
di: Hernandez, Abner, et al.
Pubblicazione: (2026)
Transferring speech-generic and depression-specific knowledge for Alzheimer's disease detection
di: Cui, Ziyun, et al.
Pubblicazione: (2023)
di: Cui, Ziyun, et al.
Pubblicazione: (2023)
ParaCLAP -- Towards a general language-audio model for computational paralinguistic tasks
di: Jing, Xin, et al.
Pubblicazione: (2024)
di: Jing, Xin, et al.
Pubblicazione: (2024)
Cross-lingual Embedding Clustering for Hierarchical Softmax in Low-Resource Multilingual Speech Recognition
di: Yang, Zhengdong, et al.
Pubblicazione: (2025)
di: Yang, Zhengdong, et al.
Pubblicazione: (2025)
The THUEE System Description for the IARPA OpenASR21 Challenge
di: Zhao, Jing, et al.
Pubblicazione: (2022)
di: Zhao, Jing, et al.
Pubblicazione: (2022)
Zero-shot Cross-lingual Voice Transfer for TTS
di: Biadsy, Fadi, et al.
Pubblicazione: (2024)
di: Biadsy, Fadi, et al.
Pubblicazione: (2024)
Towards robust paralinguistic assessment for real-world mobile health (mHealth) monitoring: an initial study of reverberation effects on speech
di: Dineley, Judith, et al.
Pubblicazione: (2023)
di: Dineley, Judith, et al.
Pubblicazione: (2023)
Speech Recognition Transformers: Topological-lingualism Perspective
di: Singh, Shruti, et al.
Pubblicazione: (2024)
di: Singh, Shruti, et al.
Pubblicazione: (2024)
Transforming LLMs into Cross-modal and Cross-lingual Retrieval Systems
di: Gomez, Frank Palma, et al.
Pubblicazione: (2024)
di: Gomez, Frank Palma, et al.
Pubblicazione: (2024)
Cross-lingual Text-To-Speech with Flow-based Voice Conversion for Improved Pronunciation
di: Ellinas, Nikolaos, et al.
Pubblicazione: (2022)
di: Ellinas, Nikolaos, et al.
Pubblicazione: (2022)
Joint Multi-scale Cross-lingual Speaking Style Transfer with Bidirectional Attention Mechanism for Automatic Dubbing
di: Li, Jingbei, et al.
Pubblicazione: (2023)
di: Li, Jingbei, et al.
Pubblicazione: (2023)
A multi-speaker multi-lingual voice cloning system based on vits2 for limmits 2024 challenge
di: Wang, Xiaopeng, et al.
Pubblicazione: (2024)
di: Wang, Xiaopeng, et al.
Pubblicazione: (2024)
Strategies for improving low resource speech to text translation relying on pre-trained ASR models
di: Kesiraju, Santosh, et al.
Pubblicazione: (2023)
di: Kesiraju, Santosh, et al.
Pubblicazione: (2023)
GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement
di: Yang, Yifan, et al.
Pubblicazione: (2024)
di: Yang, Yifan, et al.
Pubblicazione: (2024)
HAFFormer: A Hierarchical Attention-Free Framework for Alzheimer's Disease Detection From Spontaneous Speech
di: Dong, Zhongren, et al.
Pubblicazione: (2024)
di: Dong, Zhongren, et al.
Pubblicazione: (2024)
Automated speech audiometry: Can it work using open-source pre-trained Kaldi-NL automatic speech recognition?
di: Araiza-Illan, Gloria, et al.
Pubblicazione: (2023)
di: Araiza-Illan, Gloria, et al.
Pubblicazione: (2023)
Establishing degrees of closeness between audio recordings along different dimensions using large-scale cross-lingual models
di: Fily, Maxime, et al.
Pubblicazione: (2024)
di: Fily, Maxime, et al.
Pubblicazione: (2024)
GenDistiller: Distilling Pre-trained Language Models based on an Autoregressive Generative Model
di: Gao, Yingying, et al.
Pubblicazione: (2024)
di: Gao, Yingying, et al.
Pubblicazione: (2024)
SEF-VC: Speaker Embedding Free Zero-Shot Voice Conversion with Cross Attention
di: Li, Junjie, et al.
Pubblicazione: (2023)
di: Li, Junjie, et al.
Pubblicazione: (2023)
Cross-Utterance Conditioned VAE for Speech Generation
di: Li, Yang, et al.
Pubblicazione: (2023)
di: Li, Yang, et al.
Pubblicazione: (2023)
Alzheimer Disease Classification through ASR-based Transcriptions: Exploring the Impact of Punctuation and Pauses
di: Gómez-Zaragozá, Lucía, et al.
Pubblicazione: (2023)
di: Gómez-Zaragozá, Lucía, et al.
Pubblicazione: (2023)
BLSP-KD: Bootstrapping Language-Speech Pre-training via Knowledge Distillation
di: Wang, Chen, et al.
Pubblicazione: (2024)
di: Wang, Chen, et al.
Pubblicazione: (2024)
Diffusion Gaussian Mixture Audio Denoise
di: Wang, Pu, et al.
Pubblicazione: (2024)
di: Wang, Pu, et al.
Pubblicazione: (2024)
DiaMoE-TTS: A Unified IPA-Based Dialect TTS Framework with Mixture-of-Experts and Parameter-Efficient Zero-Shot Adaptation
di: Chen, Ziqi, et al.
Pubblicazione: (2025)
di: Chen, Ziqi, et al.
Pubblicazione: (2025)
Improving noisy student training for low-resource languages in End-to-End ASR using CycleGAN and inter-domain losses
di: Li, Chia-Yu, et al.
Pubblicazione: (2024)
di: Li, Chia-Yu, et al.
Pubblicazione: (2024)
Simul-Whisper: Attention-Guided Streaming Whisper with Truncation Detection
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
Cross-Lingual Multi-Granularity Framework for Interpretable Parkinson's Disease Diagnosis from Speech
di: Tougui, Ilias, et al.
Pubblicazione: (2025)
di: Tougui, Ilias, et al.
Pubblicazione: (2025)
Low-Resourced Speech Recognition for Iu Mien Language via Weakly-Supervised Phoneme-based Multilingual Pre-training
di: Dong, Lukuan, et al.
Pubblicazione: (2024)
di: Dong, Lukuan, et al.
Pubblicazione: (2024)
Analysing the Masked predictive coding training criterion for pre-training a Speech Representation Model
di: Yadav, Hemant, et al.
Pubblicazione: (2023)
di: Yadav, Hemant, et al.
Pubblicazione: (2023)
Leveraging Cross-Attention Transformer and Multi-Feature Fusion for Cross-Linguistic Speech Emotion Recognition
di: Zhao, Ruoyu, et al.
Pubblicazione: (2025)
di: Zhao, Ruoyu, et al.
Pubblicazione: (2025)
BERT-LID: Leveraging BERT to Improve Spoken Language Identification
di: Nie, Yuting, et al.
Pubblicazione: (2022)
di: Nie, Yuting, et al.
Pubblicazione: (2022)
Multilingual Zero Resource Speech Recognition Base on Self-Supervise Pre-Trained Acoustic Models
di: Wang, Haoyu, et al.
Pubblicazione: (2022)
di: Wang, Haoyu, et al.
Pubblicazione: (2022)
Exploring Effective Distillation of Self-Supervised Speech Models for Automatic Speech Recognition
di: Wang, Yujin, et al.
Pubblicazione: (2022)
di: Wang, Yujin, et al.
Pubblicazione: (2022)
Generative Pre-trained Speech Language Model with Efficient Hierarchical Transformer
di: Zhu, Yongxin, et al.
Pubblicazione: (2024)
di: Zhu, Yongxin, et al.
Pubblicazione: (2024)
Fine-grained Speech Sentiment Analysis in Chinese Psychological Support Hotlines Based on Large-scale Pre-trained Model
di: Chen, Zhonglong, et al.
Pubblicazione: (2024)
di: Chen, Zhonglong, et al.
Pubblicazione: (2024)
BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation Writing
di: Wang, Chen, et al.
Pubblicazione: (2023)
di: Wang, Chen, et al.
Pubblicazione: (2023)
Revisiting speech segmentation and lexicon learning with better features
di: Kamper, Herman, et al.
Pubblicazione: (2024)
di: Kamper, Herman, et al.
Pubblicazione: (2024)
Conversational Speech Recognition by Learning Audio-textual Cross-modal Contextual Representation
di: Wei, Kun, et al.
Pubblicazione: (2023)
di: Wei, Kun, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Improving Whisper's Recognition Performance for Under-Represented Language Kazakh Leveraging Unpaired Speech and Text
di: Li, Jinpeng, et al.
Pubblicazione: (2024) -
Integrating Pause Information with Word Embeddings in Language Models for Alzheimer's Disease Detection from Spontaneous Speech
di: Pu, Yu, et al.
Pubblicazione: (2025) -
Adapting Self-Supervised Speech Representations for Cross-lingual Dysarthria Detection in Parkinson's Disease
di: Hernandez, Abner, et al.
Pubblicazione: (2026) -
Transferring speech-generic and depression-specific knowledge for Alzheimer's disease detection
di: Cui, Ziyun, et al.
Pubblicazione: (2023) -
ParaCLAP -- Towards a general language-audio model for computational paralinguistic tasks
di: Jing, Xin, et al.
Pubblicazione: (2024)