Investigating Acoustic-Textual Emotional Inconsistency Information for Automatic Depression Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Su, Rongfeng, Xu, Changqing, Wu, Xinyi, Xu, Feng, Chen, Xie, Wangt, Lan, Yan, Nan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
An Audio-textual Diffusion Model For Converting Speech Signals Into Ultrasound Tongue Imaging Data
par: Yang, Yudong, et autres
Publié: (2024)
par: Yang, Yudong, et autres
Publié: (2024)
An End-To-End Stuttering Detection Method Based On Conformer And BILSTM
par: Liu, Xiaokang, et autres
Publié: (2024)
par: Liu, Xiaokang, et autres
Publié: (2024)
Magnitude and Phase-based Feature Fusion Using Co-attention Mechanism for Speaker recognition
par: Su, Rongfeng, et autres
Publié: (2025)
par: Su, Rongfeng, et autres
Publié: (2025)
Automatic Assessment of Dysarthria Using Audio-visual Vowel Graph Attention Network
par: Liu, Xiaokang, et autres
Publié: (2024)
par: Liu, Xiaokang, et autres
Publié: (2024)
Investigating the Impact of Word Informativeness on Speech Emotion Recognition
par: Kakouros, Sofoklis
Publié: (2025)
par: Kakouros, Sofoklis
Publié: (2025)
Pretraining End-to-End Keyword Search with Automatically Discovered Acoustic Units
par: Yusuf, Bolaji, et autres
Publié: (2024)
par: Yusuf, Bolaji, et autres
Publié: (2024)
LinTO Audio and Textual Datasets to Train and Evaluate Automatic Speech Recognition in Tunisian Arabic Dialect
par: Naouara, Hedi, et autres
Publié: (2025)
par: Naouara, Hedi, et autres
Publié: (2025)
Segmental Attention Decoding With Long Form Acoustic Encodings
par: Swietojanski, Pawel, et autres
Publié: (2025)
par: Swietojanski, Pawel, et autres
Publié: (2025)
Exploring Procedural Data Generation for Automatic Acoustic Guitar Fingerpicking Transcription
par: Murgul, Sebastian, et autres
Publié: (2025)
par: Murgul, Sebastian, et autres
Publié: (2025)
PersonaTAB: Predicting Personality Traits using Textual, Acoustic, and Behavioral Cues in Fully-Duplex Speech Dialogs
par: Inoue, Sho, et autres
Publié: (2025)
par: Inoue, Sho, et autres
Publié: (2025)
Disentangling Textual and Acoustic Features of Neural Speech Representations
par: Mohebbi, Hosein, et autres
Publié: (2024)
par: Mohebbi, Hosein, et autres
Publié: (2024)
Automatic Detection of Depression in Speech Using Ensemble Convolutional Neural Networks
par: Vázquez-Romero, Adrián, et autres
Publié: (2024)
par: Vázquez-Romero, Adrián, et autres
Publié: (2024)
Error Correction by Paying Attention to Both Acoustic and Confidence References for Automatic Speech Recognition
par: Shu, Yuchun, et autres
Publié: (2024)
par: Shu, Yuchun, et autres
Publié: (2024)
Investigation of Deep Neural Network Acoustic Modelling Approaches for Low Resource Accented Mandarin Speech Recognition
par: Xie, Xurong, et autres
Publié: (2022)
par: Xie, Xurong, et autres
Publié: (2022)
STACodec: Semantic Token Assignment for Balancing Acoustic Fidelity and Semantic Information in Audio Codecs
par: Zhang, Kaiyuan, et autres
Publié: (2026)
par: Zhang, Kaiyuan, et autres
Publié: (2026)
Layer-Wise Analysis of Self-Supervised Acoustic Word Embeddings: A Study on Speech Emotion Recognition
par: Saliba, Alexandra, et autres
Publié: (2024)
par: Saliba, Alexandra, et autres
Publié: (2024)
StoryTTS: A Highly Expressive Text-to-Speech Dataset with Rich Textual Expressiveness Annotations
par: Liu, Sen, et autres
Publié: (2024)
par: Liu, Sen, et autres
Publié: (2024)
ProMode: A Speech Prosody Model Conditioned on Acoustic and Textual Inputs
par: Eren, Eray, et autres
Publié: (2025)
par: Eren, Eray, et autres
Publié: (2025)
Automatic Text Pronunciation Correlation Generation and Application for Contextual Biasing
par: Cheng, Gaofeng, et autres
Publié: (2025)
par: Cheng, Gaofeng, et autres
Publié: (2025)
This Paper Had the Smartest Reviewers -- Flattery Detection Utilising an Audio-Textual Transformer-Based Approach
par: Christ, Lukas, et autres
Publié: (2024)
par: Christ, Lukas, et autres
Publié: (2024)
Acoustic and Semantic Modeling of Emotion in Spoken Language
par: Dutta, Soumya
Publié: (2026)
par: Dutta, Soumya
Publié: (2026)
RE-LLM: Refining Empathetic Speech-LLM Responses by Integrating Emotion Nuance
par: Chen, Jing-Han, et autres
Publié: (2026)
par: Chen, Jing-Han, et autres
Publié: (2026)
Re-Parameterization of Lightweight Transformer for On-Device Speech Emotion Recognition
par: Zhang, Zixing, et autres
Publié: (2024)
par: Zhang, Zixing, et autres
Publié: (2024)
MAD Speech: Measures of Acoustic Diversity of Speech
par: Futeral, Matthieu, et autres
Publié: (2024)
par: Futeral, Matthieu, et autres
Publié: (2024)
Emotion-Anchored Contrastive Learning Framework for Emotion Recognition in Conversation
par: Yu, Fangxu, et autres
Publié: (2024)
par: Yu, Fangxu, et autres
Publié: (2024)
A Multi-Probe Audit of Clinical-Interview Depression Detection Benchmarks
par: Ishikawa, Takehiro, et autres
Publié: (2026)
par: Ishikawa, Takehiro, et autres
Publié: (2026)
Evaluating Emotion Recognition in Spoken Language Models on Emotionally Incongruent Speech
par: Corrêa, Pedro, et autres
Publié: (2025)
par: Corrêa, Pedro, et autres
Publié: (2025)
Solla: Towards a Speech-Oriented LLM That Hears Acoustic Context
par: Ao, Junyi, et autres
Publié: (2025)
par: Ao, Junyi, et autres
Publié: (2025)
Pseudo2Real: Task Arithmetic for Pseudo-Label Correction in Automatic Speech Recognition
par: Lin, Yi-Cheng, et autres
Publié: (2025)
par: Lin, Yi-Cheng, et autres
Publié: (2025)
Vesper: A Compact and Effective Pretrained Model for Speech Emotion Recognition
par: Chen, Weidong, et autres
Publié: (2023)
par: Chen, Weidong, et autres
Publié: (2023)
Leveraging Content and Acoustic Representations for Speech Emotion Recognition
par: Dutta, Soumya, et autres
Publié: (2024)
par: Dutta, Soumya, et autres
Publié: (2024)
TouchASP: Elastic Automatic Speech Perception that Everyone Can Touch
par: Song, Xingchen, et autres
Publié: (2024)
par: Song, Xingchen, et autres
Publié: (2024)
A Preliminary Analysis of Automatic Word and Syllable Prominence Detection in Non-Native Speech With Text-to-Speech Prosody Embeddings
par: Mondal, Anindita, et autres
Publié: (2024)
par: Mondal, Anindita, et autres
Publié: (2024)
Multimodal Magic Elevating Depression Detection with a Fusion of Text and Audio Intelligence
par: Gan, Lindy, et autres
Publié: (2025)
par: Gan, Lindy, et autres
Publié: (2025)
Pitch Accent Detection improves Pretrained Automatic Speech Recognition
par: Sasu, David, et autres
Publié: (2025)
par: Sasu, David, et autres
Publié: (2025)
PAC: Pronunciation-Aware Contextualized Large Language Model-based Automatic Speech Recognition
par: Fu, Li, et autres
Publié: (2025)
par: Fu, Li, et autres
Publié: (2025)
Optimizing Speech-Input Length for Speaker-Independent Depression Classification
par: Rutowski, Tomasz, et autres
Publié: (2024)
par: Rutowski, Tomasz, et autres
Publié: (2024)
Robust Speech and Natural Language Processing Models for Depression Screening
par: Lu, Y., et autres
Publié: (2024)
par: Lu, Y., et autres
Publié: (2024)
Dual Information Speech Language Models for Emotional Conversations
par: Wang, Chun, et autres
Publié: (2025)
par: Wang, Chun, et autres
Publié: (2025)
Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation
par: Lin, Zhennan, et autres
Publié: (2025)
par: Lin, Zhennan, et autres
Publié: (2025)
Documents similaires
-
An Audio-textual Diffusion Model For Converting Speech Signals Into Ultrasound Tongue Imaging Data
par: Yang, Yudong, et autres
Publié: (2024) -
An End-To-End Stuttering Detection Method Based On Conformer And BILSTM
par: Liu, Xiaokang, et autres
Publié: (2024) -
Magnitude and Phase-based Feature Fusion Using Co-attention Mechanism for Speaker recognition
par: Su, Rongfeng, et autres
Publié: (2025) -
Automatic Assessment of Dysarthria Using Audio-visual Vowel Graph Attention Network
par: Liu, Xiaokang, et autres
Publié: (2024) -
Investigating the Impact of Word Informativeness on Speech Emotion Recognition
par: Kakouros, Sofoklis
Publié: (2025)