Self-Supervised Embeddings for Detecting Individual Symptoms of Depression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dumpala, Sri Harsha, Dikaios, Katerina, Nunes, Abraham, Rudzicz, Frank, Uher, Rudolf, Oore, Sageev |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Predicting Individual Depression Symptoms from Acoustic Features During Speech
par: Rodriguez, Sebastian, et autres
Publié: (2024)
par: Rodriguez, Sebastian, et autres
Publié: (2024)
Test-Time Training for Depression Detection
par: Dumpala, Sri Harsha, et autres
Publié: (2024)
par: Dumpala, Sri Harsha, et autres
Publié: (2024)
XANE: eXplainable Acoustic Neural Embeddings
par: Dumpala, Sri Harsha, et autres
Publié: (2024)
par: Dumpala, Sri Harsha, et autres
Publié: (2024)
Symbolic Music Generation with Non-Differentiable Rule Guided Diffusion
par: Huang, Yujia, et autres
Publié: (2024)
par: Huang, Yujia, et autres
Publié: (2024)
Phoneme-Level Deepfake Detection Across Emotional Conditions Using Self-Supervised Embeddings
par: Nallaguntla, Vamshi, et autres
Publié: (2026)
par: Nallaguntla, Vamshi, et autres
Publié: (2026)
Toward Fully Self-Supervised Multi-Pitch Estimation
par: Cwitkowitz, Frank, et autres
Publié: (2024)
par: Cwitkowitz, Frank, et autres
Publié: (2024)
Investigating an Overfitting and Degeneration Phenomenon in Self-Supervised Multi-Pitch Estimation
par: Cwitkowitz, Frank, et autres
Publié: (2025)
par: Cwitkowitz, Frank, et autres
Publié: (2025)
Temporal Pooling Strategies for Training-Free Anomalous Sound Detection with Self-Supervised Audio Embeddings
par: Wilkinghoff, Kevin, et autres
Publié: (2026)
par: Wilkinghoff, Kevin, et autres
Publié: (2026)
Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
Speaker Embeddings With Weakly Supervised Voice Activity Detection For Efficient Speaker Diarization
par: Thienpondt, Jenthe, et autres
Publié: (2024)
par: Thienpondt, Jenthe, et autres
Publié: (2024)
Exploring Self-Supervised Audio Models for Generalized Anomalous Sound Detection
par: Han, Bing, et autres
Publié: (2025)
par: Han, Bing, et autres
Publié: (2025)
SeMaScore : a new evaluation metric for automatic speech recognition tasks
par: Sasindran, Zitha, et autres
Publié: (2024)
par: Sasindran, Zitha, et autres
Publié: (2024)
Xi+: Uncertainty Supervision for Robust Speaker Embedding
par: Li, Junjie, et autres
Publié: (2025)
par: Li, Junjie, et autres
Publié: (2025)
Towards Supervised Performance on Speaker Verification with Self-Supervised Learning by Leveraging Large-Scale ASR Models
par: Miara, Victor, et autres
Publié: (2024)
par: Miara, Victor, et autres
Publié: (2024)
SynthScribe: Deep Multimodal Tools for Synthesizer Sound Retrieval and Exploration
par: Brade, Stephen, et autres
Publié: (2023)
par: Brade, Stephen, et autres
Publié: (2023)
Improving the Adversarial Robustness for Speaker Verification by Self-Supervised Learning
par: Wu, Haibin, et autres
Publié: (2021)
par: Wu, Haibin, et autres
Publié: (2021)
Self-Supervised Learning for Speaker Recognition: A study and review
par: Lepage, Theo, et autres
Publié: (2026)
par: Lepage, Theo, et autres
Publié: (2026)
Singer Identity Representation Learning using Self-Supervised Techniques
par: Torres, Bernardo, et autres
Publié: (2024)
par: Torres, Bernardo, et autres
Publié: (2024)
Self-Supervised Learning for Few-Shot Bird Sound Classification
par: Moummad, Ilyass, et autres
Publié: (2023)
par: Moummad, Ilyass, et autres
Publié: (2023)
On the Transferability of Large-Scale Self-Supervision to Few-Shot Audio Classification
par: Heggan, Calum, et autres
Publié: (2024)
par: Heggan, Calum, et autres
Publié: (2024)
Self-Supervised Frameworks for Speaker Verification via Bootstrapped Positive Sampling
par: Lepage, Theo, et autres
Publié: (2025)
par: Lepage, Theo, et autres
Publié: (2025)
The Effect of Batch Size on Contrastive Self-Supervised Speech Representation Learning
par: Vaessen, Nik, et autres
Publié: (2024)
par: Vaessen, Nik, et autres
Publié: (2024)
Recurrence-Based Nonlinear Vocal Dynamics as Digital Biomarkers for Depression Detection from Conversational Speech
par: Samanta, Himadri S
Publié: (2026)
par: Samanta, Himadri S
Publié: (2026)
Bird Vocalization Embedding Extraction Using Self-Supervised Disentangled Representation Learning
par: Shi, Runwu, et autres
Publié: (2024)
par: Shi, Runwu, et autres
Publié: (2024)
Label-Efficient Self-Supervised Speaker Verification With Information Maximization and Contrastive Learning
par: Lepage, Théo, et autres
Publié: (2022)
par: Lepage, Théo, et autres
Publié: (2022)
MT-SLVR: Multi-Task Self-Supervised Learning for Transformation In(Variant) Representations
par: Heggan, Calum, et autres
Publié: (2023)
par: Heggan, Calum, et autres
Publié: (2023)
Understanding Self-Supervised Learning of Speech Representation via Invariance and Redundancy Reduction
par: Brima, Yusuf, et autres
Publié: (2023)
par: Brima, Yusuf, et autres
Publié: (2023)
Additive Margin in Contrastive Self-Supervised Frameworks to Learn Discriminative Speaker Representations
par: Lepage, Theo, et autres
Publié: (2024)
par: Lepage, Theo, et autres
Publié: (2024)
JiTTER: Jigsaw Temporal Transformer for Event Reconstruction for Self-Supervised Sound Event Detection
par: Nam, Hyeonuk, et autres
Publié: (2025)
par: Nam, Hyeonuk, et autres
Publié: (2025)
Singing Voice Conversion with Accompaniment Using Self-Supervised Representation-Based Melody Features
par: Chen, Wei, et autres
Publié: (2025)
par: Chen, Wei, et autres
Publié: (2025)
Enhancing Audio-Language Models through Self-Supervised Post-Training with Text-Audio Pairs
par: Sinha, Anshuman, et autres
Publié: (2024)
par: Sinha, Anshuman, et autres
Publié: (2024)
Leveraging Self-Supervised Learning for Speaker Diarization
par: Han, Jiangyu, et autres
Publié: (2024)
par: Han, Jiangyu, et autres
Publié: (2024)
End-to-End Integration of Speech Emotion Recognition with Voice Activity Detection using Self-Supervised Learning Features
par: Yamashita, Natsuo, et autres
Publié: (2024)
par: Yamashita, Natsuo, et autres
Publié: (2024)
Low-Resource Cross-Domain Singing Voice Synthesis via Reduced Self-Supervised Speech Representations
par: Kakoulidis, Panos, et autres
Publié: (2024)
par: Kakoulidis, Panos, et autres
Publié: (2024)
ComFeAT: Combination of Neural and Spectral Features for Improved Depression Detection
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
BabyHuBERT: Multilingual Self-Supervised Learning for Segmenting Speakers in Child-Centered Long-Form Recordings
par: Charlot, Théo, et autres
Publié: (2025)
par: Charlot, Théo, et autres
Publié: (2025)
Windowed SummaryMixing: An Efficient Fine-Tuning of Self-Supervised Learning Models for Low-resource Speech Recognition
par: Menon, Aditya Srinivas, et autres
Publié: (2026)
par: Menon, Aditya Srinivas, et autres
Publié: (2026)
Losses Can Be Blessings: Routing Self-Supervised Speech Representations Towards Efficient Multilingual and Multitask Speech Processing
par: Fu, Yonggan, et autres
Publié: (2022)
par: Fu, Yonggan, et autres
Publié: (2022)
Soft Clustering Anchors for Self-Supervised Speech Representation Learning in Joint Embedding Prediction Architectures
par: Ioannides, Georgios, et autres
Publié: (2026)
par: Ioannides, Georgios, et autres
Publié: (2026)
w2v-SELD: A Sound Event Localization and Detection Framework for Self-Supervised Spatial Audio Pre-Training
par: Santos, Orlem Lima dos, et autres
Publié: (2023)
par: Santos, Orlem Lima dos, et autres
Publié: (2023)
Documents similaires
-
Predicting Individual Depression Symptoms from Acoustic Features During Speech
par: Rodriguez, Sebastian, et autres
Publié: (2024) -
Test-Time Training for Depression Detection
par: Dumpala, Sri Harsha, et autres
Publié: (2024) -
XANE: eXplainable Acoustic Neural Embeddings
par: Dumpala, Sri Harsha, et autres
Publié: (2024) -
Symbolic Music Generation with Non-Differentiable Rule Guided Diffusion
par: Huang, Yujia, et autres
Publié: (2024) -
Phoneme-Level Deepfake Detection Across Emotional Conditions Using Self-Supervised Embeddings
par: Nallaguntla, Vamshi, et autres
Publié: (2026)