Voice Biomarkers for Depression and Anxiety
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Abramenko, Oleksii, Stein, Noah D., Vaz, Colin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AI-Driven Acoustic Voice Biomarker-Based Hierarchical Classification of Benign Laryngeal Voice Disorders from Sustained Vowels
par: Annabestani, Mohsen, et autres
Publié: (2025)
par: Annabestani, Mohsen, et autres
Publié: (2025)
DAFMSVC: One-Shot Singing Voice Conversion with Dual Attention Mechanism and Flow Matching
par: Chen, Wei, et autres
Publié: (2025)
par: Chen, Wei, et autres
Publié: (2025)
MeanVoiceFlow: One-step Nonparallel Voice Conversion with Mean Flows
par: Kaneko, Takuhiro, et autres
Publié: (2026)
par: Kaneko, Takuhiro, et autres
Publié: (2026)
Voice "Cloning" is Style Transfer
par: Zhou, Kaitlyn, et autres
Publié: (2026)
par: Zhou, Kaitlyn, et autres
Publié: (2026)
FastVoiceGrad: One-step Diffusion-Based Voice Conversion with Adversarial Conditional Diffusion Distillation
par: Kaneko, Takuhiro, et autres
Publié: (2024)
par: Kaneko, Takuhiro, et autres
Publié: (2024)
EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents
par: Bogavelli, Tara, et autres
Publié: (2026)
par: Bogavelli, Tara, et autres
Publié: (2026)
SafeSpeech: Robust and Universal Voice Protection Against Malicious Speech Synthesis
par: Zhang, Zhisheng, et autres
Publié: (2025)
par: Zhang, Zhisheng, et autres
Publié: (2025)
FasterVoiceGrad: Faster One-step Diffusion-Based Voice Conversion with Adversarial Diffusion Conversion Distillation
par: Kaneko, Takuhiro, et autres
Publié: (2025)
par: Kaneko, Takuhiro, et autres
Publié: (2025)
Mitigating Unauthorized Speech Synthesis for Voice Protection
par: Zhang, Zhisheng, et autres
Publié: (2024)
par: Zhang, Zhisheng, et autres
Publié: (2024)
Unsupervised Rhythm and Voice Conversion to Improve ASR on Dysarthric Speech
par: Hajal, Karl El, et autres
Publié: (2025)
par: Hajal, Karl El, et autres
Publié: (2025)
Unsupervised Rhythm and Voice Conversion of Dysarthric to Healthy Speech for ASR
par: Hajal, Karl El, et autres
Publié: (2025)
par: Hajal, Karl El, et autres
Publié: (2025)
HyWA: Hypernetwork Weight Adapting Personalized Voice Activity Detection
par: Nejad, Mahsa Ghazvini, et autres
Publié: (2025)
par: Nejad, Mahsa Ghazvini, et autres
Publié: (2025)
CoMoSVC: Consistency Model-based Singing Voice Conversion
par: Lu, Yiwen, et autres
Publié: (2024)
par: Lu, Yiwen, et autres
Publié: (2024)
Prompt-Singer: Controllable Singing-Voice-Synthesis with Natural Language Prompt
par: Wang, Yongqi, et autres
Publié: (2024)
par: Wang, Yongqi, et autres
Publié: (2024)
Predicting Individual Depression Symptoms from Acoustic Features During Speech
par: Rodriguez, Sebastian, et autres
Publié: (2024)
par: Rodriguez, Sebastian, et autres
Publié: (2024)
CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models
par: Du, Zhihao, et autres
Publié: (2024)
par: Du, Zhihao, et autres
Publié: (2024)
Facing the Music: Tackling Singing Voice Separation in Cinematic Audio Source Separation
par: Watcharasupat, Karn N., et autres
Publié: (2024)
par: Watcharasupat, Karn N., et autres
Publié: (2024)
Reproducible Machine Learning-based Voice Pathology Detection: Introducing the Pitch Difference Feature
par: Vrba, Jan, et autres
Publié: (2024)
par: Vrba, Jan, et autres
Publié: (2024)
AnyEnhance: A Unified Generative Model with Prompt-Guidance and Self-Critic for Voice Enhancement
par: Zhang, Junan, et autres
Publié: (2025)
par: Zhang, Junan, et autres
Publié: (2025)
What Counts as Real? Speech Restoration and Voice Quality Conversion Pose New Challenges to Deepfake Detection
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2026)
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2026)
Beyond Fixed Frames: Dynamic Character-Aligned Speech Tokenization
par: Della Libera, Luca, et autres
Publié: (2026)
par: Della Libera, Luca, et autres
Publié: (2026)
DFKI-Speech System for WildSpoof Challenge: A robust framework for SASV In-the-Wild
par: Das, Arnab, et autres
Publié: (2026)
par: Das, Arnab, et autres
Publié: (2026)
A Human-Inspired Decoupled Architecture for Efficient Audio Representation Learning
par: Kawano, Harunori, et autres
Publié: (2026)
par: Kawano, Harunori, et autres
Publié: (2026)
AsymTalker: Identity-Consistent Long-Term Talking Head Generation via Asymmetric Distillation
par: Lu, Yuxin, et autres
Publié: (2026)
par: Lu, Yuxin, et autres
Publié: (2026)
Low-Resource Guidance for Controllable Latent Audio Diffusion
par: Novack, Zachary, et autres
Publié: (2026)
par: Novack, Zachary, et autres
Publié: (2026)
Exploring Token-Space Manipulation in Latent Audio Tokenizers
par: Paissan, Francesco, et autres
Publié: (2026)
par: Paissan, Francesco, et autres
Publié: (2026)
DAStatFormer: A Hybrid Multibranch Transformer with Statistical Feature Integration for DAS-Based Pattern Recognitions
par: Dione, Michel, et autres
Publié: (2026)
par: Dione, Michel, et autres
Publié: (2026)
Woosh: A Sound Effects Foundation Model
par: Hadjeres, Gaëtan, et autres
Publié: (2026)
par: Hadjeres, Gaëtan, et autres
Publié: (2026)
Real-Time Voicemail Detection in Telephony Audio Using Temporal Speech Activity Features
par: Saurav, Kumar
Publié: (2026)
par: Saurav, Kumar
Publié: (2026)
Depth-Structured Music Recurrence: Budgeted Recurrent Attention for Full-Piece Symbolic Music Modeling
par: Yi, Yungang, et autres
Publié: (2026)
par: Yi, Yungang, et autres
Publié: (2026)
Boosting ASR Robustness via Test-Time Reinforcement Learning with Audio-Text Semantic Rewards
par: Fang, Linghan, et autres
Publié: (2026)
par: Fang, Linghan, et autres
Publié: (2026)
Causal Prosody Mediation for Text-to-Speech:Counterfactual Training of Duration, Pitch, and Energy in FastSpeech2
par: Mohanty, Suvendu Sekhar
Publié: (2026)
par: Mohanty, Suvendu Sekhar
Publié: (2026)
ConceptCaps: a Distilled Concept Dataset for Interpretability in Music Models
par: Sienkiewicz, Bruno, et autres
Publié: (2026)
par: Sienkiewicz, Bruno, et autres
Publié: (2026)
A$^2$-LLM: An End-to-end Conversational Audio Avatar Large Language Model
par: Hu, Xiaolin, et autres
Publié: (2026)
par: Hu, Xiaolin, et autres
Publié: (2026)
Logit Distillation on Manifolds: Mapping by Learning
par: Yang, Yiru, et autres
Publié: (2026)
par: Yang, Yiru, et autres
Publié: (2026)
When Denoising Hinders: Revisiting Zero-Shot ASR with SAM-Audio and Whisper
par: Islam, Akif, et autres
Publié: (2026)
par: Islam, Akif, et autres
Publié: (2026)
AudioMosaic: Contrastive Masked Audio Representation Learning
par: Huang, Hanxun, et autres
Publié: (2026)
par: Huang, Hanxun, et autres
Publié: (2026)
Split and Conquer Partial Deepfake Speech
par: Rimon, Inbal, et autres
Publié: (2026)
par: Rimon, Inbal, et autres
Publié: (2026)
Fusing Memory and Attention: A study on LSTM, Transformer and Hybrid Architectures for Symbolic Music Generation
par: Ghoshal, Soudeep, et autres
Publié: (2026)
par: Ghoshal, Soudeep, et autres
Publié: (2026)
Beyond saliency: enhancing explanation of speech emotion recognition with expert-referenced acoustic cues
par: Nasr, Seham, et autres
Publié: (2025)
par: Nasr, Seham, et autres
Publié: (2025)
Documents similaires
-
AI-Driven Acoustic Voice Biomarker-Based Hierarchical Classification of Benign Laryngeal Voice Disorders from Sustained Vowels
par: Annabestani, Mohsen, et autres
Publié: (2025) -
DAFMSVC: One-Shot Singing Voice Conversion with Dual Attention Mechanism and Flow Matching
par: Chen, Wei, et autres
Publié: (2025) -
MeanVoiceFlow: One-step Nonparallel Voice Conversion with Mean Flows
par: Kaneko, Takuhiro, et autres
Publié: (2026) -
Voice "Cloning" is Style Transfer
par: Zhou, Kaitlyn, et autres
Publié: (2026) -
FastVoiceGrad: One-step Diffusion-Based Voice Conversion with Adversarial Conditional Diffusion Distillation
par: Kaneko, Takuhiro, et autres
Publié: (2024)