HAFFormer: A Hierarchical Attention-Free Framework for Alzheimer's Disease Detection From Spontaneous Speech
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dong, Zhongren, Zhang, Zixing, Xu, Weixiang, Han, Jing, Ou, Jianjun, Schuller, Björn W. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Re-Parameterization of Lightweight Transformer for On-Device Speech Emotion Recognition
par: Zhang, Zixing, et autres
Publié: (2024)
par: Zhang, Zixing, et autres
Publié: (2024)
Intelligent Cardiac Auscultation for Murmur Detection via Parallel-Attentive Models with Uncertainty Estimation
par: Zhang, Zixing, et autres
Publié: (2024)
par: Zhang, Zixing, et autres
Publié: (2024)
ParaLBench: A Large-Scale Benchmark for Computational Paralinguistics over Acoustic Foundation Models
par: Zhang, Zixing, et autres
Publié: (2024)
par: Zhang, Zixing, et autres
Publié: (2024)
ProsodyFM: Unsupervised Phrasing and Intonation Control for Intelligible Speech Synthesis
par: He, Xiangheng, et autres
Publié: (2024)
par: He, Xiangheng, et autres
Publié: (2024)
Quantifying Dimensional Independence in Speech: An Information-Theoretic Framework for Disentangled Representation Learning
par: Kashyap, Bipasha, et autres
Publié: (2026)
par: Kashyap, Bipasha, et autres
Publié: (2026)
Abusive Speech Detection in Indic Languages Using Acoustic Features
par: Spiesberger, Anika A., et autres
Publié: (2024)
par: Spiesberger, Anika A., et autres
Publié: (2024)
Enhancing Emotional Text-to-Speech Controllability with Natural Language Guidance through Contrastive Learning and Diffusion Models
par: Jing, Xin, et autres
Publié: (2024)
par: Jing, Xin, et autres
Publié: (2024)
From Audio Deepfake Detection to AI-Generated Music Detection -- A Pathway and Overview
par: Li, Yupei, et autres
Publié: (2024)
par: Li, Yupei, et autres
Publié: (2024)
Leveraging Multimodal Methods and Spontaneous Speech for Alzheimer's Disease Identification
par: Gao, Yifan, et autres
Publié: (2024)
par: Gao, Yifan, et autres
Publié: (2024)
Integrating Pause Information with Word Embeddings in Language Models for Alzheimer's Disease Detection from Spontaneous Speech
par: Pu, Yu, et autres
Publié: (2025)
par: Pu, Yu, et autres
Publié: (2025)
ParaCLAP -- Towards a general language-audio model for computational paralinguistic tasks
par: Jing, Xin, et autres
Publié: (2024)
par: Jing, Xin, et autres
Publié: (2024)
Can Large Language Models Aid in Annotating Speech Emotional Data? Uncovering New Frontiers
par: Latif, Siddique, et autres
Publié: (2023)
par: Latif, Siddique, et autres
Publié: (2023)
Emotion-Aware Contrastive Adaptation Network for Source-Free Cross-Corpus Speech Emotion Recognition
par: Zhao, Yan, et autres
Publié: (2024)
par: Zhao, Yan, et autres
Publié: (2024)
Testing Correctness, Fairness, and Robustness of Speech Emotion Recognition Models
par: Derington, Anna, et autres
Publié: (2023)
par: Derington, Anna, et autres
Publié: (2023)
Charting 15 years of progress in deep learning for speech emotion recognition: A replication study
par: Triantafyllopoulos, Andreas, et autres
Publié: (2025)
par: Triantafyllopoulos, Andreas, et autres
Publié: (2025)
Explainable Detection of Machine Generated Music and Early Systematic Evaluation
par: Li, Yupei, et autres
Publié: (2024)
par: Li, Yupei, et autres
Publié: (2024)
Leveraging Local and Global Knowledge Integration with Time-Frequency Calibrated Distillation for Speech Enhancement
par: Cheng, Jiaming, et autres
Publié: (2025)
par: Cheng, Jiaming, et autres
Publié: (2025)
S2ST-Omni: Hierarchical Language-Aware SpeechLLM Adaptation for Multilingual Speech-to-Speech Translation
par: Pan, Yu, et autres
Publié: (2025)
par: Pan, Yu, et autres
Publié: (2025)
Adaptive Speech Emotion Representation Learning Based On Dynamic Graph
par: Gao, Yingxue, et autres
Publié: (2024)
par: Gao, Yingxue, et autres
Publié: (2024)
AffectSpeech: A Large-Scale Emotional Speech Dataset with Fine-Grained Textual Descriptions for Speech Emotion Captioning and Synthesis
par: Qi, Tianhua, et autres
Publié: (2026)
par: Qi, Tianhua, et autres
Publié: (2026)
Domain Adapting Deep Reinforcement Learning for Real-world Speech Emotion Recognition
par: Rajapakshe, Thejan, et autres
Publié: (2022)
par: Rajapakshe, Thejan, et autres
Publié: (2022)
Cross-Dialect Bird Species Recognition with Dialect-Calibrated Augmentation
par: Ding, Jiani, et autres
Publié: (2025)
par: Ding, Jiani, et autres
Publié: (2025)
M6: Multi-generator, Multi-domain, Multi-lingual and cultural, Multi-genres, Multi-instrument Machine-Generated Music Detection Databases
par: Li, Yupei, et autres
Publié: (2024)
par: Li, Yupei, et autres
Publié: (2024)
Computer Audition: From Task-Specific Machine Learning to Foundation Models
par: Triantafyllopoulos, Andreas, et autres
Publié: (2024)
par: Triantafyllopoulos, Andreas, et autres
Publié: (2024)
Representation Learning with Parameterised Quantum Circuits for Advancing Speech Emotion Recognition
par: Rajapakshe, Thejan, et autres
Publié: (2025)
par: Rajapakshe, Thejan, et autres
Publié: (2025)
Audio-based Step-count Estimation for Running -- Windowing and Neural Network Baselines
par: Wagner, Philipp, et autres
Publié: (2024)
par: Wagner, Philipp, et autres
Publié: (2024)
Wav2Small: Distilling Wav2Vec2 to 72K parameters for Low-Resource Speech emotion recognition
par: Kounadis-Bastian, Dionyssos, et autres
Publié: (2024)
par: Kounadis-Bastian, Dionyssos, et autres
Publié: (2024)
Speech as a Biomarker for Disease Detection
par: Botelho, Catarina, et autres
Publié: (2024)
par: Botelho, Catarina, et autres
Publié: (2024)
Enhancing Speech Emotion Recognition Through Differentiable Architecture Search
par: Rajapakshe, Thejan, et autres
Publié: (2023)
par: Rajapakshe, Thejan, et autres
Publié: (2023)
STAA-Net: A Sparse and Transferable Adversarial Attack for Speech Emotion Recognition
par: Chang, Yi, et autres
Publié: (2024)
par: Chang, Yi, et autres
Publié: (2024)
From Continuous to Discrete: Cross-Domain Collaborative General Speech Enhancement via Hierarchical Language Models
par: Mu, Zhaoxi, et autres
Publié: (2025)
par: Mu, Zhaoxi, et autres
Publié: (2025)
Are you sure? Analysing Uncertainty Quantification Approaches for Real-world Speech Emotion Recognition
par: Schrüfer, Oliver, et autres
Publié: (2024)
par: Schrüfer, Oliver, et autres
Publié: (2024)
SmoothCLAP: Soft-Target Enhanced Contrastive Language\--Audio Pretraining for Affective Computing
par: Jing, Xin, et autres
Publié: (2026)
par: Jing, Xin, et autres
Publié: (2026)
An automatic analysis of ultrasound vocalisations for the prediction of interaction context in captive Egyptian fruit bats
par: Triantafyllopoulos, Andreas, et autres
Publié: (2024)
par: Triantafyllopoulos, Andreas, et autres
Publié: (2024)
Audio Explanation Synthesis with Generative Foundation Models
par: Akman, Alican, et autres
Publié: (2024)
par: Akman, Alican, et autres
Publié: (2024)
DOTA-ME-CS: Daily Oriented Text Audio-Mandarin English-Code Switching Dataset
par: Li, Yupei, et autres
Publié: (2025)
par: Li, Yupei, et autres
Publié: (2025)
Using voice analysis as an early indicator of risk for depression in young adults
par: Scherer, Klaus R., et autres
Publié: (2024)
par: Scherer, Klaus R., et autres
Publié: (2024)
emoDARTS: Joint Optimisation of CNN & Sequential Neural Network Architectures for Superior Speech Emotion Recognition
par: Rajapakshe, Thejan, et autres
Publié: (2024)
par: Rajapakshe, Thejan, et autres
Publié: (2024)
Hierarchical Decoding for Discrete Speech Synthesis with Multi-Resolution Spoof Detection
par: Zhao, Junchuan, et autres
Publié: (2026)
par: Zhao, Junchuan, et autres
Publié: (2026)
Towards Scalable AASIST: Refining Graph Attention for Speech Deepfake Detection
par: Viakhirev, Ivan, et autres
Publié: (2025)
par: Viakhirev, Ivan, et autres
Publié: (2025)
Documents similaires
-
Re-Parameterization of Lightweight Transformer for On-Device Speech Emotion Recognition
par: Zhang, Zixing, et autres
Publié: (2024) -
Intelligent Cardiac Auscultation for Murmur Detection via Parallel-Attentive Models with Uncertainty Estimation
par: Zhang, Zixing, et autres
Publié: (2024) -
ParaLBench: A Large-Scale Benchmark for Computational Paralinguistics over Acoustic Foundation Models
par: Zhang, Zixing, et autres
Publié: (2024) -
ProsodyFM: Unsupervised Phrasing and Intonation Control for Intelligible Speech Synthesis
par: He, Xiangheng, et autres
Publié: (2024) -
Quantifying Dimensional Independence in Speech: An Information-Theoretic Framework for Disentangled Representation Learning
par: Kashyap, Bipasha, et autres
Publié: (2026)