DECAF: Dynamic Envelope Context-Aware Fusion for Speech-Envelope Reconstruction from EEG
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Thakkar, Karan, Elhilali, Mounya |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Subject Disentanglement Neural Network for Speech Envelope Reconstruction from EEG
par: Zhang, Li, et autres
Publié: (2025)
par: Zhang, Li, et autres
Publié: (2025)
SoloAudio: Target Sound Extraction with Language-oriented Audio Diffusion Transformer
par: Wang, Helin, et autres
Publié: (2024)
par: Wang, Helin, et autres
Publié: (2024)
Learning Perceptually Relevant Temporal Envelope Morphing
par: Dixit, Satvik, et autres
Publié: (2025)
par: Dixit, Satvik, et autres
Publié: (2025)
SynSonic: Augmenting Sound Event Detection through Text-to-Audio Diffusion ControlNet and Effective Sample Filtering
par: Hai, Jiarui, et autres
Publié: (2025)
par: Hai, Jiarui, et autres
Publié: (2025)
Frequency-Specific Neural Response and Cross-Correlation Analysis of Envelope Following Responses to Native Speech and Music Using Multichannel EEG Signals: A Case Study
par: Hasan, Md. Mahbub, et autres
Publié: (2025)
par: Hasan, Md. Mahbub, et autres
Publié: (2025)
Perceptual Noise-Masking with Music through Deep Spectral Envelope Shaping
par: Berger, Clémentine, et autres
Publié: (2025)
par: Berger, Clémentine, et autres
Publié: (2025)
Cross-Referencing Self-Training Network for Sound Event Detection in Audio Mixtures
par: Park, Sangwook, et autres
Publié: (2021)
par: Park, Sangwook, et autres
Publié: (2021)
FlexSED: Towards Open-Vocabulary Sound Event Detection
par: Hai, Jiarui, et autres
Publié: (2025)
par: Hai, Jiarui, et autres
Publié: (2025)
SSM2Mel: State Space Model to Reconstruct Mel Spectrogram from the EEG
par: Fan, Cunhang, et autres
Publié: (2025)
par: Fan, Cunhang, et autres
Publié: (2025)
Toward Fully-End-to-End Listened Speech Decoding from EEG Signals
par: Lee, Jihwan, et autres
Publié: (2024)
par: Lee, Jihwan, et autres
Publié: (2024)
Unsupervised EEG-based decoding of absolute auditory attention with canonical correlation analysis
par: Heintz, Nicolas, et autres
Publié: (2025)
par: Heintz, Nicolas, et autres
Publié: (2025)
Brain-to-Speech: Prosody Feature Engineering and Transformer-Based Reconstruction
par: Al-Radhi, Mohammed Salah, et autres
Publié: (2026)
par: Al-Radhi, Mohammed Salah, et autres
Publié: (2026)
EEG-to-Voice Decoding of Spoken and Imagined speech Using Non-Invasive EEG
par: Park, Hanbeot, et autres
Publié: (2025)
par: Park, Hanbeot, et autres
Publié: (2025)
A Data-Centric Approach to Generalizable Speech Deepfake Detection
par: Huang, Wen, et autres
Publié: (2025)
par: Huang, Wen, et autres
Publié: (2025)
Audio-Visual Speech Enhancement: Architectural Design and Deployment Strategies
par: Hamadouche, Anis, et autres
Publié: (2025)
par: Hamadouche, Anis, et autres
Publié: (2025)
FullSubNet: A Full-Band and Sub-Band Fusion Model for Real-Time Single-Channel Speech Enhancement
par: Hao, Xiang, et autres
Publié: (2020)
par: Hao, Xiang, et autres
Publié: (2020)
A Multi-decoder Neural Tracking Method for Accurately Predicting Speech Intelligibility
par: Sonck, Rien, et autres
Publié: (2026)
par: Sonck, Rien, et autres
Publié: (2026)
ASVspoof 5: Evaluation of Spoofing, Deepfake, and Adversarial Attack Detection Using Crowdsourced Speech
par: Wang, Xin, et autres
Publié: (2026)
par: Wang, Xin, et autres
Publié: (2026)
EEG-Based Speech Decoding: A Novel Approach Using Multi-Kernel Ensemble Diffusion Models
par: Kim, Soowon, et autres
Publié: (2024)
par: Kim, Soowon, et autres
Publié: (2024)
Perception of dynamic multi-speaker auditory scenes under different modes of attention
par: Graceffo, Stephanie, et autres
Publié: (2025)
par: Graceffo, Stephanie, et autres
Publié: (2025)
An Attention-Assisted Multi-Modal Data Fusion Model for Real-Time Estimation of Underwater Sound Velocity
par: Wu, Pengfei, et autres
Publié: (2025)
par: Wu, Pengfei, et autres
Publié: (2025)
Using Ear-EEG to Decode Auditory Attention in Multiple-speaker Environment
par: Zhu, Haolin, et autres
Publié: (2024)
par: Zhu, Haolin, et autres
Publié: (2024)
AffectSpeech: A Large-Scale Emotional Speech Dataset with Fine-Grained Textual Descriptions for Speech Emotion Captioning and Synthesis
par: Qi, Tianhua, et autres
Publié: (2026)
par: Qi, Tianhua, et autres
Publié: (2026)
EzAudio: Enhancing Text-to-Audio Generation with Efficient Diffusion Transformer
par: Hai, Jiarui, et autres
Publié: (2024)
par: Hai, Jiarui, et autres
Publié: (2024)
Semantic Communications for Speech Recognition
par: Weng, Zhenzi, et autres
Publié: (2021)
par: Weng, Zhenzi, et autres
Publié: (2021)
Bridging the Gap: Integrating Pre-trained Speech Enhancement and Recognition Models for Robust Speech Recognition
par: Wang, Kuan-Chen, et autres
Publié: (2024)
par: Wang, Kuan-Chen, et autres
Publié: (2024)
Lessons Learned from the URGENT 2024 Speech Enhancement Challenge
par: Zhang, Wangyou, et autres
Publié: (2025)
par: Zhang, Wangyou, et autres
Publié: (2025)
Self-supervised speech representation and contextual text embedding for match-mismatch classification with EEG recording
par: Wang, Bo, et autres
Publié: (2024)
par: Wang, Bo, et autres
Publié: (2024)
An LLM-Enabled Frequency-Aware Flow Diffusion Model for Natural-Language-Guided Power System Scenario Generation
par: Zhou, Zhenghao, et autres
Publié: (2026)
par: Zhou, Zhenghao, et autres
Publié: (2026)
Neural Tracking of Sustained Attention, Attention Switching, and Natural Conversation in Audiovisual Environments using Mobile EEG
par: Wilroth, Johanna, et autres
Publié: (2026)
par: Wilroth, Johanna, et autres
Publié: (2026)
DreamVoice: Text-Guided Voice Conversion
par: Hai, Jiarui, et autres
Publié: (2024)
par: Hai, Jiarui, et autres
Publié: (2024)
Frequency-Based Alignment of EEG and Audio Signals Using Contrastive Learning and SincNet for Auditory Attention Detection
par: Liao, Yuan, et autres
Publié: (2025)
par: Liao, Yuan, et autres
Publié: (2025)
A Study on Speech Assessment with Visual Cues
par: Ahmed, Shafique, et autres
Publié: (2025)
par: Ahmed, Shafique, et autres
Publié: (2025)
Relating the Neural Representations of Vocalized, Mimed, and Imagined Speech
par: Maghsoudi, Maryam, et autres
Publié: (2026)
par: Maghsoudi, Maryam, et autres
Publié: (2026)
Toward Universal Speech Enhancement for Diverse Input Conditions
par: Zhang, Wangyou, et autres
Publié: (2023)
par: Zhang, Wangyou, et autres
Publié: (2023)
Speech dereverberation constrained on room impulse response characteristics
par: Bahrman, Louis, et autres
Publié: (2024)
par: Bahrman, Louis, et autres
Publié: (2024)
Contrastive Knowledge Distillation for Embedding Refinement in Personalized Speech Enhancement
par: Serre, Thomas, et autres
Publié: (2026)
par: Serre, Thomas, et autres
Publié: (2026)
Significance of Chirp MFCC as a Feature in Speech and Audio Applications
par: Joysingh, S. Johanan, et autres
Publié: (2024)
par: Joysingh, S. Johanan, et autres
Publié: (2024)
Microphone Array Signal Processing and Deep Learning for Speech Enhancement
par: Haeb-Umbach, Reinhold, et autres
Publié: (2025)
par: Haeb-Umbach, Reinhold, et autres
Publié: (2025)
Self-supervised Multimodal Speech Representations for the Assessment of Schizophrenia Symptoms
par: Premananth, Gowtham, et autres
Publié: (2024)
par: Premananth, Gowtham, et autres
Publié: (2024)
Documents similaires
-
Subject Disentanglement Neural Network for Speech Envelope Reconstruction from EEG
par: Zhang, Li, et autres
Publié: (2025) -
SoloAudio: Target Sound Extraction with Language-oriented Audio Diffusion Transformer
par: Wang, Helin, et autres
Publié: (2024) -
Learning Perceptually Relevant Temporal Envelope Morphing
par: Dixit, Satvik, et autres
Publié: (2025) -
SynSonic: Augmenting Sound Event Detection through Text-to-Audio Diffusion ControlNet and Effective Sample Filtering
par: Hai, Jiarui, et autres
Publié: (2025) -
Frequency-Specific Neural Response and Cross-Correlation Analysis of Envelope Following Responses to Native Speech and Music Using Multichannel EEG Signals: A Case Study
par: Hasan, Md. Mahbub, et autres
Publié: (2025)