EEG-Based Speech Decoding: A Novel Approach Using Multi-Kernel Ensemble Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Soowon, Jo, Ha-Na, Ko, Eunyeong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Toward Fully-End-to-End Listened Speech Decoding from EEG Signals
par: Lee, Jihwan, et autres
Publié: (2024)
par: Lee, Jihwan, et autres
Publié: (2024)
Towards Unified Neural Decoding of Perceived, Spoken and Imagined Speech from EEG Signals
par: Lee, Jung-Sun, et autres
Publié: (2024)
par: Lee, Jung-Sun, et autres
Publié: (2024)
Using Ear-EEG to Decode Auditory Attention in Multiple-speaker Environment
par: Zhu, Haolin, et autres
Publié: (2024)
par: Zhu, Haolin, et autres
Publié: (2024)
SWIM: Short-Window CNN Integrated with Mamba for EEG-Based Auditory Spatial Attention Decoding
par: Zhang, Ziyang, et autres
Publié: (2024)
par: Zhang, Ziyang, et autres
Publié: (2024)
Towards Dynamic Neural Communication and Speech Neuroprosthesis Based on Viseme Decoding
par: Park, Ji-Ha, et autres
Publié: (2025)
par: Park, Ji-Ha, et autres
Publié: (2025)
Speech Enhancement Based on Drifting Models
par: Xu, Liang, et autres
Publié: (2026)
par: Xu, Liang, et autres
Publié: (2026)
Neural Speech Embeddings for Speech Synthesis Based on Deep Generative Networks
par: Lee, Seo-Hyun, et autres
Publié: (2023)
par: Lee, Seo-Hyun, et autres
Publié: (2023)
CrossSpeech++: Cross-lingual Speech Synthesis with Decoupled Language and Speaker Generation
par: Kim, Ji-Hoon, et autres
Publié: (2024)
par: Kim, Ji-Hoon, et autres
Publié: (2024)
Conditioning and Sampling in Variational Diffusion Models for Speech Super-Resolution
par: Yu, Chin-Yun, et autres
Publié: (2022)
par: Yu, Chin-Yun, et autres
Publié: (2022)
Frequency-Based Alignment of EEG and Audio Signals Using Contrastive Learning and SincNet for Auditory Attention Detection
par: Liao, Yuan, et autres
Publié: (2025)
par: Liao, Yuan, et autres
Publié: (2025)
GAN-Based Speech Enhancement for Low SNR Using Latent Feature Conditioning
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
Neural Speech and Audio Coding: Modern AI Technology Meets Traditional Codecs
par: Kim, Minje, et autres
Publié: (2024)
par: Kim, Minje, et autres
Publié: (2024)
Beamforming in the Reproducing Kernel Domain Based on Spatial Differentiation
par: Iwami, Takahiro, et autres
Publié: (2025)
par: Iwami, Takahiro, et autres
Publié: (2025)
Automatic Speech Recognition using Advanced Deep Learning Approaches: A survey
par: Kheddar, Hamza, et autres
Publié: (2024)
par: Kheddar, Hamza, et autres
Publié: (2024)
A Hybrid Model for Weakly-Supervised Speech Dereverberation
par: Bahrman, Louis, et autres
Publié: (2025)
par: Bahrman, Louis, et autres
Publié: (2025)
JenGAN: Stacked Shifted Filters in GAN-Based Speech Synthesis
par: Cho, Hyunjae, et autres
Publié: (2024)
par: Cho, Hyunjae, et autres
Publié: (2024)
Confidence-Based Self-Training for EMG-to-Speech: Leveraging Synthetic EMG for Robust Modeling
par: Chen, Xiaodan, et autres
Publié: (2025)
par: Chen, Xiaodan, et autres
Publié: (2025)
EMOCONV-DIFF: Diffusion-based Speech Emotion Conversion for Non-parallel and In-the-wild Data
par: Prabhu, Navin Raj, et autres
Publié: (2023)
par: Prabhu, Navin Raj, et autres
Publié: (2023)
Reading to Listen at the Cocktail Party: Multi-Modal Speech Separation
par: Rahimi, Akam, et autres
Publié: (2025)
par: Rahimi, Akam, et autres
Publié: (2025)
SSM2Mel: State Space Model to Reconstruct Mel Spectrogram from the EEG
par: Fan, Cunhang, et autres
Publié: (2025)
par: Fan, Cunhang, et autres
Publié: (2025)
Speech Boosting: Low-Latency Live Speech Enhancement for TWS Earbuds
par: Bae, Hanbin, et autres
Publié: (2024)
par: Bae, Hanbin, et autres
Publié: (2024)
Bridging the Gap: Integrating Pre-trained Speech Enhancement and Recognition Models for Robust Speech Recognition
par: Wang, Kuan-Chen, et autres
Publié: (2024)
par: Wang, Kuan-Chen, et autres
Publié: (2024)
VoicePrompter: Robust Zero-Shot Voice Conversion with Voice Prompt and Conditional Flow Matching
par: Choi, Ha-Yeong, et autres
Publié: (2025)
par: Choi, Ha-Yeong, et autres
Publié: (2025)
FlexIO: Flexible Single- and Multi-Channel Speech Separation and Enhancement
par: Masuyama, Yoshiki, et autres
Publié: (2025)
par: Masuyama, Yoshiki, et autres
Publié: (2025)
Continuous Speech Tokens Makes LLMs Robust Multi-Modality Learners
par: Yuan, Ze, et autres
Publié: (2024)
par: Yuan, Ze, et autres
Publié: (2024)
AADNet: An End-to-End Deep Learning Model for Auditory Attention Decoding
par: Nguyen, Nhan Duc Thanh, et autres
Publié: (2024)
par: Nguyen, Nhan Duc Thanh, et autres
Publié: (2024)
Joint Semantic Knowledge Distillation and Masked Acoustic Modeling for Full-band Speech Restoration with Improved Intelligibility
par: Liu, Xiaoyu, et autres
Publié: (2024)
par: Liu, Xiaoyu, et autres
Publié: (2024)
DiffAU: Diffusion-Based Ambisonics Upscaling
par: Milstein, Amit, et autres
Publié: (2025)
par: Milstein, Amit, et autres
Publié: (2025)
Construction and Evaluation of Mandarin Multimodal Emotional Speech Database
par: Ting, Zhu, et autres
Publié: (2024)
par: Ting, Zhu, et autres
Publié: (2024)
AffectSpeech: A Large-Scale Emotional Speech Dataset with Fine-Grained Textual Descriptions for Speech Emotion Captioning and Synthesis
par: Qi, Tianhua, et autres
Publié: (2026)
par: Qi, Tianhua, et autres
Publié: (2026)
U-SAM: An audio language Model for Unified Speech, Audio, and Music Understanding
par: Wang, Ziqian, et autres
Publié: (2025)
par: Wang, Ziqian, et autres
Publié: (2025)
Performance Modeling for Correlation-based Neural Decoding of Auditory Attention to Speech
par: Geirnaert, Simon, et autres
Publié: (2025)
par: Geirnaert, Simon, et autres
Publié: (2025)
Classification of Heart Sounds Using Multi-Branch Deep Convolutional Network and LSTM-CNN
par: Latifi, Seyed Amir, et autres
Publié: (2024)
par: Latifi, Seyed Amir, et autres
Publié: (2024)
Wavetable Synthesis Using CVAE for Timbre Control Based on Semantic Label
par: Yutani, Tsugumasa, et autres
Publié: (2024)
par: Yutani, Tsugumasa, et autres
Publié: (2024)
Semantic Communications for Speech Recognition
par: Weng, Zhenzi, et autres
Publié: (2021)
par: Weng, Zhenzi, et autres
Publié: (2021)
Self-supervised speech representation and contextual text embedding for match-mismatch classification with EEG recording
par: Wang, Bo, et autres
Publié: (2024)
par: Wang, Bo, et autres
Publié: (2024)
A Domain-Knowledge-Inspired Music Embedding Space and a Novel Attention Mechanism for Symbolic Music Modeling
par: Guo, Z., et autres
Publié: (2022)
par: Guo, Z., et autres
Publié: (2022)
Neural Tracking of Sustained Attention, Attention Switching, and Natural Conversation in Audiovisual Environments using Mobile EEG
par: Wilroth, Johanna, et autres
Publié: (2026)
par: Wilroth, Johanna, et autres
Publié: (2026)
Predicting Heart Activity from Speech using Data-driven and Knowledge-based features
par: Elbanna, Gasser, et autres
Publié: (2024)
par: Elbanna, Gasser, et autres
Publié: (2024)
LiSenNet: Lightweight Sub-band and Dual-Path Modeling for Real-Time Speech Enhancement
par: Yan, Haoyin, et autres
Publié: (2024)
par: Yan, Haoyin, et autres
Publié: (2024)
Documents similaires
-
Toward Fully-End-to-End Listened Speech Decoding from EEG Signals
par: Lee, Jihwan, et autres
Publié: (2024) -
Towards Unified Neural Decoding of Perceived, Spoken and Imagined Speech from EEG Signals
par: Lee, Jung-Sun, et autres
Publié: (2024) -
Using Ear-EEG to Decode Auditory Attention in Multiple-speaker Environment
par: Zhu, Haolin, et autres
Publié: (2024) -
SWIM: Short-Window CNN Integrated with Mamba for EEG-Based Auditory Spatial Attention Decoding
par: Zhang, Ziyang, et autres
Publié: (2024) -
Towards Dynamic Neural Communication and Speech Neuroprosthesis Based on Viseme Decoding
par: Park, Ji-Ha, et autres
Publié: (2025)