Subject Disentanglement Neural Network for Speech Envelope Reconstruction from EEG
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Li, Liu, Jiyao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Auditory Attention Decoding without Spatial Information: A Diotic EEG Study
par: Yoshino, Masahiro, et autres
Publié: (2026)
par: Yoshino, Masahiro, et autres
Publié: (2026)
NeuroIncept Decoder for High-Fidelity Speech Reconstruction from Neural Activity
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
A 1000-hour EEG-EMG-audio dataset of Japanese speech production
par: Sato, Motoshige, et autres
Publié: (2026)
par: Sato, Motoshige, et autres
Publié: (2026)
Zero-Shot KWS for Children's Speech using Layer-Wise Features from SSL Models
par: Kutum, Subham, et autres
Publié: (2025)
par: Kutum, Subham, et autres
Publié: (2025)
Recreating Neural Activity During Speech Production with Language and Speech Model Embeddings
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
Low-latency auditory spatial attention detection based on spectro-spatial features from EEG
par: Cai, Siqi, et autres
Publié: (2021)
par: Cai, Siqi, et autres
Publié: (2021)
Active noise cancellation on open-ear smart glasses
par: Yuan, Kuang, et autres
Publié: (2026)
par: Yuan, Kuang, et autres
Publié: (2026)
A Near-Real-Time Processing Ego Speech Filtering Pipeline Designed for Speech Interruption During Human-Robot Interaction
par: Li, Yue, et autres
Publié: (2024)
par: Li, Yue, et autres
Publié: (2024)
Scaling Law in Neural Data: Non-Invasive Speech Decoding with 175 Hours of EEG Data
par: Sato, Motoshige, et autres
Publié: (2024)
par: Sato, Motoshige, et autres
Publié: (2024)
Towards LLM-Empowered Fine-Grained Speech Descriptors for Explainable Emotion Recognition
par: Chen, Youjun, et autres
Publié: (2025)
par: Chen, Youjun, et autres
Publié: (2025)
SACM: SEEG-Audio Contrastive Matching for Chinese Speech Decoding
par: Wang, Hongbin, et autres
Publié: (2025)
par: Wang, Hongbin, et autres
Publié: (2025)
Directional Source Separation for Robust Speech Recognition on Smart Glasses
par: Feng, Tiantian, et autres
Publié: (2023)
par: Feng, Tiantian, et autres
Publié: (2023)
How Private is Low-Frequency Speech Audio in the Wild? An Analysis of Verbal Intelligibility by Humans and Machines
par: Liu, Ailin, et autres
Publié: (2024)
par: Liu, Ailin, et autres
Publié: (2024)
Towards Temporally Explainable Dysarthric Speech Clarity Assessment
par: Park, Seohyun, et autres
Publié: (2025)
par: Park, Seohyun, et autres
Publié: (2025)
VoiceX: A Text-To-Speech Framework for Custom Voices
par: Mertes, Silvan, et autres
Publié: (2024)
par: Mertes, Silvan, et autres
Publié: (2024)
MHANet: Multi-scale Hybrid Attention Network for Auditory Attention Detection
par: Li, Lu, et autres
Publié: (2025)
par: Li, Lu, et autres
Publié: (2025)
Psychophysiology-aided Perceptually Fluent Speech Analysis of Children Who Stutter
par: Xiao, Yi, et autres
Publié: (2022)
par: Xiao, Yi, et autres
Publié: (2022)
Using Confidence Scores to Improve Eyes-free Detection of Speech Recognition Errors
par: Nowrin, Sadia, et autres
Publié: (2024)
par: Nowrin, Sadia, et autres
Publié: (2024)
Adapting Whisper for Lightweight and Efficient Automatic Speech Recognition of Children for On-device Edge Applications
par: Dutta, Satwik, et autres
Publié: (2025)
par: Dutta, Satwik, et autres
Publié: (2025)
USpeech: Ultrasound-Enhanced Speech with Minimal Human Effort via Cross-Modal Synthesis
par: Yu, Luca Jiang-Tao, et autres
Publié: (2024)
par: Yu, Luca Jiang-Tao, et autres
Publié: (2024)
Artificial Neural Networks to Recognize Speakers Division from Continuous Bengali Speech
par: Ali, Hasmot, et autres
Publié: (2024)
par: Ali, Hasmot, et autres
Publié: (2024)
ListenNet: A Lightweight Spatio-Temporal Enhancement Nested Network for Auditory Attention Detection
par: Fan, Cunhang, et autres
Publié: (2025)
par: Fan, Cunhang, et autres
Publié: (2025)
AVE Speech: A Comprehensive Multi-Modal Dataset for Speech Recognition Integrating Audio, Visual, and Electromyographic Signals
par: Zhou, Dongliang, et autres
Publié: (2025)
par: Zhou, Dongliang, et autres
Publié: (2025)
ASE: Practical Acoustic Speed Estimation Beyond Doppler via Sound Diffusion Field
par: Lyu, Sheng, et autres
Publié: (2024)
par: Lyu, Sheng, et autres
Publié: (2024)
Revisiting Your Memory: Reconstruction of Affect-Contextualized Memory via EEG-guided Audiovisual Generation
par: Kwon, Joonwoo, et autres
Publié: (2024)
par: Kwon, Joonwoo, et autres
Publié: (2024)
Beyond-Voice: Towards Continuous 3D Hand Pose Tracking on Commercial Home Assistant Devices
par: Li, Yin, et autres
Publié: (2023)
par: Li, Yin, et autres
Publié: (2023)
SSM2Mel: State Space Model to Reconstruct Mel Spectrogram from the EEG
par: Fan, Cunhang, et autres
Publié: (2025)
par: Fan, Cunhang, et autres
Publié: (2025)
Sound2Hap: Learning Audio-to-Vibrotactile Haptic Generation from Human Ratings
par: Li, Yinan, et autres
Publié: (2026)
par: Li, Yinan, et autres
Publié: (2026)
Early Detection of Furniture-Infesting Wood-Boring Beetles Using CNN-LSTM Networks and MFCC-Based Acoustic Features
par: Manukalpa, J. M. Chan Sri, et autres
Publié: (2025)
par: Manukalpa, J. M. Chan Sri, et autres
Publié: (2025)
Robust Dual-Modal Speech Keyword Spotting for XR Headsets
par: Cai, Zhuojiang, et autres
Publié: (2024)
par: Cai, Zhuojiang, et autres
Publié: (2024)
Real-Time Word-Level Temporal Segmentation in Streaming Speech Recognition
par: Nishida, Naoto, et autres
Publié: (2025)
par: Nishida, Naoto, et autres
Publié: (2025)
SCDiar: a streaming diarization system based on speaker change detection and speech recognition
par: Zheng, Naijun, et autres
Publié: (2025)
par: Zheng, Naijun, et autres
Publié: (2025)
Personalized Speech Emotion Recognition in Human-Robot Interaction using Vision Transformers
par: Mishra, Ruchik, et autres
Publié: (2024)
par: Mishra, Ruchik, et autres
Publié: (2024)
Improving Multimodal Emotion Recognition by Leveraging Acoustic Adaptation and Visual Alignment
par: Zhao, Zhixian, et autres
Publié: (2024)
par: Zhao, Zhixian, et autres
Publié: (2024)
Speech vs. Transcript: Does It Matter for Human Annotators in Speech Summarization?
par: Sharma, Roshan, et autres
Publié: (2024)
par: Sharma, Roshan, et autres
Publié: (2024)
Optimizing Dysarthria Wake-Up Word Spotting: An End-to-End Approach for SLT 2024 LRDWWS Challenge
par: Liu, Shuiyun, et autres
Publié: (2024)
par: Liu, Shuiyun, et autres
Publié: (2024)
RespEar: Earable-Based Robust Respiratory Rate Monitoring
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
SingVisio: Visual Analytics of Diffusion Model for Singing Voice Conversion
par: Xue, Liumeng, et autres
Publié: (2024)
par: Xue, Liumeng, et autres
Publié: (2024)
Advancing User-Voice Interaction: Exploring Emotion-Aware Voice Assistants Through a Role-Swapping Approach
par: Ma, Yong, et autres
Publié: (2025)
par: Ma, Yong, et autres
Publié: (2025)
WSCoach: Wearable Real-time Auditory Feedback for Reducing Unwanted Words in Daily Communication
par: Youpeng, Zhang, et autres
Publié: (2025)
par: Youpeng, Zhang, et autres
Publié: (2025)
Documents similaires
-
Auditory Attention Decoding without Spatial Information: A Diotic EEG Study
par: Yoshino, Masahiro, et autres
Publié: (2026) -
NeuroIncept Decoder for High-Fidelity Speech Reconstruction from Neural Activity
par: Khanday, Owais Mujtaba, et autres
Publié: (2025) -
A 1000-hour EEG-EMG-audio dataset of Japanese speech production
par: Sato, Motoshige, et autres
Publié: (2026) -
Zero-Shot KWS for Children's Speech using Layer-Wise Features from SSL Models
par: Kutum, Subham, et autres
Publié: (2025) -
Recreating Neural Activity During Speech Production with Language and Speech Model Embeddings
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)