Decoding Speech Envelopes from Electroencephalogram with a Contrastive Pearson Correlation Coefficient Loss
Fuente:
arXiv
Guardado en:
| Autores principales: | Liang, Yayun, Zhang, Yuanming, Chen, Fei, Lu, Jing, Lin, Zhibin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Decoding Stimulus Reconstruction-Based Auditory Attention Robustly in Unbalanced EEG Datasets
por: Zhang, Yuanming, et al.
Publicado: (2026)
por: Zhang, Yuanming, et al.
Publicado: (2026)
Multi-class Decoding of Attended Speaker Direction Using Electroencephalogram and Audio Spatial Spectrum
por: Zhang, Yuanming, et al.
Publicado: (2024)
por: Zhang, Yuanming, et al.
Publicado: (2024)
Auditory Attention Decoding from Ear-EEG Signals: A Dataset with Dynamic Attention Switching and Rigorous Cross-Validation
por: Zhang, Yuanming, et al.
Publicado: (2025)
por: Zhang, Yuanming, et al.
Publicado: (2025)
A Lightweight Hybrid Dual Channel Speech Enhancement System under Low-SNR Conditions
por: Wang, Zheng, et al.
Publicado: (2025)
por: Wang, Zheng, et al.
Publicado: (2025)
Comparator Loss: An Ordinal Contrastive Loss to Derive a Severity Score for Speech-based Health Monitoring
por: Webber, Jacob J, et al.
Publicado: (2025)
por: Webber, Jacob J, et al.
Publicado: (2025)
Asymmetric Encoder-Decoder Based on Time-Frequency Correlation for Speech Separation
por: Shin, Ui-Hyeop, et al.
Publicado: (2026)
por: Shin, Ui-Hyeop, et al.
Publicado: (2026)
Noise-Aware Speech Separation with Contrastive Learning
por: Zhang, Zizheng, et al.
Publicado: (2023)
por: Zhang, Zizheng, et al.
Publicado: (2023)
Reverberation-Robust Localization of Speakers Using Distinct Speech Onsets and Multi-channel Cross-Correlations
por: Lin, Shoufeng
Publicado: (2026)
por: Lin, Shoufeng
Publicado: (2026)
DeCRED: Decoder-Centric Regularization for Encoder-Decoder Based Speech Recognition
por: Polok, Alexander, et al.
Publicado: (2025)
por: Polok, Alexander, et al.
Publicado: (2025)
Improving Automatic Speech Recognition with Decoder-Centric Regularisation in Encoder-Decoder Models
por: Polok, Alexander, et al.
Publicado: (2024)
por: Polok, Alexander, et al.
Publicado: (2024)
Exploiting Consistency-Preserving Loss and Perceptual Contrast Stretching to Boost SSL-based Speech Enhancement
por: Khan, Muhammad Salman, et al.
Publicado: (2024)
por: Khan, Muhammad Salman, et al.
Publicado: (2024)
Streaming Speech Recognition with Decoder-Only Large Language Models and Latency Optimization
por: Wan, Genshun, et al.
Publicado: (2026)
por: Wan, Genshun, et al.
Publicado: (2026)
Learning Disentangled Speech Representations with Contrastive Learning and Time-Invariant Retrieval
por: Deng, Yimin, et al.
Publicado: (2024)
por: Deng, Yimin, et al.
Publicado: (2024)
VALL-T: Decoder-Only Generative Transducer for Robust and Decoding-Controllable Text-to-Speech
por: Du, Chenpeng, et al.
Publicado: (2024)
por: Du, Chenpeng, et al.
Publicado: (2024)
Enhancement of Dysarthric Speech Reconstruction by Contrastive Learning
por: Fatemeh, Keshvari, et al.
Publicado: (2024)
por: Fatemeh, Keshvari, et al.
Publicado: (2024)
Separate and Reconstruct: Asymmetric Encoder-Decoder for Speech Separation
por: Shin, Ui-Hyeop, et al.
Publicado: (2024)
por: Shin, Ui-Hyeop, et al.
Publicado: (2024)
GESI: Gammachirp Envelope Similarity Index for Predicting Intelligibility of Simulated Hearing Loss Sounds
por: Yamamoto, Ayako, et al.
Publicado: (2023)
por: Yamamoto, Ayako, et al.
Publicado: (2023)
FNSE-SBGAN: Far-field Speech Enhancement with Schrodinger Bridge and Generative Adversarial Networks
por: Lei, Tong, et al.
Publicado: (2025)
por: Lei, Tong, et al.
Publicado: (2025)
Modeling Multi-Level Hearing Loss for Speech Intelligibility Prediction
por: Zhou, Xiajie, et al.
Publicado: (2025)
por: Zhou, Xiajie, et al.
Publicado: (2025)
Speech Separation using Neural Audio Codecs with Embedding Loss
por: Yip, Jia Qi, et al.
Publicado: (2024)
por: Yip, Jia Qi, et al.
Publicado: (2024)
Towards Fine-Grained and Multi-Granular Contrastive Language-Speech Pre-training
por: Yang, Yifan, et al.
Publicado: (2026)
por: Yang, Yifan, et al.
Publicado: (2026)
VoCodec: An Efficient Lightweight Low-Bitrate Speech Codec
por: Yang, Leyan, et al.
Publicado: (2026)
por: Yang, Leyan, et al.
Publicado: (2026)
Rethinking Flow and Diffusion Bridge Models for Speech Enhancement
por: Wang, Dahan, et al.
Publicado: (2026)
por: Wang, Dahan, et al.
Publicado: (2026)
Large Language Model Guided Decoding for Self-Supervised Speech Recognition
por: Cohen, Eyal, et al.
Publicado: (2025)
por: Cohen, Eyal, et al.
Publicado: (2025)
Deep Filter Estimation from Inter-Frame Correlations for Monaural Speech Dereverberation
por: Shin, Ui-Hyeop, et al.
Publicado: (2026)
por: Shin, Ui-Hyeop, et al.
Publicado: (2026)
Streaming Decoder-Only Automatic Speech Recognition with Discrete Speech Units: A Pilot Study
por: Chen, Peikun, et al.
Publicado: (2024)
por: Chen, Peikun, et al.
Publicado: (2024)
Speech-Omni-Lite: Portable Speech Interfaces for Vision-Language Models
por: Tao, Dehua, et al.
Publicado: (2026)
por: Tao, Dehua, et al.
Publicado: (2026)
FairASR: Fair Audio Contrastive Learning for Automatic Speech Recognition
por: Kim, Jongsuk, et al.
Publicado: (2025)
por: Kim, Jongsuk, et al.
Publicado: (2025)
Audiobook-CC: Controllable Long-context Speech Generation for Multicast Audiobook
por: Liu, Min, et al.
Publicado: (2025)
por: Liu, Min, et al.
Publicado: (2025)
Attention-Constrained Inference for Robust Decoder-Only Text-to-Speech
por: Wang, Hankun, et al.
Publicado: (2024)
por: Wang, Hankun, et al.
Publicado: (2024)
Multimodal Representation Loss Between Timed Text and Audio for Regularized Speech Separation
por: Hsieh, Tsun-An, et al.
Publicado: (2024)
por: Hsieh, Tsun-An, et al.
Publicado: (2024)
EMO-RL: Emotion-Rule-Based Reinforcement Learning Enhanced Audio-Language Model for Generalized Speech Emotion Recognition
por: Li, Pengcheng, et al.
Publicado: (2025)
por: Li, Pengcheng, et al.
Publicado: (2025)
Interleaved Speech-Text Language Models for Simple Streaming Text-to-Speech Synthesis
por: Yang, Yifan, et al.
Publicado: (2024)
por: Yang, Yifan, et al.
Publicado: (2024)
Mamba-based Decoder-Only Approach with Bidirectional Speech Modeling for Speech Recognition
por: Masuyama, Yoshiki, et al.
Publicado: (2024)
por: Masuyama, Yoshiki, et al.
Publicado: (2024)
Attention-Based Beamformer For Multi-Channel Speech Enhancement
por: Bai, Jinglin, et al.
Publicado: (2024)
por: Bai, Jinglin, et al.
Publicado: (2024)
Enhancing Emotional Text-to-Speech Controllability with Natural Language Guidance through Contrastive Learning and Diffusion Models
por: Jing, Xin, et al.
Publicado: (2024)
por: Jing, Xin, et al.
Publicado: (2024)
Using Speech Foundational Models in Loss Functions for Hearing Aid Speech Enhancement
por: Sutherland, Robert, et al.
Publicado: (2024)
por: Sutherland, Robert, et al.
Publicado: (2024)
SCOREQ: Speech Quality Assessment with Contrastive Regression
por: Ragano, Alessandro, et al.
Publicado: (2024)
por: Ragano, Alessandro, et al.
Publicado: (2024)
End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios
por: Jing, Kangqi, et al.
Publicado: (2025)
por: Jing, Kangqi, et al.
Publicado: (2025)
PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement
por: Rong, Xiaobin, et al.
Publicado: (2025)
por: Rong, Xiaobin, et al.
Publicado: (2025)
Ejemplares similares
-
Decoding Stimulus Reconstruction-Based Auditory Attention Robustly in Unbalanced EEG Datasets
por: Zhang, Yuanming, et al.
Publicado: (2026) -
Multi-class Decoding of Attended Speaker Direction Using Electroencephalogram and Audio Spatial Spectrum
por: Zhang, Yuanming, et al.
Publicado: (2024) -
Auditory Attention Decoding from Ear-EEG Signals: A Dataset with Dynamic Attention Switching and Rigorous Cross-Validation
por: Zhang, Yuanming, et al.
Publicado: (2025) -
A Lightweight Hybrid Dual Channel Speech Enhancement System under Low-SNR Conditions
por: Wang, Zheng, et al.
Publicado: (2025) -
Comparator Loss: An Ordinal Contrastive Loss to Derive a Severity Score for Speech-based Health Monitoring
por: Webber, Jacob J, et al.
Publicado: (2025)