Decoding Speech Envelopes from Electroencephalogram with a Contrastive Pearson Correlation Coefficient Loss
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liang, Yayun, Zhang, Yuanming, Chen, Fei, Lu, Jing, Lin, Zhibin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Decoding Stimulus Reconstruction-Based Auditory Attention Robustly in Unbalanced EEG Datasets
par: Zhang, Yuanming, et autres
Publié: (2026)
par: Zhang, Yuanming, et autres
Publié: (2026)
Multi-class Decoding of Attended Speaker Direction Using Electroencephalogram and Audio Spatial Spectrum
par: Zhang, Yuanming, et autres
Publié: (2024)
par: Zhang, Yuanming, et autres
Publié: (2024)
Auditory Attention Decoding from Ear-EEG Signals: A Dataset with Dynamic Attention Switching and Rigorous Cross-Validation
par: Zhang, Yuanming, et autres
Publié: (2025)
par: Zhang, Yuanming, et autres
Publié: (2025)
A Lightweight Hybrid Dual Channel Speech Enhancement System under Low-SNR Conditions
par: Wang, Zheng, et autres
Publié: (2025)
par: Wang, Zheng, et autres
Publié: (2025)
Comparator Loss: An Ordinal Contrastive Loss to Derive a Severity Score for Speech-based Health Monitoring
par: Webber, Jacob J, et autres
Publié: (2025)
par: Webber, Jacob J, et autres
Publié: (2025)
Asymmetric Encoder-Decoder Based on Time-Frequency Correlation for Speech Separation
par: Shin, Ui-Hyeop, et autres
Publié: (2026)
par: Shin, Ui-Hyeop, et autres
Publié: (2026)
Noise-Aware Speech Separation with Contrastive Learning
par: Zhang, Zizheng, et autres
Publié: (2023)
par: Zhang, Zizheng, et autres
Publié: (2023)
Reverberation-Robust Localization of Speakers Using Distinct Speech Onsets and Multi-channel Cross-Correlations
par: Lin, Shoufeng
Publié: (2026)
par: Lin, Shoufeng
Publié: (2026)
DeCRED: Decoder-Centric Regularization for Encoder-Decoder Based Speech Recognition
par: Polok, Alexander, et autres
Publié: (2025)
par: Polok, Alexander, et autres
Publié: (2025)
Improving Automatic Speech Recognition with Decoder-Centric Regularisation in Encoder-Decoder Models
par: Polok, Alexander, et autres
Publié: (2024)
par: Polok, Alexander, et autres
Publié: (2024)
Exploiting Consistency-Preserving Loss and Perceptual Contrast Stretching to Boost SSL-based Speech Enhancement
par: Khan, Muhammad Salman, et autres
Publié: (2024)
par: Khan, Muhammad Salman, et autres
Publié: (2024)
Streaming Speech Recognition with Decoder-Only Large Language Models and Latency Optimization
par: Wan, Genshun, et autres
Publié: (2026)
par: Wan, Genshun, et autres
Publié: (2026)
Learning Disentangled Speech Representations with Contrastive Learning and Time-Invariant Retrieval
par: Deng, Yimin, et autres
Publié: (2024)
par: Deng, Yimin, et autres
Publié: (2024)
VALL-T: Decoder-Only Generative Transducer for Robust and Decoding-Controllable Text-to-Speech
par: Du, Chenpeng, et autres
Publié: (2024)
par: Du, Chenpeng, et autres
Publié: (2024)
Enhancement of Dysarthric Speech Reconstruction by Contrastive Learning
par: Fatemeh, Keshvari, et autres
Publié: (2024)
par: Fatemeh, Keshvari, et autres
Publié: (2024)
Separate and Reconstruct: Asymmetric Encoder-Decoder for Speech Separation
par: Shin, Ui-Hyeop, et autres
Publié: (2024)
par: Shin, Ui-Hyeop, et autres
Publié: (2024)
GESI: Gammachirp Envelope Similarity Index for Predicting Intelligibility of Simulated Hearing Loss Sounds
par: Yamamoto, Ayako, et autres
Publié: (2023)
par: Yamamoto, Ayako, et autres
Publié: (2023)
FNSE-SBGAN: Far-field Speech Enhancement with Schrodinger Bridge and Generative Adversarial Networks
par: Lei, Tong, et autres
Publié: (2025)
par: Lei, Tong, et autres
Publié: (2025)
Modeling Multi-Level Hearing Loss for Speech Intelligibility Prediction
par: Zhou, Xiajie, et autres
Publié: (2025)
par: Zhou, Xiajie, et autres
Publié: (2025)
Speech Separation using Neural Audio Codecs with Embedding Loss
par: Yip, Jia Qi, et autres
Publié: (2024)
par: Yip, Jia Qi, et autres
Publié: (2024)
Towards Fine-Grained and Multi-Granular Contrastive Language-Speech Pre-training
par: Yang, Yifan, et autres
Publié: (2026)
par: Yang, Yifan, et autres
Publié: (2026)
VoCodec: An Efficient Lightweight Low-Bitrate Speech Codec
par: Yang, Leyan, et autres
Publié: (2026)
par: Yang, Leyan, et autres
Publié: (2026)
Rethinking Flow and Diffusion Bridge Models for Speech Enhancement
par: Wang, Dahan, et autres
Publié: (2026)
par: Wang, Dahan, et autres
Publié: (2026)
Large Language Model Guided Decoding for Self-Supervised Speech Recognition
par: Cohen, Eyal, et autres
Publié: (2025)
par: Cohen, Eyal, et autres
Publié: (2025)
Deep Filter Estimation from Inter-Frame Correlations for Monaural Speech Dereverberation
par: Shin, Ui-Hyeop, et autres
Publié: (2026)
par: Shin, Ui-Hyeop, et autres
Publié: (2026)
Streaming Decoder-Only Automatic Speech Recognition with Discrete Speech Units: A Pilot Study
par: Chen, Peikun, et autres
Publié: (2024)
par: Chen, Peikun, et autres
Publié: (2024)
Speech-Omni-Lite: Portable Speech Interfaces for Vision-Language Models
par: Tao, Dehua, et autres
Publié: (2026)
par: Tao, Dehua, et autres
Publié: (2026)
FairASR: Fair Audio Contrastive Learning for Automatic Speech Recognition
par: Kim, Jongsuk, et autres
Publié: (2025)
par: Kim, Jongsuk, et autres
Publié: (2025)
Audiobook-CC: Controllable Long-context Speech Generation for Multicast Audiobook
par: Liu, Min, et autres
Publié: (2025)
par: Liu, Min, et autres
Publié: (2025)
Attention-Constrained Inference for Robust Decoder-Only Text-to-Speech
par: Wang, Hankun, et autres
Publié: (2024)
par: Wang, Hankun, et autres
Publié: (2024)
Multimodal Representation Loss Between Timed Text and Audio for Regularized Speech Separation
par: Hsieh, Tsun-An, et autres
Publié: (2024)
par: Hsieh, Tsun-An, et autres
Publié: (2024)
EMO-RL: Emotion-Rule-Based Reinforcement Learning Enhanced Audio-Language Model for Generalized Speech Emotion Recognition
par: Li, Pengcheng, et autres
Publié: (2025)
par: Li, Pengcheng, et autres
Publié: (2025)
Interleaved Speech-Text Language Models for Simple Streaming Text-to-Speech Synthesis
par: Yang, Yifan, et autres
Publié: (2024)
par: Yang, Yifan, et autres
Publié: (2024)
Mamba-based Decoder-Only Approach with Bidirectional Speech Modeling for Speech Recognition
par: Masuyama, Yoshiki, et autres
Publié: (2024)
par: Masuyama, Yoshiki, et autres
Publié: (2024)
Attention-Based Beamformer For Multi-Channel Speech Enhancement
par: Bai, Jinglin, et autres
Publié: (2024)
par: Bai, Jinglin, et autres
Publié: (2024)
Enhancing Emotional Text-to-Speech Controllability with Natural Language Guidance through Contrastive Learning and Diffusion Models
par: Jing, Xin, et autres
Publié: (2024)
par: Jing, Xin, et autres
Publié: (2024)
Using Speech Foundational Models in Loss Functions for Hearing Aid Speech Enhancement
par: Sutherland, Robert, et autres
Publié: (2024)
par: Sutherland, Robert, et autres
Publié: (2024)
SCOREQ: Speech Quality Assessment with Contrastive Regression
par: Ragano, Alessandro, et autres
Publié: (2024)
par: Ragano, Alessandro, et autres
Publié: (2024)
End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios
par: Jing, Kangqi, et autres
Publié: (2025)
par: Jing, Kangqi, et autres
Publié: (2025)
PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement
par: Rong, Xiaobin, et autres
Publié: (2025)
par: Rong, Xiaobin, et autres
Publié: (2025)
Documents similaires
-
Decoding Stimulus Reconstruction-Based Auditory Attention Robustly in Unbalanced EEG Datasets
par: Zhang, Yuanming, et autres
Publié: (2026) -
Multi-class Decoding of Attended Speaker Direction Using Electroencephalogram and Audio Spatial Spectrum
par: Zhang, Yuanming, et autres
Publié: (2024) -
Auditory Attention Decoding from Ear-EEG Signals: A Dataset with Dynamic Attention Switching and Rigorous Cross-Validation
par: Zhang, Yuanming, et autres
Publié: (2025) -
A Lightweight Hybrid Dual Channel Speech Enhancement System under Low-SNR Conditions
par: Wang, Zheng, et autres
Publié: (2025) -
Comparator Loss: An Ordinal Contrastive Loss to Derive a Severity Score for Speech-based Health Monitoring
par: Webber, Jacob J, et autres
Publié: (2025)