A Lightweight Hybrid Dual Channel Speech Enhancement System under Low-SNR Conditions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Zheng, Rong, Xiaobin, Sun, Yu, Sun, Tianchi, Lin, Zhibin, Lu, Jing |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UniPASE: A Generative Model for Universal Speech Enhancement with High Fidelity and Low Hallucinations
par: Rong, Xiaobin, et autres
Publié: (2026)
par: Rong, Xiaobin, et autres
Publié: (2026)
SNR-Progressive Model with Harmonic Compensation for Low-SNR Speech Enhancement
par: Hou, Zhongshu, et autres
Publié: (2024)
par: Hou, Zhongshu, et autres
Publié: (2024)
StuPASE: Towards Low-Hallucination Studio-Quality Generative Speech Enhancement
par: Rong, Xiaobin, et autres
Publié: (2026)
par: Rong, Xiaobin, et autres
Publié: (2026)
GAP-URGENet: A Generative-Predictive Fusion Framework for Universal Speech Enhancement
par: Rong, Xiaobin, et autres
Publié: (2026)
par: Rong, Xiaobin, et autres
Publié: (2026)
PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement
par: Rong, Xiaobin, et autres
Publié: (2025)
par: Rong, Xiaobin, et autres
Publié: (2025)
Adaptive Convolution for CNN-based Speech Enhancement Models
par: Wang, Dahan, et autres
Publié: (2025)
par: Wang, Dahan, et autres
Publié: (2025)
UL-UNAS: Ultra-Lightweight U-Nets for Real-Time Speech Enhancement via Network Architecture Search
par: Rong, Xiaobin, et autres
Publié: (2025)
par: Rong, Xiaobin, et autres
Publié: (2025)
GAN-Based Speech Enhancement for Low SNR Using Latent Feature Conditioning
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
Reducing Linguistic Hallucination in LM-Based Speech Enhancement via Noise-Invariant Acoustic-Semantic Distillation
par: Wang, Zheng, et autres
Publié: (2026)
par: Wang, Zheng, et autres
Publié: (2026)
TripleC Learning and Lightweight Speech Enhancement for Multi-Condition Target Speech Extraction
par: Huang, Ziling
Publié: (2025)
par: Huang, Ziling
Publié: (2025)
TS-URGENet: A Three-stage Universal Robust and Generalizable Speech Enhancement Network
par: Rong, Xiaobin, et autres
Publié: (2025)
par: Rong, Xiaobin, et autres
Publié: (2025)
VoCodec: An Efficient Lightweight Low-Bitrate Speech Codec
par: Yang, Leyan, et autres
Publié: (2026)
par: Yang, Leyan, et autres
Publié: (2026)
Study of Lightweight Transformer Architectures for Single-Channel Speech Enhancement
par: Zhao, Haixin, et autres
Publié: (2025)
par: Zhao, Haixin, et autres
Publié: (2025)
Dual-View Predictive Diffusion: Lightweight Speech Enhancement via Spectrogram-Image Synergy
par: Xue, Ke, et autres
Publié: (2026)
par: Xue, Ke, et autres
Publié: (2026)
Decoding Speech Envelopes from Electroencephalogram with a Contrastive Pearson Correlation Coefficient Loss
par: Liang, Yayun, et autres
Publié: (2026)
par: Liang, Yayun, et autres
Publié: (2026)
Speech Enhancement with Dual-path Multi-Channel Linear Prediction Filter and Multi-norm Beamforming
par: Qin, Chengyuan, et autres
Publié: (2025)
par: Qin, Chengyuan, et autres
Publié: (2025)
Improving Speech Enhancement by Integrating Inter-Channel and Band Features with Dual-branch Conformer
par: Li, Jizhen, et autres
Publié: (2024)
par: Li, Jizhen, et autres
Publié: (2024)
Combining Deterministic Enhanced Conditions with Dual-Streaming Encoding for Diffusion-Based Speech Enhancement
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
A Hybrid Discriminative and Generative System for Universal Speech Enhancement
par: Liu, Yinghao, et autres
Publié: (2026)
par: Liu, Yinghao, et autres
Publié: (2026)
Reference Channel Selection by Multi-Channel Masking for End-to-End Multi-Channel Speech Enhancement
par: Dai, Wang, et autres
Publié: (2024)
par: Dai, Wang, et autres
Publié: (2024)
ARiSE: Auto-Regressive Multi-Channel Speech Enhancement
par: Shen, Pengjie, et autres
Publié: (2025)
par: Shen, Pengjie, et autres
Publié: (2025)
FNSE-SBGAN: Far-field Speech Enhancement with Schrodinger Bridge and Generative Adversarial Networks
par: Lei, Tong, et autres
Publié: (2025)
par: Lei, Tong, et autres
Publié: (2025)
Dense-TSNet: Dense Connected Two-Stage Structure for Ultra-Lightweight Speech Enhancement
par: Lin, Zizhen, et autres
Publié: (2024)
par: Lin, Zizhen, et autres
Publié: (2024)
A Lightweight Fourier-based Network for Binaural Speech Enhancement with Spatial Cue Preservation
par: Lu, Xikun, et autres
Publié: (2025)
par: Lu, Xikun, et autres
Publié: (2025)
Rethinking Flow and Diffusion Bridge Models for Speech Enhancement
par: Wang, Dahan, et autres
Publié: (2026)
par: Wang, Dahan, et autres
Publié: (2026)
Conditional Latent Diffusion-Based Speech Enhancement Via Dual Context Learning
par: Zhao, Shengkui, et autres
Publié: (2025)
par: Zhao, Shengkui, et autres
Publié: (2025)
Reverse Attention for Lightweight Speech Enhancement on Edge Devices
par: Ojha, Shuubham, et autres
Publié: (2025)
par: Ojha, Shuubham, et autres
Publié: (2025)
Unified Diffusion Refinement for Multi-Channel Speech Enhancement and Separation
par: Xu, Zhongweiyang, et autres
Publié: (2026)
par: Xu, Zhongweiyang, et autres
Publié: (2026)
PLDNet: PLD-Guided Lightweight Deep Network Boosted by Efficient Attention for Handheld Dual-Microphone Speech Enhancement
par: Zhou, Nan, et autres
Publié: (2024)
par: Zhou, Nan, et autres
Publié: (2024)
Heterogeneous Space Fusion and Dual-Dimension Attention: A New Paradigm for Speech Enhancement
par: Zheng, Tao, et autres
Publié: (2024)
par: Zheng, Tao, et autres
Publié: (2024)
GALD-SE: Guided Anisotropic Lightweight Diffusion for Efficient Speech Enhancement
par: Wang, Chengzhong, et autres
Publié: (2024)
par: Wang, Chengzhong, et autres
Publié: (2024)
Hybrid Real- And Complex-Valued Neural Network Concept For Low-Complexity Phase-Aware Speech Enhancement
par: Fiorio, Luan Vinícius, et autres
Publié: (2025)
par: Fiorio, Luan Vinícius, et autres
Publié: (2025)
Universal Speech Enhancement with Regression and Generative Mamba
par: Chao, Rong, et autres
Publié: (2025)
par: Chao, Rong, et autres
Publié: (2025)
DCF-DS: Deep Cascade Fusion of Diarization and Separation for Speech Recognition under Realistic Single-Channel Conditions
par: Niu, Shu-Tong, et autres
Publié: (2024)
par: Niu, Shu-Tong, et autres
Publié: (2024)
A Lightweight and Real-Time Binaural Speech Enhancement Model with Spatial Cues Preservation
par: Wang, Jingyuan, et autres
Publié: (2024)
par: Wang, Jingyuan, et autres
Publié: (2024)
Sparsity-Driven EEG Channel Selection for Brain-Assisted Speech Enhancement
par: Zhang, Jie, et autres
Publié: (2023)
par: Zhang, Jie, et autres
Publié: (2023)
Low-latency Speech Enhancement via Speech Token Generation
par: Xue, Huaying, et autres
Publié: (2023)
par: Xue, Huaying, et autres
Publié: (2023)
Lightweight and Robust Multi-Channel End-to-End Speech Recognition with Spherical Harmonic Transform
par: Kong, Xiangzhu, et autres
Publié: (2025)
par: Kong, Xiangzhu, et autres
Publié: (2025)
LiSenNet: Lightweight Sub-band and Dual-Path Modeling for Real-Time Speech Enhancement
par: Yan, Haoyin, et autres
Publié: (2024)
par: Yan, Haoyin, et autres
Publié: (2024)
ArrayDPS-Refine: Generative Refinement of Discriminative Multi-Channel Speech Enhancement
par: Xu, Zhongweiyang, et autres
Publié: (2026)
par: Xu, Zhongweiyang, et autres
Publié: (2026)
Documents similaires
-
UniPASE: A Generative Model for Universal Speech Enhancement with High Fidelity and Low Hallucinations
par: Rong, Xiaobin, et autres
Publié: (2026) -
SNR-Progressive Model with Harmonic Compensation for Low-SNR Speech Enhancement
par: Hou, Zhongshu, et autres
Publié: (2024) -
StuPASE: Towards Low-Hallucination Studio-Quality Generative Speech Enhancement
par: Rong, Xiaobin, et autres
Publié: (2026) -
GAP-URGENet: A Generative-Predictive Fusion Framework for Universal Speech Enhancement
par: Rong, Xiaobin, et autres
Publié: (2026) -
PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement
par: Rong, Xiaobin, et autres
Publié: (2025)