NLDSI-BWE: Non Linear Dynamical Systems-Inspired Multi Resolution Discriminators for Speech Bandwidth Extension
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tamiti, Tarikul Islam, Barua, Anomadarshi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CIS-BWE: Chaos-Informed Speech Bandwidth Extension
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
HVAC-EAR: Eavesdropping Human Speech Using HVAC Systems
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
WaLi: Can Pressure Sensors in HVAC Systems Capture Human Speech?
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
A High-Fidelity Speech Super Resolution Network using a Complex Global Attention Module with Spectro-Temporal Loss
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
SUBARU: A Practical Approach to Power Saving in Hearables Using SUB-Nyquist Audio Resolution Upsampling
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
Leveraging the Potential of Prompt Engineering for Hate Speech Detection in Low-Resource Languages
par: Prome, Ruhina Tabasshum, et autres
Publié: (2025)
par: Prome, Ruhina Tabasshum, et autres
Publié: (2025)
A Survey of Advancing Audio Super-Resolution and Bandwidth Extension from Discriminative to Generative Models
par: Yang, Ningyuan, et autres
Publié: (2026)
par: Yang, Ningyuan, et autres
Publié: (2026)
Multi-Stage Speech Bandwidth Extension with Flexible Sampling Rate Control
par: Lu, Ye-Xin, et autres
Publié: (2024)
par: Lu, Ye-Xin, et autres
Publié: (2024)
UBGAN: Enhancing Coded Speech with Blind and Guided Bandwidth Extension
par: Gupta, Kishan, et autres
Publié: (2025)
par: Gupta, Kishan, et autres
Publié: (2025)
Vector Quantized Diffusion Model Based Speech Bandwidth Extension
par: Fang, Yuan, et autres
Publié: (2024)
par: Fang, Yuan, et autres
Publié: (2024)
A Fly on the Wall -- Exploiting Acoustic Side-Channels in Differential Pressure Sensors
par: Achamyeleh, Yonatan Gizachew, et autres
Publié: (2024)
par: Achamyeleh, Yonatan Gizachew, et autres
Publié: (2024)
Harmonic-Percussive Disentangled Neural Audio Codec for Bandwidth Extension
par: Giniès, Benoît, et autres
Publié: (2025)
par: Giniès, Benoît, et autres
Publié: (2025)
Single-step Controllable Music Bandwidth Extension With Flow Matching
par: Hernandez-Olivan, Carlos, et autres
Publié: (2026)
par: Hernandez-Olivan, Carlos, et autres
Publié: (2026)
Towards High-Quality and Efficient Speech Bandwidth Extension with Parallel Amplitude and Phase Prediction
par: Lu, Ye-Xin, et autres
Publié: (2024)
par: Lu, Ye-Xin, et autres
Publié: (2024)
Fast and Flexible Audio Bandwidth Extension via Vocos
par: Sharma, Yatharth
Publié: (2026)
par: Sharma, Yatharth
Publié: (2026)
A Hybrid Discriminative and Generative System for Universal Speech Enhancement
par: Liu, Yinghao, et autres
Publié: (2026)
par: Liu, Yinghao, et autres
Publié: (2026)
Configurable EBEN: Extreme Bandwidth Extension Network to enhance body-conducted speech capture
par: Hauret, Julien, et autres
Publié: (2023)
par: Hauret, Julien, et autres
Publié: (2023)
Plugin Speech Enhancement: A Universal Speech Enhancement Framework Inspired by Dynamic Neural Network
par: Chen, Yanan, et autres
Publié: (2024)
par: Chen, Yanan, et autres
Publié: (2024)
CodecFlow: Efficient Bandwidth Extension via Conditional Flow Matching in Neural Codec Latent Space
par: Zhang, Bowen, et autres
Publié: (2026)
par: Zhang, Bowen, et autres
Publié: (2026)
Contextualized Token Discrimination for Speech Search Query Correction
par: Lu, Junyu, et autres
Publié: (2025)
par: Lu, Junyu, et autres
Publié: (2025)
Enhancing Spectrogram Realism in Singing Voice Synthesis via Explicit Bandwidth Extension Prior to Vocoder
par: Yang, Runxuan, et autres
Publié: (2025)
par: Yang, Runxuan, et autres
Publié: (2025)
Blind Audio Bandwidth Extension: A Diffusion-Based Zero-Shot Approach
par: Moliner, Eloi, et autres
Publié: (2023)
par: Moliner, Eloi, et autres
Publié: (2023)
Hierarchical Decoding for Discrete Speech Synthesis with Multi-Resolution Spoof Detection
par: Zhao, Junchuan, et autres
Publié: (2026)
par: Zhao, Junchuan, et autres
Publié: (2026)
Enhancing Speech Emotion Recognition with Multi-Task Learning and Dynamic Feature Fusion
par: Wang, Honghong, et autres
Publié: (2025)
par: Wang, Honghong, et autres
Publié: (2025)
Speech Bandwidth Expansion Via High Fidelity Generative Adversarial Networks
par: Salhab, Mahmoud, et autres
Publié: (2024)
par: Salhab, Mahmoud, et autres
Publié: (2024)
SaD: A Scenario-Aware Discriminator for Speech Enhancement
par: Yuan, Xihao, et autres
Publié: (2025)
par: Yuan, Xihao, et autres
Publié: (2025)
Diffusion-based Generative Modeling with Discriminative Guidance for Streamable Speech Enhancement
par: Li, Chenda, et autres
Publié: (2024)
par: Li, Chenda, et autres
Publié: (2024)
Contrastive Learning With Audio Discrimination For Customizable Keyword Spotting In Continuous Speech
par: Xi, Yu, et autres
Publié: (2024)
par: Xi, Yu, et autres
Publié: (2024)
Towards Robust Speech Deepfake Detection via Human-Inspired Reasoning
par: Dvirniak, Artem, et autres
Publié: (2026)
par: Dvirniak, Artem, et autres
Publié: (2026)
Multi-Channel Speech Enhancement for Cocktail Party Speech Emotion Recognition
par: Chen, Youjun, et autres
Publié: (2026)
par: Chen, Youjun, et autres
Publié: (2026)
Speech Enhancement with Dual-path Multi-Channel Linear Prediction Filter and Multi-norm Beamforming
par: Qin, Chengyuan, et autres
Publié: (2025)
par: Qin, Chengyuan, et autres
Publié: (2025)
DDTSE: Discriminative Diffusion Model for Target Speech Extraction
par: Zhang, Leying, et autres
Publié: (2023)
par: Zhang, Leying, et autres
Publié: (2023)
X-Talk: On the Underestimated Potential of Modular Speech-to-Speech Dialogue System
par: Liu, Zhanxun, et autres
Publié: (2025)
par: Liu, Zhanxun, et autres
Publié: (2025)
NVBench: A Benchmark for Speech Synthesis with Non-Verbal Vocalizations
par: Xue, Liumeng, et autres
Publié: (2026)
par: Xue, Liumeng, et autres
Publié: (2026)
CogSR: Semantic-Aware Speech Super-Resolution via Chain-of-Thought Guided Flow Matching
par: Yuan, Jiajun, et autres
Publié: (2025)
par: Yuan, Jiajun, et autres
Publié: (2025)
WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation
par: Li, Longhao, et autres
Publié: (2025)
par: Li, Longhao, et autres
Publié: (2025)
DELULU: Discriminative Embedding Learning Using Latent Units for Speaker-Aware Self-Trained Speech Foundational Model
par: Baali, Massa, et autres
Publié: (2025)
par: Baali, Massa, et autres
Publié: (2025)
Milestones in Bengali Sentiment Analysis leveraging Transformer-models: Fundamentals, Challenges and Future Directions
par: Sengupta, Saptarshi, et autres
Publié: (2024)
par: Sengupta, Saptarshi, et autres
Publié: (2024)
NaijaS2ST: A Multi-Accent Benchmark for Speech-to-Speech Translation in Low-Resource Nigerian Languages
par: Maltais, Marie, et autres
Publié: (2026)
par: Maltais, Marie, et autres
Publié: (2026)
Textless and Non-Parallel Speech-to-Speech Emotion Style Transfer
par: Dutta, Soumya, et autres
Publié: (2025)
par: Dutta, Soumya, et autres
Publié: (2025)
Documents similaires
-
CIS-BWE: Chaos-Informed Speech Bandwidth Extension
par: Tamiti, Tarikul Islam, et autres
Publié: (2025) -
HVAC-EAR: Eavesdropping Human Speech Using HVAC Systems
par: Tamiti, Tarikul Islam, et autres
Publié: (2025) -
WaLi: Can Pressure Sensors in HVAC Systems Capture Human Speech?
par: Tamiti, Tarikul Islam, et autres
Publié: (2025) -
A High-Fidelity Speech Super Resolution Network using a Complex Global Attention Module with Spectro-Temporal Loss
par: Tamiti, Tarikul Islam, et autres
Publié: (2025) -
SUBARU: A Practical Approach to Power Saving in Hearables Using SUB-Nyquist Audio Resolution Upsampling
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)