Deep Active Speech Cancellation with Mamba-Masking Network
Fuente:
arXiv
Salvato in:
| Autori principali: | Mishaly, Yehuda, Wolf, Lior, Nachmani, Eliya |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation
di: Yaish, Ofir, et al.
Pubblicazione: (2025)
di: Yaish, Ofir, et al.
Pubblicazione: (2025)
MaskSR: Masked Language Model for Full-band Speech Restoration
di: Li, Xu, et al.
Pubblicazione: (2024)
di: Li, Xu, et al.
Pubblicazione: (2024)
Metis: A Foundation Speech Generation Model with Masked Generative Pre-training
di: Wang, Yuancheng, et al.
Pubblicazione: (2025)
di: Wang, Yuancheng, et al.
Pubblicazione: (2025)
Toward Optimal ANC: Establishing Mutual Information Lower Bound
di: Derrida, François, et al.
Pubblicazione: (2025)
di: Derrida, François, et al.
Pubblicazione: (2025)
Advances in Intelligent Hearing Aids: Deep Learning Approaches to Selective Noise Cancellation
di: Khan, Haris, et al.
Pubblicazione: (2025)
di: Khan, Haris, et al.
Pubblicazione: (2025)
Scaling Transformers for Low-Bitrate High-Quality Speech Coding
di: Parker, Julian D, et al.
Pubblicazione: (2024)
di: Parker, Julian D, et al.
Pubblicazione: (2024)
Can Layer-wise SSL Features Improve Zero-Shot ASR Performance for Children's Speech?
di: Sinha, Abhijit, et al.
Pubblicazione: (2025)
di: Sinha, Abhijit, et al.
Pubblicazione: (2025)
Perceptual Noise-Masking with Music through Deep Spectral Envelope Shaping
di: Berger, Clémentine, et al.
Pubblicazione: (2025)
di: Berger, Clémentine, et al.
Pubblicazione: (2025)
Joint Semantic Knowledge Distillation and Masked Acoustic Modeling for Full-band Speech Restoration with Improved Intelligibility
di: Liu, Xiaoyu, et al.
Pubblicazione: (2024)
di: Liu, Xiaoyu, et al.
Pubblicazione: (2024)
Gaussian Process Regression of Steering Vectors With Physics-Aware Deep Composite Kernels for Augmented Listening
di: Di Carlo, Diego, et al.
Pubblicazione: (2025)
di: Di Carlo, Diego, et al.
Pubblicazione: (2025)
ANIRA: An Architecture for Neural Network Inference in Real-Time Audio Applications
di: Ackva, Valentin, et al.
Pubblicazione: (2025)
di: Ackva, Valentin, et al.
Pubblicazione: (2025)
Neural Brain Fields: A NeRF-Inspired Approach for Generating Nonexistent EEG Electrodes
di: Kedem, Shahar Ain, et al.
Pubblicazione: (2025)
di: Kedem, Shahar Ain, et al.
Pubblicazione: (2025)
Zero-Shot Mono-to-Binaural Speech Synthesis
di: Levkovitch, Alon, et al.
Pubblicazione: (2024)
di: Levkovitch, Alon, et al.
Pubblicazione: (2024)
Automatic Speech Recognition using Advanced Deep Learning Approaches: A survey
di: Kheddar, Hamza, et al.
Pubblicazione: (2024)
di: Kheddar, Hamza, et al.
Pubblicazione: (2024)
CochCeps-Augment: A Novel Self-Supervised Contrastive Learning Using Cochlear Cepstrum-based Masking for Speech Emotion Recognition
di: Ziogas, Ioannis, et al.
Pubblicazione: (2024)
di: Ziogas, Ioannis, et al.
Pubblicazione: (2024)
Speech Boosting: Low-Latency Live Speech Enhancement for TWS Earbuds
di: Bae, Hanbin, et al.
Pubblicazione: (2024)
di: Bae, Hanbin, et al.
Pubblicazione: (2024)
CrossSpeech++: Cross-lingual Speech Synthesis with Decoupled Language and Speaker Generation
di: Kim, Ji-Hoon, et al.
Pubblicazione: (2024)
di: Kim, Ji-Hoon, et al.
Pubblicazione: (2024)
SWIM: Short-Window CNN Integrated with Mamba for EEG-Based Auditory Spatial Attention Decoding
di: Zhang, Ziyang, et al.
Pubblicazione: (2024)
di: Zhang, Ziyang, et al.
Pubblicazione: (2024)
Audio-JEPA: Joint-Embedding Predictive Architecture for Audio Representation Learning
di: Tuncay, Ludovic, et al.
Pubblicazione: (2025)
di: Tuncay, Ludovic, et al.
Pubblicazione: (2025)
Pitch-Conditioned Instrument Sound Synthesis From an Interactive Timbre Latent Space
di: Limberg, Christian, et al.
Pubblicazione: (2025)
di: Limberg, Christian, et al.
Pubblicazione: (2025)
AudioFuse: Unified Spectral-Temporal Learning via a Hybrid ViT-1D CNN Architecture for Robust Phonocardiogram Classification
di: Siddiqui, Md. Saiful Bari, et al.
Pubblicazione: (2025)
di: Siddiqui, Md. Saiful Bari, et al.
Pubblicazione: (2025)
Model as Loss: A Self-Consistent Training Paradigm
di: Phaye, Saisamarth Rajesh, et al.
Pubblicazione: (2025)
di: Phaye, Saisamarth Rajesh, et al.
Pubblicazione: (2025)
When Humans Growl and Birds Speak: High-Fidelity Voice Conversion from Human to Animal and Designed Sounds
di: Kang, Minsu, et al.
Pubblicazione: (2025)
di: Kang, Minsu, et al.
Pubblicazione: (2025)
Lightweight Self-Supervised Detection of Fundamental Frequency and Accurate Probability of Voicing in Monophonic Music
di: Bitra, Venkat Suprabath, et al.
Pubblicazione: (2026)
di: Bitra, Venkat Suprabath, et al.
Pubblicazione: (2026)
PeriodWave: Multi-Period Flow Matching for High-Fidelity Waveform Generation
di: Lee, Sang-Hoon, et al.
Pubblicazione: (2024)
di: Lee, Sang-Hoon, et al.
Pubblicazione: (2024)
An Explainable Proxy Model for Multiabel Audio Segmentation
di: Mariotte, Théo, et al.
Pubblicazione: (2024)
di: Mariotte, Théo, et al.
Pubblicazione: (2024)
T-FOLEY: A Controllable Waveform-Domain Diffusion Model for Temporal-Event-Guided Foley Sound Synthesis
di: Chung, Yoonjin, et al.
Pubblicazione: (2024)
di: Chung, Yoonjin, et al.
Pubblicazione: (2024)
LMAC-TD: Producing Time Domain Explanations for Audio Classifiers
di: Mancini, Eleonora, et al.
Pubblicazione: (2024)
di: Mancini, Eleonora, et al.
Pubblicazione: (2024)
Gull: A Generative Multifunctional Audio Codec
di: Luo, Yi, et al.
Pubblicazione: (2024)
di: Luo, Yi, et al.
Pubblicazione: (2024)
Design Of Rubble Analyzer Probe Using ML For Earthquake
di: Sebastian, Abhishek, et al.
Pubblicazione: (2023)
di: Sebastian, Abhishek, et al.
Pubblicazione: (2023)
Expressive Acoustic Guitar Sound Synthesis with an Instrument-Specific Input Representation and Diffusion Outpainting
di: Kim, Hounsu, et al.
Pubblicazione: (2024)
di: Kim, Hounsu, et al.
Pubblicazione: (2024)
ViolinDiff: Enhancing Expressive Violin Synthesis with Pitch Bend Conditioning
di: Kim, Daewoong, et al.
Pubblicazione: (2024)
di: Kim, Daewoong, et al.
Pubblicazione: (2024)
BUET Multi-disease Heart Sound Dataset: A Comprehensive Auscultation Dataset for Developing Computer-Aided Diagnostic Systems
di: Ali, Shams Nafisa, et al.
Pubblicazione: (2024)
di: Ali, Shams Nafisa, et al.
Pubblicazione: (2024)
Accelerating High-Fidelity Waveform Generation via Adversarial Flow Matching Optimization
di: Lee, Sang-Hoon, et al.
Pubblicazione: (2024)
di: Lee, Sang-Hoon, et al.
Pubblicazione: (2024)
Real-time Timbre Remapping with Differentiable DSP
di: Shier, Jordie, et al.
Pubblicazione: (2024)
di: Shier, Jordie, et al.
Pubblicazione: (2024)
TinyChirp: Bird Song Recognition Using TinyML Models on Low-power Wireless Acoustic Sensors
di: Huang, Zhaolan, et al.
Pubblicazione: (2024)
di: Huang, Zhaolan, et al.
Pubblicazione: (2024)
Token-Based Audio Inpainting via Discrete Diffusion
di: Dror, Tali, et al.
Pubblicazione: (2025)
di: Dror, Tali, et al.
Pubblicazione: (2025)
Single-stage TTS with Masked Audio Token Modeling and Semantic Knowledge Distillation
di: Gállego, Gerard I., et al.
Pubblicazione: (2024)
di: Gállego, Gerard I., et al.
Pubblicazione: (2024)
Speech Enhancement Based on Drifting Models
di: Xu, Liang, et al.
Pubblicazione: (2026)
di: Xu, Liang, et al.
Pubblicazione: (2026)
Translatotron 3: Speech to Speech Translation with Monolingual Data
di: Nachmani, Eliya, et al.
Pubblicazione: (2023)
di: Nachmani, Eliya, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation
di: Yaish, Ofir, et al.
Pubblicazione: (2025) -
MaskSR: Masked Language Model for Full-band Speech Restoration
di: Li, Xu, et al.
Pubblicazione: (2024) -
Metis: A Foundation Speech Generation Model with Masked Generative Pre-training
di: Wang, Yuancheng, et al.
Pubblicazione: (2025) -
Toward Optimal ANC: Establishing Mutual Information Lower Bound
di: Derrida, François, et al.
Pubblicazione: (2025) -
Advances in Intelligent Hearing Aids: Deep Learning Approaches to Selective Noise Cancellation
di: Khan, Haris, et al.
Pubblicazione: (2025)