Perceptual Noise-Masking with Music through Deep Spectral Envelope Shaping
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Berger, Clémentine, Badeau, Roland, Essid, Slim |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IS${}^3$ : Generic Impulsive--Stationary Sound Separation in Acoustic Scenes using Deep Filtering
par: Berger, Clémentine, et autres
Publié: (2025)
par: Berger, Clémentine, et autres
Publié: (2025)
Contrastive Knowledge Distillation for Embedding Refinement in Personalized Speech Enhancement
par: Serre, Thomas, et autres
Publié: (2026)
par: Serre, Thomas, et autres
Publié: (2026)
Learning Perceptually Relevant Temporal Envelope Morphing
par: Dixit, Satvik, et autres
Publié: (2025)
par: Dixit, Satvik, et autres
Publié: (2025)
Online speaker diarization of meetings guided by speech separation
par: Gruttadauria, Elio, et autres
Publié: (2024)
par: Gruttadauria, Elio, et autres
Publié: (2024)
A sound description: Exploring prompt templates and class descriptions to enhance zero-shot audio classification
par: Olvera, Michel, et autres
Publié: (2024)
par: Olvera, Michel, et autres
Publié: (2024)
Modèle physique variationnel pour l'estimation de réponses impulsionnelles de salles
par: Lalay, Louis, et autres
Publié: (2025)
par: Lalay, Louis, et autres
Publié: (2025)
Advances in Intelligent Hearing Aids: Deep Learning Approaches to Selective Noise Cancellation
par: Khan, Haris, et autres
Publié: (2025)
par: Khan, Haris, et autres
Publié: (2025)
A Domain-Knowledge-Inspired Music Embedding Space and a Novel Attention Mechanism for Symbolic Music Modeling
par: Guo, Z., et autres
Publié: (2022)
par: Guo, Z., et autres
Publié: (2022)
AI-Generated Music Detection in Broadcast Monitoring
par: López-Ayala, David, et autres
Publié: (2026)
par: López-Ayala, David, et autres
Publié: (2026)
Single-stage TTS with Masked Audio Token Modeling and Semantic Knowledge Distillation
par: Gállego, Gerard I., et autres
Publié: (2024)
par: Gállego, Gerard I., et autres
Publié: (2024)
Speech Self-Supervised Representations Benchmarking: a Case for Larger Probing Heads
par: Zaiem, Salah, et autres
Publié: (2023)
par: Zaiem, Salah, et autres
Publié: (2023)
Joint Semantic Knowledge Distillation and Masked Acoustic Modeling for Full-band Speech Restoration with Improved Intelligibility
par: Liu, Xiaoyu, et autres
Publié: (2024)
par: Liu, Xiaoyu, et autres
Publié: (2024)
SpecDiff-GAN: A Spectrally-Shaped Noise Diffusion GAN for Speech and Music Synthesis
par: Baoueb, Teysir, et autres
Publié: (2024)
par: Baoueb, Teysir, et autres
Publié: (2024)
Analyzable Chain-of-Musical-Thought Prompting for High-Fidelity Music Generation
par: Lam, Max W. Y., et autres
Publié: (2025)
par: Lam, Max W. Y., et autres
Publié: (2025)
CSL-L2M: Controllable Song-Level Lyric-to-Melody Generation Based on Conditional Transformer with Fine-Grained Lyric and Musical Controls
par: Chai, Li, et autres
Publié: (2024)
par: Chai, Li, et autres
Publié: (2024)
Deep Active Speech Cancellation with Mamba-Masking Network
par: Mishaly, Yehuda, et autres
Publié: (2025)
par: Mishaly, Yehuda, et autres
Publié: (2025)
Automatic Speech Recognition using Advanced Deep Learning Approaches: A survey
par: Kheddar, Hamza, et autres
Publié: (2024)
par: Kheddar, Hamza, et autres
Publié: (2024)
Classification of Heart Sounds Using Multi-Branch Deep Convolutional Network and LSTM-CNN
par: Latifi, Seyed Amir, et autres
Publié: (2024)
par: Latifi, Seyed Amir, et autres
Publié: (2024)
Towards Improving Speaker Distance Estimation through Generative Impulse Response Augmentation
par: Ratnarajah, Anton, et autres
Publié: (2026)
par: Ratnarajah, Anton, et autres
Publié: (2026)
Perceptual Musical Features for Interpretable Audio Tagging
par: Lyberatos, Vassilis, et autres
Publié: (2023)
par: Lyberatos, Vassilis, et autres
Publié: (2023)
MaskSR: Masked Language Model for Full-band Speech Restoration
par: Li, Xu, et autres
Publié: (2024)
par: Li, Xu, et autres
Publié: (2024)
Controlling Contrastive Self-Supervised Learning with Knowledge-Driven Multiple Hypothesis: Application to Beat Tracking
par: Gagnere, Antonin, et autres
Publié: (2025)
par: Gagnere, Antonin, et autres
Publié: (2025)
Less Forgetting for Better Generalization: Exploring Continual-learning Fine-tuning Methods for Speech Self-supervised Representations
par: Zaiem, Salah, et autres
Publié: (2024)
par: Zaiem, Salah, et autres
Publié: (2024)
A Contrastive Self-Supervised Learning scheme for beat tracking amenable to few-shot learning
par: Gagnere, Antonin, et autres
Publié: (2024)
par: Gagnere, Antonin, et autres
Publié: (2024)
SALT: Standardized Audio event Label Taxonomy
par: Stamatiadis, Paraskevas, et autres
Publié: (2024)
par: Stamatiadis, Paraskevas, et autres
Publié: (2024)
DDD: A Perceptually Superior Low-Response-Time DNN-based Declipper
par: Yi, Jayeon, et autres
Publié: (2024)
par: Yi, Jayeon, et autres
Publié: (2024)
Compressing Quaternion Convolutional Neural Networks for Audio Classification
par: Singh, Arshdeep, et autres
Publié: (2025)
par: Singh, Arshdeep, et autres
Publié: (2025)
Towards Low-Latency Tracking of Multiple Speakers With Short-Context Speaker Embeddings
par: Iatariene, Taous, et autres
Publié: (2025)
par: Iatariene, Taous, et autres
Publié: (2025)
U-DREAM: Unsupervised Dereverberation guided by a Reverberation Model
par: Bahrman, Louis, et autres
Publié: (2025)
par: Bahrman, Louis, et autres
Publié: (2025)
A Hybrid Model for Weakly-Supervised Speech Dereverberation
par: Bahrman, Louis, et autres
Publié: (2025)
par: Bahrman, Louis, et autres
Publié: (2025)
VoicePrompter: Robust Zero-Shot Voice Conversion with Voice Prompt and Conditional Flow Matching
par: Choi, Ha-Yeong, et autres
Publié: (2025)
par: Choi, Ha-Yeong, et autres
Publié: (2025)
Resounding Acoustic Fields with Reciprocity
par: Lan, Zitong, et autres
Publié: (2025)
par: Lan, Zitong, et autres
Publié: (2025)
UniverSR: Unified and Versatile Audio Super-Resolution via Vocoder-Free Flow Matching
par: Choi, Woongjib, et autres
Publié: (2025)
par: Choi, Woongjib, et autres
Publié: (2025)
Dynamic Multi-Species Bird Soundscape Generation with Acoustic Patterning and 3D Spatialization
par: Zhang, Ellie L., et autres
Publié: (2025)
par: Zhang, Ellie L., et autres
Publié: (2025)
Acoustic Imaging for UAV Detection: Dense Beamformed Energy Maps and U-Net SELD
par: Rodriguez, Belman Jahir, et autres
Publié: (2025)
par: Rodriguez, Belman Jahir, et autres
Publié: (2025)
Prompt-Unseen-Emotion: Zero-shot Expressive Speech Synthesis with Prompt-LLM Contextual Knowledge for Mixed Emotions
par: Gao, Xiaoxue, et autres
Publié: (2025)
par: Gao, Xiaoxue, et autres
Publié: (2025)
Mind the Prompt: Prompting Strategies in Audio Generations for Improving Sound Classification
par: Ronchini, Francesca, et autres
Publié: (2025)
par: Ronchini, Francesca, et autres
Publié: (2025)
Construction and Evaluation of Mandarin Multimodal Emotional Speech Database
par: Ting, Zhu, et autres
Publié: (2024)
par: Ting, Zhu, et autres
Publié: (2024)
Toward Fully-End-to-End Listened Speech Decoding from EEG Signals
par: Lee, Jihwan, et autres
Publié: (2024)
par: Lee, Jihwan, et autres
Publié: (2024)
Neural Speech and Audio Coding: Modern AI Technology Meets Traditional Codecs
par: Kim, Minje, et autres
Publié: (2024)
par: Kim, Minje, et autres
Publié: (2024)
Documents similaires
-
IS${}^3$ : Generic Impulsive--Stationary Sound Separation in Acoustic Scenes using Deep Filtering
par: Berger, Clémentine, et autres
Publié: (2025) -
Contrastive Knowledge Distillation for Embedding Refinement in Personalized Speech Enhancement
par: Serre, Thomas, et autres
Publié: (2026) -
Learning Perceptually Relevant Temporal Envelope Morphing
par: Dixit, Satvik, et autres
Publié: (2025) -
Online speaker diarization of meetings guided by speech separation
par: Gruttadauria, Elio, et autres
Publié: (2024) -
A sound description: Exploring prompt templates and class descriptions to enhance zero-shot audio classification
par: Olvera, Michel, et autres
Publié: (2024)