Toward Optimal ANC: Establishing Mutual Information Lower Bound
Fuente:
arXiv
Guardado en:
| Autores principales: | Derrida, François, Lutati, Shahar, Nachmani, Eliya |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Token-Based Audio Inpainting via Discrete Diffusion
por: Dror, Tali, et al.
Publicado: (2025)
por: Dror, Tali, et al.
Publicado: (2025)
Deep Active Speech Cancellation with Mamba-Masking Network
por: Mishaly, Yehuda, et al.
Publicado: (2025)
por: Mishaly, Yehuda, et al.
Publicado: (2025)
Neural Brain Fields: A NeRF-Inspired Approach for Generating Nonexistent EEG Electrodes
por: Kedem, Shahar Ain, et al.
Publicado: (2025)
por: Kedem, Shahar Ain, et al.
Publicado: (2025)
Two-Dimensional Quantization for Geometry-Aware Audio Coding
por: Shuster, Tal, et al.
Publicado: (2025)
por: Shuster, Tal, et al.
Publicado: (2025)
Zero-Shot Mono-to-Binaural Speech Synthesis
por: Levkovitch, Alon, et al.
Publicado: (2024)
por: Levkovitch, Alon, et al.
Publicado: (2024)
Multiple Choice Learning for Efficient Speech Separation with Many Speakers
por: Perera, David, et al.
Publicado: (2024)
por: Perera, David, et al.
Publicado: (2024)
Towards Robust Transcription: Exploring Noise Injection Strategies for Training Data Augmentation
por: Kim, Yonghyun, et al.
Publicado: (2024)
por: Kim, Yonghyun, et al.
Publicado: (2024)
Translatotron 3: Speech to Speech Translation with Monolingual Data
por: Nachmani, Eliya, et al.
Publicado: (2023)
por: Nachmani, Eliya, et al.
Publicado: (2023)
Evaluating Co-Creativity using Total Information Flow
por: Gokul, Vignesh, et al.
Publicado: (2024)
por: Gokul, Vignesh, et al.
Publicado: (2024)
Translation-Equivariant Self-Supervised Learning for Pitch Estimation with Optimal Transport
por: Torres, Bernardo, et al.
Publicado: (2025)
por: Torres, Bernardo, et al.
Publicado: (2025)
Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation
por: Yaish, Ofir, et al.
Publicado: (2025)
por: Yaish, Ofir, et al.
Publicado: (2025)
Contrastive and Transfer Learning for Effective Audio Fingerprinting through a Real-World Evaluation Protocol
por: Nikou, Christos, et al.
Publicado: (2025)
por: Nikou, Christos, et al.
Publicado: (2025)
Segment Length Matters: A Study of Segment Lengths on Audio Fingerprinting Performance
por: Gong, Ziling, et al.
Publicado: (2026)
por: Gong, Ziling, et al.
Publicado: (2026)
Evaluation of pretrained language models on music understanding
por: Vasilakis, Yannis, et al.
Publicado: (2024)
por: Vasilakis, Yannis, et al.
Publicado: (2024)
DeepSRGM -- Sequence Classification and Ranking in Indian Classical Music with Deep Learning
por: Madhusudhan, Sathwik Tejaswi, et al.
Publicado: (2024)
por: Madhusudhan, Sathwik Tejaswi, et al.
Publicado: (2024)
A Stem-Agnostic Single-Decoder System for Music Source Separation Beyond Four Stems
por: Watcharasupat, Karn N., et al.
Publicado: (2024)
por: Watcharasupat, Karn N., et al.
Publicado: (2024)
Towards Open Respiratory Acoustic Foundation Models: Pretraining and Benchmarking
por: Zhang, Yuwei, et al.
Publicado: (2024)
por: Zhang, Yuwei, et al.
Publicado: (2024)
Generative Semantic Communication for Text-to-Speech Synthesis
por: Zheng, Jiahao, et al.
Publicado: (2024)
por: Zheng, Jiahao, et al.
Publicado: (2024)
Towards Lightweight Adaptation of Speech Enhancement Models in Real-World Environments
por: Cheng, Longbiao, et al.
Publicado: (2026)
por: Cheng, Longbiao, et al.
Publicado: (2026)
Towards Human-in-the-Loop Onset Detection: A Transfer Learning Approach for Maracatu
por: Pinto, António Sá
Publicado: (2025)
por: Pinto, António Sá
Publicado: (2025)
SimulTron: On-Device Simultaneous Speech to Speech Translation
por: Agranovich, Alex, et al.
Publicado: (2024)
por: Agranovich, Alex, et al.
Publicado: (2024)
Futga: Towards Fine-grained Music Understanding through Temporally-enhanced Generative Augmentation
por: Wu, Junda, et al.
Publicado: (2024)
por: Wu, Junda, et al.
Publicado: (2024)
Diffusion Timbre Transfer Via Mutual Information Guided Inpainting
por: Lee, Ching Ho, et al.
Publicado: (2026)
por: Lee, Ching Ho, et al.
Publicado: (2026)
Speech-Forensics: Towards Comprehensive Synthetic Speech Dataset Establishment and Analysis
por: Ji, Zhoulin, et al.
Publicado: (2024)
por: Ji, Zhoulin, et al.
Publicado: (2024)
Towards Speaker Identification with Minimal Dataset and Constrained Resources using 1D-Convolution Neural Network
por: Shahan, Irfan Nafiz, et al.
Publicado: (2024)
por: Shahan, Irfan Nafiz, et al.
Publicado: (2024)
Pareto Data Framework: Steps Towards Resource-Efficient Decision Making Using Minimum Viable Data (MVD)
por: Ahmed, Tashfain, et al.
Publicado: (2024)
por: Ahmed, Tashfain, et al.
Publicado: (2024)
Emotional Text-To-Speech Based on Mutual-Information-Guided Emotion-Timbre Disentanglement
por: Yang, Jianing, et al.
Publicado: (2025)
por: Yang, Jianing, et al.
Publicado: (2025)
Towards Training Music Taggers on Synthetic Data
por: Kroher, Nadine, et al.
Publicado: (2024)
por: Kroher, Nadine, et al.
Publicado: (2024)
Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM
por: Nachmani, Eliya, et al.
Publicado: (2023)
por: Nachmani, Eliya, et al.
Publicado: (2023)
Disentangling Age and Identity with a Mutual Information Minimization Approach for Cross-Age Speaker Verification
por: Zhang, Fengrun, et al.
Publicado: (2024)
por: Zhang, Fengrun, et al.
Publicado: (2024)
Task and Perception-aware Distributed Source Coding for Correlated Speech under Bandwidth-constrained Channels
por: Bhattacharya, Sagnik, et al.
Publicado: (2025)
por: Bhattacharya, Sagnik, et al.
Publicado: (2025)
MUSE: Flexible Voiceprint Receptive Fields and Multi-Path Fusion Enhanced Taylor Transformer for U-Net-based Speech Enhancement
por: Lin, Zizhen, et al.
Publicado: (2024)
por: Lin, Zizhen, et al.
Publicado: (2024)
Purification Before Fusion: Toward Mask-Free Speech Enhancement for Robust Audio-Visual Speech Recognition
por: Wu, Linzhi, et al.
Publicado: (2026)
por: Wu, Linzhi, et al.
Publicado: (2026)
SSLAM: Enhancing Self-Supervised Models with Audio Mixtures for Polyphonic Soundscapes
por: Alex, Tony, et al.
Publicado: (2025)
por: Alex, Tony, et al.
Publicado: (2025)
Recognizing Ornaments in Vocal Indian Art Music with Active Annotation
por: Kumar, Sumit, et al.
Publicado: (2025)
por: Kumar, Sumit, et al.
Publicado: (2025)
SHAMaNS: Sound Localization with Hybrid Alpha-Stable Spatial Measure and Neural Steerer
por: Di Carlo, Diego, et al.
Publicado: (2025)
por: Di Carlo, Diego, et al.
Publicado: (2025)
Speech Command Recognition Using LogNNet Reservoir Computing for Embedded Systems
por: Izotov, Yuriy, et al.
Publicado: (2025)
por: Izotov, Yuriy, et al.
Publicado: (2025)
CoDiCodec: Unifying Continuous and Discrete Compressed Representations of Audio
por: Pasini, Marco, et al.
Publicado: (2025)
por: Pasini, Marco, et al.
Publicado: (2025)
AudioGenX: Explainability on Text-to-Audio Generative Models
por: Kang, Hyunju, et al.
Publicado: (2025)
por: Kang, Hyunju, et al.
Publicado: (2025)
A Novel Hybrid Deep Learning Technique for Speech Emotion Detection using Feature Engineering
por: Chowdhury, Shahana Yasmin, et al.
Publicado: (2025)
por: Chowdhury, Shahana Yasmin, et al.
Publicado: (2025)
Ejemplares similares
-
Token-Based Audio Inpainting via Discrete Diffusion
por: Dror, Tali, et al.
Publicado: (2025) -
Deep Active Speech Cancellation with Mamba-Masking Network
por: Mishaly, Yehuda, et al.
Publicado: (2025) -
Neural Brain Fields: A NeRF-Inspired Approach for Generating Nonexistent EEG Electrodes
por: Kedem, Shahar Ain, et al.
Publicado: (2025) -
Two-Dimensional Quantization for Geometry-Aware Audio Coding
por: Shuster, Tal, et al.
Publicado: (2025) -
Zero-Shot Mono-to-Binaural Speech Synthesis
por: Levkovitch, Alon, et al.
Publicado: (2024)