Salvato in:
| Autori principali: | Giniès, Benoît, Bie, Xiaoyu, Fercoq, Olivier, Richard, Gaël |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2511.21580 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Soft Disentanglement in Frequency Bands for Neural Audio Codecs
di: Ginies, Benoit, et al.
Pubblicazione: (2025)
di: Ginies, Benoit, et al.
Pubblicazione: (2025)
Désentrelacement Fréquentiel Doux pour les Codecs Audio Neuronaux
di: Giniès, Benoît, et al.
Pubblicazione: (2025)
di: Giniès, Benoît, et al.
Pubblicazione: (2025)
Using Random Codebooks for Audio Neural AutoEncoders
di: Giniès, Benoît, et al.
Pubblicazione: (2024)
di: Giniès, Benoît, et al.
Pubblicazione: (2024)
Learning Source Disentanglement in Neural Audio Codec
di: Bie, Xiaoyu, et al.
Pubblicazione: (2024)
di: Bie, Xiaoyu, et al.
Pubblicazione: (2024)
CodecFlow: Efficient Bandwidth Extension via Conditional Flow Matching in Neural Codec Latent Space
di: Zhang, Bowen, et al.
Pubblicazione: (2026)
di: Zhang, Bowen, et al.
Pubblicazione: (2026)
DeCodec: Rethinking Audio Codecs as Universal Disentangled Representation Learners
di: Luo, Xiaoxue, et al.
Pubblicazione: (2025)
di: Luo, Xiaoxue, et al.
Pubblicazione: (2025)
WaveTransfer: A Flexible End-to-end Multi-instrument Timbre Transfer with Diffusion
di: Baoueb, Teysir, et al.
Pubblicazione: (2024)
di: Baoueb, Teysir, et al.
Pubblicazione: (2024)
Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models
di: Baoueb, Teysir, et al.
Pubblicazione: (2025)
di: Baoueb, Teysir, et al.
Pubblicazione: (2025)
GLA-Grad++: An Improved Griffin-Lim Guided Diffusion Model for Speech Synthesis
di: Baoueb, Teysir, et al.
Pubblicazione: (2025)
di: Baoueb, Teysir, et al.
Pubblicazione: (2025)
LLM-Codec: Neural Audio Codec Meets Language Model Objectives
di: Chung, Ho-Lam, et al.
Pubblicazione: (2026)
di: Chung, Ho-Lam, et al.
Pubblicazione: (2026)
FlexiCodec: A Dynamic Neural Audio Codec for Low Frame Rates
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
Adapting Neural Audio Codecs to EEG
di: Kastrati, Ard, et al.
Pubblicazione: (2025)
di: Kastrati, Ard, et al.
Pubblicazione: (2025)
ADNAC: Audio Denoiser using Neural Audio Codec
di: Jimon, Daniel, et al.
Pubblicazione: (2025)
di: Jimon, Daniel, et al.
Pubblicazione: (2025)
QINCODEC: Neural Audio Compression with Implicit Neural Codebooks
di: Lahrichi, Zineb, et al.
Pubblicazione: (2025)
di: Lahrichi, Zineb, et al.
Pubblicazione: (2025)
Fast and Flexible Audio Bandwidth Extension via Vocos
di: Sharma, Yatharth
Pubblicazione: (2026)
di: Sharma, Yatharth
Pubblicazione: (2026)
Evaluating Objective Speech Quality Metrics for Neural Audio Codecs
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
Codec-Based Deepfake Source Tracing via Neural Audio Codec Taxonomy
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
di: Shi, Jiatong, et al.
Pubblicazione: (2024)
di: Shi, Jiatong, et al.
Pubblicazione: (2024)
CodecSep: Prompt-Driven Universal Sound Separation on Neural Audio Codec Latents
di: Banerjee, Adhiraj, et al.
Pubblicazione: (2025)
di: Banerjee, Adhiraj, et al.
Pubblicazione: (2025)
Evaluation of Audio Compression Codecs
di: Duong, Thien T., et al.
Pubblicazione: (2025)
di: Duong, Thien T., et al.
Pubblicazione: (2025)
Towards Neural Audio Codec Source Parsing
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2025)
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2025)
How to Label Resynthesized Audio: The Dual Role of Neural Audio Codecs in Audio Deepfake Detection
di: Xiao, Yixuan, et al.
Pubblicazione: (2026)
di: Xiao, Yixuan, et al.
Pubblicazione: (2026)
Code Drift: Towards Idempotent Neural Audio Codecs
di: O'Reilly, Patrick, et al.
Pubblicazione: (2024)
di: O'Reilly, Patrick, et al.
Pubblicazione: (2024)
HILCodec: High-Fidelity and Lightweight Neural Audio Codec
di: Ahn, Sunghwan, et al.
Pubblicazione: (2024)
di: Ahn, Sunghwan, et al.
Pubblicazione: (2024)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
di: Wang, Lu, et al.
Pubblicazione: (2025)
di: Wang, Lu, et al.
Pubblicazione: (2025)
Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation
di: Pina, Leonardo, et al.
Pubblicazione: (2024)
di: Pina, Leonardo, et al.
Pubblicazione: (2024)
SNAC: Multi-Scale Neural Audio Codec
di: Siuzdak, Hubert, et al.
Pubblicazione: (2024)
di: Siuzdak, Hubert, et al.
Pubblicazione: (2024)
High-Fidelity Music Vocoder using Neural Audio Codecs
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs
di: Sadok, Samir, et al.
Pubblicazione: (2026)
di: Sadok, Samir, et al.
Pubblicazione: (2026)
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
Blind Audio Bandwidth Extension: A Diffusion-Based Zero-Shot Approach
di: Moliner, Eloi, et al.
Pubblicazione: (2023)
di: Moliner, Eloi, et al.
Pubblicazione: (2023)
A Cold Diffusion Approach for Percussive Dereverberation
di: Makris, Dimos, et al.
Pubblicazione: (2026)
di: Makris, Dimos, et al.
Pubblicazione: (2026)
Codec-Robust Attacks on Audio LLMs
di: Roh, Jaechul, et al.
Pubblicazione: (2026)
di: Roh, Jaechul, et al.
Pubblicazione: (2026)
UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook
di: Jiang, Yidi, et al.
Pubblicazione: (2025)
di: Jiang, Yidi, et al.
Pubblicazione: (2025)
On the Language and Gender Biases in PSTN, VoIP and Neural Audio Codecs
di: Altwlkany, Kemal, et al.
Pubblicazione: (2025)
di: Altwlkany, Kemal, et al.
Pubblicazione: (2025)
BANC: Towards Efficient Binaural Audio Neural Codec for Overlapping Speech
di: Ratnarajah, Anton, et al.
Pubblicazione: (2023)
di: Ratnarajah, Anton, et al.
Pubblicazione: (2023)
A Streamable Neural Audio Codec with Residual Scalar-Vector Quantization for Real-Time Communication
di: Jiang, Xiao-Hang, et al.
Pubblicazione: (2025)
di: Jiang, Xiao-Hang, et al.
Pubblicazione: (2025)
Drum Synthesis from Expressive Drum Grids via Neural Audio Codecs
di: Soiledis, Konstantinos, et al.
Pubblicazione: (2026)
di: Soiledis, Konstantinos, et al.
Pubblicazione: (2026)
ComplexDec: A Domain-robust High-fidelity Neural Audio Codec with Complex Spectrum Modeling
di: Wu, Yi-Chiao, et al.
Pubblicazione: (2025)
di: Wu, Yi-Chiao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Soft Disentanglement in Frequency Bands for Neural Audio Codecs
di: Ginies, Benoit, et al.
Pubblicazione: (2025) -
Désentrelacement Fréquentiel Doux pour les Codecs Audio Neuronaux
di: Giniès, Benoît, et al.
Pubblicazione: (2025) -
Using Random Codebooks for Audio Neural AutoEncoders
di: Giniès, Benoît, et al.
Pubblicazione: (2024) -
Learning Source Disentanglement in Neural Audio Codec
di: Bie, Xiaoyu, et al.
Pubblicazione: (2024) -
CodecFlow: Efficient Bandwidth Extension via Conditional Flow Matching in Neural Codec Latent Space
di: Zhang, Bowen, et al.
Pubblicazione: (2026)