Enregistré dans:
| Auteurs principaux: | Lanzendörfer, Luca A., Grötschla, Florian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2511.19734 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SNAC: Multi-Scale Neural Audio Codec
par: Siuzdak, Hubert, et autres
Publié: (2024)
par: Siuzdak, Hubert, et autres
Publié: (2024)
High-Fidelity Music Vocoder using Neural Audio Codecs
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
Towards Leveraging Contrastively Pretrained Neural Audio Embeddings for Recommender Tasks
par: Grötschla, Florian, et autres
Publié: (2024)
par: Grötschla, Florian, et autres
Publié: (2024)
Audio Atlas: Visualizing and Exploring Audio Datasets
par: Lanzendörfer, Luca A., et autres
Publié: (2024)
par: Lanzendörfer, Luca A., et autres
Publié: (2024)
Benchmarking Music Generation Models and Metrics via Human Preference Studies
par: Grötschla, Florian, et autres
Publié: (2025)
par: Grötschla, Florian, et autres
Publié: (2025)
SALSA-V: Shortcut-Augmented Long-form Synchronized Audio from Videos
par: Dellali, Amir, et autres
Publié: (2025)
par: Dellali, Amir, et autres
Publié: (2025)
Multi-bit Audio Watermarking
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
Source Separation for A Cappella Music
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
Adapting Neural Audio Codecs to EEG
par: Kastrati, Ard, et autres
Publié: (2025)
par: Kastrati, Ard, et autres
Publié: (2025)
Parametric Neural Amp Modeling with Active Learning
par: Grötschla, Florian, et autres
Publié: (2025)
par: Grötschla, Florian, et autres
Publié: (2025)
Benchmarking Diarization Models
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
Bias beyond Borders: Global Inequalities in AI-Generated Music
par: Solak, Ahmet, et autres
Publié: (2025)
par: Solak, Ahmet, et autres
Publié: (2025)
MaskBeat: Loopable Drum Beat Generation
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
SAO-Instruct: Free-form Audio Editing using Natural Language Instructions
par: Ungersböck, Michael, et autres
Publié: (2025)
par: Ungersböck, Michael, et autres
Publié: (2025)
VCNAC: A Variable-Channel Neural Audio Codec for Mono, Stereo, and Surround Sound
par: Grötschla, Florian, et autres
Publié: (2026)
par: Grötschla, Florian, et autres
Publié: (2026)
LLM-Codec: Neural Audio Codec Meets Language Model Objectives
par: Chung, Ho-Lam, et autres
Publié: (2026)
par: Chung, Ho-Lam, et autres
Publié: (2026)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
High-Fidelity Speech Enhancement via Discrete Audio Tokens
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
Evaluation of Audio Compression Codecs
par: Duong, Thien T., et autres
Publié: (2025)
par: Duong, Thien T., et autres
Publié: (2025)
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
par: Chen, Xuanjun, et autres
Publié: (2025)
par: Chen, Xuanjun, et autres
Publié: (2025)
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
par: Li, Jiaqi, et autres
Publié: (2024)
par: Li, Jiaqi, et autres
Publié: (2024)
AffectCodec: Emotion-Preserving Neural Speech Codec for Expressive Speech Modeling
par: Shi, Jiacheng, et autres
Publié: (2026)
par: Shi, Jiacheng, et autres
Publié: (2026)
How to Label Resynthesized Audio: The Dual Role of Neural Audio Codecs in Audio Deepfake Detection
par: Xiao, Yixuan, et autres
Publié: (2026)
par: Xiao, Yixuan, et autres
Publié: (2026)
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
par: Li, Jiaqi, et autres
Publié: (2025)
par: Li, Jiaqi, et autres
Publié: (2025)
BANC: Towards Efficient Binaural Audio Neural Codec for Overlapping Speech
par: Ratnarajah, Anton, et autres
Publié: (2023)
par: Ratnarajah, Anton, et autres
Publié: (2023)
FlexiCodec: A Dynamic Neural Audio Codec for Low Frame Rates
par: Li, Jiaqi, et autres
Publié: (2025)
par: Li, Jiaqi, et autres
Publié: (2025)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
par: Wang, Lu, et autres
Publié: (2025)
par: Wang, Lu, et autres
Publié: (2025)
ADNAC: Audio Denoiser using Neural Audio Codec
par: Jimon, Daniel, et autres
Publié: (2025)
par: Jimon, Daniel, et autres
Publié: (2025)
Speech Enhancement Using Continuous Embeddings of Neural Audio Codec
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Personalized Neural Speech Codec
par: Jang, Inseon, et autres
Publié: (2024)
par: Jang, Inseon, et autres
Publié: (2024)
Soft Disentanglement in Frequency Bands for Neural Audio Codecs
par: Ginies, Benoit, et autres
Publié: (2025)
par: Ginies, Benoit, et autres
Publié: (2025)
EMO-Codec: An In-Depth Look at Emotion Preservation capacity of Legacy and Neural Codec Models With Subjective and Objective Evaluations
par: Ren, Wenze, et autres
Publié: (2024)
par: Ren, Wenze, et autres
Publié: (2024)
Towards Audio Codec-based Speech Separation
par: Yip, Jia Qi, et autres
Publié: (2024)
par: Yip, Jia Qi, et autres
Publié: (2024)
AffectCodec: Emotion-Preserving Neural Speech Codec with Block-Diagonal Residual FSQ
par: Meng, Zhaoyang, et autres
Publié: (2026)
par: Meng, Zhaoyang, et autres
Publié: (2026)
Harmonic-Percussive Disentangled Neural Audio Codec for Bandwidth Extension
par: Giniès, Benoît, et autres
Publié: (2025)
par: Giniès, Benoît, et autres
Publié: (2025)
Codec-Based Deepfake Source Tracing via Neural Audio Codec Taxonomy
par: Chen, Xuanjun, et autres
Publié: (2025)
par: Chen, Xuanjun, et autres
Publié: (2025)
CodecSep: Prompt-Driven Universal Sound Separation on Neural Audio Codec Latents
par: Banerjee, Adhiraj, et autres
Publié: (2025)
par: Banerjee, Adhiraj, et autres
Publié: (2025)
Towards Neural Audio Codec Source Parsing
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec
par: Xin, Detai, et autres
Publié: (2024)
par: Xin, Detai, et autres
Publié: (2024)
Trade-offs Between Capacity and Robustness in Neural Audio Codecs for Adversarially Robust Speech Recognition
par: Prescott, Jordan, et autres
Publié: (2026)
par: Prescott, Jordan, et autres
Publié: (2026)
Documents similaires
-
SNAC: Multi-Scale Neural Audio Codec
par: Siuzdak, Hubert, et autres
Publié: (2024) -
High-Fidelity Music Vocoder using Neural Audio Codecs
par: Lanzendörfer, Luca A., et autres
Publié: (2025) -
Towards Leveraging Contrastively Pretrained Neural Audio Embeddings for Recommender Tasks
par: Grötschla, Florian, et autres
Publié: (2024) -
Audio Atlas: Visualizing and Exploring Audio Datasets
par: Lanzendörfer, Luca A., et autres
Publié: (2024) -
Benchmarking Music Generation Models and Metrics via Human Preference Studies
par: Grötschla, Florian, et autres
Publié: (2025)