FlexiCodec: A Dynamic Neural Audio Codec for Low Frame Rates
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Jiaqi, Qian, Yao, Hu, Yuxuan, Zhang, Leying, Wang, Xiaofei, Lu, Heng, Thakker, Manthan, Li, Jinyu, Zhao, Sheng, Wu, Zhizheng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
von: Li, Jiaqi, et al.
Veröffentlicht: (2025)
von: Li, Jiaqi, et al.
Veröffentlicht: (2025)
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
von: Li, Jiaqi, et al.
Veröffentlicht: (2024)
von: Li, Jiaqi, et al.
Veröffentlicht: (2024)
SpeechX: Neural Codec Language Model as a Versatile Speech Transformer
von: Wang, Xiaofei, et al.
Veröffentlicht: (2023)
von: Wang, Xiaofei, et al.
Veröffentlicht: (2023)
CodecSlime: Temporal Redundancy Compression of Neural Speech Codec via Dynamic Frame Rate
von: Wang, Hankun, et al.
Veröffentlicht: (2025)
von: Wang, Hankun, et al.
Veröffentlicht: (2025)
CoVoMix2: Advancing Zero-Shot Dialogue Generation with Fully Non-Autoregressive Flow Matching
von: Zhang, Leying, et al.
Veröffentlicht: (2025)
von: Zhang, Leying, et al.
Veröffentlicht: (2025)
LLM-Codec: Neural Audio Codec Meets Language Model Objectives
von: Chung, Ho-Lam, et al.
Veröffentlicht: (2026)
von: Chung, Ho-Lam, et al.
Veröffentlicht: (2026)
U-Codec: Ultra Low Frame-rate Neural Speech Codec for Fast High-fidelity Speech Generation
von: Yang, Xusheng, et al.
Veröffentlicht: (2025)
von: Yang, Xusheng, et al.
Veröffentlicht: (2025)
UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook
von: Jiang, Yidi, et al.
Veröffentlicht: (2025)
von: Jiang, Yidi, et al.
Veröffentlicht: (2025)
Code Drift: Towards Idempotent Neural Audio Codecs
von: O'Reilly, Patrick, et al.
Veröffentlicht: (2024)
von: O'Reilly, Patrick, et al.
Veröffentlicht: (2024)
Unlocking Temporal Flexibility: Neural Speech Codec with Variable Frame Rate
von: Zhang, Hanglei, et al.
Veröffentlicht: (2025)
von: Zhang, Hanglei, et al.
Veröffentlicht: (2025)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
von: Wang, Lu, et al.
Veröffentlicht: (2025)
von: Wang, Lu, et al.
Veröffentlicht: (2025)
Adapting Neural Audio Codecs to EEG
von: Kastrati, Ard, et al.
Veröffentlicht: (2025)
von: Kastrati, Ard, et al.
Veröffentlicht: (2025)
DeCodec: Rethinking Audio Codecs as Universal Disentangled Representation Learners
von: Luo, Xiaoxue, et al.
Veröffentlicht: (2025)
von: Luo, Xiaoxue, et al.
Veröffentlicht: (2025)
SwitchCodec: A High-Fidelity Nerual Audio Codec With Sparse Quantization
von: Wang, Jin, et al.
Veröffentlicht: (2025)
von: Wang, Jin, et al.
Veröffentlicht: (2025)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
von: Shi, Jiatong, et al.
Veröffentlicht: (2024)
von: Shi, Jiatong, et al.
Veröffentlicht: (2024)
Codec-Based Deepfake Source Tracing via Neural Audio Codec Taxonomy
von: Chen, Xuanjun, et al.
Veröffentlicht: (2025)
von: Chen, Xuanjun, et al.
Veröffentlicht: (2025)
Evaluation of Audio Compression Codecs
von: Duong, Thien T., et al.
Veröffentlicht: (2025)
von: Duong, Thien T., et al.
Veröffentlicht: (2025)
CodecSep: Prompt-Driven Universal Sound Separation on Neural Audio Codec Latents
von: Banerjee, Adhiraj, et al.
Veröffentlicht: (2025)
von: Banerjee, Adhiraj, et al.
Veröffentlicht: (2025)
ADNAC: Audio Denoiser using Neural Audio Codec
von: Jimon, Daniel, et al.
Veröffentlicht: (2025)
von: Jimon, Daniel, et al.
Veröffentlicht: (2025)
Soft Disentanglement in Frequency Bands for Neural Audio Codecs
von: Ginies, Benoit, et al.
Veröffentlicht: (2025)
von: Ginies, Benoit, et al.
Veröffentlicht: (2025)
BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec
von: Xin, Detai, et al.
Veröffentlicht: (2024)
von: Xin, Detai, et al.
Veröffentlicht: (2024)
AffectCodec: Emotion-Preserving Neural Speech Codec with Block-Diagonal Residual FSQ
von: Meng, Zhaoyang, et al.
Veröffentlicht: (2026)
von: Meng, Zhaoyang, et al.
Veröffentlicht: (2026)
Towards Neural Audio Codec Source Parsing
von: Phukan, Orchid Chetia, et al.
Veröffentlicht: (2025)
von: Phukan, Orchid Chetia, et al.
Veröffentlicht: (2025)
Evaluating Objective Speech Quality Metrics for Neural Audio Codecs
von: Lanzendörfer, Luca A., et al.
Veröffentlicht: (2025)
von: Lanzendörfer, Luca A., et al.
Veröffentlicht: (2025)
Harmonic-Percussive Disentangled Neural Audio Codec for Bandwidth Extension
von: Giniès, Benoît, et al.
Veröffentlicht: (2025)
von: Giniès, Benoît, et al.
Veröffentlicht: (2025)
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
von: Chen, Xuanjun, et al.
Veröffentlicht: (2025)
von: Chen, Xuanjun, et al.
Veröffentlicht: (2025)
MDCTCodec: A Lightweight MDCT-based Neural Audio Codec towards High Sampling Rate and Low Bitrate Scenarios
von: Jiang, Xiao-Hang, et al.
Veröffentlicht: (2024)
von: Jiang, Xiao-Hang, et al.
Veröffentlicht: (2024)
MuCodec: Ultra Low-Bitrate Music Codec
von: Xu, Yaoxun, et al.
Veröffentlicht: (2024)
von: Xu, Yaoxun, et al.
Veröffentlicht: (2024)
SemantiCodec: An Ultra Low Bitrate Semantic Audio Codec for General Sound
von: Liu, Haohe, et al.
Veröffentlicht: (2024)
von: Liu, Haohe, et al.
Veröffentlicht: (2024)
AffectCodec: Emotion-Preserving Neural Speech Codec for Expressive Speech Modeling
von: Shi, Jiacheng, et al.
Veröffentlicht: (2026)
von: Shi, Jiacheng, et al.
Veröffentlicht: (2026)
Low Frame-rate Speech Codec: a Codec Designed for Fast High-quality Speech LLM Training and Inference
von: Casanova, Edresson, et al.
Veröffentlicht: (2024)
von: Casanova, Edresson, et al.
Veröffentlicht: (2024)
SuperCodec: A Neural Speech Codec with Selective Back-Projection Network
von: Zheng, Youqiang, et al.
Veröffentlicht: (2024)
von: Zheng, Youqiang, et al.
Veröffentlicht: (2024)
HILCodec: High-Fidelity and Lightweight Neural Audio Codec
von: Ahn, Sunghwan, et al.
Veröffentlicht: (2024)
von: Ahn, Sunghwan, et al.
Veröffentlicht: (2024)
SNAC: Multi-Scale Neural Audio Codec
von: Siuzdak, Hubert, et al.
Veröffentlicht: (2024)
von: Siuzdak, Hubert, et al.
Veröffentlicht: (2024)
Baseline Systems For The 2025 Low-Resource Audio Codec Challenge
von: Isik, Yusuf Ziya, et al.
Veröffentlicht: (2025)
von: Isik, Yusuf Ziya, et al.
Veröffentlicht: (2025)
TaDiCodec: Text-aware Diffusion Speech Tokenizer for Speech Language Modeling
von: Wang, Yuancheng, et al.
Veröffentlicht: (2025)
von: Wang, Yuancheng, et al.
Veröffentlicht: (2025)
Codec-Robust Attacks on Audio LLMs
von: Roh, Jaechul, et al.
Veröffentlicht: (2026)
von: Roh, Jaechul, et al.
Veröffentlicht: (2026)
The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs
von: Sadok, Samir, et al.
Veröffentlicht: (2026)
von: Sadok, Samir, et al.
Veröffentlicht: (2026)
High-Fidelity Music Vocoder using Neural Audio Codecs
von: Lanzendörfer, Luca A., et al.
Veröffentlicht: (2025)
von: Lanzendörfer, Luca A., et al.
Veröffentlicht: (2025)
VALL-E 2: Neural Codec Language Models are Human Parity Zero-Shot Text to Speech Synthesizers
von: Chen, Sanyuan, et al.
Veröffentlicht: (2024)
von: Chen, Sanyuan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
von: Li, Jiaqi, et al.
Veröffentlicht: (2025) -
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
von: Li, Jiaqi, et al.
Veröffentlicht: (2024) -
SpeechX: Neural Codec Language Model as a Versatile Speech Transformer
von: Wang, Xiaofei, et al.
Veröffentlicht: (2023) -
CodecSlime: Temporal Redundancy Compression of Neural Speech Codec via Dynamic Frame Rate
von: Wang, Hankun, et al.
Veröffentlicht: (2025) -
CoVoMix2: Advancing Zero-Shot Dialogue Generation with Fully Non-Autoregressive Flow Matching
von: Zhang, Leying, et al.
Veröffentlicht: (2025)