HILCodec: High-Fidelity and Lightweight Neural Audio Codec
Fuente:
arXiv
Guardado en:
| Autores principales: | Ahn, Sunghwan, Woo, Beom Jun, Han, Min Hyun, Moon, Chanyeong, Kim, Nam Soo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FastEnhancer: Speed-Optimized Streaming Neural Speech Enhancement
por: Ahn, Sunghwan, et al.
Publicado: (2025)
por: Ahn, Sunghwan, et al.
Publicado: (2025)
SwitchCodec: A High-Fidelity Nerual Audio Codec With Sparse Quantization
por: Wang, Jin, et al.
Publicado: (2025)
por: Wang, Jin, et al.
Publicado: (2025)
APCodec+: A Spectrum-Coding-Based High-Fidelity and High-Compression-Rate Neural Audio Codec with Staged Training Paradigm
por: Du, Hui-Peng, et al.
Publicado: (2024)
por: Du, Hui-Peng, et al.
Publicado: (2024)
HuBERT-EE: Early Exiting HuBERT for Efficient Speech Recognition
por: Yoon, Ji Won, et al.
Publicado: (2022)
por: Yoon, Ji Won, et al.
Publicado: (2022)
MDCTCodec: A Lightweight MDCT-based Neural Audio Codec towards High Sampling Rate and Low Bitrate Scenarios
por: Jiang, Xiao-Hang, et al.
Publicado: (2024)
por: Jiang, Xiao-Hang, et al.
Publicado: (2024)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
por: Shi, Jiatong, et al.
Publicado: (2024)
por: Shi, Jiatong, et al.
Publicado: (2024)
EnCLAP: Combining Neural Audio Codec and Audio-Text Joint Embedding for Automated Audio Captioning
por: Kim, Jaeyeon, et al.
Publicado: (2024)
por: Kim, Jaeyeon, et al.
Publicado: (2024)
Codec-Based Deepfake Source Tracing via Neural Audio Codec Taxonomy
por: Chen, Xuanjun, et al.
Publicado: (2025)
por: Chen, Xuanjun, et al.
Publicado: (2025)
Towards Neural Audio Codec Source Parsing
por: Phukan, Orchid Chetia, et al.
Publicado: (2025)
por: Phukan, Orchid Chetia, et al.
Publicado: (2025)
Code Drift: Towards Idempotent Neural Audio Codecs
por: O'Reilly, Patrick, et al.
Publicado: (2024)
por: O'Reilly, Patrick, et al.
Publicado: (2024)
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
por: Chen, Xuanjun, et al.
Publicado: (2025)
por: Chen, Xuanjun, et al.
Publicado: (2025)
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
por: Li, Jiaqi, et al.
Publicado: (2025)
por: Li, Jiaqi, et al.
Publicado: (2025)
BANC: Towards Efficient Binaural Audio Neural Codec for Overlapping Speech
por: Ratnarajah, Anton, et al.
Publicado: (2023)
por: Ratnarajah, Anton, et al.
Publicado: (2023)
On the Language and Gender Biases in PSTN, VoIP and Neural Audio Codecs
por: Altwlkany, Kemal, et al.
Publicado: (2025)
por: Altwlkany, Kemal, et al.
Publicado: (2025)
UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook
por: Jiang, Yidi, et al.
Publicado: (2025)
por: Jiang, Yidi, et al.
Publicado: (2025)
ComplexDec: A Domain-robust High-fidelity Neural Audio Codec with Complex Spectrum Modeling
por: Wu, Yi-Chiao, et al.
Publicado: (2025)
por: Wu, Yi-Chiao, et al.
Publicado: (2025)
Personalized Neural Speech Codec
por: Jang, Inseon, et al.
Publicado: (2024)
por: Jang, Inseon, et al.
Publicado: (2024)
An Intra-BRNN and GB-RVQ Based END-TO-END Neural Audio Codec
por: Xu, Linping, et al.
Publicado: (2024)
por: Xu, Linping, et al.
Publicado: (2024)
NDVQ: Robust Neural Audio Codec with Normal Distribution-Based Vector Quantization
por: Niu, Zhikang, et al.
Publicado: (2024)
por: Niu, Zhikang, et al.
Publicado: (2024)
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
por: Li, Jiaqi, et al.
Publicado: (2024)
por: Li, Jiaqi, et al.
Publicado: (2024)
Analyzing and Mitigating Inconsistency in Discrete Audio Tokens for Neural Codec Language Models
por: Liu, Wenrui, et al.
Publicado: (2024)
por: Liu, Wenrui, et al.
Publicado: (2024)
Analysis of Speaker Verification Performance Trade-offs with Neural Audio Codec Transmission
por: Thakur, Nirmalya Mallick, et al.
Publicado: (2025)
por: Thakur, Nirmalya Mallick, et al.
Publicado: (2025)
Toward a Sparse and Interpretable Audio Codec
por: Vinyard, John
Publicado: (2025)
por: Vinyard, John
Publicado: (2025)
Low-Resource Audio Codec (LRAC): 2025 Challenge Description
por: Wojcicki, Kamil, et al.
Publicado: (2025)
por: Wojcicki, Kamil, et al.
Publicado: (2025)
APCodec: A Neural Audio Codec with Parallel Amplitude and Phase Spectrum Encoding and Decoding
por: Ai, Yang, et al.
Publicado: (2024)
por: Ai, Yang, et al.
Publicado: (2024)
Streaming Endpointer for Spoken Dialogue using Neural Audio Codecs and Label-Delayed Training
por: Udupa, Sathvik, et al.
Publicado: (2025)
por: Udupa, Sathvik, et al.
Publicado: (2025)
VCNAC: A Variable-Channel Neural Audio Codec for Mono, Stereo, and Surround Sound
por: Grötschla, Florian, et al.
Publicado: (2026)
por: Grötschla, Florian, et al.
Publicado: (2026)
Trade-offs Between Capacity and Robustness in Neural Audio Codecs for Adversarially Robust Speech Recognition
por: Prescott, Jordan, et al.
Publicado: (2026)
por: Prescott, Jordan, et al.
Publicado: (2026)
SpectroStream: A Versatile Neural Codec for General Audio
por: Li, Yunpeng, et al.
Publicado: (2025)
por: Li, Yunpeng, et al.
Publicado: (2025)
Lightweight Implicit Neural Network for Binaural Audio Synthesis
por: Lu, Xikun, et al.
Publicado: (2025)
por: Lu, Xikun, et al.
Publicado: (2025)
FlashAudio: Rectified Flows for Fast and High-Fidelity Text-to-Audio Generation
por: Liu, Huadai, et al.
Publicado: (2024)
por: Liu, Huadai, et al.
Publicado: (2024)
BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec
por: Xin, Detai, et al.
Publicado: (2024)
por: Xin, Detai, et al.
Publicado: (2024)
SNAC: Multi-Scale Neural Audio Codec
por: Siuzdak, Hubert, et al.
Publicado: (2024)
por: Siuzdak, Hubert, et al.
Publicado: (2024)
DAC-JAX: A JAX Implementation of the Descript Audio Codec
por: Braun, David
Publicado: (2024)
por: Braun, David
Publicado: (2024)
SpecTokenizer: A Lightweight Streaming Codec in the Compressed Spectrum Domain
por: Wan, Zixiang, et al.
Publicado: (2025)
por: Wan, Zixiang, et al.
Publicado: (2025)
SuperCodec: A Neural Speech Codec with Selective Back-Projection Network
por: Zheng, Youqiang, et al.
Publicado: (2024)
por: Zheng, Youqiang, et al.
Publicado: (2024)
CodecFake: Enhancing Anti-Spoofing Models Against Deepfake Audios from Codec-Based Speech Synthesis Systems
por: Wu, Haibin, et al.
Publicado: (2024)
por: Wu, Haibin, et al.
Publicado: (2024)
Improving Test-Time Performance of RVQ-based Neural Codecs
por: Kim, Hyeongju, et al.
Publicado: (2025)
por: Kim, Hyeongju, et al.
Publicado: (2025)
High-Fidelity Generative Audio Compression at 0.275kbps
por: Ma, Hao, et al.
Publicado: (2026)
por: Ma, Hao, et al.
Publicado: (2026)
LongCat-Audio-Codec: An Audio Tokenizer and Detokenizer Solution Designed for Speech Large Language Models
por: Zhao, Xiaohan, et al.
Publicado: (2025)
por: Zhao, Xiaohan, et al.
Publicado: (2025)
Ejemplares similares
-
FastEnhancer: Speed-Optimized Streaming Neural Speech Enhancement
por: Ahn, Sunghwan, et al.
Publicado: (2025) -
SwitchCodec: A High-Fidelity Nerual Audio Codec With Sparse Quantization
por: Wang, Jin, et al.
Publicado: (2025) -
APCodec+: A Spectrum-Coding-Based High-Fidelity and High-Compression-Rate Neural Audio Codec with Staged Training Paradigm
por: Du, Hui-Peng, et al.
Publicado: (2024) -
HuBERT-EE: Early Exiting HuBERT for Efficient Speech Recognition
por: Yoon, Ji Won, et al.
Publicado: (2022) -
MDCTCodec: A Lightweight MDCT-based Neural Audio Codec towards High Sampling Rate and Low Bitrate Scenarios
por: Jiang, Xiao-Hang, et al.
Publicado: (2024)