A Streamable Neural Audio Codec with Residual Scalar-Vector Quantization for Real-Time Communication
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Xiao-Hang, Ai, Yang, Zheng, Rui-Chen, Ling, Zhen-Hua |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MDCTCodec: A Lightweight MDCT-based Neural Audio Codec towards High Sampling Rate and Low Bitrate Scenarios
por: Jiang, Xiao-Hang, et al.
Publicado: (2024)
por: Jiang, Xiao-Hang, et al.
Publicado: (2024)
APCodec: A Neural Audio Codec with Parallel Amplitude and Phase Spectrum Encoding and Decoding
por: Ai, Yang, et al.
Publicado: (2024)
por: Ai, Yang, et al.
Publicado: (2024)
ERVQ: Enhanced Residual Vector Quantization with Intra-and-Inter-Codebook Optimization for Neural Audio Codecs
por: Zheng, Rui-Chen, et al.
Publicado: (2024)
por: Zheng, Rui-Chen, et al.
Publicado: (2024)
APCodec+: A Spectrum-Coding-Based High-Fidelity and High-Compression-Rate Neural Audio Codec with Staged Training Paradigm
por: Du, Hui-Peng, et al.
Publicado: (2024)
por: Du, Hui-Peng, et al.
Publicado: (2024)
ParaGSE: Parallel Generative Speech Enhancement with Group-Vector-Quantization-based Neural Speech Codec
por: Liu, Fei, et al.
Publicado: (2026)
por: Liu, Fei, et al.
Publicado: (2026)
NDVQ: Robust Neural Audio Codec with Normal Distribution-Based Vector Quantization
por: Niu, Zhikang, et al.
Publicado: (2024)
por: Niu, Zhikang, et al.
Publicado: (2024)
Vision-Integrated High-Quality Neural Speech Coding
por: Guo, Yao, et al.
Publicado: (2025)
por: Guo, Yao, et al.
Publicado: (2025)
A High-Quality and Low-Complexity Streamable Neural Speech Codec with Knowledge Distillation
por: Zhang, En-Wei, et al.
Publicado: (2025)
por: Zhang, En-Wei, et al.
Publicado: (2025)
SwitchCodec: A High-Fidelity Nerual Audio Codec With Sparse Quantization
por: Wang, Jin, et al.
Publicado: (2025)
por: Wang, Jin, et al.
Publicado: (2025)
LLM-Codec: Neural Audio Codec Meets Language Model Objectives
por: Chung, Ho-Lam, et al.
Publicado: (2026)
por: Chung, Ho-Lam, et al.
Publicado: (2026)
Neural Speech Separation with Parallel Amplitude and Phase Spectrum Estimation
por: Liu, Fei, et al.
Publicado: (2025)
por: Liu, Fei, et al.
Publicado: (2025)
FlexiCodec: A Dynamic Neural Audio Codec for Low Frame Rates
por: Li, Jiaqi, et al.
Publicado: (2025)
por: Li, Jiaqi, et al.
Publicado: (2025)
Variable Bitrate Residual Vector Quantization for Audio Coding
por: Chae, Yunkee, et al.
Publicado: (2024)
por: Chae, Yunkee, et al.
Publicado: (2024)
ESTVocoder: An Excitation-Spectral-Transformed Neural Vocoder Conditioned on Mel Spectrogram
por: Jiang, Xiao-Hang, et al.
Publicado: (2024)
por: Jiang, Xiao-Hang, et al.
Publicado: (2024)
Low-Latency Neural Speech Phase Prediction based on Parallel Estimation Architecture and Anti-Wrapping Losses for Speech Generation Tasks
por: Ai, Yang, et al.
Publicado: (2024)
por: Ai, Yang, et al.
Publicado: (2024)
AffectCodec: Emotion-Preserving Neural Speech Codec with Block-Diagonal Residual FSQ
por: Meng, Zhaoyang, et al.
Publicado: (2026)
por: Meng, Zhaoyang, et al.
Publicado: (2026)
Adapting Neural Audio Codecs to EEG
por: Kastrati, Ard, et al.
Publicado: (2025)
por: Kastrati, Ard, et al.
Publicado: (2025)
ADNAC: Audio Denoiser using Neural Audio Codec
por: Jimon, Daniel, et al.
Publicado: (2025)
por: Jimon, Daniel, et al.
Publicado: (2025)
Soft Disentanglement in Frequency Bands for Neural Audio Codecs
por: Ginies, Benoit, et al.
Publicado: (2025)
por: Ginies, Benoit, et al.
Publicado: (2025)
How to Label Resynthesized Audio: The Dual Role of Neural Audio Codecs in Audio Deepfake Detection
por: Xiao, Yixuan, et al.
Publicado: (2026)
por: Xiao, Yixuan, et al.
Publicado: (2026)
Real-Time Streamable Generative Speech Restoration with Flow Matching
por: Welker, Simon, et al.
Publicado: (2025)
por: Welker, Simon, et al.
Publicado: (2025)
DeCodec: Rethinking Audio Codecs as Universal Disentangled Representation Learners
por: Luo, Xiaoxue, et al.
Publicado: (2025)
por: Luo, Xiaoxue, et al.
Publicado: (2025)
Codec-Based Deepfake Source Tracing via Neural Audio Codec Taxonomy
por: Chen, Xuanjun, et al.
Publicado: (2025)
por: Chen, Xuanjun, et al.
Publicado: (2025)
Evaluating Objective Speech Quality Metrics for Neural Audio Codecs
por: Lanzendörfer, Luca A., et al.
Publicado: (2025)
por: Lanzendörfer, Luca A., et al.
Publicado: (2025)
Harmonic-Percussive Disentangled Neural Audio Codec for Bandwidth Extension
por: Giniès, Benoît, et al.
Publicado: (2025)
por: Giniès, Benoît, et al.
Publicado: (2025)
Neural Speech Coding for Real-time Communications using Constant Bitrate Scalar Quantization
por: Brendel, Andreas, et al.
Publicado: (2024)
por: Brendel, Andreas, et al.
Publicado: (2024)
An Intra-BRNN and GB-RVQ Based END-TO-END Neural Audio Codec
por: Xu, Linping, et al.
Publicado: (2024)
por: Xu, Linping, et al.
Publicado: (2024)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
por: Shi, Jiatong, et al.
Publicado: (2024)
por: Shi, Jiatong, et al.
Publicado: (2024)
Evaluation of Audio Compression Codecs
por: Duong, Thien T., et al.
Publicado: (2025)
por: Duong, Thien T., et al.
Publicado: (2025)
SuperCodec: A Neural Speech Codec with Selective Back-Projection Network
por: Zheng, Youqiang, et al.
Publicado: (2024)
por: Zheng, Youqiang, et al.
Publicado: (2024)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
por: Wang, Lu, et al.
Publicado: (2025)
por: Wang, Lu, et al.
Publicado: (2025)
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
por: Chen, Xuanjun, et al.
Publicado: (2025)
por: Chen, Xuanjun, et al.
Publicado: (2025)
LatentFlowSR: High-Fidelity Audio Super-Resolution via Noise-Robust Latent Flow Matching
por: Liu, Fei, et al.
Publicado: (2026)
por: Liu, Fei, et al.
Publicado: (2026)
CodecSep: Prompt-Driven Universal Sound Separation on Neural Audio Codec Latents
por: Banerjee, Adhiraj, et al.
Publicado: (2025)
por: Banerjee, Adhiraj, et al.
Publicado: (2025)
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
por: Li, Jiaqi, et al.
Publicado: (2024)
por: Li, Jiaqi, et al.
Publicado: (2024)
Towards Neural Audio Codec Source Parsing
por: Phukan, Orchid Chetia, et al.
Publicado: (2025)
por: Phukan, Orchid Chetia, et al.
Publicado: (2025)
UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook
por: Jiang, Yidi, et al.
Publicado: (2025)
por: Jiang, Yidi, et al.
Publicado: (2025)
ALMTokenizer: A Low-bitrate and Semantic-rich Audio Codec Tokenizer for Audio Language Modeling
por: Yang, Dongchao, et al.
Publicado: (2025)
por: Yang, Dongchao, et al.
Publicado: (2025)
SAC: Neural Speech Codec with Semantic-Acoustic Dual-Stream Quantization
por: Chen, Wenxi, et al.
Publicado: (2025)
por: Chen, Wenxi, et al.
Publicado: (2025)
AUV: Teaching Audio Universal Vector Quantization with Single Nested Codebook
por: Chen, Yushen, et al.
Publicado: (2025)
por: Chen, Yushen, et al.
Publicado: (2025)
Ejemplares similares
-
MDCTCodec: A Lightweight MDCT-based Neural Audio Codec towards High Sampling Rate and Low Bitrate Scenarios
por: Jiang, Xiao-Hang, et al.
Publicado: (2024) -
APCodec: A Neural Audio Codec with Parallel Amplitude and Phase Spectrum Encoding and Decoding
por: Ai, Yang, et al.
Publicado: (2024) -
ERVQ: Enhanced Residual Vector Quantization with Intra-and-Inter-Codebook Optimization for Neural Audio Codecs
por: Zheng, Rui-Chen, et al.
Publicado: (2024) -
APCodec+: A Spectrum-Coding-Based High-Fidelity and High-Compression-Rate Neural Audio Codec with Staged Training Paradigm
por: Du, Hui-Peng, et al.
Publicado: (2024) -
ParaGSE: Parallel Generative Speech Enhancement with Group-Vector-Quantization-based Neural Speech Codec
por: Liu, Fei, et al.
Publicado: (2026)