A Low-Complexity Speech Codec Using Parametric Dithering for ASR
Fuente:
arXiv
Guardado en:
| Autores principales: | Murray, Ellison, Kasher, Morriel, Spasojevic, Predrag |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Optimizing Audio Compression Through Entropy-Controlled Dithering
por: Murray, Ellison, et al.
Publicado: (2025)
por: Murray, Ellison, et al.
Publicado: (2025)
Distortion-Controlled Dithering with Reduced Recompression Rate
por: Kasher, Morriel, et al.
Publicado: (2024)
por: Kasher, Morriel, et al.
Publicado: (2024)
Design and Implementation of Parametrized Look-Up Tables for Post-Correction of Oversampling Low-Resolution ADCs
por: Kasher, Morriel, et al.
Publicado: (2025)
por: Kasher, Morriel, et al.
Publicado: (2025)
Quantized Signal Recovery with Interference via Parametrized Look-Up Tables
por: Kasher, Morriel, et al.
Publicado: (2025)
por: Kasher, Morriel, et al.
Publicado: (2025)
VoCodec: An Efficient Lightweight Low-Bitrate Speech Codec
por: Yang, Leyan, et al.
Publicado: (2026)
por: Yang, Leyan, et al.
Publicado: (2026)
A High-Quality and Low-Complexity Streamable Neural Speech Codec with Knowledge Distillation
por: Zhang, En-Wei, et al.
Publicado: (2025)
por: Zhang, En-Wei, et al.
Publicado: (2025)
BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec
por: Xin, Detai, et al.
Publicado: (2024)
por: Xin, Detai, et al.
Publicado: (2024)
MSR-Codec: A Low-Bitrate Multi-Stream Residual Codec for High-Fidelity Speech Generation with Information Disentanglement
por: Li, Jingyu, et al.
Publicado: (2025)
por: Li, Jingyu, et al.
Publicado: (2025)
Single-Codec: Single-Codebook Speech Codec towards High-Performance Speech Generation
por: Li, Hanzhao, et al.
Publicado: (2024)
por: Li, Hanzhao, et al.
Publicado: (2024)
NoLACE: Improving Low-Complexity Speech Codec Enhancement Through Adaptive Temporal Shaping
por: Büthe, Jan, et al.
Publicado: (2023)
por: Büthe, Jan, et al.
Publicado: (2023)
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
por: Li, Jiaqi, et al.
Publicado: (2025)
por: Li, Jiaqi, et al.
Publicado: (2025)
Balancing Speech Understanding and Generation Using Continual Pre-training for Codec-based Speech LLM
por: Shi, Jiatong, et al.
Publicado: (2025)
por: Shi, Jiatong, et al.
Publicado: (2025)
Spectral Codecs: Improving Non-Autoregressive Speech Synthesis with Spectrogram-Based Audio Codecs
por: Langman, Ryan, et al.
Publicado: (2024)
por: Langman, Ryan, et al.
Publicado: (2024)
Assessing the Impact of Noise and Speech Enhancement on the Intelligibility of Speech Codecs
por: Behringer, Lyonel, et al.
Publicado: (2026)
por: Behringer, Lyonel, et al.
Publicado: (2026)
Entropy-Guided GRVQ for Ultra-Low Bitrate Neural Speech Codec
por: Ren, Yanzhou, et al.
Publicado: (2026)
por: Ren, Yanzhou, et al.
Publicado: (2026)
Codec2Vec: Self-Supervised Speech Representation Learning Using Neural Speech Codecs
por: Tseng, Wei-Cheng, et al.
Publicado: (2025)
por: Tseng, Wei-Cheng, et al.
Publicado: (2025)
Benchmarking Neural Speech Codec Intelligibility with SITool
por: Leschanowsky, Anna, et al.
Publicado: (2025)
por: Leschanowsky, Anna, et al.
Publicado: (2025)
Personalized Neural Speech Codec
por: Jang, Inseon, et al.
Publicado: (2024)
por: Jang, Inseon, et al.
Publicado: (2024)
SuperCodec: A Neural Speech Codec with Selective Back-Projection Network
por: Zheng, Youqiang, et al.
Publicado: (2024)
por: Zheng, Youqiang, et al.
Publicado: (2024)
PURE Codec: Progressive Unfolding of Residual Entropy for Speech Codec Learning
por: Shi, Jiatong, et al.
Publicado: (2025)
por: Shi, Jiatong, et al.
Publicado: (2025)
Language-Codec: Bridging Discrete Codec Representations and Speech Language Models
por: Ji, Shengpeng, et al.
Publicado: (2024)
por: Ji, Shengpeng, et al.
Publicado: (2024)
SPG-Codec: Exploring the Role and Boundaries of Semantic Priors in Ultra-Low-Bitrate Neural Speech Coding
por: Zhao, Mingyu, et al.
Publicado: (2026)
por: Zhao, Mingyu, et al.
Publicado: (2026)
OmniCodec: Low Frame Rate Universal Audio Codec with Semantic-Acoustic Disentanglement
por: Hu, Jingbin, et al.
Publicado: (2026)
por: Hu, Jingbin, et al.
Publicado: (2026)
MuCodec: Ultra Low-Bitrate Music Codec
por: Xu, Yaoxun, et al.
Publicado: (2024)
por: Xu, Yaoxun, et al.
Publicado: (2024)
Codec-ASR: Training Performant Automatic Speech Recognition Systems with Discrete Speech Representations
por: Dhawan, Kunal, et al.
Publicado: (2024)
por: Dhawan, Kunal, et al.
Publicado: (2024)
A Neural Speech Codec for Noise Robust Speech Coding
por: Huang, Jiayi, et al.
Publicado: (2023)
por: Huang, Jiayi, et al.
Publicado: (2023)
PhoenixCodec: Taming Neural Speech Coding for Extreme Low-Resource Scenarios
por: Wan, Zixiang, et al.
Publicado: (2025)
por: Wan, Zixiang, et al.
Publicado: (2025)
Restorative Speech Enhancement: A Progressive Approach Using SE and Codec Modules
por: Chiang, Hsin-Tien, et al.
Publicado: (2024)
por: Chiang, Hsin-Tien, et al.
Publicado: (2024)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
por: Shi, Jiatong, et al.
Publicado: (2024)
por: Shi, Jiatong, et al.
Publicado: (2024)
RepCodec: A Speech Representation Codec for Speech Tokenization
por: Huang, Zhichao, et al.
Publicado: (2023)
por: Huang, Zhichao, et al.
Publicado: (2023)
Speech Separation using Neural Audio Codecs with Embedding Loss
por: Yip, Jia Qi, et al.
Publicado: (2024)
por: Yip, Jia Qi, et al.
Publicado: (2024)
Indic-CodecFake meets SATYAM: Towards Detecting Neural Audio Codec Synthesized Speech Deepfakes in Indic Languages
por: Girish, et al.
Publicado: (2026)
por: Girish, et al.
Publicado: (2026)
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
por: Chen, Xuanjun, et al.
Publicado: (2025)
por: Chen, Xuanjun, et al.
Publicado: (2025)
SoCodec: A Semantic-Ordered Multi-Stream Speech Codec for Efficient Language Model Based Text-to-Speech Synthesis
por: Guo, Haohan, et al.
Publicado: (2024)
por: Guo, Haohan, et al.
Publicado: (2024)
CFMDCTCodec: A Low-Bitrate Neural Speech Codec with Noise-Prior-aware Conditional Flow Matching for MDCT-Spectral Enhancement
por: Jiang, Xiao-Hang, et al.
Publicado: (2026)
por: Jiang, Xiao-Hang, et al.
Publicado: (2026)
Optimizing Neural Speech Codec for Low-Bitrate Compression via Multi-Scale Encoding
por: Yang, Peiji, et al.
Publicado: (2024)
por: Yang, Peiji, et al.
Publicado: (2024)
ASR for Affective Speech: Investigating Impact of Emotion and Speech Generative Strategy
por: Wu, Ya-Tse, et al.
Publicado: (2026)
por: Wu, Ya-Tse, et al.
Publicado: (2026)
CodeSep: Low-Bitrate Codec-Driven Speech Separation with Base-Token Disentanglement and Auxiliary-Token Serial Prediction
por: Du, Hui-Peng, et al.
Publicado: (2026)
por: Du, Hui-Peng, et al.
Publicado: (2026)
On the Relation Between Speech Quality and Quantized Latent Representations of Neural Codecs
por: Halimeh, Mhd Modar, et al.
Publicado: (2025)
por: Halimeh, Mhd Modar, et al.
Publicado: (2025)
Distinctive Feature Codec: An Adaptive Efficient Speech Representation for Depression Detection
por: Zhang, Xiangyu, et al.
Publicado: (2025)
por: Zhang, Xiangyu, et al.
Publicado: (2025)
Ejemplares similares
-
Optimizing Audio Compression Through Entropy-Controlled Dithering
por: Murray, Ellison, et al.
Publicado: (2025) -
Distortion-Controlled Dithering with Reduced Recompression Rate
por: Kasher, Morriel, et al.
Publicado: (2024) -
Design and Implementation of Parametrized Look-Up Tables for Post-Correction of Oversampling Low-Resolution ADCs
por: Kasher, Morriel, et al.
Publicado: (2025) -
Quantized Signal Recovery with Interference via Parametrized Look-Up Tables
por: Kasher, Morriel, et al.
Publicado: (2025) -
VoCodec: An Efficient Lightweight Low-Bitrate Speech Codec
por: Yang, Leyan, et al.
Publicado: (2026)