Guardado en:
| Autores principales: | Chung, Ho-Lam, Chen, Yiming, Lee, Hung-yi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2604.17852 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Codec-Based Deepfake Source Tracing via Neural Audio Codec Taxonomy
por: Chen, Xuanjun, et al.
Publicado: (2025)
por: Chen, Xuanjun, et al.
Publicado: (2025)
Codec-SUPERB: An In-Depth Analysis of Sound Codec Models
por: Wu, Haibin, et al.
Publicado: (2024)
por: Wu, Haibin, et al.
Publicado: (2024)
CodecFake: Enhancing Anti-Spoofing Models Against Deepfake Audios from Codec-Based Speech Synthesis Systems
por: Wu, Haibin, et al.
Publicado: (2024)
por: Wu, Haibin, et al.
Publicado: (2024)
EMO-Codec: An In-Depth Look at Emotion Preservation capacity of Legacy and Neural Codec Models With Subjective and Objective Evaluations
por: Ren, Wenze, et al.
Publicado: (2024)
por: Ren, Wenze, et al.
Publicado: (2024)
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
por: Chen, Xuanjun, et al.
Publicado: (2025)
por: Chen, Xuanjun, et al.
Publicado: (2025)
Evaluating Objective Speech Quality Metrics for Neural Audio Codecs
por: Lanzendörfer, Luca A., et al.
Publicado: (2025)
por: Lanzendörfer, Luca A., et al.
Publicado: (2025)
Neural Codec-based Adversarial Sample Detection for Speaker Verification
por: Chen, Xuanjun, et al.
Publicado: (2024)
por: Chen, Xuanjun, et al.
Publicado: (2024)
FlexiCodec: A Dynamic Neural Audio Codec for Low Frame Rates
por: Li, Jiaqi, et al.
Publicado: (2025)
por: Li, Jiaqi, et al.
Publicado: (2025)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
por: Shi, Jiatong, et al.
Publicado: (2024)
por: Shi, Jiatong, et al.
Publicado: (2024)
Adapting Neural Audio Codecs to EEG
por: Kastrati, Ard, et al.
Publicado: (2025)
por: Kastrati, Ard, et al.
Publicado: (2025)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
por: Wang, Lu, et al.
Publicado: (2025)
por: Wang, Lu, et al.
Publicado: (2025)
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
por: Li, Jiaqi, et al.
Publicado: (2024)
por: Li, Jiaqi, et al.
Publicado: (2024)
DeCodec: Rethinking Audio Codecs as Universal Disentangled Representation Learners
por: Luo, Xiaoxue, et al.
Publicado: (2025)
por: Luo, Xiaoxue, et al.
Publicado: (2025)
CodecSep: Prompt-Driven Universal Sound Separation on Neural Audio Codec Latents
por: Banerjee, Adhiraj, et al.
Publicado: (2025)
por: Banerjee, Adhiraj, et al.
Publicado: (2025)
Codec Does Matter: Exploring the Semantic Shortcoming of Codec for Audio Language Model
por: Ye, Zhen, et al.
Publicado: (2024)
por: Ye, Zhen, et al.
Publicado: (2024)
Evaluation of Audio Compression Codecs
por: Duong, Thien T., et al.
Publicado: (2025)
por: Duong, Thien T., et al.
Publicado: (2025)
ADNAC: Audio Denoiser using Neural Audio Codec
por: Jimon, Daniel, et al.
Publicado: (2025)
por: Jimon, Daniel, et al.
Publicado: (2025)
Soft Disentanglement in Frequency Bands for Neural Audio Codecs
por: Ginies, Benoit, et al.
Publicado: (2025)
por: Ginies, Benoit, et al.
Publicado: (2025)
UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook
por: Jiang, Yidi, et al.
Publicado: (2025)
por: Jiang, Yidi, et al.
Publicado: (2025)
TW-Sound580K: A Regional Audio-Text Dataset with Verification-Guided Curation for Localized Audio-Language Modeling
por: Xie, Hao-Hui, et al.
Publicado: (2026)
por: Xie, Hao-Hui, et al.
Publicado: (2026)
Towards Neural Audio Codec Source Parsing
por: Phukan, Orchid Chetia, et al.
Publicado: (2025)
por: Phukan, Orchid Chetia, et al.
Publicado: (2025)
AffectCodec: Emotion-Preserving Neural Speech Codec for Expressive Speech Modeling
por: Shi, Jiacheng, et al.
Publicado: (2026)
por: Shi, Jiacheng, et al.
Publicado: (2026)
Harmonic-Percussive Disentangled Neural Audio Codec for Bandwidth Extension
por: Giniès, Benoît, et al.
Publicado: (2025)
por: Giniès, Benoît, et al.
Publicado: (2025)
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
por: Li, Jiaqi, et al.
Publicado: (2025)
por: Li, Jiaqi, et al.
Publicado: (2025)
Analyzing and Mitigating Inconsistency in Discrete Audio Tokens for Neural Codec Language Models
por: Liu, Wenrui, et al.
Publicado: (2024)
por: Liu, Wenrui, et al.
Publicado: (2024)
SNAC: Multi-Scale Neural Audio Codec
por: Siuzdak, Hubert, et al.
Publicado: (2024)
por: Siuzdak, Hubert, et al.
Publicado: (2024)
CLaM-TTS: Improving Neural Codec Language Model for Zero-Shot Text-to-Speech
por: Kim, Jaehyeon, et al.
Publicado: (2024)
por: Kim, Jaehyeon, et al.
Publicado: (2024)
Language-Codec: Bridging Discrete Codec Representations and Speech Language Models
por: Ji, Shengpeng, et al.
Publicado: (2024)
por: Ji, Shengpeng, et al.
Publicado: (2024)
Towards Generalized Source Tracing for Codec-Based Deepfake Speech
por: Chen, Xuanjun, et al.
Publicado: (2025)
por: Chen, Xuanjun, et al.
Publicado: (2025)
SwitchCodec: A High-Fidelity Nerual Audio Codec With Sparse Quantization
por: Wang, Jin, et al.
Publicado: (2025)
por: Wang, Jin, et al.
Publicado: (2025)
On the Language and Gender Biases in PSTN, VoIP and Neural Audio Codecs
por: Altwlkany, Kemal, et al.
Publicado: (2025)
por: Altwlkany, Kemal, et al.
Publicado: (2025)
Code Drift: Towards Idempotent Neural Audio Codecs
por: O'Reilly, Patrick, et al.
Publicado: (2024)
por: O'Reilly, Patrick, et al.
Publicado: (2024)
HILCodec: High-Fidelity and Lightweight Neural Audio Codec
por: Ahn, Sunghwan, et al.
Publicado: (2024)
por: Ahn, Sunghwan, et al.
Publicado: (2024)
Codec-SUPERB @ SLT 2024: A lightweight benchmark for neural audio codec models
por: Wu, Haibin, et al.
Publicado: (2024)
por: Wu, Haibin, et al.
Publicado: (2024)
ALMTokenizer: A Low-bitrate and Semantic-rich Audio Codec Tokenizer for Audio Language Modeling
por: Yang, Dongchao, et al.
Publicado: (2025)
por: Yang, Dongchao, et al.
Publicado: (2025)
Neural Speech and Audio Coding: Modern AI Technology Meets Traditional Codecs
por: Kim, Minje, et al.
Publicado: (2024)
por: Kim, Minje, et al.
Publicado: (2024)
Codec-Robust Attacks on Audio LLMs
por: Roh, Jaechul, et al.
Publicado: (2026)
por: Roh, Jaechul, et al.
Publicado: (2026)
The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs
por: Sadok, Samir, et al.
Publicado: (2026)
por: Sadok, Samir, et al.
Publicado: (2026)
High-Fidelity Music Vocoder using Neural Audio Codecs
por: Lanzendörfer, Luca A., et al.
Publicado: (2025)
por: Lanzendörfer, Luca A., et al.
Publicado: (2025)
Learning Source Disentanglement in Neural Audio Codec
por: Bie, Xiaoyu, et al.
Publicado: (2024)
por: Bie, Xiaoyu, et al.
Publicado: (2024)
Ejemplares similares
-
Codec-Based Deepfake Source Tracing via Neural Audio Codec Taxonomy
por: Chen, Xuanjun, et al.
Publicado: (2025) -
Codec-SUPERB: An In-Depth Analysis of Sound Codec Models
por: Wu, Haibin, et al.
Publicado: (2024) -
CodecFake: Enhancing Anti-Spoofing Models Against Deepfake Audios from Codec-Based Speech Synthesis Systems
por: Wu, Haibin, et al.
Publicado: (2024) -
EMO-Codec: An In-Depth Look at Emotion Preservation capacity of Legacy and Neural Codec Models With Subjective and Objective Evaluations
por: Ren, Wenze, et al.
Publicado: (2024) -
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
por: Chen, Xuanjun, et al.
Publicado: (2025)