Audio Codec Augmentation for Robust Collaborative Watermarking of Speech Synthesis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Juvela, Lauri, Wang, Xin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Collaborative Watermarking for Adversarial Speech Synthesis
par: Juvela, Lauri, et autres
Publié: (2023)
par: Juvela, Lauri, et autres
Publié: (2023)
Open-Amp: Synthetic Data Framework for Audio Effect Foundation Models
par: Wright, Alec, et autres
Publié: (2024)
par: Wright, Alec, et autres
Publié: (2024)
Accelerating Codec-based Speech Synthesis with Multi-Token Prediction and Speculative Decoding
par: Nguyen, Tan Dat, et autres
Publié: (2024)
par: Nguyen, Tan Dat, et autres
Publié: (2024)
Neural Speech and Audio Coding: Modern AI Technology Meets Traditional Codecs
par: Kim, Minje, et autres
Publié: (2024)
par: Kim, Minje, et autres
Publié: (2024)
EnCLAP: Combining Neural Audio Codec and Audio-Text Joint Embedding for Automated Audio Captioning
par: Kim, Jaeyeon, et autres
Publié: (2024)
par: Kim, Jaeyeon, et autres
Publié: (2024)
LSCodec: Low-Bitrate and Speaker-Decoupled Discrete Speech Codec
par: Guo, Yiwei, et autres
Publié: (2024)
par: Guo, Yiwei, et autres
Publié: (2024)
SpectroStream: A Versatile Neural Codec for General Audio
par: Li, Yunpeng, et autres
Publié: (2025)
par: Li, Yunpeng, et autres
Publié: (2025)
Aliasing-Free Neural Audio Synthesis
par: Gu, Yicheng, et autres
Publié: (2025)
par: Gu, Yicheng, et autres
Publié: (2025)
Prosody-Adaptable Audio Codecs for Zero-Shot Voice Conversion via In-Context Learning
par: Zhao, Junchuan, et autres
Publié: (2025)
par: Zhao, Junchuan, et autres
Publié: (2025)
XY-Tokenizer: Mitigating the Semantic-Acoustic Conflict in Low-Bitrate Speech Codecs
par: Gong, Yitian, et autres
Publié: (2025)
par: Gong, Yitian, et autres
Publié: (2025)
Speech Enhancement Using Continuous Embeddings of Neural Audio Codec
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
De-crackling Virtual Analog Controls with Asymptotically Stable Recurrent Neural Networks
par: Kallinen, Valtteri, et autres
Publié: (2025)
par: Kallinen, Valtteri, et autres
Publié: (2025)
GROOT: Generating Robust Watermark for Diffusion-Model-Based Audio Synthesis
par: Liu, Weizhi, et autres
Publié: (2024)
par: Liu, Weizhi, et autres
Publié: (2024)
MIDI-VALLE: Improving Expressive Piano Performance Synthesis Through Neural Codec Language Modelling
par: Tang, Jingjing, et autres
Publié: (2025)
par: Tang, Jingjing, et autres
Publié: (2025)
Bahasa Harmony: A Comprehensive Dataset for Bahasa Text-to-Speech Synthesis with Discrete Codec Modeling of EnGen-TTS
par: Susladkar, Onkar Kishor, et autres
Publié: (2024)
par: Susladkar, Onkar Kishor, et autres
Publié: (2024)
Unlocking Temporal Flexibility: Neural Speech Codec with Variable Frame Rate
par: Zhang, Hanglei, et autres
Publié: (2025)
par: Zhang, Hanglei, et autres
Publié: (2025)
SemantiCodec: An Ultra Low Bitrate Semantic Audio Codec for General Sound
par: Liu, Haohe, et autres
Publié: (2024)
par: Liu, Haohe, et autres
Publié: (2024)
On the Design of Diffusion-based Neural Speech Codecs
par: Foti, Pietro, et autres
Publié: (2025)
par: Foti, Pietro, et autres
Publié: (2025)
Do Neural Codecs Generalize? A Controlled Study Across Unseen Languages and Non-Speech Tasks
par: Wang, Shih-Heng, et autres
Publié: (2026)
par: Wang, Shih-Heng, et autres
Publié: (2026)
Universal Speech Token Learning via Low-Bitrate Neural Codec and Pretrained Representations
par: Jiang, Xue, et autres
Publié: (2025)
par: Jiang, Xue, et autres
Publié: (2025)
SecoustiCodec: Cross-Modal Aligned Streaming Single-Codecbook Speech Codec
par: Qiang, Chunyu, et autres
Publié: (2025)
par: Qiang, Chunyu, et autres
Publié: (2025)
Retrieval-Augmented Audio Deepfake Detection
par: Kang, Zuheng, et autres
Publié: (2024)
par: Kang, Zuheng, et autres
Publié: (2024)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
CodecFake: Enhancing Anti-Spoofing Models Against Deepfake Audios from Codec-Based Speech Synthesis Systems
par: Wu, Haibin, et autres
Publié: (2024)
par: Wu, Haibin, et autres
Publié: (2024)
Trade-offs Between Capacity and Robustness in Neural Audio Codecs for Adversarially Robust Speech Recognition
par: Prescott, Jordan, et autres
Publié: (2026)
par: Prescott, Jordan, et autres
Publié: (2026)
Codec Does Matter: Exploring the Semantic Shortcoming of Codec for Audio Language Model
par: Ye, Zhen, et autres
Publié: (2024)
par: Ye, Zhen, et autres
Publié: (2024)
DASB - Discrete Audio and Speech Benchmark
par: Mousavi, Pooneh, et autres
Publié: (2024)
par: Mousavi, Pooneh, et autres
Publié: (2024)
WMCodec: End-to-End Neural Speech Codec with Deep Watermarking for Authenticity Verification
par: Zhou, Junzuo, et autres
Publié: (2024)
par: Zhou, Junzuo, et autres
Publié: (2024)
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
par: Li, Jiaqi, et autres
Publié: (2025)
par: Li, Jiaqi, et autres
Publié: (2025)
Improving Robustness of LLM-based Speech Synthesis by Learning Monotonic Alignment
par: Neekhara, Paarth, et autres
Publié: (2024)
par: Neekhara, Paarth, et autres
Publié: (2024)
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
par: Li, Jiaqi, et autres
Publié: (2024)
par: Li, Jiaqi, et autres
Publié: (2024)
Learning Source Disentanglement in Neural Audio Codec
par: Bie, Xiaoyu, et autres
Publié: (2024)
par: Bie, Xiaoyu, et autres
Publié: (2024)
HH-Codec: High Compression High-fidelity Discrete Neural Codec for Spoken Language Modeling
par: Xue, Rongkun, et autres
Publié: (2025)
par: Xue, Rongkun, et autres
Publié: (2025)
LLM-Guided Reinforcement Learning for Audio-Visual Speech Enhancement
par: Chen, Chih-Ning, et autres
Publié: (2026)
par: Chen, Chih-Ning, et autres
Publié: (2026)
RALL-E: Robust Codec Language Modeling with Chain-of-Thought Prompting for Text-to-Speech Synthesis
par: Xin, Detai, et autres
Publié: (2024)
par: Xin, Detai, et autres
Publié: (2024)
A Neural Speech Codec for Noise Robust Speech Coding
par: Huang, Jiayi, et autres
Publié: (2023)
par: Huang, Jiayi, et autres
Publié: (2023)
Contrastive Augmentation: An Unsupervised Learning Approach for Keyword Spotting in Speech Technology
par: Dai, Weinan, et autres
Publié: (2024)
par: Dai, Weinan, et autres
Publié: (2024)
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
par: Chen, Xuanjun, et autres
Publié: (2025)
par: Chen, Xuanjun, et autres
Publié: (2025)
A Comprehensive Real-World Assessment of Audio Watermarking Algorithms: Will They Survive Neural Codecs?
par: Özer, Yigitcan, et autres
Publié: (2025)
par: Özer, Yigitcan, et autres
Publié: (2025)
Neurodyne: Neural Pitch Manipulation with Representation Learning and Cycle-Consistency GAN
par: Gu, Yicheng, et autres
Publié: (2025)
par: Gu, Yicheng, et autres
Publié: (2025)
Documents similaires
-
Collaborative Watermarking for Adversarial Speech Synthesis
par: Juvela, Lauri, et autres
Publié: (2023) -
Open-Amp: Synthetic Data Framework for Audio Effect Foundation Models
par: Wright, Alec, et autres
Publié: (2024) -
Accelerating Codec-based Speech Synthesis with Multi-Token Prediction and Speculative Decoding
par: Nguyen, Tan Dat, et autres
Publié: (2024) -
Neural Speech and Audio Coding: Modern AI Technology Meets Traditional Codecs
par: Kim, Minje, et autres
Publié: (2024) -
EnCLAP: Combining Neural Audio Codec and Audio-Text Joint Embedding for Automated Audio Captioning
par: Kim, Jaeyeon, et autres
Publié: (2024)