Multiplexing Neural Audio Watermarks
Fuente:
arXiv
Salvato in:
| Autori principali: | Yuan, Zheqi, Huang, Yucheng, Sun, Guangzhi, Jin, Zengrui, Zhang, Chao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Audio-Conditioned Diffusion LLMs for ASR and Deliberation Processing
di: Wang, Mengqi, et al.
Pubblicazione: (2025)
di: Wang, Mengqi, et al.
Pubblicazione: (2025)
SPEAR: A Unified SSL Framework for Learning Speech and Audio Representations
di: Yang, Xiaoyu, et al.
Pubblicazione: (2025)
di: Yang, Xiaoyu, et al.
Pubblicazione: (2025)
SOT Triggered Neural Clustering for Speaker Attributed ASR
di: Zheng, Xianrui, et al.
Pubblicazione: (2024)
di: Zheng, Xianrui, et al.
Pubblicazione: (2024)
Augmenting Open-Vocabulary Dysarthric Speech Assessment with Human Perceptual Supervision
di: Jia, Kaimeng, et al.
Pubblicazione: (2025)
di: Jia, Kaimeng, et al.
Pubblicazione: (2025)
Deep Audio Watermarks are Shallow: Limitations of Post-Hoc Watermarking Techniques for Speech
di: O'Reilly, Patrick, et al.
Pubblicazione: (2025)
di: O'Reilly, Patrick, et al.
Pubblicazione: (2025)
ClariCodec: Optimising Neural Speech Codes for 200bps Communication using Reinforcement Learning
di: Wang, Junyi, et al.
Pubblicazione: (2026)
di: Wang, Junyi, et al.
Pubblicazione: (2026)
SemanticAudio: Audio Generation and Editing in Semantic Space
di: Dai, Zheqi, et al.
Pubblicazione: (2026)
di: Dai, Zheqi, et al.
Pubblicazione: (2026)
Noise-to-mask Ratio Loss for Deep Neural Network based Audio Watermarking
di: Moritz, Martin, et al.
Pubblicazione: (2024)
di: Moritz, Martin, et al.
Pubblicazione: (2024)
WAKE: Watermarking Audio with Key Enrichment
di: Xu, Yaoxun, et al.
Pubblicazione: (2025)
di: Xu, Yaoxun, et al.
Pubblicazione: (2025)
Latent Watermarking of Audio Generative Models
di: Roman, Robin San, et al.
Pubblicazione: (2024)
di: Roman, Robin San, et al.
Pubblicazione: (2024)
Can Large Language Models Understand Spatial Audio?
di: Tang, Changli, et al.
Pubblicazione: (2024)
di: Tang, Changli, et al.
Pubblicazione: (2024)
Yours or Mine? Overwriting Attacks Against Neural Audio Watermarking
di: Yao, Lingfeng, et al.
Pubblicazione: (2025)
di: Yao, Lingfeng, et al.
Pubblicazione: (2025)
Measuring Audio's Impact on Correctness: Audio-Contribution-Aware Post-Training of Large Audio Language Models
di: He, Haolin, et al.
Pubblicazione: (2025)
di: He, Haolin, et al.
Pubblicazione: (2025)
Asymmetric Phase Coding Audio Watermarking
di: Yang, Guang, et al.
Pubblicazione: (2026)
di: Yang, Guang, et al.
Pubblicazione: (2026)
Speaker Adaptation for Quantised End-to-End ASR Models
di: Zhao, Qiuming, et al.
Pubblicazione: (2024)
di: Zhao, Qiuming, et al.
Pubblicazione: (2024)
SAML: Speaker Adaptive Mixture of LoRA Experts for End-to-End ASR
di: Zhao, Qiuming, et al.
Pubblicazione: (2024)
di: Zhao, Qiuming, et al.
Pubblicazione: (2024)
Audio-Mind: An Auditable Agentic Framework for Audio Understanding
di: Wang, Yucheng, et al.
Pubblicazione: (2026)
di: Wang, Yucheng, et al.
Pubblicazione: (2026)
WMCodec: End-to-End Neural Speech Codec with Deep Watermarking for Authenticity Verification
di: Zhou, Junzuo, et al.
Pubblicazione: (2024)
di: Zhou, Junzuo, et al.
Pubblicazione: (2024)
StreamMark: A Deep Learning-Based Semi-Fragile Audio Watermarking for Proactive Deepfake Detection
di: Liu, Zhentao, et al.
Pubblicazione: (2026)
di: Liu, Zhentao, et al.
Pubblicazione: (2026)
Joint Speaker Features Learning for Audio-visual Multichannel Speech Separation and Recognition
di: Li, Guinan, et al.
Pubblicazione: (2024)
di: Li, Guinan, et al.
Pubblicazione: (2024)
Minimising Biasing Word Errors for Contextual ASR with the Tree-Constrained Pointer Generator
di: Sun, Guangzhi, et al.
Pubblicazione: (2022)
di: Sun, Guangzhi, et al.
Pubblicazione: (2022)
Multi-bit Audio Watermarking
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
Bringing Interpretability to Neural Audio Codecs
di: Sadok, Samir, et al.
Pubblicazione: (2025)
di: Sadok, Samir, et al.
Pubblicazione: (2025)
WavMark: Watermarking for Audio Generation
di: Chen, Guangyu, et al.
Pubblicazione: (2023)
di: Chen, Guangyu, et al.
Pubblicazione: (2023)
SilentCipher: Deep Audio Watermarking
di: Singh, Mayank Kumar, et al.
Pubblicazione: (2024)
di: Singh, Mayank Kumar, et al.
Pubblicazione: (2024)
Towards Evaluating Generative Audio: Insights from Neural Audio Codec Embedding Distances
di: Biswas, Arijit, et al.
Pubblicazione: (2025)
di: Biswas, Arijit, et al.
Pubblicazione: (2025)
Wav2Prompt: End-to-End Speech Prompt Generation and Tuning For LLM in Zero and Few-shot Learning
di: Deng, Keqi, et al.
Pubblicazione: (2024)
di: Deng, Keqi, et al.
Pubblicazione: (2024)
Code Drift: Towards Idempotent Neural Audio Codecs
di: O'Reilly, Patrick, et al.
Pubblicazione: (2024)
di: O'Reilly, Patrick, et al.
Pubblicazione: (2024)
Tracking Listener Attention: Gaze-Guided Audio-Visual Speech Enhancement Framework
di: Yang, Hsiang-Cheng, et al.
Pubblicazione: (2026)
di: Yang, Hsiang-Cheng, et al.
Pubblicazione: (2026)
Unfolding A Few Structures for The Many: Memory-Efficient Compression of Conformer and Speech Foundation Models
di: Li, Zhaoqing, et al.
Pubblicazione: (2025)
di: Li, Zhaoqing, et al.
Pubblicazione: (2025)
Whisper-PMFA: Partial Multi-Scale Feature Aggregation for Speaker Verification using Whisper Models
di: Zhao, Yiyang, et al.
Pubblicazione: (2024)
di: Zhao, Yiyang, et al.
Pubblicazione: (2024)
Text-based Audio Retrieval by Learning from Similarities between Audio Captions
di: Xie, Huang, et al.
Pubblicazione: (2024)
di: Xie, Huang, et al.
Pubblicazione: (2024)
Audio Deepfake Detection at the First Greeting: "Hi!"
di: Shi, Haohan, et al.
Pubblicazione: (2026)
di: Shi, Haohan, et al.
Pubblicazione: (2026)
Acoustic Teleportation via Disentangled Neural Audio Codec Representations
di: Grundhuber, Philipp, et al.
Pubblicazione: (2025)
di: Grundhuber, Philipp, et al.
Pubblicazione: (2025)
Speech Separation using Neural Audio Codecs with Embedding Loss
di: Yip, Jia Qi, et al.
Pubblicazione: (2024)
di: Yip, Jia Qi, et al.
Pubblicazione: (2024)
DurIAN-E 2: Duration Informed Attention Network with Adaptive Variational Autoencoder and Adversarial Learning for Expressive Text-to-Speech Synthesis
di: Gu, Yu, et al.
Pubblicazione: (2024)
di: Gu, Yu, et al.
Pubblicazione: (2024)
Target Speaker Lipreading by Audio-Visual Self-Distillation Pretraining and Speaker Adaptation
di: Zhang, Jing-Xuan, et al.
Pubblicazione: (2025)
di: Zhang, Jing-Xuan, et al.
Pubblicazione: (2025)
UniSep: Universal Target Audio Separation with Language Models at Scale
di: Wang, Yuanyuan, et al.
Pubblicazione: (2025)
di: Wang, Yuanyuan, et al.
Pubblicazione: (2025)
Low-Rank and Sparse Model Merging for Multi-Lingual Speech Recognition and Translation
di: Zhao, Qiuming, et al.
Pubblicazione: (2025)
di: Zhao, Qiuming, et al.
Pubblicazione: (2025)
Leveraging Mamba with Full-Face Vision for Audio-Visual Speech Enhancement
di: Chao, Rong, et al.
Pubblicazione: (2025)
di: Chao, Rong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Audio-Conditioned Diffusion LLMs for ASR and Deliberation Processing
di: Wang, Mengqi, et al.
Pubblicazione: (2025) -
SPEAR: A Unified SSL Framework for Learning Speech and Audio Representations
di: Yang, Xiaoyu, et al.
Pubblicazione: (2025) -
SOT Triggered Neural Clustering for Speaker Attributed ASR
di: Zheng, Xianrui, et al.
Pubblicazione: (2024) -
Augmenting Open-Vocabulary Dysarthric Speech Assessment with Human Perceptual Supervision
di: Jia, Kaimeng, et al.
Pubblicazione: (2025) -
Deep Audio Watermarks are Shallow: Limitations of Post-Hoc Watermarking Techniques for Speech
di: O'Reilly, Patrick, et al.
Pubblicazione: (2025)