HarmonicAttack: An Adaptive Cross-Domain Audio Watermark Removal
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Kexin, Hu, Xiao, Grishchenko, Ilya, Lie, David |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Self Voice Conversion as an Attack against Neural Audio Watermarking
par: Özer, Yigitcan, et autres
Publié: (2026)
par: Özer, Yigitcan, et autres
Publié: (2026)
XAttnMark: Learning Robust Audio Watermarking with Cross-Attention
par: Liu, Yixin, et autres
Publié: (2025)
par: Liu, Yixin, et autres
Publié: (2025)
Latent-Mark: An Audio Watermark Robust to Neural Resynthesis
par: Chen, Yen-Shan, et autres
Publié: (2026)
par: Chen, Yen-Shan, et autres
Publié: (2026)
Codec-Robust Attacks on Audio LLMs
par: Roh, Jaechul, et autres
Publié: (2026)
par: Roh, Jaechul, et autres
Publié: (2026)
Cross-Domain Audio Deepfake Detection: Dataset and Analysis
par: Li, Yuang, et autres
Publié: (2024)
par: Li, Yuang, et autres
Publié: (2024)
Variable-Length Audio Fingerprinting
par: Chen, Hongjie, et autres
Publié: (2026)
par: Chen, Hongjie, et autres
Publié: (2026)
Are Audio-Language Models Listening? Audio-Specialist Heads for Adaptive Audio Steering
par: Glazer, Neta, et autres
Publié: (2026)
par: Glazer, Neta, et autres
Publié: (2026)
GRM: Utility-Aware Jailbreak Attacks on Audio LLMs via Gradient-Ratio Masking
par: Wang, Yunqiang, et autres
Publié: (2026)
par: Wang, Yunqiang, et autres
Publié: (2026)
Adaptive Evidence Weighting for Audio-Spatiotemporal Fusion
par: Ovanger, Oscar, et autres
Publié: (2026)
par: Ovanger, Oscar, et autres
Publié: (2026)
Speech-Audio Compositional Attacks on Multimodal LLMs and Their Mitigation with SALMONN-Guard
par: Yang, Yudong, et autres
Publié: (2025)
par: Yang, Yudong, et autres
Publié: (2025)
Audio Codec Augmentation for Robust Collaborative Watermarking of Speech Synthesis
par: Juvela, Lauri, et autres
Publié: (2024)
par: Juvela, Lauri, et autres
Publié: (2024)
Pay (Cross) Attention to the Melody: Curriculum Masking for Single-Encoder Melodic Harmonization
par: Kaliakatsos-Papakostas, Maximos, et autres
Publié: (2026)
par: Kaliakatsos-Papakostas, Maximos, et autres
Publié: (2026)
Domain-Agnostic Causal-Aware Audio Transformer for Infant Cry Classification
par: Owino, Geofrey, et autres
Publié: (2025)
par: Owino, Geofrey, et autres
Publié: (2025)
Diffusion-based Surrogate Model for Time-varying Underwater Acoustic Channels
par: Li, Kexin, et autres
Publié: (2025)
par: Li, Kexin, et autres
Publié: (2025)
MOSS-Audio Technical Report
par: Yang, Chen, et autres
Publié: (2026)
par: Yang, Chen, et autres
Publié: (2026)
Breaking Audio Large Language Models by Attacking Only the Encoder: A Universal Targeted Latent-Space Audio Attack
par: Ziv, Roee, et autres
Publié: (2025)
par: Ziv, Roee, et autres
Publié: (2025)
LoSATok: Low-dimensional Semantic-Acoustic Tokenizer for Cross-Domain Audio Understanding and Generation
par: Zhang, Zhisheng, et autres
Publié: (2026)
par: Zhang, Zhisheng, et autres
Publié: (2026)
Audio Jailbreaks in Large Audio-Language Models: Taxonomy, Attack-Defense Analysis, and Cost-Aware Evaluation
par: Feng, Bo-Han, et autres
Publié: (2026)
par: Feng, Bo-Han, et autres
Publié: (2026)
Eureka-Audio: Triggering Audio Intelligence in Compact Language Models
par: Zhang, Dan, et autres
Publié: (2026)
par: Zhang, Dan, et autres
Publié: (2026)
GROOT: Generating Robust Watermark for Diffusion-Model-Based Audio Synthesis
par: Liu, Weizhi, et autres
Publié: (2024)
par: Liu, Weizhi, et autres
Publié: (2024)
AudioMoG: Guiding Audio Generation with Mixture-of-Guidance
par: Wang, Junyou, et autres
Publié: (2025)
par: Wang, Junyou, et autres
Publié: (2025)
Protecting Bystander Privacy via Selective Hearing in Audio LLMs
par: Zhan, Xiao, et autres
Publié: (2025)
par: Zhan, Xiao, et autres
Publié: (2025)
Who Can Withstand Chat-Audio Attacks? An Evaluation Benchmark for Large Audio-Language Models
par: Yang, Wanqi, et autres
Publié: (2024)
par: Yang, Wanqi, et autres
Publié: (2024)
MeanAudio: Fast and Faithful Text-to-Audio Generation with Mean Flows
par: Li, Xiquan, et autres
Publié: (2025)
par: Li, Xiquan, et autres
Publié: (2025)
AudioGuard: Toward Comprehensive Audio Safety Protection Across Diverse Threat Models
par: Kang, Mintong, et autres
Publié: (2026)
par: Kang, Mintong, et autres
Publié: (2026)
Bridging Biological Hearing and Neuromorphic Computing: End-to-End Time-Domain Audio Signal Processing with Reservoir Computing
par: Sebastian, Rinku, et autres
Publié: (2026)
par: Sebastian, Rinku, et autres
Publié: (2026)
Audio-Guided Dynamic Modality Fusion with Stereo-Aware Attention for Audio-Visual Navigation
par: Li, Jia, et autres
Publié: (2025)
par: Li, Jia, et autres
Publié: (2025)
Separate First, Fuse Later: Mitigating Cross-Modal Interference in Audio-Visual LLMs Reasoning with Modality-Specific Chain-of-Thought
par: Li, Xuanchen, et autres
Publié: (2026)
par: Li, Xuanchen, et autres
Publié: (2026)
Replay Attacks Against Audio Deepfake Detection
par: Müller, Nicolas, et autres
Publié: (2025)
par: Müller, Nicolas, et autres
Publié: (2025)
PhyAVBench: A Challenging Audio Physics-Sensitivity Benchmark for Physically Grounded Text-to-Audio-Video Generation
par: Xie, Tianxin, et autres
Publié: (2025)
par: Xie, Tianxin, et autres
Publié: (2025)
Audio Mamba: Pretrained Audio State Space Model For Audio Tagging
par: Lin, Jiaju, et autres
Publié: (2024)
par: Lin, Jiaju, et autres
Publié: (2024)
Augmentation through Laundering Attacks for Audio Spoof Detection
par: Ali, Hashim, et autres
Publié: (2024)
par: Ali, Hashim, et autres
Publié: (2024)
AudioMotionBench: Evaluating Auditory Motion Perception in Audio LLMs
par: Sun, Zhe, et autres
Publié: (2025)
par: Sun, Zhe, et autres
Publié: (2025)
The Sonar Moment: Benchmarking Audio-Language Models in Audio Geo-Localization
par: Zhang, Ruixing, et autres
Publié: (2026)
par: Zhang, Ruixing, et autres
Publié: (2026)
Stable Audio 3
par: Evans, Zach, et autres
Publié: (2026)
par: Evans, Zach, et autres
Publié: (2026)
Iterative Residual Cross-Attention Mechanism: An Integrated Approach for Audio-Visual Navigation Tasks
par: Zhang, Hailong, et autres
Publié: (2025)
par: Zhang, Hailong, et autres
Publié: (2025)
Audio-Maestro: Enhancing Large Audio-Language Models with Tool-Augmented Reasoning
par: Lee, Kuan-Yi, et autres
Publié: (2025)
par: Lee, Kuan-Yi, et autres
Publié: (2025)
AudioSAE: Towards Understanding of Audio-Processing Models with Sparse AutoEncoders
par: Aparin, Georgii, et autres
Publié: (2026)
par: Aparin, Georgii, et autres
Publié: (2026)
The Sounds of Home: A Speech-Removed Residential Audio Dataset for Sound Event Detection
par: Bibbó, Gabriel, et autres
Publié: (2024)
par: Bibbó, Gabriel, et autres
Publié: (2024)
PitchBench: Measuring Pitch Hearing in Audio-Language Models
par: Dujardin, Milan Liessens, et autres
Publié: (2026)
par: Dujardin, Milan Liessens, et autres
Publié: (2026)
Documents similaires
-
Self Voice Conversion as an Attack against Neural Audio Watermarking
par: Özer, Yigitcan, et autres
Publié: (2026) -
XAttnMark: Learning Robust Audio Watermarking with Cross-Attention
par: Liu, Yixin, et autres
Publié: (2025) -
Latent-Mark: An Audio Watermark Robust to Neural Resynthesis
par: Chen, Yen-Shan, et autres
Publié: (2026) -
Codec-Robust Attacks on Audio LLMs
par: Roh, Jaechul, et autres
Publié: (2026) -
Cross-Domain Audio Deepfake Detection: Dataset and Analysis
par: Li, Yuang, et autres
Publié: (2024)