Training a Perceptual Model for Evaluating Auditory Similarity in Music Adversarial Attack
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Yuxuan, Sang, Rui, Zhang, Peihong, Li, Zhixin, Li, Shengchen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MAIA: An Inpainting-Based Approach for Music Adversarial Attacks
par: Liu, Yuxuan, et autres
Publié: (2025)
par: Liu, Yuxuan, et autres
Publié: (2025)
TF-SepNet: An Efficient 1D Kernel Design in CNNs for Low-Complexity Acoustic Scene Classification
par: Cai, Yiqiang, et autres
Publié: (2023)
par: Cai, Yiqiang, et autres
Publié: (2023)
Leveraging Self-supervised Audio Representations for Data-Efficient Acoustic Scene Classification
par: Cai, Yiqiang, et autres
Publié: (2024)
par: Cai, Yiqiang, et autres
Publié: (2024)
Learning Separated Representations for Instrument-based Music Similarity
par: Hashizume, Yuka, et autres
Publié: (2025)
par: Hashizume, Yuka, et autres
Publié: (2025)
Melodia: Training-Free Music Editing Guided by Attention Probing in Diffusion Models
par: Yang, Yi, et autres
Publié: (2025)
par: Yang, Yi, et autres
Publié: (2025)
Learning Multidimensional Disentangled Representations of Instrumental Sounds for Musical Similarity Assessment
par: Hashizume, Yuka, et autres
Publié: (2024)
par: Hashizume, Yuka, et autres
Publié: (2024)
Speech Denoising with Auditory Models
par: Saddler, Mark R., et autres
Publié: (2020)
par: Saddler, Mark R., et autres
Publié: (2020)
Enabling Auditory Large Language Models for Automatic Speech Quality Evaluation
par: Wang, Siyin, et autres
Publié: (2024)
par: Wang, Siyin, et autres
Publié: (2024)
Weighted-Sampling Audio Adversarial Example Attack
par: Liu, Xiaolei, et autres
Publié: (2019)
par: Liu, Xiaolei, et autres
Publié: (2019)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
StreamAAD: Decoding Spatial Auditory Attention with a Streaming Architecture
par: Qiu, Zelin, et autres
Publié: (2024)
par: Qiu, Zelin, et autres
Publié: (2024)
AdvSV: An Over-the-Air Adversarial Attack Dataset for Speaker Verification
par: Wang, Li, et autres
Publié: (2023)
par: Wang, Li, et autres
Publié: (2023)
SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms
par: Li, Sirui, et autres
Publié: (2025)
par: Li, Sirui, et autres
Publié: (2025)
Explainable Detection of Machine Generated Music and Early Systematic Evaluation
par: Li, Yupei, et autres
Publié: (2024)
par: Li, Yupei, et autres
Publié: (2024)
Audio-Visual Target Speaker Extraction with Reverse Selective Auditory Attention
par: Tao, Ruijie, et autres
Publié: (2024)
par: Tao, Ruijie, et autres
Publié: (2024)
MusicEval: A Generative Music Dataset with Expert Ratings for Automatic Text-to-Music Evaluation
par: Liu, Cheng, et autres
Publié: (2025)
par: Liu, Cheng, et autres
Publié: (2025)
Exploring Differences between Human Perception and Model Inference in Audio Event Recognition
par: Tan, Yizhou, et autres
Publié: (2024)
par: Tan, Yizhou, et autres
Publié: (2024)
Seed-Music: A Unified Framework for High Quality and Controlled Music Generation
par: Bai, Ye, et autres
Publié: (2024)
par: Bai, Ye, et autres
Publié: (2024)
Towards Musically Informed Evaluation of Piano Transcription Models
par: Hu, Patricia, et autres
Publié: (2024)
par: Hu, Patricia, et autres
Publié: (2024)
URGENT-PK: Perceptually-Aligned Ranking Model Designed for Speech Enhancement Competition
par: Wang, Jiahe, et autres
Publié: (2025)
par: Wang, Jiahe, et autres
Publié: (2025)
Music Similarity Representation Learning Focusing on Individual Instruments with Source Separation and Human Preference
par: Imamura, Takehiro, et autres
Publié: (2025)
par: Imamura, Takehiro, et autres
Publié: (2025)
Perceptual Musical Features for Interpretable Audio Tagging
par: Lyberatos, Vassilis, et autres
Publié: (2023)
par: Lyberatos, Vassilis, et autres
Publié: (2023)
Transferable Adversarial Attacks on Audio Deepfake Detection
par: Farooq, Muhammad Umar, et autres
Publié: (2025)
par: Farooq, Muhammad Umar, et autres
Publié: (2025)
DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification
par: Wang, Qing, et autres
Publié: (2025)
par: Wang, Qing, et autres
Publié: (2025)
Hybrid-Sep: Language-queried audio source separation via pre-trained Model Fusion and Adversarial Diffusion Training
par: Feng, Jianyuan, et autres
Publié: (2025)
par: Feng, Jianyuan, et autres
Publié: (2025)
Large-Scale Training Data Attribution for Music Generative Models via Unlearning
par: Choi, Woosung, et autres
Publié: (2025)
par: Choi, Woosung, et autres
Publié: (2025)
Automatic Live Music Song Identification Using Multi-level Deep Sequence Similarity Learning
par: Hakala, Aapo, et autres
Publié: (2025)
par: Hakala, Aapo, et autres
Publié: (2025)
Music Style Transfer with Time-Varying Inversion of Diffusion Models
par: Li, Sifei, et autres
Publié: (2024)
par: Li, Sifei, et autres
Publié: (2024)
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
par: Li, Jiajia, et autres
Publié: (2024)
par: Li, Jiajia, et autres
Publié: (2024)
FakeMusicCaps: a Dataset for Detection and Attribution of Synthetic Music Generated via Text-to-Music Models
par: Comanducci, Luca, et autres
Publié: (2024)
par: Comanducci, Luca, et autres
Publié: (2024)
Auditory Representation Effective for Estimating Vocal Tract Information
par: Irino, Toshio, et autres
Publié: (2023)
par: Irino, Toshio, et autres
Publié: (2023)
OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction
par: Alonso-Jiménez, Pablo, et autres
Publié: (2025)
par: Alonso-Jiménez, Pablo, et autres
Publié: (2025)
Polyphonia: Zero-Shot Timbre Transfer in Polyphonic Music with Acoustic-Informed Attention Calibration
par: Li, Haowen, et autres
Publié: (2026)
par: Li, Haowen, et autres
Publié: (2026)
The MUSE Benchmark: Probing Music Perception and Auditory Relational Reasoning in Audio LLMS
par: Carone, Brandon James, et autres
Publié: (2025)
par: Carone, Brandon James, et autres
Publié: (2025)
Improving Controllability and Editability for Pretrained Text-to-Music Generation Models
par: Zhang, Yixiao
Publié: (2024)
par: Zhang, Yixiao
Publié: (2024)
Sound Field Translation and Mixed Source Model for Virtual Applications with Perceptual Validation
par: Birnie, Lachlan, et autres
Publié: (2020)
par: Birnie, Lachlan, et autres
Publié: (2020)
Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling
par: Zhou, Xuanru, et autres
Publié: (2025)
par: Zhou, Xuanru, et autres
Publié: (2025)
Pianoroll-Event: A Novel Score Representation for Symbolic Music
par: Qian, Lekai, et autres
Publié: (2026)
par: Qian, Lekai, et autres
Publié: (2026)
Modeling the Difficulty of Saxophone Music
par: Libřický, Šimon, et autres
Publié: (2025)
par: Libřický, Šimon, et autres
Publié: (2025)
Diffusion-Based Adversarial Purification for Speaker Verification
par: Bai, Yibo, et autres
Publié: (2023)
par: Bai, Yibo, et autres
Publié: (2023)
Documents similaires
-
MAIA: An Inpainting-Based Approach for Music Adversarial Attacks
par: Liu, Yuxuan, et autres
Publié: (2025) -
TF-SepNet: An Efficient 1D Kernel Design in CNNs for Low-Complexity Acoustic Scene Classification
par: Cai, Yiqiang, et autres
Publié: (2023) -
Leveraging Self-supervised Audio Representations for Data-Efficient Acoustic Scene Classification
par: Cai, Yiqiang, et autres
Publié: (2024) -
Learning Separated Representations for Instrument-based Music Similarity
par: Hashizume, Yuka, et autres
Publié: (2025) -
Melodia: Training-Free Music Editing Guided by Attention Probing in Diffusion Models
par: Yang, Yi, et autres
Publié: (2025)