An Experimental Comparison Of Multi-view Self-supervised Methods For Music Tagging
Fuente:
arXiv
Salvato in:
| Autori principali: | Meseguer-Brocal, Gabriel, Desblancs, Dorian, Hennequin, Romain |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
From Real to Cloned Singer Identification
di: Desblancs, Dorian, et al.
Pubblicazione: (2024)
di: Desblancs, Dorian, et al.
Pubblicazione: (2024)
Detecting music deepfakes is easy but actually hard
di: Afchar, Darius, et al.
Pubblicazione: (2024)
di: Afchar, Darius, et al.
Pubblicazione: (2024)
AI-Generated Music Detection and its Challenges
di: Afchar, Darius, et al.
Pubblicazione: (2025)
di: Afchar, Darius, et al.
Pubblicazione: (2025)
S-KEY: Self-supervised Learning of Major and Minor Keys from Audio
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
Emergent musical properties of a transformer under contrastive self-supervised learning
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
STONE: Self-supervised Tonality Estimator
di: Kong, Yuexuan, et al.
Pubblicazione: (2024)
di: Kong, Yuexuan, et al.
Pubblicazione: (2024)
Learning Linearity in Audio Consistency Autoencoders via Implicit Regularization
di: Torres, Bernardo, et al.
Pubblicazione: (2025)
di: Torres, Bernardo, et al.
Pubblicazione: (2025)
LC-Protonets: Multi-Label Few-Shot Learning for World Music Audio Tagging
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2024)
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2024)
Semantic-Aware Interpretable Multimodal Music Auto-Tagging
di: Patakis, Andreas, et al.
Pubblicazione: (2025)
di: Patakis, Andreas, et al.
Pubblicazione: (2025)
Beyond Musical Descriptors: Extracting Preference-Bearing Intent in Music Queries
di: Baranes, Marion, et al.
Pubblicazione: (2026)
di: Baranes, Marion, et al.
Pubblicazione: (2026)
Comparison of spectrogram scaling in multi-label Music Genre Recognition
di: Karpiński, Bartosz, et al.
Pubblicazione: (2025)
di: Karpiński, Bartosz, et al.
Pubblicazione: (2025)
Generating Music with Structure Using Self-Similarity as Attention
di: Hager, Sophia, et al.
Pubblicazione: (2024)
di: Hager, Sophia, et al.
Pubblicazione: (2024)
Self-Supervised Learning for Few-Shot Bird Sound Classification
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
Multi-Source Music Generation with Latent Diffusion
di: Xu, Zhongweiyang, et al.
Pubblicazione: (2024)
di: Xu, Zhongweiyang, et al.
Pubblicazione: (2024)
Causal Self-supervised Pretrained Frontend with Predictive Code for Speech Separation
di: Wang, Wupeng, et al.
Pubblicazione: (2025)
di: Wang, Wupeng, et al.
Pubblicazione: (2025)
Musical Word Embedding for Music Tagging and Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
Sound Tagging in Infant-centric Home Soundscapes
di: Khan, Mohammad Nur Hossain, et al.
Pubblicazione: (2024)
di: Khan, Mohammad Nur Hossain, et al.
Pubblicazione: (2024)
Multi-Source Diffusion Models for Simultaneous Music Generation and Separation
di: Mariani, Giorgio, et al.
Pubblicazione: (2023)
di: Mariani, Giorgio, et al.
Pubblicazione: (2023)
Generalized Multi-Source Inference for Text Conditioned Music Diffusion Models
di: Postolache, Emilian, et al.
Pubblicazione: (2024)
di: Postolache, Emilian, et al.
Pubblicazione: (2024)
MusicRL: Aligning Music Generation to Human Preferences
di: Cideron, Geoffrey, et al.
Pubblicazione: (2024)
di: Cideron, Geoffrey, et al.
Pubblicazione: (2024)
Music Tagging with Classifier Group Chains
di: Hasumi, Takuya, et al.
Pubblicazione: (2025)
di: Hasumi, Takuya, et al.
Pubblicazione: (2025)
Do we need more complex representations for structure? A comparison of note duration representation for Music Transformers
di: Souza, Gabriel, et al.
Pubblicazione: (2024)
di: Souza, Gabriel, et al.
Pubblicazione: (2024)
Mixture of Mixups for Multi-label Classification of Rare Anuran Sounds
di: Moummad, Ilyass, et al.
Pubblicazione: (2024)
di: Moummad, Ilyass, et al.
Pubblicazione: (2024)
Geo-ATBench: A Benchmark for Geospatial Audio Tagging with Geospatial Semantic Context
di: Hou, Yuanbo, et al.
Pubblicazione: (2026)
di: Hou, Yuanbo, et al.
Pubblicazione: (2026)
Anticipatory Music Transformer
di: Thickstun, John, et al.
Pubblicazione: (2023)
di: Thickstun, John, et al.
Pubblicazione: (2023)
Automatic Identification of Samples in Hip-Hop Music via Multi-Loss Training and an Artificial Dataset
di: Cheston, Huw, et al.
Pubblicazione: (2025)
di: Cheston, Huw, et al.
Pubblicazione: (2025)
Integrating Text-to-Music Models with Language Models: Composing Long Structured Music Pieces
di: Atassi, Lilac
Pubblicazione: (2024)
di: Atassi, Lilac
Pubblicazione: (2024)
ProGress: Structured Music Generation via Graph Diffusion and Hierarchical Music Analysis
di: Ni-Hahn, Stephen, et al.
Pubblicazione: (2025)
di: Ni-Hahn, Stephen, et al.
Pubblicazione: (2025)
Score-informed Music Source Separation: Improving Synthetic-to-real Generalization in Classical Music
di: Tunturi, Eetu, et al.
Pubblicazione: (2025)
di: Tunturi, Eetu, et al.
Pubblicazione: (2025)
Double Entendre: Robust Audio-Based AI-Generated Lyrics Detection via Multi-View Fusion
di: Frohmann, Markus, et al.
Pubblicazione: (2025)
di: Frohmann, Markus, et al.
Pubblicazione: (2025)
Multi-Stage Music Source Restoration with BandSplit-RoFormer Separation and HiFi++ GAN
di: Morocutti, Tobias, et al.
Pubblicazione: (2026)
di: Morocutti, Tobias, et al.
Pubblicazione: (2026)
Energy Consumption Trends in Sound Event Detection Systems
di: Douwes, Constance, et al.
Pubblicazione: (2024)
di: Douwes, Constance, et al.
Pubblicazione: (2024)
A benchmark of state-of-the-art sound event detection systems evaluated on synthetic soundscapes
di: Ronchini, Francesca, et al.
Pubblicazione: (2022)
di: Ronchini, Francesca, et al.
Pubblicazione: (2022)
Hierarchical Label Propagation: A Model-Size-Dependent Performance Booster for AudioSet Tagging
di: Tuncay, Ludovic, et al.
Pubblicazione: (2025)
di: Tuncay, Ludovic, et al.
Pubblicazione: (2025)
YourMT3+: Multi-instrument Music Transcription with Enhanced Transformer Architectures and Cross-dataset Stem Augmentation
di: Chang, Sungkyun, et al.
Pubblicazione: (2024)
di: Chang, Sungkyun, et al.
Pubblicazione: (2024)
Tempo estimation as fully self-supervised binary classification
di: Henkel, Florian, et al.
Pubblicazione: (2024)
di: Henkel, Florian, et al.
Pubblicazione: (2024)
Watermarking Training Data of Music Generation Models
di: Epple, Pascal, et al.
Pubblicazione: (2024)
di: Epple, Pascal, et al.
Pubblicazione: (2024)
Benchmarking Representations for Speech, Music, and Acoustic Events
di: La Quatra, Moreno, et al.
Pubblicazione: (2024)
di: La Quatra, Moreno, et al.
Pubblicazione: (2024)
Music Genre Classification: Training an AI model
di: Mogonediwa, Keoikantse
Pubblicazione: (2024)
di: Mogonediwa, Keoikantse
Pubblicazione: (2024)
Evaluating Disentangled Representations for Controllable Music Generation
di: Ibáñez-Martínez, Laura, et al.
Pubblicazione: (2026)
di: Ibáñez-Martínez, Laura, et al.
Pubblicazione: (2026)
Documenti analoghi
-
From Real to Cloned Singer Identification
di: Desblancs, Dorian, et al.
Pubblicazione: (2024) -
Detecting music deepfakes is easy but actually hard
di: Afchar, Darius, et al.
Pubblicazione: (2024) -
AI-Generated Music Detection and its Challenges
di: Afchar, Darius, et al.
Pubblicazione: (2025) -
S-KEY: Self-supervised Learning of Major and Minor Keys from Audio
di: Kong, Yuexuan, et al.
Pubblicazione: (2025) -
Emergent musical properties of a transformer under contrastive self-supervised learning
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)