OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Alonso-Jiménez, Pablo, Ramoneda, Pedro, Araz, R. Oguz, Poltronieri, Andrea, Bogdanov, Dmitry |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Benchmarking Music Autotagging with MGPHot Expert Annotations vs. Generic Tag Datasets
par: Ramoneda, Pedro, et autres
Publié: (2025)
par: Ramoneda, Pedro, et autres
Publié: (2025)
Discogs-VI: A Musical Version Identification Dataset Based on Public Editorial Metadata
par: Araz, R. Oguz, et autres
Publié: (2024)
par: Araz, R. Oguz, et autres
Publié: (2024)
Enhancing Neural Audio Fingerprint Robustness to Audio Degradation for Music Identification
par: Araz, R. Oguz, et autres
Publié: (2025)
par: Araz, R. Oguz, et autres
Publié: (2025)
Leveraging Pre-Trained Autoencoders for Interpretable Prototype Learning of Music Audio
par: Alonso-Jiménez, Pablo, et autres
Publié: (2024)
par: Alonso-Jiménez, Pablo, et autres
Publié: (2024)
Can Audio Reveal Music Performance Difficulty? Insights from the Piano Syllabus Dataset
par: Ramoneda, Pedro, et autres
Publié: (2024)
par: Ramoneda, Pedro, et autres
Publié: (2024)
Supervised contrastive learning from weakly-labeled audio segments for musical version matching
par: Serrà, Joan, et autres
Publié: (2025)
par: Serrà, Joan, et autres
Publié: (2025)
Music Proofreading with RefinPaint: Where and How to Modify Compositions given Context
par: Ramoneda, Pedro, et autres
Publié: (2024)
par: Ramoneda, Pedro, et autres
Publié: (2024)
Evaluating Disentangled Representations for Controllable Music Generation
par: Ibáñez-Martínez, Laura, et autres
Publié: (2026)
par: Ibáñez-Martínez, Laura, et autres
Publié: (2026)
Self-Supervised Multi-View Learning for Disentangled Music Audio Representations
par: Wilkins, Julia, et autres
Publié: (2024)
par: Wilkins, Julia, et autres
Publié: (2024)
Amphion: An Open-Source Audio, Music and Speech Generation Toolkit
par: Zhang, Xueyao, et autres
Publié: (2023)
par: Zhang, Xueyao, et autres
Publié: (2023)
Audio Conditioning for Music Generation via Discrete Bottleneck Features
par: Rouard, Simon, et autres
Publié: (2024)
par: Rouard, Simon, et autres
Publié: (2024)
From Discord to Harmony: Decomposed Consonance-based Training for Improved Audio Chord Estimation
par: Poltronieri, Andrea, et autres
Publié: (2025)
par: Poltronieri, Andrea, et autres
Publié: (2025)
Evaluating CNN with Stacked Feature Representations and Audio Spectrogram Transformer Models for Sound Classification
par: Dehaghania, Parinaz Binandeh, et autres
Publié: (2026)
par: Dehaghania, Parinaz Binandeh, et autres
Publié: (2026)
MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models
par: Gong, Yitian, et autres
Publié: (2026)
par: Gong, Yitian, et autres
Publié: (2026)
Tune It Up: Music Genre Transfer and Prediction
par: Samet, Fidan, et autres
Publié: (2025)
par: Samet, Fidan, et autres
Publié: (2025)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
MuChoMusic: Evaluating Music Understanding in Multimodal Audio-Language Models
par: Weck, Benno, et autres
Publié: (2024)
par: Weck, Benno, et autres
Publié: (2024)
M-BEST-RQ: A Multi-Channel Speech Foundation Model for Smart Glasses
par: Yang, Yufeng, et autres
Publié: (2024)
par: Yang, Yufeng, et autres
Publié: (2024)
SpecMaskGIT: Masked Generative Modeling of Audio Spectrograms for Efficient Audio Synthesis and Beyond
par: Comunità, Marco, et autres
Publié: (2024)
par: Comunità, Marco, et autres
Publié: (2024)
Perceptual Musical Features for Interpretable Audio Tagging
par: Lyberatos, Vassilis, et autres
Publié: (2023)
par: Lyberatos, Vassilis, et autres
Publié: (2023)
Learning Music Audio Representations With Limited Data
par: Plachouras, Christos, et autres
Publié: (2025)
par: Plachouras, Christos, et autres
Publié: (2025)
MART: Learning Hierarchical Music Audio Representations with Part-Whole Transformer
par: Yao, Dong, et autres
Publié: (2023)
par: Yao, Dong, et autres
Publié: (2023)
Prediction of Spotify Chart Success Using Audio and Streaming Features
par: Cabansag, Ian Jacob, et autres
Publié: (2025)
par: Cabansag, Ian Jacob, et autres
Publié: (2025)
Exploring Perceptual Audio Quality Measurement on Stereo Processing Using the Open Dataset of Audio Quality
par: Delgado, Pablo M., et autres
Publié: (2025)
par: Delgado, Pablo M., et autres
Publié: (2025)
ChordSync: Conformer-Based Alignment of Chord Annotations to Music Audio
par: Poltronieri, Andrea, et autres
Publié: (2024)
par: Poltronieri, Andrea, et autres
Publié: (2024)
Exploring Prediction Targets in Masked Pre-Training for Speech Foundation Models
par: Chen, Li-Wei, et autres
Publié: (2024)
par: Chen, Li-Wei, et autres
Publié: (2024)
Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning
par: Wilkins, Julia, et autres
Publié: (2025)
par: Wilkins, Julia, et autres
Publié: (2025)
Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems
par: Xiao, Yang, et autres
Publié: (2026)
par: Xiao, Yang, et autres
Publié: (2026)
Generative Audio Language Modeling with Continuous-valued Tokens and Masked Next-Token Prediction
par: Yang, Shu-wen, et autres
Publié: (2025)
par: Yang, Shu-wen, et autres
Publié: (2025)
Discrete Audio Representations for Automated Audio Captioning
par: Tian, Jingguang, et autres
Publié: (2025)
par: Tian, Jingguang, et autres
Publié: (2025)
Masked Audio Modeling with CLAP and Multi-Objective Learning
par: Xin, Yifei, et autres
Publié: (2024)
par: Xin, Yifei, et autres
Publié: (2024)
Towards Explainable and Interpretable Musical Difficulty Estimation: A Parameter-efficient Approach
par: Ramoneda, Pedro, et autres
Publié: (2024)
par: Ramoneda, Pedro, et autres
Publié: (2024)
MoodLoopGP: Generating Emotion-Conditioned Loop Tablature Music with Multi-Granular Features
par: Cui, Wenqian, et autres
Publié: (2024)
par: Cui, Wenqian, et autres
Publié: (2024)
CLAP-ART: Automated Audio Captioning with Semantic-rich Audio Representation Tokenizer
par: Takeuchi, Daiki, et autres
Publié: (2025)
par: Takeuchi, Daiki, et autres
Publié: (2025)
COCOLA: Coherence-Oriented Contrastive Learning of Musical Audio Representations
par: Ciranni, Ruben, et autres
Publié: (2024)
par: Ciranni, Ruben, et autres
Publié: (2024)
Compositional Audio Representation Learning
par: Sridhar, Sripathi, et autres
Publié: (2024)
par: Sridhar, Sripathi, et autres
Publié: (2024)
The Rhythm In Anything: Audio-Prompted Drums Generation with Masked Language Modeling
par: O'Reilly, Patrick, et autres
Publié: (2025)
par: O'Reilly, Patrick, et autres
Publié: (2025)
Joint Audio and Symbolic Conditioning for Temporally Controlled Text-to-Music Generation
par: Tal, Or, et autres
Publié: (2024)
par: Tal, Or, et autres
Publié: (2024)
LongCat-Audio-Codec: An Audio Tokenizer and Detokenizer Solution Designed for Speech Large Language Models
par: Zhao, Xiaohan, et autres
Publié: (2025)
par: Zhao, Xiaohan, et autres
Publié: (2025)
OpenACE: An Open Benchmark for Evaluating Audio Coding Performance
par: Coldenhoff, Jozef, et autres
Publié: (2024)
par: Coldenhoff, Jozef, et autres
Publié: (2024)
Documents similaires
-
Benchmarking Music Autotagging with MGPHot Expert Annotations vs. Generic Tag Datasets
par: Ramoneda, Pedro, et autres
Publié: (2025) -
Discogs-VI: A Musical Version Identification Dataset Based on Public Editorial Metadata
par: Araz, R. Oguz, et autres
Publié: (2024) -
Enhancing Neural Audio Fingerprint Robustness to Audio Degradation for Music Identification
par: Araz, R. Oguz, et autres
Publié: (2025) -
Leveraging Pre-Trained Autoencoders for Interpretable Prototype Learning of Music Audio
par: Alonso-Jiménez, Pablo, et autres
Publié: (2024) -
Can Audio Reveal Music Performance Difficulty? Insights from the Piano Syllabus Dataset
par: Ramoneda, Pedro, et autres
Publié: (2024)