Estimating Musical Surprisal in Audio
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bjare, Mathias Rose, Cantisani, Giorgia, Lattner, Stefan, Widmer, Gerhard |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Estimating Musical Surprisal from Audio in Autoregressive Diffusion Model Noise Spaces
par: Bjare, Mathias Rose, et autres
Publié: (2025)
par: Bjare, Mathias Rose, et autres
Publié: (2025)
Controlling Surprisal in Music Generation via Information Content Curve Matching
par: Bjare, Mathias Rose, et autres
Publié: (2024)
par: Bjare, Mathias Rose, et autres
Publié: (2024)
Perceptually Aligning Representations of Music via Noise-Augmented Autoencoders
par: Bjare, Mathias Rose, et autres
Publié: (2025)
par: Bjare, Mathias Rose, et autres
Publié: (2025)
Music2Latent2: Audio Compression with Summary Embeddings and Autoregressive Decoding
par: Pasini, Marco, et autres
Publié: (2025)
par: Pasini, Marco, et autres
Publié: (2025)
Zero-shot Musical Stem Retrieval with Joint-Embedding Predictive Architectures
par: Riou, Alain, et autres
Publié: (2024)
par: Riou, Alain, et autres
Publié: (2024)
Diff-A-Riff: Musical Accompaniment Co-creation via Latent Diffusion Models
par: Nistal, Javier, et autres
Publié: (2024)
par: Nistal, Javier, et autres
Publié: (2024)
CoDiCodec: Unifying Continuous and Discrete Compressed Representations of Audio
par: Pasini, Marco, et autres
Publié: (2025)
par: Pasini, Marco, et autres
Publié: (2025)
Are Inherently Interpretable Models More Robust? A Study In Music Emotion Recognition
par: Hoedt, Katharina, et autres
Publié: (2025)
par: Hoedt, Katharina, et autres
Publié: (2025)
Investigating Design Choices in Joint-Embedding Predictive Architectures for General Audio Representation Learning
par: Riou, Alain, et autres
Publié: (2024)
par: Riou, Alain, et autres
Publié: (2024)
Music2Latent: Consistency Autoencoders for Latent Audio Compression
par: Pasini, Marco, et autres
Publié: (2024)
par: Pasini, Marco, et autres
Publié: (2024)
GraphMuse: A Library for Symbolic Music Graph Processing
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
Improving Musical Accompaniment Co-creation via Diffusion Transformers
par: Nistal, Javier, et autres
Publié: (2024)
par: Nistal, Javier, et autres
Publié: (2024)
Assessing the Alignment of Audio Representations with Timbre Similarity Ratings
par: Tian, Haokun, et autres
Publié: (2025)
par: Tian, Haokun, et autres
Publié: (2025)
Diffusion Timbre Transfer Via Mutual Information Guided Inpainting
par: Lee, Ching Ho, et autres
Publié: (2026)
par: Lee, Ching Ho, et autres
Publié: (2026)
Perception-Inspired Graph Convolution for Music Understanding Tasks
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
Perceptual Musical Features for Interpretable Audio Tagging
par: Lyberatos, Vassilis, et autres
Publié: (2023)
par: Lyberatos, Vassilis, et autres
Publié: (2023)
Audio Prompt Adapter: Unleashing Music Editing Abilities for Text-to-Music with Lightweight Finetuning
par: Tsai, Fang-Duo, et autres
Publié: (2024)
par: Tsai, Fang-Duo, et autres
Publié: (2024)
Exploring Musical Roots: Applying Audio Embeddings to Empower Influence Attribution for a Generative Music Model
par: Barnett, Julia, et autres
Publié: (2024)
par: Barnett, Julia, et autres
Publié: (2024)
Continuous Autoregressive Models with Noise Augmentation Avoid Error Accumulation
par: Pasini, Marco, et autres
Publié: (2024)
par: Pasini, Marco, et autres
Publié: (2024)
The MUSE Benchmark: Probing Music Perception and Auditory Relational Reasoning in Audio LLMS
par: Carone, Brandon James, et autres
Publié: (2025)
par: Carone, Brandon James, et autres
Publié: (2025)
On Temporal Guidance and Iterative Refinement in Audio Source Separation
par: Morocutti, Tobias, et autres
Publié: (2025)
par: Morocutti, Tobias, et autres
Publié: (2025)
MixAssist: An Audio-Language Dataset for Co-Creative AI Assistance in Music Mixing
par: Clemens, Michael, et autres
Publié: (2025)
par: Clemens, Michael, et autres
Publié: (2025)
PESTO: Real-Time Pitch Estimation with Self-supervised Transposition-equivariant Objective
par: Riou, Alain, et autres
Publié: (2025)
par: Riou, Alain, et autres
Publié: (2025)
PESTO: Pitch Estimation with Self-supervised Transposition-equivariant Objective
par: Riou, Alain, et autres
Publié: (2023)
par: Riou, Alain, et autres
Publié: (2023)
CoLLAP: Contrastive Long-form Language-Audio Pretraining with Musical Temporal Structure Augmentation
par: Wu, Junda, et autres
Publié: (2024)
par: Wu, Junda, et autres
Publié: (2024)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
par: Batlle-Roca, Roser, et autres
Publié: (2024)
par: Batlle-Roca, Roser, et autres
Publié: (2024)
Arrange, Inpaint, and Refine: Steerable Long-term Music Audio Generation and Editing via Content-based Controls
par: Lin, Liwei, et autres
Publié: (2024)
par: Lin, Liwei, et autres
Publié: (2024)
Music Boomerang: Reusing Diffusion Models for Data Augmentation and Audio Manipulation
par: Fichtinger, Alexander, et autres
Publié: (2025)
par: Fichtinger, Alexander, et autres
Publié: (2025)
Stem-JEPA: A Joint-Embedding Predictive Architecture for Musical Stem Compatibility Estimation
par: Riou, Alain, et autres
Publié: (2024)
par: Riou, Alain, et autres
Publié: (2024)
Leveraging Pre-Trained Autoencoders for Interpretable Prototype Learning of Music Audio
par: Alonso-Jiménez, Pablo, et autres
Publié: (2024)
par: Alonso-Jiménez, Pablo, et autres
Publié: (2024)
SMUG-Explain: A Framework for Symbolic Music Graph Explanations
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
Estimated Audio-Caption Correspondences Improve Language-Based Audio Retrieval
par: Primus, Paul, et autres
Publié: (2024)
par: Primus, Paul, et autres
Publié: (2024)
MAJL: A Model-Agnostic Joint Learning Framework for Music Source Separation and Pitch Estimation
par: Wei, Haojie, et autres
Publié: (2025)
par: Wei, Haojie, et autres
Publié: (2025)
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
par: Li, Jiajia, et autres
Publié: (2024)
par: Li, Jiajia, et autres
Publié: (2024)
Audio Mamba: Pretrained Audio State Space Model For Audio Tagging
par: Lin, Jiaju, et autres
Publié: (2024)
par: Lin, Jiaju, et autres
Publié: (2024)
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
par: Mancusi, Michele, et autres
Publié: (2024)
par: Mancusi, Michele, et autres
Publié: (2024)
MMT-BERT: Chord-aware Symbolic Music Generation Based on Multitrack Music Transformer and MusicBERT
par: Zhu, Jinlong, et autres
Publié: (2024)
par: Zhu, Jinlong, et autres
Publié: (2024)
Tuning Music Education: AI-Powered Personalization in Learning Music
par: Sanganeria, Mayank, et autres
Publié: (2024)
par: Sanganeria, Mayank, et autres
Publié: (2024)
Audio Atlas: Visualizing and Exploring Audio Datasets
par: Lanzendörfer, Luca A., et autres
Publié: (2024)
par: Lanzendörfer, Luca A., et autres
Publié: (2024)
Real-world Music Plagiarism Detection With Music Segment Transcription System
par: Go, Seonghyeon
Publié: (2025)
par: Go, Seonghyeon
Publié: (2025)
Documents similaires
-
Estimating Musical Surprisal from Audio in Autoregressive Diffusion Model Noise Spaces
par: Bjare, Mathias Rose, et autres
Publié: (2025) -
Controlling Surprisal in Music Generation via Information Content Curve Matching
par: Bjare, Mathias Rose, et autres
Publié: (2024) -
Perceptually Aligning Representations of Music via Noise-Augmented Autoencoders
par: Bjare, Mathias Rose, et autres
Publié: (2025) -
Music2Latent2: Audio Compression with Summary Embeddings and Autoregressive Decoding
par: Pasini, Marco, et autres
Publié: (2025) -
Zero-shot Musical Stem Retrieval with Joint-Embedding Predictive Architectures
par: Riou, Alain, et autres
Publié: (2024)