Benchmarking Music Generation Models and Metrics via Human Preference Studies
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Grötschla, Florian, Solak, Ahmet, Lanzendörfer, Luca A., Wattenhofer, Roger |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Bias beyond Borders: Global Inequalities in AI-Generated Music
par: Solak, Ahmet, et autres
Publié: (2025)
par: Solak, Ahmet, et autres
Publié: (2025)
Benchmarking Diarization Models
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
High-Fidelity Music Vocoder using Neural Audio Codecs
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
SALSA-V: Shortcut-Augmented Long-form Synchronized Audio from Videos
par: Dellali, Amir, et autres
Publié: (2025)
par: Dellali, Amir, et autres
Publié: (2025)
Parametric Neural Amp Modeling with Active Learning
par: Grötschla, Florian, et autres
Publié: (2025)
par: Grötschla, Florian, et autres
Publié: (2025)
Source Separation for A Cappella Music
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
Multi-bit Audio Watermarking
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
SAO-Instruct: Free-form Audio Editing using Natural Language Instructions
par: Ungersböck, Michael, et autres
Publié: (2025)
par: Ungersböck, Michael, et autres
Publié: (2025)
Evaluating Objective Speech Quality Metrics for Neural Audio Codecs
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
MaskBeat: Loopable Drum Beat Generation
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
SNAC: Multi-Scale Neural Audio Codec
par: Siuzdak, Hubert, et autres
Publié: (2024)
par: Siuzdak, Hubert, et autres
Publié: (2024)
Towards Leveraging Contrastively Pretrained Neural Audio Embeddings for Recommender Tasks
par: Grötschla, Florian, et autres
Publié: (2024)
par: Grötschla, Florian, et autres
Publié: (2024)
Audio Atlas: Visualizing and Exploring Audio Datasets
par: Lanzendörfer, Luca A., et autres
Publié: (2024)
par: Lanzendörfer, Luca A., et autres
Publié: (2024)
High-Fidelity Speech Enhancement via Discrete Audio Tokens
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
par: Lanzendörfer, Luca A., et autres
Publié: (2025)
Adapting Neural Audio Codecs to EEG
par: Kastrati, Ard, et autres
Publié: (2025)
par: Kastrati, Ard, et autres
Publié: (2025)
Parametric Neural Amp Modeling with Active Learning
par: Grötschla, Florian, et autres
Publié: (2025)
par: Grötschla, Florian, et autres
Publié: (2025)
Inductive Transfer Learning for Graph-Based Recommenders
par: Grötschla, Florian, et autres
Publié: (2025)
par: Grötschla, Florian, et autres
Publié: (2025)
EuroSpeech: A Multilingual Speech Corpus
par: Pfisterer, Samuel, et autres
Publié: (2025)
par: Pfisterer, Samuel, et autres
Publié: (2025)
Benchmarking Positional Encodings for GNNs and Graph Transformers
par: Grötschla, Florian, et autres
Publié: (2024)
par: Grötschla, Florian, et autres
Publié: (2024)
MusicRL: Aligning Music Generation to Human Preferences
par: Cideron, Geoffrey, et autres
Publié: (2024)
par: Cideron, Geoffrey, et autres
Publié: (2024)
Benchmarking GNNs Using Lightning Network Data
par: Feichtinger, Rainer, et autres
Publié: (2024)
par: Feichtinger, Rainer, et autres
Publié: (2024)
Next Level Message-Passing with Hierarchical Support Graphs
par: Vonessen, Carlos, et autres
Publié: (2024)
par: Vonessen, Carlos, et autres
Publié: (2024)
PUZZLES: A Benchmark for Neural Algorithmic Reasoning
par: Estermann, Benjamin, et autres
Publié: (2024)
par: Estermann, Benjamin, et autres
Publié: (2024)
Musical Attention Transformer: Music Generation Using a Music-Specific Attention Model
par: Taksuka, Shinnosuke, et autres
Publié: (2026)
par: Taksuka, Shinnosuke, et autres
Publié: (2026)
Flood and Echo Net: Algorithmically Aligned GNNs that Generalize
par: Mathys, Joël, et autres
Publié: (2023)
par: Mathys, Joël, et autres
Publié: (2023)
Generative Adversarial Post-Training Mitigates Reward Hacking in Live Human-AI Music Interaction
par: Wu, Yusong, et autres
Publié: (2025)
par: Wu, Yusong, et autres
Publié: (2025)
Benchmarking Representations for Speech, Music, and Acoustic Events
par: La Quatra, Moreno, et autres
Publié: (2024)
par: La Quatra, Moreno, et autres
Publié: (2024)
Multi-Source Diffusion Models for Simultaneous Music Generation and Separation
par: Mariani, Giorgio, et autres
Publié: (2023)
par: Mariani, Giorgio, et autres
Publié: (2023)
Affective Music Recommendation: A Rollout-Based World Model for Offline Preference Optimization
par: Chan, Audrey, et autres
Publié: (2026)
par: Chan, Audrey, et autres
Publié: (2026)
AI-Assisted Music Production: A User Study on Text-to-Music Models
par: Ronchini, Francesca, et autres
Publié: (2025)
par: Ronchini, Francesca, et autres
Publié: (2025)
Generalized Multi-Source Inference for Text Conditioned Music Diffusion Models
par: Postolache, Emilian, et autres
Publié: (2024)
par: Postolache, Emilian, et autres
Publié: (2024)
AEye: A Visualization Tool for Image Datasets
par: Grötschla, Florian, et autres
Publié: (2024)
par: Grötschla, Florian, et autres
Publié: (2024)
Sound and Music Biases in Deep Music Transcription Models: A Systematic Analysis
par: Marták, Lukáš Samuel, et autres
Publié: (2025)
par: Marták, Lukáš Samuel, et autres
Publié: (2025)
Alignment-Aware Decoding
par: Berdoz, Frédéric, et autres
Publié: (2025)
par: Berdoz, Frédéric, et autres
Publié: (2025)
Survey on the Evaluation of Generative Models in Music
par: Lerch, Alexander, et autres
Publié: (2025)
par: Lerch, Alexander, et autres
Publié: (2025)
CoRe-GD: A Hierarchical Framework for Scalable Graph Visualization with GNNs
par: Grötschla, Florian, et autres
Publié: (2024)
par: Grötschla, Florian, et autres
Publié: (2024)
Text-to-Scene with Large Reasoning Models
par: Berdoz, Frédéric, et autres
Publié: (2025)
par: Berdoz, Frédéric, et autres
Publié: (2025)
SAMUeL: Efficient Vocal-Conditioned Music Generation via Soft Alignment Attention and Latent Diffusion
par: Cheung, Hei Shing, et autres
Publié: (2025)
par: Cheung, Hei Shing, et autres
Publié: (2025)
A Study on the Data Distribution Gap in Music Emotion Recognition
par: Ching, Joann, et autres
Publié: (2025)
par: Ching, Joann, et autres
Publié: (2025)
Rethinking Music Captioning with Music Metadata LLMs
par: Bukey, Irmak, et autres
Publié: (2026)
par: Bukey, Irmak, et autres
Publié: (2026)
Documents similaires
-
Bias beyond Borders: Global Inequalities in AI-Generated Music
par: Solak, Ahmet, et autres
Publié: (2025) -
Benchmarking Diarization Models
par: Lanzendörfer, Luca A., et autres
Publié: (2025) -
High-Fidelity Music Vocoder using Neural Audio Codecs
par: Lanzendörfer, Luca A., et autres
Publié: (2025) -
SALSA-V: Shortcut-Augmented Long-form Synchronized Audio from Videos
par: Dellali, Amir, et autres
Publié: (2025) -
Parametric Neural Amp Modeling with Active Learning
par: Grötschla, Florian, et autres
Publié: (2025)