AI-Assisted Music Production: A User Study on Text-to-Music Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Ronchini, Francesca, Comanducci, Luca, Marcucci, Simone, Antonacci, Fabio |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Synthetic training set generation using text-to-audio models for environmental sound classification
di: Ronchini, Francesca, et al.
Pubblicazione: (2024)
di: Ronchini, Francesca, et al.
Pubblicazione: (2024)
Mitigating data replication in text-to-audio generative diffusion models through anti-memorization guidance
di: Messina, Francisco, et al.
Pubblicazione: (2025)
di: Messina, Francisco, et al.
Pubblicazione: (2025)
Room Transfer Function Reconstruction Using Complex-valued Neural Networks and Irregularly Distributed Microphones
di: Ronchini, Francesca, et al.
Pubblicazione: (2024)
di: Ronchini, Francesca, et al.
Pubblicazione: (2024)
Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models
di: Passoni, Riccardo, et al.
Pubblicazione: (2025)
di: Passoni, Riccardo, et al.
Pubblicazione: (2025)
Reconstruction of Sound Field through Diffusion Models
di: Miotello, Federico, et al.
Pubblicazione: (2023)
di: Miotello, Federico, et al.
Pubblicazione: (2023)
PAGURI: a user experience study of creative interaction with text-to-music models
di: Ronchini, Francesca, et al.
Pubblicazione: (2024)
di: Ronchini, Francesca, et al.
Pubblicazione: (2024)
MambaFoley: Foley Sound Generation using Selective State-Space Models
di: Colombo, Marco Furio, et al.
Pubblicazione: (2024)
di: Colombo, Marco Furio, et al.
Pubblicazione: (2024)
FakeMusicCaps: a Dataset for Detection and Attribution of Synthetic Music Generated via Text-to-Music Models
di: Comanducci, Luca, et al.
Pubblicazione: (2024)
di: Comanducci, Luca, et al.
Pubblicazione: (2024)
Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models
di: Baoueb, Teysir, et al.
Pubblicazione: (2025)
di: Baoueb, Teysir, et al.
Pubblicazione: (2025)
Implicit neural representation with physics-informed neural networks for the reconstruction of the early part of room impulse responses
di: Pezzoli, Mirco, et al.
Pubblicazione: (2023)
di: Pezzoli, Mirco, et al.
Pubblicazione: (2023)
Interpreting End-to-End Deep Learning Models for Speech Source Localization Using Layer-wise Relevance Propagation
di: Comanducci, Luca, et al.
Pubblicazione: (2024)
di: Comanducci, Luca, et al.
Pubblicazione: (2024)
Mind the Prompt: Prompting Strategies in Audio Generations for Improving Sound Classification
di: Ronchini, Francesca, et al.
Pubblicazione: (2025)
di: Ronchini, Francesca, et al.
Pubblicazione: (2025)
A Physics-Informed Neural Network-Based Approach for the Spatial Upsampling of Spherical Microphone Arrays
di: Miotello, Federico, et al.
Pubblicazione: (2024)
di: Miotello, Federico, et al.
Pubblicazione: (2024)
Remixing Music for Hearing Aids Using Ensemble of Fine-Tuned Source Separators
di: Daly, Matthew
Pubblicazione: (2024)
di: Daly, Matthew
Pubblicazione: (2024)
SpecDiff-GAN: A Spectrally-Shaped Noise Diffusion GAN for Speech and Music Synthesis
di: Baoueb, Teysir, et al.
Pubblicazione: (2024)
di: Baoueb, Teysir, et al.
Pubblicazione: (2024)
Decoding Selective Auditory Attention to Musical Elements in Ecologically Valid Music Listening
di: Akama, Taketo, et al.
Pubblicazione: (2025)
di: Akama, Taketo, et al.
Pubblicazione: (2025)
Towards HRTF Personalization using Denoising Diffusion Models
di: Sánchez, Juan Camilo Albarracín, et al.
Pubblicazione: (2025)
di: Sánchez, Juan Camilo Albarracín, et al.
Pubblicazione: (2025)
Musical Source Separation of Brazilian Percussion
di: Namballa, Richa, et al.
Pubblicazione: (2025)
di: Namballa, Richa, et al.
Pubblicazione: (2025)
Integrating Text-to-Music Models with Language Models: Composing Long Structured Music Pieces
di: Atassi, Lilac
Pubblicazione: (2024)
di: Atassi, Lilac
Pubblicazione: (2024)
Generalized Multi-Source Inference for Text Conditioned Music Diffusion Models
di: Postolache, Emilian, et al.
Pubblicazione: (2024)
di: Postolache, Emilian, et al.
Pubblicazione: (2024)
AutoMashup: Automatic Music Mashups Creation
di: Delabaere, Marine, et al.
Pubblicazione: (2025)
di: Delabaere, Marine, et al.
Pubblicazione: (2025)
Musical Score Following using Statistical Inference
di: Cowley, Josephine
Pubblicazione: (2025)
di: Cowley, Josephine
Pubblicazione: (2025)
A benchmark of state-of-the-art sound event detection systems evaluated on synthetic soundscapes
di: Ronchini, Francesca, et al.
Pubblicazione: (2022)
di: Ronchini, Francesca, et al.
Pubblicazione: (2022)
U-SAM: An audio language Model for Unified Speech, Audio, and Music Understanding
di: Wang, Ziqian, et al.
Pubblicazione: (2025)
di: Wang, Ziqian, et al.
Pubblicazione: (2025)
Do Music Source Separation Models Preserve Spatial Information in Binaural Audio?
di: Namballa, Richa, et al.
Pubblicazione: (2025)
di: Namballa, Richa, et al.
Pubblicazione: (2025)
Predicting Artificial Neural Network Representations to Learn Recognition Model for Music Identification from Brain Recordings
di: Akama, Taketo, et al.
Pubblicazione: (2024)
di: Akama, Taketo, et al.
Pubblicazione: (2024)
How Does Instrumental Music Help SingFake Detection?
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
MusicHiFi: Fast High-Fidelity Stereo Vocoding
di: Zhu, Ge, et al.
Pubblicazione: (2024)
di: Zhu, Ge, et al.
Pubblicazione: (2024)
Lightweight Self-Supervised Detection of Fundamental Frequency and Accurate Probability of Voicing in Monophonic Music
di: Bitra, Venkat Suprabath, et al.
Pubblicazione: (2026)
di: Bitra, Venkat Suprabath, et al.
Pubblicazione: (2026)
Reverse Engineering of Music Mixing Graphs with Differentiable Processors and Iterative Pruning
di: Lee, Sungho, et al.
Pubblicazione: (2025)
di: Lee, Sungho, et al.
Pubblicazione: (2025)
Note-Level Singing Melody Transcription for Time-Aligned Musical Score Generation
di: Kim, Leekyung, et al.
Pubblicazione: (2025)
di: Kim, Leekyung, et al.
Pubblicazione: (2025)
Wavelet-Based Time-Frequency Fingerprinting for Feature Extraction of Traditional Irish Music
di: Shore, Noah
Pubblicazione: (2025)
di: Shore, Noah
Pubblicazione: (2025)
AI-Generated Music Detection in Broadcast Monitoring
di: López-Ayala, David, et al.
Pubblicazione: (2026)
di: López-Ayala, David, et al.
Pubblicazione: (2026)
BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing
di: Kawamura, Masaya, et al.
Pubblicazione: (2025)
di: Kawamura, Masaya, et al.
Pubblicazione: (2025)
Listenable Maps for Zero-Shot Audio Classifiers
di: Paissan, Francesco, et al.
Pubblicazione: (2024)
di: Paissan, Francesco, et al.
Pubblicazione: (2024)
A Domain-Knowledge-Inspired Music Embedding Space and a Novel Attention Mechanism for Symbolic Music Modeling
di: Guo, Z., et al.
Pubblicazione: (2022)
di: Guo, Z., et al.
Pubblicazione: (2022)
Multi-Source Diffusion Models for Simultaneous Music Generation and Separation
di: Mariani, Giorgio, et al.
Pubblicazione: (2023)
di: Mariani, Giorgio, et al.
Pubblicazione: (2023)
Music Genre Classification: Training an AI model
di: Mogonediwa, Keoikantse
Pubblicazione: (2024)
di: Mogonediwa, Keoikantse
Pubblicazione: (2024)
Resource-Efficient Separation Transformer
di: Della Libera, Luca, et al.
Pubblicazione: (2022)
di: Della Libera, Luca, et al.
Pubblicazione: (2022)
MusicRL: Aligning Music Generation to Human Preferences
di: Cideron, Geoffrey, et al.
Pubblicazione: (2024)
di: Cideron, Geoffrey, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Synthetic training set generation using text-to-audio models for environmental sound classification
di: Ronchini, Francesca, et al.
Pubblicazione: (2024) -
Mitigating data replication in text-to-audio generative diffusion models through anti-memorization guidance
di: Messina, Francisco, et al.
Pubblicazione: (2025) -
Room Transfer Function Reconstruction Using Complex-valued Neural Networks and Irregularly Distributed Microphones
di: Ronchini, Francesca, et al.
Pubblicazione: (2024) -
Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models
di: Passoni, Riccardo, et al.
Pubblicazione: (2025) -
Reconstruction of Sound Field through Diffusion Models
di: Miotello, Federico, et al.
Pubblicazione: (2023)