A Survey of Music Generation in the Context of Interaction
Fuente:
arXiv
Guardado en:
| Autores principales: | Agchar, Ismael, Baumann, Ilja, Braun, Franziska, Perez-Toro, Paula Andrea, Riedhammer, Korbinian, Trump, Sebastian, Ullrich, Martin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Outlier Reduction with Gated Attention for Improved Post-training Quantization in Large Sequence-to-sequence Speech Foundation Models
por: Wagner, Dominik, et al.
Publicado: (2024)
por: Wagner, Dominik, et al.
Publicado: (2024)
Personalized Fine-Tuning with Controllable Synthetic Speech from LLM-Generated Transcripts for Dysarthric Speech Recognition
por: Wagner, Dominik, et al.
Publicado: (2025)
por: Wagner, Dominik, et al.
Publicado: (2025)
Large Language Models for Dysfluency Detection in Stuttered Speech
por: Wagner, Dominik, et al.
Publicado: (2024)
por: Wagner, Dominik, et al.
Publicado: (2024)
Infusing Acoustic Pause Context into Text-Based Dementia Assessment
por: Braun, Franziska, et al.
Publicado: (2024)
por: Braun, Franziska, et al.
Publicado: (2024)
Adapter-Based Multi-Agent AVSR Extension for Pre-Trained ASR Models
por: Simic, Christopher, et al.
Publicado: (2025)
por: Simic, Christopher, et al.
Publicado: (2025)
Vocoder-Free Non-Parallel Conversion of Whispered Speech With Masked Cycle-Consistent Generative Adversarial Networks
por: Wagner, Dominik, et al.
Publicado: (2023)
por: Wagner, Dominik, et al.
Publicado: (2023)
Detecting Dysfluencies in Stuttering Therapy Using wav2vec 2.0
por: Bayerl, Sebastian P., et al.
Publicado: (2022)
por: Bayerl, Sebastian P., et al.
Publicado: (2022)
A Survey on Evaluation Metrics for Music Generation
por: Kader, Faria Binte, et al.
Publicado: (2025)
por: Kader, Faria Binte, et al.
Publicado: (2025)
Ultra-Low Latency Speech Enhancement - A Comprehensive Study
por: Wu, Haibin, et al.
Publicado: (2024)
por: Wu, Haibin, et al.
Publicado: (2024)
A Survey on Cross-Modal Interaction Between Music and Multimodal Data
por: Li, Sifei, et al.
Publicado: (2025)
por: Li, Sifei, et al.
Publicado: (2025)
MusicEval: A Generative Music Dataset with Expert Ratings for Automatic Text-to-Music Evaluation
por: Liu, Cheng, et al.
Publicado: (2025)
por: Liu, Cheng, et al.
Publicado: (2025)
The PARLO Dementia Corpus: A German Multi-Center Resource for Alzheimer's Disease
por: Braun, Franziska, et al.
Publicado: (2026)
por: Braun, Franziska, et al.
Publicado: (2026)
FakeMusicCaps: a Dataset for Detection and Attribution of Synthetic Music Generated via Text-to-Music Models
por: Comanducci, Luca, et al.
Publicado: (2024)
por: Comanducci, Luca, et al.
Publicado: (2024)
Seed-Music: A Unified Framework for High Quality and Controlled Music Generation
por: Bai, Ye, et al.
Publicado: (2024)
por: Bai, Ye, et al.
Publicado: (2024)
Language Models for Music Medicine Generation
por: Nikolakakis, Emmanouil, et al.
Publicado: (2024)
por: Nikolakakis, Emmanouil, et al.
Publicado: (2024)
Generating Rhythm Game Music with Jukebox
por: Yan, Nicholas
Publicado: (2023)
por: Yan, Nicholas
Publicado: (2023)
AI-Generated Music Detection and its Challenges
por: Afchar, Darius, et al.
Publicado: (2025)
por: Afchar, Darius, et al.
Publicado: (2025)
MusicMamba: A Dual-Feature Modeling Approach for Generating Chinese Traditional Music with Modal Precision
por: Chen, Jiatao, et al.
Publicado: (2024)
por: Chen, Jiatao, et al.
Publicado: (2024)
A Diffusion-Based Generative Equalizer for Music Restoration
por: Moliner, Eloi, et al.
Publicado: (2024)
por: Moliner, Eloi, et al.
Publicado: (2024)
Semantic and Semiotic Interplays in Text-to-Audio AI: Exploring Cognitive Dynamics and Musical Interactions
por: Coelho, Guilherme
Publicado: (2025)
por: Coelho, Guilherme
Publicado: (2025)
A Survey on Multimodal Music Emotion Recognition
por: Liyanarachchi, Rashini, et al.
Publicado: (2025)
por: Liyanarachchi, Rashini, et al.
Publicado: (2025)
Musical Word Embedding for Music Tagging and Retrieval
por: Doh, SeungHeon, et al.
Publicado: (2024)
por: Doh, SeungHeon, et al.
Publicado: (2024)
Explainable Detection of Machine Generated Music and Early Systematic Evaluation
por: Li, Yupei, et al.
Publicado: (2024)
por: Li, Yupei, et al.
Publicado: (2024)
Improving Controllability and Editability for Pretrained Text-to-Music Generation Models
por: Zhang, Yixiao
Publicado: (2024)
por: Zhang, Yixiao
Publicado: (2024)
SymPAC: Scalable Symbolic Music Generation With Prompts And Constraints
por: Chen, Haonan, et al.
Publicado: (2024)
por: Chen, Haonan, et al.
Publicado: (2024)
Audio Conditioning for Music Generation via Discrete Bottleneck Features
por: Rouard, Simon, et al.
Publicado: (2024)
por: Rouard, Simon, et al.
Publicado: (2024)
Amphion: An Open-Source Audio, Music and Speech Generation Toolkit
por: Zhang, Xueyao, et al.
Publicado: (2023)
por: Zhang, Xueyao, et al.
Publicado: (2023)
Evaluating Disentangled Representations for Controllable Music Generation
por: Ibáñez-Martínez, Laura, et al.
Publicado: (2026)
por: Ibáñez-Martínez, Laura, et al.
Publicado: (2026)
DAC-JAX: A JAX Implementation of the Descript Audio Codec
por: Braun, David
Publicado: (2024)
por: Braun, David
Publicado: (2024)
Sub-band and Full-band Interactive U-Net with DPRNN for Demixing Cross-talk Stereo Music
por: Yin, Han, et al.
Publicado: (2024)
por: Yin, Han, et al.
Publicado: (2024)
ACE-Step: A Step Towards Music Generation Foundation Model
por: Gong, Junmin, et al.
Publicado: (2025)
por: Gong, Junmin, et al.
Publicado: (2025)
Automatic Music Mixing using a Generative Model of Effect Embeddings
por: Moliner, Eloi, et al.
Publicado: (2025)
por: Moliner, Eloi, et al.
Publicado: (2025)
GD-Retriever: Controllable Generative Text-Music Retrieval with Diffusion Models
por: Guinot, Julien, et al.
Publicado: (2025)
por: Guinot, Julien, et al.
Publicado: (2025)
Joint Audio and Symbolic Conditioning for Temporally Controlled Text-to-Music Generation
por: Tal, Or, et al.
Publicado: (2024)
por: Tal, Or, et al.
Publicado: (2024)
WeaveMuse: An Open Agentic System for Multimodal Music Understanding and Generation
por: Karystinaios, Emmanouil
Publicado: (2025)
por: Karystinaios, Emmanouil
Publicado: (2025)
SMITIN: Self-Monitored Inference-Time INtervention for Generative Music Transformers
por: Koo, Junghyun, et al.
Publicado: (2024)
por: Koo, Junghyun, et al.
Publicado: (2024)
Music2Fail: Transfer Music to Failed Recorder Style
por: Leong, Chon In, et al.
Publicado: (2024)
por: Leong, Chon In, et al.
Publicado: (2024)
Pitfalls and Limits in Automatic Dementia Assessment
por: Braun, Franziska, et al.
Publicado: (2025)
por: Braun, Franziska, et al.
Publicado: (2025)
CoheDancers: Enhancing Interactive Group Dance Generation through Music-Driven Coherence Decomposition
por: Yang, Kaixing, et al.
Publicado: (2024)
por: Yang, Kaixing, et al.
Publicado: (2024)
Flexible Control in Symbolic Music Generation via Musical Metadata
por: Han, Sangjun, et al.
Publicado: (2024)
por: Han, Sangjun, et al.
Publicado: (2024)
Ejemplares similares
-
Outlier Reduction with Gated Attention for Improved Post-training Quantization in Large Sequence-to-sequence Speech Foundation Models
por: Wagner, Dominik, et al.
Publicado: (2024) -
Personalized Fine-Tuning with Controllable Synthetic Speech from LLM-Generated Transcripts for Dysarthric Speech Recognition
por: Wagner, Dominik, et al.
Publicado: (2025) -
Large Language Models for Dysfluency Detection in Stuttered Speech
por: Wagner, Dominik, et al.
Publicado: (2024) -
Infusing Acoustic Pause Context into Text-Based Dementia Assessment
por: Braun, Franziska, et al.
Publicado: (2024) -
Adapter-Based Multi-Agent AVSR Extension for Pre-Trained ASR Models
por: Simic, Christopher, et al.
Publicado: (2025)