MixAssist: An Audio-Language Dataset for Co-Creative AI Assistance in Music Mixing
Fuente:
arXiv
Guardado en:
| Autores principales: | Clemens, Michael, Marasović, Ana |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CoLLAP: Contrastive Long-form Language-Audio Pretraining with Musical Temporal Structure Augmentation
por: Wu, Junda, et al.
Publicado: (2024)
por: Wu, Junda, et al.
Publicado: (2024)
TinyMusician: On-Device Music Generation with Knowledge Distillation and Mixed Precision Quantization
por: Wang, Hainan, et al.
Publicado: (2025)
por: Wang, Hainan, et al.
Publicado: (2025)
Estimating Musical Surprisal in Audio
por: Bjare, Mathias Rose, et al.
Publicado: (2025)
por: Bjare, Mathias Rose, et al.
Publicado: (2025)
Perceptual Musical Features for Interpretable Audio Tagging
por: Lyberatos, Vassilis, et al.
Publicado: (2023)
por: Lyberatos, Vassilis, et al.
Publicado: (2023)
Audio Atlas: Visualizing and Exploring Audio Datasets
por: Lanzendörfer, Luca A., et al.
Publicado: (2024)
por: Lanzendörfer, Luca A., et al.
Publicado: (2024)
Audio Prompt Adapter: Unleashing Music Editing Abilities for Text-to-Music with Lightweight Finetuning
por: Tsai, Fang-Duo, et al.
Publicado: (2024)
por: Tsai, Fang-Duo, et al.
Publicado: (2024)
Exploring Variational Auto-Encoder Architectures, Configurations, and Datasets for Generative Music Explainable AI
por: Bryan-Kinns, Nick, et al.
Publicado: (2023)
por: Bryan-Kinns, Nick, et al.
Publicado: (2023)
Exploring Musical Roots: Applying Audio Embeddings to Empower Influence Attribution for a Generative Music Model
por: Barnett, Julia, et al.
Publicado: (2024)
por: Barnett, Julia, et al.
Publicado: (2024)
MOSA: Music Motion with Semantic Annotation Dataset for Cross-Modal Music Processing
por: Huang, Yu-Fen, et al.
Publicado: (2024)
por: Huang, Yu-Fen, et al.
Publicado: (2024)
Tuning Music Education: AI-Powered Personalization in Learning Music
por: Sanganeria, Mayank, et al.
Publicado: (2024)
por: Sanganeria, Mayank, et al.
Publicado: (2024)
IndieFake Dataset: A Benchmark Dataset for Audio Deepfake Detection
por: Kumar, Abhay, et al.
Publicado: (2025)
por: Kumar, Abhay, et al.
Publicado: (2025)
The MUSE Benchmark: Probing Music Perception and Auditory Relational Reasoning in Audio LLMS
por: Carone, Brandon James, et al.
Publicado: (2025)
por: Carone, Brandon James, et al.
Publicado: (2025)
Estimating Musical Surprisal from Audio in Autoregressive Diffusion Model Noise Spaces
por: Bjare, Mathias Rose, et al.
Publicado: (2025)
por: Bjare, Mathias Rose, et al.
Publicado: (2025)
Audio Deepfake Attribution: An Initial Dataset and Investigation
por: Yan, Xinrui, et al.
Publicado: (2022)
por: Yan, Xinrui, et al.
Publicado: (2022)
CoVoMix2: Advancing Zero-Shot Dialogue Generation with Fully Non-Autoregressive Flow Matching
por: Zhang, Leying, et al.
Publicado: (2025)
por: Zhang, Leying, et al.
Publicado: (2025)
AudioRole: An Audio Dataset for Character Role-Playing in Large Language Models
por: Li, Wenyu, et al.
Publicado: (2025)
por: Li, Wenyu, et al.
Publicado: (2025)
Segment Transformer: AI-Generated Music Detection via Music Structural Analysis
por: Kim, Yumin, et al.
Publicado: (2025)
por: Kim, Yumin, et al.
Publicado: (2025)
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
por: Li, Jiajia, et al.
Publicado: (2024)
por: Li, Jiajia, et al.
Publicado: (2024)
Generative AI for Music and Audio
por: Dong, Hao-Wen
Publicado: (2024)
por: Dong, Hao-Wen
Publicado: (2024)
The Codecfake Dataset and Countermeasures for the Universally Detection of Deepfake Audio
por: Xie, Yuankun, et al.
Publicado: (2024)
por: Xie, Yuankun, et al.
Publicado: (2024)
Cross-Domain Audio Deepfake Detection: Dataset and Analysis
por: Li, Yuang, et al.
Publicado: (2024)
por: Li, Yuang, et al.
Publicado: (2024)
AudioSetMix: Enhancing Audio-Language Datasets with LLM-Assisted Augmentations
por: Xu, David
Publicado: (2024)
por: Xu, David
Publicado: (2024)
DroneAudioset: An Audio Dataset for Drone-based Search and Rescue
por: Gupta, Chitralekha, et al.
Publicado: (2025)
por: Gupta, Chitralekha, et al.
Publicado: (2025)
Codecfake: An Initial Dataset for Detecting LLM-based Deepfake Audio
por: Lu, Yi, et al.
Publicado: (2024)
por: Lu, Yi, et al.
Publicado: (2024)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
por: Batlle-Roca, Roser, et al.
Publicado: (2024)
por: Batlle-Roca, Roser, et al.
Publicado: (2024)
Reducing Barriers to the Use of Marginalised Music Genres in AI
por: Bryan-Kinns, Nick, et al.
Publicado: (2024)
por: Bryan-Kinns, Nick, et al.
Publicado: (2024)
Effective and Efficient Mixed Precision Quantization of Speech Foundation Models
por: Xu, Haoning, et al.
Publicado: (2025)
por: Xu, Haoning, et al.
Publicado: (2025)
GOAT: A Large Dataset of Paired Guitar Audio Recordings and Tablatures
por: Loth, Jackson, et al.
Publicado: (2025)
por: Loth, Jackson, et al.
Publicado: (2025)
Multi-Speaker Conversational Audio Deepfake: Taxonomy, Dataset and Pilot Study
por: Ahmed, Alabi, et al.
Publicado: (2026)
por: Ahmed, Alabi, et al.
Publicado: (2026)
DAIRHuM: A Platform for Directly Aligning AI Representations with Human Musical Judgments applied to Carnatic Music
por: Ravikumar, Prashanth Thattai
Publicado: (2024)
por: Ravikumar, Prashanth Thattai
Publicado: (2024)
Arrange, Inpaint, and Refine: Steerable Long-term Music Audio Generation and Editing via Content-based Controls
por: Lin, Liwei, et al.
Publicado: (2024)
por: Lin, Liwei, et al.
Publicado: (2024)
Audio Jailbreak: An Open Comprehensive Benchmark for Jailbreaking Large Audio-Language Models
por: Song, Zirui, et al.
Publicado: (2025)
por: Song, Zirui, et al.
Publicado: (2025)
NotaGen: Advancing Musicality in Symbolic Music Generation with Large Language Model Training Paradigms
por: Wang, Yashan, et al.
Publicado: (2025)
por: Wang, Yashan, et al.
Publicado: (2025)
Enhancing Retrieval-Augmented Audio Captioning with Generation-Assisted Multimodal Querying and Progressive Learning
por: Changin, Choi, et al.
Publicado: (2024)
por: Changin, Choi, et al.
Publicado: (2024)
Aligning Generative Music AI with Human Preferences: Methods and Challenges
por: Herremans, Dorien, et al.
Publicado: (2025)
por: Herremans, Dorien, et al.
Publicado: (2025)
BanglaFake: Constructing and Evaluating a Specialized Bengali Deepfake Audio Dataset
por: Fahad, Istiaq Ahmed, et al.
Publicado: (2025)
por: Fahad, Istiaq Ahmed, et al.
Publicado: (2025)
Quranic Audio Dataset: Crowdsourced and Labeled Recitation from Non-Arabic Speakers
por: Salameh, Raghad, et al.
Publicado: (2024)
por: Salameh, Raghad, et al.
Publicado: (2024)
BirdSet: A Large-Scale Dataset for Audio Classification in Avian Bioacoustics
por: Rauch, Lukas, et al.
Publicado: (2024)
por: Rauch, Lukas, et al.
Publicado: (2024)
SLAP: Scalable Language-Audio Pretraining with Variable-Duration Audio and Multi-Objective Training
por: Mei, Xinhao, et al.
Publicado: (2026)
por: Mei, Xinhao, et al.
Publicado: (2026)
Linear Time Complexity Conformers with SummaryMixing for Streaming Speech Recognition
por: Parcollet, Titouan, et al.
Publicado: (2024)
por: Parcollet, Titouan, et al.
Publicado: (2024)
Ejemplares similares
-
CoLLAP: Contrastive Long-form Language-Audio Pretraining with Musical Temporal Structure Augmentation
por: Wu, Junda, et al.
Publicado: (2024) -
TinyMusician: On-Device Music Generation with Knowledge Distillation and Mixed Precision Quantization
por: Wang, Hainan, et al.
Publicado: (2025) -
Estimating Musical Surprisal in Audio
por: Bjare, Mathias Rose, et al.
Publicado: (2025) -
Perceptual Musical Features for Interpretable Audio Tagging
por: Lyberatos, Vassilis, et al.
Publicado: (2023) -
Audio Atlas: Visualizing and Exploring Audio Datasets
por: Lanzendörfer, Luca A., et al.
Publicado: (2024)