Controlling Surprisal in Music Generation via Information Content Curve Matching
Fuente:
arXiv
Salvato in:
| Autori principali: | Bjare, Mathias Rose, Lattner, Stefan, Widmer, Gerhard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Estimating Musical Surprisal from Audio in Autoregressive Diffusion Model Noise Spaces
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025)
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025)
Estimating Musical Surprisal in Audio
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025)
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025)
Diff-A-Riff: Musical Accompaniment Co-creation via Latent Diffusion Models
di: Nistal, Javier, et al.
Pubblicazione: (2024)
di: Nistal, Javier, et al.
Pubblicazione: (2024)
Zero-shot Musical Stem Retrieval with Joint-Embedding Predictive Architectures
di: Riou, Alain, et al.
Pubblicazione: (2024)
di: Riou, Alain, et al.
Pubblicazione: (2024)
Music2Latent2: Audio Compression with Summary Embeddings and Autoregressive Decoding
di: Pasini, Marco, et al.
Pubblicazione: (2025)
di: Pasini, Marco, et al.
Pubblicazione: (2025)
Are Inherently Interpretable Models More Robust? A Study In Music Emotion Recognition
di: Hoedt, Katharina, et al.
Pubblicazione: (2025)
di: Hoedt, Katharina, et al.
Pubblicazione: (2025)
Improving Musical Accompaniment Co-creation via Diffusion Transformers
di: Nistal, Javier, et al.
Pubblicazione: (2024)
di: Nistal, Javier, et al.
Pubblicazione: (2024)
InspireMusic: Integrating Super Resolution and Large Language Model for High-Fidelity Long-Form Music Generation
di: Zhang, Chong, et al.
Pubblicazione: (2025)
di: Zhang, Chong, et al.
Pubblicazione: (2025)
Diffusion Timbre Transfer Via Mutual Information Guided Inpainting
di: Lee, Ching Ho, et al.
Pubblicazione: (2026)
di: Lee, Ching Ho, et al.
Pubblicazione: (2026)
Text2midi: Generating Symbolic Music from Captions
di: Bhandari, Keshav, et al.
Pubblicazione: (2024)
di: Bhandari, Keshav, et al.
Pubblicazione: (2024)
Bob's Confetti: Phonetic Memorization Attacks in Music and Video Generation
di: Roh, Jaechul, et al.
Pubblicazione: (2025)
di: Roh, Jaechul, et al.
Pubblicazione: (2025)
Cross-Modal Learning for Music-to-Music-Video Description Generation
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
UniSonate: A Unified Model for Speech, Music, and Sound Effect Generation with Text Instructions
di: Qiang, Chunyu, et al.
Pubblicazione: (2026)
di: Qiang, Chunyu, et al.
Pubblicazione: (2026)
Audio Flamingo Next: Next-Generation Open Audio-Language Models for Speech, Sound, and Music
di: Ghosh, Sreyan, et al.
Pubblicazione: (2026)
di: Ghosh, Sreyan, et al.
Pubblicazione: (2026)
MusicFlow: Cascaded Flow Matching for Text Guided Music Generation
di: Prajwal, K R, et al.
Pubblicazione: (2024)
di: Prajwal, K R, et al.
Pubblicazione: (2024)
Arrange, Inpaint, and Refine: Steerable Long-term Music Audio Generation and Editing via Content-based Controls
di: Lin, Liwei, et al.
Pubblicazione: (2024)
di: Lin, Liwei, et al.
Pubblicazione: (2024)
Musical ethnocentrism in Large Language Models
di: Kruspe, Anna
Pubblicazione: (2025)
di: Kruspe, Anna
Pubblicazione: (2025)
GraphMuse: A Library for Symbolic Music Graph Processing
di: Karystinaios, Emmanouil, et al.
Pubblicazione: (2024)
di: Karystinaios, Emmanouil, et al.
Pubblicazione: (2024)
Content-based Controls For Music Large Language Modeling
di: Lin, Liwei, et al.
Pubblicazione: (2023)
di: Lin, Liwei, et al.
Pubblicazione: (2023)
Sing it, Narrate it: Quality Musical Lyrics Translation
di: Ye, Zhuorui, et al.
Pubblicazione: (2024)
di: Ye, Zhuorui, et al.
Pubblicazione: (2024)
Genre Controlled Music Generation via Activation Steering
di: Narashiman, Swathi, et al.
Pubblicazione: (2025)
di: Narashiman, Swathi, et al.
Pubblicazione: (2025)
DeepResonance: Enhancing Multimodal Music Understanding via Music-centric Multi-way Instruction Tuning
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
TangoFlux: Super Fast and Faithful Text to Audio Generation with Flow Matching and Clap-Ranked Preference Optimization
di: Hung, Chia-Yu, et al.
Pubblicazione: (2024)
di: Hung, Chia-Yu, et al.
Pubblicazione: (2024)
ControlAudio: Tackling Text-Guided, Timing-Indicated and Intelligible Audio Generation via Progressive Diffusion Modeling
di: Jiang, Yuxuan, et al.
Pubblicazione: (2025)
di: Jiang, Yuxuan, et al.
Pubblicazione: (2025)
Perception-Inspired Graph Convolution for Music Understanding Tasks
di: Karystinaios, Emmanouil, et al.
Pubblicazione: (2024)
di: Karystinaios, Emmanouil, et al.
Pubblicazione: (2024)
Do Music Generation Models Encode Music Theory?
di: Wei, Megan, et al.
Pubblicazione: (2024)
di: Wei, Megan, et al.
Pubblicazione: (2024)
Augment, Drop & Swap: Improving Diversity in LLM Captions for Efficient Music-Text Representation Learning
di: Manco, Ilaria, et al.
Pubblicazione: (2024)
di: Manco, Ilaria, et al.
Pubblicazione: (2024)
Investigating Design Choices in Joint-Embedding Predictive Architectures for General Audio Representation Learning
di: Riou, Alain, et al.
Pubblicazione: (2024)
di: Riou, Alain, et al.
Pubblicazione: (2024)
CoDiCodec: Unifying Continuous and Discrete Compressed Representations of Audio
di: Pasini, Marco, et al.
Pubblicazione: (2025)
di: Pasini, Marco, et al.
Pubblicazione: (2025)
Forensic deepfake audio detection using segmental speech features
di: Yang, Tianle, et al.
Pubblicazione: (2025)
di: Yang, Tianle, et al.
Pubblicazione: (2025)
Exploring Acoustic Similarity in Emotional Speech and Music via Self-Supervised Representations
di: Sun, Yujia, et al.
Pubblicazione: (2024)
di: Sun, Yujia, et al.
Pubblicazione: (2024)
CSyMR: Benchmarking Compositional Music Information Retrieval in Symbolic Music Reasoning
di: Wang, Boyang, et al.
Pubblicazione: (2025)
di: Wang, Boyang, et al.
Pubblicazione: (2025)
PAL: Probing Audio Encoders via LLMs -- Audio Information Transfer into LLMs
di: Alex, Tony, et al.
Pubblicazione: (2025)
di: Alex, Tony, et al.
Pubblicazione: (2025)
MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query Response
di: Deng, Zihao, et al.
Pubblicazione: (2023)
di: Deng, Zihao, et al.
Pubblicazione: (2023)
FLowHigh: Towards Efficient and High-Quality Audio Super-Resolution with Single-Step Flow Matching
di: Yun, Jun-Hak, et al.
Pubblicazione: (2025)
di: Yun, Jun-Hak, et al.
Pubblicazione: (2025)
Segment Transformer: AI-Generated Music Detection via Music Structural Analysis
di: Kim, Yumin, et al.
Pubblicazione: (2025)
di: Kim, Yumin, et al.
Pubblicazione: (2025)
XMusic: Towards a Generalized and Controllable Symbolic Music Generation Framework
di: Tian, Sida, et al.
Pubblicazione: (2025)
di: Tian, Sida, et al.
Pubblicazione: (2025)
Double Entendre: Robust Audio-Based AI-Generated Lyrics Detection via Multi-View Fusion
di: Frohmann, Markus, et al.
Pubblicazione: (2025)
di: Frohmann, Markus, et al.
Pubblicazione: (2025)
NTPP: Generative Speech Language Modeling for Dual-Channel Spoken Dialogue via Next-Token-Pair Prediction
di: Wang, Qichao, et al.
Pubblicazione: (2025)
di: Wang, Qichao, et al.
Pubblicazione: (2025)
SimClass: A Classroom Speech Dataset Generated via Game Engine Simulation For Automatic Speech Recognition Research
di: Attia, Ahmed Adel, et al.
Pubblicazione: (2025)
di: Attia, Ahmed Adel, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Estimating Musical Surprisal from Audio in Autoregressive Diffusion Model Noise Spaces
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025) -
Estimating Musical Surprisal in Audio
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025) -
Diff-A-Riff: Musical Accompaniment Co-creation via Latent Diffusion Models
di: Nistal, Javier, et al.
Pubblicazione: (2024) -
Zero-shot Musical Stem Retrieval with Joint-Embedding Predictive Architectures
di: Riou, Alain, et al.
Pubblicazione: (2024) -
Music2Latent2: Audio Compression with Summary Embeddings and Autoregressive Decoding
di: Pasini, Marco, et al.
Pubblicazione: (2025)