Enhancing Dance-to-Music Generation via Negative Conditioning Latent Diffusion Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Changchang, Liu, Gaowen, Fleming, Charles, Yan, Yan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MIDGET: Music Conditioned 3D Dance Generation
par: Wang, Jinwu, et autres
Publié: (2024)
par: Wang, Jinwu, et autres
Publié: (2024)
DanceChat: Large Language Model-Guided Music-to-Dance Generation
par: Wang, Qing, et autres
Publié: (2025)
par: Wang, Qing, et autres
Publié: (2025)
Bidirectional Autoregressive Diffusion Model for Dance Generation
par: Zhang, Canyu, et autres
Publié: (2024)
par: Zhang, Canyu, et autres
Publié: (2024)
Exploring Multi-Modal Control in Music-Driven Dance Generation
par: Li, Ronghui, et autres
Publié: (2024)
par: Li, Ronghui, et autres
Publié: (2024)
Lodge: A Coarse to Fine Diffusion Network for Long Dance Generation Guided by the Characteristic Dance Primitives
par: Li, Ronghui, et autres
Publié: (2024)
par: Li, Ronghui, et autres
Publié: (2024)
DuetGen: Music Driven Two-Person Dance Generation via Hierarchical Masked Modeling
par: Ghosh, Anindita, et autres
Publié: (2025)
par: Ghosh, Anindita, et autres
Publié: (2025)
MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation
par: Huang, Mingyang, et autres
Publié: (2025)
par: Huang, Mingyang, et autres
Publié: (2025)
GCDance: Genre-Controlled Music-Driven 3D Full Body Dance Generation
par: Liu, Xinran, et autres
Publié: (2025)
par: Liu, Xinran, et autres
Publié: (2025)
VMAS: Video-to-Music Generation via Semantic Alignment in Web Music Videos
par: Lin, Yan-Bo, et autres
Publié: (2024)
par: Lin, Yan-Bo, et autres
Publié: (2024)
Controllable Dance Generation with Style-Guided Motion Diffusion
par: Wang, Hongsong, et autres
Publié: (2024)
par: Wang, Hongsong, et autres
Publié: (2024)
PF-D2M: A Pose-free Diffusion Model for Universal Dance-to-Music Generation
par: Im, Jaekwon, et autres
Publié: (2026)
par: Im, Jaekwon, et autres
Publié: (2026)
Contrastive Conditional Latent Diffusion for Audio-visual Segmentation
par: Mao, Yuxin, et autres
Publié: (2023)
par: Mao, Yuxin, et autres
Publié: (2023)
InterDance:Reactive 3D Dance Generation with Realistic Duet Interactions
par: Li, Ronghui, et autres
Publié: (2024)
par: Li, Ronghui, et autres
Publié: (2024)
EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model
par: Zhang, Bingyuan, et autres
Publié: (2024)
par: Zhang, Bingyuan, et autres
Publié: (2024)
Towards Video to Piano Music Generation with Chain-of-Perform Support Benchmarks
par: Liu, Chang, et autres
Publié: (2025)
par: Liu, Chang, et autres
Publié: (2025)
Music Genre Classification using Large Language Models
par: Meguenani, Mohamed El Amine, et autres
Publié: (2024)
par: Meguenani, Mohamed El Amine, et autres
Publié: (2024)
FLUX that Plays Music
par: Fei, Zhengcong, et autres
Publié: (2024)
par: Fei, Zhengcong, et autres
Publié: (2024)
ExpGest: Expressive Speaker Generation Using Diffusion Model and Hybrid Audio-Text Guidance
par: Cheng, Yongkang, et autres
Publié: (2024)
par: Cheng, Yongkang, et autres
Publié: (2024)
Seeing and Hearing: Open-domain Visual-Audio Generation with Diffusion Latent Aligners
par: Xing, Yazhou, et autres
Publié: (2024)
par: Xing, Yazhou, et autres
Publié: (2024)
Enhance Generation Quality of Flow Matching V2A Model via Multi-Step CoT-Like Guidance and Combined Preference Optimization
par: Zhang, Haomin, et autres
Publié: (2025)
par: Zhang, Haomin, et autres
Publié: (2025)
Sheet Music Transformer: End-To-End Optical Music Recognition Beyond Monophonic Transcription
par: Ríos-Vila, Antonio, et autres
Publié: (2024)
par: Ríos-Vila, Antonio, et autres
Publié: (2024)
Dance Any Beat: Blending Beats with Visuals in Dance Video Generation
par: Wang, Xuanchen, et autres
Publié: (2024)
par: Wang, Xuanchen, et autres
Publié: (2024)
UniMuMo: Unified Text, Music and Motion Generation
par: Yang, Han, et autres
Publié: (2024)
par: Yang, Han, et autres
Publié: (2024)
Prosody-Enhanced Acoustic Pre-training and Acoustic-Disentangled Prosody Adapting for Movie Dubbing
par: Zhang, Zhedong, et autres
Publié: (2025)
par: Zhang, Zhedong, et autres
Publié: (2025)
TCDiff++: An End-to-end Trajectory-Controllable Diffusion Model for Harmonious Music-Driven Group Choreography
par: Dai, Yuqin, et autres
Publié: (2025)
par: Dai, Yuqin, et autres
Publié: (2025)
Bridging Paintings and Music -- Exploring Emotion based Music Generation through Paintings
par: Hisariya, Tanisha, et autres
Publié: (2024)
par: Hisariya, Tanisha, et autres
Publié: (2024)
CustomListener: Text-guided Responsive Interaction for User-friendly Listening Head Generation
par: Liu, Xi, et autres
Publié: (2024)
par: Liu, Xi, et autres
Publié: (2024)
A Critical Assessment of Visual Sound Source Localization Models Including Negative Audio
par: Juanola, Xavier, et autres
Publié: (2024)
par: Juanola, Xavier, et autres
Publié: (2024)
Duolando: Follower GPT with Off-Policy Reinforcement Learning for Dance Accompaniment
par: Siyao, Li, et autres
Publié: (2024)
par: Siyao, Li, et autres
Publié: (2024)
Multimodal Music Generation with Explicit Bridges and Retrieval Augmentation
par: Wang, Baisen, et autres
Publié: (2024)
par: Wang, Baisen, et autres
Publié: (2024)
AutoMV: An Automatic Multi-Agent System for Music Video Generation
par: Tang, Xiaoxuan, et autres
Publié: (2025)
par: Tang, Xiaoxuan, et autres
Publié: (2025)
Input Conditioned Layer Dropping in Speech Foundation Models
par: Hannan, Abdul, et autres
Publié: (2025)
par: Hannan, Abdul, et autres
Publié: (2025)
Spectrogram-Based Detection of Auto-Tuned Vocals in Music Recordings
par: Gohari, Mahyar, et autres
Publié: (2024)
par: Gohari, Mahyar, et autres
Publié: (2024)
OmniAudio: Generating Spatial Audio from 360-Degree Video
par: Liu, Huadai, et autres
Publié: (2025)
par: Liu, Huadai, et autres
Publié: (2025)
Conditional GAN for Enhancing Diffusion Models in Efficient and Authentic Global Gesture Generation from Audios
par: Cheng, Yongkang, et autres
Publié: (2024)
par: Cheng, Yongkang, et autres
Publié: (2024)
Separate to Collaborate: Dual-Stream Diffusion Model for Coordinated Piano Hand Motion Synthesis
par: Liu, Zihao, et autres
Publié: (2025)
par: Liu, Zihao, et autres
Publié: (2025)
Latent Swap Joint Diffusion for 2D Long-Form Latent Generation
par: Dai, Yusheng, et autres
Publié: (2025)
par: Dai, Yusheng, et autres
Publié: (2025)
Learning Musical Representations for Music Performance Question Answering
par: Diao, Xingjian, et autres
Publié: (2025)
par: Diao, Xingjian, et autres
Publié: (2025)
Siamese Vision Transformers are Scalable Audio-visual Learners
par: Lin, Yan-Bo, et autres
Publié: (2024)
par: Lin, Yan-Bo, et autres
Publié: (2024)
MuVi: Video-to-Music Generation with Semantic Alignment and Rhythmic Synchronization
par: Li, Ruiqi, et autres
Publié: (2024)
par: Li, Ruiqi, et autres
Publié: (2024)
Documents similaires
-
MIDGET: Music Conditioned 3D Dance Generation
par: Wang, Jinwu, et autres
Publié: (2024) -
DanceChat: Large Language Model-Guided Music-to-Dance Generation
par: Wang, Qing, et autres
Publié: (2025) -
Bidirectional Autoregressive Diffusion Model for Dance Generation
par: Zhang, Canyu, et autres
Publié: (2024) -
Exploring Multi-Modal Control in Music-Driven Dance Generation
par: Li, Ronghui, et autres
Publié: (2024) -
Lodge: A Coarse to Fine Diffusion Network for Long Dance Generation Guided by the Characteristic Dance Primitives
par: Li, Ronghui, et autres
Publié: (2024)