Exploring Multi-Modal Control in Music-Driven Dance Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Ronghui, Dai, Yuqin, Zhang, Yachao, Li, Jun, Yang, Jian, Guo, Jie, Li, Xiu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TCDiff++: An End-to-end Trajectory-Controllable Diffusion Model for Harmonious Music-Driven Group Choreography
por: Dai, Yuqin, et al.
Publicado: (2025)
por: Dai, Yuqin, et al.
Publicado: (2025)
Lodge: A Coarse to Fine Diffusion Network for Long Dance Generation Guided by the Characteristic Dance Primitives
por: Li, Ronghui, et al.
Publicado: (2024)
por: Li, Ronghui, et al.
Publicado: (2024)
InterDance:Reactive 3D Dance Generation with Realistic Duet Interactions
por: Li, Ronghui, et al.
Publicado: (2024)
por: Li, Ronghui, et al.
Publicado: (2024)
DuetGen: Music Driven Two-Person Dance Generation via Hierarchical Masked Modeling
por: Ghosh, Anindita, et al.
Publicado: (2025)
por: Ghosh, Anindita, et al.
Publicado: (2025)
GCDance: Genre-Controlled Music-Driven 3D Full Body Dance Generation
por: Liu, Xinran, et al.
Publicado: (2025)
por: Liu, Xinran, et al.
Publicado: (2025)
Music-Aligned Holistic 3D Dance Generation via Hierarchical Motion Modeling
por: Li, Xiaojie, et al.
Publicado: (2025)
por: Li, Xiaojie, et al.
Publicado: (2025)
DanceChat: Large Language Model-Guided Music-to-Dance Generation
por: Wang, Qing, et al.
Publicado: (2025)
por: Wang, Qing, et al.
Publicado: (2025)
Enhancing Dance-to-Music Generation via Negative Conditioning Latent Diffusion Model
por: Sun, Changchang, et al.
Publicado: (2025)
por: Sun, Changchang, et al.
Publicado: (2025)
MIDGET: Music Conditioned 3D Dance Generation
por: Wang, Jinwu, et al.
Publicado: (2024)
por: Wang, Jinwu, et al.
Publicado: (2024)
Separate to Collaborate: Dual-Stream Diffusion Model for Coordinated Piano Hand Motion Synthesis
por: Liu, Zihao, et al.
Publicado: (2025)
por: Liu, Zihao, et al.
Publicado: (2025)
EnchantDance: Unveiling the Potential of Music-Driven Dance Movement
por: Han, Bo, et al.
Publicado: (2023)
por: Han, Bo, et al.
Publicado: (2023)
Controllable Dance Generation with Style-Guided Motion Diffusion
por: Wang, Hongsong, et al.
Publicado: (2024)
por: Wang, Hongsong, et al.
Publicado: (2024)
Computation and Parameter Efficient Multi-Modal Fusion Transformer for Cued Speech Recognition
por: Liu, Lei, et al.
Publicado: (2024)
por: Liu, Lei, et al.
Publicado: (2024)
Bidirectional Autoregressive Diffusion Model for Dance Generation
por: Zhang, Canyu, et al.
Publicado: (2024)
por: Zhang, Canyu, et al.
Publicado: (2024)
MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation
por: Huang, Mingyang, et al.
Publicado: (2025)
por: Huang, Mingyang, et al.
Publicado: (2025)
Dance-to-Music Generation with Encoder-based Textual Inversion
por: Li, Sifei, et al.
Publicado: (2024)
por: Li, Sifei, et al.
Publicado: (2024)
DGFM: Full Body Dance Generation Driven by Music Foundation Models
por: Liu, Xinran, et al.
Publicado: (2025)
por: Liu, Xinran, et al.
Publicado: (2025)
Bridging Paintings and Music -- Exploring Emotion based Music Generation through Paintings
por: Hisariya, Tanisha, et al.
Publicado: (2024)
por: Hisariya, Tanisha, et al.
Publicado: (2024)
CoheDancers: Enhancing Interactive Group Dance Generation through Music-Driven Coherence Decomposition
por: Yang, Kaixing, et al.
Publicado: (2024)
por: Yang, Kaixing, et al.
Publicado: (2024)
POPDG: Popular 3D Dance Generation with PopDanceSet
por: Luo, Zhenye, et al.
Publicado: (2024)
por: Luo, Zhenye, et al.
Publicado: (2024)
AutoMV: An Automatic Multi-Agent System for Music Video Generation
por: Tang, Xiaoxuan, et al.
Publicado: (2025)
por: Tang, Xiaoxuan, et al.
Publicado: (2025)
Global-Local Distillation Network-Based Audio-Visual Speaker Tracking with Incomplete Modalities
por: Li, Yidi, et al.
Publicado: (2024)
por: Li, Yidi, et al.
Publicado: (2024)
FilmComposer: LLM-Driven Music Production for Silent Film Clips
por: Xie, Zhifeng, et al.
Publicado: (2025)
por: Xie, Zhifeng, et al.
Publicado: (2025)
Duolando: Follower GPT with Off-Policy Reinforcement Learning for Dance Accompaniment
por: Siyao, Li, et al.
Publicado: (2024)
por: Siyao, Li, et al.
Publicado: (2024)
Wav2Sem: Plug-and-Play Audio Semantic Decoupling for 3D Speech-Driven Facial Animation
por: Li, Hao, et al.
Publicado: (2025)
por: Li, Hao, et al.
Publicado: (2025)
OmniFlow: Any-to-Any Generation with Multi-Modal Rectified Flows
por: Li, Shufan, et al.
Publicado: (2024)
por: Li, Shufan, et al.
Publicado: (2024)
Both Ears Wide Open: Towards Language-Driven Spatial Audio Generation
por: Sun, Peiwen, et al.
Publicado: (2024)
por: Sun, Peiwen, et al.
Publicado: (2024)
Art2Mus: Bridging Visual Arts and Music through Cross-Modal Generation
por: Rinaldi, Ivan, et al.
Publicado: (2024)
por: Rinaldi, Ivan, et al.
Publicado: (2024)
Seed-Music: A Unified Framework for High Quality and Controlled Music Generation
por: Bai, Ye, et al.
Publicado: (2024)
por: Bai, Ye, et al.
Publicado: (2024)
AlignVSR: Audio-Visual Cross-Modal Alignment for Visual Speech Recognition
por: Liu, Zehua, et al.
Publicado: (2024)
por: Liu, Zehua, et al.
Publicado: (2024)
DeepAudio-V1:Towards Multi-Modal Multi-Stage End-to-End Video to Speech and Audio Generation
por: Zhang, Haomin, et al.
Publicado: (2025)
por: Zhang, Haomin, et al.
Publicado: (2025)
VMAS: Video-to-Music Generation via Semantic Alignment in Web Music Videos
por: Lin, Yan-Bo, et al.
Publicado: (2024)
por: Lin, Yan-Bo, et al.
Publicado: (2024)
UniCUE: Unified Recognition and Generation Framework for Chinese Cued Speech Video-to-Speech Generation
por: Wang, Jinting, et al.
Publicado: (2025)
por: Wang, Jinting, et al.
Publicado: (2025)
MuVi: Video-to-Music Generation with Semantic Alignment and Rhythmic Synchronization
por: Li, Ruiqi, et al.
Publicado: (2024)
por: Li, Ruiqi, et al.
Publicado: (2024)
Multimodal Music Generation with Explicit Bridges and Retrieval Augmentation
por: Wang, Baisen, et al.
Publicado: (2024)
por: Wang, Baisen, et al.
Publicado: (2024)
Tri-Ergon: Fine-grained Video-to-Audio Generation with Multi-modal Conditions and LUFS Control
por: Li, Bingliang, et al.
Publicado: (2024)
por: Li, Bingliang, et al.
Publicado: (2024)
EXPOTION: Facial Expression and Motion Control for Multimodal Music Generation
por: Izzati, Fathinah, et al.
Publicado: (2025)
por: Izzati, Fathinah, et al.
Publicado: (2025)
Towards Video to Piano Music Generation with Chain-of-Perform Support Benchmarks
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
PoolingVQ: A VQVAE Variant for Reducing Audio Redundancy and Boosting Multi-Modal Fusion in Music Emotion Analysis
por: Zou, Dinghao, et al.
Publicado: (2025)
por: Zou, Dinghao, et al.
Publicado: (2025)
PF-D2M: A Pose-free Diffusion Model for Universal Dance-to-Music Generation
por: Im, Jaekwon, et al.
Publicado: (2026)
por: Im, Jaekwon, et al.
Publicado: (2026)
Ejemplares similares
-
TCDiff++: An End-to-end Trajectory-Controllable Diffusion Model for Harmonious Music-Driven Group Choreography
por: Dai, Yuqin, et al.
Publicado: (2025) -
Lodge: A Coarse to Fine Diffusion Network for Long Dance Generation Guided by the Characteristic Dance Primitives
por: Li, Ronghui, et al.
Publicado: (2024) -
InterDance:Reactive 3D Dance Generation with Realistic Duet Interactions
por: Li, Ronghui, et al.
Publicado: (2024) -
DuetGen: Music Driven Two-Person Dance Generation via Hierarchical Masked Modeling
por: Ghosh, Anindita, et al.
Publicado: (2025) -
GCDance: Genre-Controlled Music-Driven 3D Full Body Dance Generation
por: Liu, Xinran, et al.
Publicado: (2025)