Tempo as the Stable Cue: Hierarchical Mixture of Tempo and Beat Experts for Music to 3D Dance Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Lyu, Guangtao, Xu, Chenghao, Liu, Qi, Yan, Jiexi, Yang, Muli, Fang, Fen, Deng, Cheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Music-Aligned Holistic 3D Dance Generation via Hierarchical Motion Modeling
por: Li, Xiaojie, et al.
Publicado: (2025)
por: Li, Xiaojie, et al.
Publicado: (2025)
MEGADance: Mixture-of-Experts Architecture for Genre-Aware 3D Dance Generation
por: Yang, Kaixing, et al.
Publicado: (2025)
por: Yang, Kaixing, et al.
Publicado: (2025)
HAFM: Hierarchical Autoregressive Foundation Model for Music Accompaniment Generation
por: Zhu, Jian, et al.
Publicado: (2026)
por: Zhu, Jian, et al.
Publicado: (2026)
Dance-to-Music Generation with Encoder-based Textual Inversion
por: Li, Sifei, et al.
Publicado: (2024)
por: Li, Sifei, et al.
Publicado: (2024)
DanceAnyWay: Synthesizing Beat-Guided 3D Dances with Randomized Temporal Contrastive Learning
por: Bhattacharya, Aneesh, et al.
Publicado: (2023)
por: Bhattacharya, Aneesh, et al.
Publicado: (2023)
Dance Any Beat: Blending Beats with Visuals in Dance Video Generation
por: Wang, Xuanchen, et al.
Publicado: (2024)
por: Wang, Xuanchen, et al.
Publicado: (2024)
ChoreoMuse: Robust Music-to-Dance Video Generation with Style Transfer and Beat-Adherent Motion
por: Wang, Xuanchen, et al.
Publicado: (2025)
por: Wang, Xuanchen, et al.
Publicado: (2025)
Enhancing Expressiveness in Dance Generation via Integrating Frequency and Music Style Information
por: Huang, Qiaochu, et al.
Publicado: (2024)
por: Huang, Qiaochu, et al.
Publicado: (2024)
DanceEditor: Towards Iterative Editable Music-driven Dance Generation with Open-Vocabulary Descriptions
por: Zhang, Hengyuan, et al.
Publicado: (2025)
por: Zhang, Hengyuan, et al.
Publicado: (2025)
Video Echoed in Music: Semantic, Temporal, and Rhythmic Alignment for Video-to-Music Generation
por: Tong, Xinyi, et al.
Publicado: (2025)
por: Tong, Xinyi, et al.
Publicado: (2025)
CoheDancers: Enhancing Interactive Group Dance Generation through Music-Driven Coherence Decomposition
por: Yang, Kaixing, et al.
Publicado: (2024)
por: Yang, Kaixing, et al.
Publicado: (2024)
MusicWeaver: Composer-Style Structural Editing and Minute-Scale Coherent Music Generation
por: Wang, Xuanchen, et al.
Publicado: (2025)
por: Wang, Xuanchen, et al.
Publicado: (2025)
MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection
por: Pan, Zihan, et al.
Publicado: (2025)
por: Pan, Zihan, et al.
Publicado: (2025)
DanceChat: Large Language Model-Guided Music-to-Dance Generation
por: Wang, Qing, et al.
Publicado: (2025)
por: Wang, Qing, et al.
Publicado: (2025)
MG-Former: A Transformer-Based Framework for Music-Driven 3D Conducting Gesture Generation
por: Qiu, Ke, et al.
Publicado: (2026)
por: Qiu, Ke, et al.
Publicado: (2026)
MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation
por: Gupta, Prerit, et al.
Publicado: (2025)
por: Gupta, Prerit, et al.
Publicado: (2025)
Gesture2Music: A Low-Latency Real-Time Framework for Continuous Gesture-Driven Music Generation
por: Jeyaraj, Rathinaraja, et al.
Publicado: (2025)
por: Jeyaraj, Rathinaraja, et al.
Publicado: (2025)
MotionBeat: Motion-Aligned Music Representation via Embodied Contrastive Learning and Bar-Equivariant Contact-Aware Encoding
por: Wang, Xuanchen, et al.
Publicado: (2025)
por: Wang, Xuanchen, et al.
Publicado: (2025)
AV-EMO-Reasoning: Benchmarking Emotional Reasoning Capabilities in Omni-modal LLMS with Audio-visual Cues
por: Zhou, Dingkun, et al.
Publicado: (2025)
por: Zhou, Dingkun, et al.
Publicado: (2025)
MART: Learning Hierarchical Music Audio Representations with Part-Whole Transformer
por: Yao, Dong, et al.
Publicado: (2023)
por: Yao, Dong, et al.
Publicado: (2023)
MusicAOG: an Energy-Based Model for Learning and Sampling a Hierarchical Representation of Symbolic Music
por: Qian, Yikai, et al.
Publicado: (2024)
por: Qian, Yikai, et al.
Publicado: (2024)
LM2D: Lyrics- and Music-Driven Dance Synthesis
por: Yin, Wenjie, et al.
Publicado: (2024)
por: Yin, Wenjie, et al.
Publicado: (2024)
Stemphonic: All-at-once Flexible Multi-stem Music Generation
por: Wu, Shih-Lun, et al.
Publicado: (2026)
por: Wu, Shih-Lun, et al.
Publicado: (2026)
MIDI-LLM: Adapting Large Language Models for Text-to-MIDI Music Generation
por: Wu, Shih-Lun, et al.
Publicado: (2025)
por: Wu, Shih-Lun, et al.
Publicado: (2025)
GACA-DiT: Diffusion-based Dance-to-Music Generation with Genre-Adaptive Rhythm and Context-Aware Alignment
por: Wang, Jinting, et al.
Publicado: (2025)
por: Wang, Jinting, et al.
Publicado: (2025)
Dance2MIDI: Dance-driven multi-instruments music generation
por: Han, Bo, et al.
Publicado: (2023)
por: Han, Bo, et al.
Publicado: (2023)
Memo2496: Expert-Annotated Dataset and Dual-View Adaptive Framework for Music Emotion Recognition
por: Li, Qilin, et al.
Publicado: (2025)
por: Li, Qilin, et al.
Publicado: (2025)
Noise-Conditioned Mixture-of-Experts Framework for Robust Speaker Verification
por: Gu, Bin, et al.
Publicado: (2025)
por: Gu, Bin, et al.
Publicado: (2025)
Can We Hear from Events? Generating Speech from Event Camera
por: Fang, Jingping, et al.
Publicado: (2026)
por: Fang, Jingping, et al.
Publicado: (2026)
Towards Practical Real-Time Low-Latency Music Source Separation
por: Wu, Junyu, et al.
Publicado: (2025)
por: Wu, Junyu, et al.
Publicado: (2025)
XGC-AVis: Towards Audio-Visual Content Understanding with a Multi-Agent Collaborative System
por: Cao, Yuqin, et al.
Publicado: (2025)
por: Cao, Yuqin, et al.
Publicado: (2025)
Efficient Adapter Tuning for Joint Singing Voice Beat and Downbeat Tracking with Self-supervised Learning Features
por: Deng, Jiajun, et al.
Publicado: (2025)
por: Deng, Jiajun, et al.
Publicado: (2025)
MIDI-LLaMA: An Instruction-Following Multimodal LLM for Symbolic Music Understanding
por: Yang, Meng, et al.
Publicado: (2026)
por: Yang, Meng, et al.
Publicado: (2026)
GVMGen: A General Video-to-Music Generation Model with Hierarchical Attentions
por: Zuo, Heda, et al.
Publicado: (2025)
por: Zuo, Heda, et al.
Publicado: (2025)
MATHDance: Mamba-Transformer Architecture with Uniform Tokenization for High-Quality 3D Dance Generation
por: Yang, Kaixing, et al.
Publicado: (2025)
por: Yang, Kaixing, et al.
Publicado: (2025)
Flexible Control in Symbolic Music Generation via Musical Metadata
por: Han, Sangjun, et al.
Publicado: (2024)
por: Han, Sangjun, et al.
Publicado: (2024)
Audio-Visual Separation with Hierarchical Fusion and Representation Alignment
por: Hu, Han, et al.
Publicado: (2025)
por: Hu, Han, et al.
Publicado: (2025)
Music Arena: Live Evaluation for Text-to-Music
por: Kim, Yonghyun, et al.
Publicado: (2025)
por: Kim, Yonghyun, et al.
Publicado: (2025)
MusicSwarm: Biologically Inspired Intelligence for Music Composition
por: Buehler, Markus J.
Publicado: (2025)
por: Buehler, Markus J.
Publicado: (2025)
Intelligent Text-Conditioned Music Generation
por: Xie, Zhouyao, et al.
Publicado: (2024)
por: Xie, Zhouyao, et al.
Publicado: (2024)
Ejemplares similares
-
Music-Aligned Holistic 3D Dance Generation via Hierarchical Motion Modeling
por: Li, Xiaojie, et al.
Publicado: (2025) -
MEGADance: Mixture-of-Experts Architecture for Genre-Aware 3D Dance Generation
por: Yang, Kaixing, et al.
Publicado: (2025) -
HAFM: Hierarchical Autoregressive Foundation Model for Music Accompaniment Generation
por: Zhu, Jian, et al.
Publicado: (2026) -
Dance-to-Music Generation with Encoder-based Textual Inversion
por: Li, Sifei, et al.
Publicado: (2024) -
DanceAnyWay: Synthesizing Beat-Guided 3D Dances with Randomized Temporal Contrastive Learning
por: Bhattacharya, Aneesh, et al.
Publicado: (2023)