LM2D: Lyrics- and Music-Driven Dance Synthesis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yin, Wenjie, Zhao, Xuejiao, Yu, Yi, Yin, Hang, Kragic, Danica, Björkman, Mårten |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GACA-DiT: Diffusion-based Dance-to-Music Generation with Genre-Adaptive Rhythm and Context-Aware Alignment
par: Wang, Jinting, et autres
Publié: (2025)
par: Wang, Jinting, et autres
Publié: (2025)
CoheDancers: Enhancing Interactive Group Dance Generation through Music-Driven Coherence Decomposition
par: Yang, Kaixing, et autres
Publié: (2024)
par: Yang, Kaixing, et autres
Publié: (2024)
Dance-to-Music Generation with Encoder-based Textual Inversion
par: Li, Sifei, et autres
Publié: (2024)
par: Li, Sifei, et autres
Publié: (2024)
Music-Aligned Holistic 3D Dance Generation via Hierarchical Motion Modeling
par: Li, Xiaojie, et autres
Publié: (2025)
par: Li, Xiaojie, et autres
Publié: (2025)
Frechet Music Distance: A Metric For Generative Symbolic Music Evaluation
par: Retkowski, Jan, et autres
Publié: (2024)
par: Retkowski, Jan, et autres
Publié: (2024)
Zero-Effort Image-to-Music Generation: An Interpretable RAG-based VLM Approach
par: Zhao, Zijian, et autres
Publié: (2025)
par: Zhao, Zijian, et autres
Publié: (2025)
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
par: Zhang, Yixiao, et autres
Publié: (2024)
par: Zhang, Yixiao, et autres
Publié: (2024)
MusER: Musical Element-Based Regularization for Generating Symbolic Music with Emotion
par: Ji, Shulei, et autres
Publié: (2023)
par: Ji, Shulei, et autres
Publié: (2023)
MMVA: Multimodal Matching Based on Valence and Arousal across Images, Music, and Musical Captions
par: Choi, Suhwan, et autres
Publié: (2025)
par: Choi, Suhwan, et autres
Publié: (2025)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
par: Batlle-Roca, Roser, et autres
Publié: (2024)
par: Batlle-Roca, Roser, et autres
Publié: (2024)
Analyzable Chain-of-Musical-Thought Prompting for High-Fidelity Music Generation
par: Lam, Max W. Y., et autres
Publié: (2025)
par: Lam, Max W. Y., et autres
Publié: (2025)
LPIPS-AttnWav2Lip: Generic Audio-Driven lip synchronization for Talking Head Generation in the Wild
par: Chen, Zhipeng, et autres
Publié: (2026)
par: Chen, Zhipeng, et autres
Publié: (2026)
A Survey of Foundation Models for Music Understanding
par: Li, Wenjun, et autres
Publié: (2024)
par: Li, Wenjun, et autres
Publié: (2024)
MSAC: Multiple Speech Attribute Control Method for Reliable Speech Emotion Recognition
par: Pan, Yu, et autres
Publié: (2023)
par: Pan, Yu, et autres
Publié: (2023)
Enhancing Expressiveness in Dance Generation via Integrating Frequency and Music Style Information
par: Huang, Qiaochu, et autres
Publié: (2024)
par: Huang, Qiaochu, et autres
Publié: (2024)
PointTalk: Audio-Driven Dynamic Lip Point Cloud for 3D Gaussian-based Talking Head Synthesis
par: Xie, Yifan, et autres
Publié: (2024)
par: Xie, Yifan, et autres
Publié: (2024)
YuE: Scaling Open Foundation Models for Long-Form Music Generation
par: Yuan, Ruibin, et autres
Publié: (2025)
par: Yuan, Ruibin, et autres
Publié: (2025)
CoComposer: LLM Multi-agent Collaborative Music Composition
par: Xing, Peiwen, et autres
Publié: (2025)
par: Xing, Peiwen, et autres
Publié: (2025)
Controllable Video-to-Music Generation with Multiple Time-Varying Conditions
par: Wu, Junxian, et autres
Publié: (2025)
par: Wu, Junxian, et autres
Publié: (2025)
From Sound to Sight: Towards AI-authored Music Videos
par: Vitasovic, Leo, et autres
Publié: (2025)
par: Vitasovic, Leo, et autres
Publié: (2025)
Dance2MIDI: Dance-driven multi-instruments music generation
par: Han, Bo, et autres
Publié: (2023)
par: Han, Bo, et autres
Publié: (2023)
Leveraging Pre-Trained Autoencoders for Interpretable Prototype Learning of Music Audio
par: Alonso-Jiménez, Pablo, et autres
Publié: (2024)
par: Alonso-Jiménez, Pablo, et autres
Publié: (2024)
ONOTE: Benchmarking Omnimodal Notation Processing for Expert-level Music Intelligence
par: Ma, Menghe, et autres
Publié: (2026)
par: Ma, Menghe, et autres
Publié: (2026)
GVMGen: A General Video-to-Music Generation Model with Hierarchical Attentions
par: Zuo, Heda, et autres
Publié: (2025)
par: Zuo, Heda, et autres
Publié: (2025)
Exploring Classical Piano Performance Generation with Expressive Music Variational AutoEncoder
par: Luo, Jing, et autres
Publié: (2025)
par: Luo, Jing, et autres
Publié: (2025)
Audio is all in one: speech-driven gesture synthetics using WavLM pre-trained model
par: Zhang, Fan, et autres
Publié: (2023)
par: Zhang, Fan, et autres
Publié: (2023)
BandCondiNet: Parallel Transformers-based Conditional Popular Music Generation with Multi-View Features
par: Luo, Jing, et autres
Publié: (2024)
par: Luo, Jing, et autres
Publié: (2024)
OmniCustom: Sync Audio-Video Customization Via Joint Audio-Video Generation Model
par: Li, Maomao, et autres
Publié: (2026)
par: Li, Maomao, et autres
Publié: (2026)
DreamHead: Learning Spatial-Temporal Correspondence via Hierarchical Diffusion for Audio-driven Talking Head Synthesis
par: Hong, Fa-Ting, et autres
Publié: (2024)
par: Hong, Fa-Ting, et autres
Publié: (2024)
Cross-Modal Learning for Music-to-Music-Video Description Generation
par: Mao, Zhuoyuan, et autres
Publié: (2025)
par: Mao, Zhuoyuan, et autres
Publié: (2025)
Segment-Factorized Full-Song Generation on Symbolic Piano Music
par: Chen, Ping-Yi, et autres
Publié: (2025)
par: Chen, Ping-Yi, et autres
Publié: (2025)
MEGADance: Mixture-of-Experts Architecture for Genre-Aware 3D Dance Generation
par: Yang, Kaixing, et autres
Publié: (2025)
par: Yang, Kaixing, et autres
Publié: (2025)
DeepResonance: Enhancing Multimodal Music Understanding via Music-centric Multi-way Instruction Tuning
par: Mao, Zhuoyuan, et autres
Publié: (2025)
par: Mao, Zhuoyuan, et autres
Publié: (2025)
SonicVisionLM: Playing Sound with Vision Language Models
par: Xie, Zhifeng, et autres
Publié: (2024)
par: Xie, Zhifeng, et autres
Publié: (2024)
Separate Anything You Describe
par: Liu, Xubo, et autres
Publié: (2023)
par: Liu, Xubo, et autres
Publié: (2023)
When End-to-End is Overkill: Rethinking Cascaded Speech-to-Text Translation
par: Min, Anna, et autres
Publié: (2025)
par: Min, Anna, et autres
Publié: (2025)
A Survey on Cross-Modal Interaction Between Music and Multimodal Data
par: Li, Sifei, et autres
Publié: (2025)
par: Li, Sifei, et autres
Publié: (2025)
AudioRole: An Audio Dataset for Character Role-Playing in Large Language Models
par: Li, Wenyu, et autres
Publié: (2025)
par: Li, Wenyu, et autres
Publié: (2025)
Disentangling Score Content and Performance Style for Joint Piano Rendering and Transcription
par: Zeng, Wei, et autres
Publié: (2025)
par: Zeng, Wei, et autres
Publié: (2025)
Instruct-MusicGen: Unlocking Text-to-Music Editing for Music Language Models via Instruction Tuning
par: Zhang, Yixiao, et autres
Publié: (2024)
par: Zhang, Yixiao, et autres
Publié: (2024)
Documents similaires
-
GACA-DiT: Diffusion-based Dance-to-Music Generation with Genre-Adaptive Rhythm and Context-Aware Alignment
par: Wang, Jinting, et autres
Publié: (2025) -
CoheDancers: Enhancing Interactive Group Dance Generation through Music-Driven Coherence Decomposition
par: Yang, Kaixing, et autres
Publié: (2024) -
Dance-to-Music Generation with Encoder-based Textual Inversion
par: Li, Sifei, et autres
Publié: (2024) -
Music-Aligned Holistic 3D Dance Generation via Hierarchical Motion Modeling
par: Li, Xiaojie, et autres
Publié: (2025) -
Frechet Music Distance: A Metric For Generative Symbolic Music Evaluation
par: Retkowski, Jan, et autres
Publié: (2024)