Separate to Collaborate: Dual-Stream Diffusion Model for Coordinated Piano Hand Motion Synthesis
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Zihao, Ou, Mingwen, Xu, Zunnan, Huang, Jiaqi, Han, Haonan, Li, Ronghui, Li, Xiu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FürElise: Capturing and Physically Synthesizing Hand Motions of Piano Performance
di: Wang, Ruocheng, et al.
Pubblicazione: (2024)
di: Wang, Ruocheng, et al.
Pubblicazione: (2024)
BATON: Aligning Text-to-Audio Model with Human Preference Feedback
di: Liao, Huan, et al.
Pubblicazione: (2024)
di: Liao, Huan, et al.
Pubblicazione: (2024)
Towards An Integrated Approach for Expressive Piano Performance Synthesis from Music Scores
di: Tang, Jingjing, et al.
Pubblicazione: (2025)
di: Tang, Jingjing, et al.
Pubblicazione: (2025)
PANDORA: Diffusion Policy Learning for Dexterous Robotic Piano Playing
di: Huang, Yanjia, et al.
Pubblicazione: (2025)
di: Huang, Yanjia, et al.
Pubblicazione: (2025)
PianoMotion10M: Dataset and Benchmark for Hand Motion Generation in Piano Performance
di: Gan, Qijun, et al.
Pubblicazione: (2024)
di: Gan, Qijun, et al.
Pubblicazione: (2024)
CUSIDE-T: Chunking, Simulating Future and Decoding for Transducer based Streaming ASR
di: Zhao, Wenbo, et al.
Pubblicazione: (2024)
di: Zhao, Wenbo, et al.
Pubblicazione: (2024)
Combining Deterministic Enhanced Conditions with Dual-Streaming Encoding for Diffusion-Based Speech Enhancement
di: Shi, Hao, et al.
Pubblicazione: (2025)
di: Shi, Hao, et al.
Pubblicazione: (2025)
Convolutional Neural Network Achieves Human-level Accuracy in Music Genre Classification
di: Dong, Mingwen
Pubblicazione: (2018)
di: Dong, Mingwen
Pubblicazione: (2018)
Towards Musically Informed Evaluation of Piano Transcription Models
di: Hu, Patricia, et al.
Pubblicazione: (2024)
di: Hu, Patricia, et al.
Pubblicazione: (2024)
Lend a Hand: Semi Training-Free Cued Speech Recognition via MLLM-Driven Hand Modeling for Barrier-free Communication
di: Huang, Guanjie, et al.
Pubblicazione: (2025)
di: Huang, Guanjie, et al.
Pubblicazione: (2025)
Music-Aligned Holistic 3D Dance Generation via Hierarchical Motion Modeling
di: Li, Xiaojie, et al.
Pubblicazione: (2025)
di: Li, Xiaojie, et al.
Pubblicazione: (2025)
The Florence Price Art Song Dataset and Piano Accompaniment Generator
di: He, Tao-Tao, et al.
Pubblicazione: (2025)
di: He, Tao-Tao, et al.
Pubblicazione: (2025)
A Holistic Evaluation of Piano Sound Quality
di: Zhou, Monan, et al.
Pubblicazione: (2023)
di: Zhou, Monan, et al.
Pubblicazione: (2023)
SAC: Neural Speech Codec with Semantic-Acoustic Dual-Stream Quantization
di: Chen, Wenxi, et al.
Pubblicazione: (2025)
di: Chen, Wenxi, et al.
Pubblicazione: (2025)
Unsupervised Single-Channel Audio Separation with Diffusion Source Priors
di: Shi, Runwu, et al.
Pubblicazione: (2025)
di: Shi, Runwu, et al.
Pubblicazione: (2025)
How does the teacher rate? Observations from the NeuroPiano dataset
di: Zhang, Huan, et al.
Pubblicazione: (2024)
di: Zhang, Huan, et al.
Pubblicazione: (2024)
Comprehend and Talk: Text to Speech Synthesis via Dual Language Modeling
di: Cao, Junjie, et al.
Pubblicazione: (2025)
di: Cao, Junjie, et al.
Pubblicazione: (2025)
Unsupervised Single-Channel Speech Separation with a Diffusion Prior under Speaker-Embedding Guidance
di: Shi, Runwu, et al.
Pubblicazione: (2025)
di: Shi, Runwu, et al.
Pubblicazione: (2025)
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
VoiceDiT: Dual-Condition Diffusion Transformer for Environment-Aware Speech Synthesis
di: Jung, Jaemin, et al.
Pubblicazione: (2024)
di: Jung, Jaemin, et al.
Pubblicazione: (2024)
Dual-path Mamba: Short and Long-term Bidirectional Selective Structured State Space Models for Speech Separation
di: Jiang, Xilin, et al.
Pubblicazione: (2024)
di: Jiang, Xilin, et al.
Pubblicazione: (2024)
DualVC 2: Dynamic Masked Convolution for Unified Streaming and Non-Streaming Voice Conversion
di: Ning, Ziqian, et al.
Pubblicazione: (2023)
di: Ning, Ziqian, et al.
Pubblicazione: (2023)
PiCoGen: Generate Piano Covers with a Two-stage Approach
di: Tan, Chih-Pin, et al.
Pubblicazione: (2024)
di: Tan, Chih-Pin, et al.
Pubblicazione: (2024)
Generating Piano Music with Transformers: A Comparative Study of Scale, Data, and Metrics
di: Lehmkuhl, Jonathan, et al.
Pubblicazione: (2025)
di: Lehmkuhl, Jonathan, et al.
Pubblicazione: (2025)
StreamAAD: Decoding Spatial Auditory Attention with a Streaming Architecture
di: Qiu, Zelin, et al.
Pubblicazione: (2024)
di: Qiu, Zelin, et al.
Pubblicazione: (2024)
Can Audio Reveal Music Performance Difficulty? Insights from the Piano Syllabus Dataset
di: Ramoneda, Pedro, et al.
Pubblicazione: (2024)
di: Ramoneda, Pedro, et al.
Pubblicazione: (2024)
StyleTTS-ZS: Efficient High-Quality Zero-Shot Text-to-Speech Synthesis with Distilled Time-Varying Style Diffusion
di: Li, Yinghao Aaron, et al.
Pubblicazione: (2024)
di: Li, Yinghao Aaron, et al.
Pubblicazione: (2024)
Phoneme-based speech recognition driven by large language models and sampling marginalization
di: Ma, Te, et al.
Pubblicazione: (2025)
di: Ma, Te, et al.
Pubblicazione: (2025)
Pairing Real-Time Piano Transcription with Symbol-level Tracking for Precise and Robust Score Following
di: Peter, Silvan, et al.
Pubblicazione: (2025)
di: Peter, Silvan, et al.
Pubblicazione: (2025)
Improved Architecture for High-resolution Piano Transcription to Efficiently Capture Acoustic Characteristics of Music Signals
di: Mi, Jinyi, et al.
Pubblicazione: (2024)
di: Mi, Jinyi, et al.
Pubblicazione: (2024)
Diffusion-based Signal Refiner for Speech Enhancement and Separation
di: Hirano, Masato, et al.
Pubblicazione: (2023)
di: Hirano, Masato, et al.
Pubblicazione: (2023)
Improving Music Source Separation with Diffusion and Consistency Refinement
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
Amanous: Distribution-Switching for Superhuman Piano Density on Disklavier
di: Bae, Joonhyung
Pubblicazione: (2026)
di: Bae, Joonhyung
Pubblicazione: (2026)
PianoBART: Symbolic Piano Music Generation and Understanding with Large-Scale Pre-Training
di: Liang, Xiao, et al.
Pubblicazione: (2024)
di: Liang, Xiao, et al.
Pubblicazione: (2024)
MoMu-Diffusion: On Learning Long-Term Motion-Music Synchronization and Correspondence
di: You, Fuming, et al.
Pubblicazione: (2024)
di: You, Fuming, et al.
Pubblicazione: (2024)
PiCoGen2: Piano cover generation with transfer learning approach and weakly aligned data
di: Tan, Chih-Pin, et al.
Pubblicazione: (2024)
di: Tan, Chih-Pin, et al.
Pubblicazione: (2024)
A Fast and Lightweight Model for Causal Audio-Visual Speech Separation
di: Sang, Wendi, et al.
Pubblicazione: (2025)
di: Sang, Wendi, et al.
Pubblicazione: (2025)
Zero-Shot Duet Singing Voices Separation with Diffusion Models
di: Yu, Chin-Yun, et al.
Pubblicazione: (2023)
di: Yu, Chin-Yun, et al.
Pubblicazione: (2023)
EDSep: An Effective Diffusion-Based Method for Speech Source Separation
di: Dong, Jinwei, et al.
Pubblicazione: (2025)
di: Dong, Jinwei, et al.
Pubblicazione: (2025)
Streaming Piano Transcription Based on Consistent Onset and Offset Decoding with Sustain Pedal Detection
di: Wei, Weixing, et al.
Pubblicazione: (2025)
di: Wei, Weixing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
FürElise: Capturing and Physically Synthesizing Hand Motions of Piano Performance
di: Wang, Ruocheng, et al.
Pubblicazione: (2024) -
BATON: Aligning Text-to-Audio Model with Human Preference Feedback
di: Liao, Huan, et al.
Pubblicazione: (2024) -
Towards An Integrated Approach for Expressive Piano Performance Synthesis from Music Scores
di: Tang, Jingjing, et al.
Pubblicazione: (2025) -
PANDORA: Diffusion Policy Learning for Dexterous Robotic Piano Playing
di: Huang, Yanjia, et al.
Pubblicazione: (2025) -
PianoMotion10M: Dataset and Benchmark for Hand Motion Generation in Piano Performance
di: Gan, Qijun, et al.
Pubblicazione: (2024)