Streaming Piano Transcription Based on Consistent Onset and Offset Decoding with Sustain Pedal Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Wei, Weixing, Zhao, Jiahao, Wu, Yulun, Yoshii, Kazuyoshi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
JEPOO: Highly Accurate Joint Estimation of Pitch, Onset and Offset for Music Information Retrieval
di: Wei, Haojie, et al.
Pubblicazione: (2023)
di: Wei, Haojie, et al.
Pubblicazione: (2023)
Evaluating High-Resolution Piano Sustain Pedal Depth Estimation with Musically Informed Metrics
di: Zhang, Hanwen, et al.
Pubblicazione: (2025)
di: Zhang, Hanwen, et al.
Pubblicazione: (2025)
Efficient Transformer-Based Piano Transcription With Sparse Attention Mechanisms
di: Wei, Weixing, et al.
Pubblicazione: (2025)
di: Wei, Weixing, et al.
Pubblicazione: (2025)
SynthTab: Leveraging Synthesized Data for Guitar Tablature Transcription
di: Zang, Yongyi, et al.
Pubblicazione: (2023)
di: Zang, Yongyi, et al.
Pubblicazione: (2023)
High-Resolution Sustain Pedal Depth Estimation from Piano Audio Across Room Acoustics
di: Fang, Kun, et al.
Pubblicazione: (2025)
di: Fang, Kun, et al.
Pubblicazione: (2025)
TalkPlay-Tools: Conversational Music Recommendation with LLM Tool Calling
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
Diff4Steer: Steerable Diffusion Prior for Generative Music Retrieval with Semantic Guidance
di: Bao, Xuchan, et al.
Pubblicazione: (2024)
di: Bao, Xuchan, et al.
Pubblicazione: (2024)
Enriching Music Descriptions with a Finetuned-LLM and Metadata for Text-to-Music Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
Disentangling Score Content and Performance Style for Joint Piano Rendering and Transcription
di: Zeng, Wei, et al.
Pubblicazione: (2025)
di: Zeng, Wei, et al.
Pubblicazione: (2025)
A Dataset and Baselines for Measuring and Predicting the Music Piece Memorability
di: Tseng, Li-Yang, et al.
Pubblicazione: (2024)
di: Tseng, Li-Yang, et al.
Pubblicazione: (2024)
MERGE -- A Bimodal Audio-Lyrics Dataset for Static Music Emotion Recognition
di: Louro, Pedro Lima, et al.
Pubblicazione: (2024)
di: Louro, Pedro Lima, et al.
Pubblicazione: (2024)
Anchor-aware Deep Metric Learning for Audio-visual Retrieval
di: Zeng, Donghuo, et al.
Pubblicazione: (2024)
di: Zeng, Donghuo, et al.
Pubblicazione: (2024)
On the Effect of Data-Augmentation on Local Embedding Properties in the Contrastive Learning of Music Audio Representations
di: McCallum, Matthew C., et al.
Pubblicazione: (2024)
di: McCallum, Matthew C., et al.
Pubblicazione: (2024)
ASK: Adaptive Self-improving Knowledge Framework for Audio Text Retrieval
di: Fu, Siyuan, et al.
Pubblicazione: (2025)
di: Fu, Siyuan, et al.
Pubblicazione: (2025)
Music Genre Classification: Ensemble Learning with Subcomponents-level Attention
di: Liu, Yichen, et al.
Pubblicazione: (2024)
di: Liu, Yichen, et al.
Pubblicazione: (2024)
TalkPlayData 2: An Agentic Synthetic Data Pipeline for Multimodal Conversational Music Recommendation
di: Choi, Keunwoo, et al.
Pubblicazione: (2025)
di: Choi, Keunwoo, et al.
Pubblicazione: (2025)
Learning Normal Patterns in Musical Loops
di: Dadman, Shayan, et al.
Pubblicazione: (2025)
di: Dadman, Shayan, et al.
Pubblicazione: (2025)
A Distribution Matching Approach to Neural Piano Transcription with Optimal Transport
di: Wei, Weixing, et al.
Pubblicazione: (2026)
di: Wei, Weixing, et al.
Pubblicazione: (2026)
Amanous: Distribution-Switching for Superhuman Piano Density on Disklavier
di: Bae, Joonhyung
Pubblicazione: (2026)
di: Bae, Joonhyung
Pubblicazione: (2026)
DOA-Aware Audio-Visual Self-Supervised Learning for Sound Event Localization and Detection
di: Fujita, Yoto, et al.
Pubblicazione: (2024)
di: Fujita, Yoto, et al.
Pubblicazione: (2024)
Audio Does Matter: Importance-Aware Multi-Granularity Fusion for Video Moment Retrieval
di: Lin, Junan, et al.
Pubblicazione: (2025)
di: Lin, Junan, et al.
Pubblicazione: (2025)
Zero-Shot Fake Video Detection by Audio-Visual Consistency
di: Li, Xiaolou, et al.
Pubblicazione: (2024)
di: Li, Xiaolou, et al.
Pubblicazione: (2024)
A Traditional Approach to Symbolic Piano Continuation
di: Zhou-Zheng, Christian, et al.
Pubblicazione: (2025)
di: Zhou-Zheng, Christian, et al.
Pubblicazione: (2025)
Fretting-Transformer: Encoder-Decoder Model for MIDI to Tablature Transcription
di: Hamberger, Anna, et al.
Pubblicazione: (2025)
di: Hamberger, Anna, et al.
Pubblicazione: (2025)
FGAS: Fixed Decoder Network-Based Audio Steganography with Adversarial Perturbation Generation
di: Yan, Jialin, et al.
Pubblicazione: (2025)
di: Yan, Jialin, et al.
Pubblicazione: (2025)
VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering
di: Rackauckas, Zackary, et al.
Pubblicazione: (2025)
di: Rackauckas, Zackary, et al.
Pubblicazione: (2025)
Exploring Classical Piano Performance Generation with Expressive Music Variational AutoEncoder
di: Luo, Jing, et al.
Pubblicazione: (2025)
di: Luo, Jing, et al.
Pubblicazione: (2025)
Towards Streaming Synchronized Spatial Audio Generation via Autoregressive Diffusion Transformer
di: Lei, Ke, et al.
Pubblicazione: (2026)
di: Lei, Ke, et al.
Pubblicazione: (2026)
Deconstructing Jazz Piano Style Using Machine Learning
di: Cheston, Huw, et al.
Pubblicazione: (2025)
di: Cheston, Huw, et al.
Pubblicazione: (2025)
MusFlow: Multimodal Music Generation via Conditional Flow Matching
di: Song, Jiahao, et al.
Pubblicazione: (2025)
di: Song, Jiahao, et al.
Pubblicazione: (2025)
PIAST: A Multimodal Piano Dataset with Audio, Symbolic and Text
di: Bang, Hayeon, et al.
Pubblicazione: (2024)
di: Bang, Hayeon, et al.
Pubblicazione: (2024)
SteerMusic: Enhanced Musical Consistency for Zero-shot Text-guided and Personalized Music Editing
di: Niu, Xinlei, et al.
Pubblicazione: (2025)
di: Niu, Xinlei, et al.
Pubblicazione: (2025)
Multiscale Matching Driven by Cross-Modal Similarity Consistency for Audio-Text Retrieval
di: Wang, Qian, et al.
Pubblicazione: (2024)
di: Wang, Qian, et al.
Pubblicazione: (2024)
Trusted Fake Audio Detection Based on Dirichlet Distribution
di: Ding, Chi, et al.
Pubblicazione: (2025)
di: Ding, Chi, et al.
Pubblicazione: (2025)
BERT-like Pre-training for Symbolic Piano Music Classification Tasks
di: Chou, Yi-Hui, et al.
Pubblicazione: (2021)
di: Chou, Yi-Hui, et al.
Pubblicazione: (2021)
Siamese Residual Neural Network for Musical Shape Evaluation in Piano Performance Assessment
di: Li, Xiaoquan, et al.
Pubblicazione: (2024)
di: Li, Xiaoquan, et al.
Pubblicazione: (2024)
MART: Learning Hierarchical Music Audio Representations with Part-Whole Transformer
di: Yao, Dong, et al.
Pubblicazione: (2023)
di: Yao, Dong, et al.
Pubblicazione: (2023)
TEAdapter: Supply abundant guidance for controllable text-to-music generation
di: Zou, Jialing, et al.
Pubblicazione: (2024)
di: Zou, Jialing, et al.
Pubblicazione: (2024)
Noise-Conditioned Mixture-of-Experts Framework for Robust Speaker Verification
di: Gu, Bin, et al.
Pubblicazione: (2025)
di: Gu, Bin, et al.
Pubblicazione: (2025)
Speech-to-See: End-to-End Speech-Driven Open-Set Object Detection
di: Lu, Wenhuan, et al.
Pubblicazione: (2025)
di: Lu, Wenhuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
JEPOO: Highly Accurate Joint Estimation of Pitch, Onset and Offset for Music Information Retrieval
di: Wei, Haojie, et al.
Pubblicazione: (2023) -
Evaluating High-Resolution Piano Sustain Pedal Depth Estimation with Musically Informed Metrics
di: Zhang, Hanwen, et al.
Pubblicazione: (2025) -
Efficient Transformer-Based Piano Transcription With Sparse Attention Mechanisms
di: Wei, Weixing, et al.
Pubblicazione: (2025) -
SynthTab: Leveraging Synthesized Data for Guitar Tablature Transcription
di: Zang, Yongyi, et al.
Pubblicazione: (2023) -
High-Resolution Sustain Pedal Depth Estimation from Piano Audio Across Room Acoustics
di: Fang, Kun, et al.
Pubblicazione: (2025)