A New Dataset, Notation Software, and Representation for Computational Schenkerian Analysis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ni-Hahn, Stephen, Xu, Weihan, Yin, Jerry, Zhu, Rico, Mak, Simon, Jiang, Yue, Rudin, Cynthia |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AutoSchA: Automatic Hierarchical Music Representations via Multi-Relational Node Isolation
par: Ni-Hahn, Stephen, et autres
Publié: (2025)
par: Ni-Hahn, Stephen, et autres
Publié: (2025)
ProGress: Structured Music Generation via Graph Diffusion and Hierarchical Music Analysis
par: Ni-Hahn, Stephen, et autres
Publié: (2025)
par: Ni-Hahn, Stephen, et autres
Publié: (2025)
YNote: A Novel Music Notation for Fine-Tuning LLMs in Music Generation
par: Lu, Shao-Chien, et autres
Publié: (2025)
par: Lu, Shao-Chien, et autres
Publié: (2025)
ONOTE: Benchmarking Omnimodal Notation Processing for Expert-level Music Intelligence
par: Ma, Menghe, et autres
Publié: (2026)
par: Ma, Menghe, et autres
Publié: (2026)
Via Score to Performance: Efficient Human-Controllable Long Song Generation with Bar-Level Symbolic Notation
par: Wang, Tongxi, et autres
Publié: (2025)
par: Wang, Tongxi, et autres
Publié: (2025)
Bridging Biological Hearing and Neuromorphic Computing: End-to-End Time-Domain Audio Signal Processing with Reservoir Computing
par: Sebastian, Rinku, et autres
Publié: (2026)
par: Sebastian, Rinku, et autres
Publié: (2026)
EMelodyGen: Emotion-Conditioned Melody Generation in ABC Notation with the Musical Feature Template
par: Zhou, Monan, et autres
Publié: (2023)
par: Zhou, Monan, et autres
Publié: (2023)
Aria-MIDI: A Dataset of Piano MIDI Files for Symbolic Music Modeling
par: Bradshaw, Louis, et autres
Publié: (2025)
par: Bradshaw, Louis, et autres
Publié: (2025)
Infant Cry Detection Using Causal Temporal Representation
par: Fu, Minghao, et autres
Publié: (2025)
par: Fu, Minghao, et autres
Publié: (2025)
What Do Language Models Hear? Probing for Auditory Representations in Language Models
par: Ngo, Jerry, et autres
Publié: (2024)
par: Ngo, Jerry, et autres
Publié: (2024)
Evaluation of Deep Audio Representations for Hearables
par: Gröger, Fabian, et autres
Publié: (2025)
par: Gröger, Fabian, et autres
Publié: (2025)
NOTA: Multimodal Music Notation Understanding for Visual Large Language Model
par: Tang, Mingni, et autres
Publié: (2025)
par: Tang, Mingni, et autres
Publié: (2025)
Quantize More, Lose Less: Autoregressive Generation from Residually Quantized Speech Representations
par: Han, Yichen, et autres
Publié: (2025)
par: Han, Yichen, et autres
Publié: (2025)
Tadabur: A Large-Scale Quran Audio Dataset
par: Alherran, Faisal
Publié: (2026)
par: Alherran, Faisal
Publié: (2026)
SCDF: A Speaker Characteristics DeepFake Speech Dataset for Bias Analysis
par: Staněk, Vojtěch, et autres
Publié: (2025)
par: Staněk, Vojtěch, et autres
Publié: (2025)
Cross-Domain Audio Deepfake Detection: Dataset and Analysis
par: Li, Yuang, et autres
Publié: (2024)
par: Li, Yuang, et autres
Publié: (2024)
Deepfake Audio Detection Using Self-supervised Fusion Representations
par: Zaman, Khalid, et autres
Publié: (2026)
par: Zaman, Khalid, et autres
Publié: (2026)
Perceptually Aligning Representations of Music via Noise-Augmented Autoencoders
par: Bjare, Mathias Rose, et autres
Publié: (2025)
par: Bjare, Mathias Rose, et autres
Publié: (2025)
Enabling Automatic Disordered Speech Recognition: An Impaired Speech Dataset in the Akan Language
par: Wiafe, Isaac, et autres
Publié: (2026)
par: Wiafe, Isaac, et autres
Publié: (2026)
HAIM: Human-AI Music Datasets for AI Music Production Tracking Benchmark
par: Go, Seonghyeon, et autres
Publié: (2026)
par: Go, Seonghyeon, et autres
Publié: (2026)
Generating Symbolic Music from Natural Language Prompts using an LLM-Enhanced Dataset
par: Xu, Weihan, et autres
Publié: (2024)
par: Xu, Weihan, et autres
Publié: (2024)
Masked Latent Prediction and Classification for Self-Supervised Audio Representation Learning
par: Quelennec, Aurian, et autres
Publié: (2025)
par: Quelennec, Aurian, et autres
Publié: (2025)
NSTR: Neural Spectral Transport Representation for Space-Varying Frequency Fields
par: Versace, Plein
Publié: (2025)
par: Versace, Plein
Publié: (2025)
Rethinking Leveraging Pre-Trained Multi-Layer Representations for Speaker Verification
par: Kim, Jin Sob, et autres
Publié: (2025)
par: Kim, Jin Sob, et autres
Publié: (2025)
JamendoMaxCaps: A Large Scale Music-caption Dataset with Imputed Metadata
par: Roy, Abhinaba, et autres
Publié: (2025)
par: Roy, Abhinaba, et autres
Publié: (2025)
Structure-Aware Piano Accompaniment via Style Planning and Dataset-Aligned Pattern Retrieval
par: Zang, Wanyu, et autres
Publié: (2026)
par: Zang, Wanyu, et autres
Publié: (2026)
Multi-Accent Mandarin Dry-Vocal Singing Dataset: Benchmark for Singing Accent Recognition
par: Wang, Zihao, et autres
Publié: (2025)
par: Wang, Zihao, et autres
Publié: (2025)
MATPAC++: Enhanced Masked Latent Prediction for Self-Supervised Audio Representation Learning
par: Quelennec, Aurian, et autres
Publié: (2025)
par: Quelennec, Aurian, et autres
Publié: (2025)
Prosodic Boundary-Aware Streaming Generation for LLM-Based TTS with Streaming Text Input
par: Liu, Changsong, et autres
Publié: (2026)
par: Liu, Changsong, et autres
Publié: (2026)
UniWhisper: Efficient Continual Multi-task Training for Robust Universal Audio Representation
par: Chen, Yuxuan, et autres
Publié: (2026)
par: Chen, Yuxuan, et autres
Publié: (2026)
Cross-Cultural Bias in Mel-Scale Representations: Evidence and Alternatives from Speech and Music
par: Chauhan, Shivam, et autres
Publié: (2026)
par: Chauhan, Shivam, et autres
Publié: (2026)
Towards Lightweight and Stable Zero-shot TTS with Self-distilled Representation Disentanglement
par: Chen, Qianniu, et autres
Publié: (2025)
par: Chen, Qianniu, et autres
Publié: (2025)
Speech-Forensics: Towards Comprehensive Synthetic Speech Dataset Establishment and Analysis
par: Ji, Zhoulin, et autres
Publié: (2024)
par: Ji, Zhoulin, et autres
Publié: (2024)
Improving Anomalous Sound Detection with Attribute-aware Representation from Domain-adaptive Pre-training
par: Fang, Xin, et autres
Publié: (2025)
par: Fang, Xin, et autres
Publié: (2025)
A Toolkit for Detecting Spurious Correlations in Speech Datasets
par: Gauder, Lara, et autres
Publié: (2026)
par: Gauder, Lara, et autres
Publié: (2026)
AudioMoG: Guiding Audio Generation with Mixture-of-Guidance
par: Wang, Junyou, et autres
Publié: (2025)
par: Wang, Junyou, et autres
Publié: (2025)
DAStatFormer: A Hybrid Multibranch Transformer with Statistical Feature Integration for DAS-Based Pattern Recognitions
par: Dione, Michel, et autres
Publié: (2026)
par: Dione, Michel, et autres
Publié: (2026)
YMIR: A new Benchmark Dataset and Model for Arabic Yemeni Music Genre Classification Using Convolutional Neural Networks
par: AL-Makhlafi, Moeen, et autres
Publié: (2026)
par: AL-Makhlafi, Moeen, et autres
Publié: (2026)
Layer-wise Investigation of Large-Scale Self-Supervised Music Representation Models
par: Zhou, Yizhi, et autres
Publié: (2025)
par: Zhou, Yizhi, et autres
Publié: (2025)
AnalysisGNN: Unified Music Analysis with Graph Neural Networks
par: Karystinaios, Emmanouil, et autres
Publié: (2025)
par: Karystinaios, Emmanouil, et autres
Publié: (2025)
Documents similaires
-
AutoSchA: Automatic Hierarchical Music Representations via Multi-Relational Node Isolation
par: Ni-Hahn, Stephen, et autres
Publié: (2025) -
ProGress: Structured Music Generation via Graph Diffusion and Hierarchical Music Analysis
par: Ni-Hahn, Stephen, et autres
Publié: (2025) -
YNote: A Novel Music Notation for Fine-Tuning LLMs in Music Generation
par: Lu, Shao-Chien, et autres
Publié: (2025) -
ONOTE: Benchmarking Omnimodal Notation Processing for Expert-level Music Intelligence
par: Ma, Menghe, et autres
Publié: (2026) -
Via Score to Performance: Efficient Human-Controllable Long Song Generation with Bar-Level Symbolic Notation
par: Wang, Tongxi, et autres
Publié: (2025)