BERT-APC: A Reference-free Framework for Automatic Pitch Correction via Musical Context Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Sungjae, Na, Kihyun, Choi, Jinyoung, Kim, Injung |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MuSE-SVS: Multi-Singer Emotional Singing Voice Synthesizer that Controls Emotional Intensity
par: Kim, Sungjae, et autres
Publié: (2022)
par: Kim, Sungjae, et autres
Publié: (2022)
MMT-BERT: Chord-aware Symbolic Music Generation Based on Multitrack Music Transformer and MusicBERT
par: Zhu, Jinlong, et autres
Publié: (2024)
par: Zhu, Jinlong, et autres
Publié: (2024)
HuBERT-VIC: Improving Noise-Robust Automatic Speech Recognition of Speech Foundation Model via Variance-Invariance-Covariance Regularization
par: Ahn, Hyebin, et autres
Publié: (2025)
par: Ahn, Hyebin, et autres
Publié: (2025)
MAJL: A Model-Agnostic Joint Learning Framework for Music Source Separation and Pitch Estimation
par: Wei, Haojie, et autres
Publié: (2025)
par: Wei, Haojie, et autres
Publié: (2025)
Segment Transformer: AI-Generated Music Detection via Music Structural Analysis
par: Kim, Yumin, et autres
Publié: (2025)
par: Kim, Yumin, et autres
Publié: (2025)
Annotation-free Automatic Music Transcription with Scalable Synthetic Data and Adversarial Domain Confusion
par: Sato, Gakusei, et autres
Publié: (2023)
par: Sato, Gakusei, et autres
Publié: (2023)
MMVA: Multimodal Matching Based on Valence and Arousal across Images, Music, and Musical Captions
par: Choi, Suhwan, et autres
Publié: (2025)
par: Choi, Suhwan, et autres
Publié: (2025)
Source Separation & Automatic Transcription for Music
par: Derby, Bradford, et autres
Publié: (2024)
par: Derby, Bradford, et autres
Publié: (2024)
Chatterbox-Flash: Prior-Calibrated Block Diffusion for Streaming Zero-Shot TTS
par: Seo, Deokjin, et autres
Publié: (2026)
par: Seo, Deokjin, et autres
Publié: (2026)
DisMix: Disentangling Mixtures of Musical Instruments for Source-level Pitch and Timbre Manipulation
par: Luo, Yin-Jyun, et autres
Publié: (2024)
par: Luo, Yin-Jyun, et autres
Publié: (2024)
Audio Prompt Adapter: Unleashing Music Editing Abilities for Text-to-Music with Lightweight Finetuning
par: Tsai, Fang-Duo, et autres
Publié: (2024)
par: Tsai, Fang-Duo, et autres
Publié: (2024)
ShrutiSense: Microtonal Modeling and Correction in Indian Classical Music
par: Ghosh, Rajarshi, et autres
Publié: (2025)
par: Ghosh, Rajarshi, et autres
Publié: (2025)
Dialogue in Resonance: An Interactive Music Piece for Piano and Real-Time Automatic Transcription System
par: Bang, Hayeon, et autres
Publié: (2025)
par: Bang, Hayeon, et autres
Publié: (2025)
AMT-APC: Automatic Piano Cover by Fine-Tuning an Automatic Music Transcription Model
par: Komiya, Kazuma, et autres
Publié: (2024)
par: Komiya, Kazuma, et autres
Publié: (2024)
ZeSTA: Zero-Shot TTS Augmentation with Domain-Conditioned Training for Data-Efficient Personalized Speech Synthesis
par: Choi, Youngwon, et autres
Publié: (2026)
par: Choi, Youngwon, et autres
Publié: (2026)
AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation
par: Go, Gyehun, et autres
Publié: (2025)
par: Go, Gyehun, et autres
Publié: (2025)
SPA-SVC: Self-supervised Pitch Augmentation for Singing Voice Conversion
par: Bai, Bingsong, et autres
Publié: (2024)
par: Bai, Bingsong, et autres
Publié: (2024)
Incremental FastPitch: Chunk-based High Quality Text to Speech
par: Du, Muyang, et autres
Publié: (2024)
par: Du, Muyang, et autres
Publié: (2024)
Mamba2 Meets Silence: Robust Vocal Source Separation for Sparse Regions
par: Kim, Euiyeon, et autres
Publié: (2025)
par: Kim, Euiyeon, et autres
Publié: (2025)
Disambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-trained BERT
par: Dai, Dongyang, et autres
Publié: (2025)
par: Dai, Dongyang, et autres
Publié: (2025)
GEC-RAG: Improving Generative Error Correction via Retrieval-Augmented Generation for Automatic Speech Recognition Systems
par: Robatian, Amin, et autres
Publié: (2025)
par: Robatian, Amin, et autres
Publié: (2025)
Music Proofreading with RefinPaint: Where and How to Modify Compositions given Context
par: Ramoneda, Pedro, et autres
Publié: (2024)
par: Ramoneda, Pedro, et autres
Publié: (2024)
Practical and Reproducible Symbolic Music Generation by Large Language Models with Structural Embeddings
par: Rhyu, Seungyeon, et autres
Publié: (2024)
par: Rhyu, Seungyeon, et autres
Publié: (2024)
Real-Time Pitch/F0 Detection Using Spectrogram Images and Convolutional Neural Networks
par: Zhao, Xufang, et autres
Publié: (2025)
par: Zhao, Xufang, et autres
Publié: (2025)
Six Dragons Fly Again: Reviving 15th-Century Korean Court Music with Transformers and Novel Encoding
par: Han, Danbinaerin, et autres
Publié: (2024)
par: Han, Danbinaerin, et autres
Publié: (2024)
Speech Recognition-based Feature Extraction for Enhanced Automatic Severity Classification in Dysarthric Speech
par: Choi, Yerin, et autres
Publié: (2024)
par: Choi, Yerin, et autres
Publié: (2024)
XMusic: Towards a Generalized and Controllable Symbolic Music Generation Framework
par: Tian, Sida, et autres
Publié: (2025)
par: Tian, Sida, et autres
Publié: (2025)
Genre Controlled Music Generation via Activation Steering
par: Narashiman, Swathi, et autres
Publié: (2025)
par: Narashiman, Swathi, et autres
Publié: (2025)
Wave-U-Mamba: An End-To-End Framework For High-Quality And Efficient Speech Super Resolution
par: Lee, Yongjoon, et autres
Publié: (2024)
par: Lee, Yongjoon, et autres
Publié: (2024)
AISTAT lab system for DCASE2025 Task6: Language-based audio retrieval
par: Kim, Hyun Jun, et autres
Publié: (2025)
par: Kim, Hyun Jun, et autres
Publié: (2025)
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
par: Li, Jiajia, et autres
Publié: (2024)
par: Li, Jiajia, et autres
Publié: (2024)
Tuning Music Education: AI-Powered Personalization in Learning Music
par: Sanganeria, Mayank, et autres
Publié: (2024)
par: Sanganeria, Mayank, et autres
Publié: (2024)
ViolinDiff: Enhancing Expressive Violin Synthesis with Pitch Bend Conditioning
par: Kim, Daewoong, et autres
Publié: (2024)
par: Kim, Daewoong, et autres
Publié: (2024)
MusicFlow: Cascaded Flow Matching for Text Guided Music Generation
par: Prajwal, K R, et autres
Publié: (2024)
par: Prajwal, K R, et autres
Publié: (2024)
Real-world Music Plagiarism Detection With Music Segment Transcription System
par: Go, Seonghyeon
Publié: (2025)
par: Go, Seonghyeon
Publié: (2025)
MuSpike: A Benchmark and Evaluation Framework for Symbolic Music Generation with Spiking Neural Networks
par: Liang, Qian, et autres
Publié: (2025)
par: Liang, Qian, et autres
Publié: (2025)
RGI-Net: 3D Room Geometry Inference from Room Impulse Responses With Hidden First-Order Reflections
par: Yeon, Inmo, et autres
Publié: (2023)
par: Yeon, Inmo, et autres
Publié: (2023)
Music Consistency Models
par: Fei, Zhengcong, et autres
Publié: (2024)
par: Fei, Zhengcong, et autres
Publié: (2024)
YNote: A Novel Music Notation for Fine-Tuning LLMs in Music Generation
par: Lu, Shao-Chien, et autres
Publié: (2025)
par: Lu, Shao-Chien, et autres
Publié: (2025)
MOSA: Music Motion with Semantic Annotation Dataset for Cross-Modal Music Processing
par: Huang, Yu-Fen, et autres
Publié: (2024)
par: Huang, Yu-Fen, et autres
Publié: (2024)
Documents similaires
-
MuSE-SVS: Multi-Singer Emotional Singing Voice Synthesizer that Controls Emotional Intensity
par: Kim, Sungjae, et autres
Publié: (2022) -
MMT-BERT: Chord-aware Symbolic Music Generation Based on Multitrack Music Transformer and MusicBERT
par: Zhu, Jinlong, et autres
Publié: (2024) -
HuBERT-VIC: Improving Noise-Robust Automatic Speech Recognition of Speech Foundation Model via Variance-Invariance-Covariance Regularization
par: Ahn, Hyebin, et autres
Publié: (2025) -
MAJL: A Model-Agnostic Joint Learning Framework for Music Source Separation and Pitch Estimation
par: Wei, Haojie, et autres
Publié: (2025) -
Segment Transformer: AI-Generated Music Detection via Music Structural Analysis
par: Kim, Yumin, et autres
Publié: (2025)