Joint Transcription of Acoustic Guitar Strumming Directions and Chords
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Murgul, Sebastian, Schimper, Johannes, Heizmann, Michael |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring Procedural Data Generation for Automatic Acoustic Guitar Fingerpicking Transcription
par: Murgul, Sebastian, et autres
Publié: (2025)
par: Murgul, Sebastian, et autres
Publié: (2025)
Beat and Downbeat Tracking in Performance MIDI Using an End-to-End Transformer Architecture
par: Murgul, Sebastian, et autres
Publié: (2025)
par: Murgul, Sebastian, et autres
Publié: (2025)
Fretting-Transformer: Encoder-Decoder Model for MIDI to Tablature Transcription
par: Hamberger, Anna, et autres
Publié: (2025)
par: Hamberger, Anna, et autres
Publié: (2025)
Beat-Based Rhythm Quantization of MIDI Performances
par: Wachter, Maximilian, et autres
Publié: (2025)
par: Wachter, Maximilian, et autres
Publié: (2025)
Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations
par: Murgul, Sebastian, et autres
Publié: (2025)
par: Murgul, Sebastian, et autres
Publié: (2025)
Transformer-Based Rhythm Quantization of Performance MIDI Using Beat Annotations
par: Wachter, Maximilian, et autres
Publié: (2026)
par: Wachter, Maximilian, et autres
Publié: (2026)
Guitar-TECHS: An Electric Guitar Dataset Covering Techniques, Musical Excerpts, Chords and Scales Using a Diverse Array of Hardware
par: Pedroza, Hegel, et autres
Publié: (2025)
par: Pedroza, Hegel, et autres
Publié: (2025)
Leveraging Real Electric Guitar Tones and Effects to Improve Robustness in Guitar Tablature Transcription Modeling
par: Pedroza, Hegel, et autres
Publié: (2024)
par: Pedroza, Hegel, et autres
Publié: (2024)
Acoustically Precise Hesitation Tagging Is Essential for End-to-End Verbatim Transcription Systems
par: Lin, Jhen-Ke, et autres
Publié: (2025)
par: Lin, Jhen-Ke, et autres
Publié: (2025)
Production and Manufacturing of 3D Printed Acoustic Guitars
par: Tran, Timothy, et autres
Publié: (2025)
par: Tran, Timothy, et autres
Publié: (2025)
GAPS: A Large and Diverse Classical Guitar Dataset and Benchmark Transcription Model
par: Riley, Xavier, et autres
Publié: (2024)
par: Riley, Xavier, et autres
Publié: (2024)
CALM: Joint Contextual Acoustic-Linguistic Modeling for Personalization of Multi-Speaker ASR
par: Shakeel, Muhammad, et autres
Publié: (2026)
par: Shakeel, Muhammad, et autres
Publié: (2026)
Towards Generalizability to Tone and Content Variations in the Transcription of Amplifier Rendered Electric Guitar Audio
par: Chen, Yu-Hua, et autres
Publié: (2025)
par: Chen, Yu-Hua, et autres
Publié: (2025)
audio2chart: End to End Audio Transcription into playable Guitar Hero charts
par: Tripodi, Riccardo
Publié: (2025)
par: Tripodi, Riccardo
Publié: (2025)
DDSP Guitar Amp: Interpretable Guitar Amplifier Modeling
par: Yeh, Yen-Tung, et autres
Publié: (2024)
par: Yeh, Yen-Tung, et autres
Publié: (2024)
Infusing Acoustic Pause Context into Text-Based Dementia Assessment
par: Braun, Franziska, et autres
Publié: (2024)
par: Braun, Franziska, et autres
Publié: (2024)
High Resolution Guitar Transcription via Domain Adaptation
par: Riley, Xavier, et autres
Publié: (2024)
par: Riley, Xavier, et autres
Publié: (2024)
WHISTRESS: Enriching Transcriptions with Sentence Stress Detection
par: Yosha, Iddo, et autres
Publié: (2025)
par: Yosha, Iddo, et autres
Publié: (2025)
Fotheidil: an Automatic Transcription System for the Irish Language
par: Lonergan, Liam, et autres
Publié: (2024)
par: Lonergan, Liam, et autres
Publié: (2024)
Transcript-Prompted Whisper with Dictionary-Enhanced Decoding for Japanese Speech Annotation
par: Hu, Rui, et autres
Publié: (2025)
par: Hu, Rui, et autres
Publié: (2025)
Mind the Gap: Entity-Preserved Context-Aware ASR Structured Transcriptions
par: Altinok, Duygu
Publié: (2025)
par: Altinok, Duygu
Publié: (2025)
Towards Building an End-to-End Multilingual Automatic Lyrics Transcription Model
par: Huang, Jiawen, et autres
Publié: (2024)
par: Huang, Jiawen, et autres
Publié: (2024)
Revisiting Acoustic Features for Robust ASR
par: Shah, Muhammad A., et autres
Publié: (2024)
par: Shah, Muhammad A., et autres
Publié: (2024)
The Sound of Healthcare: Improving Medical Transcription ASR Accuracy with Large Language Models
par: Adedeji, Ayo, et autres
Publié: (2024)
par: Adedeji, Ayo, et autres
Publié: (2024)
A Theoretical Framework for Acoustic Neighbor Embeddings
par: Jeon, Woojay
Publié: (2024)
par: Jeon, Woojay
Publié: (2024)
Exploring the Benefits of Tokenization of Discrete Acoustic Units
par: Dekel, Avihu, et autres
Publié: (2024)
par: Dekel, Avihu, et autres
Publié: (2024)
Guitar Pickups I: Analysis of the Effect of Winding and Wire Gauge on Single Coil Electric Guitar Pickups
par: Batchelor, Charles, et autres
Publié: (2024)
par: Batchelor, Charles, et autres
Publié: (2024)
LyricWhiz: Robust Multilingual Zero-shot Lyrics Transcription by Whispering to ChatGPT
par: Zhuo, Le, et autres
Publié: (2023)
par: Zhuo, Le, et autres
Publié: (2023)
Exploring Spoken Language Identification Strategies for Automatic Transcription of Multilingual Broadcast and Institutional Speech
par: Valente, Martina, et autres
Publié: (2024)
par: Valente, Martina, et autres
Publié: (2024)
K-Function: Joint Pronunciation Transcription and Feedback for Evaluating Kids Language Function
par: Li, Shuhe, et autres
Publié: (2025)
par: Li, Shuhe, et autres
Publié: (2025)
Salmon: A Suite for Acoustic Language Model Evaluation
par: Maimon, Gallil, et autres
Publié: (2024)
par: Maimon, Gallil, et autres
Publié: (2024)
Breaking the Transcription Bottleneck: Fine-tuning ASR Models for Extremely Low-Resource Fieldwork Languages
par: Liang, Siyu, et autres
Publié: (2025)
par: Liang, Siyu, et autres
Publié: (2025)
Universal Acoustic Adversarial Attacks for Flexible Control of Speech-LLMs
par: Ma, Rao, et autres
Publié: (2025)
par: Ma, Rao, et autres
Publié: (2025)
Solla: Towards a Speech-Oriented LLM That Hears Acoustic Context
par: Ao, Junyi, et autres
Publié: (2025)
par: Ao, Junyi, et autres
Publié: (2025)
Acoustic Model Optimization over Multiple Data Sources: Merging and Valuation
par: Wei, Victor Junqiu, et autres
Publié: (2024)
par: Wei, Victor Junqiu, et autres
Publié: (2024)
From Weak Labels to Strong Results: Utilizing 5,000 Hours of Noisy Classroom Transcripts with Minimal Accurate Data
par: Attia, Ahmed Adel, et autres
Publié: (2025)
par: Attia, Ahmed Adel, et autres
Publié: (2025)
Voice Conversion for Lombard Speaking Style with Implicit and Explicit Acoustic Feature Conditioning
par: Woszczyk, Dominika, et autres
Publié: (2025)
par: Woszczyk, Dominika, et autres
Publié: (2025)
R-Spin: Efficient Speaker and Noise-invariant Representation Learning with Acoustic Pieces
par: Chang, Heng-Jui, et autres
Publié: (2023)
par: Chang, Heng-Jui, et autres
Publié: (2023)
Muting Whisper: A Universal Acoustic Adversarial Attack on Speech Foundation Models
par: Raina, Vyas, et autres
Publié: (2024)
par: Raina, Vyas, et autres
Publié: (2024)
Controlling Whisper: Universal Acoustic Adversarial Attacks to Control Speech Foundation Models
par: Raina, Vyas, et autres
Publié: (2024)
par: Raina, Vyas, et autres
Publié: (2024)
Documents similaires
-
Exploring Procedural Data Generation for Automatic Acoustic Guitar Fingerpicking Transcription
par: Murgul, Sebastian, et autres
Publié: (2025) -
Beat and Downbeat Tracking in Performance MIDI Using an End-to-End Transformer Architecture
par: Murgul, Sebastian, et autres
Publié: (2025) -
Fretting-Transformer: Encoder-Decoder Model for MIDI to Tablature Transcription
par: Hamberger, Anna, et autres
Publié: (2025) -
Beat-Based Rhythm Quantization of MIDI Performances
par: Wachter, Maximilian, et autres
Publié: (2025) -
Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations
par: Murgul, Sebastian, et autres
Publié: (2025)