Multi-Stage Music Source Restoration with BandSplit-RoFormer Separation and HiFi++ GAN
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Morocutti, Tobias, Karystinaios, Emmanouil, Greif, Jonathan, Widmer, Gerhard |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mel-RoFormer for Vocal Separation and Vocal Melody Transcription
par: Wang, Ju-Chiang, et autres
Publié: (2024)
par: Wang, Ju-Chiang, et autres
Publié: (2024)
SMUG-Explain: A Framework for Symbolic Music Graph Explanations
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
Improving Audio Spectrogram Transformers for Sound Event Detection Through Multi-Stage Training
par: Schmid, Florian, et autres
Publié: (2024)
par: Schmid, Florian, et autres
Publié: (2024)
GraphMuse: A Library for Symbolic Music Graph Processing
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
On Temporal Guidance and Iterative Refinement in Audio Source Separation
par: Morocutti, Tobias, et autres
Publié: (2025)
par: Morocutti, Tobias, et autres
Publié: (2025)
WeaveMuse: An Open Agentic System for Multimodal Music Understanding and Generation
par: Karystinaios, Emmanouil
Publié: (2025)
par: Karystinaios, Emmanouil
Publié: (2025)
Language Models for Music Medicine Generation
par: Nikolakakis, Emmanouil, et autres
Publié: (2024)
par: Nikolakakis, Emmanouil, et autres
Publié: (2024)
Perception-Inspired Graph Convolution for Music Understanding Tasks
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
Exploring Performance-Complexity Trade-Offs in Sound Event Detection Models
par: Morocutti, Tobias, et autres
Publié: (2025)
par: Morocutti, Tobias, et autres
Publié: (2025)
DTT-BSR: GAN-based DTTNet with RoPE Transformer Enhancement for Music Source Restoration
par: Tan, Shihong, et autres
Publié: (2026)
par: Tan, Shihong, et autres
Publié: (2026)
HiFi-Glot: High-Fidelity Neural Formant Synthesis with Differentiable Resonant Filters
par: Gu, Yicheng, et autres
Publié: (2024)
par: Gu, Yicheng, et autres
Publié: (2024)
Sounding Out Reconstruction Error-Based Evaluation of Generative Models of Expressive Performance
par: Peter, Silvan David, et autres
Publié: (2023)
par: Peter, Silvan David, et autres
Publié: (2023)
A Two-Stage Band-Split Mamba-2 Network For Music Separation
par: Bai, Jinglin, et autres
Publié: (2024)
par: Bai, Jinglin, et autres
Publié: (2024)
HiFi-Stream: Streaming Speech Enhancement with Generative Adversarial Networks
par: Dmitrieva, Ekaterina, et autres
Publié: (2025)
par: Dmitrieva, Ekaterina, et autres
Publié: (2025)
Spectrogram Patch Codec: A 2D Block-Quantized VQ-VAE and HiFi-GAN for Neural Speech Coding
par: Chary, Luis Felipe, et autres
Publié: (2025)
par: Chary, Luis Felipe, et autres
Publié: (2025)
HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution
par: Zhao, Shengkui, et autres
Publié: (2025)
par: Zhao, Shengkui, et autres
Publié: (2025)
Creating a Good Teacher for Knowledge Distillation in Acoustic Scene Classification
par: Morocutti, Tobias, et autres
Publié: (2025)
par: Morocutti, Tobias, et autres
Publié: (2025)
Effective Pre-Training of Audio Transformers for Sound Event Detection
par: Schmid, Florian, et autres
Publié: (2024)
par: Schmid, Florian, et autres
Publié: (2024)
Multi-Iteration Multi-Stage Fine-Tuning of Transformers for Sound Event Detection with Heterogeneous Datasets
par: Schmid, Florian, et autres
Publié: (2024)
par: Schmid, Florian, et autres
Publié: (2024)
Device-Robust Acoustic Scene Classification via Impulse Response Augmentation
par: Morocutti, Tobias, et autres
Publié: (2023)
par: Morocutti, Tobias, et autres
Publié: (2023)
Moises-Light: Resource-efficient Band-split U-Net For Music Source Separation
par: Yun-Ning, et autres
Publié: (2025)
par: Yun-Ning, et autres
Publié: (2025)
Music Source Restoration with Ensemble Separation and Targeted Reconstruction
par: Deng, Xinlong, et autres
Publié: (2026)
par: Deng, Xinlong, et autres
Publié: (2026)
MusicHiFi: Fast High-Fidelity Stereo Vocoding
par: Zhu, Ge, et autres
Publié: (2024)
par: Zhu, Ge, et autres
Publié: (2024)
Improving Music Source Separation with Diffusion and Consistency Refinement
par: Karchkhadze, Tornike, et autres
Publié: (2024)
par: Karchkhadze, Tornike, et autres
Publié: (2024)
ACMID: Automatic Curation of Musical Instrument Dataset for 7-Stem Music Source Separation
par: Yu, Ji, et autres
Publié: (2025)
par: Yu, Ji, et autres
Publié: (2025)
Exploiting Music Source Separation for Automatic Lyrics Transcription with Whisper
par: Syed, Jaza, et autres
Publié: (2025)
par: Syed, Jaza, et autres
Publié: (2025)
Towards Musically Informed Evaluation of Piano Transcription Models
par: Hu, Patricia, et autres
Publié: (2024)
par: Hu, Patricia, et autres
Publié: (2024)
Expressivity-aware Music Performance Retrieval using Mid-level Perceptual Features and Emotion Word Embeddings
par: Chowdhury, Shreyan, et autres
Publié: (2024)
par: Chowdhury, Shreyan, et autres
Publié: (2024)
Embedding-Based Intrusive Evaluation Metrics for Musical Source Separation Using MERT Representations
par: Bereuter, Paul A., et autres
Publié: (2026)
par: Bereuter, Paul A., et autres
Publié: (2026)
Music Similarity Representation Learning Focusing on Individual Instruments with Source Separation and Human Preference
par: Imamura, Takehiro, et autres
Publié: (2025)
par: Imamura, Takehiro, et autres
Publié: (2025)
Musical Source Separation of Brazilian Percussion
par: Namballa, Richa, et autres
Publié: (2025)
par: Namballa, Richa, et autres
Publié: (2025)
Source Separation & Automatic Transcription for Music
par: Derby, Bradford, et autres
Publié: (2024)
par: Derby, Bradford, et autres
Publié: (2024)
Summary of The Inaugural Music Source Restoration Challenge
par: Zang, Yongyi, et autres
Publié: (2026)
par: Zang, Yongyi, et autres
Publié: (2026)
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
par: Sawata, Ryosuke, et autres
Publié: (2023)
par: Sawata, Ryosuke, et autres
Publié: (2023)
Music Boomerang: Reusing Diffusion Models for Data Augmentation and Audio Manipulation
par: Fichtinger, Alexander, et autres
Publié: (2025)
par: Fichtinger, Alexander, et autres
Publié: (2025)
Cluster and Separate: a GNN Approach to Voice and Staff Prediction for Score Engraving
par: Foscarin, Francesco, et autres
Publié: (2024)
par: Foscarin, Francesco, et autres
Publié: (2024)
Are Inherently Interpretable Models More Robust? A Study In Music Emotion Recognition
par: Hoedt, Katharina, et autres
Publié: (2025)
par: Hoedt, Katharina, et autres
Publié: (2025)
Music Source Restoration
par: Zang, Yongyi, et autres
Publié: (2025)
par: Zang, Yongyi, et autres
Publié: (2025)
Estimating Musical Surprisal in Audio
par: Bjare, Mathias Rose, et autres
Publié: (2025)
par: Bjare, Mathias Rose, et autres
Publié: (2025)
Quantifying the Corpus Bias Problem in Automatic Music Transcription Systems
par: Marták, Lukáš Samuel, et autres
Publié: (2024)
par: Marták, Lukáš Samuel, et autres
Publié: (2024)
Documents similaires
-
Mel-RoFormer for Vocal Separation and Vocal Melody Transcription
par: Wang, Ju-Chiang, et autres
Publié: (2024) -
SMUG-Explain: A Framework for Symbolic Music Graph Explanations
par: Karystinaios, Emmanouil, et autres
Publié: (2024) -
Improving Audio Spectrogram Transformers for Sound Event Detection Through Multi-Stage Training
par: Schmid, Florian, et autres
Publié: (2024) -
GraphMuse: A Library for Symbolic Music Graph Processing
par: Karystinaios, Emmanouil, et autres
Publié: (2024) -
On Temporal Guidance and Iterative Refinement in Audio Source Separation
par: Morocutti, Tobias, et autres
Publié: (2025)