Self-supervised restoration of singing voice degraded by pitch shifting using shallow diffusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Yunyi, Akama, Taketo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Interpretable and Perceptually-Aligned Music Similarity with Pretrained Embeddings
di: Vohra, Arhan, et al.
Pubblicazione: (2026)
di: Vohra, Arhan, et al.
Pubblicazione: (2026)
Annotation-Free MIDI-to-Audio Synthesis via Concatenative Synthesis and Generative Refinement
di: Take, Osamu, et al.
Pubblicazione: (2024)
di: Take, Osamu, et al.
Pubblicazione: (2024)
HyperGANStrument: Instrument Sound Synthesis and Editing with Pitch-Invariant Hypernetworks
di: Zhang, Zhe, et al.
Pubblicazione: (2024)
di: Zhang, Zhe, et al.
Pubblicazione: (2024)
A Computational Analysis of Lyric Similarity Perception
di: Kim, Haven, et al.
Pubblicazione: (2024)
di: Kim, Haven, et al.
Pubblicazione: (2024)
Annotation-free Automatic Music Transcription with Scalable Synthetic Data and Adversarial Domain Confusion
di: Sato, Gakusei, et al.
Pubblicazione: (2023)
di: Sato, Gakusei, et al.
Pubblicazione: (2023)
A Preliminary Investigation on Flexible Singing Voice Synthesis Through Decomposed Framework with Inferrable Features
di: Violeta, Lester Phillip, et al.
Pubblicazione: (2024)
di: Violeta, Lester Phillip, et al.
Pubblicazione: (2024)
Towards Realistic Synthetic Data for Automatic Drum Transcription
di: Melucci, Pierfrancesco, et al.
Pubblicazione: (2026)
di: Melucci, Pierfrancesco, et al.
Pubblicazione: (2026)
Music Proofreading with RefinPaint: Where and How to Modify Compositions given Context
di: Ramoneda, Pedro, et al.
Pubblicazione: (2024)
di: Ramoneda, Pedro, et al.
Pubblicazione: (2024)
Resource-constrained stereo singing voice cancellation
di: Borrelli, Clara, et al.
Pubblicazione: (2024)
di: Borrelli, Clara, et al.
Pubblicazione: (2024)
DNN-based ensemble singing voice synthesis with interactions between singers
di: Hyodo, Hiroaki, et al.
Pubblicazione: (2024)
di: Hyodo, Hiroaki, et al.
Pubblicazione: (2024)
PF-D2M: A Pose-free Diffusion Model for Universal Dance-to-Music Generation
di: Im, Jaekwon, et al.
Pubblicazione: (2026)
di: Im, Jaekwon, et al.
Pubblicazione: (2026)
Accurate analysis of the pitch pulse-based magnitude/phase structure of natural vowels and assessment of three lightweight time/frequency voicing restoration methods
di: Ferreira, Aníbal J. S., et al.
Pubblicazione: (2025)
di: Ferreira, Aníbal J. S., et al.
Pubblicazione: (2025)
Naturalistic Music Decoding from EEG Data via Latent Diffusion Models
di: Postolache, Emilian, et al.
Pubblicazione: (2024)
di: Postolache, Emilian, et al.
Pubblicazione: (2024)
Decoding Selective Auditory Attention to Musical Elements in Ecologically Valid Music Listening
di: Akama, Taketo, et al.
Pubblicazione: (2025)
di: Akama, Taketo, et al.
Pubblicazione: (2025)
Interactive singing melody extraction based on active adaptation
di: Saxena, Kavya Ranjan, et al.
Pubblicazione: (2024)
di: Saxena, Kavya Ranjan, et al.
Pubblicazione: (2024)
voice2mode: Phonation Mode Classification in Singing using Self-Supervised Speech Models
di: Justus, Aju Ani, et al.
Pubblicazione: (2026)
di: Justus, Aju Ani, et al.
Pubblicazione: (2026)
Predicting Artificial Neural Network Representations to Learn Recognition Model for Music Identification from Brain Recordings
di: Akama, Taketo, et al.
Pubblicazione: (2024)
di: Akama, Taketo, et al.
Pubblicazione: (2024)
ICGAN: An implicit conditioning method for interpretable feature control of neural audio synthesis
di: Liu, Yunyi, et al.
Pubblicazione: (2024)
di: Liu, Yunyi, et al.
Pubblicazione: (2024)
Simi-SFX: A similarity-based conditioning method for controllable sound effect synthesis
di: Liu, Yunyi, et al.
Pubblicazione: (2024)
di: Liu, Yunyi, et al.
Pubblicazione: (2024)
Methods for pitch analysis in contemporary popular music: highlighting pitch uncertainty in Primaal's commercial works
di: Deruty, Emmanuel, et al.
Pubblicazione: (2025)
di: Deruty, Emmanuel, et al.
Pubblicazione: (2025)
Methods for pitch analysis in contemporary popular music: multiple pitches from harmonic tones in Vitalic's music
di: Deruty, Emmanuel, et al.
Pubblicazione: (2025)
di: Deruty, Emmanuel, et al.
Pubblicazione: (2025)
GVPT -- A software for guided visual pitch tracking
di: Cho, Hyunjin, et al.
Pubblicazione: (2025)
di: Cho, Hyunjin, et al.
Pubblicazione: (2025)
Optimized Self-supervised Training with BEST-RQ for Speech Recognition
di: Baumann, Ilja, et al.
Pubblicazione: (2025)
di: Baumann, Ilja, et al.
Pubblicazione: (2025)
Multi-Class-Token Transformer for Multitask Self-supervised Music Information Retrieval
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
A comparative study of generative models for child voice conversion
di: Sudro, Protima Nomo, et al.
Pubblicazione: (2025)
di: Sudro, Protima Nomo, et al.
Pubblicazione: (2025)
STONE: Self-supervised Tonality Estimator
di: Kong, Yuexuan, et al.
Pubblicazione: (2024)
di: Kong, Yuexuan, et al.
Pubblicazione: (2024)
Gender-ambiguous voice generation through feminine speaking style transfer in male voices
di: Koutsogiannaki, Maria, et al.
Pubblicazione: (2024)
di: Koutsogiannaki, Maria, et al.
Pubblicazione: (2024)
ARIONet: An Advanced Self-supervised Contrastive Representation Network for Birdsong Classification and Future Frame Prediction
di: Rahman, Md. Abdur, et al.
Pubblicazione: (2025)
di: Rahman, Md. Abdur, et al.
Pubblicazione: (2025)
Deepfake Audio Detection Using Self-supervised Fusion Representations
di: Zaman, Khalid, et al.
Pubblicazione: (2026)
di: Zaman, Khalid, et al.
Pubblicazione: (2026)
Self-supervised learning method using multiple sampling strategies for general-purpose audio representation
di: Kuroyanagi, Ibuki, et al.
Pubblicazione: (2025)
di: Kuroyanagi, Ibuki, et al.
Pubblicazione: (2025)
Text2Move: Text-to-moving sound generation via trajectory prediction and temporal alignment
di: Liu, Yunyi, et al.
Pubblicazione: (2025)
di: Liu, Yunyi, et al.
Pubblicazione: (2025)
PESTO: Pitch Estimation with Self-supervised Transposition-equivariant Objective
di: Riou, Alain, et al.
Pubblicazione: (2023)
di: Riou, Alain, et al.
Pubblicazione: (2023)
Probing Self-supervised Learning Models with Target Speech Extraction
di: Peng, Junyi, et al.
Pubblicazione: (2024)
di: Peng, Junyi, et al.
Pubblicazione: (2024)
Lightweight and perceptually-guided voice conversion for electro-laryngeal speech
di: Mayrhofer, Benedikt, et al.
Pubblicazione: (2026)
di: Mayrhofer, Benedikt, et al.
Pubblicazione: (2026)
More than words: Advancements and challenges in speech recognition for singing
di: Kruspe, Anna
Pubblicazione: (2024)
di: Kruspe, Anna
Pubblicazione: (2024)
Self-supervised Reflective Learning through Self-distillation and Online Clustering for Speaker Representation Learning
di: Cai, Danwei, et al.
Pubblicazione: (2024)
di: Cai, Danwei, et al.
Pubblicazione: (2024)
MSR-HuBERT: Self-supervised Pre-training for Adaptation to Multiple Sampling Rates
di: Huang, Zikang, et al.
Pubblicazione: (2026)
di: Huang, Zikang, et al.
Pubblicazione: (2026)
S-KEY: Self-supervised Learning of Major and Minor Keys from Audio
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
Target Speech Extraction with Pre-trained Self-supervised Learning Models
di: Peng, Junyi, et al.
Pubblicazione: (2024)
di: Peng, Junyi, et al.
Pubblicazione: (2024)
SCDNet: Self-supervised Learning Feature-based Speaker Change Detection
di: Li, Yue, et al.
Pubblicazione: (2024)
di: Li, Yue, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Interpretable and Perceptually-Aligned Music Similarity with Pretrained Embeddings
di: Vohra, Arhan, et al.
Pubblicazione: (2026) -
Annotation-Free MIDI-to-Audio Synthesis via Concatenative Synthesis and Generative Refinement
di: Take, Osamu, et al.
Pubblicazione: (2024) -
HyperGANStrument: Instrument Sound Synthesis and Editing with Pitch-Invariant Hypernetworks
di: Zhang, Zhe, et al.
Pubblicazione: (2024) -
A Computational Analysis of Lyric Similarity Perception
di: Kim, Haven, et al.
Pubblicazione: (2024) -
Annotation-free Automatic Music Transcription with Scalable Synthetic Data and Adversarial Domain Confusion
di: Sato, Gakusei, et al.
Pubblicazione: (2023)