Singer Identity Representation Learning using Self-Supervised Techniques
Fuente:
arXiv
Salvato in:
| Autori principali: | Torres, Bernardo, Lattner, Stefan, Richard, Gaël |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PESTO: Real-Time Pitch Estimation with Self-supervised Transposition-equivariant Objective
di: Riou, Alain, et al.
Pubblicazione: (2025)
di: Riou, Alain, et al.
Pubblicazione: (2025)
Translation-Equivariant Self-Supervised Learning for Pitch Estimation with Optimal Transport
di: Torres, Bernardo, et al.
Pubblicazione: (2025)
di: Torres, Bernardo, et al.
Pubblicazione: (2025)
Bass Accompaniment Generation via Latent Diffusion
di: Pasini, Marco, et al.
Pubblicazione: (2024)
di: Pasini, Marco, et al.
Pubblicazione: (2024)
Music2Latent: Consistency Autoencoders for Latent Audio Compression
di: Pasini, Marco, et al.
Pubblicazione: (2024)
di: Pasini, Marco, et al.
Pubblicazione: (2024)
The Inverse Drum Machine: Source Separation Through Joint Transcription and Analysis-by-Synthesis
di: Torres, Bernardo, et al.
Pubblicazione: (2025)
di: Torres, Bernardo, et al.
Pubblicazione: (2025)
Unsupervised Harmonic Parameter Estimation Using Differentiable DSP and Spectral Optimal Transport
di: Torres, Bernardo, et al.
Pubblicazione: (2023)
di: Torres, Bernardo, et al.
Pubblicazione: (2023)
CoDiCodec: Unifying Continuous and Discrete Compressed Representations of Audio
di: Pasini, Marco, et al.
Pubblicazione: (2025)
di: Pasini, Marco, et al.
Pubblicazione: (2025)
Investigating Design Choices in Joint-Embedding Predictive Architectures for General Audio Representation Learning
di: Riou, Alain, et al.
Pubblicazione: (2024)
di: Riou, Alain, et al.
Pubblicazione: (2024)
Stem-JEPA: A Joint-Embedding Predictive Architecture for Musical Stem Compatibility Estimation
di: Riou, Alain, et al.
Pubblicazione: (2024)
di: Riou, Alain, et al.
Pubblicazione: (2024)
The Effect of Batch Size on Contrastive Self-Supervised Speech Representation Learning
di: Vaessen, Nik, et al.
Pubblicazione: (2024)
di: Vaessen, Nik, et al.
Pubblicazione: (2024)
Assessing the Alignment of Audio Representations with Timbre Similarity Ratings
di: Tian, Haokun, et al.
Pubblicazione: (2025)
di: Tian, Haokun, et al.
Pubblicazione: (2025)
Additive Margin in Contrastive Self-Supervised Frameworks to Learn Discriminative Speaker Representations
di: Lepage, Theo, et al.
Pubblicazione: (2024)
di: Lepage, Theo, et al.
Pubblicazione: (2024)
MT-SLVR: Multi-Task Self-Supervised Learning for Transformation In(Variant) Representations
di: Heggan, Calum, et al.
Pubblicazione: (2023)
di: Heggan, Calum, et al.
Pubblicazione: (2023)
Understanding Self-Supervised Learning of Speech Representation via Invariance and Redundancy Reduction
di: Brima, Yusuf, et al.
Pubblicazione: (2023)
di: Brima, Yusuf, et al.
Pubblicazione: (2023)
Music2Latent2: Audio Compression with Summary Embeddings and Autoregressive Decoding
di: Pasini, Marco, et al.
Pubblicazione: (2025)
di: Pasini, Marco, et al.
Pubblicazione: (2025)
Hybrid Losses for Hierarchical Embedding Learning
di: Tian, Haokun, et al.
Pubblicazione: (2025)
di: Tian, Haokun, et al.
Pubblicazione: (2025)
BiSinger: Bilingual Singing Voice Synthesis
di: Zhou, Huali, et al.
Pubblicazione: (2023)
di: Zhou, Huali, et al.
Pubblicazione: (2023)
Multiple Choice Learning for Efficient Speech Separation with Many Speakers
di: Perera, David, et al.
Pubblicazione: (2024)
di: Perera, David, et al.
Pubblicazione: (2024)
Singing Voice Conversion with Accompaniment Using Self-Supervised Representation-Based Melody Features
di: Chen, Wei, et al.
Pubblicazione: (2025)
di: Chen, Wei, et al.
Pubblicazione: (2025)
PESTO: Pitch Estimation with Self-supervised Transposition-equivariant Objective
di: Riou, Alain, et al.
Pubblicazione: (2023)
di: Riou, Alain, et al.
Pubblicazione: (2023)
Continuous Autoregressive Models with Noise Augmentation Avoid Error Accumulation
di: Pasini, Marco, et al.
Pubblicazione: (2024)
di: Pasini, Marco, et al.
Pubblicazione: (2024)
ConSinger: Efficient High-Fidelity Singing Voice Generation with Minimal Steps
di: Song, Yulin, et al.
Pubblicazione: (2024)
di: Song, Yulin, et al.
Pubblicazione: (2024)
Improving the Adversarial Robustness for Speaker Verification by Self-Supervised Learning
di: Wu, Haibin, et al.
Pubblicazione: (2021)
di: Wu, Haibin, et al.
Pubblicazione: (2021)
Self-Supervised Learning for Speaker Recognition: A study and review
di: Lepage, Theo, et al.
Pubblicazione: (2026)
di: Lepage, Theo, et al.
Pubblicazione: (2026)
Self-Supervised Learning for Few-Shot Bird Sound Classification
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
Low-Resource Cross-Domain Singing Voice Synthesis via Reduced Self-Supervised Speech Representations
di: Kakoulidis, Panos, et al.
Pubblicazione: (2024)
di: Kakoulidis, Panos, et al.
Pubblicazione: (2024)
Towards Supervised Performance on Speaker Verification with Self-Supervised Learning by Leveraging Large-Scale ASR Models
di: Miara, Victor, et al.
Pubblicazione: (2024)
di: Miara, Victor, et al.
Pubblicazione: (2024)
Losses Can Be Blessings: Routing Self-Supervised Speech Representations Towards Efficient Multilingual and Multitask Speech Processing
di: Fu, Yonggan, et al.
Pubblicazione: (2022)
di: Fu, Yonggan, et al.
Pubblicazione: (2022)
Label-Efficient Self-Supervised Speaker Verification With Information Maximization and Contrastive Learning
di: Lepage, Théo, et al.
Pubblicazione: (2022)
di: Lepage, Théo, et al.
Pubblicazione: (2022)
Improving Musical Accompaniment Co-creation via Diffusion Transformers
di: Nistal, Javier, et al.
Pubblicazione: (2024)
di: Nistal, Javier, et al.
Pubblicazione: (2024)
Scaling Self-Supervised Representation Learning for Symbolic Piano Performance
di: Bradshaw, Louis, et al.
Pubblicazione: (2025)
di: Bradshaw, Louis, et al.
Pubblicazione: (2025)
Speech Self-Supervised Representations Benchmarking: a Case for Larger Probing Heads
di: Zaiem, Salah, et al.
Pubblicazione: (2023)
di: Zaiem, Salah, et al.
Pubblicazione: (2023)
Self-Supervised Disentangled Representation Learning for Robust Target Speech Extraction
di: Mu, Zhaoxi, et al.
Pubblicazione: (2023)
di: Mu, Zhaoxi, et al.
Pubblicazione: (2023)
SiFiSinger: A High-Fidelity End-to-End Singing Voice Synthesizer based on Source-filter Model
di: Cui, Jianwei, et al.
Pubblicazione: (2024)
di: Cui, Jianwei, et al.
Pubblicazione: (2024)
Toward Fully Self-Supervised Multi-Pitch Estimation
di: Cwitkowitz, Frank, et al.
Pubblicazione: (2024)
di: Cwitkowitz, Frank, et al.
Pubblicazione: (2024)
Self-Supervised Embeddings for Detecting Individual Symptoms of Depression
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024)
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024)
Learning Source Disentanglement in Neural Audio Codec
di: Bie, Xiaoyu, et al.
Pubblicazione: (2024)
di: Bie, Xiaoyu, et al.
Pubblicazione: (2024)
BabyHuBERT: Multilingual Self-Supervised Learning for Segmenting Speakers in Child-Centered Long-Form Recordings
di: Charlot, Théo, et al.
Pubblicazione: (2025)
di: Charlot, Théo, et al.
Pubblicazione: (2025)
Windowed SummaryMixing: An Efficient Fine-Tuning of Self-Supervised Learning Models for Low-resource Speech Recognition
di: Menon, Aditya Srinivas, et al.
Pubblicazione: (2026)
di: Menon, Aditya Srinivas, et al.
Pubblicazione: (2026)
On the Transferability of Large-Scale Self-Supervision to Few-Shot Audio Classification
di: Heggan, Calum, et al.
Pubblicazione: (2024)
di: Heggan, Calum, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PESTO: Real-Time Pitch Estimation with Self-supervised Transposition-equivariant Objective
di: Riou, Alain, et al.
Pubblicazione: (2025) -
Translation-Equivariant Self-Supervised Learning for Pitch Estimation with Optimal Transport
di: Torres, Bernardo, et al.
Pubblicazione: (2025) -
Bass Accompaniment Generation via Latent Diffusion
di: Pasini, Marco, et al.
Pubblicazione: (2024) -
Music2Latent: Consistency Autoencoders for Latent Audio Compression
di: Pasini, Marco, et al.
Pubblicazione: (2024) -
The Inverse Drum Machine: Source Separation Through Joint Transcription and Analysis-by-Synthesis
di: Torres, Bernardo, et al.
Pubblicazione: (2025)