Prototype and Instance Contrastive Learning for Unsupervised Domain Adaptation in Speaker Verification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Wen, Han, Bing, Chen, Zhengyang, Wang, Shuai, Qian, Yanmin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Flow-TSVAD: Target-Speaker Voice Activity Detection via Latent Flow Matching
par: Chen, Zhengyang, et autres
Publié: (2024)
par: Chen, Zhengyang, et autres
Publié: (2024)
Overview of Speaker Modeling and Its Applications: From the Lens of Deep Speaker Representation Learning
par: Wang, Shuai, et autres
Publié: (2024)
par: Wang, Shuai, et autres
Publié: (2024)
Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification
par: Liu, Bei, et autres
Publié: (2024)
par: Liu, Bei, et autres
Publié: (2024)
Towards Lightweight Speaker Verification via Adaptive Neural Network Quantization
par: Liu, Bei, et autres
Publié: (2024)
par: Liu, Bei, et autres
Publié: (2024)
Generating Speakers by Prompting Listener Impressions for Pre-trained Multi-Speaker Text-to-Speech Systems
par: Chen, Zhengyang, et autres
Publié: (2024)
par: Chen, Zhengyang, et autres
Publié: (2024)
Disentangling the Prosody and Semantic Information with Pre-trained Model for In-Context Learning based Zero-Shot Voice Conversion
par: Chen, Zhengyang, et autres
Publié: (2024)
par: Chen, Zhengyang, et autres
Publié: (2024)
Self-Distillation Prototypes Network: Learning Robust Speaker Representations without Supervision
par: Chen, Yafeng, et autres
Publié: (2024)
par: Chen, Yafeng, et autres
Publié: (2024)
Self-Distillation Prototypes Network: Learning Robust Speaker Representations without Supervision
par: Chen, Yafeng, et autres
Publié: (2023)
par: Chen, Yafeng, et autres
Publié: (2023)
USED: Universal Speaker Extraction and Diarization
par: Ao, Junyi, et autres
Publié: (2023)
par: Ao, Junyi, et autres
Publié: (2023)
Advanced Zero-Shot Text-to-Speech for Background Removal and Preservation with Controllable Masked Speech Prediction
par: Zhang, Leying, et autres
Publié: (2025)
par: Zhang, Leying, et autres
Publié: (2025)
PhiNet: Speaker Verification with Phonetic Interpretability
par: Ma, Yi, et autres
Publié: (2026)
par: Ma, Yi, et autres
Publié: (2026)
ASRRL-TTS: Agile Speaker Representation Reinforcement Learning for Text-to-Speech Speaker Adaptation
par: Fu, Ruibo, et autres
Publié: (2024)
par: Fu, Ruibo, et autres
Publié: (2024)
Spectral-Aware Low-Rank Adaptation for Speaker Verification
par: Li, Zhe, et autres
Publié: (2025)
par: Li, Zhe, et autres
Publié: (2025)
Speaker Contrastive Learning for Source Speaker Tracing
par: Wang, Qing, et autres
Publié: (2024)
par: Wang, Qing, et autres
Publié: (2024)
Data-Efficient Low-Complexity Acoustic Scene Classification via Distilling and Progressive Pruning
par: Han, Bing, et autres
Publié: (2024)
par: Han, Bing, et autres
Publié: (2024)
Learning Emotion-Invariant Speaker Representations for Speaker Verification
par: Tian, Jingguang, et autres
Publié: (2025)
par: Tian, Jingguang, et autres
Publié: (2025)
An Investigation of Reprogramming for Cross-Language Adaptation in Speaker Verification Systems
par: Li, Jingyu, et autres
Publié: (2024)
par: Li, Jingyu, et autres
Publié: (2024)
Spoofing-Aware Speaker Verification Robust Against Domain and Channel Mismatches
par: Zeng, Chang, et autres
Publié: (2024)
par: Zeng, Chang, et autres
Publié: (2024)
WeSep: A Scalable and Flexible Toolkit Towards Generalizable Target Speaker Extraction
par: Wang, Shuai, et autres
Publié: (2024)
par: Wang, Shuai, et autres
Publié: (2024)
SE/BN Adapter: Parametric Efficient Domain Adaptation for Speaker Recognition
par: Wang, Tianhao, et autres
Publié: (2024)
par: Wang, Tianhao, et autres
Publié: (2024)
Channel Adaptation for Speaker Verification Using Optimal Transport with Pseudo Label
par: Yang, Wenhao, et autres
Publié: (2024)
par: Yang, Wenhao, et autres
Publié: (2024)
Speaker-IPL: Unsupervised Learning of Speaker Characteristics with i-Vector based Pseudo-Labels
par: Aldeneh, Zakaria, et autres
Publié: (2024)
par: Aldeneh, Zakaria, et autres
Publié: (2024)
Speaker Targeting via Self-Speaker Adaptation for Multi-talker ASR
par: Wang, Weiqing, et autres
Publié: (2025)
par: Wang, Weiqing, et autres
Publié: (2025)
Whisper-PMFA: Partial Multi-Scale Feature Aggregation for Speaker Verification using Whisper Models
par: Zhao, Yiyang, et autres
Publié: (2024)
par: Zhao, Yiyang, et autres
Publié: (2024)
Adversarial Reweighting for Speaker Verification Fairness
par: Jin, Minho, et autres
Publié: (2022)
par: Jin, Minho, et autres
Publié: (2022)
Domain Adaptation for Contrastive Audio-Language Models
par: Deshmukh, Soham, et autres
Publié: (2024)
par: Deshmukh, Soham, et autres
Publié: (2024)
SpeechFake: A Large-Scale Multilingual Speech Deepfake Dataset Incorporating Cutting-Edge Generation Methods
par: Huang, Wen, et autres
Publié: (2025)
par: Huang, Wen, et autres
Publié: (2025)
Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation
par: Huang, Wen, et autres
Publié: (2025)
par: Huang, Wen, et autres
Publié: (2025)
From Sharpness to Better Generalization for Speech Deepfake Detection
par: Huang, Wen, et autres
Publié: (2025)
par: Huang, Wen, et autres
Publié: (2025)
MASV: Speaker Verification with Global and Local Context Mamba
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
Pushing the Frontiers of Self-Distillation Prototypes Network with Dimension Regularization and Score Normalization
par: Chen, Yafeng, et autres
Publié: (2025)
par: Chen, Yafeng, et autres
Publié: (2025)
Source -Free Domain Adaptation for Speaker Verification in Data-Scarce Languages and Noisy Channels
par: Elia, Shlomo Salo, et autres
Publié: (2024)
par: Elia, Shlomo Salo, et autres
Publié: (2024)
Text adaptation for speaker verification with speaker-text factorized embeddings
par: Yang, Yexin, et autres
Publié: (2025)
par: Yang, Yexin, et autres
Publié: (2025)
Emphasized Non-Target Speaker Knowledge in Knowledge Distillation for Automatic Speaker Verification
par: Truong, Duc-Tuan, et autres
Publié: (2023)
par: Truong, Duc-Tuan, et autres
Publié: (2023)
Multi-Level Speaker Representation for Target Speaker Extraction
par: Zhang, Ke, et autres
Publié: (2024)
par: Zhang, Ke, et autres
Publié: (2024)
Unsupervised Multi-channel Separation and Adaptation
par: Han, Cong, et autres
Publié: (2023)
par: Han, Cong, et autres
Publié: (2023)
Phonetic Richness for Improved Automatic Speaker Verification
par: Klein, Nicholas, et autres
Publié: (2024)
par: Klein, Nicholas, et autres
Publié: (2024)
Diffusion-Based Adversarial Purification for Speaker Verification
par: Bai, Yibo, et autres
Publié: (2023)
par: Bai, Yibo, et autres
Publié: (2023)
Neural Codec-based Adversarial Sample Detection for Speaker Verification
par: Chen, Xuanjun, et autres
Publié: (2024)
par: Chen, Xuanjun, et autres
Publié: (2024)
Speaker-Smoothed kNN Speaker Adaptation for End-to-End ASR
par: Li, Shaojun, et autres
Publié: (2024)
par: Li, Shaojun, et autres
Publié: (2024)
Documents similaires
-
Flow-TSVAD: Target-Speaker Voice Activity Detection via Latent Flow Matching
par: Chen, Zhengyang, et autres
Publié: (2024) -
Overview of Speaker Modeling and Its Applications: From the Lens of Deep Speaker Representation Learning
par: Wang, Shuai, et autres
Publié: (2024) -
Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification
par: Liu, Bei, et autres
Publié: (2024) -
Towards Lightweight Speaker Verification via Adaptive Neural Network Quantization
par: Liu, Bei, et autres
Publié: (2024) -
Generating Speakers by Prompting Listener Impressions for Pre-trained Multi-Speaker Text-to-Speech Systems
par: Chen, Zhengyang, et autres
Publié: (2024)