Zero-Shot Multi-Lingual Speaker Verification in Clinical Trials
Fuente:
arXiv
Guardado en:
| Autores principales: | Akram, Ali, Stanojevic, Marija, Ehghaghi, Malikeh, Novikova, Jekaterina |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Zero Shot Audio to Audio Emotion Transfer With Speaker Disentanglement
por: Dutta, Soumya, et al.
Publicado: (2024)
por: Dutta, Soumya, et al.
Publicado: (2024)
Adversarial Speaker Distillation for Countermeasure Model on Automatic Speaker Verification
por: Liao, Yen-Lun, et al.
Publicado: (2022)
por: Liao, Yen-Lun, et al.
Publicado: (2022)
HiddenSpeaker: Generate Imperceptible Unlearnable Audios for Speaker Verification System
por: Zhang, Zhisheng, et al.
Publicado: (2024)
por: Zhang, Zhisheng, et al.
Publicado: (2024)
Multi-stream Convolutional Neural Network with Frequency Selection for Robust Speaker Verification
por: Yao, Wei, et al.
Publicado: (2020)
por: Yao, Wei, et al.
Publicado: (2020)
Adversarial Data Augmentation for Robust Speaker Verification
por: Zhou, Zhenyu, et al.
Publicado: (2024)
por: Zhou, Zhenyu, et al.
Publicado: (2024)
Multi-Stage Speaker Diarization for Noisy Classrooms
por: Khan, Ali Sartaz, et al.
Publicado: (2025)
por: Khan, Ali Sartaz, et al.
Publicado: (2025)
TinySV: Speaker Verification in TinyML with On-device Learning
por: Pavan, Massimo, et al.
Publicado: (2024)
por: Pavan, Massimo, et al.
Publicado: (2024)
Robust Channel Learning for Large-Scale Radio Speaker Verification
por: Yang, Wenhao, et al.
Publicado: (2024)
por: Yang, Wenhao, et al.
Publicado: (2024)
Improving the Adversarial Robustness for Speaker Verification by Self-Supervised Learning
por: Wu, Haibin, et al.
Publicado: (2021)
por: Wu, Haibin, et al.
Publicado: (2021)
Enhancing Zero-Shot Multi-Speaker TTS with Negated Speaker Representations
por: Jeon, Yejin, et al.
Publicado: (2024)
por: Jeon, Yejin, et al.
Publicado: (2024)
Self-Supervised Frameworks for Speaker Verification via Bootstrapped Positive Sampling
por: Lepage, Theo, et al.
Publicado: (2025)
por: Lepage, Theo, et al.
Publicado: (2025)
Multi-label Zero-Shot Audio Classification with Temporal Attention
por: Dogan, Duygu, et al.
Publicado: (2024)
por: Dogan, Duygu, et al.
Publicado: (2024)
Multi-modal Adversarial Training for Zero-Shot Voice Cloning
por: Janiczek, John, et al.
Publicado: (2024)
por: Janiczek, John, et al.
Publicado: (2024)
Efficient Adapter Tuning of Pre-trained Speech Models for Automatic Speaker Verification
por: Sang, Mufan, et al.
Publicado: (2024)
por: Sang, Mufan, et al.
Publicado: (2024)
Label-Efficient Self-Supervised Speaker Verification With Information Maximization and Contrastive Learning
por: Lepage, Théo, et al.
Publicado: (2022)
por: Lepage, Théo, et al.
Publicado: (2022)
LMD: A Learnable Mask Network to Detect Adversarial Examples for Speaker Verification
por: Chen, Xing, et al.
Publicado: (2022)
por: Chen, Xing, et al.
Publicado: (2022)
Source -Free Domain Adaptation for Speaker Verification in Data-Scarce Languages and Noisy Channels
por: Elia, Shlomo Salo, et al.
Publicado: (2024)
por: Elia, Shlomo Salo, et al.
Publicado: (2024)
The THU-HCSI Multi-Speaker Multi-Lingual Few-Shot Voice Cloning System for LIMMITS'24 Challenge
por: Zhou, Yixuan, et al.
Publicado: (2024)
por: Zhou, Yixuan, et al.
Publicado: (2024)
ControlSpeech: Towards Simultaneous and Independent Zero-shot Speaker Cloning and Zero-shot Language Style Control
por: Ji, Shengpeng, et al.
Publicado: (2024)
por: Ji, Shengpeng, et al.
Publicado: (2024)
Scaling NVIDIA's Multi-speaker Multi-lingual TTS Systems with Zero-Shot TTS to Indic Languages
por: Arora, Akshit, et al.
Publicado: (2024)
por: Arora, Akshit, et al.
Publicado: (2024)
Towards Supervised Performance on Speaker Verification with Self-Supervised Learning by Leveraging Large-Scale ASR Models
por: Miara, Victor, et al.
Publicado: (2024)
por: Miara, Victor, et al.
Publicado: (2024)
Zero-Shot Mono-to-Binaural Speech Synthesis
por: Levkovitch, Alon, et al.
Publicado: (2024)
por: Levkovitch, Alon, et al.
Publicado: (2024)
Multi-Speaker Multi-Lingual VQTTS System for LIMMITS 2023 Challenge
por: Du, Chenpeng, et al.
Publicado: (2023)
por: Du, Chenpeng, et al.
Publicado: (2023)
DINO-VITS: Data-Efficient Zero-Shot TTS with Self-Supervised Speaker Verification Loss for Noise Robustness
por: Pankov, Vikentii, et al.
Publicado: (2023)
por: Pankov, Vikentii, et al.
Publicado: (2023)
Embedding-Space Diffusion for Zero-Shot Environmental Sound Classification
por: Sims, Ysobel, et al.
Publicado: (2024)
por: Sims, Ysobel, et al.
Publicado: (2024)
UniPET-SPK: A Unified Framework for Parameter-Efficient Tuning of Pre-trained Speech Models for Robust Speaker Verification
por: Sang, Mufan, et al.
Publicado: (2025)
por: Sang, Mufan, et al.
Publicado: (2025)
On Class Separability Pitfalls In Audio-Text Contrastive Zero-Shot Learning
por: Tavares, Tiago, et al.
Publicado: (2024)
por: Tavares, Tiago, et al.
Publicado: (2024)
Zero-Shot Unsupervised and Text-Based Audio Editing Using DDPM Inversion
por: Manor, Hila, et al.
Publicado: (2024)
por: Manor, Hila, et al.
Publicado: (2024)
Blind Audio Bandwidth Extension: A Diffusion-Based Zero-Shot Approach
por: Moliner, Eloi, et al.
Publicado: (2023)
por: Moliner, Eloi, et al.
Publicado: (2023)
Highly Efficient Real-Time Streaming and Fully On-Device Speaker Diarization with Multi-Stage Clustering
por: Wang, Quan, et al.
Publicado: (2022)
por: Wang, Quan, et al.
Publicado: (2022)
SEF-MK: Speaker-Embedding-Free Voice Anonymization through Multi-k-means Quantization
por: Tang, Beilong, et al.
Publicado: (2025)
por: Tang, Beilong, et al.
Publicado: (2025)
ChildAugment: Data Augmentation Methods for Zero-Resource Children's Speaker Verification
por: Singh, Vishwanath Pratap, et al.
Publicado: (2024)
por: Singh, Vishwanath Pratap, et al.
Publicado: (2024)
Listenable Maps for Zero-Shot Audio Classifiers
por: Paissan, Francesco, et al.
Publicado: (2024)
por: Paissan, Francesco, et al.
Publicado: (2024)
MegaTTS 3: Sparse Alignment Enhanced Latent Diffusion Transformer for Zero-Shot Speech Synthesis
por: Jiang, Ziyue, et al.
Publicado: (2025)
por: Jiang, Ziyue, et al.
Publicado: (2025)
SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning
por: Nam, KiHyun, et al.
Publicado: (2026)
por: Nam, KiHyun, et al.
Publicado: (2026)
Adversarial Training of Denoising Diffusion Model Using Dual Discriminators for High-Fidelity Multi-Speaker TTS
por: Ko, Myeongjin, et al.
Publicado: (2023)
por: Ko, Myeongjin, et al.
Publicado: (2023)
A Layer-Anchoring Strategy for Enhancing Cross-Lingual Speech Emotion Recognition
por: Upadhyay, Shreya G., et al.
Publicado: (2024)
por: Upadhyay, Shreya G., et al.
Publicado: (2024)
Investigating Confidence Estimation Measures for Speaker Diarization
por: Chowdhury, Anurag, et al.
Publicado: (2024)
por: Chowdhury, Anurag, et al.
Publicado: (2024)
Cosine Scoring with Uncertainty for Neural Speaker Embedding
por: Wang, Qiongqiong, et al.
Publicado: (2024)
por: Wang, Qiongqiong, et al.
Publicado: (2024)
Language Modelling for Speaker Diarization in Telephonic Interviews
por: India, Miquel, et al.
Publicado: (2025)
por: India, Miquel, et al.
Publicado: (2025)
Ejemplares similares
-
Zero Shot Audio to Audio Emotion Transfer With Speaker Disentanglement
por: Dutta, Soumya, et al.
Publicado: (2024) -
Adversarial Speaker Distillation for Countermeasure Model on Automatic Speaker Verification
por: Liao, Yen-Lun, et al.
Publicado: (2022) -
HiddenSpeaker: Generate Imperceptible Unlearnable Audios for Speaker Verification System
por: Zhang, Zhisheng, et al.
Publicado: (2024) -
Multi-stream Convolutional Neural Network with Frequency Selection for Robust Speaker Verification
por: Yao, Wei, et al.
Publicado: (2020) -
Adversarial Data Augmentation for Robust Speaker Verification
por: Zhou, Zhenyu, et al.
Publicado: (2024)