Enhancement of a Text-Independent Speaker Verification System by using Feature Combination and Parallel-Structure Classifiers
Fuente:
arXiv
Guardado en:
| Autores principales: | Abdalmalak, Kerlos Atia, Gallardo-Antol'in, Ascensión |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
The SVASR System for Text-dependent Speaker Verification (TdSV) AAIC Challenge 2024
por: Molavi, Mohammadreza, et al.
Publicado: (2024)
por: Molavi, Mohammadreza, et al.
Publicado: (2024)
Text-dependent Speaker Verification (TdSV) Challenge 2024: Challenge Evaluation Plan
por: Hossein, Zeinali, et al.
Publicado: (2024)
por: Hossein, Zeinali, et al.
Publicado: (2024)
Explainable Attribute-Based Speaker Verification
por: Wu, Xiaoliang, et al.
Publicado: (2024)
por: Wu, Xiaoliang, et al.
Publicado: (2024)
Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification
por: Liu, Bei, et al.
Publicado: (2024)
por: Liu, Bei, et al.
Publicado: (2024)
ExPO: Explainable Phonetic Trait-Oriented Network for Speaker Verification
por: Ma, Yi, et al.
Publicado: (2025)
por: Ma, Yi, et al.
Publicado: (2025)
An Attention Long Short-Term Memory based system for automatic classification of speech intelligibility
por: Fernández-Díaz, Miguel, et al.
Publicado: (2024)
por: Fernández-Díaz, Miguel, et al.
Publicado: (2024)
DART: Disentanglement of Accent and Speaker Representation in Multispeaker Text-to-Speech
por: Melechovsky, Jan, et al.
Publicado: (2024)
por: Melechovsky, Jan, et al.
Publicado: (2024)
Disentangling Age and Identity with a Mutual Information Minimization Approach for Cross-Age Speaker Verification
por: Zhang, Fengrun, et al.
Publicado: (2024)
por: Zhang, Fengrun, et al.
Publicado: (2024)
Selective Classifier-free Guidance for Zero-shot Text-to-speech
por: Zheng, John, et al.
Publicado: (2025)
por: Zheng, John, et al.
Publicado: (2025)
Stable-TTS: Stable Speaker-Adaptive Text-to-Speech Synthesis via Prosody Prompting
por: Han, Wooseok, et al.
Publicado: (2024)
por: Han, Wooseok, et al.
Publicado: (2024)
Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech
por: Kim, Taesoo, et al.
Publicado: (2025)
por: Kim, Taesoo, et al.
Publicado: (2025)
GMM-ResNext: Combining Generative and Discriminative Models for Speaker Verification
por: Yan, Hui, et al.
Publicado: (2024)
por: Yan, Hui, et al.
Publicado: (2024)
Speaker Embeddings to Improve Tracking of Intermittent and Moving Speakers
por: Iatariene, Taous, et al.
Publicado: (2025)
por: Iatariene, Taous, et al.
Publicado: (2025)
Disentangling Speakers in Multi-Talker Speech Recognition with Speaker-Aware CTC
por: Kang, Jiawen, et al.
Publicado: (2024)
por: Kang, Jiawen, et al.
Publicado: (2024)
Leveraging Speaker Embeddings in End-to-End Neural Diarization for Two-Speaker Scenarios
por: Alvarez-Trejos, Juan Ignacio, et al.
Publicado: (2024)
por: Alvarez-Trejos, Juan Ignacio, et al.
Publicado: (2024)
Multi-Label Training for Text-Independent Speaker Identification
por: Xue, Yuqi
Publicado: (2022)
por: Xue, Yuqi
Publicado: (2022)
Generalizing Speaker Verification for Spoof Awareness in the Embedding Space
por: Liu, Xuechen, et al.
Publicado: (2024)
por: Liu, Xuechen, et al.
Publicado: (2024)
Developing an Effective Training Dataset to Enhance the Performance of AI-based Speaker Separation Systems
por: Melhem, Rawad, et al.
Publicado: (2024)
por: Melhem, Rawad, et al.
Publicado: (2024)
Removing Speaker Information from Speech Representation using Variable-Length Soft Pooling
por: Hwang, Injune, et al.
Publicado: (2024)
por: Hwang, Injune, et al.
Publicado: (2024)
DiEmo-TTS: Disentangled Emotion Representations via Self-Supervised Distillation for Cross-Speaker Emotion Transfer in Text-to-Speech
por: Cho, Deok-Hyeon, et al.
Publicado: (2025)
por: Cho, Deok-Hyeon, et al.
Publicado: (2025)
Robust Cross-Etiology and Speaker-Independent Dysarthric Speech Recognition
por: Singh, Satwinder, et al.
Publicado: (2025)
por: Singh, Satwinder, et al.
Publicado: (2025)
SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning
por: Nam, KiHyun, et al.
Publicado: (2026)
por: Nam, KiHyun, et al.
Publicado: (2026)
Prior-agnostic Multi-scale Contrastive Text-Audio Pre-training for Parallelized TTS Frontend Modeling
por: Wang, Quanxiu, et al.
Publicado: (2024)
por: Wang, Quanxiu, et al.
Publicado: (2024)
From Modular to End-to-End Speaker Diarization
por: Landini, Federico
Publicado: (2024)
por: Landini, Federico
Publicado: (2024)
Certification of Speaker Recognition Models to Additive Perturbations
por: Korzh, Dmitrii, et al.
Publicado: (2024)
por: Korzh, Dmitrii, et al.
Publicado: (2024)
Unsupervised Speech Enhancement using Data-defined Priors
por: Klement, Dominik, et al.
Publicado: (2025)
por: Klement, Dominik, et al.
Publicado: (2025)
SDBench: A Comprehensive Benchmark Suite for Speaker Diarization
por: Pacheco, Eduardo, et al.
Publicado: (2025)
por: Pacheco, Eduardo, et al.
Publicado: (2025)
The VoxCeleb Speaker Recognition Challenge: A Retrospective
por: Huh, Jaesung, et al.
Publicado: (2024)
por: Huh, Jaesung, et al.
Publicado: (2024)
Whisper-PMFA: Partial Multi-Scale Feature Aggregation for Speaker Verification using Whisper Models
por: Zhao, Yiyang, et al.
Publicado: (2024)
por: Zhao, Yiyang, et al.
Publicado: (2024)
EnCLAP: Combining Neural Audio Codec and Audio-Text Joint Embedding for Automated Audio Captioning
por: Kim, Jaeyeon, et al.
Publicado: (2024)
por: Kim, Jaeyeon, et al.
Publicado: (2024)
End-to-End Supervised Hierarchical Graph Clustering for Speaker Diarization
por: Singh, Prachi, et al.
Publicado: (2024)
por: Singh, Prachi, et al.
Publicado: (2024)
LSCodec: Low-Bitrate and Speaker-Decoupled Discrete Speech Codec
por: Guo, Yiwei, et al.
Publicado: (2024)
por: Guo, Yiwei, et al.
Publicado: (2024)
Unispeaker: A Unified Approach for Multimodality-driven Speaker Generation
por: Sheng, Zhengyan, et al.
Publicado: (2025)
por: Sheng, Zhengyan, et al.
Publicado: (2025)
Asynchronous Voice Anonymization Using Adversarial Perturbation On Speaker Embedding
por: Wang, Rui, et al.
Publicado: (2024)
por: Wang, Rui, et al.
Publicado: (2024)
Evaluating Speaker Identity Coding in Self-supervised Models and Humans
por: Elbanna, Gasser
Publicado: (2024)
por: Elbanna, Gasser
Publicado: (2024)
Real-Time Speech Enhancement via a Hybrid ViT: A Dual-Input Acoustic-Image Feature Fusion
por: Bahmei, Behnaz, et al.
Publicado: (2025)
por: Bahmei, Behnaz, et al.
Publicado: (2025)
CryCeleb: A Speaker Verification Dataset Based on Infant Cry Sounds
por: Budaghyan, David, et al.
Publicado: (2023)
por: Budaghyan, David, et al.
Publicado: (2023)
SSPS: Self-Supervised Positive Sampling for Robust Self-Supervised Speaker Verification
por: Lepage, Theo, et al.
Publicado: (2025)
por: Lepage, Theo, et al.
Publicado: (2025)
Personalized Speech Enhancement Without a Separate Speaker Embedding Model
por: Pärnamaa, Tanel, et al.
Publicado: (2024)
por: Pärnamaa, Tanel, et al.
Publicado: (2024)
Multi-Speaker Conversational Audio Deepfake: Taxonomy, Dataset and Pilot Study
por: Ahmed, Alabi, et al.
Publicado: (2026)
por: Ahmed, Alabi, et al.
Publicado: (2026)
Ejemplares similares
-
The SVASR System for Text-dependent Speaker Verification (TdSV) AAIC Challenge 2024
por: Molavi, Mohammadreza, et al.
Publicado: (2024) -
Text-dependent Speaker Verification (TdSV) Challenge 2024: Challenge Evaluation Plan
por: Hossein, Zeinali, et al.
Publicado: (2024) -
Explainable Attribute-Based Speaker Verification
por: Wu, Xiaoliang, et al.
Publicado: (2024) -
Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification
por: Liu, Bei, et al.
Publicado: (2024) -
ExPO: Explainable Phonetic Trait-Oriented Network for Speaker Verification
por: Ma, Yi, et al.
Publicado: (2025)