ExPO: Explainable Phonetic Trait-Oriented Network for Speaker Verification
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Yi, Wang, Shuai, Liu, Tianchi, Li, Haizhou |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PhiNet: Speaker Verification with Phonetic Interpretability
por: Ma, Yi, et al.
Publicado: (2026)
por: Ma, Yi, et al.
Publicado: (2026)
Golden Gemini is All You Need: Finding the Sweet Spots for Speaker Verification
por: Liu, Tianchi, et al.
Publicado: (2023)
por: Liu, Tianchi, et al.
Publicado: (2023)
Explainable Attribute-Based Speaker Verification
por: Wu, Xiaoliang, et al.
Publicado: (2024)
por: Wu, Xiaoliang, et al.
Publicado: (2024)
How Do Neural Spoofing Countermeasures Detect Partially Spoofed Audio?
por: Liu, Tianchi, et al.
Publicado: (2024)
por: Liu, Tianchi, et al.
Publicado: (2024)
Phonetic Richness for Improved Automatic Speaker Verification
por: Klein, Nicholas, et al.
Publicado: (2024)
por: Klein, Nicholas, et al.
Publicado: (2024)
Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification
por: Liu, Bei, et al.
Publicado: (2024)
por: Liu, Bei, et al.
Publicado: (2024)
Nes2Net: A Lightweight Nested Architecture for Foundation Model Driven Speech Anti-spoofing
por: Liu, Tianchi, et al.
Publicado: (2025)
por: Liu, Tianchi, et al.
Publicado: (2025)
NeuroSpex: Neuro-Guided Speaker Extraction with Cross-Modal Attention
por: De Silva, Dashanka, et al.
Publicado: (2024)
por: De Silva, Dashanka, et al.
Publicado: (2024)
M-Vec: Matryoshka Speaker Embeddings with Flexible Dimensions
por: Wang, Shuai, et al.
Publicado: (2024)
por: Wang, Shuai, et al.
Publicado: (2024)
Multi-Level Speaker Representation for Target Speaker Extraction
por: Zhang, Ke, et al.
Publicado: (2024)
por: Zhang, Ke, et al.
Publicado: (2024)
Disentangling Age and Identity with a Mutual Information Minimization Approach for Cross-Age Speaker Verification
por: Zhang, Fengrun, et al.
Publicado: (2024)
por: Zhang, Fengrun, et al.
Publicado: (2024)
CosyAccent: Duration-Controllable Accent Normalization Using Source-Synthesis Training Data
por: Bai, Qibing, et al.
Publicado: (2026)
por: Bai, Qibing, et al.
Publicado: (2026)
Controllable Accent Normalization via Discrete Diffusion
por: Bai, Qibing, et al.
Publicado: (2026)
por: Bai, Qibing, et al.
Publicado: (2026)
Overview of Speaker Modeling and Its Applications: From the Lens of Deep Speaker Representation Learning
por: Wang, Shuai, et al.
Publicado: (2024)
por: Wang, Shuai, et al.
Publicado: (2024)
SCRAPS: Speech Contrastive Representations of Acoustic and Phonetic Spaces
por: Vallés-Pérez, Ivan, et al.
Publicado: (2023)
por: Vallés-Pérez, Ivan, et al.
Publicado: (2023)
The SVASR System for Text-dependent Speaker Verification (TdSV) AAIC Challenge 2024
por: Molavi, Mohammadreza, et al.
Publicado: (2024)
por: Molavi, Mohammadreza, et al.
Publicado: (2024)
Text-dependent Speaker Verification (TdSV) Challenge 2024: Challenge Evaluation Plan
por: Hossein, Zeinali, et al.
Publicado: (2024)
por: Hossein, Zeinali, et al.
Publicado: (2024)
ED-sKWS: Early-Decision Spiking Neural Networks for Rapid,and Energy-Efficient Keyword Spotting
por: Song, Zeyang, et al.
Publicado: (2024)
por: Song, Zeyang, et al.
Publicado: (2024)
Disentangling Speakers in Multi-Talker Speech Recognition with Speaker-Aware CTC
por: Kang, Jiawen, et al.
Publicado: (2024)
por: Kang, Jiawen, et al.
Publicado: (2024)
Speaker Diarization with Overlapping Community Detection Using Graph Attention Networks and Label Propagation Algorithm
por: Li, Zhaoyang, et al.
Publicado: (2025)
por: Li, Zhaoyang, et al.
Publicado: (2025)
ML-SAN: Multi-Level Speaker-Adaptive Network for Emotion Recognition in Conversations
por: Wang, Kexue, et al.
Publicado: (2026)
por: Wang, Kexue, et al.
Publicado: (2026)
Speech Foundation Model Ensembles for the Controlled Singing Voice Deepfake Detection (CtrSVDD) Challenge 2024
por: Guragain, Anmol, et al.
Publicado: (2024)
por: Guragain, Anmol, et al.
Publicado: (2024)
Generalizing Speaker Verification for Spoof Awareness in the Embedding Space
por: Liu, Xuechen, et al.
Publicado: (2024)
por: Liu, Xuechen, et al.
Publicado: (2024)
Speaker Embeddings to Improve Tracking of Intermittent and Moving Speakers
por: Iatariene, Taous, et al.
Publicado: (2025)
por: Iatariene, Taous, et al.
Publicado: (2025)
Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis
por: Zhang, Miao, et al.
Publicado: (2025)
por: Zhang, Miao, et al.
Publicado: (2025)
Plug-and-Play Co-Occurring Face Attention for Robust Audio-Visual Speaker Extraction
por: Pan, Zexu, et al.
Publicado: (2025)
por: Pan, Zexu, et al.
Publicado: (2025)
Learning Semantic Information from Raw Audio Signal Using Both Contextual and Phonetic Representations
por: Kim, Jaeyeon, et al.
Publicado: (2024)
por: Kim, Jaeyeon, et al.
Publicado: (2024)
On the effectiveness of enrollment speech augmentation for Target Speaker Extraction
por: Li, Junjie, et al.
Publicado: (2024)
por: Li, Junjie, et al.
Publicado: (2024)
USED: Universal Speaker Extraction and Diarization
por: Ao, Junyi, et al.
Publicado: (2023)
por: Ao, Junyi, et al.
Publicado: (2023)
Leveraging Speaker Embeddings in End-to-End Neural Diarization for Two-Speaker Scenarios
por: Alvarez-Trejos, Juan Ignacio, et al.
Publicado: (2024)
por: Alvarez-Trejos, Juan Ignacio, et al.
Publicado: (2024)
Listening and Seeing Again: Generative Error Correction for Audio-Visual Speech Recognition
por: Liu, Rui, et al.
Publicado: (2025)
por: Liu, Rui, et al.
Publicado: (2025)
LSCodec: Low-Bitrate and Speaker-Decoupled Discrete Speech Codec
por: Guo, Yiwei, et al.
Publicado: (2024)
por: Guo, Yiwei, et al.
Publicado: (2024)
Perceiver-Prompt: Flexible Speaker Adaptation in Whisper for Chinese Disordered Speech Recognition
por: Jiang, Yicong, et al.
Publicado: (2024)
por: Jiang, Yicong, et al.
Publicado: (2024)
Adversarial Reweighting for Speaker Verification Fairness
por: Jin, Minho, et al.
Publicado: (2022)
por: Jin, Minho, et al.
Publicado: (2022)
Towards Lightweight Speaker Verification via Adaptive Neural Network Quantization
por: Liu, Bei, et al.
Publicado: (2024)
por: Liu, Bei, et al.
Publicado: (2024)
A Mamba-based Network for Semi-supervised Singing Melody Extraction Using Confidence Binary Regularization
por: He, Xiaoliang, et al.
Publicado: (2025)
por: He, Xiaoliang, et al.
Publicado: (2025)
Asynchronous Voice Anonymization Using Adversarial Perturbation On Speaker Embedding
por: Wang, Rui, et al.
Publicado: (2024)
por: Wang, Rui, et al.
Publicado: (2024)
SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning
por: Nam, KiHyun, et al.
Publicado: (2026)
por: Nam, KiHyun, et al.
Publicado: (2026)
Prototype and Instance Contrastive Learning for Unsupervised Domain Adaptation in Speaker Verification
por: Huang, Wen, et al.
Publicado: (2024)
por: Huang, Wen, et al.
Publicado: (2024)
From Modular to End-to-End Speaker Diarization
por: Landini, Federico
Publicado: (2024)
por: Landini, Federico
Publicado: (2024)
Ejemplares similares
-
PhiNet: Speaker Verification with Phonetic Interpretability
por: Ma, Yi, et al.
Publicado: (2026) -
Golden Gemini is All You Need: Finding the Sweet Spots for Speaker Verification
por: Liu, Tianchi, et al.
Publicado: (2023) -
Explainable Attribute-Based Speaker Verification
por: Wu, Xiaoliang, et al.
Publicado: (2024) -
How Do Neural Spoofing Countermeasures Detect Partially Spoofed Audio?
por: Liu, Tianchi, et al.
Publicado: (2024) -
Phonetic Richness for Improved Automatic Speaker Verification
por: Klein, Nicholas, et al.
Publicado: (2024)