Integrated Multi-Level Knowledge Distillation for Enhanced Speaker Verification
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Wenhao, Wei, Jianguo, Lu, Wenhuan, Lu, Xugang, Li, Lei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Channel Adaptation for Speaker Verification Using Optimal Transport with Pseudo Label
por: Yang, Wenhao, et al.
Publicado: (2024)
por: Yang, Wenhao, et al.
Publicado: (2024)
Robust Channel Learning for Large-Scale Radio Speaker Verification
por: Yang, Wenhao, et al.
Publicado: (2024)
por: Yang, Wenhao, et al.
Publicado: (2024)
Neighborhood Attention Transformer with Progressive Channel Fusion for Speaker Verification
por: Li, Nian, et al.
Publicado: (2024)
por: Li, Nian, et al.
Publicado: (2024)
Emphasized Non-Target Speaker Knowledge in Knowledge Distillation for Automatic Speaker Verification
por: Truong, Duc-Tuan, et al.
Publicado: (2023)
por: Truong, Duc-Tuan, et al.
Publicado: (2023)
Speech-to-See: End-to-End Speech-Driven Open-Set Object Detection
por: Lu, Wenhuan, et al.
Publicado: (2025)
por: Lu, Wenhuan, et al.
Publicado: (2025)
Enhancing Speaker Verification with w2v-BERT 2.0 and Knowledge Distillation guided Structured Pruning
por: Li, Ze, et al.
Publicado: (2025)
por: Li, Ze, et al.
Publicado: (2025)
Emotion Recognition in Multi-Speaker Conversations through Speaker Identification, Knowledge Distillation, and Hierarchical Fusion
por: Li, Xiao, et al.
Publicado: (2025)
por: Li, Xiao, et al.
Publicado: (2025)
Whisper-SV: Adapting Whisper for Low-data-resource Speaker Verification
por: Zhang, Li, et al.
Publicado: (2024)
por: Zhang, Li, et al.
Publicado: (2024)
Multi-Level Speaker Representation for Target Speaker Extraction
por: Zhang, Ke, et al.
Publicado: (2024)
por: Zhang, Ke, et al.
Publicado: (2024)
Diffusion-Based Adversarial Purification for Speaker Verification
por: Bai, Yibo, et al.
Publicado: (2023)
por: Bai, Yibo, et al.
Publicado: (2023)
Combining Deterministic Enhanced Conditions with Dual-Streaming Encoding for Diffusion-Based Speech Enhancement
por: Shi, Hao, et al.
Publicado: (2025)
por: Shi, Hao, et al.
Publicado: (2025)
Listening for "You": Enhancing Speech Image Retrieval via Target Speaker Extraction
por: Yang, Wenhao, et al.
Publicado: (2025)
por: Yang, Wenhao, et al.
Publicado: (2025)
Enhancing Age-Related Robustness in Children Speaker Verification
por: Shetty, Vishwas M., et al.
Publicado: (2025)
por: Shetty, Vishwas M., et al.
Publicado: (2025)
Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification
por: Zhang, Li, et al.
Publicado: (2025)
por: Zhang, Li, et al.
Publicado: (2025)
Adversarial Speaker Distillation for Countermeasure Model on Automatic Speaker Verification
por: Liao, Yen-Lun, et al.
Publicado: (2022)
por: Liao, Yen-Lun, et al.
Publicado: (2022)
Learning Emotion-Invariant Speaker Representations for Speaker Verification
por: Tian, Jingguang, et al.
Publicado: (2025)
por: Tian, Jingguang, et al.
Publicado: (2025)
MASV: Speaker Verification with Global and Local Context Mamba
por: Liu, Yang, et al.
Publicado: (2024)
por: Liu, Yang, et al.
Publicado: (2024)
AdvSV: An Over-the-Air Adversarial Attack Dataset for Speaker Verification
por: Wang, Li, et al.
Publicado: (2023)
por: Wang, Li, et al.
Publicado: (2023)
PhiNet: Speaker Verification with Phonetic Interpretability
por: Ma, Yi, et al.
Publicado: (2026)
por: Ma, Yi, et al.
Publicado: (2026)
An Initial Investigation of Neural Replay Simulator for Over-the-Air Adversarial Perturbations to Automatic Speaker Verification
por: Li, Jiaqi, et al.
Publicado: (2023)
por: Li, Jiaqi, et al.
Publicado: (2023)
EASY: Emotion-aware Speaker Anonymization via Factorized Distillation
por: Yao, Jixun, et al.
Publicado: (2025)
por: Yao, Jixun, et al.
Publicado: (2025)
Adversarial Reweighting for Speaker Verification Fairness
por: Jin, Minho, et al.
Publicado: (2022)
por: Jin, Minho, et al.
Publicado: (2022)
SA-SOT: Speaker-Aware Serialized Output Training for Multi-Talker ASR
por: Fan, Zhiyun, et al.
Publicado: (2024)
por: Fan, Zhiyun, et al.
Publicado: (2024)
Spoofing-Aware Speaker Verification via Wavelet Prompt Tuning and Multi-Model Ensembles
por: Farhadipour, Aref, et al.
Publicado: (2026)
por: Farhadipour, Aref, et al.
Publicado: (2026)
Robust Training for Speaker Verification against Noisy Labels
por: Fang, Zhihua, et al.
Publicado: (2022)
por: Fang, Zhihua, et al.
Publicado: (2022)
Spectral-Aware Low-Rank Adaptation for Speaker Verification
por: Li, Zhe, et al.
Publicado: (2025)
por: Li, Zhe, et al.
Publicado: (2025)
Enhancing Zero-Shot Multi-Speaker TTS with Negated Speaker Representations
por: Jeon, Yejin, et al.
Publicado: (2024)
por: Jeon, Yejin, et al.
Publicado: (2024)
Phonetic Richness for Improved Automatic Speaker Verification
por: Klein, Nicholas, et al.
Publicado: (2024)
por: Klein, Nicholas, et al.
Publicado: (2024)
A New Perspective on Speaker Verification: Joint Modeling with DFSMN and Transformer
por: Wang, Hongyu, et al.
Publicado: (2023)
por: Wang, Hongyu, et al.
Publicado: (2023)
Integrated Spoofing-Robust Automatic Speaker Verification via a Three-Class Formulation and LLR
por: Tan, Kai, et al.
Publicado: (2026)
por: Tan, Kai, et al.
Publicado: (2026)
An Investigation of Reprogramming for Cross-Language Adaptation in Speaker Verification Systems
por: Li, Jingyu, et al.
Publicado: (2024)
por: Li, Jingyu, et al.
Publicado: (2024)
Dynamic Frequency-Adaptive Knowledge Distillation for Speech Enhancement
por: Yuan, Xihao, et al.
Publicado: (2025)
por: Yuan, Xihao, et al.
Publicado: (2025)
Multi-Level Attention Aggregation for Language-Agnostic Speaker Replication
por: Jeon, Yejin, et al.
Publicado: (2024)
por: Jeon, Yejin, et al.
Publicado: (2024)
NeXt-TDNN: Modernizing Multi-Scale Temporal Convolution Backbone for Speaker Verification
por: Heo, Hyun-Jun, et al.
Publicado: (2023)
por: Heo, Hyun-Jun, et al.
Publicado: (2023)
Speaker Contrastive Learning for Source Speaker Tracing
por: Wang, Qing, et al.
Publicado: (2024)
por: Wang, Qing, et al.
Publicado: (2024)
A Stage-Wise Learning Strategy with Fixed Anchors for Robust Speaker Verification
por: Gu, Bin, et al.
Publicado: (2025)
por: Gu, Bin, et al.
Publicado: (2025)
Efficient Audio Captioning with Encoder-Level Knowledge Distillation
por: Xu, Xuenan, et al.
Publicado: (2024)
por: Xu, Xuenan, et al.
Publicado: (2024)
Whisper-PMFA: Partial Multi-Scale Feature Aggregation for Speaker Verification using Whisper Models
por: Zhao, Yiyang, et al.
Publicado: (2024)
por: Zhao, Yiyang, et al.
Publicado: (2024)
MGFF-TDNN: A Multi-Granularity Feature Fusion TDNN Model with Depth-Wise Separable Module for Speaker Verification
por: Li, Ya, et al.
Publicado: (2025)
por: Li, Ya, et al.
Publicado: (2025)
MDD: a Mask Diffusion Detector to Protect Speaker Verification Systems from Adversarial Perturbations
por: Bai, Yibo, et al.
Publicado: (2025)
por: Bai, Yibo, et al.
Publicado: (2025)
Ejemplares similares
-
Channel Adaptation for Speaker Verification Using Optimal Transport with Pseudo Label
por: Yang, Wenhao, et al.
Publicado: (2024) -
Robust Channel Learning for Large-Scale Radio Speaker Verification
por: Yang, Wenhao, et al.
Publicado: (2024) -
Neighborhood Attention Transformer with Progressive Channel Fusion for Speaker Verification
por: Li, Nian, et al.
Publicado: (2024) -
Emphasized Non-Target Speaker Knowledge in Knowledge Distillation for Automatic Speaker Verification
por: Truong, Duc-Tuan, et al.
Publicado: (2023) -
Speech-to-See: End-to-End Speech-Driven Open-Set Object Detection
por: Lu, Wenhuan, et al.
Publicado: (2025)