openFEAT: Improving Speaker Identification by Open-set Few-shot Embedding Adaptation with Transformer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | C, Kishan K, Tan, Zhenning, Chen, Long, Jin, Minho, Han, Eunjung, Stolcke, Andreas, Lee, Chul |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SpeakerRPL v2: Robust Open-set Speaker Identification through Enhanced Few-shot Foundation Tuning and Model Fusion
par: Chen, Zhiyong, et autres
Publié: (2026)
par: Chen, Zhiyong, et autres
Publié: (2026)
Adversarial Reweighting for Speaker Verification Fairness
par: Jin, Minho, et autres
Publié: (2022)
par: Jin, Minho, et autres
Publié: (2022)
Improving fairness in speaker verification via Group-adapted Fusion Network
par: Shen, Hua, et autres
Publié: (2022)
par: Shen, Hua, et autres
Publié: (2022)
Post-Training Embedding Alignment for Decoupling Enrollment and Runtime Speaker Recognition Models
par: Gao, Chenyang, et autres
Publié: (2024)
par: Gao, Chenyang, et autres
Publié: (2024)
Improving speaker verification robustness with synthetic emotional utterances
par: Koditala, Nikhil Kumar, et autres
Publié: (2024)
par: Koditala, Nikhil Kumar, et autres
Publié: (2024)
Fully Few-shot Class-incremental Audio Classification Using Multi-level Embedding Extractor and Ridge Regression Classifier
par: Si, Yongjie, et autres
Publié: (2025)
par: Si, Yongjie, et autres
Publié: (2025)
Target Speaker Lipreading by Audio-Visual Self-Distillation Pretraining and Speaker Adaptation
par: Zhang, Jing-Xuan, et autres
Publié: (2025)
par: Zhang, Jing-Xuan, et autres
Publié: (2025)
VoxBlink2: A 100K+ Speaker Recognition Corpus and the Open-Set Speaker-Identification Benchmark
par: Lin, Yuke, et autres
Publié: (2024)
par: Lin, Yuke, et autres
Publié: (2024)
Speaker Embeddings to Improve Tracking of Intermittent and Moving Speakers
par: Iatariene, Taous, et autres
Publié: (2025)
par: Iatariene, Taous, et autres
Publié: (2025)
Rhythm Features for Speaker Identification
par: Mehlman, Nick, et autres
Publié: (2025)
par: Mehlman, Nick, et autres
Publié: (2025)
Enhancing Open-Set Speaker Identification through Rapid Tuning with Speaker Reciprocal Points and Negative Sample
par: Chen, Zhiyong, et autres
Publié: (2024)
par: Chen, Zhiyong, et autres
Publié: (2024)
Emotional Styles Hide in Deep Speaker Embeddings: Disentangle Deep Speaker Embeddings for Speaker Clustering
par: Lin, Chaohao, et autres
Publié: (2025)
par: Lin, Chaohao, et autres
Publié: (2025)
An Investigation of Reprogramming for Cross-Language Adaptation in Speaker Verification Systems
par: Li, Jingyu, et autres
Publié: (2024)
par: Li, Jingyu, et autres
Publié: (2024)
What Does the Speaker Embedding Encode?
par: Wang, Shuai, et autres
Publié: (2025)
par: Wang, Shuai, et autres
Publié: (2025)
Whisper Speaker Identification: Leveraging Pre-Trained Multilingual Transformers for Robust Speaker Embeddings
par: Emon, Jakaria Islam, et autres
Publié: (2025)
par: Emon, Jakaria Islam, et autres
Publié: (2025)
Guided Speaker Embedding
par: Horiguchi, Shota, et autres
Publié: (2024)
par: Horiguchi, Shota, et autres
Publié: (2024)
On-the-fly Routing for Zero-shot MoE Speaker Adaptation of Speech Foundation Models for Dysarthric Speech Recognition
par: HU, Shujie, et autres
Publié: (2025)
par: HU, Shujie, et autres
Publié: (2025)
Pretraining Multi-Speaker Identification for Neural Speaker Diarization
par: Horiguchi, Shota, et autres
Publié: (2025)
par: Horiguchi, Shota, et autres
Publié: (2025)
Mitigating Non-Target Speaker Bias in Guided Speaker Embedding
par: Horiguchi, Shota, et autres
Publié: (2025)
par: Horiguchi, Shota, et autres
Publié: (2025)
PseudoVC: Improving One-shot Voice Conversion with Pseudo Paired Data
par: Cao, Songjun, et autres
Publié: (2025)
par: Cao, Songjun, et autres
Publié: (2025)
Speaker-Smoothed kNN Speaker Adaptation for End-to-End ASR
par: Li, Shaojun, et autres
Publié: (2024)
par: Li, Shaojun, et autres
Publié: (2024)
Speaker Targeting via Self-Speaker Adaptation for Multi-talker ASR
par: Wang, Weiqing, et autres
Publié: (2025)
par: Wang, Weiqing, et autres
Publié: (2025)
UNet-Based Fusion and Exponential Moving Average Adaptation for Noise-Robust Speaker Recognition
par: Gan, Chong-Xin, et autres
Publié: (2026)
par: Gan, Chong-Xin, et autres
Publié: (2026)
USEF-TSE: Universal Speaker Embedding Free Target Speaker Extraction
par: Zeng, Bang, et autres
Publié: (2024)
par: Zeng, Bang, et autres
Publié: (2024)
Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement
par: Huang, Ziling, et autres
Publié: (2025)
par: Huang, Ziling, et autres
Publié: (2025)
Interpreting the Dimensions of Speaker Embedding Space
par: Huckvale, Mark
Publié: (2025)
par: Huckvale, Mark
Publié: (2025)
Test-Time Adaptation for Speech Enhancement via Domain Invariant Embedding Transformation
par: Raichle, Tobias, et autres
Publié: (2025)
par: Raichle, Tobias, et autres
Publié: (2025)
Recursive Attentive Pooling for Extracting Speaker Embeddings from Multi-Speaker Recordings
par: Horiguchi, Shota, et autres
Publié: (2024)
par: Horiguchi, Shota, et autres
Publié: (2024)
Speaker Embeddings With Weakly Supervised Voice Activity Detection For Efficient Speaker Diarization
par: Thienpondt, Jenthe, et autres
Publié: (2024)
par: Thienpondt, Jenthe, et autres
Publié: (2024)
Fully Few-shot Class-incremental Audio Classification Using Expandable Dual-embedding Extractor
par: Si, Yongjie, et autres
Publié: (2024)
par: Si, Yongjie, et autres
Publié: (2024)
A Toolkit for Joint Speaker Diarization and Identification with Application to Speaker-Attributed ASR
par: Morrone, Giovanni, et autres
Publié: (2024)
par: Morrone, Giovanni, et autres
Publié: (2024)
SEED: Speaker Embedding Enhancement Diffusion Model
par: Nam, KiHyun, et autres
Publié: (2025)
par: Nam, KiHyun, et autres
Publié: (2025)
ASRRL-TTS: Agile Speaker Representation Reinforcement Learning for Text-to-Speech Speaker Adaptation
par: Fu, Ruibo, et autres
Publié: (2024)
par: Fu, Ruibo, et autres
Publié: (2024)
Universal Speaker Embedding Free Target Speaker Extraction and Personal Voice Activity Detection
par: Zeng, Bang, et autres
Publié: (2025)
par: Zeng, Bang, et autres
Publié: (2025)
The Reasonable Effectiveness of Speaker Embeddings for Violence Detection
par: Jain, Sarthak, et autres
Publié: (2024)
par: Jain, Sarthak, et autres
Publié: (2024)
Explaining Speaker and Spoof Embeddings via Probing
par: Liu, Xuechen, et autres
Publié: (2024)
par: Liu, Xuechen, et autres
Publié: (2024)
Xi+: Uncertainty Supervision for Robust Speaker Embedding
par: Li, Junjie, et autres
Publié: (2025)
par: Li, Junjie, et autres
Publié: (2025)
Cochleagram-based Noise Adapted Speaker Identification System for Distorted Speech
par: Ahmed, Sabbir, et autres
Publié: (2025)
par: Ahmed, Sabbir, et autres
Publié: (2025)
DNN based HRIRs Identification with a Continuously Rotating Speaker Array
par: Ko, Byeong-Yun, et autres
Publié: (2025)
par: Ko, Byeong-Yun, et autres
Publié: (2025)
Unsupervised Single-Channel Speech Separation with a Diffusion Prior under Speaker-Embedding Guidance
par: Shi, Runwu, et autres
Publié: (2025)
par: Shi, Runwu, et autres
Publié: (2025)
Documents similaires
-
SpeakerRPL v2: Robust Open-set Speaker Identification through Enhanced Few-shot Foundation Tuning and Model Fusion
par: Chen, Zhiyong, et autres
Publié: (2026) -
Adversarial Reweighting for Speaker Verification Fairness
par: Jin, Minho, et autres
Publié: (2022) -
Improving fairness in speaker verification via Group-adapted Fusion Network
par: Shen, Hua, et autres
Publié: (2022) -
Post-Training Embedding Alignment for Decoupling Enrollment and Runtime Speaker Recognition Models
par: Gao, Chenyang, et autres
Publié: (2024) -
Improving speaker verification robustness with synthetic emotional utterances
par: Koditala, Nikhil Kumar, et autres
Publié: (2024)