Multi-Label Training for Text-Independent Speaker Identification
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Xue, Yuqi |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pretraining Multi-Speaker Identification for Neural Speaker Diarization
par: Horiguchi, Shota, et autres
Publié: (2025)
par: Horiguchi, Shota, et autres
Publié: (2025)
From Independence to Interaction: Speaker-Aware Simulation of Multi-Speaker Conversational Timing
par: Gedeon, Máté, et autres
Publié: (2025)
par: Gedeon, Máté, et autres
Publié: (2025)
Robust Training for Speaker Verification against Noisy Labels
par: Fang, Zhihua, et autres
Publié: (2022)
par: Fang, Zhihua, et autres
Publié: (2022)
Emotion Recognition in Multi-Speaker Conversations through Speaker Identification, Knowledge Distillation, and Hierarchical Fusion
par: Li, Xiao, et autres
Publié: (2025)
par: Li, Xiao, et autres
Publié: (2025)
Text-Independent Speaker Identification Using Audio Looping With Margin Based Loss Functions
par: Garcia, Elliot Q C, et autres
Publié: (2025)
par: Garcia, Elliot Q C, et autres
Publié: (2025)
Generating Speakers by Prompting Listener Impressions for Pre-trained Multi-Speaker Text-to-Speech Systems
par: Chen, Zhengyang, et autres
Publié: (2024)
par: Chen, Zhengyang, et autres
Publié: (2024)
Speaker-IPL: Unsupervised Learning of Speaker Characteristics with i-Vector based Pseudo-Labels
par: Aldeneh, Zakaria, et autres
Publié: (2024)
par: Aldeneh, Zakaria, et autres
Publié: (2024)
Multi-Scale Accent Modeling and Disentangling for Multi-Speaker Multi-Accent Text-to-Speech Synthesis
par: Zhou, Xuehao, et autres
Publié: (2024)
par: Zhou, Xuehao, et autres
Publié: (2024)
NanoVoice: Efficient Speaker-Adaptive Text-to-Speech for Multiple Speakers
par: Park, Nohil, et autres
Publié: (2024)
par: Park, Nohil, et autres
Publié: (2024)
Multi-speaker Text-to-speech Training with Speaker Anonymized Data
par: Huang, Wen-Chin, et autres
Publié: (2024)
par: Huang, Wen-Chin, et autres
Publié: (2024)
In This Environment, As That Speaker: A Text-Driven Framework for Multi-Attribute Speech Conversion
par: Jin, Jiawei, et autres
Publié: (2025)
par: Jin, Jiawei, et autres
Publié: (2025)
Multi-Level Speaker Representation for Target Speaker Extraction
par: Zhang, Ke, et autres
Publié: (2024)
par: Zhang, Ke, et autres
Publié: (2024)
SA-SOT: Speaker-Aware Serialized Output Training for Multi-Talker ASR
par: Fan, Zhiyun, et autres
Publié: (2024)
par: Fan, Zhiyun, et autres
Publié: (2024)
CEC: A Noisy Label Detection Method for Speaker Recognition
par: Shen, Yao, et autres
Publié: (2024)
par: Shen, Yao, et autres
Publié: (2024)
Erasing Your Voice Before It's Heard: Training-free Speaker Unlearning for Zero-shot Text-to-Speech
par: Lee, Myungjin, et autres
Publié: (2026)
par: Lee, Myungjin, et autres
Publié: (2026)
ASRRL-TTS: Agile Speaker Representation Reinforcement Learning for Text-to-Speech Speaker Adaptation
par: Fu, Ruibo, et autres
Publié: (2024)
par: Fu, Ruibo, et autres
Publié: (2024)
Enhancing Open-Set Speaker Identification through Rapid Tuning with Speaker Reciprocal Points and Negative Sample
par: Chen, Zhiyong, et autres
Publié: (2024)
par: Chen, Zhiyong, et autres
Publié: (2024)
Channel Adaptation for Speaker Verification Using Optimal Transport with Pseudo Label
par: Yang, Wenhao, et autres
Publié: (2024)
par: Yang, Wenhao, et autres
Publié: (2024)
Enhancing Zero-Shot Multi-Speaker TTS with Negated Speaker Representations
par: Jeon, Yejin, et autres
Publié: (2024)
par: Jeon, Yejin, et autres
Publié: (2024)
Speaker Targeting via Self-Speaker Adaptation for Multi-talker ASR
par: Wang, Weiqing, et autres
Publié: (2025)
par: Wang, Weiqing, et autres
Publié: (2025)
Uncertainty Quantification in Machine Learning for Joint Speaker Diarization and Identification
par: McKnight, Simon W., et autres
Publié: (2023)
par: McKnight, Simon W., et autres
Publié: (2023)
Enhancing Speaker-Independent Dysarthric Speech Severity Classification with DSSCNet and Cross-Corpus Adaptation
par: Roy, Arnab Kumar, et autres
Publié: (2025)
par: Roy, Arnab Kumar, et autres
Publié: (2025)
Multi-level Temporal-channel Speaker Retrieval for Zero-shot Voice Conversion
par: Wang, Zhichao, et autres
Publié: (2023)
par: Wang, Zhichao, et autres
Publié: (2023)
Can We Really Repurpose Multi-Speaker ASR Corpus for Speaker Diarization?
par: Horiguchi, Shota, et autres
Publié: (2025)
par: Horiguchi, Shota, et autres
Publié: (2025)
Recursive Attentive Pooling for Extracting Speaker Embeddings from Multi-Speaker Recordings
par: Horiguchi, Shota, et autres
Publié: (2024)
par: Horiguchi, Shota, et autres
Publié: (2024)
Beyond Speaker Identity: Text Guided Target Speech Extraction
par: Huo, Mingyue, et autres
Publié: (2025)
par: Huo, Mingyue, et autres
Publié: (2025)
Joint ASR and Speaker Role Tagging with Serialized Output Training
par: Xu, Anfeng, et autres
Publié: (2025)
par: Xu, Anfeng, et autres
Publié: (2025)
DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification
par: Wang, Qing, et autres
Publié: (2025)
par: Wang, Qing, et autres
Publié: (2025)
Inter-Speaker Relative Cues for Text-Guided Target Speech Extraction
par: Dai, Wang, et autres
Publié: (2025)
par: Dai, Wang, et autres
Publié: (2025)
Multi-Speaker DOA Estimation in Binaural Hearing Aids using Deep Learning and Speaker Count Fusion
par: Jazaeri, Farnaz, et autres
Publié: (2025)
par: Jazaeri, Farnaz, et autres
Publié: (2025)
Joint Training of Speaker Embedding Extractor, Speech and Overlap Detection for Diarization
par: Pálka, Petr, et autres
Publié: (2024)
par: Pálka, Petr, et autres
Publié: (2024)
pTSE-T: Presentation Target Speaker Extraction using Unaligned Text Cues
par: Jiang, Ziyang, et autres
Publié: (2024)
par: Jiang, Ziyang, et autres
Publié: (2024)
Multi-Speaker Multi-Lingual VQTTS System for LIMMITS 2023 Challenge
par: Du, Chenpeng, et autres
Publié: (2023)
par: Du, Chenpeng, et autres
Publié: (2023)
A Joint Noise Disentanglement and Adversarial Training Framework for Robust Speaker Verification
par: Xing, Xujiang, et autres
Publié: (2024)
par: Xing, Xujiang, et autres
Publié: (2024)
Speaker Contrastive Learning for Source Speaker Tracing
par: Wang, Qing, et autres
Publié: (2024)
par: Wang, Qing, et autres
Publié: (2024)
Emotional Styles Hide in Deep Speaker Embeddings: Disentangle Deep Speaker Embeddings for Speaker Clustering
par: Lin, Chaohao, et autres
Publié: (2025)
par: Lin, Chaohao, et autres
Publié: (2025)
A Comprehensive Investigation on Speaker Augmentation for Speaker Recognition
par: Zhou, Zhenyu, et autres
Publié: (2024)
par: Zhou, Zhenyu, et autres
Publié: (2024)
Learning Emotion-Invariant Speaker Representations for Speaker Verification
par: Tian, Jingguang, et autres
Publié: (2025)
par: Tian, Jingguang, et autres
Publié: (2025)
An Investigation on Speaker Augmentation for End-to-End Speaker Extraction
par: You, Zhenghai, et autres
Publié: (2025)
par: You, Zhenghai, et autres
Publié: (2025)
Integrated Multi-Level Knowledge Distillation for Enhanced Speaker Verification
par: Yang, Wenhao, et autres
Publié: (2024)
par: Yang, Wenhao, et autres
Publié: (2024)
Documents similaires
-
Pretraining Multi-Speaker Identification for Neural Speaker Diarization
par: Horiguchi, Shota, et autres
Publié: (2025) -
From Independence to Interaction: Speaker-Aware Simulation of Multi-Speaker Conversational Timing
par: Gedeon, Máté, et autres
Publié: (2025) -
Robust Training for Speaker Verification against Noisy Labels
par: Fang, Zhihua, et autres
Publié: (2022) -
Emotion Recognition in Multi-Speaker Conversations through Speaker Identification, Knowledge Distillation, and Hierarchical Fusion
par: Li, Xiao, et autres
Publié: (2025) -
Text-Independent Speaker Identification Using Audio Looping With Margin Based Loss Functions
par: Garcia, Elliot Q C, et autres
Publié: (2025)