Guardado en:
| Autores principales: | Seo, Seungmin, Aulov, Oleg, Godil, Afzal, Mangold, Kevin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2508.14012 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Measuring Soft Biometric Leakage in Speaker De-Identification Systems
por: Seo, Seungmin, et al.
Publicado: (2025)
por: Seo, Seungmin, et al.
Publicado: (2025)
Continual Speaker Identity Unlearning with Minimal Interference
por: Kim, Jinju, et al.
Publicado: (2026)
por: Kim, Jinju, et al.
Publicado: (2026)
Evaluating Speaker Identity Coding in Self-supervised Models and Humans
por: Elbanna, Gasser
Publicado: (2024)
por: Elbanna, Gasser
Publicado: (2024)
Speaker Verification with Speech-Aware LLMs: Evaluation and Augmentation
por: Thebaud, Thomas, et al.
Publicado: (2026)
por: Thebaud, Thomas, et al.
Publicado: (2026)
Certification of Speaker Recognition Models to Additive Perturbations
por: Korzh, Dmitrii, et al.
Publicado: (2024)
por: Korzh, Dmitrii, et al.
Publicado: (2024)
Deep Learning for Speaker Identification: Architectural Insights from AB-1 Corpus Analysis and Performance Evaluation
por: Bartolo, Matthias
Publicado: (2024)
por: Bartolo, Matthias
Publicado: (2024)
Robust Target Speaker Diarization and Separation via Augmented Speaker Embedding Sampling
por: Jalal, Md Asif, et al.
Publicado: (2025)
por: Jalal, Md Asif, et al.
Publicado: (2025)
Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech
por: Kim, Taesoo, et al.
Publicado: (2025)
por: Kim, Taesoo, et al.
Publicado: (2025)
SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models
por: Yin, Han, et al.
Publicado: (2025)
por: Yin, Han, et al.
Publicado: (2025)
Whisper Speaker Identification: Leveraging Pre-Trained Multilingual Transformers for Robust Speaker Embeddings
por: Emon, Jakaria Islam, et al.
Publicado: (2025)
por: Emon, Jakaria Islam, et al.
Publicado: (2025)
Disentangling Age and Identity with a Mutual Information Minimization Approach for Cross-Age Speaker Verification
por: Zhang, Fengrun, et al.
Publicado: (2024)
por: Zhang, Fengrun, et al.
Publicado: (2024)
Exploring Speaker Diarization with Mixture of Experts
por: Yang, Gaobin, et al.
Publicado: (2025)
por: Yang, Gaobin, et al.
Publicado: (2025)
An End-to-End Approach for Korean Wakeword Systems with Speaker Authentication
por: Seo, Geonwoo
Publicado: (2025)
por: Seo, Geonwoo
Publicado: (2025)
Probabilistic Fusion and Calibration of Neural Speaker Diarization Models
por: Alvarez-Trejos, Juan Ignacio, et al.
Publicado: (2025)
por: Alvarez-Trejos, Juan Ignacio, et al.
Publicado: (2025)
Hyperbolic Additive Margin Softmax with Hierarchical Information for Speaker Verification
por: Fang, Zhihua, et al.
Publicado: (2026)
por: Fang, Zhihua, et al.
Publicado: (2026)
SNAP: Speaker Nulling for Artifact Projection in Speech Deepfake Detection
por: Jung, Kyudan, et al.
Publicado: (2026)
por: Jung, Kyudan, et al.
Publicado: (2026)
Speaker Embeddings to Improve Tracking of Intermittent and Moving Speakers
por: Iatariene, Taous, et al.
Publicado: (2025)
por: Iatariene, Taous, et al.
Publicado: (2025)
Rethinking Leveraging Pre-Trained Multi-Layer Representations for Speaker Verification
por: Kim, Jin Sob, et al.
Publicado: (2025)
por: Kim, Jin Sob, et al.
Publicado: (2025)
Neural Multi-Speaker Voice Cloning for Nepali in Low-Resource Settings
por: Shrestha, Aayush M., et al.
Publicado: (2026)
por: Shrestha, Aayush M., et al.
Publicado: (2026)
A Novel Automatic Framework for Speaker Drift Detection in Synthesized Speech
por: Huang, Jia-Hong, et al.
Publicado: (2026)
por: Huang, Jia-Hong, et al.
Publicado: (2026)
Eta-WavLM: Efficient Speaker Identity Removal in Self-Supervised Speech Representations Using a Simple Linear Equation
por: Ruggiero, Giuseppe, et al.
Publicado: (2025)
por: Ruggiero, Giuseppe, et al.
Publicado: (2025)
Novel Loss-Enhanced Universal Adversarial Patches for Sustainable Speaker Privacy
por: Karimov, Elvir, et al.
Publicado: (2025)
por: Karimov, Elvir, et al.
Publicado: (2025)
End-to-End Multi-Microphone Speaker Extraction Using Relative Transfer Functions
por: Eisenberg, Aviad, et al.
Publicado: (2025)
por: Eisenberg, Aviad, et al.
Publicado: (2025)
Disentangling Speakers in Multi-Talker Speech Recognition with Speaker-Aware CTC
por: Kang, Jiawen, et al.
Publicado: (2024)
por: Kang, Jiawen, et al.
Publicado: (2024)
Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification
por: Liu, Bei, et al.
Publicado: (2024)
por: Liu, Bei, et al.
Publicado: (2024)
TFGA-Net: Temporal-Frequency Graph Attention Network for Brain-Controlled Speaker Extraction
por: Si, Youhao, et al.
Publicado: (2025)
por: Si, Youhao, et al.
Publicado: (2025)
An Investigation Into Various Approaches For Bengali Long-Form Speech Transcription and Bengali Speaker Diarization
por: Jahan, Epshita, et al.
Publicado: (2026)
por: Jahan, Epshita, et al.
Publicado: (2026)
Leveraging Speaker Embeddings in End-to-End Neural Diarization for Two-Speaker Scenarios
por: Alvarez-Trejos, Juan Ignacio, et al.
Publicado: (2024)
por: Alvarez-Trejos, Juan Ignacio, et al.
Publicado: (2024)
Mask2Flow-TSE: Two-Stage Target Speaker Extraction with Masking and Flow Matching
por: Moon, Junwon, et al.
Publicado: (2026)
por: Moon, Junwon, et al.
Publicado: (2026)
A Holistic Framework for Robust Bangla ASR and Speaker Diarization with Optimized VAD and CTC Alignment
por: Ishmam, Zarif, et al.
Publicado: (2026)
por: Ishmam, Zarif, et al.
Publicado: (2026)
Text-dependent Speaker Verification (TdSV) Challenge 2024: Challenge Evaluation Plan
por: Hossein, Zeinali, et al.
Publicado: (2024)
por: Hossein, Zeinali, et al.
Publicado: (2024)
AlphaFlowTSE: One-Step Generative Target Speaker Extraction via Conditional AlphaFlow
por: Li, Duojia, et al.
Publicado: (2026)
por: Li, Duojia, et al.
Publicado: (2026)
Towards Streaming Target Speaker Extraction via Chunk-wise Interleaved Splicing of Autoregressive Language Model
por: Peng, Shuhai, et al.
Publicado: (2026)
por: Peng, Shuhai, et al.
Publicado: (2026)
Anonymizing Speech: Evaluating and Designing Speaker Anonymization Techniques
por: Champion, Pierre
Publicado: (2023)
por: Champion, Pierre
Publicado: (2023)
Probabilistic Verification of Voice Anti-Spoofing Models
por: Kushnir, Evgeny, et al.
Publicado: (2026)
por: Kushnir, Evgeny, et al.
Publicado: (2026)
The SVASR System for Text-dependent Speaker Verification (TdSV) AAIC Challenge 2024
por: Molavi, Mohammadreza, et al.
Publicado: (2024)
por: Molavi, Mohammadreza, et al.
Publicado: (2024)
Developing an Effective Training Dataset to Enhance the Performance of AI-based Speaker Separation Systems
por: Melhem, Rawad, et al.
Publicado: (2024)
por: Melhem, Rawad, et al.
Publicado: (2024)
Who is Authentic Speaker
por: Huang, Qiang
Publicado: (2024)
por: Huang, Qiang
Publicado: (2024)
Explainable Attribute-Based Speaker Verification
por: Wu, Xiaoliang, et al.
Publicado: (2024)
por: Wu, Xiaoliang, et al.
Publicado: (2024)
Evaluating the Effectiveness of Transformer Layers in Wav2Vec 2.0, XLS-R, and Whisper for Speaker Identification Tasks
por: Stuhlmann, Linus, et al.
Publicado: (2025)
por: Stuhlmann, Linus, et al.
Publicado: (2025)
Ejemplares similares
-
Measuring Soft Biometric Leakage in Speaker De-Identification Systems
por: Seo, Seungmin, et al.
Publicado: (2025) -
Continual Speaker Identity Unlearning with Minimal Interference
por: Kim, Jinju, et al.
Publicado: (2026) -
Evaluating Speaker Identity Coding in Self-supervised Models and Humans
por: Elbanna, Gasser
Publicado: (2024) -
Speaker Verification with Speech-Aware LLMs: Evaluation and Augmentation
por: Thebaud, Thomas, et al.
Publicado: (2026) -
Certification of Speaker Recognition Models to Additive Perturbations
por: Korzh, Dmitrii, et al.
Publicado: (2024)