Target speaker anonymization in multi-speaker recordings
Fuente:
arXiv
Salvato in:
| Autori principali: | Tomashenko, Natalia, Yamagishi, Junichi, Wang, Xin, Liu, Yun, Vincent, Emmanuel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The First VoicePrivacy Attacker Challenge
di: Tomashenko, Natalia, et al.
Pubblicazione: (2025)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2025)
The First VoicePrivacy Attacker Challenge Evaluation Plan
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
The VoicePrivacy 2024 Challenge Evaluation Plan
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
Exploiting Context-dependent Duration Features for Voice Anonymization Attack Systems
di: Tomashenko, Natalia, et al.
Pubblicazione: (2025)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2025)
Improving curriculum learning for target speaker extraction with synthetic speakers
di: Liu, Yun, et al.
Pubblicazione: (2024)
di: Liu, Yun, et al.
Pubblicazione: (2024)
A Preliminary Case Study on Long-Form In-the-Wild Audio Spoofing Detection
di: Liu, Xuechen, et al.
Pubblicazione: (2024)
di: Liu, Xuechen, et al.
Pubblicazione: (2024)
LENS-DF: Deepfake Detection and Temporal Localization for Long-Form Noisy Speech
di: Liu, Xuechen, et al.
Pubblicazione: (2025)
di: Liu, Xuechen, et al.
Pubblicazione: (2025)
Multi-speaker Text-to-speech Training with Speaker Anonymized Data
di: Huang, Wen-Chin, et al.
Pubblicazione: (2024)
di: Huang, Wen-Chin, et al.
Pubblicazione: (2024)
Quantifying Source Speaker Leakage in One-to-One Voice Conversion
di: Wellington, Scott, et al.
Pubblicazione: (2025)
di: Wellington, Scott, et al.
Pubblicazione: (2025)
Spoofing attack augmentation: can differently-trained attack models improve generalisation?
di: Ge, Wanying, et al.
Pubblicazione: (2023)
di: Ge, Wanying, et al.
Pubblicazione: (2023)
Malacopula: adversarial automatic speaker verification attacks using a neural-based generalised Hammerstein model
di: Todisco, Massimiliano, et al.
Pubblicazione: (2024)
di: Todisco, Massimiliano, et al.
Pubblicazione: (2024)
SPGISpeech 2.0: Transcribed multi-speaker financial audio for speaker-tagged transcription
di: Grossman, Raymond, et al.
Pubblicazione: (2025)
di: Grossman, Raymond, et al.
Pubblicazione: (2025)
Analysis of Speech Temporal Dynamics in the Context of Speaker Verification and Voice Anonymization
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
The Third VoicePrivacy Challenge: Preserving Emotional Expressiveness and Linguistic Content in Voice Anonymization
di: Tomashenko, Natalia, et al.
Pubblicazione: (2026)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2026)
A Benchmark for Multi-speaker Anonymization
di: Miao, Xiaoxiao, et al.
Pubblicazione: (2024)
di: Miao, Xiaoxiao, et al.
Pubblicazione: (2024)
1000 African Voices: Advancing inclusive multi-speaker multi-accent speech synthesis
di: Ogun, Sewade, et al.
Pubblicazione: (2024)
di: Ogun, Sewade, et al.
Pubblicazione: (2024)
Investigation of perception inconsistency in speaker embedding for asynchronous voice anonymization
di: Wang, Rui, et al.
Pubblicazione: (2025)
di: Wang, Rui, et al.
Pubblicazione: (2025)
A multi-speaker multi-lingual voice cloning system based on vits2 for limmits 2024 challenge
di: Wang, Xiaopeng, et al.
Pubblicazione: (2024)
di: Wang, Xiaopeng, et al.
Pubblicazione: (2024)
Efficiently Train ASR Models that Memorize Less and Perform Better with Per-core Clipping
di: Wang, Lun, et al.
Pubblicazione: (2024)
di: Wang, Lun, et al.
Pubblicazione: (2024)
LLM-based speaker diarization correction: A generalizable approach
di: Efstathiadis, Georgios, et al.
Pubblicazione: (2024)
di: Efstathiadis, Georgios, et al.
Pubblicazione: (2024)
Extending Whisper with prompt tuning to target-speaker ASR
di: Ma, Hao, et al.
Pubblicazione: (2023)
di: Ma, Hao, et al.
Pubblicazione: (2023)
An approach to optimize inference of the DIART speaker diarization pipeline
di: Aperdannier, Roman, et al.
Pubblicazione: (2024)
di: Aperdannier, Roman, et al.
Pubblicazione: (2024)
Why disentanglement-based speaker anonymization systems fail at preserving emotions?
di: Gaznepoglu, Ünal Ege, et al.
Pubblicazione: (2025)
di: Gaznepoglu, Ünal Ege, et al.
Pubblicazione: (2025)
Deepfake Word Detection by Next-token Prediction using Fine-tuned Whisper
di: Tran, Hoan My, et al.
Pubblicazione: (2026)
di: Tran, Hoan My, et al.
Pubblicazione: (2026)
Analyzing the relationships between pretraining language, phonetic, tonal, and speaker information in self-supervised speech models
di: Gubian, Michele, et al.
Pubblicazione: (2025)
di: Gubian, Michele, et al.
Pubblicazione: (2025)
The VoicePrivacy 2022 Challenge: Progress and Perspectives in Voice Anonymisation
di: Panariello, Michele, et al.
Pubblicazione: (2024)
di: Panariello, Michele, et al.
Pubblicazione: (2024)
Inference Attacks for X-Vector Speaker Anonymization
di: Bauer, Luke, et al.
Pubblicazione: (2025)
di: Bauer, Luke, et al.
Pubblicazione: (2025)
Hierarchical speaker representation for target speaker extraction
di: He, Shulin, et al.
Pubblicazione: (2022)
di: He, Shulin, et al.
Pubblicazione: (2022)
Text adaptation for speaker verification with speaker-text factorized embeddings
di: Yang, Yexin, et al.
Pubblicazione: (2025)
di: Yang, Yexin, et al.
Pubblicazione: (2025)
ClaritySpeech: Dementia Obfuscation in Speech
di: Woszczyk, Dominika, et al.
Pubblicazione: (2025)
di: Woszczyk, Dominika, et al.
Pubblicazione: (2025)
Multilingual and Multi-Accent Jailbreaking of Audio LLMs
di: Roh, Jaechul, et al.
Pubblicazione: (2025)
di: Roh, Jaechul, et al.
Pubblicazione: (2025)
Preset-Voice Matching for Privacy Regulated Speech-to-Speech Translation Systems
di: Platnick, Daniel, et al.
Pubblicazione: (2024)
di: Platnick, Daniel, et al.
Pubblicazione: (2024)
Prosody-Driven Privacy-Preserving Dementia Detection
di: Woszczyk, Dominika, et al.
Pubblicazione: (2024)
di: Woszczyk, Dominika, et al.
Pubblicazione: (2024)
Ultralow-power standoff acoustic leak detection
di: Hasselbeck, Michael P.
Pubblicazione: (2025)
di: Hasselbeck, Michael P.
Pubblicazione: (2025)
Asymmetric Phase Coding Audio Watermarking
di: Yang, Guang, et al.
Pubblicazione: (2026)
di: Yang, Guang, et al.
Pubblicazione: (2026)
QuietPrint: Protecting 3D Printers Against Acoustic Side-Channel Attacks
di: Asgar, Seyed Ali Ghazi, et al.
Pubblicazione: (2026)
di: Asgar, Seyed Ali Ghazi, et al.
Pubblicazione: (2026)
You don't understand me!: Comparing ASR results for L1 and L2 speakers of Swedish
di: Cumbal, Ronald, et al.
Pubblicazione: (2024)
di: Cumbal, Ronald, et al.
Pubblicazione: (2024)
SpeechVerifier: Robust Acoustic Fingerprint against Tampering Attacks via Watermarking
di: Yao, Lingfeng, et al.
Pubblicazione: (2025)
di: Yao, Lingfeng, et al.
Pubblicazione: (2025)
AfriHuBERT: A self-supervised speech representation model for African languages
di: Alabi, Jesujoba O., et al.
Pubblicazione: (2024)
di: Alabi, Jesujoba O., et al.
Pubblicazione: (2024)
Yours or Mine? Overwriting Attacks Against Neural Audio Watermarking
di: Yao, Lingfeng, et al.
Pubblicazione: (2025)
di: Yao, Lingfeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The First VoicePrivacy Attacker Challenge
di: Tomashenko, Natalia, et al.
Pubblicazione: (2025) -
The First VoicePrivacy Attacker Challenge Evaluation Plan
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024) -
The VoicePrivacy 2024 Challenge Evaluation Plan
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024) -
Exploiting Context-dependent Duration Features for Voice Anonymization Attack Systems
di: Tomashenko, Natalia, et al.
Pubblicazione: (2025) -
Improving curriculum learning for target speaker extraction with synthetic speakers
di: Liu, Yun, et al.
Pubblicazione: (2024)