HLTCOE JHU Submission to the Voice Privacy Challenge 2024
Fuente:
arXiv
Salvato in:
| Autori principali: | Xinyuan, Henry Li, Cai, Zexin, Garg, Ashi, Duh, Kevin, García-Perera, Leibny Paola, Khudanpur, Sanjeev, Andrews, Nicholas, Wiesner, Matthew |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Rapidly Adapting to New Voice Spoofing: Few-Shot Detection of Synthesized Speech Under Distribution Shifts
di: Garg, Ashi, et al.
Pubblicazione: (2025)
di: Garg, Ashi, et al.
Pubblicazione: (2025)
GenVC: Self-Supervised Zero-Shot Voice Conversion
di: Cai, Zexin, et al.
Pubblicazione: (2025)
di: Cai, Zexin, et al.
Pubblicazione: (2025)
Privacy versus Emotion Preservation Trade-offs in Emotion-Preserving Speaker Anonymization
di: Cai, Zexin, et al.
Pubblicazione: (2024)
di: Cai, Zexin, et al.
Pubblicazione: (2024)
Scalable Controllable Accented TTS
di: Xinyuan, Henry Li, et al.
Pubblicazione: (2025)
di: Xinyuan, Henry Li, et al.
Pubblicazione: (2025)
ShiftySpeech: A Large-Scale Synthetic Speech Dataset with Distribution Shifts
di: Garg, Ashi, et al.
Pubblicazione: (2025)
di: Garg, Ashi, et al.
Pubblicazione: (2025)
Universal Speech Content Factorization
di: Xinyuan, Henry Li, et al.
Pubblicazione: (2026)
di: Xinyuan, Henry Li, et al.
Pubblicazione: (2026)
Can LLMs Help Localize Fake Words in Partially Fake Speech?
di: Zhang, Lin, et al.
Pubblicazione: (2026)
di: Zhang, Lin, et al.
Pubblicazione: (2026)
Integrated Spoofing-Robust Automatic Speaker Verification via a Three-Class Formulation and LLR
di: Tan, Kai, et al.
Pubblicazione: (2026)
di: Tan, Kai, et al.
Pubblicazione: (2026)
Acoustic modeling for Overlapping Speech Recognition: JHU Chime-5 Challenge System
di: Manohar, Vimal, et al.
Pubblicazione: (2024)
di: Manohar, Vimal, et al.
Pubblicazione: (2024)
On Speaker Attribution with SURT
di: Raj, Desh, et al.
Pubblicazione: (2024)
di: Raj, Desh, et al.
Pubblicazione: (2024)
HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation
di: Hussein, Amir, et al.
Pubblicazione: (2025)
di: Hussein, Amir, et al.
Pubblicazione: (2025)
Target Speaker ASR with Whisper
di: Polok, Alexander, et al.
Pubblicazione: (2024)
di: Polok, Alexander, et al.
Pubblicazione: (2024)
NPU-NTU System for Voice Privacy 2024 Challenge
di: Yao, Jixun, et al.
Pubblicazione: (2024)
di: Yao, Jixun, et al.
Pubblicazione: (2024)
The VoicePrivacy 2022 Challenge: Progress and Perspectives in Voice Anonymisation
di: Panariello, Michele, et al.
Pubblicazione: (2024)
di: Panariello, Michele, et al.
Pubblicazione: (2024)
DiffAnon: Diffusion-based Prosody Control for Voice Anonymization
di: Ulgen, Ismail Rasim, et al.
Pubblicazione: (2026)
di: Ulgen, Ismail Rasim, et al.
Pubblicazione: (2026)
The VoicePrivacy 2024 Challenge Evaluation Plan
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
CASPER: A Large Scale Spontaneous Speech Dataset
di: Xiao, Cihan, et al.
Pubblicazione: (2025)
di: Xiao, Cihan, et al.
Pubblicazione: (2025)
SE-DiCoW: Self-Enrolled Diarization-Conditioned Whisper
di: Polok, Alexander, et al.
Pubblicazione: (2026)
di: Polok, Alexander, et al.
Pubblicazione: (2026)
NTU-NPU System for Voice Privacy 2024 Challenge
di: Kuzmin, Nikita, et al.
Pubblicazione: (2024)
di: Kuzmin, Nikita, et al.
Pubblicazione: (2024)
Clean Label Attacks against SLU Systems
di: Xinyuan, Henry Li, et al.
Pubblicazione: (2024)
di: Xinyuan, Henry Li, et al.
Pubblicazione: (2024)
Improving Neural Biasing for Contextual Speech Recognition by Early Context Injection and Text Perturbation
di: Huang, Ruizhe, et al.
Pubblicazione: (2024)
di: Huang, Ruizhe, et al.
Pubblicazione: (2024)
The Database and Benchmark for the Source Speaker Tracing Challenge 2024
di: Li, Ze, et al.
Pubblicazione: (2024)
di: Li, Ze, et al.
Pubblicazione: (2024)
DiCoW: Diarization-Conditioned Whisper for Target Speaker Automatic Speech Recognition
di: Polok, Alexander, et al.
Pubblicazione: (2024)
di: Polok, Alexander, et al.
Pubblicazione: (2024)
Modeling Overlapped Speech with Shuffles
di: Wiesner, Matthew, et al.
Pubblicazione: (2026)
di: Wiesner, Matthew, et al.
Pubblicazione: (2026)
SpatialEmb: Extract and Encode Spatial Information for 1-Stage Multi-channel Multi-speaker ASR on Arbitrary Microphone Arrays
di: Shao, Yiwen, et al.
Pubblicazione: (2026)
di: Shao, Yiwen, et al.
Pubblicazione: (2026)
The Risks and Detection of Overestimated Privacy Protection in Voice Anonymisation
di: Panariello, Michele, et al.
Pubblicazione: (2025)
di: Panariello, Michele, et al.
Pubblicazione: (2025)
The Third VoicePrivacy Challenge: Preserving Emotional Expressiveness and Linguistic Content in Voice Anonymization
di: Tomashenko, Natalia, et al.
Pubblicazione: (2026)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2026)
Multi-Channel Multi-Speaker ASR Using Target Speaker's Solo Segment
di: Shao, Yiwen, et al.
Pubblicazione: (2024)
di: Shao, Yiwen, et al.
Pubblicazione: (2024)
Joint Optimization of ASV and CM tasks: BTUEF Team's Submission for WildSpoof Challenge
di: Kurnaz, Oguzhan, et al.
Pubblicazione: (2026)
di: Kurnaz, Oguzhan, et al.
Pubblicazione: (2026)
The VoiceMOS Challenge 2024: Beyond Speech Quality Prediction
di: Huang, Wen-Chin, et al.
Pubblicazione: (2024)
di: Huang, Wen-Chin, et al.
Pubblicazione: (2024)
Unsupervised Speech Enhancement using Data-defined Priors
di: Klement, Dominik, et al.
Pubblicazione: (2025)
di: Klement, Dominik, et al.
Pubblicazione: (2025)
Zero-Shot TTS With Enhanced Audio Prompts: Bsc Submission For The 2026 Wildspoof Challenge TTS Track
di: Giraldo, Jose, et al.
Pubblicazione: (2026)
di: Giraldo, Jose, et al.
Pubblicazione: (2026)
The First VoicePrivacy Attacker Challenge
di: Tomashenko, Natalia, et al.
Pubblicazione: (2025)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2025)
Dimensionality-Aware Anomaly Detection in Learned Representations of Self-Supervised Speech Models
di: Arcos-Holzinger, Sandra, et al.
Pubblicazione: (2026)
di: Arcos-Holzinger, Sandra, et al.
Pubblicazione: (2026)
SVDD 2024: The Inaugural Singing Voice Deepfake Detection Challenge
di: Zhang, You, et al.
Pubblicazione: (2024)
di: Zhang, You, et al.
Pubblicazione: (2024)
Self-supervised Reflective Learning through Self-distillation and Online Clustering for Speaker Representation Learning
di: Cai, Danwei, et al.
Pubblicazione: (2024)
di: Cai, Danwei, et al.
Pubblicazione: (2024)
Aligning Speech to Languages to Enhance Code-switching Speech Recognition
di: Liu, Hexin, et al.
Pubblicazione: (2024)
di: Liu, Hexin, et al.
Pubblicazione: (2024)
The First VoicePrivacy Attacker Challenge Evaluation Plan
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
Voice Privacy Preservation with Multiple Random Orthogonal Secret Keys: Attack Resistance Analysis
di: Tanaka, Kohei, et al.
Pubblicazione: (2025)
di: Tanaka, Kohei, et al.
Pubblicazione: (2025)
Natural Yet Challenging to Detect: Robust In-the-Wild TTS through EMA and Dual-Scoring Prompt Selection -- Submission for WildSpoof 2026 TTS Track
di: Sun, Renhe, et al.
Pubblicazione: (2026)
di: Sun, Renhe, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Rapidly Adapting to New Voice Spoofing: Few-Shot Detection of Synthesized Speech Under Distribution Shifts
di: Garg, Ashi, et al.
Pubblicazione: (2025) -
GenVC: Self-Supervised Zero-Shot Voice Conversion
di: Cai, Zexin, et al.
Pubblicazione: (2025) -
Privacy versus Emotion Preservation Trade-offs in Emotion-Preserving Speaker Anonymization
di: Cai, Zexin, et al.
Pubblicazione: (2024) -
Scalable Controllable Accented TTS
di: Xinyuan, Henry Li, et al.
Pubblicazione: (2025) -
ShiftySpeech: A Large-Scale Synthetic Speech Dataset with Distribution Shifts
di: Garg, Ashi, et al.
Pubblicazione: (2025)