Quantum-Inspired Audio Unlearning: Towards Privacy-Preserving Voice Biometrics
Fuente:
arXiv
Guardado en:
| Autores principales: | Pathak, Shreyansh, Shreshtha, Sonu, Singh, Richa, Vatsa, Mayank |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SynHate: Detecting Hate Speech in Synthetic Deepfake Audio
por: Ranjan, Rishabh, et al.
Publicado: (2025)
por: Ranjan, Rishabh, et al.
Publicado: (2025)
Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?
por: Dutta, Bikash, et al.
Publicado: (2025)
por: Dutta, Bikash, et al.
Publicado: (2025)
Multimodal Zero-Shot Framework for Deepfake Hate Speech Detection in Low-Resource Languages
por: Ranjan, Rishabh, et al.
Publicado: (2025)
por: Ranjan, Rishabh, et al.
Publicado: (2025)
LAPS-Diff: A Diffusion-Based Framework for Singing Voice Synthesis With Language Aware Prosody-Style Guided Learning
por: Dhar, Sandipan, et al.
Publicado: (2025)
por: Dhar, Sandipan, et al.
Publicado: (2025)
Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech
por: Kim, Taesoo, et al.
Publicado: (2025)
por: Kim, Taesoo, et al.
Publicado: (2025)
VoiceShop: A Unified Speech-to-Speech Framework for Identity-Preserving Zero-Shot Voice Editing
por: Anastassiou, Philip, et al.
Publicado: (2024)
por: Anastassiou, Philip, et al.
Publicado: (2024)
Towards Privacy-Preserving Audio Classification Systems
por: Chhaglani, Bhawana, et al.
Publicado: (2024)
por: Chhaglani, Bhawana, et al.
Publicado: (2024)
Prosody-Adaptable Audio Codecs for Zero-Shot Voice Conversion via In-Context Learning
por: Zhao, Junchuan, et al.
Publicado: (2025)
por: Zhao, Junchuan, et al.
Publicado: (2025)
RBA-FE: A Robust Brain-Inspired Audio Feature Extractor for Depression Diagnosis
por: Wu, Yu-Xuan, et al.
Publicado: (2025)
por: Wu, Yu-Xuan, et al.
Publicado: (2025)
Audio-to-Image Encoding for Improved Voice Characteristic Detection Using Deep Convolutional Neural Networks
por: Atif, Youness
Publicado: (2025)
por: Atif, Youness
Publicado: (2025)
Towards Controllable Audio Texture Morphing
por: Gupta, Chitralekha, et al.
Publicado: (2023)
por: Gupta, Chitralekha, et al.
Publicado: (2023)
FunAudioLLM: Voice Understanding and Generation Foundation Models for Natural Interaction Between Humans and LLMs
por: An, Keyu, et al.
Publicado: (2024)
por: An, Keyu, et al.
Publicado: (2024)
WavShape: Information-Theoretic Speech Representation Learning for Fair and Privacy-Aware Audio Processing
por: Baser, Oguzhan, et al.
Publicado: (2025)
por: Baser, Oguzhan, et al.
Publicado: (2025)
EZ-VC: Easy Zero-shot Any-to-Any Voice Conversion
por: Joglekar, Advait, et al.
Publicado: (2025)
por: Joglekar, Advait, et al.
Publicado: (2025)
FusionAudio-1.2M: Towards Fine-grained Audio Captioning with Multimodal Contextual Fusion
por: Chen, Shunian, et al.
Publicado: (2025)
por: Chen, Shunian, et al.
Publicado: (2025)
Towards Better Disentanglement in Non-Autoregressive Zero-Shot Expressive Voice Conversion
por: Akti, Seymanur, et al.
Publicado: (2025)
por: Akti, Seymanur, et al.
Publicado: (2025)
Tuning Music Education: AI-Powered Personalization in Learning Music
por: Sanganeria, Mayank, et al.
Publicado: (2024)
por: Sanganeria, Mayank, et al.
Publicado: (2024)
TTMBA: Towards Text To Multiple Sources Binaural Audio Generation
por: He, Yuxuan, et al.
Publicado: (2025)
por: He, Yuxuan, et al.
Publicado: (2025)
Towards Attention-based Contrastive Learning for Audio Spoof Detection
por: Goel, Chirag, et al.
Publicado: (2024)
por: Goel, Chirag, et al.
Publicado: (2024)
SafeEar: Content Privacy-Preserving Audio Deepfake Detection
por: Li, Xinfeng, et al.
Publicado: (2024)
por: Li, Xinfeng, et al.
Publicado: (2024)
SoulX-Singer: Towards High-Quality Zero-Shot Singing Voice Synthesis
por: Qian, Jiale, et al.
Publicado: (2026)
por: Qian, Jiale, et al.
Publicado: (2026)
Towards Leveraging Contrastively Pretrained Neural Audio Embeddings for Recommender Tasks
por: Grötschla, Florian, et al.
Publicado: (2024)
por: Grötschla, Florian, et al.
Publicado: (2024)
Quantum-Inspired Genetic Algorithm for Robust Source Separation in Smart City Acoustics
por: Quan, Minh K., et al.
Publicado: (2025)
por: Quan, Minh K., et al.
Publicado: (2025)
CosyVoice 3: Towards In-the-wild Speech Generation via Scaling-up and Post-training
por: Du, Zhihao, et al.
Publicado: (2025)
por: Du, Zhihao, et al.
Publicado: (2025)
LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging
por: Singh, Shubhr, et al.
Publicado: (2025)
por: Singh, Shubhr, et al.
Publicado: (2025)
R2-SVC: Towards Real-World Robust and Expressive Zero-shot Singing Voice Conversion
por: Zheng, Junjie, et al.
Publicado: (2025)
por: Zheng, Junjie, et al.
Publicado: (2025)
HQ-SVC: Towards High-Quality Zero-Shot Singing Voice Conversion in Low-Resource Scenarios
por: Bai, Bingsong, et al.
Publicado: (2025)
por: Bai, Bingsong, et al.
Publicado: (2025)
Audio Mamba: Pretrained Audio State Space Model For Audio Tagging
por: Lin, Jiaju, et al.
Publicado: (2024)
por: Lin, Jiaju, et al.
Publicado: (2024)
Audio Deepfake Detection in the Age of Advanced Text-to-Speech models
por: Singh, Robin, et al.
Publicado: (2026)
por: Singh, Robin, et al.
Publicado: (2026)
The Sounds of Home: A Speech-Removed Residential Audio Dataset for Sound Event Detection
por: Bibbó, Gabriel, et al.
Publicado: (2024)
por: Bibbó, Gabriel, et al.
Publicado: (2024)
Audio Atlas: Visualizing and Exploring Audio Datasets
por: Lanzendörfer, Luca A., et al.
Publicado: (2024)
por: Lanzendörfer, Luca A., et al.
Publicado: (2024)
VoiceGRPO: Modern MoE Transformers with Group Relative Policy Optimization GRPO for AI Voice Health Care Applications on Voice Pathology Detection
por: Togootogtokh, Enkhtogtokh, et al.
Publicado: (2025)
por: Togootogtokh, Enkhtogtokh, et al.
Publicado: (2025)
Voice Cloning: Comprehensive Survey
por: Azzuni, Hussam, et al.
Publicado: (2025)
por: Azzuni, Hussam, et al.
Publicado: (2025)
Do Music Source Separation Models Preserve Spatial Information in Binaural Audio?
por: Namballa, Richa, et al.
Publicado: (2025)
por: Namballa, Richa, et al.
Publicado: (2025)
Representation-Regularized Convolutional Audio Transformer for Audio Understanding
por: Han, Bing, et al.
Publicado: (2026)
por: Han, Bing, et al.
Publicado: (2026)
Audio Spatially-Guided Fusion for Audio-Visual Navigation
por: Zhou, Xinyu, et al.
Publicado: (2026)
por: Zhou, Xinyu, et al.
Publicado: (2026)
Voice EHR: Introducing Multimodal Audio Data for Health
por: Anibal, James, et al.
Publicado: (2024)
por: Anibal, James, et al.
Publicado: (2024)
EnCLAP: Combining Neural Audio Codec and Audio-Text Joint Embedding for Automated Audio Captioning
por: Kim, Jaeyeon, et al.
Publicado: (2024)
por: Kim, Jaeyeon, et al.
Publicado: (2024)
AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion
por: Zhao, Junqi, et al.
Publicado: (2025)
por: Zhao, Junqi, et al.
Publicado: (2025)
DreamAudio: Customized Text-to-Audio Generation with Diffusion Models
por: Yuan, Yi, et al.
Publicado: (2025)
por: Yuan, Yi, et al.
Publicado: (2025)
Ejemplares similares
-
SynHate: Detecting Hate Speech in Synthetic Deepfake Audio
por: Ranjan, Rishabh, et al.
Publicado: (2025) -
Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?
por: Dutta, Bikash, et al.
Publicado: (2025) -
Multimodal Zero-Shot Framework for Deepfake Hate Speech Detection in Low-Resource Languages
por: Ranjan, Rishabh, et al.
Publicado: (2025) -
LAPS-Diff: A Diffusion-Based Framework for Singing Voice Synthesis With Language Aware Prosody-Style Guided Learning
por: Dhar, Sandipan, et al.
Publicado: (2025) -
Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech
por: Kim, Taesoo, et al.
Publicado: (2025)