Privacy Disclosure of Similarity Rank in Speech and Language Processing
Fuente:
arXiv
Guardado en:
| Autores principales: | Bäckström, Tom, Vali, Mohammad Hassan, Nguyen, My, Rech, Silas |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Privacy in Speech Technology
por: Bäckström, Tom
Publicado: (2023)
por: Bäckström, Tom
Publicado: (2023)
Enhancement by postfiltering for speech and audio coding in ad-hoc sensor networks
por: Das, Sneha, et al.
Publicado: (2020)
por: Das, Sneha, et al.
Publicado: (2020)
Characterization of Speech Similarity Between Australian Aboriginal and High-Resource Languages: A Case Study on Dharawal
por: Dang, Ting, et al.
Publicado: (2025)
por: Dang, Ting, et al.
Publicado: (2025)
Examining the Interplay Between Privacy and Fairness for Speech Processing: A Review and Perspective
por: Leschanowsky, Anna, et al.
Publicado: (2024)
por: Leschanowsky, Anna, et al.
Publicado: (2024)
Evaluating voice anonymisation using similarity rank disclosure
por: Chandra, Shilpa, et al.
Publicado: (2026)
por: Chandra, Shilpa, et al.
Publicado: (2026)
Enhancement of Dysarthric Speech Reconstruction by Contrastive Learning
por: Fatemeh, Keshvari, et al.
Publicado: (2024)
por: Fatemeh, Keshvari, et al.
Publicado: (2024)
Speech Representation Analysis based on Inter- and Intra-Model Similarities
por: Kheir, Yassine El, et al.
Publicado: (2024)
por: Kheir, Yassine El, et al.
Publicado: (2024)
Aligning Speech to Languages to Enhance Code-switching Speech Recognition
por: Liu, Hexin, et al.
Publicado: (2024)
por: Liu, Hexin, et al.
Publicado: (2024)
Advances in Microphone Array Processing and Multichannel Speech Enhancement
por: Huang, Gongping, et al.
Publicado: (2025)
por: Huang, Gongping, et al.
Publicado: (2025)
Rethinking Mamba in Speech Processing by Self-Supervised Models
por: Zhang, Xiangyu, et al.
Publicado: (2024)
por: Zhang, Xiangyu, et al.
Publicado: (2024)
Cross-lingual Data Selection Using Clip-level Acoustic Similarity for Enhancing Low-resource Automatic Speech Recognition
por: Mitsumori, Shunsuke, et al.
Publicado: (2025)
por: Mitsumori, Shunsuke, et al.
Publicado: (2025)
Synthetic Speech Classification: IEEE Signal Processing Cup 2022 challenge
por: Rahmun, Mahieyin, et al.
Publicado: (2024)
por: Rahmun, Mahieyin, et al.
Publicado: (2024)
Speech-Omni-Lite: Portable Speech Interfaces for Vision-Language Models
por: Tao, Dehua, et al.
Publicado: (2026)
por: Tao, Dehua, et al.
Publicado: (2026)
LLMs and Speech: Integration vs. Combination
por: Schmitt, Robin, et al.
Publicado: (2026)
por: Schmitt, Robin, et al.
Publicado: (2026)
Brain-Informed Speech Separation for Cochlear Implants
por: Gajecki, Tom, et al.
Publicado: (2026)
por: Gajecki, Tom, et al.
Publicado: (2026)
Speech Token Prediction via Compressed-to-fine Language Modeling for Speech Generation
por: Liu, Wenrui, et al.
Publicado: (2025)
por: Liu, Wenrui, et al.
Publicado: (2025)
Interleaved Speech-Text Language Models for Simple Streaming Text-to-Speech Synthesis
por: Yang, Yifan, et al.
Publicado: (2024)
por: Yang, Yifan, et al.
Publicado: (2024)
Revisiting the Privacy of Low-Frequency Speech Signals: Exploring Resampling Methods, Evaluation Scenarios, and Speaker Characteristics
por: Pohlhausen, Jule, et al.
Publicado: (2025)
por: Pohlhausen, Jule, et al.
Publicado: (2025)
Adapting Speech Foundation Models for Unified Multimodal Speech Recognition with Large Language Models
por: Zhang, Jing-Xuan, et al.
Publicado: (2025)
por: Zhang, Jing-Xuan, et al.
Publicado: (2025)
Speculative Speech Recognition by Audio-Prefixed Low-Rank Adaptation of Language Models
por: Yusuf, Bolaji, et al.
Publicado: (2024)
por: Yusuf, Bolaji, et al.
Publicado: (2024)
VoxPrivacy: A Benchmark for Evaluating Interactional Privacy of Speech Language Models
por: Wang, Yuxiang, et al.
Publicado: (2026)
por: Wang, Yuxiang, et al.
Publicado: (2026)
Towards Automatic Assessment of Self-Supervised Speech Models using Rank
por: Aldeneh, Zakaria, et al.
Publicado: (2024)
por: Aldeneh, Zakaria, et al.
Publicado: (2024)
Few-shot Personalization via In-Context Learning for Speech Emotion Recognition based on Speech-Language Model
por: Ihori, Mana, et al.
Publicado: (2025)
por: Ihori, Mana, et al.
Publicado: (2025)
A Survey on Speech Large Language Models for Understanding
por: Peng, Jing, et al.
Publicado: (2024)
por: Peng, Jing, et al.
Publicado: (2024)
Improvement Speaker Similarity for Zero-Shot Any-to-Any Voice Conversion of Whispered and Regular Speech
por: Avdeeva, Anastasia, et al.
Publicado: (2024)
por: Avdeeva, Anastasia, et al.
Publicado: (2024)
URGENT-PK: Perceptually-Aligned Ranking Model Designed for Speech Enhancement Competition
por: Wang, Jiahe, et al.
Publicado: (2025)
por: Wang, Jiahe, et al.
Publicado: (2025)
MamTra: A Hybrid Mamba-Transformer Backbone for Speech Synthesis
por: Nguyen, Tan Dat, et al.
Publicado: (2026)
por: Nguyen, Tan Dat, et al.
Publicado: (2026)
Similarity Metrics For Late Reverberation
por: Santo, Gloria Dal, et al.
Publicado: (2024)
por: Santo, Gloria Dal, et al.
Publicado: (2024)
Multi-Axis Speech Similarity via Factor-Partitioned Embeddings
por: O'Regan, Jim, et al.
Publicado: (2026)
por: O'Regan, Jim, et al.
Publicado: (2026)
Content Leakage in LibriSpeech and Its Impact on the Privacy Evaluation of Speaker Anonymization
por: Franzreb, Carlos, et al.
Publicado: (2026)
por: Franzreb, Carlos, et al.
Publicado: (2026)
Towards Machine Unlearning for Paralinguistic Speech Processing
por: Phukan, Orchid Chetia, et al.
Publicado: (2025)
por: Phukan, Orchid Chetia, et al.
Publicado: (2025)
Can Large Language Models Aid in Annotating Speech Emotional Data? Uncovering New Frontiers
por: Latif, Siddique, et al.
Publicado: (2023)
por: Latif, Siddique, et al.
Publicado: (2023)
Non-Intrusive Automatic Speech Recognition Refinement: A Survey
por: Peyghan, Mohammad Reza, et al.
Publicado: (2025)
por: Peyghan, Mohammad Reza, et al.
Publicado: (2025)
Robust Speech and Natural Language Processing Models for Depression Screening
por: Lu, Y., et al.
Publicado: (2024)
por: Lu, Y., et al.
Publicado: (2024)
Collecting, Curating, and Annotating Good Quality Speech deepfake dataset for Famous Figures: Process and Challenges
por: Ali, Hashim, et al.
Publicado: (2025)
por: Ali, Hashim, et al.
Publicado: (2025)
Rethinking Processing Distortions: Disentangling the Impact of Speech Enhancement Errors on Speech Recognition Performance
por: Ochiai, Tsubasa, et al.
Publicado: (2024)
por: Ochiai, Tsubasa, et al.
Publicado: (2024)
Multi-stage Large Language Model Correction for Speech Recognition
por: Pu, Jie, et al.
Publicado: (2023)
por: Pu, Jie, et al.
Publicado: (2023)
DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action
por: Zhang, Haoyang, et al.
Publicado: (2026)
por: Zhang, Haoyang, et al.
Publicado: (2026)
Group Relative Policy Optimization for Text-to-Speech with Large Language Models
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
Large Language Model Guided Decoding for Self-Supervised Speech Recognition
por: Cohen, Eyal, et al.
Publicado: (2025)
por: Cohen, Eyal, et al.
Publicado: (2025)
Ejemplares similares
-
Privacy in Speech Technology
por: Bäckström, Tom
Publicado: (2023) -
Enhancement by postfiltering for speech and audio coding in ad-hoc sensor networks
por: Das, Sneha, et al.
Publicado: (2020) -
Characterization of Speech Similarity Between Australian Aboriginal and High-Resource Languages: A Case Study on Dharawal
por: Dang, Ting, et al.
Publicado: (2025) -
Examining the Interplay Between Privacy and Fairness for Speech Processing: A Review and Perspective
por: Leschanowsky, Anna, et al.
Publicado: (2024) -
Evaluating voice anonymisation using similarity rank disclosure
por: Chandra, Shilpa, et al.
Publicado: (2026)