Quantum Vision Theory Applied to Audio Classification for Deepfake Speech Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Zaman, Khalid, Sah, Melike, Chaiwongyenc, Anuwat, Direkoglu, Cem |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Spectro-Temporal Modulation Representation Framework for Human-Imitated Speech Detection
di: Zaman, Khalid, et al.
Pubblicazione: (2026)
di: Zaman, Khalid, et al.
Pubblicazione: (2026)
AUDDT: Audio Unified Deepfake Detection Benchmark Toolkit
di: Zhu, Yi, et al.
Pubblicazione: (2025)
di: Zhu, Yi, et al.
Pubblicazione: (2025)
Audios Don't Lie: Multi-Frequency Channel Attention Mechanism for Audio Deepfake Detection
di: Feng, Yangguang
Pubblicazione: (2024)
di: Feng, Yangguang
Pubblicazione: (2024)
ICLAD: In-Context Learning with Comparison-Guidance for Audio Deepfake Detection
di: Chou, Benjamin, et al.
Pubblicazione: (2026)
di: Chou, Benjamin, et al.
Pubblicazione: (2026)
ALLM4ADD: Unlocking the Capabilities of Audio Large Language Models for Audio Deepfake Detection
di: Gu, Hao, et al.
Pubblicazione: (2025)
di: Gu, Hao, et al.
Pubblicazione: (2025)
Classification of Spontaneous and Scripted Speech for Multilingual Audio
di: Elisha, Shahar, et al.
Pubblicazione: (2024)
di: Elisha, Shahar, et al.
Pubblicazione: (2024)
Deepfake Audio Detection Using Self-supervised Fusion Representations
di: Zaman, Khalid, et al.
Pubblicazione: (2026)
di: Zaman, Khalid, et al.
Pubblicazione: (2026)
SARA: Stress Test Reasoning in Audio Deepfake Detection
di: Nguyen, Binh, et al.
Pubblicazione: (2026)
di: Nguyen, Binh, et al.
Pubblicazione: (2026)
NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation
di: Xian, Huhong, et al.
Pubblicazione: (2025)
di: Xian, Huhong, et al.
Pubblicazione: (2025)
Bona fide Cross Testing Reveals Weak Spot in Audio Deepfake Detection Systems
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2025)
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2025)
Performance Analysis of Supervised Machine Learning Algorithms for Text Classification
di: Mishu, Sadia Zaman, et al.
Pubblicazione: (2025)
di: Mishu, Sadia Zaman, et al.
Pubblicazione: (2025)
Toward Transdisciplinary Approaches to Audio Deepfake Discernment
di: Janeja, Vandana P., et al.
Pubblicazione: (2024)
di: Janeja, Vandana P., et al.
Pubblicazione: (2024)
Interpretable Text Classification Applied to the Detection of LLM-generated Creative Writing
di: Suvanto, Minerva, et al.
Pubblicazione: (2026)
di: Suvanto, Minerva, et al.
Pubblicazione: (2026)
Do Compact SSL Backbones Matter for Audio Deepfake Detection? A Controlled Study with RAPTOR
di: Kulkarni, Ajinkya, et al.
Pubblicazione: (2026)
di: Kulkarni, Ajinkya, et al.
Pubblicazione: (2026)
ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances
di: Do, Huy Ba, et al.
Pubblicazione: (2025)
di: Do, Huy Ba, et al.
Pubblicazione: (2025)
Quantizer-Aware Hierarchical Neural Codec Modeling for Speech Deepfake Detection
di: Wu, Jinyang, et al.
Pubblicazione: (2026)
di: Wu, Jinyang, et al.
Pubblicazione: (2026)
Beyond Classification: Towards Speech Emotion Reasoning with Multitask AudioLLMs
di: Zhang, Wenyu, et al.
Pubblicazione: (2025)
di: Zhang, Wenyu, et al.
Pubblicazione: (2025)
WST-X Series: Wavelet Scattering Transform for Interpretable Speech Deepfake Detection
di: Xuan, Xi, et al.
Pubblicazione: (2026)
di: Xuan, Xi, et al.
Pubblicazione: (2026)
AudioInsight: Detecting Social Contexts Relevant to Social Anxiety from Speech
di: Reddy, Varun, et al.
Pubblicazione: (2024)
di: Reddy, Varun, et al.
Pubblicazione: (2024)
Joint Effects of Argumentation Theory, Audio Modality and Data Enrichment on LLM-Based Fallacy Classification
di: Zhou, Hongxu, et al.
Pubblicazione: (2025)
di: Zhou, Hongxu, et al.
Pubblicazione: (2025)
An Investigation Into Explainable Audio Hate Speech Detection
di: An, Jinmyeong, et al.
Pubblicazione: (2024)
di: An, Jinmyeong, et al.
Pubblicazione: (2024)
Disagreeing Rationales: Rethinking Classification and Explainability Evaluation in Hate Speech Detection
di: Muscato, Benedetta, et al.
Pubblicazione: (2026)
di: Muscato, Benedetta, et al.
Pubblicazione: (2026)
Common Sense Reasoning for Deepfake Detection
di: Zhang, Yue, et al.
Pubblicazione: (2024)
di: Zhang, Yue, et al.
Pubblicazione: (2024)
TRACE: Training-Free Partial Audio Deepfake Detection via Embedding Trajectory Analysis of Speech Foundation Models
di: Khan, Awais, et al.
Pubblicazione: (2026)
di: Khan, Awais, et al.
Pubblicazione: (2026)
Language Barriers: Evaluating Cross-Lingual Performance of CNN and Transformer Architectures for Speech Quality Estimation
di: Wardah, Wafaa, et al.
Pubblicazione: (2025)
di: Wardah, Wafaa, et al.
Pubblicazione: (2025)
Linguistic Analysis, Description, and Typological Exploration with Categorial Grammar (TheBench Guide)
di: Bozsahin, Cem
Pubblicazione: (2024)
di: Bozsahin, Cem
Pubblicazione: (2024)
Cracking the Code: Enhancing Implicit Hate Speech Detection through Coding Classification
di: Wei, Lu, et al.
Pubblicazione: (2025)
di: Wei, Lu, et al.
Pubblicazione: (2025)
Cocktail-Party Audio-Visual Speech Recognition
di: Nguyen, Thai-Binh, et al.
Pubblicazione: (2025)
di: Nguyen, Thai-Binh, et al.
Pubblicazione: (2025)
WaveSP-Net: Learnable Wavelet-Domain Sparse Prompt Tuning for Speech Deepfake Detection
di: Xuan, Xi, et al.
Pubblicazione: (2025)
di: Xuan, Xi, et al.
Pubblicazione: (2025)
Revealing the Truth with ConLLM for Detecting Multi-Modal Deepfakes
di: Kashyap, Gautam Siddharth, et al.
Pubblicazione: (2026)
di: Kashyap, Gautam Siddharth, et al.
Pubblicazione: (2026)
Hate Speech Detection and Classification in Amharic Text with Deep Learning
di: Gashe, Samuel Minale, et al.
Pubblicazione: (2024)
di: Gashe, Samuel Minale, et al.
Pubblicazione: (2024)
Multilingual Source Tracing of Speech Deepfakes: A First Benchmark
di: Xuan, Xi, et al.
Pubblicazione: (2025)
di: Xuan, Xi, et al.
Pubblicazione: (2025)
Developing a Comprehensive Framework for Sentiment Analysis in Turkish
di: Aydin, Cem Rifki
Pubblicazione: (2025)
di: Aydin, Cem Rifki
Pubblicazione: (2025)
Mobile Sequencers
di: Bozsahin, Cem
Pubblicazione: (2024)
di: Bozsahin, Cem
Pubblicazione: (2024)
SpeechR: A Benchmark for Speech Reasoning in Large Audio-Language Models
di: Yang, Wanqi, et al.
Pubblicazione: (2025)
di: Yang, Wanqi, et al.
Pubblicazione: (2025)
Watch and Listen: Understanding Audio-Visual-Speech Moments with Multimodal LLM
di: Li, Zinuo, et al.
Pubblicazione: (2025)
di: Li, Zinuo, et al.
Pubblicazione: (2025)
Multi3Hate: Multimodal, Multilingual, and Multicultural Hate Speech Detection with Vision-Language Models
di: Bui, Minh Duc, et al.
Pubblicazione: (2024)
di: Bui, Minh Duc, et al.
Pubblicazione: (2024)
ALAS: Measuring Latent Speech-Text Alignment For Spoken Language Understanding In Multimodal LLMs
di: Mousavi, Pooneh, et al.
Pubblicazione: (2025)
di: Mousavi, Pooneh, et al.
Pubblicazione: (2025)
XMAD-Bench: Cross-Domain Multilingual Audio Deepfake Benchmark
di: Ciobanu, Ioan-Paul, et al.
Pubblicazione: (2025)
di: Ciobanu, Ioan-Paul, et al.
Pubblicazione: (2025)
WavSLM: Single-Stream Speech Language Modeling via WavLM Distillation
di: Della Libera, Luca, et al.
Pubblicazione: (2026)
di: Della Libera, Luca, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Spectro-Temporal Modulation Representation Framework for Human-Imitated Speech Detection
di: Zaman, Khalid, et al.
Pubblicazione: (2026) -
AUDDT: Audio Unified Deepfake Detection Benchmark Toolkit
di: Zhu, Yi, et al.
Pubblicazione: (2025) -
Audios Don't Lie: Multi-Frequency Channel Attention Mechanism for Audio Deepfake Detection
di: Feng, Yangguang
Pubblicazione: (2024) -
ICLAD: In-Context Learning with Comparison-Guidance for Audio Deepfake Detection
di: Chou, Benjamin, et al.
Pubblicazione: (2026) -
ALLM4ADD: Unlocking the Capabilities of Audio Large Language Models for Audio Deepfake Detection
di: Gu, Hao, et al.
Pubblicazione: (2025)