Zero-Shot to Zero-Lies: Detecting Bengali Deepfake Audio through Transfer Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Samu, Most. Sharmin Sultana, Islam, Md. Rakibul, Hossain, Md. Zahid, Bhuiyan, Md. Kamrozzaman, Zaman, Farhad Uz |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Detecting AI-Generated Paraphrases in Bengali: A Comparative Study of Zero-Shot and Fine-Tuned Transformers
par: Islam, Md. Rakibul, et autres
Publié: (2025)
par: Islam, Md. Rakibul, et autres
Publié: (2025)
FUSE: Unifying Spectral and Semantic Cues for Robust AI-Generated Image Detection
par: Hossain, Md. Zahid, et autres
Publié: (2025)
par: Hossain, Md. Zahid, et autres
Publié: (2025)
BeHGAN: Bengali Handwritten Word Generation from Plain Text Using Generative Adversarial Networks
par: Islam, Md. Rakibul, et autres
Publié: (2025)
par: Islam, Md. Rakibul, et autres
Publié: (2025)
Explainable AI-Driven Detection of Human Monkeypox Using Deep Learning and Vision Transformers: A Comprehensive Analysis
par: Hossain, Md. Zahid, et autres
Publié: (2025)
par: Hossain, Md. Zahid, et autres
Publié: (2025)
Privacy-Preserving Chest X-ray Report Generation via Multimodal Federated Learning with ViT and GPT-2
par: Hossain, Md. Zahid, et autres
Publié: (2025)
par: Hossain, Md. Zahid, et autres
Publié: (2025)
Vision-Language Models for Automated Chest X-ray Interpretation: Leveraging ViT and GPT-2
par: Islam, Md. Rakibul, et autres
Publié: (2025)
par: Islam, Md. Rakibul, et autres
Publié: (2025)
A Two-Stage Multitask Vision-Language Framework for Explainable Crop Disease Visual Question Answering
par: Hossain, Md. Zahid, et autres
Publié: (2026)
par: Hossain, Md. Zahid, et autres
Publié: (2026)
When Denoising Hinders: Revisiting Zero-Shot ASR with SAM-Audio and Whisper
par: Islam, Akif, et autres
Publié: (2026)
par: Islam, Akif, et autres
Publié: (2026)
From Automation to Collaboration: Human-in-the-Loop Methods for Safe and Trustworthy NLP
par: Samu, Most. Sharmin Sultana, et autres
Publié: (2026)
par: Samu, Most. Sharmin Sultana, et autres
Publié: (2026)
An Investigation Into Various Approaches For Bengali Long-Form Speech Transcription and Bengali Speaker Diarization
par: Jahan, Epshita, et autres
Publié: (2026)
par: Jahan, Epshita, et autres
Publié: (2026)
Frequency-Specific Neural Response and Cross-Correlation Analysis of Envelope Following Responses to Native Speech and Music Using Multichannel EEG Signals: A Case Study
par: Hasan, Md. Mahbub, et autres
Publié: (2025)
par: Hasan, Md. Mahbub, et autres
Publié: (2025)
Explainable Multi-Modal Deep Learning for Automatic Detection of Lung Diseases from Respiratory Audio Signals
par: Saky, S M Asiful Islam, et autres
Publié: (2025)
par: Saky, S M Asiful Islam, et autres
Publié: (2025)
Exploring Green AI for Audio Deepfake Detection
par: Saha, Subhajit, et autres
Publié: (2024)
par: Saha, Subhajit, et autres
Publié: (2024)
Zero Shot Audio to Audio Emotion Transfer With Speaker Disentanglement
par: Dutta, Soumya, et autres
Publié: (2024)
par: Dutta, Soumya, et autres
Publié: (2024)
FunnelNet: An End-to-End Deep Learning Framework to Monitor Digital Heart Murmur in Real-Time
par: Jobayer, Md, et autres
Publié: (2024)
par: Jobayer, Md, et autres
Publié: (2024)
Artificial Neural Networks to Recognize Speakers Division from Continuous Bengali Speech
par: Ali, Hasmot, et autres
Publié: (2024)
par: Ali, Hasmot, et autres
Publié: (2024)
Quantum Kernels for Audio Deepfake Detection Using Spectrogram Patch Features
par: Amin, Lisan Al, et autres
Publié: (2026)
par: Amin, Lisan Al, et autres
Publié: (2026)
Deepfake Audio Detection Using Self-supervised Fusion Representations
par: Zaman, Khalid, et autres
Publié: (2026)
par: Zaman, Khalid, et autres
Publié: (2026)
SS-DPPN: A self-supervised dual-path foundation model for the generalizable cardiac audio representation
par: Muna, Ummy Maria, et autres
Publié: (2025)
par: Muna, Ummy Maria, et autres
Publié: (2025)
A Cascaded Architecture for Extractive Summarization of Multimedia Content via Audio-to-Text Alignment
par: Hossain, Tanzir, et autres
Publié: (2025)
par: Hossain, Tanzir, et autres
Publié: (2025)
Emotion Detection in Speech Using Lightweight and Transformer-Based Models: A Comparative and Ablation Study
par: Onyekwelu-Udoka, Lucky, et autres
Publié: (2025)
par: Onyekwelu-Udoka, Lucky, et autres
Publié: (2025)
A Novel Transfer Learning Approach for Mental Stability Classification from Voice Signal
par: Islam, Rafiul, et autres
Publié: (2026)
par: Islam, Rafiul, et autres
Publié: (2026)
Multimodal Zero-Shot Framework for Deepfake Hate Speech Detection in Low-Resource Languages
par: Ranjan, Rishabh, et autres
Publié: (2025)
par: Ranjan, Rishabh, et autres
Publié: (2025)
Zero-Shot Fake Video Detection by Audio-Visual Consistency
par: Li, Xiaolou, et autres
Publié: (2024)
par: Li, Xiaolou, et autres
Publié: (2024)
AI as Teammate or Tool? A Review of Human-AI Interaction in Decision Support
par: Samu, Most. Sharmin Sultana, et autres
Publié: (2026)
par: Samu, Most. Sharmin Sultana, et autres
Publié: (2026)
Transferable Adversarial Attacks on Audio Deepfake Detection
par: Farooq, Muhammad Umar, et autres
Publié: (2025)
par: Farooq, Muhammad Umar, et autres
Publié: (2025)
DeepAgent: A Dual Stream Multi Agent Fusion for Robust Multimodal Deepfake Detection
par: Zaman, Sayeem Been, et autres
Publié: (2025)
par: Zaman, Sayeem Been, et autres
Publié: (2025)
Bengali-Loop: Community Benchmarks for Long-Form Bangla ASR and Speaker Diarization
par: Tabib, H. M. Shadman, et autres
Publié: (2026)
par: Tabib, H. M. Shadman, et autres
Publié: (2026)
Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?
par: Dutta, Bikash, et autres
Publié: (2025)
par: Dutta, Bikash, et autres
Publié: (2025)
BanglaFake: Constructing and Evaluating a Specialized Bengali Deepfake Audio Dataset
par: Fahad, Istiaq Ahmed, et autres
Publié: (2025)
par: Fahad, Istiaq Ahmed, et autres
Publié: (2025)
Improving Audio Classification by Transitioning from Zero- to Few-Shot
par: Taylor, James, et autres
Publié: (2025)
par: Taylor, James, et autres
Publié: (2025)
ChildAugment: Data Augmentation Methods for Zero-Resource Children's Speaker Verification
par: Singh, Vishwanath Pratap, et autres
Publié: (2024)
par: Singh, Vishwanath Pratap, et autres
Publié: (2024)
Audios Don't Lie: Multi-Frequency Channel Attention Mechanism for Audio Deepfake Detection
par: Feng, Yangguang
Publié: (2024)
par: Feng, Yangguang
Publié: (2024)
Zero-Shot Audio Captioning Using Soft and Hard Prompts
par: Zhang, Yiming, et autres
Publié: (2024)
par: Zhang, Yiming, et autres
Publié: (2024)
Adaptive Test-Time Scaling for Zero-Shot Respiratory Audio Classification
par: Wang, Tsai-Ning, et autres
Publié: (2026)
par: Wang, Tsai-Ning, et autres
Publié: (2026)
On Class Separability Pitfalls In Audio-Text Contrastive Zero-Shot Learning
par: Tavares, Tiago, et autres
Publié: (2024)
par: Tavares, Tiago, et autres
Publié: (2024)
MusicDET: Zero-Shot AI-Generated Music Detection
par: Han, Chaolei, et autres
Publié: (2026)
par: Han, Chaolei, et autres
Publié: (2026)
PAT: Parameter-Free Audio-Text Aligner to Boost Zero-Shot Audio Classification
par: Seth, Ashish, et autres
Publié: (2024)
par: Seth, Ashish, et autres
Publié: (2024)
Listenable Maps for Zero-Shot Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)
par: Paissan, Francesco, et autres
Publié: (2024)
Generalizable Detection of Audio Deepfakes
par: Lopez, Jose A., et autres
Publié: (2025)
par: Lopez, Jose A., et autres
Publié: (2025)
Documents similaires
-
Detecting AI-Generated Paraphrases in Bengali: A Comparative Study of Zero-Shot and Fine-Tuned Transformers
par: Islam, Md. Rakibul, et autres
Publié: (2025) -
FUSE: Unifying Spectral and Semantic Cues for Robust AI-Generated Image Detection
par: Hossain, Md. Zahid, et autres
Publié: (2025) -
BeHGAN: Bengali Handwritten Word Generation from Plain Text Using Generative Adversarial Networks
par: Islam, Md. Rakibul, et autres
Publié: (2025) -
Explainable AI-Driven Detection of Human Monkeypox Using Deep Learning and Vision Transformers: A Comprehensive Analysis
par: Hossain, Md. Zahid, et autres
Publié: (2025) -
Privacy-Preserving Chest X-ray Report Generation via Multimodal Federated Learning with ViT and GPT-2
par: Hossain, Md. Zahid, et autres
Publié: (2025)