AVT2-DWF: Improving Deepfake Detection with Audio-Visual Fusion and Dynamic Weighting Strategies
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Rui, Ye, Dengpan, Tang, Long, Zhang, Yunming, Deng, Jiacheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Take Fake as Real: Realistic-like Robust Black-box Adversarial Attack to Evade AIGC Detection
di: Xie, Caiyun, et al.
Pubblicazione: (2024)
di: Xie, Caiyun, et al.
Pubblicazione: (2024)
Trinity Detector:text-assisted and attention mechanisms based spectral fusion for diffusion generation image detection
di: Song, Jiawei, et al.
Pubblicazione: (2024)
di: Song, Jiawei, et al.
Pubblicazione: (2024)
StyleMark: A Robust Watermarking Method for Art Style Images Against Black-Box Arbitrary Style Transfer
di: Zhang, Yunming, et al.
Pubblicazione: (2024)
di: Zhang, Yunming, et al.
Pubblicazione: (2024)
DIP-Watermark: A Double Identity Protection Method Based on Robust Adversarial Watermark
di: Zhang, Yunming, et al.
Pubblicazione: (2024)
di: Zhang, Yunming, et al.
Pubblicazione: (2024)
Three-in-One: Robust Enhanced Universal Transferable Anti-Facial Retrieval in Online Social Networks
di: Lv, Yunna, et al.
Pubblicazione: (2024)
di: Lv, Yunna, et al.
Pubblicazione: (2024)
MA-AVT: Modality Alignment for Parameter-Efficient Audio-Visual Transformers
di: Mahmud, Tanvir, et al.
Pubblicazione: (2024)
di: Mahmud, Tanvir, et al.
Pubblicazione: (2024)
Tutor-Student Reinforcement Learning: A Dynamic Curriculum for Robust Deepfake Detection
di: Lei, Zhanhe, et al.
Pubblicazione: (2026)
di: Lei, Zhanhe, et al.
Pubblicazione: (2026)
Leave No Stone Unturned: Uncovering Holistic Audio-Visual Intrinsic Coherence for Deepfake Detection
di: Peng, Jielun, et al.
Pubblicazione: (2026)
di: Peng, Jielun, et al.
Pubblicazione: (2026)
ErasableMask: A Robust and Erasable Privacy Protection Scheme against Black-box Face Recognition Models
di: Shen, Sipeng, et al.
Pubblicazione: (2024)
di: Shen, Sipeng, et al.
Pubblicazione: (2024)
AVFF: Audio-Visual Feature Fusion for Video Deepfake Detection
di: Oorloff, Trevine, et al.
Pubblicazione: (2024)
di: Oorloff, Trevine, et al.
Pubblicazione: (2024)
FauForensics: Boosting Audio-Visual Deepfake Detection with Facial Action Units
di: Wang, Jian, et al.
Pubblicazione: (2025)
di: Wang, Jian, et al.
Pubblicazione: (2025)
LAVA: Layered Audio-Visual Anti-tampering Watermarking for Robust Deepfake Detection and Localization
di: Zeng, Bokang, et al.
Pubblicazione: (2026)
di: Zeng, Bokang, et al.
Pubblicazione: (2026)
Make the Most of Everything: Further Considerations on Disrupting Diffusion-based Customization
di: Tang, Long, et al.
Pubblicazione: (2025)
di: Tang, Long, et al.
Pubblicazione: (2025)
Rethinking Early-Fusion Strategies for Improved Multispectral Object Detection
di: Zhang, Xue, et al.
Pubblicazione: (2024)
di: Zhang, Xue, et al.
Pubblicazione: (2024)
KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features
di: Kukanov, Ivan, et al.
Pubblicazione: (2025)
di: Kukanov, Ivan, et al.
Pubblicazione: (2025)
Detecting Audio-Visual Deepfakes with Fine-Grained Inconsistencies
di: Astrid, Marcella, et al.
Pubblicazione: (2024)
di: Astrid, Marcella, et al.
Pubblicazione: (2024)
AV-Deepfake1M: A Large-Scale LLM-Driven Audio-Visual Deepfake Dataset
di: Cai, Zhixi, et al.
Pubblicazione: (2023)
di: Cai, Zhixi, et al.
Pubblicazione: (2023)
Towards Generalizable Deepfake Detection via Forgery-aware Audio-Visual Adaptation: A Variational Bayesian Approach
di: Nie, Fan, et al.
Pubblicazione: (2025)
di: Nie, Fan, et al.
Pubblicazione: (2025)
Improved Masked Image Generation with Knowledge-Augmented Token Representations
di: Liang, Guotao, et al.
Pubblicazione: (2025)
di: Liang, Guotao, et al.
Pubblicazione: (2025)
Dynamic Multi-Target Fusion for Efficient Audio-Visual Navigation
di: Yu, Yinfeng, et al.
Pubblicazione: (2025)
di: Yu, Yinfeng, et al.
Pubblicazione: (2025)
AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations
di: Cai, Zhixi, et al.
Pubblicazione: (2025)
di: Cai, Zhixi, et al.
Pubblicazione: (2025)
Audio Deepfake Detection with Half-Truth Localisation Using Cross-Attentive Feature Fusion
di: Sutharya, S., et al.
Pubblicazione: (2026)
di: Sutharya, S., et al.
Pubblicazione: (2026)
DTFSal: Audio-Visual Dynamic Token Fusion for Video Saliency Prediction
di: Hooshanfar, Kiana, et al.
Pubblicazione: (2025)
di: Hooshanfar, Kiana, et al.
Pubblicazione: (2025)
SELFI: Selective Fusion of Identity for Generalizable Deepfake Detection
di: Kim, Younghun, et al.
Pubblicazione: (2025)
di: Kim, Younghun, et al.
Pubblicazione: (2025)
X-AVDT: Audio-Visual Cross-Attention for Robust Deepfake Detection
di: Kim, Youngseo, et al.
Pubblicazione: (2026)
di: Kim, Youngseo, et al.
Pubblicazione: (2026)
Audio-Visual Deepfake Detection With Local Temporal Inconsistencies
di: Astrid, Marcella, et al.
Pubblicazione: (2025)
di: Astrid, Marcella, et al.
Pubblicazione: (2025)
A Novel Audio-Visual Information Fusion System for Mental Disorders Detection
di: Li, Yichun, et al.
Pubblicazione: (2024)
di: Li, Yichun, et al.
Pubblicazione: (2024)
D2Fusion: Dual-domain Fusion with Feature Superposition for Deepfake Detection
di: Qiu, Xueqi, et al.
Pubblicazione: (2025)
di: Qiu, Xueqi, et al.
Pubblicazione: (2025)
MUG: Pseudo Labeling Augmented Audio-Visual Mamba Network for Audio-Visual Video Parsing
di: Wang, Langyu, et al.
Pubblicazione: (2025)
di: Wang, Langyu, et al.
Pubblicazione: (2025)
Dynamic Inter-Class Confusion-Aware Encoder for Audio-Visual Fusion in Human Activity Recognition
di: Cong, Kaixuan, et al.
Pubblicazione: (2025)
di: Cong, Kaixuan, et al.
Pubblicazione: (2025)
Knowledge-Guided Prompt Learning for Deepfake Facial Image Detection
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
Efficient Audio-Visual Fusion for Video Classification
di: Awan, Mahrukh, et al.
Pubblicazione: (2024)
di: Awan, Mahrukh, et al.
Pubblicazione: (2024)
HOLA: Enhancing Audio-visual Deepfake Detection via Hierarchical Contextual Aggregations and Efficient Pre-training
di: Wu, Xuecheng, et al.
Pubblicazione: (2025)
di: Wu, Xuecheng, et al.
Pubblicazione: (2025)
CAT: Enhancing Multimodal Large Language Model to Answer Questions in Dynamic Audio-Visual Scenarios
di: Ye, Qilang, et al.
Pubblicazione: (2024)
di: Ye, Qilang, et al.
Pubblicazione: (2024)
Pindrop it! Audio and Visual Deepfake Countermeasures for Robust Detection and Fine Grained-Localization
di: Klein, Nicholas, et al.
Pubblicazione: (2025)
di: Klein, Nicholas, et al.
Pubblicazione: (2025)
Beyond the Final Layer: Hierarchical Query Fusion Transformer with Agent-Interpolation Initialization for 3D Instance Segmentation
di: Lu, Jiahao, et al.
Pubblicazione: (2025)
di: Lu, Jiahao, et al.
Pubblicazione: (2025)
Towards Improved Text-Aligned Codebook Learning: Multi-Hierarchical Codebook-Text Alignment with Long Text
di: Liang, Guotao, et al.
Pubblicazione: (2025)
di: Liang, Guotao, et al.
Pubblicazione: (2025)
Unleashing Vision-Language Semantics for Deepfake Video Detection
di: Zhu, Jiawen, et al.
Pubblicazione: (2026)
di: Zhu, Jiawen, et al.
Pubblicazione: (2026)
Exploring Active Data Selection Strategies for Continuous Training in Deepfake Detection
di: Furuhashi, Yoshihiko, et al.
Pubblicazione: (2025)
di: Furuhashi, Yoshihiko, et al.
Pubblicazione: (2025)
HFMF: Hierarchical Fusion Meets Multi-Stream Models for Deepfake Detection
di: Mehta, Anant, et al.
Pubblicazione: (2025)
di: Mehta, Anant, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Take Fake as Real: Realistic-like Robust Black-box Adversarial Attack to Evade AIGC Detection
di: Xie, Caiyun, et al.
Pubblicazione: (2024) -
Trinity Detector:text-assisted and attention mechanisms based spectral fusion for diffusion generation image detection
di: Song, Jiawei, et al.
Pubblicazione: (2024) -
StyleMark: A Robust Watermarking Method for Art Style Images Against Black-Box Arbitrary Style Transfer
di: Zhang, Yunming, et al.
Pubblicazione: (2024) -
DIP-Watermark: A Double Identity Protection Method Based on Robust Adversarial Watermark
di: Zhang, Yunming, et al.
Pubblicazione: (2024) -
Three-in-One: Robust Enhanced Universal Transferable Anti-Facial Retrieval in Online Social Networks
di: Lv, Yunna, et al.
Pubblicazione: (2024)