Copy-Move Forgery Detection and Question Answering for Remote Sensing Image
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Ze, Zhao, Enyuan, Niu, Di, Nie, Jie, Liang, Xinyue, Huang, Lei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Challenging Dataset and Multi-modal Gated Mixture of Experts Model for Remote Sensing Copy-Move Forgery Understanding
di: Zhang, Ze, et al.
Pubblicazione: (2025)
di: Zhang, Ze, et al.
Pubblicazione: (2025)
An Effective Image Copy-Move Forgery Detection Using Entropy Information
di: Jiang, Li, et al.
Pubblicazione: (2023)
di: Jiang, Li, et al.
Pubblicazione: (2023)
Towards Generalizable Deepfake Detection via Forgery-aware Audio-Visual Adaptation: A Variational Bayesian Approach
di: Nie, Fan, et al.
Pubblicazione: (2025)
di: Nie, Fan, et al.
Pubblicazione: (2025)
Towards Open-Vocabulary Remote Sensing Image Semantic Segmentation
di: Ye, Chengyang, et al.
Pubblicazione: (2024)
di: Ye, Chengyang, et al.
Pubblicazione: (2024)
TMFNet: Two-Stream Multi-Channels Fusion Networks for Color Image Operation Chain Detection
di: Niu, Yakun, et al.
Pubblicazione: (2024)
di: Niu, Yakun, et al.
Pubblicazione: (2024)
Continual Panoptic Perception: Towards Multi-modal Incremental Interpretation of Remote Sensing Images
di: Yuan, Bo, et al.
Pubblicazione: (2024)
di: Yuan, Bo, et al.
Pubblicazione: (2024)
Band-Attention Modulated RetNet for Face Forgery Detection
di: Zhang, Zhida, et al.
Pubblicazione: (2024)
di: Zhang, Zhida, et al.
Pubblicazione: (2024)
Generalized Face Forgery Detection via Adaptive Learning for Pre-trained Vision Transformer
di: Luo, Anwei, et al.
Pubblicazione: (2023)
di: Luo, Anwei, et al.
Pubblicazione: (2023)
Transcending Fusion: A Multi-Scale Alignment Method for Remote Sensing Image-Text Retrieval
di: Yang, Rui, et al.
Pubblicazione: (2024)
di: Yang, Rui, et al.
Pubblicazione: (2024)
Representation Discrepancy Bridging Method for Remote Sensing Image-Text Retrieval
di: Ning, Hailong, et al.
Pubblicazione: (2025)
di: Ning, Hailong, et al.
Pubblicazione: (2025)
Inclusion 2024 Global Multimedia Deepfake Detection Challenge: Towards Multi-dimensional Face Forgery Detection
di: Zhang, Yi, et al.
Pubblicazione: (2024)
di: Zhang, Yi, et al.
Pubblicazione: (2024)
VideoForest: Person-Anchored Hierarchical Reasoning for Cross-Video Question Answering
di: Meng, Yiran, et al.
Pubblicazione: (2025)
di: Meng, Yiran, et al.
Pubblicazione: (2025)
Towards Flexible Evaluation for Generative Visual Question Answering
di: Ji, Huishan, et al.
Pubblicazione: (2024)
di: Ji, Huishan, et al.
Pubblicazione: (2024)
Patch-level Sounding Object Tracking for Audio-Visual Question Answering
di: Li, Zhangbin, et al.
Pubblicazione: (2024)
di: Li, Zhangbin, et al.
Pubblicazione: (2024)
SM3Det: A Unified Model for Multi-Modal Remote Sensing Object Detection
di: Li, Yuxuan, et al.
Pubblicazione: (2024)
di: Li, Yuxuan, et al.
Pubblicazione: (2024)
Generalizable Deepfake Detection Based on Forgery-aware Layer Masking and Multi-artifact Subspace Decomposition
di: Zhang, Xiang, et al.
Pubblicazione: (2026)
di: Zhang, Xiang, et al.
Pubblicazione: (2026)
PolySmart @ TRECVid 2024 Medical Video Question Answering
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
Scene-Text Grounding for Text-Based Video Question Answering
di: Zhou, Sheng, et al.
Pubblicazione: (2024)
di: Zhou, Sheng, et al.
Pubblicazione: (2024)
Listening Deepfake Detection: A New Perspective Beyond Speaking-Centric Forgery Analysis
di: Liu, Miao, et al.
Pubblicazione: (2026)
di: Liu, Miao, et al.
Pubblicazione: (2026)
MEGC2025: Micro-Expression Grand Challenge on Spot Then Recognize and Visual Question Answering
di: Fan, Xinqi, et al.
Pubblicazione: (2025)
di: Fan, Xinqi, et al.
Pubblicazione: (2025)
MEGC2026: Micro-Expression Grand Challenge on Visual Question Answering
di: Fan, Xinqi, et al.
Pubblicazione: (2026)
di: Fan, Xinqi, et al.
Pubblicazione: (2026)
POVQA: Preference-Optimized Video Question Answering with Rationales for Data Efficiency
di: Dahal, Ashim, et al.
Pubblicazione: (2025)
di: Dahal, Ashim, et al.
Pubblicazione: (2025)
Object-level Copy-Move Forgery Image Detection based on Inconsistency Mining
di: Wang, Jingyu, et al.
Pubblicazione: (2024)
di: Wang, Jingyu, et al.
Pubblicazione: (2024)
Boosting Audio Visual Question Answering via Key Semantic-Aware Cues
di: Li, Guangyao, et al.
Pubblicazione: (2024)
di: Li, Guangyao, et al.
Pubblicazione: (2024)
VidCtx: Context-aware Video Question Answering with Image Models
di: Goulas, Andreas, et al.
Pubblicazione: (2024)
di: Goulas, Andreas, et al.
Pubblicazione: (2024)
DMC$^3$: Dual-Modal Counterfactual Contrastive Construction for Egocentric Video Question Answering
di: Zou, Jiayi, et al.
Pubblicazione: (2025)
di: Zou, Jiayi, et al.
Pubblicazione: (2025)
EgoTextVQA: Towards Egocentric Scene-Text Aware Video Question Answering
di: Zhou, Sheng, et al.
Pubblicazione: (2025)
di: Zhou, Sheng, et al.
Pubblicazione: (2025)
Question-Answering Dense Video Events
di: Qin, Hangyu, et al.
Pubblicazione: (2024)
di: Qin, Hangyu, et al.
Pubblicazione: (2024)
Towards Signboard-Oriented Visual Question Answering: ViSignVQA Dataset, Method and Benchmark
di: Nguyen, Hieu Minh, et al.
Pubblicazione: (2025)
di: Nguyen, Hieu Minh, et al.
Pubblicazione: (2025)
Enhancing Generalization in Medical Visual Question Answering Tasks via Gradient-Guided Model Perturbation
di: Liu, Gang, et al.
Pubblicazione: (2024)
di: Liu, Gang, et al.
Pubblicazione: (2024)
Knowledge Acquisition Disentanglement for Knowledge-based Visual Question Answering with Large Language Models
di: An, Wenbin, et al.
Pubblicazione: (2024)
di: An, Wenbin, et al.
Pubblicazione: (2024)
Self-similarity Prior Distillation for Unsupervised Remote Physiological Measurement
di: Zhang, Xinyu, et al.
Pubblicazione: (2023)
di: Zhang, Xinyu, et al.
Pubblicazione: (2023)
Mitigating Easy Option Bias in Multiple-Choice Question Answering
di: Zhang, Hao, et al.
Pubblicazione: (2025)
di: Zhang, Hao, et al.
Pubblicazione: (2025)
Navigating the Mirage: A Dual-Path Agentic Framework for Robust Misleading Chart Question Answering
di: Zhang, Yanjie, et al.
Pubblicazione: (2026)
di: Zhang, Yanjie, et al.
Pubblicazione: (2026)
Cross-Modal and Uni-Modal Soft-Label Alignment for Image-Text Retrieval
di: Huang, Hailang, et al.
Pubblicazione: (2024)
di: Huang, Hailang, et al.
Pubblicazione: (2024)
SFFNet: Synergistic Feature Fusion Network With Dual-Domain Edge Enhancement for UAV Image Object Detection
di: Zhang, Wenfeng, et al.
Pubblicazione: (2026)
di: Zhang, Wenfeng, et al.
Pubblicazione: (2026)
On the Robustness of Human-Object Interaction Detection against Distribution Shift
di: Xie, Chi, et al.
Pubblicazione: (2025)
di: Xie, Chi, et al.
Pubblicazione: (2025)
PMPGuard: Catching Pseudo-Matched Pairs in Remote Sensing Image-Text Retrieval
di: Ouyang, Pengxiang, et al.
Pubblicazione: (2025)
di: Ouyang, Pengxiang, et al.
Pubblicazione: (2025)
DIP: Diffusion Learning of Inconsistency Pattern for General DeepFake Detection
di: Nie, Fan, et al.
Pubblicazione: (2024)
di: Nie, Fan, et al.
Pubblicazione: (2024)
Context-aware TFL: A Universal Context-aware Contrastive Learning Framework for Temporal Forgery Localization
di: Yin, Qilin, et al.
Pubblicazione: (2025)
di: Yin, Qilin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Challenging Dataset and Multi-modal Gated Mixture of Experts Model for Remote Sensing Copy-Move Forgery Understanding
di: Zhang, Ze, et al.
Pubblicazione: (2025) -
An Effective Image Copy-Move Forgery Detection Using Entropy Information
di: Jiang, Li, et al.
Pubblicazione: (2023) -
Towards Generalizable Deepfake Detection via Forgery-aware Audio-Visual Adaptation: A Variational Bayesian Approach
di: Nie, Fan, et al.
Pubblicazione: (2025) -
Towards Open-Vocabulary Remote Sensing Image Semantic Segmentation
di: Ye, Chengyang, et al.
Pubblicazione: (2024) -
TMFNet: Two-Stream Multi-Channels Fusion Networks for Color Image Operation Chain Detection
di: Niu, Yakun, et al.
Pubblicazione: (2024)