Fine-grained Multiple Supervisory Network for Multi-modal Manipulation Detecting and Grounding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Xinquan, Lu, Wei, Luo, Xiangyang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CIEC: Coupling Implicit and Explicit Cues for Multimodal Weakly Supervised Manipulation Localization
par: Yu, Xinquan, et autres
Publié: (2026)
par: Yu, Xinquan, et autres
Publié: (2026)
RaCMC: Residual-Aware Compensation Network with Multi-Granularity Constraints for Fake News Detection
par: Yu, Xinquan, et autres
Publié: (2024)
par: Yu, Xinquan, et autres
Publié: (2024)
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
par: He, Junwen, et autres
Publié: (2024)
par: He, Junwen, et autres
Publié: (2024)
MFCLIP: Multi-modal Fine-grained CLIP for Generalizable Diffusion Face Forgery Detection
par: Zhang, Yaning, et autres
Publié: (2024)
par: Zhang, Yaning, et autres
Publié: (2024)
Multi-modal Reference Learning for Fine-grained Text-to-Image Retrieval
par: Ma, Zehong, et autres
Publié: (2025)
par: Ma, Zehong, et autres
Publié: (2025)
Diffusion-based Adversarial Identity Manipulation for Facial Privacy Protection
par: Wang, Liqin, et autres
Publié: (2025)
par: Wang, Liqin, et autres
Publié: (2025)
Fine-grained Context and Multi-modal Alignment for Freehand 3D Ultrasound Reconstruction
par: Yan, Zhongnuo, et autres
Publié: (2024)
par: Yan, Zhongnuo, et autres
Publié: (2024)
MMHead: Towards Fine-grained Multi-modal 3D Facial Animation
par: Wu, Sijing, et autres
Publié: (2024)
par: Wu, Sijing, et autres
Publié: (2024)
Exploiting Modality-Specific Features For Multi-Modal Manipulation Detection And Grounding
par: Wang, Jiazhen, et autres
Publié: (2023)
par: Wang, Jiazhen, et autres
Publié: (2023)
MARE: Multimodal Alignment and Reinforcement for Explainable Deepfake Detection via Vision-Language Models
par: Xu, Wenbo, et autres
Publié: (2026)
par: Xu, Wenbo, et autres
Publié: (2026)
Fine-grained Action Analysis: A Multi-modality and Multi-task Dataset of Figure Skating
par: Liu, Sheng-Lan, et autres
Publié: (2023)
par: Liu, Sheng-Lan, et autres
Publié: (2023)
Semantic Change Detection of Roads and Bridges: A Fine-grained Dataset and Multimodal Frequency-driven Detector
par: Shu, Qingling, et autres
Publié: (2025)
par: Shu, Qingling, et autres
Publié: (2025)
Multi-modal Representations for Fine-grained Multi-label Critical View of Safety Recognition
par: Baby, Britty, et autres
Publié: (2025)
par: Baby, Britty, et autres
Publié: (2025)
Fine-grained Spatiotemporal Grounding on Egocentric Videos
par: Liang, Shuo, et autres
Publié: (2025)
par: Liang, Shuo, et autres
Publié: (2025)
Fine-grained Dynamic Network for Generic Event Boundary Detection
par: Zheng, Ziwei, et autres
Publié: (2024)
par: Zheng, Ziwei, et autres
Publié: (2024)
BFA: Best-Feature-Aware Fusion for Multi-View Fine-grained Manipulation
par: Lan, Zihan, et autres
Publié: (2025)
par: Lan, Zihan, et autres
Publié: (2025)
Simplify Implant Depth Prediction as Video Grounding: A Texture Perceive Implant Depth Prediction Network
par: Yang, Xinquan, et autres
Publié: (2024)
par: Yang, Xinquan, et autres
Publié: (2024)
FineCLIPER: Multi-modal Fine-grained CLIP for Dynamic Facial Expression Recognition with AdaptERs
par: Chen, Haodong, et autres
Publié: (2024)
par: Chen, Haodong, et autres
Publié: (2024)
Weakly Supervised Multimodal Temporal Forgery Localization via Multitask Learning
par: Xu, Wenbo, et autres
Publié: (2025)
par: Xu, Wenbo, et autres
Publié: (2025)
Semi-distributed Cross-modal Air-Ground Relative Localization
par: Lu, Weining, et autres
Publié: (2025)
par: Lu, Weining, et autres
Publié: (2025)
Language-driven Fine-grained Retrieval
par: Wang, Shijie, et autres
Publié: (2025)
par: Wang, Shijie, et autres
Publié: (2025)
Multi-view Crowd Tracking Transformer with View-Ground Interactions Under Large Real-World Scenes
par: Zhang, Qi, et autres
Publié: (2026)
par: Zhang, Qi, et autres
Publié: (2026)
ID-Guard: A Universal Framework for Combating Facial Manipulation via Breaking Identification
par: Qu, Zuomin, et autres
Publié: (2024)
par: Qu, Zuomin, et autres
Publié: (2024)
FineRS: Fine-grained Reasoning and Segmentation of Small Objects with Reinforcement Learning
par: Zhang, Lu, et autres
Publié: (2025)
par: Zhang, Lu, et autres
Publié: (2025)
Q-Ground: Image Quality Grounding with Large Multi-modality Models
par: Chen, Chaofeng, et autres
Publié: (2024)
par: Chen, Chaofeng, et autres
Publié: (2024)
HiVG: Hierarchical Multimodal Fine-grained Modulation for Visual Grounding
par: Xiao, Linhui, et autres
Publié: (2024)
par: Xiao, Linhui, et autres
Publié: (2024)
LLMs Meet VLMs: Boost Open Vocabulary Object Detection with Fine-grained Descriptors
par: Jin, Sheng, et autres
Publié: (2024)
par: Jin, Sheng, et autres
Publié: (2024)
Cross-modal Full-mode Fine-grained Alignment for Text-to-Image Person Retrieval
par: Yin, Hao, et autres
Publié: (2025)
par: Yin, Hao, et autres
Publié: (2025)
Unleashing the Potential of Consistency Learning for Detecting and Grounding Multi-Modal Media Manipulation
par: Li, Yiheng, et autres
Publié: (2025)
par: Li, Yiheng, et autres
Publié: (2025)
Self-paced Multi-grained Cross-modal Interaction Modeling for Referring Expression Comprehension
par: Miao, Peihan, et autres
Publié: (2022)
par: Miao, Peihan, et autres
Publié: (2022)
GroundingGPT:Language Enhanced Multi-modal Grounding Model
par: Li, Zhaowei, et autres
Publié: (2024)
par: Li, Zhaowei, et autres
Publié: (2024)
AU-Blendshape for Fine-grained Stylized 3D Facial Expression Manipulation
par: Li, Hao, et autres
Publié: (2025)
par: Li, Hao, et autres
Publié: (2025)
Multi-modality Anomaly Segmentation on the Road
par: Gao, Heng, et autres
Publié: (2025)
par: Gao, Heng, et autres
Publié: (2025)
UB-FineNet: Urban Building Fine-grained Classification Network for Open-access Satellite Images
par: He, Zhiyi, et autres
Publié: (2024)
par: He, Zhiyi, et autres
Publié: (2024)
Achieving Fine-grained Cross-modal Understanding through Brain-inspired Hierarchical Representation Learning
par: You, Weihang, et autres
Publié: (2026)
par: You, Weihang, et autres
Publié: (2026)
Towards Open-world Generalized Deepfake Detection: General Feature Extraction via Unsupervised Domain Adaptation
par: Guo, Midou, et autres
Publié: (2025)
par: Guo, Midou, et autres
Publié: (2025)
Focus Anywhere for Fine-grained Multi-page Document Understanding
par: Liu, Chenglong, et autres
Publié: (2024)
par: Liu, Chenglong, et autres
Publié: (2024)
Visual Grounding with Multi-modal Conditional Adaptation
par: Yao, Ruilin, et autres
Publié: (2024)
par: Yao, Ruilin, et autres
Publié: (2024)
Rethinking Cross-Domain Evaluation for Face Forgery Detection with Semantic Fine-grained Alignment and Mixture-of-Experts
par: Luo, Yuhan, et autres
Publié: (2026)
par: Luo, Yuhan, et autres
Publié: (2026)
Fast-then-Fine: A Two-Stage Framework with Multi-Granular Representation for Cross-Modal Retrieval in Remote Sensing
par: Chen, Xi, et autres
Publié: (2026)
par: Chen, Xi, et autres
Publié: (2026)
Documents similaires
-
CIEC: Coupling Implicit and Explicit Cues for Multimodal Weakly Supervised Manipulation Localization
par: Yu, Xinquan, et autres
Publié: (2026) -
RaCMC: Residual-Aware Compensation Network with Multi-Granularity Constraints for Fake News Detection
par: Yu, Xinquan, et autres
Publié: (2024) -
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
par: He, Junwen, et autres
Publié: (2024) -
MFCLIP: Multi-modal Fine-grained CLIP for Generalizable Diffusion Face Forgery Detection
par: Zhang, Yaning, et autres
Publié: (2024) -
Multi-modal Reference Learning for Fine-grained Text-to-Image Retrieval
par: Ma, Zehong, et autres
Publié: (2025)