SAPL: Semantic-Agnostic Prompt Learning in CLIP for Weakly Supervised Image Manipulation Localization
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Xinghao, Miao, Changtao, Sheng, Dianmo, Gong, Tao, Chu, Qi, Yu, Nenghai, Zou, Quanchen, Zhang, Deyue, Zhang, Xiangzheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Context-Aware Weakly Supervised Image Manipulation Localization with SAM Refinement
di: Wang, Xinghao, et al.
Pubblicazione: (2025)
di: Wang, Xinghao, et al.
Pubblicazione: (2025)
Training-Free In-Context Forensic Chain for Image Manipulation Detection and Localization
di: Chen, Rui, et al.
Pubblicazione: (2025)
di: Chen, Rui, et al.
Pubblicazione: (2025)
Robust Privacy: Inference-Time Privacy through Certified Robustness
di: Jin, Jiankai, et al.
Pubblicazione: (2026)
di: Jin, Jiankai, et al.
Pubblicazione: (2026)
DMN: A Compositional Framework for Jailbreaking Multimodal LLMs with Multi-Image Inputs
di: Xu, Wenzhuo, et al.
Pubblicazione: (2026)
di: Xu, Wenzhuo, et al.
Pubblicazione: (2026)
PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking
di: Zou, Quanchen, et al.
Pubblicazione: (2025)
di: Zou, Quanchen, et al.
Pubblicazione: (2025)
Mixture-of-Noises Enhanced Forgery-Aware Predictor for Multi-Face Manipulation Detection and Localization
di: Miao, Changtao, et al.
Pubblicazione: (2024)
di: Miao, Changtao, et al.
Pubblicazione: (2024)
Multi-spectral Class Center Network for Face Manipulation Detection and Localization
di: Miao, Changtao, et al.
Pubblicazione: (2023)
di: Miao, Changtao, et al.
Pubblicazione: (2023)
Reasoning-Oriented Programming: Chaining Semantic Gadgets to Jailbreak Large Vision Language Models
di: Zou, Quanchen, et al.
Pubblicazione: (2026)
di: Zou, Quanchen, et al.
Pubblicazione: (2026)
GuardTrace-VL: Detecting Unsafe Multimodel Reasoning via Iterative Safety Supervision
di: Xiang, Yuxiao, et al.
Pubblicazione: (2025)
di: Xiang, Yuxiao, et al.
Pubblicazione: (2025)
SafeHarbor: Hierarchical Memory-Augmented Guardrail for LLM Agent Safety
di: Liu, Zhe, et al.
Pubblicazione: (2026)
di: Liu, Zhe, et al.
Pubblicazione: (2026)
Probabilistic Modeling of Jailbreak on Multimodal LLMs: From Quantification to Application
di: Xu, Wenzhuo, et al.
Pubblicazione: (2025)
di: Xu, Wenzhuo, et al.
Pubblicazione: (2025)
Exploiting Modality-Specific Features For Multi-Modal Manipulation Detection And Grounding
di: Wang, Jiazhen, et al.
Pubblicazione: (2023)
di: Wang, Jiazhen, et al.
Pubblicazione: (2023)
DIVER: Dynamic Iterative Visual Evidence Reasoning for Multimodal Fake News Detection
di: Zhou, Weilin, et al.
Pubblicazione: (2026)
di: Zhou, Weilin, et al.
Pubblicazione: (2026)
Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models
di: Ying, Zonghao, et al.
Pubblicazione: (2025)
di: Ying, Zonghao, et al.
Pubblicazione: (2025)
Multi-Turn Context Jailbreak Attack on Large Language Models From First Principles
di: Sun, Xiongtao, et al.
Pubblicazione: (2024)
di: Sun, Xiongtao, et al.
Pubblicazione: (2024)
Learning to Focus and Precise Cropping: A Reinforcement Learning Framework with Information Gaps and Grounding Loss for MLLMs
di: Zhao, Xuanpu, et al.
Pubblicazione: (2026)
di: Zhao, Xuanpu, et al.
Pubblicazione: (2026)
Disentangling Fact from Sentiment: A Dynamic Conflict-Consensus Framework for Multimodal Fake News Detection
di: Zhou, Weilin, et al.
Pubblicazione: (2025)
di: Zhou, Weilin, et al.
Pubblicazione: (2025)
Towards More Unified In-context Visual Understanding
di: Sheng, Dianmo, et al.
Pubblicazione: (2023)
di: Sheng, Dianmo, et al.
Pubblicazione: (2023)
Mean-squared Energy Difference for Exploring Potential Energy Landscapes of Supercooled Liquids
di: Zhang, Dianmo, et al.
Pubblicazione: (2025)
di: Zhang, Dianmo, et al.
Pubblicazione: (2025)
The Courtroom Trial of Pixels: Robust Image Manipulation Localization via Adversarial Evidence and Reinforcement Learning Judgment
di: Li, Songlin, et al.
Pubblicazione: (2026)
di: Li, Songlin, et al.
Pubblicazione: (2026)
Frozen CLIP: A Strong Backbone for Weakly Supervised Semantic Segmentation
di: Zhang, Bingfeng, et al.
Pubblicazione: (2024)
di: Zhang, Bingfeng, et al.
Pubblicazione: (2024)
Two Frames Matter: A Temporal Attack for Text-to-Video Model Jailbreaking
di: Chen, Moyang, et al.
Pubblicazione: (2026)
di: Chen, Moyang, et al.
Pubblicazione: (2026)
TrajShield: Trajectory-Level Safety Mediation for Defending Text-to-Video Models Against Jailbreak Attacks
di: Zou, Quanchen, et al.
Pubblicazione: (2026)
di: Zou, Quanchen, et al.
Pubblicazione: (2026)
Towards Understanding the Safety Boundaries of DeepSeek Models: Evaluation and Findings
di: Ying, Zonghao, et al.
Pubblicazione: (2025)
di: Ying, Zonghao, et al.
Pubblicazione: (2025)
Exploring CLIP's Dense Knowledge for Weakly Supervised Semantic Segmentation
di: Yang, Zhiwei, et al.
Pubblicazione: (2025)
di: Yang, Zhiwei, et al.
Pubblicazione: (2025)
CLIP-Fields: Weakly Supervised Semantic Fields for Robotic Memory
di: Shafiullah, Nur Muhammad Mahi, et al.
Pubblicazione: (2022)
di: Shafiullah, Nur Muhammad Mahi, et al.
Pubblicazione: (2022)
Contrastive Prompt Clustering for Weakly Supervised Semantic Segmentation
di: Wu, Wangyu, et al.
Pubblicazione: (2025)
di: Wu, Wangyu, et al.
Pubblicazione: (2025)
Semantic Prompt Learning for Weakly-Supervised Semantic Segmentation
di: Lin, Ci-Siang, et al.
Pubblicazione: (2024)
di: Lin, Ci-Siang, et al.
Pubblicazione: (2024)
DiCLIP: Diffusion Model Enhances CLIP's Dense Knowledge for Weakly Supervised Semantic Segmentation
di: Yang, Zhiwei, et al.
Pubblicazione: (2026)
di: Yang, Zhiwei, et al.
Pubblicazione: (2026)
SSR: Semantic and Spatial Rectification for CLIP-based Weakly Supervised Segmentation
di: Bi, Xiuli, et al.
Pubblicazione: (2025)
di: Bi, Xiuli, et al.
Pubblicazione: (2025)
Emerging Trends in Pseudo-Label Refinement for Weakly Supervised Semantic Segmentation with Image-Level Supervision
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
Demystifying and Detecting Agentic Workflow Injection Vulnerabilities in GitHub Actions
di: Wang, Shenao, et al.
Pubblicazione: (2026)
di: Wang, Shenao, et al.
Pubblicazione: (2026)
Mask-GCG: Are All Tokens in Adversarial Suffixes Necessary for Jailbreak Attacks?
di: Mu, Junjie, et al.
Pubblicazione: (2025)
di: Mu, Junjie, et al.
Pubblicazione: (2025)
Prompt Categories Cluster for Weakly Supervised Semantic Segmentation
di: Wu, Wangyu, et al.
Pubblicazione: (2024)
di: Wu, Wangyu, et al.
Pubblicazione: (2024)
Beyond Fully Supervised Pixel Annotations: Scribble-Driven Weakly-Supervised Framework for Image Manipulation Localization
di: Li, Songlin, et al.
Pubblicazione: (2025)
di: Li, Songlin, et al.
Pubblicazione: (2025)
Sequential Comics for Jailbreaking Multimodal Large Language Models via Structured Visual Storytelling
di: Zhang, Deyue, et al.
Pubblicazione: (2025)
di: Zhang, Deyue, et al.
Pubblicazione: (2025)
Weakly Supervised Video Anomaly Detection and Localization with Spatio-Temporal Prompts
di: Wu, Peng, et al.
Pubblicazione: (2024)
di: Wu, Peng, et al.
Pubblicazione: (2024)
Superpixel Boundary Correction for Weakly-Supervised Semantic Segmentation on Histopathology Images
di: Wu, Hongyi, et al.
Pubblicazione: (2025)
di: Wu, Hongyi, et al.
Pubblicazione: (2025)
Bootstrapping MLLM for Weakly-Supervised Class-Agnostic Object Counting
di: Zhang, Xiaowen, et al.
Pubblicazione: (2026)
di: Zhang, Xiaowen, et al.
Pubblicazione: (2026)
Propose and Rectify: A Forensics-Driven MLLM Framework for Image Manipulation Localization
di: Zhang, Keyang, et al.
Pubblicazione: (2025)
di: Zhang, Keyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Context-Aware Weakly Supervised Image Manipulation Localization with SAM Refinement
di: Wang, Xinghao, et al.
Pubblicazione: (2025) -
Training-Free In-Context Forensic Chain for Image Manipulation Detection and Localization
di: Chen, Rui, et al.
Pubblicazione: (2025) -
Robust Privacy: Inference-Time Privacy through Certified Robustness
di: Jin, Jiankai, et al.
Pubblicazione: (2026) -
DMN: A Compositional Framework for Jailbreaking Multimodal LLMs with Multi-Image Inputs
di: Xu, Wenzhuo, et al.
Pubblicazione: (2026) -
PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking
di: Zou, Quanchen, et al.
Pubblicazione: (2025)