ProGuard: Towards Proactive Multimodal Safeguard
Fuente:
arXiv
Salvato in:
| Autori principali: | Yu, Shaohan, Li, Lijun, Si, Chenyang, Sheng, Lu, Shao, Jing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HomeGuard: VLM-based Embodied Safeguard for Identifying Contextual Risk in Household Task
di: Lu, Xiaoya, et al.
Pubblicazione: (2026)
di: Lu, Xiaoya, et al.
Pubblicazione: (2026)
GuardDoor: Safeguarding Against Malicious Diffusion Editing via Protective Backdoors
di: Zeng, Yaopei, et al.
Pubblicazione: (2025)
di: Zeng, Yaopei, et al.
Pubblicazione: (2025)
OmniPro: A Comprehensive Benchmark for Omni-Proactive Streaming Video Understanding
di: Zhao, Ruixiang, et al.
Pubblicazione: (2026)
di: Zhao, Ruixiang, et al.
Pubblicazione: (2026)
Assessment of Multimodal Large Language Models in Alignment with Human Values
di: Shi, Zhelun, et al.
Pubblicazione: (2024)
di: Shi, Zhelun, et al.
Pubblicazione: (2024)
ConceptGuard: Proactive Safety in Text-and-Image-to-Video Generation through Multimodal Risk Detection
di: Ma, Ruize, et al.
Pubblicazione: (2025)
di: Ma, Ruize, et al.
Pubblicazione: (2025)
ProMark: Proactive Diffusion Watermarking for Causal Attribution
di: Asnani, Vishal, et al.
Pubblicazione: (2024)
di: Asnani, Vishal, et al.
Pubblicazione: (2024)
Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations
di: Chi, Jianfeng, et al.
Pubblicazione: (2024)
di: Chi, Jianfeng, et al.
Pubblicazione: (2024)
ProReason: Multi-Modal Proactive Reasoning with Decoupled Eyesight and Wisdom
di: Zhou, Jingqi, et al.
Pubblicazione: (2024)
di: Zhou, Jingqi, et al.
Pubblicazione: (2024)
ProactiveBench: Benchmarking Proactiveness in Multimodal Large Language Models
di: De Min, Thomas, et al.
Pubblicazione: (2026)
di: De Min, Thomas, et al.
Pubblicazione: (2026)
ProFocus: Proactive Perception and Focused Reasoning in Vision-and-Language Navigation
di: Xue, Wei, et al.
Pubblicazione: (2026)
di: Xue, Wei, et al.
Pubblicazione: (2026)
EgoPro-Bench: Benchmarking Personalized Proactive Interaction in Egocentric Video Streams
di: Ran, Dongchuan, et al.
Pubblicazione: (2026)
di: Ran, Dongchuan, et al.
Pubblicazione: (2026)
LLaVAShield: Safeguarding Multimodal Multi-Turn Dialogues in Vision-Language Models
di: Huang, Guolei, et al.
Pubblicazione: (2025)
di: Huang, Guolei, et al.
Pubblicazione: (2025)
WorldSimBench: Towards Video Generation Models as World Simulators
di: Qin, Yiran, et al.
Pubblicazione: (2024)
di: Qin, Yiran, et al.
Pubblicazione: (2024)
Towards Language-Driven Video Inpainting via Multimodal Large Language Models
di: Wu, Jianzong, et al.
Pubblicazione: (2024)
di: Wu, Jianzong, et al.
Pubblicazione: (2024)
TreeTeaming: Autonomous Red-Teaming of Vision-Language Models via Hierarchical Strategy Exploration
di: Li, Chunxiao, et al.
Pubblicazione: (2026)
di: Li, Chunxiao, et al.
Pubblicazione: (2026)
Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation
di: Wu, Xun, et al.
Pubblicazione: (2024)
di: Wu, Xun, et al.
Pubblicazione: (2024)
Self-adaptive Dataset Construction for Real-World Multimodal Safety Scenarios
di: Qu, Jingen, et al.
Pubblicazione: (2025)
di: Qu, Jingen, et al.
Pubblicazione: (2025)
StreamPro: From Reactive Perception to Proactive Decision-Making in Streaming Video
di: Li, Ao, et al.
Pubblicazione: (2026)
di: Li, Ao, et al.
Pubblicazione: (2026)
Proactive Reasoning-with-Retrieval Framework for Medical Multimodal Large Language Models
di: Wang, Lehan, et al.
Pubblicazione: (2025)
di: Wang, Lehan, et al.
Pubblicazione: (2025)
ProDehaze: Prompting Diffusion Models Toward Faithful Image Dehazing
di: Zhou, Tianwen, et al.
Pubblicazione: (2025)
di: Zhou, Tianwen, et al.
Pubblicazione: (2025)
LlavaGuard: An Open VLM-based Framework for Safeguarding Vision Datasets and Models
di: Helff, Lukas, et al.
Pubblicazione: (2024)
di: Helff, Lukas, et al.
Pubblicazione: (2024)
Contextual Image Attack: How Visual Context Exposes Multimodal Safety Vulnerabilities
di: Xiong, Yuan, et al.
Pubblicazione: (2025)
di: Xiong, Yuan, et al.
Pubblicazione: (2025)
FaceSwapGuard: Safeguarding Facial Privacy from DeepFake Threats through Identity Obfuscation
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
LongVie: Multimodal-Guided Controllable Ultra-Long Video Generation
di: Gao, Jianxiong, et al.
Pubblicazione: (2025)
di: Gao, Jianxiong, et al.
Pubblicazione: (2025)
BLM-Guard: Explainable Multimodal Ad Moderation with Chain-of-Thought and Policy-Aligned Rewards
di: Yang, Yiran, et al.
Pubblicazione: (2026)
di: Yang, Yiran, et al.
Pubblicazione: (2026)
EvoGuard: An Extensible Agentic RL-based Framework for Practical and Evolving AI-Generated Image Detection
di: Zhu, Chenyang, et al.
Pubblicazione: (2026)
di: Zhu, Chenyang, et al.
Pubblicazione: (2026)
Efficient Detection of Long Consistent Cycles and its Application to Distributed Synchronization
di: Li, Shaohan, et al.
Pubblicazione: (2024)
di: Li, Shaohan, et al.
Pubblicazione: (2024)
ProMMSearchAgent: A Generalizable Multimodal Search Agent Trained with Process-Oriented Rewards
di: Yan, Wentao, et al.
Pubblicazione: (2026)
di: Yan, Wentao, et al.
Pubblicazione: (2026)
FontGuard: A Robust Font Watermarking Approach Leveraging Deep Font Knowledge
di: Wong, Kahim, et al.
Pubblicazione: (2025)
di: Wong, Kahim, et al.
Pubblicazione: (2025)
VLM-Guard: Safeguarding Vision-Language Models via Fulfilling Safety Alignment Gap
di: Liu, Qin, et al.
Pubblicazione: (2025)
di: Liu, Qin, et al.
Pubblicazione: (2025)
PosterCopilot: Toward Layout Reasoning and Controllable Editing for Professional Graphic Design
di: Wei, Jiazhe, et al.
Pubblicazione: (2025)
di: Wei, Jiazhe, et al.
Pubblicazione: (2025)
Kosmos-G: Generating Images in Context with Multimodal Large Language Models
di: Pan, Xichen, et al.
Pubblicazione: (2023)
di: Pan, Xichen, et al.
Pubblicazione: (2023)
ProAct: A Dual-System Framework for Proactive Embodied Social Agents
di: Zhang, Zeyi, et al.
Pubblicazione: (2026)
di: Zhang, Zeyi, et al.
Pubblicazione: (2026)
StableGuard: Towards Unified Copyright Protection and Tamper Localization in Latent Diffusion Models
di: Yang, Haoxin, et al.
Pubblicazione: (2025)
di: Yang, Haoxin, et al.
Pubblicazione: (2025)
Towards Generalized Proactive Defense against Face Swapping with Contour-Hybrid Watermark
di: Xia, Ruiyang, et al.
Pubblicazione: (2025)
di: Xia, Ruiyang, et al.
Pubblicazione: (2025)
Rethinking Cross-Modal Interaction in Multimodal Diffusion Transformers
di: Lv, Zhengyao, et al.
Pubblicazione: (2025)
di: Lv, Zhengyao, et al.
Pubblicazione: (2025)
OmniVL-Guard Pro: A Tool-Augmented Agent for Omnibus Vision-Language Forensics
di: Shen, Jinjie, et al.
Pubblicazione: (2026)
di: Shen, Jinjie, et al.
Pubblicazione: (2026)
LongVie 2: Multimodal Controllable Ultra-Long Video World Model
di: Gao, Jianxiong, et al.
Pubblicazione: (2025)
di: Gao, Jianxiong, et al.
Pubblicazione: (2025)
BetterCheck: Towards Safeguarding VLMs for Automotive Perception Systems
di: Dona, Malsha Ashani Mahawatta, et al.
Pubblicazione: (2025)
di: Dona, Malsha Ashani Mahawatta, et al.
Pubblicazione: (2025)
RH20T-P: A Primitive-Level Robotic Dataset Towards Composable Generalization Agents
di: Chen, Zeren, et al.
Pubblicazione: (2024)
di: Chen, Zeren, et al.
Pubblicazione: (2024)
Documenti analoghi
-
HomeGuard: VLM-based Embodied Safeguard for Identifying Contextual Risk in Household Task
di: Lu, Xiaoya, et al.
Pubblicazione: (2026) -
GuardDoor: Safeguarding Against Malicious Diffusion Editing via Protective Backdoors
di: Zeng, Yaopei, et al.
Pubblicazione: (2025) -
OmniPro: A Comprehensive Benchmark for Omni-Proactive Streaming Video Understanding
di: Zhao, Ruixiang, et al.
Pubblicazione: (2026) -
Assessment of Multimodal Large Language Models in Alignment with Human Values
di: Shi, Zhelun, et al.
Pubblicazione: (2024) -
ConceptGuard: Proactive Safety in Text-and-Image-to-Video Generation through Multimodal Risk Detection
di: Ma, Ruize, et al.
Pubblicazione: (2025)