ShieldVLM: Safeguarding the Multimodal Implicit Toxicity via Deliberative Reasoning with LVLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cui, Shiyao, Zhang, Qinglin, Ouyang, Xuan, Chen, Renmiao, Zhang, Zhexin, Lu, Yida, Wang, Hongning, Qiu, Han, Huang, Minlie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
JPS: Jailbreak Multimodal Large Language Models with Collaborative Visual Perturbation and Textual Steering
par: Chen, Renmiao, et autres
Publié: (2025)
par: Chen, Renmiao, et autres
Publié: (2025)
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
par: Liu, Shuhang, et autres
Publié: (2025)
par: Liu, Shuhang, et autres
Publié: (2025)
The Side Effects of Being Smart: Safety Risks in MLLMs' Multi-Image Reasoning
par: Chen, Renmiao, et autres
Publié: (2026)
par: Chen, Renmiao, et autres
Publié: (2026)
SMSP: A Plug-and-Play Strategy of Multi-Scale Perception for MLLMs to Perceive Visual Illusions
par: Tu, Jinzhe, et autres
Publié: (2026)
par: Tu, Jinzhe, et autres
Publié: (2026)
Agent-SafetyBench: Evaluating the Safety of LLM Agents
par: Zhang, Zhexin, et autres
Publié: (2024)
par: Zhang, Zhexin, et autres
Publié: (2024)
Guiding not Forcing: Enhancing the Transferability of Jailbreaking Attacks on LLMs via Removing Superfluous Constraints
par: Yang, Junxiao, et autres
Publié: (2025)
par: Yang, Junxiao, et autres
Publié: (2025)
Benchmarking and Improving LVLMs on Event Extraction from Multimedia Documents
par: Xing, Fuyu, et autres
Publié: (2025)
par: Xing, Fuyu, et autres
Publié: (2025)
When Smiley Turns Hostile: Interpreting How Emojis Trigger LLMs' Toxicity
par: Cui, Shiyao, et autres
Publié: (2025)
par: Cui, Shiyao, et autres
Publié: (2025)
Enhancing Multimodal Entity and Relation Extraction with Variational Information Bottleneck
par: Cui, Shiyao, et autres
Publié: (2023)
par: Cui, Shiyao, et autres
Publié: (2023)
From Theft to Bomb-Making: The Ripple Effect of Unlearning in Defending Against Jailbreak Attacks
par: Zhang, Zhexin, et autres
Publié: (2024)
par: Zhang, Zhexin, et autres
Publié: (2024)
Dark Side of Modalities: Reinforced Multimodal Distillation for Multimodal Knowledge Graph Reasoning
par: Zhao, Yu, et autres
Publié: (2025)
par: Zhao, Yu, et autres
Publié: (2025)
Frozen LVLMs for Micro-Video Recommendation: A Systematic Study of Feature Extraction and Fusion
par: Sun, Huatuan, et autres
Publié: (2025)
par: Sun, Huatuan, et autres
Publié: (2025)
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
par: Zhou, Qianrui, et autres
Publié: (2026)
par: Zhou, Qianrui, et autres
Publié: (2026)
SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
par: Ma, Chenghao, et autres
Publié: (2025)
par: Ma, Chenghao, et autres
Publié: (2025)
MM-InstructEval: Zero-Shot Evaluation of (Multimodal) Large Language Models on Multimodal Reasoning Tasks
par: Yang, Xiaocui, et autres
Publié: (2024)
par: Yang, Xiaocui, et autres
Publié: (2024)
PRM-BAS: Enhancing Multimodal Reasoning through PRM-guided Beam Annealing Search
par: Hu, Pengfei, et autres
Publié: (2025)
par: Hu, Pengfei, et autres
Publié: (2025)
FakeSV-VLM: Taming VLM for Detecting Fake Short-Video News via Progressive Mixture-Of-Experts Adapter
par: Wang, Junxi, et autres
Publié: (2025)
par: Wang, Junxi, et autres
Publié: (2025)
Distilling Implicit Multimodal Knowledge into Large Language Models for Zero-Resource Dialogue Generation
par: Zhang, Bo, et autres
Publié: (2024)
par: Zhang, Bo, et autres
Publié: (2024)
The Missing Half: Unveiling Training-time Implicit Safety Risks Beyond Deployment
par: Zhang, Zhexin, et autres
Publié: (2026)
par: Zhang, Zhexin, et autres
Publié: (2026)
HumanVLM: Foundation for Human-Scene Vision-Language Model
par: Dai, Dawei, et autres
Publié: (2024)
par: Dai, Dawei, et autres
Publié: (2024)
EmpathyEar: An Open-source Avatar Multimodal Empathetic Chatbot
par: Fei, Hao, et autres
Publié: (2024)
par: Fei, Hao, et autres
Publié: (2024)
Towards Multimodal Empathetic Response Generation: A Rich Text-Speech-Vision Avatar-based Benchmark
par: Zhang, Han, et autres
Publié: (2025)
par: Zhang, Han, et autres
Publié: (2025)
SEER: Semantic Enhancement and Emotional Reasoning Network for Multimodal Fake News Detection
par: Zhu, Peican, et autres
Publié: (2025)
par: Zhu, Peican, et autres
Publié: (2025)
UniPath: Adaptive Coordination of Understanding and Generation for Unified Multimodal Reasoning
par: Bai, Hayes, et autres
Publié: (2026)
par: Bai, Hayes, et autres
Publié: (2026)
When Harmful Content Gets Camouflaged: Unveiling Perception Failure of LVLMs with CamHarmTI
par: Li, Yanhui, et autres
Publié: (2025)
par: Li, Yanhui, et autres
Publié: (2025)
Mixture of Disentangled Experts with Missing Modalities for Robust Multimodal Sentiment Analysis
par: Li, Xiang, et autres
Publié: (2026)
par: Li, Xiang, et autres
Publié: (2026)
HKD4VLM: A Progressive Hybrid Knowledge Distillation Framework for Robust Multimodal Hallucination and Factuality Detection in VLMs
par: Zhang, Zijian, et autres
Publié: (2025)
par: Zhang, Zijian, et autres
Publié: (2025)
Mitigating Multimodal Inconsistency via Cognitive Dual-Pathway Reasoning for Intent Recognition
par: Wang, Yifan, et autres
Publié: (2026)
par: Wang, Yifan, et autres
Publié: (2026)
Multimodal Classification and Out-of-distribution Detection for Multimodal Intent Understanding
par: Zhang, Hanlei, et autres
Publié: (2024)
par: Zhang, Hanlei, et autres
Publié: (2024)
WildFusion: Multimodal Implicit 3D Reconstructions in the Wild
par: Liu, Yanbaihui, et autres
Publié: (2024)
par: Liu, Yanbaihui, et autres
Publié: (2024)
MIND Your Reasoning: A Meta-Cognitive Intuitive-Reflective Network for Dual-Reasoning in Multimodal Stance Detection
par: Wang, Bingbing, et autres
Publié: (2025)
par: Wang, Bingbing, et autres
Publié: (2025)
Mitigating Shared-Private Branch Imbalance via Dual-Branch Rebalancing for Multimodal Sentiment Analysis
par: Meng, Chunlei, et autres
Publié: (2026)
par: Meng, Chunlei, et autres
Publié: (2026)
Harnessing Multimodal Large Language Models for Personalized Product Search with Query-aware Refinement
par: Zhang, Beibei, et autres
Publié: (2025)
par: Zhang, Beibei, et autres
Publié: (2025)
MMESGBench: Pioneering Multimodal Understanding and Complex Reasoning Benchmark for ESG Tasks
par: Zhang, Lei, et autres
Publié: (2025)
par: Zhang, Lei, et autres
Publié: (2025)
PathVLM-R1: A Reinforcement Learning-Driven Reasoning Model for Pathology Visual-Language Tasks
par: Wu, Jianyu, et autres
Publié: (2025)
par: Wu, Jianyu, et autres
Publié: (2025)
SVLA: A Unified Speech-Vision-Language Assistant with Multimodal Reasoning and Speech Generation
par: Huynh, Ngoc Dung, et autres
Publié: (2025)
par: Huynh, Ngoc Dung, et autres
Publié: (2025)
EmoVLM-KD: Fusing Distilled Expertise with Vision-Language Models for Visual Emotion Analysis
par: Lee, SangEun, et autres
Publié: (2025)
par: Lee, SangEun, et autres
Publié: (2025)
Multimodal Graph-Based Variational Mixture of Experts Network for Zero-Shot Multimodal Information Extraction
par: Zhou, Baohang, et autres
Publié: (2025)
par: Zhou, Baohang, et autres
Publié: (2025)
Memory-Anchored Multimodal Reasoning for Explainable Video Forensics
par: Chen, Chen, et autres
Publié: (2025)
par: Chen, Chen, et autres
Publié: (2025)
A Multimodal Transformer for Live Streaming Highlight Prediction
par: Deng, Jiaxin, et autres
Publié: (2024)
par: Deng, Jiaxin, et autres
Publié: (2024)
Documents similaires
-
JPS: Jailbreak Multimodal Large Language Models with Collaborative Visual Perturbation and Textual Steering
par: Chen, Renmiao, et autres
Publié: (2025) -
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
par: Liu, Shuhang, et autres
Publié: (2025) -
The Side Effects of Being Smart: Safety Risks in MLLMs' Multi-Image Reasoning
par: Chen, Renmiao, et autres
Publié: (2026) -
SMSP: A Plug-and-Play Strategy of Multi-Scale Perception for MLLMs to Perceive Visual Illusions
par: Tu, Jinzhe, et autres
Publié: (2026) -
Agent-SafetyBench: Evaluating the Safety of LLM Agents
par: Zhang, Zhexin, et autres
Publié: (2024)