Stop Reasoning! When Multimodal LLM with Chain-of-Thought Reasoning Meets Adversarial Image
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Zefeng, Han, Zhen, Chen, Shuo, Xue, Fan, Ding, Zifeng, Xiao, Xun, Tresp, Volker, Torr, Philip, Gu, Jindong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Bag of Tricks for Subverting Reasoning-based Safety Guardrails
von: Chen, Shuo, et al.
Veröffentlicht: (2025)
von: Chen, Shuo, et al.
Veröffentlicht: (2025)
Red Teaming GPT-4V: Are GPT-4V Safe Against Uni/Multi-Modal Jailbreak Attacks?
von: Chen, Shuo, et al.
Veröffentlicht: (2024)
von: Chen, Shuo, et al.
Veröffentlicht: (2024)
Deep Research Brings Deeper Harm
von: Chen, Shuo, et al.
Veröffentlicht: (2025)
von: Chen, Shuo, et al.
Veröffentlicht: (2025)
Multimodal Pragmatic Jailbreak on Text-to-image Models
von: Liu, Tong, et al.
Veröffentlicht: (2024)
von: Liu, Tong, et al.
Veröffentlicht: (2024)
Imitation Game for Adversarial Disillusion with Chain-of-Thought Reasoning in Generative AI
von: Chang, Ching-Chun, et al.
Veröffentlicht: (2025)
von: Chang, Ching-Chun, et al.
Veröffentlicht: (2025)
ExplainableGuard: Interpretable Adversarial Defense for Large Language Models Using Chain-of-Thought Reasoning
von: Guan, Shaowei, et al.
Veröffentlicht: (2025)
von: Guan, Shaowei, et al.
Veröffentlicht: (2025)
LLM Jailbreak Detection for (Almost) Free!
von: Chen, Guorui, et al.
Veröffentlicht: (2025)
von: Chen, Guorui, et al.
Veröffentlicht: (2025)
Can Reasoning Models Obfuscate Reasoning? Stress-Testing Chain-of-Thought Monitorability
von: Zolkowski, Artur, et al.
Veröffentlicht: (2025)
von: Zolkowski, Artur, et al.
Veröffentlicht: (2025)
Thought-Transfer: Indirect Targeted Poisoning Attacks on Chain-of-Thought Reasoning Models
von: Chaudhari, Harsh, et al.
Veröffentlicht: (2026)
von: Chaudhari, Harsh, et al.
Veröffentlicht: (2026)
PPMI: Privacy-Preserving LLM Interaction with Socratic Chain-of-Thought Reasoning and Homomorphically Encrypted Vector Databases
von: Bae, Yubeen, et al.
Veröffentlicht: (2025)
von: Bae, Yubeen, et al.
Veröffentlicht: (2025)
Reimagining Safety Alignment with An Image
von: Xia, Yifan, et al.
Veröffentlicht: (2025)
von: Xia, Yifan, et al.
Veröffentlicht: (2025)
Preemptive Answer "Attacks" on Chain-of-Thought Reasoning
von: Xu, Rongwu, et al.
Veröffentlicht: (2024)
von: Xu, Rongwu, et al.
Veröffentlicht: (2024)
Echoes within the Reasoning: Stealthy and Effective Watermarking via Chain of Thought
von: Lu, Jiacheng, et al.
Veröffentlicht: (2026)
von: Lu, Jiacheng, et al.
Veröffentlicht: (2026)
R-CoT: A Reasoning-Layer Watermark via Redundant Chain-of-Thought in Large Language Models
von: Zhang, Ziming, et al.
Veröffentlicht: (2026)
von: Zhang, Ziming, et al.
Veröffentlicht: (2026)
BadThink: Triggered Overthinking Attacks on Chain-of-Thought Reasoning in Large Language Models
von: Liu, Shuaitong, et al.
Veröffentlicht: (2025)
von: Liu, Shuaitong, et al.
Veröffentlicht: (2025)
Reasoning Under Pressure: How do Training Incentives Influence Chain-of-Thought Monitorability?
von: MacDermott, Matt, et al.
Veröffentlicht: (2025)
von: MacDermott, Matt, et al.
Veröffentlicht: (2025)
When Reasoning Leaks Membership: Membership Inference Attack on Black-box Large Reasoning Models
von: Hu, Ruihan, et al.
Veröffentlicht: (2026)
von: Hu, Ruihan, et al.
Veröffentlicht: (2026)
SkillJect: Effectively Automating Skill-Based Prompt Injection for Skill-Enabled Agents
von: Jia, Xiaojun, et al.
Veröffentlicht: (2026)
von: Jia, Xiaojun, et al.
Veröffentlicht: (2026)
Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation
von: Roh, Jaechul, et al.
Veröffentlicht: (2025)
von: Roh, Jaechul, et al.
Veröffentlicht: (2025)
Strengthening Human-Centric Chain-of-Thought Reasoning Integrity in LLMs via a Structured Prompt Framework
von: Zhou, Jiling, et al.
Veröffentlicht: (2026)
von: Zhou, Jiling, et al.
Veröffentlicht: (2026)
BadChain: Backdoor Chain-of-Thought Prompting for Large Language Models
von: Xiang, Zhen, et al.
Veröffentlicht: (2024)
von: Xiang, Zhen, et al.
Veröffentlicht: (2024)
When LLM Meets DRL: Advancing Jailbreaking Efficiency via DRL-guided Search
von: Chen, Xuan, et al.
Veröffentlicht: (2024)
von: Chen, Xuan, et al.
Veröffentlicht: (2024)
TRAP: Hijacking VLA CoT-Reasoning via Adversarial Patches
von: Huang, Zhengxian, et al.
Veröffentlicht: (2026)
von: Huang, Zhengxian, et al.
Veröffentlicht: (2026)
From Thinking to Output: Chain-of-Thought and Text Generation Characteristics in Reasoning Language Models
von: Liu, Junhao, et al.
Veröffentlicht: (2025)
von: Liu, Junhao, et al.
Veröffentlicht: (2025)
Hidden Thoughts Are Not Secret: Reasoning Trace Exposure in LLMs
von: Lu, Yu-An, et al.
Veröffentlicht: (2026)
von: Lu, Yu-An, et al.
Veröffentlicht: (2026)
Oedipus: LLM-enchanced Reasoning CAPTCHA Solver
von: Deng, Gelei, et al.
Veröffentlicht: (2024)
von: Deng, Gelei, et al.
Veröffentlicht: (2024)
DarkMind: Latent Chain-of-Thought Backdoor in Customized LLMs
von: Guo, Zhen, et al.
Veröffentlicht: (2025)
von: Guo, Zhen, et al.
Veröffentlicht: (2025)
ExtendAttack: Attacking Servers of LRMs via Extending Reasoning
von: Zhu, Zhenhao, et al.
Veröffentlicht: (2025)
von: Zhu, Zhenhao, et al.
Veröffentlicht: (2025)
The Forking Way: When TEEs Meet Consensus
von: Wilde, Annika, et al.
Veröffentlicht: (2024)
von: Wilde, Annika, et al.
Veröffentlicht: (2024)
Inducing High Energy-Latency of Large Vision-Language Models with Verbose Images
von: Gao, Kuofeng, et al.
Veröffentlicht: (2024)
von: Gao, Kuofeng, et al.
Veröffentlicht: (2024)
When LLMs Copy to Think: Uncovering Copy-Guided Attacks in Reasoning LLMs
von: Li, Yue, et al.
Veröffentlicht: (2025)
von: Li, Yue, et al.
Veröffentlicht: (2025)
Retrieval Augmented Generation Based LLM Evaluation For Protocol State Machine Inference With Chain-of-Thought Reasoning
von: Maklad, Youssef, et al.
Veröffentlicht: (2025)
von: Maklad, Youssef, et al.
Veröffentlicht: (2025)
GSPR: Aligning LLM Safeguards as Generalizable Safety Policy Reasoners
von: Li, Haoran, et al.
Veröffentlicht: (2025)
von: Li, Haoran, et al.
Veröffentlicht: (2025)
Reasoning-Oriented Programming: Chaining Semantic Gadgets to Jailbreak Large Vision Language Models
von: Zou, Quanchen, et al.
Veröffentlicht: (2026)
von: Zou, Quanchen, et al.
Veröffentlicht: (2026)
Does Few-shot Learning Suffer from Backdoor Attacks?
von: Liu, Xinwei, et al.
Veröffentlicht: (2023)
von: Liu, Xinwei, et al.
Veröffentlicht: (2023)
RHINO: Guided Reasoning for Mapping Network Logs to Adversarial Tactics and Techniques with Large Language Models
von: Meng, Fanchao, et al.
Veröffentlicht: (2025)
von: Meng, Fanchao, et al.
Veröffentlicht: (2025)
ALRPHFS: Adversarially Learned Risk Patterns with Hierarchical Fast \& Slow Reasoning for Robust Agent Defense
von: Xiang, Shiyu, et al.
Veröffentlicht: (2025)
von: Xiang, Shiyu, et al.
Veröffentlicht: (2025)
Belt and Braces: When Federated Learning Meets Differential Privacy
von: Ren, Xuebin, et al.
Veröffentlicht: (2024)
von: Ren, Xuebin, et al.
Veröffentlicht: (2024)
PrivCode: When Code Generation Meets Differential Privacy
von: Liu, Zheng, et al.
Veröffentlicht: (2025)
von: Liu, Zheng, et al.
Veröffentlicht: (2025)
Unreal Thinking: Chain-of-Thought Hijacking via Two-stage Backdoor
von: Chang, Wenhan, et al.
Veröffentlicht: (2026)
von: Chang, Wenhan, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Bag of Tricks for Subverting Reasoning-based Safety Guardrails
von: Chen, Shuo, et al.
Veröffentlicht: (2025) -
Red Teaming GPT-4V: Are GPT-4V Safe Against Uni/Multi-Modal Jailbreak Attacks?
von: Chen, Shuo, et al.
Veröffentlicht: (2024) -
Deep Research Brings Deeper Harm
von: Chen, Shuo, et al.
Veröffentlicht: (2025) -
Multimodal Pragmatic Jailbreak on Text-to-image Models
von: Liu, Tong, et al.
Veröffentlicht: (2024) -
Imitation Game for Adversarial Disillusion with Chain-of-Thought Reasoning in Generative AI
von: Chang, Ching-Chun, et al.
Veröffentlicht: (2025)