Invisible to Humans, Triggered by Agents: Stealthy Jailbreak Attacks on Mobile Vision-Language Agents
Fuente:
arXiv
Guardado en:
| Autores principales: | Ding, Renhua, Yang, Xiao, Fang, Zhengwei, Luo, Jun, He, Kun, Zhu, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Is Monitoring Enough? Strategic Agent Selection For Stealthy Attack in Multi-Agent Discussions
por: Xiang, Qiuchi, et al.
Publicado: (2026)
por: Xiang, Qiuchi, et al.
Publicado: (2026)
SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents
por: Liang, Siyuan, et al.
Publicado: (2025)
por: Liang, Siyuan, et al.
Publicado: (2025)
Transferable & Stealthy Ensemble Attacks: A Black-Box Jailbreaking Framework for Large Language Models
por: Yang, Yiqi, et al.
Publicado: (2024)
por: Yang, Yiqi, et al.
Publicado: (2024)
Hijacking Agent Memory: Stealthy Trojan Attacks Through Conversational Interaction
por: Wang, Hongtao, et al.
Publicado: (2026)
por: Wang, Hongtao, et al.
Publicado: (2026)
Invisible Textual Backdoor Attacks based on Dual-Trigger
por: Hou, Yang, et al.
Publicado: (2024)
por: Hou, Yang, et al.
Publicado: (2024)
Stealthy Dual-Trigger Backdoors: Attacking Prompt Tuning in LM-Empowered Graph Foundation Models
por: Xue, Xiaoyu, et al.
Publicado: (2025)
por: Xue, Xiaoyu, et al.
Publicado: (2025)
Backdoor Attack with Invisible Triggers Based on Model Architecture Modification
por: Ma, Yuan, et al.
Publicado: (2024)
por: Ma, Yuan, et al.
Publicado: (2024)
Hiding in Plain Sight: A Steganographic Approach to Stealthy LLM Jailbreaks
por: Geng, Jianing, et al.
Publicado: (2025)
por: Geng, Jianing, et al.
Publicado: (2025)
A Spatiotemporal Stealthy Backdoor Attack against Cooperative Multi-Agent Deep Reinforcement Learning
por: Yu, Yinbo, et al.
Publicado: (2024)
por: Yu, Yinbo, et al.
Publicado: (2024)
MRJ-Agent: An Effective Jailbreak Agent for Multi-Round Dialogue
por: Wang, Fengxiang, et al.
Publicado: (2024)
por: Wang, Fengxiang, et al.
Publicado: (2024)
PAPILLON: Efficient and Stealthy Fuzz Testing-Powered Jailbreaks for LLMs
por: Gong, Xueluan, et al.
Publicado: (2024)
por: Gong, Xueluan, et al.
Publicado: (2024)
Amplified Vulnerabilities: Structured Jailbreak Attacks on LLM-based Multi-Agent Debate
por: Qi, Senmao, et al.
Publicado: (2025)
por: Qi, Senmao, et al.
Publicado: (2025)
WebTrap: Stealthy Mid-Task Hijacking of Browser Agents During Navigation
por: Liu, Zhichao, et al.
Publicado: (2026)
por: Liu, Zhichao, et al.
Publicado: (2026)
Stealthy Backdoor Attacks against LLMs Based on Natural Style Triggers
por: Wei, Jiali, et al.
Publicado: (2026)
por: Wei, Jiali, et al.
Publicado: (2026)
DemonAgent: Dynamically Encrypted Multi-Backdoor Implantation Attack on LLM-based Agent
por: Zhu, Pengyu, et al.
Publicado: (2025)
por: Zhu, Pengyu, et al.
Publicado: (2025)
Shadowcast: Stealthy Data Poisoning Attacks Against Vision-Language Models
por: Xu, Yuancheng, et al.
Publicado: (2024)
por: Xu, Yuancheng, et al.
Publicado: (2024)
SNEAKDOOR: Stealthy Backdoor Attacks against Distribution Matching-based Dataset Condensation
por: Yang, He, et al.
Publicado: (2026)
por: Yang, He, et al.
Publicado: (2026)
Breaking the Code: Security Assessment of AI Code Agents Through Systematic Jailbreaking Attacks
por: Saha, Shoumik, et al.
Publicado: (2025)
por: Saha, Shoumik, et al.
Publicado: (2025)
New Wide-Net-Casting Jailbreak Attacks Risk Large Models
por: Xiang, Qiuchi, et al.
Publicado: (2026)
por: Xiang, Qiuchi, et al.
Publicado: (2026)
Can Small Language Models Reliably Resist Jailbreak Attacks? A Comprehensive Evaluation
por: Zhang, Wenhui, et al.
Publicado: (2025)
por: Zhang, Wenhui, et al.
Publicado: (2025)
LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models
por: Yu, Miao, et al.
Publicado: (2024)
por: Yu, Miao, et al.
Publicado: (2024)
JailDAM: Jailbreak Detection with Adaptive Memory for Vision-Language Model
por: Nian, Yi, et al.
Publicado: (2025)
por: Nian, Yi, et al.
Publicado: (2025)
SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-Action Models
por: Xu, Bingxin, et al.
Publicado: (2026)
por: Xu, Bingxin, et al.
Publicado: (2026)
AdvWave: Stealthy Adversarial Jailbreak Attack against Large Audio-Language Models
por: Kang, Mintong, et al.
Publicado: (2024)
por: Kang, Mintong, et al.
Publicado: (2024)
SoK: Robustness in Large Language Models against Jailbreak Attacks
por: Xu, Feiyue, et al.
Publicado: (2026)
por: Xu, Feiyue, et al.
Publicado: (2026)
Graph of Attacks with Pruning: Optimizing Stealthy Jailbreak Prompt Generation for Enhanced LLM Content Moderation
por: Schwartz, Daniel, et al.
Publicado: (2025)
por: Schwartz, Daniel, et al.
Publicado: (2025)
Reasoning-Style Poisoning of LLM Agents via Stealthy Style Transfer: Process-Level Attacks and Runtime Monitoring in RSV Space
por: Zhou, Xingfu, et al.
Publicado: (2025)
por: Zhou, Xingfu, et al.
Publicado: (2025)
Distract Large Language Models for Automatic Jailbreak Attack
por: Xiao, Zeguan, et al.
Publicado: (2024)
por: Xiao, Zeguan, et al.
Publicado: (2024)
BLAST: A Stealthy Backdoor Leverage Attack against Cooperative Multi-Agent Deep Reinforcement Learning based Systems
por: Fang, Jing, et al.
Publicado: (2025)
por: Fang, Jing, et al.
Publicado: (2025)
A Cross-Language Investigation into Jailbreak Attacks in Large Language Models
por: Li, Jie, et al.
Publicado: (2024)
por: Li, Jie, et al.
Publicado: (2024)
Beyond Max Tokens: Stealthy Resource Amplification via Tool Calling Chains in LLM Agents
por: Zhou, Kaiyu, et al.
Publicado: (2026)
por: Zhou, Kaiyu, et al.
Publicado: (2026)
Rubrics as an Attack Surface: Stealthy Preference Drift in LLM Judges
por: Ding, Ruomeng, et al.
Publicado: (2026)
por: Ding, Ruomeng, et al.
Publicado: (2026)
Invisible Threats from Model Context Protocol: Generating Stealthy Injection Payload via Tree-based Adaptive Search
por: Shen, Yulin, et al.
Publicado: (2026)
por: Shen, Yulin, et al.
Publicado: (2026)
Safe2Harm: Semantic Isomorphism Attacks for Jailbreaking Large Language Models
por: Yang, Fan
Publicado: (2025)
por: Yang, Fan
Publicado: (2025)
SkillTrojan: Backdoor Attacks on Skill-Based Agent Systems
por: Feng, Yunhao, et al.
Publicado: (2026)
por: Feng, Yunhao, et al.
Publicado: (2026)
Towards Effective, Stealthy, and Persistent Backdoor Attacks Targeting Graph Foundation Models
por: Luo, Jiayi, et al.
Publicado: (2025)
por: Luo, Jiayi, et al.
Publicado: (2025)
Untargeted Jailbreak Attack
por: Huang, Xinzhe, et al.
Publicado: (2025)
por: Huang, Xinzhe, et al.
Publicado: (2025)
Attack the Messages, Not the Agents: A Multi-round Adaptive Stealthy Tampering Framework for LLM-MAS
por: Yan, Bingyu, et al.
Publicado: (2025)
por: Yan, Bingyu, et al.
Publicado: (2025)
Red-teaming the Multimodal Reasoning: Jailbreaking Vision-Language Models via Cross-modal Entanglement Attacks
por: Yan, Yu, et al.
Publicado: (2026)
por: Yan, Yu, et al.
Publicado: (2026)
Evolving Jailbreaks: Automated Multi-Objective Long-Tail Attacks on Large Language Models
por: Hong, Wenjing, et al.
Publicado: (2026)
por: Hong, Wenjing, et al.
Publicado: (2026)
Ejemplares similares
-
Is Monitoring Enough? Strategic Agent Selection For Stealthy Attack in Multi-Agent Discussions
por: Xiang, Qiuchi, et al.
Publicado: (2026) -
SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents
por: Liang, Siyuan, et al.
Publicado: (2025) -
Transferable & Stealthy Ensemble Attacks: A Black-Box Jailbreaking Framework for Large Language Models
por: Yang, Yiqi, et al.
Publicado: (2024) -
Hijacking Agent Memory: Stealthy Trojan Attacks Through Conversational Interaction
por: Wang, Hongtao, et al.
Publicado: (2026) -
Invisible Textual Backdoor Attacks based on Dual-Trigger
por: Hou, Yang, et al.
Publicado: (2024)