OrchJail: Jailbreaking Tool-Calling Text-to-Image Agents by Orchestration-Guided Fuzzing
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Jianming, Wang, Yawen, Wang, Junjie, Liu, Zhe, Wang, Qing, Xu, Fanjiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adversarial Attack on Black-Box Multi-Agent by Adaptive Perturbation
di: Chen, Jianming, et al.
Pubblicazione: (2025)
di: Chen, Jianming, et al.
Pubblicazione: (2025)
SoK: Security of Autonomous LLM Agents in Agentic Commerce
di: Mao, Qian'ang, et al.
Pubblicazione: (2026)
di: Mao, Qian'ang, et al.
Pubblicazione: (2026)
CEE: An Inference-Time Jailbreak Defense for Embodied Intelligence via Subspace Concept Rotation
di: Yang, Jirui, et al.
Pubblicazione: (2025)
di: Yang, Jirui, et al.
Pubblicazione: (2025)
Understanding Individual Agent Importance in Multi-Agent System via Counterfactual Reasoning
di: Chen, Jianming, et al.
Pubblicazione: (2024)
di: Chen, Jianming, et al.
Pubblicazione: (2024)
Secure Forgetting: A Framework for Privacy-Driven Unlearning in Large Language Model (LLM)-Based Agents
di: Ye, Dayong, et al.
Pubblicazione: (2026)
di: Ye, Dayong, et al.
Pubblicazione: (2026)
PILLAR: an AI-Powered Privacy Threat Modeling Tool
di: Mollaeefar, Majid, et al.
Pubblicazione: (2024)
di: Mollaeefar, Majid, et al.
Pubblicazione: (2024)
Aegis: Towards Governance, Integrity, and Security of AI Voice Agents
di: Li, Xiang, et al.
Pubblicazione: (2026)
di: Li, Xiang, et al.
Pubblicazione: (2026)
Breaking the Secret: Economic Interventions for Combating Collusion in Embodied Multi-Agent Systems
di: Liu, Qi, et al.
Pubblicazione: (2026)
di: Liu, Qi, et al.
Pubblicazione: (2026)
Beyond Input Guardrails: Reconstructing Cross-Agent Semantic Flows for Execution-Aware Attack Detection
di: Wei, Yangyang, et al.
Pubblicazione: (2026)
di: Wei, Yangyang, et al.
Pubblicazione: (2026)
MultiFuzz: A Dense Retrieval-based Multi-Agent System for Network Protocol Fuzzing
di: Maklad, Youssef, et al.
Pubblicazione: (2025)
di: Maklad, Youssef, et al.
Pubblicazione: (2025)
Where Did It Go Wrong? Capability-Oriented Failure Attribution for Vision-and-Language Navigation Agents
di: Chen, Jianming, et al.
Pubblicazione: (2026)
di: Chen, Jianming, et al.
Pubblicazione: (2026)
AI Agents with Decentralized Identifiers and Verifiable Credentials
di: Garzon, Sandro Rodriguez, et al.
Pubblicazione: (2025)
di: Garzon, Sandro Rodriguez, et al.
Pubblicazione: (2025)
Decentralized Multi-Agent System with Trust-Aware Communication
di: Ding, Yepeng, et al.
Pubblicazione: (2025)
di: Ding, Yepeng, et al.
Pubblicazione: (2025)
Memory Poisoning Attack and Defense on Memory Based LLM-Agents
di: Sunil, Balachandra Devarangadi, et al.
Pubblicazione: (2026)
di: Sunil, Balachandra Devarangadi, et al.
Pubblicazione: (2026)
Multi-Agent Actor-Critics in Autonomous Cyber Defense
di: Wang, Mingjun, et al.
Pubblicazione: (2024)
di: Wang, Mingjun, et al.
Pubblicazione: (2024)
EncGPT: A Multi-Agent Workflow for Dynamic Encryption Algorithms
di: Li, Donghe, et al.
Pubblicazione: (2025)
di: Li, Donghe, et al.
Pubblicazione: (2025)
The Best-Laid SCHEMEs: Coordinated Sabotage and Monitoring in Multi-Agent Systems
di: Radev, Nikolay, et al.
Pubblicazione: (2026)
di: Radev, Nikolay, et al.
Pubblicazione: (2026)
ClawCoin: An Agentic AI-Native Cryptocurrency for Decentralized Agent Economies
di: Li, Shaoyu, et al.
Pubblicazione: (2026)
di: Li, Shaoyu, et al.
Pubblicazione: (2026)
G-Safeguard: A Topology-Guided Security Lens and Treatment on LLM-based Multi-agent Systems
di: Wang, Shilong, et al.
Pubblicazione: (2025)
di: Wang, Shilong, et al.
Pubblicazione: (2025)
CoTDeceptor:Adversarial Code Obfuscation Against CoT-Enhanced LLM Code Agents
di: Li, Haoyang, et al.
Pubblicazione: (2025)
di: Li, Haoyang, et al.
Pubblicazione: (2025)
Towards Transparent and Incentive-Compatible Collaboration in Decentralized LLM Multi-Agent Systems: A Blockchain-Driven Approach
di: Qi, Minfeng, et al.
Pubblicazione: (2025)
di: Qi, Minfeng, et al.
Pubblicazione: (2025)
ScamAgents: How AI Agents Can Simulate Human-Level Scam Calls
di: Badhe, Sanket
Pubblicazione: (2025)
di: Badhe, Sanket
Pubblicazione: (2025)
Scalable Multi-Agent Reinforcement Learning for Residential Load Scheduling under Data Governance
di: Qin, Zhaoming, et al.
Pubblicazione: (2021)
di: Qin, Zhaoming, et al.
Pubblicazione: (2021)
Out of Sight, Not Out of Mind: Unveiling Latent Attack in Latent-based Multi-Agent Systems
di: Wang, Chenxi, et al.
Pubblicazione: (2026)
di: Wang, Chenxi, et al.
Pubblicazione: (2026)
Extending the OWASP Multi-Agentic System Threat Modeling Guide: Insights from Multi-Agent Security Research
di: Krawiecka, Klaudia, et al.
Pubblicazione: (2025)
di: Krawiecka, Klaudia, et al.
Pubblicazione: (2025)
Locally Differentially Private Distributed Online Learning with Guaranteed Optimality
di: Chen, Ziqin, et al.
Pubblicazione: (2023)
di: Chen, Ziqin, et al.
Pubblicazione: (2023)
A Vision for Access Control in LLM-based Agent Systems
di: Li, Xinfeng, et al.
Pubblicazione: (2025)
di: Li, Xinfeng, et al.
Pubblicazione: (2025)
Attack the Messages, Not the Agents: A Multi-round Adaptive Stealthy Tampering Framework for LLM-MAS
di: Yan, Bingyu, et al.
Pubblicazione: (2025)
di: Yan, Bingyu, et al.
Pubblicazione: (2025)
DrunkAgent: Stealthy Memory Corruption in LLM-Powered Recommender Agents
di: Yang, Shiyi, et al.
Pubblicazione: (2025)
di: Yang, Shiyi, et al.
Pubblicazione: (2025)
Agent Smith: A Single Image Can Jailbreak One Million Multimodal LLM Agents Exponentially Fast
di: Gu, Xiangming, et al.
Pubblicazione: (2024)
di: Gu, Xiangming, et al.
Pubblicazione: (2024)
Who Owns This Agent? Tracing AI Agents Back to Their Owners
di: Chocron, Ruben, et al.
Pubblicazione: (2026)
di: Chocron, Ruben, et al.
Pubblicazione: (2026)
Web Fraud Attacks Against LLM-Driven Multi-Agent Systems
di: Kong, Dezhang, et al.
Pubblicazione: (2025)
di: Kong, Dezhang, et al.
Pubblicazione: (2025)
When Embedding-Based Defenses Fail: Rethinking Safety in LLM-Based Multi-Agent Systems
di: Zhang, Lingxi, et al.
Pubblicazione: (2026)
di: Zhang, Lingxi, et al.
Pubblicazione: (2026)
Voting-Bloc Entropy: A New Metric for DAO Decentralization
di: Fábrega, Andrés, et al.
Pubblicazione: (2025)
di: Fábrega, Andrés, et al.
Pubblicazione: (2025)
Trustworthy Decentralized Autonomous Machines: A New Paradigm in Automation Economy
di: Castillo, Fernando, et al.
Pubblicazione: (2025)
di: Castillo, Fernando, et al.
Pubblicazione: (2025)
Incentive Mechanism Design for Privacy-Preserving Decentralized Blockchain Relayers
di: Jebari, Boutaina, et al.
Pubblicazione: (2026)
di: Jebari, Boutaina, et al.
Pubblicazione: (2026)
BMC4TimeSec: Verification Of Timed Security Protocols
di: Zbrzezny, Agnieszka M.
Pubblicazione: (2026)
di: Zbrzezny, Agnieszka M.
Pubblicazione: (2026)
Agents for Agents: An Interrogator-Based Secure Framework for Autonomous Internet of Underwater Things
di: Akarma, Ali, et al.
Pubblicazione: (2026)
di: Akarma, Ali, et al.
Pubblicazione: (2026)
Enhancing the Robustness of QMIX against State-adversarial Attacks
di: Guo, Weiran, et al.
Pubblicazione: (2023)
di: Guo, Weiran, et al.
Pubblicazione: (2023)
Open Challenges in Multi-Agent Security: Towards Secure Systems of Interacting AI Agents
di: de Witt, Christian Schroeder, et al.
Pubblicazione: (2025)
di: de Witt, Christian Schroeder, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Adversarial Attack on Black-Box Multi-Agent by Adaptive Perturbation
di: Chen, Jianming, et al.
Pubblicazione: (2025) -
SoK: Security of Autonomous LLM Agents in Agentic Commerce
di: Mao, Qian'ang, et al.
Pubblicazione: (2026) -
CEE: An Inference-Time Jailbreak Defense for Embodied Intelligence via Subspace Concept Rotation
di: Yang, Jirui, et al.
Pubblicazione: (2025) -
Understanding Individual Agent Importance in Multi-Agent System via Counterfactual Reasoning
di: Chen, Jianming, et al.
Pubblicazione: (2024) -
Secure Forgetting: A Framework for Privacy-Driven Unlearning in Large Language Model (LLM)-Based Agents
di: Ye, Dayong, et al.
Pubblicazione: (2026)