Defenses & Enablers For Skill Injection Attacks on Terminal Based Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Fujinuma, Yoshinari, Gangal, Varun, Rebedea, Traian, Sreedhar, Makesh Narasimhan, Varshney, Prasoon, Qian, Rebecca, Kannappan, Anand |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pluralistic Behavior Suite: Stress-Testing Multi-Turn Adherence to Custom Behavioral Policies
par: Varshney, Prasoon, et autres
Publié: (2025)
par: Varshney, Prasoon, et autres
Publié: (2025)
Training a General Purpose Automated Red Teaming Model
par: Padmakumar, Aishwarya, et autres
Publié: (2026)
par: Padmakumar, Aishwarya, et autres
Publié: (2026)
AegisAgent: An Autonomous Defense Agent Against Prompt Injection Attacks in LLM-HARs
par: Wang, Yihan, et autres
Publié: (2025)
par: Wang, Yihan, et autres
Publié: (2025)
Defense Against Prompt Injection Attack by Leveraging Attack Techniques
par: Chen, Yulin, et autres
Publié: (2024)
par: Chen, Yulin, et autres
Publié: (2024)
Adaptive Attacks Break Defenses Against Indirect Prompt Injection Attacks on LLM Agents
par: Zhan, Qiusi, et autres
Publié: (2025)
par: Zhan, Qiusi, et autres
Publié: (2025)
Backdoor-Powered Prompt Injection Attacks Nullify Defense Methods
par: Chen, Yulin, et autres
Publié: (2025)
par: Chen, Yulin, et autres
Publié: (2025)
MELON: Provable Defense Against Indirect Prompt Injection Attacks in AI Agents
par: Zhu, Kaijie, et autres
Publié: (2025)
par: Zhu, Kaijie, et autres
Publié: (2025)
A Multi-Agent LLM Defense Pipeline Against Prompt Injection Attacks
par: Hossain, S M Asif, et autres
Publié: (2025)
par: Hossain, S M Asif, et autres
Publié: (2025)
SUAD: Solid-Channel Ultrasound Injection Attack and Defense to Voice Assistants
par: Liu, Chao, et autres
Publié: (2025)
par: Liu, Chao, et autres
Publié: (2025)
AgentDojo: A Dynamic Environment to Evaluate Prompt Injection Attacks and Defenses for LLM Agents
par: Debenedetti, Edoardo, et autres
Publié: (2024)
par: Debenedetti, Edoardo, et autres
Publié: (2024)
Digital Privacy Under Attack: Challenges and Enablers
par: Song, Baobao, et autres
Publié: (2023)
par: Song, Baobao, et autres
Publié: (2023)
Jailbreaking Generative AI: Multivector Phishing Threats and Transformer based Defenses
par: Mishra, Rina, et autres
Publié: (2025)
par: Mishra, Rina, et autres
Publié: (2025)
SkillJect: Effectively Automating Skill-Based Prompt Injection for Skill-Enabled Agents
par: Jia, Xiaojun, et autres
Publié: (2026)
par: Jia, Xiaojun, et autres
Publié: (2026)
Safety Through Reasoning: An Empirical Study of Reasoning Guardrail Models
par: Sreedhar, Makesh Narsimhan, et autres
Publié: (2025)
par: Sreedhar, Makesh Narsimhan, et autres
Publié: (2025)
Unsupervised Extraction of Dialogue Policies from Conversations
par: Sreedhar, Makesh Narsimhan, et autres
Publié: (2024)
par: Sreedhar, Makesh Narsimhan, et autres
Publié: (2024)
SkillAttack: Automated Red Teaming of Agent Skills through Attack Path Refinement
par: Duan, Zenghao, et autres
Publié: (2026)
par: Duan, Zenghao, et autres
Publié: (2026)
Multimodal Prompt Injection Attacks: Risks and Defenses for Modern LLMs
par: Yeo, Andrew, et autres
Publié: (2025)
par: Yeo, Andrew, et autres
Publié: (2025)
A Critical Evaluation of Defenses against Prompt Injection Attacks
par: Jia, Yuqi, et autres
Publié: (2025)
par: Jia, Yuqi, et autres
Publié: (2025)
When Skills Lie: Hidden-Comment Injection in LLM Agents
par: Wang, Qianli, et autres
Publié: (2026)
par: Wang, Qianli, et autres
Publié: (2026)
System-Level Defense against Indirect Prompt Injection Attacks: An Information Flow Control Perspective
par: Wu, Fangzhou, et autres
Publié: (2024)
par: Wu, Fangzhou, et autres
Publié: (2024)
Prompt Injection Attack to Tool Selection in LLM Agents
par: Shi, Jiawen, et autres
Publié: (2025)
par: Shi, Jiawen, et autres
Publié: (2025)
PINA: Prompt Injection Attack against Navigation Agents
par: Liu, Jiani, et autres
Publié: (2026)
par: Liu, Jiani, et autres
Publié: (2026)
Architecting Secure AI Agents: Perspectives on System-Level Defenses Against Indirect Prompt Injection Attacks
par: Xiang, Chong, et autres
Publié: (2026)
par: Xiang, Chong, et autres
Publié: (2026)
SkillTrojan: Backdoor Attacks on Skill-Based Agent Systems
par: Feng, Yunhao, et autres
Publié: (2026)
par: Feng, Yunhao, et autres
Publié: (2026)
DRIFT: Dynamic Rule-Based Defense with Injection Isolation for Securing LLM Agents
par: Li, Hao, et autres
Publié: (2025)
par: Li, Hao, et autres
Publié: (2025)
ObliInjection: Order-Oblivious Prompt Injection Attack to LLM Agents with Multi-source Data
par: Wang, Reachal, et autres
Publié: (2025)
par: Wang, Reachal, et autres
Publié: (2025)
Trace: Unmasking AI Attack Agents Through Terminal Behavior Fingerprinting
par: Ediga, Murali, et autres
Publié: (2026)
par: Ediga, Murali, et autres
Publié: (2026)
Memory Poisoning Attack and Defense on Memory Based LLM-Agents
par: Sunil, Balachandra Devarangadi, et autres
Publié: (2026)
par: Sunil, Balachandra Devarangadi, et autres
Publié: (2026)
SuperLocalMemory: Privacy-Preserving Multi-Agent Memory with Bayesian Trust Defense Against Memory Poisoning
par: Bhardwaj, Varun Pratap
Publié: (2026)
par: Bhardwaj, Varun Pratap
Publié: (2026)
A Login Page Transparency and Visual Similarity Based Zero Day Phishing Defense Protocol
par: Varshney, Gaurav, et autres
Publié: (2025)
par: Varshney, Gaurav, et autres
Publié: (2025)
Dynamic Probabilistic Noise Injection for Membership Inference Defense
par: Forough, Javad, et autres
Publié: (2025)
par: Forough, Javad, et autres
Publié: (2025)
LoopTrap: Termination Poisoning Attacks on LLM Agents
par: Xu, Huiyu, et autres
Publié: (2026)
par: Xu, Huiyu, et autres
Publié: (2026)
FATH: Authentication-based Test-time Defense against Indirect Prompt Injection Attacks
par: Wang, Jiongxiao, et autres
Publié: (2024)
par: Wang, Jiongxiao, et autres
Publié: (2024)
WARD: Adversarially Robust Defense of Web Agents Against Prompt Injections
par: Cao, Tri, et autres
Publié: (2026)
par: Cao, Tri, et autres
Publié: (2026)
Prompt Injection Attacks on Agentic Coding Assistants: A Systematic Analysis of Vulnerabilities in Skills, Tools, and Protocol Ecosystems
par: Maloyan, Narek, et autres
Publié: (2026)
par: Maloyan, Narek, et autres
Publié: (2026)
Jailbreaking Generative AI: Empowering Novices to Conduct Phishing Attacks
par: Mishra, Rina, et autres
Publié: (2025)
par: Mishra, Rina, et autres
Publié: (2025)
Formalizing and Benchmarking Prompt Injection Attacks and Defenses
par: Liu, Yupei, et autres
Publié: (2023)
par: Liu, Yupei, et autres
Publié: (2023)
Defending Against Prompt Injection With a Few DefensiveTokens
par: Chen, Sizhe, et autres
Publié: (2025)
par: Chen, Sizhe, et autres
Publié: (2025)
Skill-Inject: Measuring Agent Vulnerability to Skill File Attacks
par: Schmotz, David, et autres
Publié: (2026)
par: Schmotz, David, et autres
Publié: (2026)
BadSkill: Backdoor Attacks on Agent Skills via Model-in-Skill Poisoning
par: Tie, Guiyao, et autres
Publié: (2026)
par: Tie, Guiyao, et autres
Publié: (2026)
Documents similaires
-
Pluralistic Behavior Suite: Stress-Testing Multi-Turn Adherence to Custom Behavioral Policies
par: Varshney, Prasoon, et autres
Publié: (2025) -
Training a General Purpose Automated Red Teaming Model
par: Padmakumar, Aishwarya, et autres
Publié: (2026) -
AegisAgent: An Autonomous Defense Agent Against Prompt Injection Attacks in LLM-HARs
par: Wang, Yihan, et autres
Publié: (2025) -
Defense Against Prompt Injection Attack by Leveraging Attack Techniques
par: Chen, Yulin, et autres
Publié: (2024) -
Adaptive Attacks Break Defenses Against Indirect Prompt Injection Attacks on LLM Agents
par: Zhan, Qiusi, et autres
Publié: (2025)