Poisoning the Watchtower: Prompt Injection Attacks Against LLM-Augmented Security Operations Through Adversarial Log Content
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pandey, Rohan, Bhujang, Archit |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Adaptive Attacks Break Defenses Against Indirect Prompt Injection Attacks on LLM Agents
par: Zhan, Qiusi, et autres
Publié: (2025)
par: Zhan, Qiusi, et autres
Publié: (2025)
A Multi-Agent LLM Defense Pipeline Against Prompt Injection Attacks
par: Hossain, S M Asif, et autres
Publié: (2025)
par: Hossain, S M Asif, et autres
Publié: (2025)
SecureLearn -- An Attack-agnostic Defense for Multiclass Machine Learning Against Data Poisoning Attacks
par: Paracha, Anum, et autres
Publié: (2025)
par: Paracha, Anum, et autres
Publié: (2025)
Secure Retrieval-Augmented Generation against Poisoning Attacks
par: Cheng, Zirui, et autres
Publié: (2025)
par: Cheng, Zirui, et autres
Publié: (2025)
Design Patterns for Securing LLM Agents against Prompt Injections
par: Beurer-Kellner, Luca, et autres
Publié: (2025)
par: Beurer-Kellner, Luca, et autres
Publié: (2025)
Defending Against Indirect Prompt Injection Attacks With Spotlighting
par: Hines, Keegan, et autres
Publié: (2024)
par: Hines, Keegan, et autres
Publié: (2024)
Adversarial Prompt Evaluation: Systematic Benchmarking of Guardrails Against Prompt Input Attacks on LLMs
par: Zizzo, Giulio, et autres
Publié: (2025)
par: Zizzo, Giulio, et autres
Publié: (2025)
Poisoned-MRAG: Knowledge Poisoning Attacks to Multimodal Retrieval Augmented Generation
par: Liu, Yinuo, et autres
Publié: (2025)
par: Liu, Yinuo, et autres
Publié: (2025)
PIShield: Detecting Prompt Injection Attacks via Intrinsic LLM Features
par: Zou, Wei, et autres
Publié: (2025)
par: Zou, Wei, et autres
Publié: (2025)
Enhancing Prompt Injection Attacks to LLMs via Poisoning Alignment
par: Shao, Zedian, et autres
Publié: (2024)
par: Shao, Zedian, et autres
Publié: (2024)
Comments on "Privacy-Enhanced Federated Learning Against Poisoning Adversaries"
par: Schneider, Thomas, et autres
Publié: (2024)
par: Schneider, Thomas, et autres
Publié: (2024)
Backdoored Retrievers for Prompt Injection Attacks on Retrieval Augmented Generation of Large Language Models
par: Clop, Cody, et autres
Publié: (2024)
par: Clop, Cody, et autres
Publié: (2024)
The Attacker Moves Second: Stronger Adaptive Attacks Bypass Defenses Against Llm Jailbreaks and Prompt Injections
par: Nasr, Milad, et autres
Publié: (2025)
par: Nasr, Milad, et autres
Publié: (2025)
GenTel-Safe: A Unified Benchmark and Shielding Framework for Defending Against Prompt Injection Attacks
par: Li, Rongchang, et autres
Publié: (2024)
par: Li, Rongchang, et autres
Publié: (2024)
LogJack: Indirect Prompt Injection Through Cloud Logs Against LLM Debugging Agents
par: Shah, Harsh
Publié: (2026)
par: Shah, Harsh
Publié: (2026)
A Systematic Review of Poisoning Attacks Against Large Language Models
par: Fendley, Neil, et autres
Publié: (2025)
par: Fendley, Neil, et autres
Publié: (2025)
Exploring Secure Machine Learning Through Payload Injection and FGSM Attacks on ResNet-50
par: Yadav, Umesh, et autres
Publié: (2025)
par: Yadav, Umesh, et autres
Publié: (2025)
PoisonedParrot: Subtle Data Poisoning Attacks to Elicit Copyright-Infringing Content from Large Language Models
par: Panaitescu-Liess, Michael-Andrei, et autres
Publié: (2025)
par: Panaitescu-Liess, Michael-Andrei, et autres
Publié: (2025)
Securing Large Language Models (LLMs) from Prompt Injection Attacks
par: Suri, Omar Farooq Khan, et autres
Publié: (2025)
par: Suri, Omar Farooq Khan, et autres
Publié: (2025)
AgentDojo: A Dynamic Environment to Evaluate Prompt Injection Attacks and Defenses for LLM Agents
par: Debenedetti, Edoardo, et autres
Publié: (2024)
par: Debenedetti, Edoardo, et autres
Publié: (2024)
SleeperNets: Universal Backdoor Poisoning Attacks Against Reinforcement Learning Agents
par: Rathbun, Ethan, et autres
Publié: (2024)
par: Rathbun, Ethan, et autres
Publié: (2024)
Provable Robustness of (Graph) Neural Networks Against Data Poisoning and Backdoor Attacks
par: Gosch, Lukas, et autres
Publié: (2024)
par: Gosch, Lukas, et autres
Publié: (2024)
Defending Against Sophisticated Poisoning Attacks with RL-based Aggregation in Federated Learning
par: Wang, Yujing, et autres
Publié: (2024)
par: Wang, Yujing, et autres
Publié: (2024)
Online Poisoning Attack Against Reinforcement Learning under Black-box Environments
par: Li, Jianhui, et autres
Publié: (2024)
par: Li, Jianhui, et autres
Publié: (2024)
SecAlign: Defending Against Prompt Injection with Preference Optimization
par: Chen, Sizhe, et autres
Publié: (2024)
par: Chen, Sizhe, et autres
Publié: (2024)
Lessons from Defending Gemini Against Indirect Prompt Injections
par: Shi, Chongyang, et autres
Publié: (2025)
par: Shi, Chongyang, et autres
Publié: (2025)
Robustness Against Adversarial Attacks via Learning Confined Adversarial Polytopes
par: Hamidi, Shayan Mohajer, et autres
Publié: (2024)
par: Hamidi, Shayan Mohajer, et autres
Publié: (2024)
LeakSealer: A Semisupervised Defense for LLMs Against Prompt Injection and Leakage Attacks
par: Panebianco, Francesco, et autres
Publié: (2025)
par: Panebianco, Francesco, et autres
Publié: (2025)
Traceback of Poisoning Attacks to Retrieval-Augmented Generation
par: Zhang, Baolei, et autres
Publié: (2025)
par: Zhang, Baolei, et autres
Publié: (2025)
Be Kind, Rewrite: Benign Projections via Rewriting Defend Against LLM Data Poisoning Attacks
par: Halloran, John T., et autres
Publié: (2026)
par: Halloran, John T., et autres
Publié: (2026)
Secure Aggregation is Not Private Against Membership Inference Attacks
par: Ngo, Khac-Hoang, et autres
Publié: (2024)
par: Ngo, Khac-Hoang, et autres
Publié: (2024)
Poison Attacks and Adversarial Prompts Against an Informed University Virtual Assistant
par: Fernandez, Ivan A., et autres
Publié: (2024)
par: Fernandez, Ivan A., et autres
Publié: (2024)
PoisonedRAG: Knowledge Corruption Attacks to Retrieval-Augmented Generation of Large Language Models
par: Zou, Wei, et autres
Publié: (2024)
par: Zou, Wei, et autres
Publié: (2024)
Transferable Availability Poisoning Attacks
par: Liu, Yiyong, et autres
Publié: (2023)
par: Liu, Yiyong, et autres
Publié: (2023)
Universal Black-Box Reward Poisoning Attack against Offline Reinforcement Learning
par: Xu, Yinglun, et autres
Publié: (2024)
par: Xu, Yinglun, et autres
Publié: (2024)
How to Defend Against Large-scale Model Poisoning Attacks in Federated Learning: A Vertical Solution
par: Wang, Jinbo, et autres
Publié: (2024)
par: Wang, Jinbo, et autres
Publié: (2024)
Krait: A Backdoor Attack Against Graph Prompt Tuning
par: Song, Ying, et autres
Publié: (2024)
par: Song, Ying, et autres
Publié: (2024)
Prompt Stealing Attacks Against Text-to-Image Generation Models
par: Shen, Xinyue, et autres
Publié: (2023)
par: Shen, Xinyue, et autres
Publié: (2023)
Neural Exec: Learning (and Learning from) Execution Triggers for Prompt Injection Attacks
par: Pasquini, Dario, et autres
Publié: (2024)
par: Pasquini, Dario, et autres
Publié: (2024)
Practical Poisoning Attacks against Retrieval-Augmented Generation
par: Zhang, Baolei, et autres
Publié: (2025)
par: Zhang, Baolei, et autres
Publié: (2025)
Documents similaires
-
Adaptive Attacks Break Defenses Against Indirect Prompt Injection Attacks on LLM Agents
par: Zhan, Qiusi, et autres
Publié: (2025) -
A Multi-Agent LLM Defense Pipeline Against Prompt Injection Attacks
par: Hossain, S M Asif, et autres
Publié: (2025) -
SecureLearn -- An Attack-agnostic Defense for Multiclass Machine Learning Against Data Poisoning Attacks
par: Paracha, Anum, et autres
Publié: (2025) -
Secure Retrieval-Augmented Generation against Poisoning Attacks
par: Cheng, Zirui, et autres
Publié: (2025) -
Design Patterns for Securing LLM Agents against Prompt Injections
par: Beurer-Kellner, Luca, et autres
Publié: (2025)