Enregistré dans:
| Auteur principal: | KumarRavindran, Santhosh |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2510.04528 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Prompt Injection 2.0: Hybrid AI Threats
par: McHugh, Jeremy, et autres
Publié: (2025)
par: McHugh, Jeremy, et autres
Publié: (2025)
Portable Agent Memory: A Protocol for Cryptographically-Verified Memory Transfer Across Heterogeneous AI Agents
par: Ravindran, Santhosh Kumar
Publié: (2026)
par: Ravindran, Santhosh Kumar
Publié: (2026)
Prompt Injection as an Emerging Threat: Evaluating the Resilience of Large Language Models
par: Ganiuly, Daniyal, et autres
Publié: (2025)
par: Ganiuly, Daniyal, et autres
Publié: (2025)
From Prompt Injections to Protocol Exploits: Threats in LLM-Powered AI Agents Workflows
par: Ferrag, Mohamed Amine, et autres
Publié: (2025)
par: Ferrag, Mohamed Amine, et autres
Publié: (2025)
RAG-targeted Adversarial Attack on LLM-based Threat Detection and Mitigation Framework
par: Ikbarieh, Seif, et autres
Publié: (2025)
par: Ikbarieh, Seif, et autres
Publié: (2025)
Invisible Prompts, Visible Threats: Malicious Font Injection in External Resources for Large Language Models
par: Xiong, Junjie, et autres
Publié: (2025)
par: Xiong, Junjie, et autres
Publié: (2025)
Adversarial Activation Patching: A Framework for Detecting and Mitigating Emergent Deception in Safety-Aligned Transformers
par: Ravindran, Santhosh Kumar
Publié: (2025)
par: Ravindran, Santhosh Kumar
Publié: (2025)
The Mirror Design Pattern: Strict Data Geometry over Model Scale for Prompt Injection Detection
par: Corll, J Alex
Publié: (2026)
par: Corll, J Alex
Publié: (2026)
Defending against Indirect Prompt Injection by Instruction Detection
par: Wen, Tongyu, et autres
Publié: (2025)
par: Wen, Tongyu, et autres
Publié: (2025)
Enterprise-Grade Security for the Model Context Protocol (MCP): Frameworks and Mitigation Strategies
par: Narajala, Vineeth Sai, et autres
Publié: (2025)
par: Narajala, Vineeth Sai, et autres
Publié: (2025)
SecInfer: Preventing Prompt Injection via Inference-time Scaling
par: Liu, Yupei, et autres
Publié: (2025)
par: Liu, Yupei, et autres
Publié: (2025)
Bypassing Prompt Injection Detectors through Evasive Injections
par: Rahman, Md Jahedur, et autres
Publié: (2026)
par: Rahman, Md Jahedur, et autres
Publié: (2026)
PromptLocate: Localizing Prompt Injection Attacks
par: Jia, Yuqi, et autres
Publié: (2025)
par: Jia, Yuqi, et autres
Publié: (2025)
Adversarial Defense in Cybersecurity: A Systematic Review of GANs for Threat Detection and Mitigation
par: Ndayipfukamiye, Tharcisse, et autres
Publié: (2025)
par: Ndayipfukamiye, Tharcisse, et autres
Publié: (2025)
Defeating Prompt Injections by Design
par: Debenedetti, Edoardo, et autres
Publié: (2025)
par: Debenedetti, Edoardo, et autres
Publié: (2025)
How Not to Detect Prompt Injections with an LLM
par: Choudhary, Sarthak, et autres
Publié: (2025)
par: Choudhary, Sarthak, et autres
Publié: (2025)
DataSentinel: A Game-Theoretic Detection of Prompt Injection Attacks
par: Liu, Yupei, et autres
Publié: (2025)
par: Liu, Yupei, et autres
Publié: (2025)
The Ethics of Interaction: Mitigating Security Threats in LLMs
par: Kumar, Ashutosh, et autres
Publié: (2024)
par: Kumar, Ashutosh, et autres
Publié: (2024)
SnapGuard: Lightweight Prompt Injection Detection for Screenshot-Based Web Agents
par: Du, Mengyao, et autres
Publié: (2026)
par: Du, Mengyao, et autres
Publié: (2026)
PromptArmor: Simple yet Effective Prompt Injection Defenses
par: Shi, Tianneng, et autres
Publié: (2025)
par: Shi, Tianneng, et autres
Publié: (2025)
Securing Agentic AI: A Comprehensive Threat Model and Mitigation Framework for Generative AI Agents
par: Narajala, Vineeth Sai, et autres
Publié: (2025)
par: Narajala, Vineeth Sai, et autres
Publié: (2025)
Toward Trustworthy Agentic AI: A Multimodal Framework for Preventing Prompt Injection Attacks
par: Syed, Toqeer Ali, et autres
Publié: (2025)
par: Syed, Toqeer Ali, et autres
Publié: (2025)
InjecGuard: Benchmarking and Mitigating Over-defense in Prompt Injection Guardrail Models
par: Li, Hao, et autres
Publié: (2024)
par: Li, Hao, et autres
Publié: (2024)
To Protect the LLM Agent Against the Prompt Injection Attack with Polymorphic Prompt
par: Wang, Zhilong, et autres
Publié: (2025)
par: Wang, Zhilong, et autres
Publié: (2025)
Multi-Stage Prompt Inference Attacks on Enterprise LLM Systems
par: Balashov, Andrii, et autres
Publié: (2025)
par: Balashov, Andrii, et autres
Publié: (2025)
Democratizing ML for Enterprise Security: A Self-Sustained Attack Detection Framework
par: Momeni, Sadegh, et autres
Publié: (2025)
par: Momeni, Sadegh, et autres
Publié: (2025)
Attention Tracker: Detecting Prompt Injection Attacks in LLMs
par: Hung, Kuo-Han, et autres
Publié: (2024)
par: Hung, Kuo-Han, et autres
Publié: (2024)
SD-RAG: A Prompt-Injection-Resilient Framework for Selective Disclosure in Retrieval-Augmented Generation
par: Masoud, Aiman Al, et autres
Publié: (2026)
par: Masoud, Aiman Al, et autres
Publié: (2026)
CASCADE: A Cascaded Hybrid Defense Architecture for Prompt Injection Detection in MCP-Based Systems
par: Turgut, İpek Abasıkeleş, et autres
Publié: (2026)
par: Turgut, İpek Abasıkeleş, et autres
Publié: (2026)
F2A: An Innovative Approach for Prompt Injection by Utilizing Feign Security Detection Agents
par: Ren, Yupeng
Publié: (2024)
par: Ren, Yupeng
Publié: (2024)
How Vulnerable Are AI Agents to Indirect Prompt Injections? Insights from a Large-Scale Public Competition
par: Dziemian, Mateusz, et autres
Publié: (2026)
par: Dziemian, Mateusz, et autres
Publié: (2026)
Securing AI Agents Against Prompt Injection Attacks
par: Ramakrishnan, Badrinath, et autres
Publié: (2025)
par: Ramakrishnan, Badrinath, et autres
Publié: (2025)
Analysis of LLMs Against Prompt Injection and Jailbreak Attacks
par: Jaiswal, Piyush, et autres
Publié: (2026)
par: Jaiswal, Piyush, et autres
Publié: (2026)
Evaluation of Prompt Injection Defenses in Large Language Models
par: Deep, Priyal, et autres
Publié: (2026)
par: Deep, Priyal, et autres
Publié: (2026)
Assessing Prompt Injection Risks in 200+ Custom GPTs
par: Yu, Jiahao, et autres
Publié: (2023)
par: Yu, Jiahao, et autres
Publié: (2023)
WAInjectBench: Benchmarking Prompt Injection Detections for Web Agents
par: Liu, Yinuo, et autres
Publié: (2025)
par: Liu, Yinuo, et autres
Publié: (2025)
Policy-Guided Threat Hunting: An LLM enabled Framework with Splunk SOC Triage
par: Sahay, Rishikesh, et autres
Publié: (2026)
par: Sahay, Rishikesh, et autres
Publié: (2026)
Adversarial Threat Vectors and Risk Mitigation for Retrieval-Augmented Generation Systems
par: Ward, Chris M., et autres
Publié: (2025)
par: Ward, Chris M., et autres
Publié: (2025)
ClawGuard: A Runtime Security Framework for Tool-Augmented LLM Agents Against Indirect Prompt Injection
par: Zhao, Wei, et autres
Publié: (2026)
par: Zhao, Wei, et autres
Publié: (2026)
ThreatFormer-IDS: Robust Transformer Intrusion Detection with Zero-Day Generalization and Explainable Attribution
par: Nayak, Srikumar
Publié: (2026)
par: Nayak, Srikumar
Publié: (2026)
Documents similaires
-
Prompt Injection 2.0: Hybrid AI Threats
par: McHugh, Jeremy, et autres
Publié: (2025) -
Portable Agent Memory: A Protocol for Cryptographically-Verified Memory Transfer Across Heterogeneous AI Agents
par: Ravindran, Santhosh Kumar
Publié: (2026) -
Prompt Injection as an Emerging Threat: Evaluating the Resilience of Large Language Models
par: Ganiuly, Daniyal, et autres
Publié: (2025) -
From Prompt Injections to Protocol Exploits: Threats in LLM-Powered AI Agents Workflows
par: Ferrag, Mohamed Amine, et autres
Publié: (2025) -
RAG-targeted Adversarial Attack on LLM-based Threat Detection and Mitigation Framework
par: Ikbarieh, Seif, et autres
Publié: (2025)