Securing AI Systems: A Guide to Known Attacks and Impacts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kiribuchi, Naoto, Zenitani, Kengo, Semitsu, Takayuki |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Automated Analysis of Global AI Safety Initiatives: A Taxonomy-Driven LLM Approach
par: Semitsu, Takayuki, et autres
Publié: (2026)
par: Semitsu, Takayuki, et autres
Publié: (2026)
Securing AI Agents Against Prompt Injection Attacks
par: Ramakrishnan, Badrinath, et autres
Publié: (2025)
par: Ramakrishnan, Badrinath, et autres
Publié: (2025)
AI Security Map: Holistic Organization of AI Security Technologies and Impacts on Stakeholders
par: Kato, Hiroya, et autres
Publié: (2025)
par: Kato, Hiroya, et autres
Publié: (2025)
Architecting Secure AI Agents: Perspectives on System-Level Defenses Against Indirect Prompt Injection Attacks
par: Xiang, Chong, et autres
Publié: (2026)
par: Xiang, Chong, et autres
Publié: (2026)
Breaking the Code: Security Assessment of AI Code Agents Through Systematic Jailbreaking Attacks
par: Saha, Shoumik, et autres
Publié: (2025)
par: Saha, Shoumik, et autres
Publié: (2025)
SPEAR: Security Posture Evaluation using AI Planner-Reasoning on Attack-Connectivity Hypergraphs
par: Podder, Rakesh, et autres
Publié: (2025)
par: Podder, Rakesh, et autres
Publié: (2025)
Towards Robust and Secure Embodied AI: A Survey on Vulnerabilities and Attacks
par: Xing, Wenpeng, et autres
Publié: (2025)
par: Xing, Wenpeng, et autres
Publié: (2025)
Security of Internet of Agents: Attacks and Countermeasures
par: Wang, Yuntao, et autres
Publié: (2025)
par: Wang, Yuntao, et autres
Publié: (2025)
Offensive Security for AI Systems: Concepts, Practices, and Applications
par: Harguess, Josh, et autres
Publié: (2025)
par: Harguess, Josh, et autres
Publié: (2025)
Security-First AI: Foundations for Robust and Trustworthy Systems
par: Tallam, Krti
Publié: (2025)
par: Tallam, Krti
Publié: (2025)
CAM-LDS: Cyber Attack Manifestations for Automatic Interpretation of System Logs and Security Alerts
par: Landauer, Max, et autres
Publié: (2026)
par: Landauer, Max, et autres
Publié: (2026)
Serverless AI Security: Attack Surface Analysis and Runtime Protection Mechanisms for FaaS-Based Machine Learning
par: Pathade, Chetan, et autres
Publié: (2026)
par: Pathade, Chetan, et autres
Publié: (2026)
Evolving Security in LLMs: A Study of Jailbreak Attacks and Defenses
par: Shang, Zhengchun, et autres
Publié: (2025)
par: Shang, Zhengchun, et autres
Publié: (2025)
CyberSentinel: An Emergent Threat Detection System for AI Security
par: Tallam, Krti
Publié: (2025)
par: Tallam, Krti
Publié: (2025)
The System Prompt Is the Attack Surface: How LLM Agent Configuration Shapes Security and Creates Exploitable Vulnerabilities
par: Litvak, Ron
Publié: (2026)
par: Litvak, Ron
Publié: (2026)
Securing Agentic AI: Threat Modeling and Risk Analysis for Network Monitoring Agentic AI System
par: Zambare, Pallavi, et autres
Publié: (2025)
par: Zambare, Pallavi, et autres
Publié: (2025)
Security of AI Agents
par: He, Yifeng, et autres
Publié: (2024)
par: He, Yifeng, et autres
Publié: (2024)
MCP Guardian: A Security-First Layer for Safeguarding MCP-Based AI System
par: Kumar, Sonu, et autres
Publié: (2025)
par: Kumar, Sonu, et autres
Publié: (2025)
CivicShield: A Cross-Domain Defense-in-Depth Framework for Securing Government-Facing AI Chatbots Against Multi-Turn Adversarial Attacks
par: Patil, KrishnaSaiReddy
Publié: (2026)
par: Patil, KrishnaSaiReddy
Publié: (2026)
RAG Security and Privacy: Formalizing the Threat Model and Attack Surface
par: Arzanipour, Atousa, et autres
Publié: (2025)
par: Arzanipour, Atousa, et autres
Publié: (2025)
Enhancing TinyML Security: Study of Adversarial Attack Transferability
par: Shah, Parin, et autres
Publié: (2024)
par: Shah, Parin, et autres
Publié: (2024)
Democratizing ML for Enterprise Security: A Self-Sustained Attack Detection Framework
par: Momeni, Sadegh, et autres
Publié: (2025)
par: Momeni, Sadegh, et autres
Publié: (2025)
Securing Retrieval-Augmented Generation: A Taxonomy of Attacks, Defenses, and Future Directions
par: Xu, Yuming, et autres
Publié: (2026)
par: Xu, Yuming, et autres
Publié: (2026)
SECUREVENT: Hybrid AI/ML Security Monitoring for Distributed Event-Based Systems
par: Liang, Eric
Publié: (2026)
par: Liang, Eric
Publié: (2026)
ATLAS: AI-Assisted Threat-to-Assertion Learning for System-on-Chip Security Verification
par: Tashdid, Ishraq, et autres
Publié: (2026)
par: Tashdid, Ishraq, et autres
Publié: (2026)
Agentic AI for Cyber Resilience: A New Security Paradigm and Its System-Theoretic Foundations
par: Li, Tao, et autres
Publié: (2025)
par: Li, Tao, et autres
Publié: (2025)
Security of and by Generative AI platforms
par: Hayagreevan, Hari, et autres
Publié: (2024)
par: Hayagreevan, Hari, et autres
Publié: (2024)
The AI Security Pyramid of Pain
par: Ward, Chris M., et autres
Publié: (2024)
par: Ward, Chris M., et autres
Publié: (2024)
Secure Multiparty Generative AI
par: Shrestha, Manil, et autres
Publié: (2024)
par: Shrestha, Manil, et autres
Publié: (2024)
MATRA: Modeling the Attack Surface of Agentic AI Systems -- OpenClaw Case Study
par: Van hamme, Tim, et autres
Publié: (2026)
par: Van hamme, Tim, et autres
Publié: (2026)
Distillability of LLM Security Logic: Predicting Attack Success Rate of Outline Filling Attack via Ranking Regression
par: Zhang, Tianyu, et autres
Publié: (2025)
par: Zhang, Tianyu, et autres
Publié: (2025)
Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security
par: Dai, Muzhi, et autres
Publié: (2025)
par: Dai, Muzhi, et autres
Publié: (2025)
Concept-Guided Backdoor Attack on Vision Language Models
par: Shen, Haoyu, et autres
Publié: (2025)
par: Shen, Haoyu, et autres
Publié: (2025)
PBI-Attack: Prior-Guided Bimodal Interactive Black-Box Jailbreak Attack for Toxicity Maximization
par: Cheng, Ruoxi, et autres
Publié: (2024)
par: Cheng, Ruoxi, et autres
Publié: (2024)
Meta SecAlign: A Secure Foundation LLM Against Prompt Injection Attacks
par: Chen, Sizhe, et autres
Publié: (2025)
par: Chen, Sizhe, et autres
Publié: (2025)
Autonomous Action Runtime Management(AARM):A System Specification for Securing AI-Driven Actions at Runtime
par: Errico, Herman
Publié: (2026)
par: Errico, Herman
Publié: (2026)
Towards Secure MLOps: Surveying Attacks, Mitigation Strategies, and Research Challenges
par: Patel, Raj, et autres
Publié: (2025)
par: Patel, Raj, et autres
Publié: (2025)
WASP: Benchmarking Web Agent Security Against Prompt Injection Attacks
par: Evtimov, Ivan, et autres
Publié: (2025)
par: Evtimov, Ivan, et autres
Publié: (2025)
FedSecurity: Benchmarking Attacks and Defenses in Federated Learning and Federated LLMs
par: Han, Shanshan, et autres
Publié: (2023)
par: Han, Shanshan, et autres
Publié: (2023)
Cascade: Composing Software-Hardware Attack Gadgets for Adversarial Threat Amplification in Compound AI Systems
par: Banerjee, Sarbartha, et autres
Publié: (2026)
par: Banerjee, Sarbartha, et autres
Publié: (2026)
Documents similaires
-
Automated Analysis of Global AI Safety Initiatives: A Taxonomy-Driven LLM Approach
par: Semitsu, Takayuki, et autres
Publié: (2026) -
Securing AI Agents Against Prompt Injection Attacks
par: Ramakrishnan, Badrinath, et autres
Publié: (2025) -
AI Security Map: Holistic Organization of AI Security Technologies and Impacts on Stakeholders
par: Kato, Hiroya, et autres
Publié: (2025) -
Architecting Secure AI Agents: Perspectives on System-Level Defenses Against Indirect Prompt Injection Attacks
par: Xiang, Chong, et autres
Publié: (2026) -
Breaking the Code: Security Assessment of AI Code Agents Through Systematic Jailbreaking Attacks
par: Saha, Shoumik, et autres
Publié: (2025)