ShieldNet: Network-Level Guardrails against Emerging Supply-Chain Injections in Agentic Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yuan, Zhuowen, Chen, Zhaorun, Xiang, Zhen, Bastian, Nathaniel D., Hashemi, Seyyed Hadi, Xiao, Chaowei, Guo, Wenbo, Li, Bo |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SafeVision: Efficient Image Guardrail with Robust Policy Adherence and Explainability
par: Xu, Peiyang, et autres
Publié: (2025)
par: Xu, Peiyang, et autres
Publié: (2025)
AgentPoison: Red-teaming LLM Agents via Poisoning Memory or Knowledge Bases
par: Chen, Zhaorun, et autres
Publié: (2024)
par: Chen, Zhaorun, et autres
Publié: (2024)
RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content
par: Yuan, Zhuowen, et autres
Publié: (2024)
par: Yuan, Zhuowen, et autres
Publié: (2024)
System-Level Defense against Indirect Prompt Injection Attacks: An Information Flow Control Perspective
par: Wu, Fangzhou, et autres
Publié: (2024)
par: Wu, Fangzhou, et autres
Publié: (2024)
ShieldAgent: Shielding Agents via Verifiable Safety Policy Reasoning
par: Chen, Zhaorun, et autres
Publié: (2025)
par: Chen, Zhaorun, et autres
Publié: (2025)
SafeWatch: An Efficient Safety-Policy Following Video Guardrail Model with Transparent Explanations
par: Chen, Zhaorun, et autres
Publié: (2024)
par: Chen, Zhaorun, et autres
Publié: (2024)
LPG: Balancing Efficiency and Policy Reasoning in Latent Policy Guardrails
par: Li, Nanxi, et autres
Publié: (2026)
par: Li, Nanxi, et autres
Publié: (2026)
ML-Bench&Guard: Policy-Grounded Multilingual Safety Benchmark and Guardrail for Large Language Models
par: Zhao, Yunhan, et autres
Publié: (2026)
par: Zhao, Yunhan, et autres
Publié: (2026)
Automatic and Universal Prompt Injection Attacks against Large Language Models
par: Liu, Xiaogeng, et autres
Publié: (2024)
par: Liu, Xiaogeng, et autres
Publié: (2024)
Mitigating Indirect Prompt Injection via Instruction-Following Intent Analysis
par: Kang, Mintong, et autres
Publié: (2025)
par: Kang, Mintong, et autres
Publié: (2025)
ReasAlign: Reasoning Enhanced Safety Alignment against Prompt Injection Attack
par: Li, Hao, et autres
Publié: (2026)
par: Li, Hao, et autres
Publié: (2026)
Analgesic Efficacy of Bromelain and Bromelain Plus Turmeric for Pain Control After Orthodontic Separator Placement: A Triple‐Blind Randomized Clinical Trial
par: Shabnam Ajami, et autres
Publié: (2025)
par: Shabnam Ajami, et autres
Publié: (2025)
Roadmap to Precision 3D Printing of Cellulose: Rheology‐Guided Formulation, Fidelity Assessment, and Application Horizons (Adv. Mater. Technol. 8/2026)
par: Majed Amini, et autres
Publié: (2026)
par: Majed Amini, et autres
Publié: (2026)
Structural Design for EMI Shielding: From Underlying Mechanisms to Common Pitfalls
par: Ali Akbar Isari, et autres
Publié: (2024)
par: Ali Akbar Isari, et autres
Publié: (2024)
OneShield -- the Next Generation of LLM Guardrails
par: DeLuca, Chad, et autres
Publié: (2025)
par: DeLuca, Chad, et autres
Publié: (2025)
A Survey of Visual Attention Models
par: Seyyed Mohammad Reza Hashemi
Publié: (2015)
par: Seyyed Mohammad Reza Hashemi
Publié: (2015)
Architecting Secure AI Agents: Perspectives on System-Level Defenses Against Indirect Prompt Injection Attacks
par: Xiang, Chong, et autres
Publié: (2026)
par: Xiang, Chong, et autres
Publié: (2026)
Poly-Guard: Massive Multi-Domain Safety Policy-Grounded Guardrail Dataset
par: Kang, Mintong, et autres
Publié: (2025)
par: Kang, Mintong, et autres
Publié: (2025)
Bypassing LLM Guardrails: An Empirical Analysis of Evasion Attacks against Prompt Injection and Jailbreak Detection Systems
par: Hackett, William, et autres
Publié: (2025)
par: Hackett, William, et autres
Publié: (2025)
AGrail: A Lifelong Agent Guardrail with Effective and Adaptive Safety Detection
par: Luo, Weidi, et autres
Publié: (2025)
par: Luo, Weidi, et autres
Publié: (2025)
AdaShield: Safeguarding Multimodal Large Language Models from Structure-based Attack via Adaptive Shield Prompting
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Peering Behind the Shield: Guardrail Identification in Large Language Models
par: Yang, Ziqing, et autres
Publié: (2025)
par: Yang, Ziqing, et autres
Publié: (2025)
Emerging Trends and Challenges in Supply Chain Management and Sustainability
par: Isabel Castillo‐Pérez, et autres
Publié: (2025)
par: Isabel Castillo‐Pérez, et autres
Publié: (2025)
Supply Chain Network Extraction and Entity Classification Leveraging Large Language Models
par: Liu, Tong, et autres
Publié: (2024)
par: Liu, Tong, et autres
Publié: (2024)
FATH: Authentication-based Test-time Defense against Indirect Prompt Injection Attacks
par: Wang, Jiongxiao, et autres
Publié: (2024)
par: Wang, Jiongxiao, et autres
Publié: (2024)
Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models
par: Abolghasemi, Amin, et autres
Publié: (2024)
par: Abolghasemi, Amin, et autres
Publié: (2024)
Agentic AI Sustainability Assessment for Supply Chain Document Insights
par: Gosmar, Diego, et autres
Publié: (2025)
par: Gosmar, Diego, et autres
Publié: (2025)
Formal Analysis and Supply Chain Security for Agentic AI Skills
par: Bhardwaj, Varun Pratap
Publié: (2026)
par: Bhardwaj, Varun Pratap
Publié: (2026)
ORCA: An Agentic Reasoning Framework for Hallucination and Adversarial Robustness in Vision-Language Models
par: Yu, Chung-En Johnny, et autres
Publié: (2025)
par: Yu, Chung-En Johnny, et autres
Publié: (2025)
EIA: Environmental Injection Attack on Generalist Web Agents for Privacy Leakage
par: Liao, Zeyi, et autres
Publié: (2024)
par: Liao, Zeyi, et autres
Publié: (2024)
Generalized Holographic Reduced Representations
par: Yeung, Calvin, et autres
Publié: (2024)
par: Yeung, Calvin, et autres
Publié: (2024)
AI Supply Chains: An Emerging Ecosystem of AI Actors, Products, and Services
par: Hopkins, Aspen, et autres
Publié: (2025)
par: Hopkins, Aspen, et autres
Publié: (2025)
Dynamic Self-Assessment of Supply Chains Performance: an Emerging Market Approach
par: M. Cedillo-Campos
Publié: (2013)
par: M. Cedillo-Campos
Publié: (2013)
ClusComp: A Simple Paradigm for Model Compression and Efficient Finetuning
par: Liao, Baohao, et autres
Publié: (2025)
par: Liao, Baohao, et autres
Publié: (2025)
Unilogit: Robust Machine Unlearning for LLMs Using Uniform-Target Self-Distillation
par: Vasilev, Stefan, et autres
Publié: (2025)
par: Vasilev, Stefan, et autres
Publié: (2025)
Automating Supply Chain Disruption Monitoring via an Agentic AI Approach
par: AlMahri, Sara, et autres
Publié: (2026)
par: AlMahri, Sara, et autres
Publié: (2026)
LLM Scalability Risk for Agentic-AI and Model Supply Chain Security
par: Ahi, Kiarash, et autres
Publié: (2026)
par: Ahi, Kiarash, et autres
Publié: (2026)
Novel Blockchain-based Protocols for Electronic Voting and Auctions
par: Lin, Zhaorun
Publié: (2025)
par: Lin, Zhaorun
Publié: (2025)
TrojFM: Resource-efficient Backdoor Attacks against Very Large Foundation Models
par: Nie, Yuzhou., et autres
Publié: (2024)
par: Nie, Yuzhou., et autres
Publié: (2024)
Noise Injection Systemically Degrades Large Language Model Safety Guardrails
par: Shahani, Prithviraj Singh, et autres
Publié: (2025)
par: Shahani, Prithviraj Singh, et autres
Publié: (2025)
Documents similaires
-
SafeVision: Efficient Image Guardrail with Robust Policy Adherence and Explainability
par: Xu, Peiyang, et autres
Publié: (2025) -
AgentPoison: Red-teaming LLM Agents via Poisoning Memory or Knowledge Bases
par: Chen, Zhaorun, et autres
Publié: (2024) -
RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content
par: Yuan, Zhuowen, et autres
Publié: (2024) -
System-Level Defense against Indirect Prompt Injection Attacks: An Information Flow Control Perspective
par: Wu, Fangzhou, et autres
Publié: (2024) -
ShieldAgent: Shielding Agents via Verifiable Safety Policy Reasoning
par: Chen, Zhaorun, et autres
Publié: (2025)