MCPTox: A Benchmark for Tool Poisoning Attack on Real-World MCP Servers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Zhiqiang, Gao, Yichao, Wang, Yanting, Liu, Suyuan, Sun, Haifeng, Cheng, Haoran, Shi, Guanquan, Du, Haohua, Li, Xiangyang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MindGuard: Intrinsic Decision Inspection for Securing LLM Agents Against Metadata Poisoning
par: Wang, Zhiqiang, et autres
Publié: (2025)
par: Wang, Zhiqiang, et autres
Publié: (2025)
MCP-ITP: An Automated Framework for Implicit Tool Poisoning in MCP
par: Li, Ruiqi, et autres
Publié: (2026)
par: Li, Ruiqi, et autres
Publié: (2026)
SoK: Trust-Authorization Mismatch in LLM Agent Interactions
par: Shi, Guanquan, et autres
Publié: (2025)
par: Shi, Guanquan, et autres
Publié: (2025)
MCP Pitfall Lab: Exposing Developer Pitfalls in MCP Tool Server Security under Multi-Vector Attacks
par: Hao, Run, et autres
Publié: (2026)
par: Hao, Run, et autres
Publié: (2026)
A First Measurement Study on Authentication Security in Real-World Remote MCP Servers
par: Zhou, Huijun, et autres
Publié: (2026)
par: Zhou, Huijun, et autres
Publié: (2026)
IntentMiner: Intent Inversion Attack via Tool Call Analysis in the Model Context Protocol
par: Yao, Yunhao, et autres
Publié: (2025)
par: Yao, Yunhao, et autres
Publié: (2025)
Auditing MCP Servers for Over-Privileged Tool Capabilities
par: Huang, Charoes, et autres
Publié: (2026)
par: Huang, Charoes, et autres
Publié: (2026)
When MCP Servers Attack: Taxonomy, Feasibility, and Mitigation
par: Zhao, Weibo, et autres
Publié: (2025)
par: Zhao, Weibo, et autres
Publié: (2025)
When the Manual Lies: A Realistic Benchmark to Evaluate MCP Poisoning Attacks for LLM Agents
par: Liu, Shi, et autres
Publié: (2026)
par: Liu, Shi, et autres
Publié: (2026)
MCPGuard : Automatically Detecting Vulnerabilities in MCP Servers
par: Wang, Bin, et autres
Publié: (2025)
par: Wang, Bin, et autres
Publié: (2025)
SECNEURON: Reliable and Flexible Abuse Control in Local LLMs via Hybrid Neuron Encryption
par: Wang, Zhiqiang, et autres
Publié: (2025)
par: Wang, Zhiqiang, et autres
Publié: (2025)
Trivial Trojans: How Minimal MCP Servers Enable Cross-Tool Exfiltration of Sensitive Data
par: Croce, Nicola, et autres
Publié: (2025)
par: Croce, Nicola, et autres
Publié: (2025)
Can LLM Infer Risk Information From MCP Server System Logs?
par: Fu, Jiayi, et autres
Publié: (2025)
par: Fu, Jiayi, et autres
Publié: (2025)
VIPER-MCP: Detecting and Exploiting Taint-Style Vulnerabilities in Model Context Protocol Servers
par: Sun, Pengyu, et autres
Publié: (2026)
par: Sun, Pengyu, et autres
Publié: (2026)
ExtendAttack: Attacking Servers of LRMs via Extending Reasoning
par: Zhu, Zhenhao, et autres
Publié: (2025)
par: Zhu, Zhenhao, et autres
Publié: (2025)
Activation-Guided Local Editing for Jailbreaking Attacks
par: Wang, Jiecong, et autres
Publié: (2025)
par: Wang, Jiecong, et autres
Publié: (2025)
Benchmarking Poisoning Attacks against Retrieval-Augmented Generation
par: Zhang, Baolei, et autres
Publié: (2025)
par: Zhang, Baolei, et autres
Publié: (2025)
Mitigating Data Poisoning Attacks to Local Differential Privacy
par: Li, Xiaolin, et autres
Publié: (2025)
par: Li, Xiaolin, et autres
Publié: (2025)
Confused ChatGPT: Cross-App Context Poisoning via First-Party APIs
par: Wang, Chao, et autres
Publié: (2026)
par: Wang, Chao, et autres
Publié: (2026)
Parasites in the Toolchain: A Large-Scale Analysis of Attacks on the MCP Ecosystem
par: Zhao, Shuli, et autres
Publié: (2025)
par: Zhao, Shuli, et autres
Publié: (2025)
PoisonCatcher: Revealing and Identifying LDP Poisoning Attacks in IIoT
par: Shuai, Lisha, et autres
Publié: (2024)
par: Shuai, Lisha, et autres
Publié: (2024)
Knowledge Poisoning Attacks on Medical Multi-Modal Retrieval-Augmented Generation
par: Yang, Peiru, et autres
Publié: (2026)
par: Yang, Peiru, et autres
Publié: (2026)
RefineRAG: Word-Level Poisoning Attacks via Retriever-Guided Text Refinement
par: Wang, Ziye, et autres
Publié: (2026)
par: Wang, Ziye, et autres
Publié: (2026)
From Component Manipulation to System Compromise: Understanding and Detecting Malicious MCP Servers
par: Huang, Yiheng, et autres
Publié: (2026)
par: Huang, Yiheng, et autres
Publié: (2026)
Tricking Retrievers with Influential Tokens: An Efficient Black-Box Corpus Poisoning Attack
par: Wang, Cheng, et autres
Publié: (2025)
par: Wang, Cheng, et autres
Publié: (2025)
Provable Watermarking for Data Poisoning Attacks
par: Zhu, Yifan, et autres
Publié: (2025)
par: Zhu, Yifan, et autres
Publié: (2025)
Denial-of-Service Poisoning Attacks against Large Language Models
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
Sharpness-Aware Data Poisoning Attack
par: He, Pengfei, et autres
Publié: (2023)
par: He, Pengfei, et autres
Publié: (2023)
Poisoning Attacks and Defenses in Recommender Systems: A Survey
par: Wang, Zongwei, et autres
Publié: (2024)
par: Wang, Zongwei, et autres
Publié: (2024)
Defense against Poisoning Attacks under Shuffle-DP
par: Wang, Siyi, et autres
Publié: (2026)
par: Wang, Siyi, et autres
Publié: (2026)
Poisoned-MRAG: Knowledge Poisoning Attacks to Multimodal Retrieval Augmented Generation
par: Liu, Yinuo, et autres
Publié: (2025)
par: Liu, Yinuo, et autres
Publié: (2025)
SafeToolBench: Pioneering a Prospective Benchmark to Evaluating Tool Utilization Safety in LLMs
par: Xia, Hongfei, et autres
Publié: (2025)
par: Xia, Hongfei, et autres
Publié: (2025)
Comprehensive Evaluation of Cloaking Backdoor Attacks on Object Detector in Real-World
par: Ma, Hua, et autres
Publié: (2025)
par: Ma, Hua, et autres
Publié: (2025)
Spa-VLM: Stealthy Poisoning Attacks on RAG-based VLM
par: Yu, Lei, et autres
Publié: (2025)
par: Yu, Lei, et autres
Publié: (2025)
IndirectAD: Practical Data Poisoning Attacks against Recommender Systems for Item Promotion
par: Wang, Zihao, et autres
Publié: (2025)
par: Wang, Zihao, et autres
Publié: (2025)
MCP Bridge: A Lightweight, LLM-Agnostic RESTful Proxy for Model Context Protocol Servers
par: Ahmadi, Arash, et autres
Publié: (2025)
par: Ahmadi, Arash, et autres
Publié: (2025)
MCP-SandboxScan: WASM-based Secure Execution and Runtime Analysis for MCP Tools
par: Tan, Zhuoran, et autres
Publié: (2026)
par: Tan, Zhuoran, et autres
Publié: (2026)
Data Poisoning Attacks in Intelligent Transportation Systems: A Survey
par: Wang, Feilong, et autres
Publié: (2024)
par: Wang, Feilong, et autres
Publié: (2024)
MCP Security Bench (MSB): Benchmarking Attacks Against Model Context Protocol in LLM Agents
par: Zhang, Dongsen, et autres
Publié: (2025)
par: Zhang, Dongsen, et autres
Publié: (2025)
PRSA: Prompt Stealing Attacks against Real-World Prompt Services
par: Yang, Yong, et autres
Publié: (2024)
par: Yang, Yong, et autres
Publié: (2024)
Documents similaires
-
MindGuard: Intrinsic Decision Inspection for Securing LLM Agents Against Metadata Poisoning
par: Wang, Zhiqiang, et autres
Publié: (2025) -
MCP-ITP: An Automated Framework for Implicit Tool Poisoning in MCP
par: Li, Ruiqi, et autres
Publié: (2026) -
SoK: Trust-Authorization Mismatch in LLM Agent Interactions
par: Shi, Guanquan, et autres
Publié: (2025) -
MCP Pitfall Lab: Exposing Developer Pitfalls in MCP Tool Server Security under Multi-Vector Attacks
par: Hao, Run, et autres
Publié: (2026) -
A First Measurement Study on Authentication Security in Real-World Remote MCP Servers
par: Zhou, Huijun, et autres
Publié: (2026)