MCPHunt: An Evaluation Framework for Cross-Boundary Data Propagation in Multi-Server MCP Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Haonan, Sun, Tianjun, Wang, Yongqing, Zhang, Qisheng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MCPGuard : Automatically Detecting Vulnerabilities in MCP Servers
par: Wang, Bin, et autres
Publié: (2025)
par: Wang, Bin, et autres
Publié: (2025)
PHMForge: Evaluating LLM Agents on Industrial Prognostics through MCP-Native, Algorithm-Grounded Tools
par: Feng, Tianjun, et autres
Publié: (2026)
par: Feng, Tianjun, et autres
Publié: (2026)
Trivial Trojans: How Minimal MCP Servers Enable Cross-Tool Exfiltration of Sensitive Data
par: Croce, Nicola, et autres
Publié: (2025)
par: Croce, Nicola, et autres
Publié: (2025)
MCP-SafetyBench: A Benchmark for Safety Evaluation of Large Language Models with Real-World MCP Servers
par: Zong, Xuanjun, et autres
Publié: (2025)
par: Zong, Xuanjun, et autres
Publié: (2025)
LiteCUA: Computer as MCP Server for Computer-Use Agent on AIOS
par: Mei, Kai, et autres
Publié: (2025)
par: Mei, Kai, et autres
Publié: (2025)
Towards a Declarative Agentic Layer for Intelligent Agents in MCP-Based Server Ecosystems
par: Rodriguez-Sanchez, Maria Jesus, et autres
Publié: (2026)
par: Rodriguez-Sanchez, Maria Jesus, et autres
Publié: (2026)
MCP-Atlas: A Large-Scale Benchmark for Tool-Use Competency with Real MCP Servers
par: Bandi, Chaithanya, et autres
Publié: (2026)
par: Bandi, Chaithanya, et autres
Publié: (2026)
ROSBag MCP Server: Analyzing Robot Data with LLMs for Agentic Embodied AI Applications
par: Fu, Lei, et autres
Publié: (2025)
par: Fu, Lei, et autres
Publié: (2025)
MCP-ITP: An Automated Framework for Implicit Tool Poisoning in MCP
par: Li, Ruiqi, et autres
Publié: (2026)
par: Li, Ruiqi, et autres
Publié: (2026)
TAIJI: MCP-based Multi-Modal Data Analytics on Data Lakes
par: Zhang, Chao, et autres
Publié: (2025)
par: Zhang, Chao, et autres
Publié: (2025)
TrafficSimAgent: A Hierarchical Agent Framework for Autonomous Traffic Simulation with MCP Control
par: Du, Yuwei, et autres
Publié: (2025)
par: Du, Yuwei, et autres
Publié: (2025)
MCP-AgentBench: Evaluating Real-World Language Agent Performance with MCP-Mediated Tools
par: Guo, Zikang, et autres
Publié: (2025)
par: Guo, Zikang, et autres
Publié: (2025)
TCP-MCP: Landscape-Guided Co-Evolution of Prompts and Communication Topologies for Multi-Agent Systems
par: Ding, Yi, et autres
Publié: (2026)
par: Ding, Yi, et autres
Publié: (2026)
MCP-Orchestrated Multi-Agent System for Automated Disinformation Detection
par: Avram, Alexandru-Andrei, et autres
Publié: (2025)
par: Avram, Alexandru-Andrei, et autres
Publié: (2025)
MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models
par: Liu, Zhiwei, et autres
Publié: (2025)
par: Liu, Zhiwei, et autres
Publié: (2025)
MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers
par: Luo, Ziyang, et autres
Publié: (2025)
par: Luo, Ziyang, et autres
Publié: (2025)
MCP-Flow: Facilitating LLM Agents to Master Real-World, Diverse and Scaling MCP Tools
par: Wang, Wenhao, et autres
Publié: (2025)
par: Wang, Wenhao, et autres
Publié: (2025)
AgentDistill: Training-Free Agent Distillation with Generalizable MCP Boxes
par: Qiu, Jiahao, et autres
Publié: (2025)
par: Qiu, Jiahao, et autres
Publié: (2025)
LiveMCP-101: Stress Testing and Diagnosing MCP-enabled Agents on Challenging Queries
par: Yin, Ming, et autres
Publié: (2025)
par: Yin, Ming, et autres
Publié: (2025)
ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox
par: Li, Yuanyang, et autres
Publié: (2026)
par: Li, Yuanyang, et autres
Publié: (2026)
MCP Bridge: A Lightweight, LLM-Agnostic RESTful Proxy for Model Context Protocol Servers
par: Ahmadi, Arash, et autres
Publié: (2025)
par: Ahmadi, Arash, et autres
Publié: (2025)
EE-MCP: Self-Evolving MCP-GUI Agents via Automated Environment Generation and Experience Learning
par: He, Tiantian, et autres
Publié: (2026)
par: He, Tiantian, et autres
Publié: (2026)
A Modular Reference Architecture for MCP-Servers Enabling Agentic BIM Interaction
par: Heimig-Elschner, Tobias, et autres
Publié: (2025)
par: Heimig-Elschner, Tobias, et autres
Publié: (2025)
A Privacy-Preserving Framework with Multi-Modal Data for Cross-Domain Recommendation
par: Wang, Li, et autres
Publié: (2024)
par: Wang, Li, et autres
Publié: (2024)
MCP-Cosmos: World Model-Augmented Agents for Complex Task Execution in MCP Environments
par: Ganapavarapu, Giridhar, et autres
Publié: (2026)
par: Ganapavarapu, Giridhar, et autres
Publié: (2026)
A Multi-Agent Framework with Automated Decision Rule Optimization for Cross-Domain Misinformation Detection
par: Li, Hui, et autres
Publié: (2025)
par: Li, Hui, et autres
Publié: (2025)
When Continual Learning Moves to Memory: A Study of Experience Reuse in LLM Agents
par: Hu, Qisheng, et autres
Publié: (2026)
par: Hu, Qisheng, et autres
Publié: (2026)
AutoBinder Agent: An MCP-Based Agent for End-to-End Protein Binder Design
par: Ge, Fukang, et autres
Publié: (2026)
par: Ge, Fukang, et autres
Publié: (2026)
Leveraging LLMs as Meta-Judges: A Multi-Agent Framework for Evaluating LLM Judgments
par: Li, Yuran, et autres
Publié: (2025)
par: Li, Yuran, et autres
Publié: (2025)
MCPAgentBench: A Real-world Task Benchmark for Evaluating LLM Agent MCP Tool Use
par: Liu, Wenrui, et autres
Publié: (2025)
par: Liu, Wenrui, et autres
Publié: (2025)
MultiVis-Agent: A Multi-Agent Framework with Logic Rules for Reliable and Comprehensive Cross-Modal Data Visualization
par: Lu, Jinwei, et autres
Publié: (2026)
par: Lu, Jinwei, et autres
Publié: (2026)
LiveMCPBench: Can Agents Navigate an Ocean of MCP Tools?
par: Mo, Guozhao, et autres
Publié: (2025)
par: Mo, Guozhao, et autres
Publié: (2025)
DataCross: A Unified Benchmark and Agent Framework for Cross-Modal Heterogeneous Data Analysis
par: Qi, Ruyi, et autres
Publié: (2026)
par: Qi, Ruyi, et autres
Publié: (2026)
Agent-ValueBench: A Comprehensive Benchmark for Evaluating Agent Values
par: Dong, Haonan, et autres
Publié: (2026)
par: Dong, Haonan, et autres
Publié: (2026)
MedMCP-Calc: Benchmarking LLMs for Realistic Medical Calculator Scenarios via MCP Integration
par: Zhu, Yakun, et autres
Publié: (2026)
par: Zhu, Yakun, et autres
Publié: (2026)
Cognitive Insights and Stable Coalition Matching for Fostering Multi-Agent Cooperation
par: Shao, Jiaqi, et autres
Publié: (2024)
par: Shao, Jiaqi, et autres
Publié: (2024)
A Study on the MCP x A2A Framework for Enhancing Interoperability of LLM-based Autonomous Agents
par: Jeong, Cheonsu
Publié: (2025)
par: Jeong, Cheonsu
Publié: (2025)
ACE-Router: Generalizing History-Aware Routing from MCP Tools to the Agent Web
par: Yao, Zhiyuan, et autres
Publié: (2026)
par: Yao, Zhiyuan, et autres
Publié: (2026)
EvoAgent: An Evolvable Agent Framework with Skill Learning and Multi-Agent Delegation
par: Zhang, Aimin, et autres
Publié: (2026)
par: Zhang, Aimin, et autres
Publié: (2026)
Mobile-Agent-RAG: Driving Smart Multi-Agent Coordination with Contextual Knowledge Empowerment for Long-Horizon Mobile Automation
par: Zhou, Yuxiang, et autres
Publié: (2025)
par: Zhou, Yuxiang, et autres
Publié: (2025)
Documents similaires
-
MCPGuard : Automatically Detecting Vulnerabilities in MCP Servers
par: Wang, Bin, et autres
Publié: (2025) -
PHMForge: Evaluating LLM Agents on Industrial Prognostics through MCP-Native, Algorithm-Grounded Tools
par: Feng, Tianjun, et autres
Publié: (2026) -
Trivial Trojans: How Minimal MCP Servers Enable Cross-Tool Exfiltration of Sensitive Data
par: Croce, Nicola, et autres
Publié: (2025) -
MCP-SafetyBench: A Benchmark for Safety Evaluation of Large Language Models with Real-World MCP Servers
par: Zong, Xuanjun, et autres
Publié: (2025) -
LiteCUA: Computer as MCP Server for Computer-Use Agent on AIOS
par: Mei, Kai, et autres
Publié: (2025)