SkillProbe: Security Auditing for Emerging Agent Skill Marketplaces via Multi-Agent Collaboration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guo, Zihan, Chen, Zhiyu, Nie, Xiaohang, Lin, Jianghao, Zhou, Yuanjian, Zhang, Weinan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploiting LLM Agent Supply Chains via Payload-less Skills
par: Liu, Xinyu, et autres
Publié: (2026)
par: Liu, Xinyu, et autres
Publié: (2026)
When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems
par: Wang, Su, et autres
Publié: (2026)
par: Wang, Su, et autres
Publié: (2026)
Agent Skills in the Wild: An Empirical Study of Security Vulnerabilities at Scale
par: Liu, Yi, et autres
Publié: (2026)
par: Liu, Yi, et autres
Publié: (2026)
Security Is Relative: Training-Free Vulnerability Detection via Multi-Agent Behavioral Contract Synthesis
par: Wang, Yongchao, et autres
Publié: (2026)
par: Wang, Yongchao, et autres
Publié: (2026)
Multi-Agent Collaborative Fuzzing with Continuous Reflection for Smart Contracts Vulnerability Detection
par: Chen, Jie, et autres
Publié: (2025)
par: Chen, Jie, et autres
Publié: (2025)
Who Tests the Testers? Systematic Enumeration and Coverage Audit of LLM Agent Tool Call Safety
par: Chen, Xuan, et autres
Publié: (2026)
par: Chen, Xuan, et autres
Publié: (2026)
From LLMs to Agents: A Comparative Evaluation of LLMs and LLM-based Agents in Security Patch Detection
par: Han, Junxiao, et autres
Publié: (2025)
par: Han, Junxiao, et autres
Publié: (2025)
FuzzAgent: Multi-Agent System for Evolutionary Library Fuzzing
par: Lyu, Yunlong, et autres
Publié: (2026)
par: Lyu, Yunlong, et autres
Publié: (2026)
QASecClaw: A Multi-Agent LLM Approach for False Positive Reduction in Static Application Security Testing
par: Ameen, Mohd Ruhul, et autres
Publié: (2026)
par: Ameen, Mohd Ruhul, et autres
Publié: (2026)
AgentGuard: A Multi-Agent Framework for Robust Package Confusion Detection via Hybrid Search and Metadata-Content Fusion
par: Li, Yu, et autres
Publié: (2026)
par: Li, Yu, et autres
Publié: (2026)
"Elementary, My Dear Watson." Detecting Malicious Skills via Neuro-Symbolic Reasoning across Heterogeneous Artifacts
par: Wang, Shenao, et autres
Publié: (2026)
par: Wang, Shenao, et autres
Publié: (2026)
Multi-Agent Taint Specification Extraction for Vulnerability Detection
par: Ghebremichael, Jonah, et autres
Publié: (2026)
par: Ghebremichael, Jonah, et autres
Publié: (2026)
Identifying Adversary Tactics and Techniques in Malware Binaries with an LLM Agent
par: Xuan, Zhou, et autres
Publié: (2026)
par: Xuan, Zhou, et autres
Publié: (2026)
MARD: A Multi-Agent Framework for Robust Android Malware Detection
par: Zeng, Xueying, et autres
Publié: (2026)
par: Zeng, Xueying, et autres
Publié: (2026)
Coverage-Guided Multi-Agent Harness Generation for Java Library Fuzzing
par: Loose, Nils, et autres
Publié: (2026)
par: Loose, Nils, et autres
Publié: (2026)
Give LLMs a Security Course: Securing Retrieval-Augmented Code Generation via Knowledge Injection
par: Lin, Bo, et autres
Publié: (2025)
par: Lin, Bo, et autres
Publié: (2025)
Argus: Reorchestrating Static Analysis via a Multi-Agent Ensemble for Full-Chain Security Vulnerability Detection
par: Liang, Zi, et autres
Publié: (2026)
par: Liang, Zi, et autres
Publié: (2026)
Think Broad, Act Narrow: CWE Identification with Multi-Agent Large Language Models
par: Sayagh, Mohammed, et autres
Publié: (2025)
par: Sayagh, Mohammed, et autres
Publié: (2025)
ChainFuzzer: Greybox Fuzzing for Workflow-Level Multi-Tool Vulnerabilities in LLM Agents
par: Wu, Jiangrong, et autres
Publié: (2026)
par: Wu, Jiangrong, et autres
Publié: (2026)
Extending the OWASP Multi-Agentic System Threat Modeling Guide: Insights from Multi-Agent Security Research
par: Krawiecka, Klaudia, et autres
Publié: (2025)
par: Krawiecka, Klaudia, et autres
Publié: (2025)
SecureFixAgent: A Hybrid LLM Agent for Automated Python Static Vulnerability Repair
par: Gajjar, Jugal, et autres
Publié: (2025)
par: Gajjar, Jugal, et autres
Publié: (2025)
Evaluation of the Programming Skills of Large Language Models
par: Heitz, Luc Bryan, et autres
Publié: (2024)
par: Heitz, Luc Bryan, et autres
Publié: (2024)
FuzzingBrain V2: A Multi-Agent LLM System for Automated Vulnerability Discovery and Reproduction
par: Sheng, Ze, et autres
Publié: (2026)
par: Sheng, Ze, et autres
Publié: (2026)
RepoMark: A Data-Usage Auditing Framework for Code Large Language Models
par: Qu, Wenjie, et autres
Publié: (2025)
par: Qu, Wenjie, et autres
Publié: (2025)
SABER: Benchmarking Operational Safety of LLM Coding Agents in Stateful Project Workspaces
par: Hu, Qi, et autres
Publié: (2026)
par: Hu, Qi, et autres
Publié: (2026)
Auditing MCP Servers for Over-Privileged Tool Capabilities
par: Huang, Charoes, et autres
Publié: (2026)
par: Huang, Charoes, et autres
Publié: (2026)
RiskTagger: An LLM-based Agent for Automatic Annotation of Web3 Crypto Money Laundering Behaviors
par: Lin, Dan, et autres
Publié: (2025)
par: Lin, Dan, et autres
Publié: (2025)
Challenges in the Safety-Security Co-Assurance of Collaborative Industrial Robots
par: Gleirscher, Mario, et autres
Publié: (2020)
par: Gleirscher, Mario, et autres
Publié: (2020)
SIR-Bench: Evaluating Investigation Depth in Security Incident Response Agents
par: Begimher, Daniel, et autres
Publié: (2026)
par: Begimher, Daniel, et autres
Publié: (2026)
CHASE: LLM Agents for Dissecting Malicious PyPI Packages
par: Toda, Takaaki, et autres
Publié: (2026)
par: Toda, Takaaki, et autres
Publié: (2026)
LLM Agents for Automated Web Vulnerability Reproduction: Are We There Yet?
par: Liu, Bin, et autres
Publié: (2025)
par: Liu, Bin, et autres
Publié: (2025)
BandFuzz: An ML-powered Collaborative Fuzzing Framework
par: Shi, Wenxuan, et autres
Publié: (2025)
par: Shi, Wenxuan, et autres
Publié: (2025)
Skills as Verifiable Artifacts: A Trust Schema and a Biconditional Correctness Criterion for Human-in-the-Loop Agent Runtimes
par: Metere, Alfredo
Publié: (2026)
par: Metere, Alfredo
Publié: (2026)
Towards Trust Proof for Secure Confidential Virtual Machines
par: Mao, Jingkai, et autres
Publié: (2024)
par: Mao, Jingkai, et autres
Publié: (2024)
MAVUL: Multi-Agent Vulnerability Detection via Contextual Reasoning and Interactive Refinement
par: Li, Youpeng, et autres
Publié: (2025)
par: Li, Youpeng, et autres
Publié: (2025)
Probing Privacy Leaks in LLM-based Code Generation via Test Generation
par: Ge, Yifei, et autres
Publié: (2026)
par: Ge, Yifei, et autres
Publié: (2026)
LLMs as Firmware Experts: A Runtime-Grown Tree-of-Agents Framework
par: Zhang, Xiangrui, et autres
Publié: (2025)
par: Zhang, Xiangrui, et autres
Publié: (2025)
ARGUS: Defending LLM Agents Against Context-Aware Prompt Injection
par: Weng, Shihao, et autres
Publié: (2026)
par: Weng, Shihao, et autres
Publié: (2026)
Generating API Parameter Security Rules with LLM for API Misuse Detection
par: Liu, Jinghua, et autres
Publié: (2024)
par: Liu, Jinghua, et autres
Publié: (2024)
Exploring the Security Threats of Retriever Backdoors in Retrieval-Augmented Code Generation
par: Li, Tian, et autres
Publié: (2025)
par: Li, Tian, et autres
Publié: (2025)
Documents similaires
-
Exploiting LLM Agent Supply Chains via Payload-less Skills
par: Liu, Xinyu, et autres
Publié: (2026) -
When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems
par: Wang, Su, et autres
Publié: (2026) -
Agent Skills in the Wild: An Empirical Study of Security Vulnerabilities at Scale
par: Liu, Yi, et autres
Publié: (2026) -
Security Is Relative: Training-Free Vulnerability Detection via Multi-Agent Behavioral Contract Synthesis
par: Wang, Yongchao, et autres
Publié: (2026) -
Multi-Agent Collaborative Fuzzing with Continuous Reflection for Smart Contracts Vulnerability Detection
par: Chen, Jie, et autres
Publié: (2025)