Quantitative Certification of Agentic Tool Selection
Fuente:
arXiv
Salvato in:
| Autori principali: | Yeon, Jehyeok, Chaudhary, Isha, Singh, Gagandeep |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bypassing the Safety Training of Open-Source LLMs with Priming Attacks
di: Vega, Jason, et al.
Pubblicazione: (2023)
di: Vega, Jason, et al.
Pubblicazione: (2023)
How Catastrophic is Your LLM? Certifying Risk in Conversation
di: Wang, Chengxiao, et al.
Pubblicazione: (2025)
di: Wang, Chengxiao, et al.
Pubblicazione: (2025)
Matching Ranks Over Probability Yields Truly Deep Safety Alignment
di: Vega, Jason, et al.
Pubblicazione: (2025)
di: Vega, Jason, et al.
Pubblicazione: (2025)
TRAP: Targeted Redirecting of Agentic Preferences
di: Kang, Hangoo, et al.
Pubblicazione: (2025)
di: Kang, Hangoo, et al.
Pubblicazione: (2025)
AgenTRIM: Tool Risk Mitigation for Agentic AI
di: Betser, Roy, et al.
Pubblicazione: (2026)
di: Betser, Roy, et al.
Pubblicazione: (2026)
AdapTools: Adaptive Tool-based Indirect Prompt Injection Attacks on Agentic LLMs
di: Wang, Che, et al.
Pubblicazione: (2026)
di: Wang, Che, et al.
Pubblicazione: (2026)
Universal Black-Box Reward Poisoning Attack against Offline Reinforcement Learning
di: Xu, Yinglun, et al.
Pubblicazione: (2024)
di: Xu, Yinglun, et al.
Pubblicazione: (2024)
AgentGuard: Repurposing Agentic Orchestrator for Safety Evaluation of Tool Orchestration
di: Chen, Jizhou, et al.
Pubblicazione: (2025)
di: Chen, Jizhou, et al.
Pubblicazione: (2025)
ToolTweak: An Attack on Tool Selection in LLM-based Agents
di: Sneh, Jonathan, et al.
Pubblicazione: (2025)
di: Sneh, Jonathan, et al.
Pubblicazione: (2025)
CyberCertBench: Evaluating LLMs in Cybersecurity Certification Knowledge
di: Keppler, Gustav, et al.
Pubblicazione: (2026)
di: Keppler, Gustav, et al.
Pubblicazione: (2026)
Deep learning based intelligent IDS for Large-scale IoT networks
di: Andrade, Isha, et al.
Pubblicazione: (2026)
di: Andrade, Isha, et al.
Pubblicazione: (2026)
Towards Agentic Honeynet Configuration
di: Mirra, Federico, et al.
Pubblicazione: (2026)
di: Mirra, Federico, et al.
Pubblicazione: (2026)
Securing Agentic AI: Threat Modeling and Risk Analysis for Network Monitoring Agentic AI System
di: Zambare, Pallavi, et al.
Pubblicazione: (2025)
di: Zambare, Pallavi, et al.
Pubblicazione: (2025)
Towards Adapting Federated & Quantum Machine Learning for Network Intrusion Detection: A Survey
di: Chaudhary, Devashish, et al.
Pubblicazione: (2025)
di: Chaudhary, Devashish, et al.
Pubblicazione: (2025)
Stable Agentic Control: Tool-Mediated LLM Architecture for Autonomous Cyber Defense
di: Prinos, Kerri, et al.
Pubblicazione: (2026)
di: Prinos, Kerri, et al.
Pubblicazione: (2026)
LOCARD: An Agentic Framework for Blockchain Forensics
di: Yu, Xiaohang, et al.
Pubblicazione: (2026)
di: Yu, Xiaohang, et al.
Pubblicazione: (2026)
Tool Preferences in Agentic LLMs are Unreliable
di: Faghih, Kazem, et al.
Pubblicazione: (2025)
di: Faghih, Kazem, et al.
Pubblicazione: (2025)
PentestMCP: A Toolkit for Agentic Penetration Testing
di: Ezetta, Zachary, et al.
Pubblicazione: (2025)
di: Ezetta, Zachary, et al.
Pubblicazione: (2025)
SUDP: Secret-Use Delegation Protocol for Agentic Systems
di: Yu, Xiaohang, et al.
Pubblicazione: (2026)
di: Yu, Xiaohang, et al.
Pubblicazione: (2026)
TxRay: Agentic Postmortem of Live Blockchain Attacks
di: Wang, Ziyue, et al.
Pubblicazione: (2026)
di: Wang, Ziyue, et al.
Pubblicazione: (2026)
On Protecting Agentic Systems' Intellectual Property via Watermarking
di: Wang, Liwen, et al.
Pubblicazione: (2026)
di: Wang, Liwen, et al.
Pubblicazione: (2026)
ARCeR: an Agentic RAG for the Automated Definition of Cyber Ranges
di: Lupinacci, Matteo, et al.
Pubblicazione: (2025)
di: Lupinacci, Matteo, et al.
Pubblicazione: (2025)
A2AS: Agentic AI Runtime Security and Self-Defense
di: Neelou, Eugene, et al.
Pubblicazione: (2025)
di: Neelou, Eugene, et al.
Pubblicazione: (2025)
The End of Trust: How Agentic AI Breaks Security Assumptions
di: Zafar, Osama, et al.
Pubblicazione: (2026)
di: Zafar, Osama, et al.
Pubblicazione: (2026)
AgentSCOPE: Evaluating Contextual Privacy Across Agentic Workflows
di: Ngong, Ivoline C., et al.
Pubblicazione: (2026)
di: Ngong, Ivoline C., et al.
Pubblicazione: (2026)
The Attack and Defense Landscape of Agentic AI: A Comprehensive Survey
di: Kim, Juhee, et al.
Pubblicazione: (2026)
di: Kim, Juhee, et al.
Pubblicazione: (2026)
AgentSOC: A Multi-Layer Agentic AI Framework for Security Operations Automation
di: Roy, Joyjit, et al.
Pubblicazione: (2026)
di: Roy, Joyjit, et al.
Pubblicazione: (2026)
Towards Unifying Quantitative Security Benchmarking for Multi Agent Systems
di: Sharma, Gauri, et al.
Pubblicazione: (2025)
di: Sharma, Gauri, et al.
Pubblicazione: (2025)
MAIF: Enforcing AI Trust and Provenance with an Artifact-Centric Agentic Paradigm
di: Narajala, Vineeth Sai, et al.
Pubblicazione: (2025)
di: Narajala, Vineeth Sai, et al.
Pubblicazione: (2025)
NetMoniAI: An Agentic AI Framework for Network Security & Monitoring
di: Zambare, Pallavi, et al.
Pubblicazione: (2025)
di: Zambare, Pallavi, et al.
Pubblicazione: (2025)
Agentic JWT: A Secure Delegation Protocol for Autonomous AI Agents
di: Goswami, Abhishek
Pubblicazione: (2025)
di: Goswami, Abhishek
Pubblicazione: (2025)
ASTRIDE: A Security Threat Modeling Platform for Agentic-AI Applications
di: Bandara, Eranga, et al.
Pubblicazione: (2025)
di: Bandara, Eranga, et al.
Pubblicazione: (2025)
PrivScope: Task-scoped Disclosure Control for Hybrid Agentic Systems
di: Seeam, Shafizur Rahman, et al.
Pubblicazione: (2026)
di: Seeam, Shafizur Rahman, et al.
Pubblicazione: (2026)
Foundations for Agentic AI Investigations from the Forensic Analysis of OpenClaw
di: Gruber, Jan, et al.
Pubblicazione: (2026)
di: Gruber, Jan, et al.
Pubblicazione: (2026)
Redefining AI Red Teaming in the Agentic Era: From Weeks to Hours
di: Dheekonda, Raja Sekhar Rao, et al.
Pubblicazione: (2026)
di: Dheekonda, Raja Sekhar Rao, et al.
Pubblicazione: (2026)
Benchmarking Security Risk Detection and Verification in Open Agentic Skill Ecosystems
di: Hossain, Ismail, et al.
Pubblicazione: (2026)
di: Hossain, Ismail, et al.
Pubblicazione: (2026)
Agentic AI for Cybersecurity: A Meta-Cognitive Architecture for Governable Autonomy
di: Kojukhov, Andrei, et al.
Pubblicazione: (2026)
di: Kojukhov, Andrei, et al.
Pubblicazione: (2026)
AAGATE: A NIST AI RMF-Aligned Governance Platform for Agentic AI
di: Huang, Ken, et al.
Pubblicazione: (2025)
di: Huang, Ken, et al.
Pubblicazione: (2025)
Automating Prompt Leakage Attacks on Large Language Models Using Agentic Approach
di: Sternak, Tvrtko, et al.
Pubblicazione: (2025)
di: Sternak, Tvrtko, et al.
Pubblicazione: (2025)
Agentic AI Microservice Framework for Deepfake and Document Fraud Detection in KYC Pipelines
di: Kubam, Chandra Sekhar
Pubblicazione: (2026)
di: Kubam, Chandra Sekhar
Pubblicazione: (2026)
Documenti analoghi
-
Bypassing the Safety Training of Open-Source LLMs with Priming Attacks
di: Vega, Jason, et al.
Pubblicazione: (2023) -
How Catastrophic is Your LLM? Certifying Risk in Conversation
di: Wang, Chengxiao, et al.
Pubblicazione: (2025) -
Matching Ranks Over Probability Yields Truly Deep Safety Alignment
di: Vega, Jason, et al.
Pubblicazione: (2025) -
TRAP: Targeted Redirecting of Agentic Preferences
di: Kang, Hangoo, et al.
Pubblicazione: (2025) -
AgenTRIM: Tool Risk Mitigation for Agentic AI
di: Betser, Roy, et al.
Pubblicazione: (2026)