Enregistré dans:
| Auteurs principaux: | Zhang, Yilin, Hua, Yingkai, Wei, Chunyu, Wang, Xin, Chen, Yueguo |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2605.09497 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Please Don't Kill My Vibe: Empowering Agents with Data Flow Control
par: Summers, Charlie, et autres
Publié: (2025)
par: Summers, Charlie, et autres
Publié: (2025)
Don't believe everything you read: Understanding and Measuring MCP Behavior under Misleading Tool Descriptions
par: Li, Zhihao, et autres
Publié: (2026)
par: Li, Zhihao, et autres
Publié: (2026)
Prompts Don't Protect: Architectural Enforcement via MCP Proxy for LLM Tool Access Control
par: Uppala, Rohith
Publié: (2026)
par: Uppala, Rohith
Publié: (2026)
Secret Collusion among AI Agents: Multi-Agent Deception via Steganography
par: Motwani, Sumeet Ramesh, et autres
Publié: (2024)
par: Motwani, Sumeet Ramesh, et autres
Publié: (2024)
I Don't Know You, But I Can Catch You: Real-Time Defense against Diverse Adversarial Patches for Object Detectors
par: Lin, Zijin, et autres
Publié: (2024)
par: Lin, Zijin, et autres
Publié: (2024)
Mind the Web: The Security of Web Use Agents
par: Shapira, Avishag, et autres
Publié: (2025)
par: Shapira, Avishag, et autres
Publié: (2025)
WebTrap Park: An Automated Platform for Systematic Security Evaluation of Web Agents
par: Wu, Xinyi, et autres
Publié: (2026)
par: Wu, Xinyi, et autres
Publié: (2026)
AI-Governed Agent Architecture for Web-Trustworthy Tokenization of Alternative Assets
par: Borjigin, Ailiya, et autres
Publié: (2025)
par: Borjigin, Ailiya, et autres
Publié: (2025)
LLM Cyber Evaluations Don't Capture Real-World Risk
par: Lukošiūtė, Kamilė, et autres
Publié: (2025)
par: Lukošiūtė, Kamilė, et autres
Publié: (2025)
WIPI: A New Web Threat for LLM-Driven Web Agents
par: Wu, Fangzhou, et autres
Publié: (2024)
par: Wu, Fangzhou, et autres
Publié: (2024)
Fuzz-Testing Meets LLM-Based Agents: An Automated and Efficient Framework for Jailbreaking Text-To-Image Generation Models
par: Dong, Yingkai, et autres
Publié: (2024)
par: Dong, Yingkai, et autres
Publié: (2024)
AdInject: Real-World Black-Box Attacks on Web Agents via Advertising Delivery
par: Wang, Haowei, et autres
Publié: (2025)
par: Wang, Haowei, et autres
Publié: (2025)
Multi-Agent Penetration Testing AI for the Web
par: David, Isaac, et autres
Publié: (2025)
par: David, Isaac, et autres
Publié: (2025)
WARD: Adversarially Robust Defense of Web Agents Against Prompt Injections
par: Cao, Tri, et autres
Publié: (2026)
par: Cao, Tri, et autres
Publié: (2026)
AWE: Adaptive Agents for Dynamic Web Penetration Testing
par: Jaswal, Akshat Singh, et autres
Publié: (2026)
par: Jaswal, Akshat Singh, et autres
Publié: (2026)
DECEPTICON: How Dark Patterns Manipulate Web Agents
par: Cuvin, Phil, et autres
Publié: (2025)
par: Cuvin, Phil, et autres
Publié: (2025)
SnapGuard: Lightweight Prompt Injection Detection for Screenshot-Based Web Agents
par: Du, Mengyao, et autres
Publié: (2026)
par: Du, Mengyao, et autres
Publié: (2026)
WebSentinel: Detecting and Localizing Prompt Injection Attacks for Web Agents
par: Wang, Xilong, et autres
Publié: (2026)
par: Wang, Xilong, et autres
Publié: (2026)
Poison Once, Exploit Forever: Environment-Injected Memory Poisoning Attacks on Web Agents
par: Zou, Wei, et autres
Publié: (2026)
par: Zou, Wei, et autres
Publié: (2026)
Cross-Modal Content Optimization for Steering Web Agent Preferences
par: Jiang, Tanqiu, et autres
Publié: (2025)
par: Jiang, Tanqiu, et autres
Publié: (2025)
Real Money, Fake Models: Deceptive Model Claims in Shadow APIs
par: Zhang, Yage, et autres
Publié: (2026)
par: Zhang, Yage, et autres
Publié: (2026)
WebPII: Benchmarking Visual PII Detection for Computer-Use Agents
par: Zhao, Nathan
Publié: (2026)
par: Zhao, Nathan
Publié: (2026)
WASP: Benchmarking Web Agent Security Against Prompt Injection Attacks
par: Evtimov, Ivan, et autres
Publié: (2025)
par: Evtimov, Ivan, et autres
Publié: (2025)
IPI-proxy: An Intercepting Proxy for Red-Teaming Web-Browsing AI Agents Against Indirect Prompt Injection
par: Chia-Pei, et autres
Publié: (2026)
par: Chia-Pei, et autres
Publié: (2026)
When Bots Take the Bait: Exposing and Mitigating the Emerging Social Engineering Attack in Web Automation Agent
par: Wu, Xinyi, et autres
Publié: (2026)
par: Wu, Xinyi, et autres
Publié: (2026)
Options, Not Clicks: Lattice Refinement for Consent-Driven MCP Authorization
par: Li, Ying, et autres
Publié: (2026)
par: Li, Ying, et autres
Publié: (2026)
WebWeaver: Breaking Topology Confidentiality in LLM Multi-Agent Systems with Stealthy Context-Based Inference
par: Xiong, Zixun, et autres
Publié: (2026)
par: Xiong, Zixun, et autres
Publié: (2026)
WebTrap: Stealthy Mid-Task Hijacking of Browser Agents During Navigation
par: Liu, Zhichao, et autres
Publié: (2026)
par: Liu, Zhichao, et autres
Publié: (2026)
zkUnlearner: A Zero-Knowledge Framework for Verifiable Unlearning with Multi-Granularity and Forgery-Resistance
par: Wang, Nan, et autres
Publié: (2025)
par: Wang, Nan, et autres
Publié: (2025)
CheatAgent: Attacking LLM-Empowered Recommender Systems via LLM Agent
par: Ning, Liang-bo, et autres
Publié: (2025)
par: Ning, Liang-bo, et autres
Publié: (2025)
Jailbreaking Frontier Foundation Models Through Intention Deception
par: Wang, Xinhe, et autres
Publié: (2026)
par: Wang, Xinhe, et autres
Publié: (2026)
AdaPhish: AI-Powered Adaptive Defense and Education Resource Against Deceptive Emails
par: Meguro, Rei, et autres
Publié: (2025)
par: Meguro, Rei, et autres
Publié: (2025)
Autonomous Intelligent Agents for Natural-Language-Driven Web Execution with Integrated Security Assurance
par: Pasupuleti, Vinil, et autres
Publié: (2026)
par: Pasupuleti, Vinil, et autres
Publié: (2026)
MalURLBench: A Benchmark Evaluating Agents' Vulnerabilities When Processing Web URLs
par: Kong, Dezhang, et autres
Publié: (2026)
par: Kong, Dezhang, et autres
Publié: (2026)
Contextual Chart Generation for Cyber Deception
par: Nguyen, David D., et autres
Publié: (2024)
par: Nguyen, David D., et autres
Publié: (2024)
PAPILLON: Efficient and Stealthy Fuzz Testing-Powered Jailbreaks for LLMs
par: Gong, Xueluan, et autres
Publié: (2024)
par: Gong, Xueluan, et autres
Publié: (2024)
ICON: Indirect Prompt Injection Defense for Agents based on Inference-Time Correction
par: Wang, Che, et autres
Publié: (2026)
par: Wang, Che, et autres
Publié: (2026)
MUZZLE: Adaptive Agentic Red-Teaming of Web Agents Against Indirect Prompt Injection Attacks
par: Syros, Georgios, et autres
Publié: (2026)
par: Syros, Georgios, et autres
Publié: (2026)
Manipulating LLM Web Agents with Indirect Prompt Injection Attack via HTML Accessibility Tree
par: Johnson, Sam, et autres
Publié: (2025)
par: Johnson, Sam, et autres
Publié: (2025)
WebSP-Eval: Evaluating Web Agents on Website Security and Privacy Tasks
par: Ramesh, Guruprasad Viswanathan, et autres
Publié: (2026)
par: Ramesh, Guruprasad Viswanathan, et autres
Publié: (2026)
Documents similaires
-
Please Don't Kill My Vibe: Empowering Agents with Data Flow Control
par: Summers, Charlie, et autres
Publié: (2025) -
Don't believe everything you read: Understanding and Measuring MCP Behavior under Misleading Tool Descriptions
par: Li, Zhihao, et autres
Publié: (2026) -
Prompts Don't Protect: Architectural Enforcement via MCP Proxy for LLM Tool Access Control
par: Uppala, Rohith
Publié: (2026) -
Secret Collusion among AI Agents: Multi-Agent Deception via Steganography
par: Motwani, Sumeet Ramesh, et autres
Publié: (2024) -
I Don't Know You, But I Can Catch You: Real-Time Defense against Diverse Adversarial Patches for Object Detectors
par: Lin, Zijin, et autres
Publié: (2024)