In-Context Defense in Computer Agents: An Empirical Study
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Pei, Ci, Hai, Shou, Mike Zheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
macOSWorld: A Multilingual Interactive Benchmark for GUI Agents
par: Yang, Pei, et autres
Publié: (2025)
par: Yang, Pei, et autres
Publié: (2025)
H2R-Grounder: A Paired-Data-Free Paradigm for Translating Human Interaction Videos into Physically Grounded Robot Videos
par: Ci, Hai, et autres
Publié: (2025)
par: Ci, Hai, et autres
Publié: (2025)
Steganalysis on Digital Watermarking: Is Your Defense Truly Impervious?
par: Yang, Pei, et autres
Publié: (2024)
par: Yang, Pei, et autres
Publié: (2024)
OptMark: Robust Multi-bit Diffusion Watermarking via Inference Time Optimization
par: Xing, Jiazheng, et autres
Publié: (2025)
par: Xing, Jiazheng, et autres
Publié: (2025)
AUTO-Explorer: Automated Data Collection for GUI Agent
par: Guo, Xiangwu, et autres
Publié: (2025)
par: Guo, Xiangwu, et autres
Publié: (2025)
The Dawn of GUI Agent: A Preliminary Case Study with Claude 3.5 Computer Use
par: Hu, Siyuan, et autres
Publié: (2024)
par: Hu, Siyuan, et autres
Publié: (2024)
Image Watermarks are Removable Using Controllable Regeneration from Clean Noise
par: Liu, Yepeng, et autres
Publié: (2024)
par: Liu, Yepeng, et autres
Publié: (2024)
ProcessPainter: Learn Painting Process from Sequence Data
par: Song, Yiren, et autres
Publié: (2024)
par: Song, Yiren, et autres
Publié: (2024)
X-Humanoid: Robotize Human Videos to Generate Humanoid Videos at Scale
par: Yang, Pei, et autres
Publié: (2025)
par: Yang, Pei, et autres
Publié: (2025)
IDProtector: An Adversarial Noise Encoder to Protect Against ID-Preserving Image Generation
par: Song, Yiren, et autres
Publié: (2024)
par: Song, Yiren, et autres
Publié: (2024)
RingID: Rethinking Tree-Ring Watermarking for Enhanced Multi-Key Identification
par: Ci, Hai, et autres
Publié: (2024)
par: Ci, Hai, et autres
Publié: (2024)
Anti-Reference: Universal and Immediate Defense Against Reference-Based Generation
par: Song, Yiren, et autres
Publié: (2024)
par: Song, Yiren, et autres
Publié: (2024)
An Empirical Study of Agent Developer Practices in AI Agent Frameworks
par: Wang, Yanlin, et autres
Publié: (2025)
par: Wang, Yanlin, et autres
Publié: (2025)
An Empirical Study of Agent Skills for Healthcare: Practice, Gaps, and Governance
par: Xu, Gelei, et autres
Publié: (2026)
par: Xu, Gelei, et autres
Publié: (2026)
DeepDefense: Layer-Wise Gradient-Feature Alignment for Building Robust Neural Networks
par: Lin, Ci, et autres
Publié: (2025)
par: Lin, Ci, et autres
Publié: (2025)
VideoMind: A Chain-of-LoRA Agent for Temporal-Grounded Video Reasoning
par: Liu, Ye, et autres
Publié: (2025)
par: Liu, Ye, et autres
Publié: (2025)
Token Economics for LLM Agents: A Dual-View Study from Computing and Economics
par: Chen, Yuxi, et autres
Publié: (2026)
par: Chen, Yuxi, et autres
Publié: (2026)
CityNet: A Comprehensive Multi-Modal Urban Dataset for Advanced Research in Urban Computing
par: Zheng, Zhengfei, et autres
Publié: (2021)
par: Zheng, Zhengfei, et autres
Publié: (2021)
Genixer: Empowering Multimodal Large Language Models as a Powerful Data Generator
par: Zhao, Henry Hengyuan, et autres
Publié: (2023)
par: Zhao, Henry Hengyuan, et autres
Publié: (2023)
An Empirical Study of Multi-Agent Collaboration for Automated Research
par: Shen, Yang, et autres
Publié: (2026)
par: Shen, Yang, et autres
Publié: (2026)
OAgents: An Empirical Study of Building Effective Agents
par: Zhu, He, et autres
Publié: (2025)
par: Zhu, He, et autres
Publié: (2025)
Impossible Videos
par: Bai, Zechen, et autres
Publié: (2025)
par: Bai, Zechen, et autres
Publié: (2025)
Can RL Improve Generalization of LLM Agents? An Empirical Study
par: Xi, Zhiheng, et autres
Publié: (2026)
par: Xi, Zhiheng, et autres
Publié: (2026)
Context-Length Robustness in Question Answering Models: A Comparative Empirical Study
par: Dhara, Trishita, et autres
Publié: (2026)
par: Dhara, Trishita, et autres
Publié: (2026)
Catching the Infection Before It Spreads: Foresight-Guided Defense in Multi-Agent Systems
par: Ma, Yue, et autres
Publié: (2026)
par: Ma, Yue, et autres
Publié: (2026)
Sparkle: Realizing Lively Instruction-Guided Video Background Replacement via Decoupled Guidance
par: Zeng, Ziyun, et autres
Publié: (2026)
par: Zeng, Ziyun, et autres
Publié: (2026)
DiffSeg30k: A Multi-Turn Diffusion Editing Benchmark for Localized AIGC Detection
par: Ci, Hai, et autres
Publié: (2025)
par: Ci, Hai, et autres
Publié: (2025)
WMAdapter: Adding WaterMark Control to Latent Diffusion Models
par: Ci, Hai, et autres
Publié: (2024)
par: Ci, Hai, et autres
Publié: (2024)
UENR-600K: A Large-Scale Physically Grounded Dataset for Nighttime Video Deraining
par: Yang, Pei, et autres
Publié: (2026)
par: Yang, Pei, et autres
Publié: (2026)
MachaGrasp: Morphology-Aware Cross-Embodiment Dexterous Hand Articulation Generation for Grasping
par: Zhang, Heng, et autres
Publié: (2025)
par: Zhang, Heng, et autres
Publié: (2025)
GameWorld: Towards Standardized and Verifiable Evaluation of Multimodal Game Agents
par: Ouyang, Mingyu, et autres
Publié: (2026)
par: Ouyang, Mingyu, et autres
Publié: (2026)
Empirical Computation
par: Tang, Eric, et autres
Publié: (2025)
par: Tang, Eric, et autres
Publié: (2025)
ReCAP: Recursive Context-Aware Reasoning and Planning for Large Language Model Agents
par: Zhang, Zhenyu, et autres
Publié: (2025)
par: Zhang, Zhenyu, et autres
Publié: (2025)
Contextualized Privacy Defense for LLM Agents
par: Wen, Yule, et autres
Publié: (2026)
par: Wen, Yule, et autres
Publié: (2026)
InterFeedback: Unveiling Interactive Intelligence of Large Multimodal Models via Human Feedback
par: Zhao, Henry Hengyuan, et autres
Publié: (2025)
par: Zhao, Henry Hengyuan, et autres
Publié: (2025)
Does Chain-of-Thought Reasoning Help Mobile GUI Agent? An Empirical Study
par: Zhang, Li, et autres
Publié: (2025)
par: Zhang, Li, et autres
Publié: (2025)
Leveraging AI Agents for Autonomous Networks: A Reference Architecture and Empirical Studies
par: Wu, Binghan, et autres
Publié: (2025)
par: Wu, Binghan, et autres
Publié: (2025)
ShowUI-$π$: Flow-based Generative Models as GUI Dexterous Hands
par: Hu, Siyuan, et autres
Publié: (2025)
par: Hu, Siyuan, et autres
Publié: (2025)
Think or Not? Selective Reasoning via Reinforcement Learning for Vision-Language Models
par: Wang, Jiaqi, et autres
Publié: (2025)
par: Wang, Jiaqi, et autres
Publié: (2025)
Draw-In-Mind: Rebalancing Designer-Painter Roles in Unified Multimodal Models Benefits Image Editing
par: Zeng, Ziyun, et autres
Publié: (2025)
par: Zeng, Ziyun, et autres
Publié: (2025)
Documents similaires
-
macOSWorld: A Multilingual Interactive Benchmark for GUI Agents
par: Yang, Pei, et autres
Publié: (2025) -
H2R-Grounder: A Paired-Data-Free Paradigm for Translating Human Interaction Videos into Physically Grounded Robot Videos
par: Ci, Hai, et autres
Publié: (2025) -
Steganalysis on Digital Watermarking: Is Your Defense Truly Impervious?
par: Yang, Pei, et autres
Publié: (2024) -
OptMark: Robust Multi-bit Diffusion Watermarking via Inference Time Optimization
par: Xing, Jiazheng, et autres
Publié: (2025) -
AUTO-Explorer: Automated Data Collection for GUI Agent
par: Guo, Xiangwu, et autres
Publié: (2025)