Enregistré dans:
| Auteurs principaux: | Yang, Hao, Ma, Zhuo, Liu, Yang, Yang, Yilong, Wang, Guancheng, Ma, JianFeng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2605.16090 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Slot: Provenance-Driven APT Detection through Graph Reinforcement Learning
par: Qiao, Wei, et autres
Publié: (2024)
par: Qiao, Wei, et autres
Publié: (2024)
Image Corruption-Inspired Membership Inference Attacks against Large Vision-Language Models
par: Wu, Zongyu, et autres
Publié: (2025)
par: Wu, Zongyu, et autres
Publié: (2025)
One Perturbation is Enough: On Generating Universal Adversarial Perturbations against Vision-Language Pre-training Models
par: Fang, Hao, et autres
Publié: (2024)
par: Fang, Hao, et autres
Publié: (2024)
BSPA: Exploring Black-box Stealthy Prompt Attacks against Image Generators
par: Tian, Yu, et autres
Publié: (2024)
par: Tian, Yu, et autres
Publié: (2024)
ReasAlign: Reasoning Enhanced Safety Alignment against Prompt Injection Attack
par: Li, Hao, et autres
Publié: (2026)
par: Li, Hao, et autres
Publié: (2026)
PINA: Prompt Injection Attack against Navigation Agents
par: Liu, Jiani, et autres
Publié: (2026)
par: Liu, Jiani, et autres
Publié: (2026)
StruPhantom: Evolutionary Injection Attacks on Black-Box Tabular Agents Powered by Large Language Models
par: Feng, Yang, et autres
Publié: (2025)
par: Feng, Yang, et autres
Publié: (2025)
ShadowCode: Towards (Automatic) External Prompt Injection Attack against Code LLMs
par: Yang, Yuchen, et autres
Publié: (2024)
par: Yang, Yuchen, et autres
Publié: (2024)
Mirage in the Eyes: Hallucination Attack on Multi-modal Large Language Models with Only Attention Sink
par: Wang, Yining, et autres
Publié: (2025)
par: Wang, Yining, et autres
Publié: (2025)
Robustness via Referencing: Defending against Prompt Injection Attacks by Referencing the Executed Instruction
par: Chen, Yulin, et autres
Publié: (2025)
par: Chen, Yulin, et autres
Publié: (2025)
On the Generation and Mitigation of Harmful Geometry in Image-to-3D Models
par: Liu, Yule, et autres
Publié: (2026)
par: Liu, Yule, et autres
Publié: (2026)
Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt
par: Ying, Zonghao, et autres
Publié: (2024)
par: Ying, Zonghao, et autres
Publié: (2024)
Defending Code Language Models against Backdoor Attacks with Deceptive Cross-Entropy Loss
par: Yang, Guang, et autres
Publié: (2024)
par: Yang, Guang, et autres
Publié: (2024)
Prompt Stealing Attacks Against Large Language Models
par: Sha, Zeyang, et autres
Publié: (2024)
par: Sha, Zeyang, et autres
Publié: (2024)
PLA: Prompt Learning Attack against Text-to-Image Generative Models
par: Lyu, Xinqi, et autres
Publié: (2025)
par: Lyu, Xinqi, et autres
Publié: (2025)
Prompt Inversion Attack against Collaborative Inference of Large Language Models
par: Qu, Wenjie, et autres
Publié: (2025)
par: Qu, Wenjie, et autres
Publié: (2025)
Leave My Images Alone: Preventing Multi-Modal Large Language Models from Analyzing Images via Visual Prompt Injection
par: Shao, Zedian, et autres
Publié: (2026)
par: Shao, Zedian, et autres
Publié: (2026)
Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models
par: Park, Junyoung, et autres
Publié: (2026)
par: Park, Junyoung, et autres
Publié: (2026)
Prompt Injection Attacks on Large Language Models in Oncology
par: Clusmann, Jan, et autres
Publié: (2024)
par: Clusmann, Jan, et autres
Publié: (2024)
CPA-RAG:Covert Poisoning Attacks on Retrieval-Augmented Generation in Large Language Models
par: Li, Chunyang, et autres
Publié: (2025)
par: Li, Chunyang, et autres
Publié: (2025)
Environmental Injection Attacks against GUI Agents in Realistic Dynamic Environments
par: Zhang, Yitong, et autres
Publié: (2025)
par: Zhang, Yitong, et autres
Publié: (2025)
BadBone: Backdoor Attacks Against Backbone Models in Visual Prompt Learning
par: Yang, Ziqing, et autres
Publié: (2026)
par: Yang, Ziqing, et autres
Publié: (2026)
Inducing High Energy-Latency of Large Vision-Language Models with Verbose Images
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models
par: Chen, Zeyuan, et autres
Publié: (2026)
par: Chen, Zeyuan, et autres
Publié: (2026)
PRSA: Prompt Stealing Attacks against Real-World Prompt Services
par: Yang, Yong, et autres
Publié: (2024)
par: Yang, Yong, et autres
Publié: (2024)
Backdoor Attacks against No-Reference Image Quality Assessment Models via a Scalable Trigger
par: Yu, Yi, et autres
Publié: (2024)
par: Yu, Yi, et autres
Publié: (2024)
AttackEval: A Systematic Empirical Study of Prompt Injection Attack Effectiveness Against Large Language Models
par: Wang, Jackson
Publié: (2026)
par: Wang, Jackson
Publié: (2026)
MMA-Diffusion: MultiModal Attack on Diffusion Models
par: Yang, Yijun, et autres
Publié: (2023)
par: Yang, Yijun, et autres
Publié: (2023)
Attacking Transformers with Feature Diversity Adversarial Perturbation
par: Gao, Chenxing, et autres
Publié: (2024)
par: Gao, Chenxing, et autres
Publié: (2024)
Membership Inference Attacks against Large Vision-Language Models
par: Li, Zhan, et autres
Publié: (2024)
par: Li, Zhan, et autres
Publié: (2024)
Test-Time Attention Purification for Backdoored Large Vision Language Models
par: Zhang, Zhifang, et autres
Publié: (2026)
par: Zhang, Zhifang, et autres
Publié: (2026)
A Critical Evaluation of Defenses against Prompt Injection Attacks
par: Jia, Yuqi, et autres
Publié: (2025)
par: Jia, Yuqi, et autres
Publié: (2025)
An Early Categorization of Prompt Injection Attacks on Large Language Models
par: Rossi, Sippo, et autres
Publié: (2024)
par: Rossi, Sippo, et autres
Publié: (2024)
FreqCross: A Multi-Modal Frequency-Spatial Fusion Network for Robust Detection of Stable Diffusion 3.5 Generated Images
par: Yang, Guang
Publié: (2025)
par: Yang, Guang
Publié: (2025)
Not All Prompts Are Secure: A Switchable Backdoor Attack Against Pre-trained Vision Transformers
par: Yang, Sheng, et autres
Publié: (2024)
par: Yang, Sheng, et autres
Publié: (2024)
AttackVLA: Benchmarking Adversarial and Backdoor Attacks on Vision-Language-Action Models
par: Li, Jiayu, et autres
Publié: (2025)
par: Li, Jiayu, et autres
Publié: (2025)
ProvX: Generating Counterfactual-Driven Attack Explanations for Provenance-Based Detection
par: Wu, Weiheng, et autres
Publié: (2025)
par: Wu, Weiheng, et autres
Publié: (2025)
Combinational Backdoor Attack against Customized Text-to-Image Models
par: Jiang, Wenbo, et autres
Publié: (2024)
par: Jiang, Wenbo, et autres
Publié: (2024)
PR-Attack: Coordinated Prompt-RAG Attacks on Retrieval-Augmented Generation in Large Language Models via Bilevel Optimization
par: Jiao, Yang, et autres
Publié: (2025)
par: Jiao, Yang, et autres
Publié: (2025)
A Novel Evaluation Framework for Assessing Resilience Against Prompt Injection Attacks in Large Language Models
par: Yip, Daniel Wankit, et autres
Publié: (2024)
par: Yip, Daniel Wankit, et autres
Publié: (2024)
Documents similaires
-
Slot: Provenance-Driven APT Detection through Graph Reinforcement Learning
par: Qiao, Wei, et autres
Publié: (2024) -
Image Corruption-Inspired Membership Inference Attacks against Large Vision-Language Models
par: Wu, Zongyu, et autres
Publié: (2025) -
One Perturbation is Enough: On Generating Universal Adversarial Perturbations against Vision-Language Pre-training Models
par: Fang, Hao, et autres
Publié: (2024) -
BSPA: Exploring Black-box Stealthy Prompt Attacks against Image Generators
par: Tian, Yu, et autres
Publié: (2024) -
ReasAlign: Reasoning Enhanced Safety Alignment against Prompt Injection Attack
par: Li, Hao, et autres
Publié: (2026)