Vera Verto: Multimodal Hijacking Attack
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Minxing, Salem, Ahmed, Backes, Michael, Zhang, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SOS! Soft Prompt Attack Against Open-Source Large Language Models
di: Yang, Ziqing, et al.
Pubblicazione: (2024)
di: Yang, Ziqing, et al.
Pubblicazione: (2024)
Model Hijacking Attack in Federated Learning
di: Li, Zheng, et al.
Pubblicazione: (2024)
di: Li, Zheng, et al.
Pubblicazione: (2024)
Learning to Attack: Uncovering Privacy Risks in Sequential Data Releases
di: Cui, Ziyao, et al.
Pubblicazione: (2025)
di: Cui, Ziyao, et al.
Pubblicazione: (2025)
Understanding Data Importance in Machine Learning Attacks: Does Valuable Data Pose Greater Harm?
di: Wen, Rui, et al.
Pubblicazione: (2024)
di: Wen, Rui, et al.
Pubblicazione: (2024)
Transferable Availability Poisoning Attacks
di: Liu, Yiyong, et al.
Pubblicazione: (2023)
di: Liu, Yiyong, et al.
Pubblicazione: (2023)
Breaking Agents: Compromising Autonomous LLM Agents Through Malfunction Amplification
di: Zhang, Boyang, et al.
Pubblicazione: (2024)
di: Zhang, Boyang, et al.
Pubblicazione: (2024)
Voice Jailbreak Attacks Against GPT-4o
di: Shen, Xinyue, et al.
Pubblicazione: (2024)
di: Shen, Xinyue, et al.
Pubblicazione: (2024)
Prompt Stealing Attacks Against Text-to-Image Generation Models
di: Shen, Xinyue, et al.
Pubblicazione: (2023)
di: Shen, Xinyue, et al.
Pubblicazione: (2023)
Excessive Reasoning Attack on Reasoning LLMs
di: Si, Wai Man, et al.
Pubblicazione: (2025)
di: Si, Wai Man, et al.
Pubblicazione: (2025)
SoK: Data Reconstruction Attacks Against Machine Learning Models: Definition, Metrics, and Benchmark
di: Wen, Rui, et al.
Pubblicazione: (2025)
di: Wen, Rui, et al.
Pubblicazione: (2025)
On Membership Inference Attacks in Knowledge Distillation
di: Cui, Ziyao, et al.
Pubblicazione: (2025)
di: Cui, Ziyao, et al.
Pubblicazione: (2025)
Instruction Backdoor Attacks Against Customized LLMs
di: Zhang, Rui, et al.
Pubblicazione: (2024)
di: Zhang, Rui, et al.
Pubblicazione: (2024)
Moshi Moshi? A Model Selection Hijacking Adversarial Attack
di: Petrucci, Riccardo, et al.
Pubblicazione: (2025)
di: Petrucci, Riccardo, et al.
Pubblicazione: (2025)
DiffusionHijack: Supply-Chain PRNG Backdoor Attack on Diffusion Models and Quantum Random Number Defense
di: You, Ziyang, et al.
Pubblicazione: (2026)
di: You, Ziyang, et al.
Pubblicazione: (2026)
Link Stealing Attacks Against Inductive Graph Neural Networks
di: Wu, Yixin, et al.
Pubblicazione: (2024)
di: Wu, Yixin, et al.
Pubblicazione: (2024)
Composite Backdoor Attacks Against Large Language Models
di: Huang, Hai, et al.
Pubblicazione: (2023)
di: Huang, Hai, et al.
Pubblicazione: (2023)
MIP against Agent: Malicious Image Patches Hijacking Multimodal OS Agents
di: Aichberger, Lukas, et al.
Pubblicazione: (2025)
di: Aichberger, Lukas, et al.
Pubblicazione: (2025)
Beyond Crash: Hijacking Your Autonomous Vehicle for Fun and Profit
di: Sun, Qi, et al.
Pubblicazione: (2026)
di: Sun, Qi, et al.
Pubblicazione: (2026)
Image-Perfect Imperfections: Safety, Bias, and Authenticity in the Shadow of Text-To-Image Model Evolution
di: Wu, Yixin, et al.
Pubblicazione: (2024)
di: Wu, Yixin, et al.
Pubblicazione: (2024)
When GPT Spills the Tea: Comprehensive Assessment of Knowledge File Leakage in GPTs
di: Shen, Xinyue, et al.
Pubblicazione: (2025)
di: Shen, Xinyue, et al.
Pubblicazione: (2025)
Invisibility Cloak: Disappearance under Human Pose Estimation via Backdoor Attacks
di: Zhang, Minxing, et al.
Pubblicazione: (2024)
di: Zhang, Minxing, et al.
Pubblicazione: (2024)
MGTBench: Benchmarking Machine-Generated Text Detection
di: He, Xinlei, et al.
Pubblicazione: (2023)
di: He, Xinlei, et al.
Pubblicazione: (2023)
"Do Anything Now": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models
di: Shen, Xinyue, et al.
Pubblicazione: (2023)
di: Shen, Xinyue, et al.
Pubblicazione: (2023)
Osmosis Distillation: Model Hijacking with the Fewest Samples
di: Shi, Yuchen, et al.
Pubblicazione: (2026)
di: Shi, Yuchen, et al.
Pubblicazione: (2026)
Provably Cost-Sensitive Adversarial Defense via Randomized Smoothing
di: Xin, Yuan, et al.
Pubblicazione: (2023)
di: Xin, Yuan, et al.
Pubblicazione: (2023)
The Challenge of Identifying the Origin of Black-Box Large Language Models
di: Yang, Ziqing, et al.
Pubblicazione: (2025)
di: Yang, Ziqing, et al.
Pubblicazione: (2025)
Hijack Vertical Federated Learning Models As One Party
di: Qiu, Pengyu, et al.
Pubblicazione: (2022)
di: Qiu, Pengyu, et al.
Pubblicazione: (2022)
HateBench: Benchmarking Hate Speech Detectors on LLM-Generated Content and Hate Campaigns
di: Shen, Xinyue, et al.
Pubblicazione: (2025)
di: Shen, Xinyue, et al.
Pubblicazione: (2025)
JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs
di: Chu, Junjie, et al.
Pubblicazione: (2024)
di: Chu, Junjie, et al.
Pubblicazione: (2024)
AutoRAN: Automated Hijacking of Safety Reasoning in Large Reasoning Models
di: Liang, Jiacheng, et al.
Pubblicazione: (2025)
di: Liang, Jiacheng, et al.
Pubblicazione: (2025)
UDora: A Unified Red Teaming Framework against LLM Agents by Dynamically Hijacking Their Own Reasoning
di: Zhang, Jiawei, et al.
Pubblicazione: (2025)
di: Zhang, Jiawei, et al.
Pubblicazione: (2025)
AttackLLM: LLM-based Attack Pattern Generation for an Industrial Control System
di: Ahmed, Chuadhry Mujeeb
Pubblicazione: (2025)
di: Ahmed, Chuadhry Mujeeb
Pubblicazione: (2025)
AIJack: Let's Hijack AI! Security and Privacy Risk Simulator for Machine Learning
di: Takahashi, Hideaki
Pubblicazione: (2023)
di: Takahashi, Hideaki
Pubblicazione: (2023)
Stealthy and Adjustable Text-Guided Backdoor Attacks on Multimodal Pretrained Models
di: Zhang, Yiyang, et al.
Pubblicazione: (2026)
di: Zhang, Yiyang, et al.
Pubblicazione: (2026)
CHAI: Command Hijacking against embodied AI
di: Burbano, Luis, et al.
Pubblicazione: (2025)
di: Burbano, Luis, et al.
Pubblicazione: (2025)
In-Context Representation Hijacking
di: Yona, Itay, et al.
Pubblicazione: (2025)
di: Yona, Itay, et al.
Pubblicazione: (2025)
Trust Me, I Know This Function: Hijacking LLM Static Analysis using Bias
di: Bernstein, Shir, et al.
Pubblicazione: (2025)
di: Bernstein, Shir, et al.
Pubblicazione: (2025)
FuncPoison: Poisoning Function Library to Hijack Multi-agent Autonomous Driving Systems
di: Long, Yuzhen, et al.
Pubblicazione: (2025)
di: Long, Yuzhen, et al.
Pubblicazione: (2025)
Generated Data with Fake Privacy: Hidden Dangers of Fine-tuning Large Language Models on Generated Data
di: Akkus, Atilla, et al.
Pubblicazione: (2024)
di: Akkus, Atilla, et al.
Pubblicazione: (2024)
Synthetic Artifact Auditing: Tracing LLM-Generated Synthetic Data Usage in Downstream Applications
di: Wu, Yixin, et al.
Pubblicazione: (2025)
di: Wu, Yixin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SOS! Soft Prompt Attack Against Open-Source Large Language Models
di: Yang, Ziqing, et al.
Pubblicazione: (2024) -
Model Hijacking Attack in Federated Learning
di: Li, Zheng, et al.
Pubblicazione: (2024) -
Learning to Attack: Uncovering Privacy Risks in Sequential Data Releases
di: Cui, Ziyao, et al.
Pubblicazione: (2025) -
Understanding Data Importance in Machine Learning Attacks: Does Valuable Data Pose Greater Harm?
di: Wen, Rui, et al.
Pubblicazione: (2024) -
Transferable Availability Poisoning Attacks
di: Liu, Yiyong, et al.
Pubblicazione: (2023)