Guardado en:
| Autores principales: | Huster, Todd, Lin, Peter, Stefanescu, Razvan, Ekwedike, Emmanuel, Chadha, Ritu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2411.03445 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CatchBackdoor: Backdoor Detection via Critical Trojan Neural Path Fuzzing
por: Jin, Haibo, et al.
Publicado: (2021)
por: Jin, Haibo, et al.
Publicado: (2021)
Mind the Trojan Horse: Image Prompt Adapter Enabling Scalable and Deceptive Jailbreaking
por: Chen, Junxi, et al.
Publicado: (2025)
por: Chen, Junxi, et al.
Publicado: (2025)
An Experimental Study of Trojan Vulnerabilities in UAV Autonomous Landing
por: Ahmari, Reza, et al.
Publicado: (2025)
por: Ahmari, Reza, et al.
Publicado: (2025)
DeepSight: An All-in-One LM Safety Toolkit
por: Zhang, Bo, et al.
Publicado: (2026)
por: Zhang, Bo, et al.
Publicado: (2026)
Event Trojan: Asynchronous Event-based Backdoor Attacks
por: Wang, Ruofei, et al.
Publicado: (2024)
por: Wang, Ruofei, et al.
Publicado: (2024)
A Survey of Trojan Attacks and Defenses to Deep Neural Networks
por: Jin, Lingxin, et al.
Publicado: (2024)
por: Jin, Lingxin, et al.
Publicado: (2024)
Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety
por: Ma, Xingjun, et al.
Publicado: (2025)
por: Ma, Xingjun, et al.
Publicado: (2025)
Navigation as Attackers Wish? Towards Building Robust Embodied Agents under Federated Learning
por: Zhang, Yunchao, et al.
Publicado: (2022)
por: Zhang, Yunchao, et al.
Publicado: (2022)
Beyond Boundaries: A Comprehensive Survey of Transferable Attacks on AI Systems
por: Wang, Guangjing, et al.
Publicado: (2023)
por: Wang, Guangjing, et al.
Publicado: (2023)
PII-VisBench: Evaluating Personally Identifiable Information Safety in Vision Language Models Along a Continuum of Visibility
por: Shahariar, G M, et al.
Publicado: (2026)
por: Shahariar, G M, et al.
Publicado: (2026)
SafeGen: Mitigating Sexually Explicit Content Generation in Text-to-Image Models
por: Li, Xinfeng, et al.
Publicado: (2024)
por: Li, Xinfeng, et al.
Publicado: (2024)
Rethinking Machine Unlearning in Image Generation Models
por: Liu, Renyang, et al.
Publicado: (2025)
por: Liu, Renyang, et al.
Publicado: (2025)
VLMs Can Aggregate Scattered Training Patches
por: Zhou, Zhanhui, et al.
Publicado: (2025)
por: Zhou, Zhanhui, et al.
Publicado: (2025)
Jailbreaking Safeguarded Text-to-Image Models via Large Language Models
por: Jiang, Zhengyuan, et al.
Publicado: (2025)
por: Jiang, Zhengyuan, et al.
Publicado: (2025)
VLSBench: Unveiling Visual Leakage in Multimodal Safety
por: Hu, Xuhao, et al.
Publicado: (2024)
por: Hu, Xuhao, et al.
Publicado: (2024)
SSL-Cleanse: Trojan Detection and Mitigation in Self-Supervised Learning
por: Zheng, Mengxin, et al.
Publicado: (2023)
por: Zheng, Mengxin, et al.
Publicado: (2023)
Effective and Efficient Adversarial Detection for Vision-Language Models via A Single Vector
por: Huang, Youcheng, et al.
Publicado: (2024)
por: Huang, Youcheng, et al.
Publicado: (2024)
Recovering the Pre-Fine-Tuning Weights of Generative Models
por: Horwitz, Eliahu, et al.
Publicado: (2024)
por: Horwitz, Eliahu, et al.
Publicado: (2024)
Effective Fine-Tuning of Vision Transformers with Low-Rank Adaptation for Privacy-Preserving Image Classification
por: Lin, Haiwei, et al.
Publicado: (2025)
por: Lin, Haiwei, et al.
Publicado: (2025)
Selective Amnesia: On Efficient, High-Fidelity and Blind Suppression of Backdoor Effects in Trojaned Machine Learning Models
por: Zhu, Rui, et al.
Publicado: (2022)
por: Zhu, Rui, et al.
Publicado: (2022)
Chain-of-Jailbreak Attack for Image Generation Models via Editing Step by Step
por: Wang, Wenxuan, et al.
Publicado: (2024)
por: Wang, Wenxuan, et al.
Publicado: (2024)
Is Artificial Intelligence Generated Image Detection a Solved Problem?
por: Li, Ziqiang, et al.
Publicado: (2025)
por: Li, Ziqiang, et al.
Publicado: (2025)
Transformers and Large Language Models for Efficient Intrusion Detection Systems: A Comprehensive Survey
por: Kheddar, Hamza
Publicado: (2024)
por: Kheddar, Hamza
Publicado: (2024)
CAPTCHA Solving for Native GUI Agents: Automated Reasoning-Action Data Generation and Self-Corrective Training
por: Chen, Yuxi, et al.
Publicado: (2026)
por: Chen, Yuxi, et al.
Publicado: (2026)
AgentDoG 1.5: A Lightweight and Scalable Alignment Framework for AI Agent Safety and Security
por: Liu, Dongrui, et al.
Publicado: (2026)
por: Liu, Dongrui, et al.
Publicado: (2026)
Are GUI Agents Focused Enough? Automated Distraction via Semantic-level UI Element Injection
por: Yang, Wenkui, et al.
Publicado: (2026)
por: Yang, Wenkui, et al.
Publicado: (2026)
Iteratively Prompting Multimodal LLMs to Reproduce Natural and AI-Generated Images
por: Naseh, Ali, et al.
Publicado: (2024)
por: Naseh, Ali, et al.
Publicado: (2024)
IAG: Input-aware Backdoor Attack on VLM-based Visual Grounding
por: Li, Junxian, et al.
Publicado: (2025)
por: Li, Junxian, et al.
Publicado: (2025)
Image-Based Geolocation Using Large Vision-Language Models
por: Liu, Yi, et al.
Publicado: (2024)
por: Liu, Yi, et al.
Publicado: (2024)
MLLM-Protector: Ensuring MLLM's Safety without Hurting Performance
por: Pi, Renjie, et al.
Publicado: (2024)
por: Pi, Renjie, et al.
Publicado: (2024)
Privacy-Preserving Federated Learning with Verifiable Fairness Guarantees
por: Ali, Mohammed Himayath, et al.
Publicado: (2026)
por: Ali, Mohammed Himayath, et al.
Publicado: (2026)
Visual Contextual Attack: Jailbreaking MLLMs with Image-Driven Context Injection
por: Miao, Ziqi, et al.
Publicado: (2025)
por: Miao, Ziqi, et al.
Publicado: (2025)
SlowBA: An efficiency backdoor attack towards VLM-based GUI agents
por: Li, Junxian, et al.
Publicado: (2026)
por: Li, Junxian, et al.
Publicado: (2026)
Generating Synthetic Data with Formal Privacy Guarantees: State of the Art and the Road Ahead
por: Schlegel, Viktor, et al.
Publicado: (2025)
por: Schlegel, Viktor, et al.
Publicado: (2025)
Rethinking Bottlenecks in Safety Fine-Tuning of Vision Language Models
por: Ding, Yi, et al.
Publicado: (2025)
por: Ding, Yi, et al.
Publicado: (2025)
Contextual Image Attack: How Visual Context Exposes Multimodal Safety Vulnerabilities
por: Xiong, Yuan, et al.
Publicado: (2025)
por: Xiong, Yuan, et al.
Publicado: (2025)
Are Vision-Language Models Safe in the Wild? A Meme-Based Benchmark Study
por: Lee, DongGeon, et al.
Publicado: (2025)
por: Lee, DongGeon, et al.
Publicado: (2025)
Self-adaptive Dataset Construction for Real-World Multimodal Safety Scenarios
por: Qu, Jingen, et al.
Publicado: (2025)
por: Qu, Jingen, et al.
Publicado: (2025)
Doubly-Universal Adversarial Perturbations: Deceiving Vision-Language Models Across Both Images and Text with a Single Perturbation
por: Kim, Hee-Seon, et al.
Publicado: (2024)
por: Kim, Hee-Seon, et al.
Publicado: (2024)
BSPA: Exploring Black-box Stealthy Prompt Attacks against Image Generators
por: Tian, Yu, et al.
Publicado: (2024)
por: Tian, Yu, et al.
Publicado: (2024)
Ejemplares similares
-
CatchBackdoor: Backdoor Detection via Critical Trojan Neural Path Fuzzing
por: Jin, Haibo, et al.
Publicado: (2021) -
Mind the Trojan Horse: Image Prompt Adapter Enabling Scalable and Deceptive Jailbreaking
por: Chen, Junxi, et al.
Publicado: (2025) -
An Experimental Study of Trojan Vulnerabilities in UAV Autonomous Landing
por: Ahmari, Reza, et al.
Publicado: (2025) -
DeepSight: An All-in-One LM Safety Toolkit
por: Zhang, Bo, et al.
Publicado: (2026) -
Event Trojan: Asynchronous Event-based Backdoor Attacks
por: Wang, Ruofei, et al.
Publicado: (2024)