AutoBreach: Universal and Adaptive Jailbreaking with Efficient Wordplay-Guided Optimization
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Jiawei, Yang, Xiao, Fang, Zhengwei, Tian, Yu, Dong, Yinpeng, Yin, Zhaoxia, Su, Hang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
FaceCat: Enhancing Face Recognition Security with a Unified Diffusion Model
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
BSPA: Exploring Black-box Stealthy Prompt Attacks against Image Generators
von: Tian, Yu, et al.
Veröffentlicht: (2024)
von: Tian, Yu, et al.
Veröffentlicht: (2024)
Towards Transferable Targeted 3D Adversarial Attack in the Physical World
von: Huang, Yao, et al.
Veröffentlicht: (2023)
von: Huang, Yao, et al.
Veröffentlicht: (2023)
Rethinking Model Ensemble in Transfer-based Adversarial Attacks
von: Chen, Huanran, et al.
Veröffentlicht: (2023)
von: Chen, Huanran, et al.
Veröffentlicht: (2023)
Who Can See Through You? Adversarial Shielding Against VLM-Based Attribute Inference Attacks
von: Fan, Yucheng, et al.
Veröffentlicht: (2025)
von: Fan, Yucheng, et al.
Veröffentlicht: (2025)
Efficient Black-box Adversarial Attacks via Bayesian Optimization Guided by a Function Prior
von: Cheng, Shuyu, et al.
Veröffentlicht: (2024)
von: Cheng, Shuyu, et al.
Veröffentlicht: (2024)
Embodied Active Defense: Leveraging Recurrent Feedback to Counter Adversarial Patches
von: Wu, Lingxuan, et al.
Veröffentlicht: (2024)
von: Wu, Lingxuan, et al.
Veröffentlicht: (2024)
AdvFAS: A robust face anti-spoofing framework against adversarial examples
von: Chen, Jiawei, et al.
Veröffentlicht: (2023)
von: Chen, Jiawei, et al.
Veröffentlicht: (2023)
SAIDO: Generalizable Detection of AI-Generated Images via Scene-Aware and Importance-Guided Dynamic Optimization in Continual Learning
von: Hu, Yongkang, et al.
Veröffentlicht: (2025)
von: Hu, Yongkang, et al.
Veröffentlicht: (2025)
Your Diffusion Model is Secretly a Certifiably Robust Classifier
von: Chen, Huanran, et al.
Veröffentlicht: (2024)
von: Chen, Huanran, et al.
Veröffentlicht: (2024)
DO-Bench: An Attributable Benchmark for Diagnosing Object Hallucination in Vision-Language Models
von: Wang, JiYang, et al.
Veröffentlicht: (2026)
von: Wang, JiYang, et al.
Veröffentlicht: (2026)
Tex3D: Objects as Attack Surfaces via Adversarial 3D Textures for Vision-Language-Action Models
von: Chen, Jiawei, et al.
Veröffentlicht: (2026)
von: Chen, Jiawei, et al.
Veröffentlicht: (2026)
Machine Vision Therapy: Multimodal Large Language Models Can Enhance Visual Robustness via Denoising In-Context Learning
von: Huang, Zhuo, et al.
Veröffentlicht: (2023)
von: Huang, Zhuo, et al.
Veröffentlicht: (2023)
Omniview-Tuning: Boosting Viewpoint Invariance of Vision-Language Pre-training Models
von: Ruan, Shouwei, et al.
Veröffentlicht: (2024)
von: Ruan, Shouwei, et al.
Veröffentlicht: (2024)
Robust Classification via a Single Diffusion Model
von: Chen, Huanran, et al.
Veröffentlicht: (2023)
von: Chen, Huanran, et al.
Veröffentlicht: (2023)
Exploring the Secondary Risks of Large Language Models
von: Chen, Jiawei, et al.
Veröffentlicht: (2025)
von: Chen, Jiawei, et al.
Veröffentlicht: (2025)
KG-DF: A Black-box Defense Framework against Jailbreak Attacks Based on Knowledge Graphs
von: Liu, Shuyuan, et al.
Veröffentlicht: (2025)
von: Liu, Shuyuan, et al.
Veröffentlicht: (2025)
Neural network fragile watermarking with no model performance degradation
von: Yin, Zhaoxia, et al.
Veröffentlicht: (2022)
von: Yin, Zhaoxia, et al.
Veröffentlicht: (2022)
MultiTrust: A Comprehensive Benchmark Towards Trustworthy Multimodal Large Language Models
von: Zhang, Yichi, et al.
Veröffentlicht: (2024)
von: Zhang, Yichi, et al.
Veröffentlicht: (2024)
From Pixels to Tokens: Revisiting Object Hallucinations in Large Vision-Language Models
von: Shang, Yuying, et al.
Veröffentlicht: (2024)
von: Shang, Yuying, et al.
Veröffentlicht: (2024)
Adversarial Attacks on Medical Hyperspectral Imaging Exploiting Spectral-Spatial Dependencies and Multiscale Features
von: Gu, Yunrui, et al.
Veröffentlicht: (2026)
von: Gu, Yunrui, et al.
Veröffentlicht: (2026)
Exploring the Transferability of Visual Prompting for Multimodal Large Language Models
von: Zhang, Yichi, et al.
Veröffentlicht: (2024)
von: Zhang, Yichi, et al.
Veröffentlicht: (2024)
Efficient Modulation for Vision Networks
von: Ma, Xu, et al.
Veröffentlicht: (2024)
von: Ma, Xu, et al.
Veröffentlicht: (2024)
AdvDreamer Unveils: Are Vision-Language Models Truly Ready for Real-World 3D Variations?
von: Ruan, Shouwei, et al.
Veröffentlicht: (2024)
von: Ruan, Shouwei, et al.
Veröffentlicht: (2024)
Membership Inference on Text-to-Image Diffusion Models via Conditional Likelihood Discrepancy
von: Zhai, Shengfang, et al.
Veröffentlicht: (2024)
von: Zhai, Shengfang, et al.
Veröffentlicht: (2024)
Network Knowledge Prior Guided Learning for Data-Efficient Surface Defect Detection
von: Dong, Hang-Cheng, et al.
Veröffentlicht: (2026)
von: Dong, Hang-Cheng, et al.
Veröffentlicht: (2026)
Geometry-Aware Rotary Position Embedding for Consistent Video World Model
von: Xiang, Chendong, et al.
Veröffentlicht: (2026)
von: Xiang, Chendong, et al.
Veröffentlicht: (2026)
Effective Black-Box Multi-Faceted Attacks Breach Vision Large Language Model Guardrails
von: Yang, Yijun, et al.
Veröffentlicht: (2025)
von: Yang, Yijun, et al.
Veröffentlicht: (2025)
Face-D(^2)CL: Multi-Domain Synergistic Representation with Dual Continual Learning for Facial DeepFake Detection
von: Zhang, Yushuo, et al.
Veröffentlicht: (2026)
von: Zhang, Yushuo, et al.
Veröffentlicht: (2026)
GPO-V: Jailbreak Diffusion Vision Language Model by Global Probability Optimization
von: Pan, Yu, et al.
Veröffentlicht: (2026)
von: Pan, Yu, et al.
Veröffentlicht: (2026)
MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments
von: Yang, Xiao, et al.
Veröffentlicht: (2025)
von: Yang, Xiao, et al.
Veröffentlicht: (2025)
PolarMAE: Efficient Fetal Ultrasound Pre-training via Semantic Screening and Polar-Guided Masking
von: Lv, Meng, et al.
Veröffentlicht: (2026)
von: Lv, Meng, et al.
Veröffentlicht: (2026)
Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient
von: Chen, Zigeng, et al.
Veröffentlicht: (2024)
von: Chen, Zigeng, et al.
Veröffentlicht: (2024)
Toward Availability Attacks in 3D Point Clouds
von: Zhu, Yifan, et al.
Veröffentlicht: (2024)
von: Zhu, Yifan, et al.
Veröffentlicht: (2024)
DIFFender: Diffusion-Based Adversarial Defense against Patch Attacks
von: Kang, Caixin, et al.
Veröffentlicht: (2023)
von: Kang, Caixin, et al.
Veröffentlicht: (2023)
Real-world Adversarial Defense against Patch Attacks based on Diffusion Model
von: Wei, Xingxing, et al.
Veröffentlicht: (2024)
von: Wei, Xingxing, et al.
Veröffentlicht: (2024)
SAM Encoder Breach by Adversarial Simplicial Complex Triggers Downstream Model Failures
von: Qin, Yi, et al.
Veröffentlicht: (2025)
von: Qin, Yi, et al.
Veröffentlicht: (2025)
HybridDepth: Robust Metric Depth Fusion by Leveraging Depth from Focus and Single-Image Priors
von: Ganj, Ashkan, et al.
Veröffentlicht: (2024)
von: Ganj, Ashkan, et al.
Veröffentlicht: (2024)
AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting
von: Zhou, Xiaoyu, et al.
Veröffentlicht: (2025)
von: Zhou, Xiaoyu, et al.
Veröffentlicht: (2025)
Benchmarking the Trustworthiness in Multimodal LLMs for Video Understanding
von: Wang, Youze, et al.
Veröffentlicht: (2025)
von: Wang, Youze, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
FaceCat: Enhancing Face Recognition Security with a Unified Diffusion Model
von: Chen, Jiawei, et al.
Veröffentlicht: (2024) -
BSPA: Exploring Black-box Stealthy Prompt Attacks against Image Generators
von: Tian, Yu, et al.
Veröffentlicht: (2024) -
Towards Transferable Targeted 3D Adversarial Attack in the Physical World
von: Huang, Yao, et al.
Veröffentlicht: (2023) -
Rethinking Model Ensemble in Transfer-based Adversarial Attacks
von: Chen, Huanran, et al.
Veröffentlicht: (2023) -
Who Can See Through You? Adversarial Shielding Against VLM-Based Attribute Inference Attacks
von: Fan, Yucheng, et al.
Veröffentlicht: (2025)