Adversarial Attacks on Parts of Speech: An Empirical Study in Text-to-Image Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shahariar, G M, Chen, Jia, Li, Jiachen, Dong, Yue |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On Evaluating The Performance of Watermarked Machine-Generated Texts Under Adversarial Attacks
par: Liu, Zesen, et autres
Publié: (2024)
par: Liu, Zesen, et autres
Publié: (2024)
Misaligned Roles, Misplaced Images: Structural Input Perturbations Expose Multimodal Alignment Blind Spots
par: Shayegani, Erfan, et autres
Publié: (2025)
par: Shayegani, Erfan, et autres
Publié: (2025)
The Resurgence of GCG Adversarial Attacks on Large Language Models
par: Tan, Yuting, et autres
Publié: (2025)
par: Tan, Yuting, et autres
Publié: (2025)
Investigating Imperceptibility of Adversarial Attacks on Tabular Data: An Empirical Analysis
par: He, Zhipeng, et autres
Publié: (2024)
par: He, Zhipeng, et autres
Publié: (2024)
REALISTA: Realistic Latent Adversarial Attacks that Elicit LLM Hallucinations
par: Liang, Buyun, et autres
Publié: (2026)
par: Liang, Buyun, et autres
Publié: (2026)
Revealing Weaknesses in Text Watermarking Through Self-Information Rewrite Attacks
par: Cheng, Yixin, et autres
Publié: (2025)
par: Cheng, Yixin, et autres
Publié: (2025)
Asymmetric Bias in Text-to-Image Generation with Adversarial Attacks
par: Shahgir, Haz Sameen, et autres
Publié: (2023)
par: Shahgir, Haz Sameen, et autres
Publié: (2023)
Adversarial Text Purification: A Large Language Model Approach for Defense
par: Moraffah, Raha, et autres
Publié: (2024)
par: Moraffah, Raha, et autres
Publié: (2024)
Formalizing and Benchmarking Prompt Injection Attacks and Defenses
par: Liu, Yupei, et autres
Publié: (2023)
par: Liu, Yupei, et autres
Publié: (2023)
Toward a Safer Web: Multilingual Multi-Agent LLMs for Mitigating Adversarial Misinformation Attacks
par: Aldahoul, Nouar, et autres
Publié: (2025)
par: Aldahoul, Nouar, et autres
Publié: (2025)
Route to Rome Attack: Directing LLM Routers to Expensive Models via Adversarial Suffix Optimization
par: Tang, Haochun, et autres
Publié: (2026)
par: Tang, Haochun, et autres
Publié: (2026)
Query-Based Adversarial Prompt Generation
par: Hayase, Jonathan, et autres
Publié: (2024)
par: Hayase, Jonathan, et autres
Publié: (2024)
Less is More: Understanding Word-level Textual Adversarial Attack via n-gram Frequency Descend
par: Lu, Ning, et autres
Publié: (2023)
par: Lu, Ning, et autres
Publié: (2023)
Input-Specific and Universal Adversarial Attack Generation for Spiking Neural Networks in the Spiking Domain
par: Raptis, Spyridon, et autres
Publié: (2025)
par: Raptis, Spyridon, et autres
Publié: (2025)
MoCo-EA: Exploiting Adversarial Mode Connectivity for Efficient Evolutionary Attacks
par: Kim, Hyo Seo, et autres
Publié: (2026)
par: Kim, Hyo Seo, et autres
Publié: (2026)
Measuring Real-World Prompt Injection Attacks in LLM-based Resume Screening
par: Zhang, Mohan, et autres
Publié: (2026)
par: Zhang, Mohan, et autres
Publié: (2026)
Prompt2Fingerprint: Plug-and-Play LLM Fingerprinting via Text-to-Weight Generation
par: Chen, Sixu, et autres
Publié: (2026)
par: Chen, Sixu, et autres
Publié: (2026)
Untargeted Adversarial Attack on Knowledge Graph Embeddings
par: Zhao, Tianzhe, et autres
Publié: (2024)
par: Zhao, Tianzhe, et autres
Publié: (2024)
Can Adversarial Code Comments Fool AI Security Reviewers -- Large-Scale Empirical Study of Comment-Based Attacks and Defenses Against LLM Code Analysis
par: Thornton, Scott
Publié: (2026)
par: Thornton, Scott
Publié: (2026)
Scalable Defense against In-the-wild Jailbreaking Attacks with Safety Context Retrieval
par: Chen, Taiye, et autres
Publié: (2025)
par: Chen, Taiye, et autres
Publié: (2025)
Medusa: Cross-Modal Transferable Adversarial Attacks on Multimodal Medical Retrieval-Augmented Generation
par: Shang, Yingjia, et autres
Publié: (2025)
par: Shang, Yingjia, et autres
Publié: (2025)
Attack and defense techniques in large language models: A survey and new perspectives
par: Liao, Zhiyu, et autres
Publié: (2025)
par: Liao, Zhiyu, et autres
Publié: (2025)
Modeling the Attack: Detecting AI-Generated Text by Quantifying Adversarial Perturbations
par: Teja, Lekkala Sai, et autres
Publié: (2025)
par: Teja, Lekkala Sai, et autres
Publié: (2025)
MetaDefense: Defending Finetuning-based Jailbreak Attack Before and During Generation
par: Jiang, Weisen, et autres
Publié: (2025)
par: Jiang, Weisen, et autres
Publié: (2025)
Certifying LLM Safety against Adversarial Prompting
par: Kumar, Aounon, et autres
Publié: (2023)
par: Kumar, Aounon, et autres
Publié: (2023)
A Survey on Physical Adversarial Attacks against Face Recognition Systems
par: Wang, Mingsi, et autres
Publié: (2024)
par: Wang, Mingsi, et autres
Publié: (2024)
A General Black-box Adversarial Attack on Graph-based Fake News Detectors
par: Zhu, Peican, et autres
Publié: (2024)
par: Zhu, Peican, et autres
Publié: (2024)
On the Robustness of Bayesian Neural Networks to Adversarial Attacks
par: Bortolussi, Luca, et autres
Publié: (2022)
par: Bortolussi, Luca, et autres
Publié: (2022)
Adversarial Attacks on Transformers-Based Malware Detectors
par: Jakhotiya, Yash, et autres
Publié: (2022)
par: Jakhotiya, Yash, et autres
Publié: (2022)
Relationship between Uncertainty in DNNs and Adversarial Attacks
par: Ogonna, Mabel, et autres
Publié: (2024)
par: Ogonna, Mabel, et autres
Publié: (2024)
Fuzz-Testing Meets LLM-Based Agents: An Automated and Efficient Framework for Jailbreaking Text-To-Image Generation Models
par: Dong, Yingkai, et autres
Publié: (2024)
par: Dong, Yingkai, et autres
Publié: (2024)
Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM
par: Cao, Bochuan, et autres
Publié: (2023)
par: Cao, Bochuan, et autres
Publié: (2023)
Mitigation of Camouflaged Adversarial Attacks in Autonomous Vehicles--A Case Study Using CARLA Simulator
par: Martinez, Yago Romano, et autres
Publié: (2025)
par: Martinez, Yago Romano, et autres
Publié: (2025)
Empirical Analysis of Adversarial Robustness and Explainability Drift in Cybersecurity Classifiers
par: Rajhans, Mona, et autres
Publié: (2026)
par: Rajhans, Mona, et autres
Publié: (2026)
Vision Transformer with Adversarial Indicator Token against Adversarial Attacks in Radio Signal Classifications
par: Zhang, Lu, et autres
Publié: (2025)
par: Zhang, Lu, et autres
Publié: (2025)
MF-CLIP: Leveraging CLIP as Surrogate Models for No-box Adversarial Attacks
par: Zhang, Jiaming, et autres
Publié: (2023)
par: Zhang, Jiaming, et autres
Publié: (2023)
Quantifying the Noise of Structural Perturbations on Graph Adversarial Attacks
par: Fang, Junyuan, et autres
Publié: (2025)
par: Fang, Junyuan, et autres
Publié: (2025)
An Adversarial Perspective on Machine Unlearning for AI Safety
par: Łucki, Jakub, et autres
Publié: (2024)
par: Łucki, Jakub, et autres
Publié: (2024)
On Adversarial Robustness of Language Models in Transfer Learning
par: Turbal, Bohdan, et autres
Publié: (2024)
par: Turbal, Bohdan, et autres
Publié: (2024)
AliMark: Enhancing Robustness of Sentence-Level Watermarking Against Text Paraphrasing
par: Li, Yuexin, et autres
Publié: (2026)
par: Li, Yuexin, et autres
Publié: (2026)
Documents similaires
-
On Evaluating The Performance of Watermarked Machine-Generated Texts Under Adversarial Attacks
par: Liu, Zesen, et autres
Publié: (2024) -
Misaligned Roles, Misplaced Images: Structural Input Perturbations Expose Multimodal Alignment Blind Spots
par: Shayegani, Erfan, et autres
Publié: (2025) -
The Resurgence of GCG Adversarial Attacks on Large Language Models
par: Tan, Yuting, et autres
Publié: (2025) -
Investigating Imperceptibility of Adversarial Attacks on Tabular Data: An Empirical Analysis
par: He, Zhipeng, et autres
Publié: (2024) -
REALISTA: Realistic Latent Adversarial Attacks that Elicit LLM Hallucinations
par: Liang, Buyun, et autres
Publié: (2026)