Guardado en:
| Autores principales: | Truong, Vu Tuan, Dang, Luan Ba, Le, Long Bao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2408.03400 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Critical-CoT: A Robust Defense Framework against Reasoning-Level Backdoor Attacks in Large Language Models
por: Truong, Vu Tuan, et al.
Publicado: (2026)
por: Truong, Vu Tuan, et al.
Publicado: (2026)
Enhancing Security in Deep Reinforcement Learning: A Comprehensive Survey on Adversarial Attacks and Defenses
por: Yichao, Wu, et al.
Publicado: (2025)
por: Yichao, Wu, et al.
Publicado: (2025)
A Survey on Model Extraction Attacks and Defenses for Large Language Models
por: Zhao, Kaixiang, et al.
Publicado: (2025)
por: Zhao, Kaixiang, et al.
Publicado: (2025)
A Survey of Model Extraction Attacks and Defenses in Distributed Computing Environments
por: Zhao, Kaixiang, et al.
Publicado: (2025)
por: Zhao, Kaixiang, et al.
Publicado: (2025)
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
por: Huang, Tiansheng, et al.
Publicado: (2024)
por: Huang, Tiansheng, et al.
Publicado: (2024)
A Systematic Survey of Model Extraction Attacks and Defenses: State-of-the-Art and Perspectives
por: Zhao, Kaixiang, et al.
Publicado: (2025)
por: Zhao, Kaixiang, et al.
Publicado: (2025)
Jailbreak Attacks and Defenses Against Large Language Models: A Survey
por: Yi, Sibo, et al.
Publicado: (2024)
por: Yi, Sibo, et al.
Publicado: (2024)
Attacks and Defenses Against LLM Fingerprinting
por: Kurian, Kevin, et al.
Publicado: (2025)
por: Kurian, Kevin, et al.
Publicado: (2025)
A Causal Perspective for Enhancing Jailbreak Attack and Defense
por: Pan, Licheng, et al.
Publicado: (2026)
por: Pan, Licheng, et al.
Publicado: (2026)
Optimal Defenses Against Gradient Reconstruction Attacks
por: Chen, Yuxiao, et al.
Publicado: (2024)
por: Chen, Yuxiao, et al.
Publicado: (2024)
Stealthy Poisoning Attacks Bypass Defenses in Regression Settings
por: Carnerero-Cano, Javier, et al.
Publicado: (2026)
por: Carnerero-Cano, Javier, et al.
Publicado: (2026)
SoK: Benchmarking Poisoning Attacks and Defenses in Federated Learning
por: Zhang, Heyi, et al.
Publicado: (2025)
por: Zhang, Heyi, et al.
Publicado: (2025)
Backdoor Vectors: a Task Arithmetic View on Backdoor Attacks and Defenses
por: Pawlak, Stanisław, et al.
Publicado: (2025)
por: Pawlak, Stanisław, et al.
Publicado: (2025)
Semantic Chameleon: Corpus-Dependent Poisoning Attacks and Defenses in RAG Systems
por: Thornton, Scott
Publicado: (2026)
por: Thornton, Scott
Publicado: (2026)
LeakSealer: A Semisupervised Defense for LLMs Against Prompt Injection and Leakage Attacks
por: Panebianco, Francesco, et al.
Publicado: (2025)
por: Panebianco, Francesco, et al.
Publicado: (2025)
A Survey of Privacy Threats and Defense in Vertical Federated Learning: From Model Life Cycle Perspective
por: Yu, Lei, et al.
Publicado: (2024)
por: Yu, Lei, et al.
Publicado: (2024)
Defending the Edge: Representative-Attention Defense against Backdoor Attacks in Federated Learning
por: Obioma, Chibueze Peace, et al.
Publicado: (2025)
por: Obioma, Chibueze Peace, et al.
Publicado: (2025)
The Attack and Defense Landscape of Agentic AI: A Comprehensive Survey
por: Kim, Juhee, et al.
Publicado: (2026)
por: Kim, Juhee, et al.
Publicado: (2026)
MetaDefense: Defending Finetuning-based Jailbreak Attack Before and During Generation
por: Jiang, Weisen, et al.
Publicado: (2025)
por: Jiang, Weisen, et al.
Publicado: (2025)
Real-world Adversarial Defense against Patch Attacks based on Diffusion Model
por: Wei, Xingxing, et al.
Publicado: (2024)
por: Wei, Xingxing, et al.
Publicado: (2024)
Formalizing and Benchmarking Prompt Injection Attacks and Defenses
por: Liu, Yupei, et al.
Publicado: (2023)
por: Liu, Yupei, et al.
Publicado: (2023)
A Survey of Privacy-Preserving Model Explanations: Privacy Risks, Attacks, and Countermeasures
por: Nguyen, Thanh Tam, et al.
Publicado: (2024)
por: Nguyen, Thanh Tam, et al.
Publicado: (2024)
DIFFender: Diffusion-Based Adversarial Defense against Patch Attacks
por: Kang, Caixin, et al.
Publicado: (2023)
por: Kang, Caixin, et al.
Publicado: (2023)
Diffusion-Driven Synthetic Tabular Data Generation for Enhanced DoS/DDoS Attack Classification
por: B, Aravind, et al.
Publicado: (2026)
por: B, Aravind, et al.
Publicado: (2026)
AI Security in the Foundation Model Era: A Comprehensive Survey from a Unified Perspective
por: Wang, Zhenyi, et al.
Publicado: (2026)
por: Wang, Zhenyi, et al.
Publicado: (2026)
A Comprehensive Study of Supervised Machine Learning Models for Zero-Day Attack Detection: Analyzing Performance on Imbalanced Data
por: Lotfi, Zahra, et al.
Publicado: (2025)
por: Lotfi, Zahra, et al.
Publicado: (2025)
LaFA: Latent Feature Attacks on Non-negative Matrix Factorization
por: Vu, Minh, et al.
Publicado: (2024)
por: Vu, Minh, et al.
Publicado: (2024)
PureGen: Universal Data Purification for Train-Time Poison Defense via Generative Model Dynamics
por: Bhat, Sunay, et al.
Publicado: (2024)
por: Bhat, Sunay, et al.
Publicado: (2024)
Thought Purity: A Defense Framework For Chain-of-Thought Attack
por: Xue, Zihao, et al.
Publicado: (2025)
por: Xue, Zihao, et al.
Publicado: (2025)
UIFV: Data Reconstruction Attack in Vertical Federated Learning
por: Yang, Jirui, et al.
Publicado: (2024)
por: Yang, Jirui, et al.
Publicado: (2024)
RedVisor: Reasoning-Aware Prompt Injection Defense via Zero-Copy KV Cache Reuse
por: Liu, Mingrui, et al.
Publicado: (2026)
por: Liu, Mingrui, et al.
Publicado: (2026)
How Does a Deep Learning Model Architecture Impact Its Privacy? A Comprehensive Study of Privacy Attacks on CNNs and Transformers
por: Zhang, Guangsheng, et al.
Publicado: (2022)
por: Zhang, Guangsheng, et al.
Publicado: (2022)
Winning the MIDST Challenge: New Membership Inference Attacks on Diffusion Models for Tabular Data Synthesis
por: Wu, Xiaoyu, et al.
Publicado: (2025)
por: Wu, Xiaoyu, et al.
Publicado: (2025)
Disrupting Model Merging: A Parameter-Level Defense Without Sacrificing Accuracy
por: Junhao, Wei, et al.
Publicado: (2025)
por: Junhao, Wei, et al.
Publicado: (2025)
LoRID: Low-Rank Iterative Diffusion for Adversarial Purification
por: Zollicoffer, Geigh, et al.
Publicado: (2024)
por: Zollicoffer, Geigh, et al.
Publicado: (2024)
Large Language Models in Cybersecurity: Applications, Vulnerabilities, and Defense Techniques
por: Jaffal, Niveen O., et al.
Publicado: (2025)
por: Jaffal, Niveen O., et al.
Publicado: (2025)
Twin Auto-Encoder Model for Learning Separable Representation in Cyberattack Detection
por: Dinh, Phai Vu, et al.
Publicado: (2024)
por: Dinh, Phai Vu, et al.
Publicado: (2024)
LLM Security: Vulnerabilities, Attacks, Defenses, and Countermeasures
por: Aguilera-Martínez, Francisco, et al.
Publicado: (2025)
por: Aguilera-Martínez, Francisco, et al.
Publicado: (2025)
Scalable Defense against In-the-wild Jailbreaking Attacks with Safety Context Retrieval
por: Chen, Taiye, et al.
Publicado: (2025)
por: Chen, Taiye, et al.
Publicado: (2025)
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
por: Zhao, Shuai, et al.
Publicado: (2024)
por: Zhao, Shuai, et al.
Publicado: (2024)
Ejemplares similares
-
Critical-CoT: A Robust Defense Framework against Reasoning-Level Backdoor Attacks in Large Language Models
por: Truong, Vu Tuan, et al.
Publicado: (2026) -
Enhancing Security in Deep Reinforcement Learning: A Comprehensive Survey on Adversarial Attacks and Defenses
por: Yichao, Wu, et al.
Publicado: (2025) -
A Survey on Model Extraction Attacks and Defenses for Large Language Models
por: Zhao, Kaixiang, et al.
Publicado: (2025) -
A Survey of Model Extraction Attacks and Defenses in Distributed Computing Environments
por: Zhao, Kaixiang, et al.
Publicado: (2025) -
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
por: Huang, Tiansheng, et al.
Publicado: (2024)