Enregistré dans:
| Auteur principal: | Kulkarni, Prashant |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2604.28129 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RAG-targeted Adversarial Attack on LLM-based Threat Detection and Mitigation Framework
par: Ikbarieh, Seif, et autres
Publié: (2025)
par: Ikbarieh, Seif, et autres
Publié: (2025)
Adversarial-Resilient RF Fingerprinting: A CNN-GAN Framework for Rogue Transmitter Detection
par: Dhakal, Raju, et autres
Publié: (2025)
par: Dhakal, Raju, et autres
Publié: (2025)
Active Honeypot Guardrail System: Probing and Confirming Multi-Turn LLM Jailbreaks
par: Wu, ChenYu, et autres
Publié: (2025)
par: Wu, ChenYu, et autres
Publié: (2025)
Enhancing TinyML Security: Study of Adversarial Attack Transferability
par: Shah, Parin, et autres
Publié: (2024)
par: Shah, Parin, et autres
Publié: (2024)
Great, Now Write an Article About That: The Crescendo Multi-Turn LLM Jailbreak Attack
par: Russinovich, Mark, et autres
Publié: (2024)
par: Russinovich, Mark, et autres
Publié: (2024)
HarmNet: A Framework for Adaptive Multi-Turn Jailbreak Attacks on Large Language Models
par: Narula, Sidhant, et autres
Publié: (2025)
par: Narula, Sidhant, et autres
Publié: (2025)
Enhancing Network Intrusion Detection Systems: A Multi-Layer Ensemble Approach to Mitigate Adversarial Attacks
par: Soltani, Nasim, et autres
Publié: (2026)
par: Soltani, Nasim, et autres
Publié: (2026)
Foe for Fraud: Transferable Adversarial Attacks in Credit Card Fraud Detection
par: Fok, Jan Lum, et autres
Publié: (2025)
par: Fok, Jan Lum, et autres
Publié: (2025)
Probing Latent Subspaces in LLM for AI Security: Identifying and Manipulating Adversarial States
par: Chia, Xin Wei, et autres
Publié: (2025)
par: Chia, Xin Wei, et autres
Publié: (2025)
Adversarial Reinforcement Learning for Detecting False Data Injection Attacks in Vehicular Routing
par: Eghtesad, Taha, et autres
Publié: (2026)
par: Eghtesad, Taha, et autres
Publié: (2026)
The Echo Chamber Multi-Turn LLM Jailbreak
par: Alobaid, Ahmad, et autres
Publié: (2026)
par: Alobaid, Ahmad, et autres
Publié: (2026)
MultiPhishGuard: An Explainable and Adaptive Multi-Agent LLM System for Phishing Email Detection
par: Xue, Yinuo, et autres
Publié: (2025)
par: Xue, Yinuo, et autres
Publié: (2025)
ICON: Intent-Context Coupling for Efficient Multi-Turn Jailbreak Attack
par: Lin, Xingwei, et autres
Publié: (2026)
par: Lin, Xingwei, et autres
Publié: (2026)
Surviving the Unseen: Predictive Defense for Novel Multi-Turn Multimodal Attacks
par: You, Doohee
Publié: (2026)
par: You, Doohee
Publié: (2026)
REALISTA: Realistic Latent Adversarial Attacks that Elicit LLM Hallucinations
par: Liang, Buyun, et autres
Publié: (2026)
par: Liang, Buyun, et autres
Publié: (2026)
Explainer-guided Targeted Adversarial Attacks against Binary Code Similarity Detection Models
par: Chen, Mingjie, et autres
Publié: (2025)
par: Chen, Mingjie, et autres
Publié: (2025)
Adversarial Attacks against Windows PE Malware Detection: A Survey of the State-of-the-Art
par: Ling, Xiang, et autres
Publié: (2021)
par: Ling, Xiang, et autres
Publié: (2021)
An Attack Method for Medical Insurance Claim Fraud Detection based on Generative Adversarial Network
par: Pang, Yining, et autres
Publié: (2025)
par: Pang, Yining, et autres
Publié: (2025)
CivicShield: A Cross-Domain Defense-in-Depth Framework for Securing Government-Facing AI Chatbots Against Multi-Turn Adversarial Attacks
par: Patil, KrishnaSaiReddy
Publié: (2026)
par: Patil, KrishnaSaiReddy
Publié: (2026)
Peak + Accumulation: A Proxy-Level Scoring Formula for Multi-Turn LLM Attack Detection
par: Corll, J Alex
Publié: (2026)
par: Corll, J Alex
Publié: (2026)
CSC: Turning the Adversary's Poison against Itself
par: Shi, Yuchen, et autres
Publié: (2026)
par: Shi, Yuchen, et autres
Publié: (2026)
Vulnerability Disclosure through Adaptive Black-Box Adversarial Attacks on NIDS
par: Ennaji, Sabrine, et autres
Publié: (2025)
par: Ennaji, Sabrine, et autres
Publié: (2025)
AMDS: Attack-Aware Multi-Stage Defense System for Network Intrusion Detection with Two-Stage Adaptive Weight Learning
par: Olukola, Oluseyi, et autres
Publié: (2026)
par: Olukola, Oluseyi, et autres
Publié: (2026)
LLM-Driven Feature-Level Adversarial Attacks on Android Malware Detectors
par: Lan, Tianwei, et autres
Publié: (2025)
par: Lan, Tianwei, et autres
Publié: (2025)
NetDiffuser: Deceiving DNN-Based Network Attack Detection Systems with Diffusion-Generated Adversarial Traffic
par: Kumar, Pratyay, et autres
Publié: (2026)
par: Kumar, Pratyay, et autres
Publié: (2026)
Refusal Before Decoding: Detecting and Exploiting Refusal Signals in Intermediate LLM Activations
par: Collu, Matteo Gioele, et autres
Publié: (2026)
par: Collu, Matteo Gioele, et autres
Publié: (2026)
TEAM: Temporal Adversarial Examples Attack Model against Network Intrusion Detection System Applied to RNN
par: Liu, Ziyi, et autres
Publié: (2024)
par: Liu, Ziyi, et autres
Publié: (2024)
MT-JailBench: A Modular Benchmark for Understanding Multi-Turn Jailbreak Attacks
par: Zhang, Xinkai, et autres
Publié: (2026)
par: Zhang, Xinkai, et autres
Publié: (2026)
Bidirectional Intention Inference Enhances LLMs' Defense Against Multi-Turn Jailbreak Attacks
par: Tong, Haibo, et autres
Publié: (2025)
par: Tong, Haibo, et autres
Publié: (2025)
Building A Secure Agentic AI Application Leveraging A2A Protocol
par: Habler, Idan, et autres
Publié: (2025)
par: Habler, Idan, et autres
Publié: (2025)
Comprehensive Botnet Detection by Mitigating Adversarial Attacks, Navigating the Subtleties of Perturbation Distances and Fortifying Predictions with Conformal Layers
par: Yumlembam, Rahul, et autres
Publié: (2024)
par: Yumlembam, Rahul, et autres
Publié: (2024)
Kill Two Birds with One Stone! Trajectory enabled Unified Online Detection of Adversarial Examples and Backdoor Attacks
par: Fu, Anmin, et autres
Publié: (2025)
par: Fu, Anmin, et autres
Publié: (2025)
Evaluating Answer Leakage Robustness of LLM Tutors against Adversarial Student Attacks
par: Zhao, Jin, et autres
Publié: (2026)
par: Zhao, Jin, et autres
Publié: (2026)
Modeling the Attack: Detecting AI-Generated Text by Quantifying Adversarial Perturbations
par: Teja, Lekkala Sai, et autres
Publié: (2025)
par: Teja, Lekkala Sai, et autres
Publié: (2025)
Runtime Detection of Adversarial Attacks in AI Accelerators Using Performance Counters
par: Rahaman, Habibur, et autres
Publié: (2025)
par: Rahaman, Habibur, et autres
Publié: (2025)
AdaDoS: Adaptive DoS Attack via Deep Adversarial Reinforcement Learning in SDN
par: Shao, Wei, et autres
Publié: (2025)
par: Shao, Wei, et autres
Publié: (2025)
A Demonstration of Self-Adaptive Jamming Attack Detection in AI/ML Integrated O-RAN
par: Rahman, Md Habibur, et autres
Publié: (2025)
par: Rahman, Md Habibur, et autres
Publié: (2025)
Emerging Vulnerabilities in Frontier Models: Multi-Turn Jailbreak Attacks
par: Gibbs, Tom, et autres
Publié: (2024)
par: Gibbs, Tom, et autres
Publié: (2024)
Detection of Adversarial Attacks in Robotic Perception
par: Sharawy, Ziad, et autres
Publié: (2026)
par: Sharawy, Ziad, et autres
Publié: (2026)
Turning Generative Models Degenerate: The Power of Data Poisoning Attacks
par: Jiang, Shuli, et autres
Publié: (2024)
par: Jiang, Shuli, et autres
Publié: (2024)
Documents similaires
-
RAG-targeted Adversarial Attack on LLM-based Threat Detection and Mitigation Framework
par: Ikbarieh, Seif, et autres
Publié: (2025) -
Adversarial-Resilient RF Fingerprinting: A CNN-GAN Framework for Rogue Transmitter Detection
par: Dhakal, Raju, et autres
Publié: (2025) -
Active Honeypot Guardrail System: Probing and Confirming Multi-Turn LLM Jailbreaks
par: Wu, ChenYu, et autres
Publié: (2025) -
Enhancing TinyML Security: Study of Adversarial Attack Transferability
par: Shah, Parin, et autres
Publié: (2024) -
Great, Now Write an Article About That: The Crescendo Multi-Turn LLM Jailbreak Attack
par: Russinovich, Mark, et autres
Publié: (2024)