Guardado en:
| Autores principales: | Draganov, Andrew, Dur, Tolga H., Bhongade, Anandmayi, Phuong, Mary |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.04899 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LLMs Can Covertly Sandbag on Capability Evaluations Against Chain-of-Thought Monitoring
por: Li, Chloe, et al.
Publicado: (2025)
por: Li, Chloe, et al.
Publicado: (2025)
Shadowcast: Stealthy Data Poisoning Attacks Against Vision-Language Models
por: Xu, Yuancheng, et al.
Publicado: (2024)
por: Xu, Yuancheng, et al.
Publicado: (2024)
How Reliable Are AI Attackers Against a Fixed Vulnerable Target? A 400-Run Empirical Study of LLM Penetration Testing Consistency
por: Erdem, Galip Tolga
Publicado: (2026)
por: Erdem, Galip Tolga
Publicado: (2026)
Data Poisoning in Deep Learning: A Survey
por: Zhao, Pinlong, et al.
Publicado: (2025)
por: Zhao, Pinlong, et al.
Publicado: (2025)
Have You Poisoned My Data? Defending Neural Networks against Data Poisoning
por: De Gaspari, Fabio, et al.
Publicado: (2024)
por: De Gaspari, Fabio, et al.
Publicado: (2024)
Defending Against Beta Poisoning Attacks in Machine Learning Models
por: Gulciftci, Nilufer, et al.
Publicado: (2025)
por: Gulciftci, Nilufer, et al.
Publicado: (2025)
Be Kind, Rewrite: Benign Projections via Rewriting Defend Against LLM Data Poisoning Attacks
por: Halloran, John T., et al.
Publicado: (2026)
por: Halloran, John T., et al.
Publicado: (2026)
Turning Generative Models Degenerate: The Power of Data Poisoning Attacks
por: Jiang, Shuli, et al.
Publicado: (2024)
por: Jiang, Shuli, et al.
Publicado: (2024)
When and Where do Data Poisons Attack Textual Inversion?
por: Styborski, Jeremy, et al.
Publicado: (2025)
por: Styborski, Jeremy, et al.
Publicado: (2025)
CBPF: Filtering Poisoned Data Based on Composite Backdoor Attack
por: Xia, Hanfeng, et al.
Publicado: (2024)
por: Xia, Hanfeng, et al.
Publicado: (2024)
Through the Stealth Lens: Attention-Aware Defenses Against Poisoning in RAG
por: Choudhary, Sarthak, et al.
Publicado: (2025)
por: Choudhary, Sarthak, et al.
Publicado: (2025)
FIDELIS: Blockchain-Enabled Protection Against Poisoning Attacks in Federated Learning
por: Carney, Jane, et al.
Publicado: (2025)
por: Carney, Jane, et al.
Publicado: (2025)
PoisonBench: Assessing Large Language Model Vulnerability to Data Poisoning
por: Fu, Tingchen, et al.
Publicado: (2024)
por: Fu, Tingchen, et al.
Publicado: (2024)
Precision Guided Approach to Mitigate Data Poisoning Attacks in Federated Learning
por: Kumar, K Naveen, et al.
Publicado: (2024)
por: Kumar, K Naveen, et al.
Publicado: (2024)
Vulnerabilities in AI Code Generators: Exploring Targeted Data Poisoning Attacks
por: Cotroneo, Domenico, et al.
Publicado: (2023)
por: Cotroneo, Domenico, et al.
Publicado: (2023)
Scaling Trends for Data Poisoning in LLMs
por: Bowen, Dillon, et al.
Publicado: (2024)
por: Bowen, Dillon, et al.
Publicado: (2024)
Unraveling the Connections between Privacy and Certified Robustness in Federated Learning Against Poisoning Attacks
por: Xie, Chulin, et al.
Publicado: (2022)
por: Xie, Chulin, et al.
Publicado: (2022)
Addressing The Devastating Effects Of Single-Task Data Poisoning In Exemplar-Free Continual Learning
por: Pawlak, Stanisław, et al.
Publicado: (2025)
por: Pawlak, Stanisław, et al.
Publicado: (2025)
Data Poisoning Vulnerabilities Across Healthcare AI Architectures: A Security Threat Analysis
por: Abtahi, Farhad, et al.
Publicado: (2025)
por: Abtahi, Farhad, et al.
Publicado: (2025)
Robustness Analysis of Machine Learning Models for IoT Intrusion Detection Under Data Poisoning Attacks
por: Wulnye, Fortunatus Aabangbio, et al.
Publicado: (2026)
por: Wulnye, Fortunatus Aabangbio, et al.
Publicado: (2026)
Building Better Environments for Autonomous Cyber Defence
por: Hicks, Chris, et al.
Publicado: (2026)
por: Hicks, Chris, et al.
Publicado: (2026)
Poisoned Acoustics
por: Dahme, Harrison
Publicado: (2026)
por: Dahme, Harrison
Publicado: (2026)
SuperLocalMemory: Privacy-Preserving Multi-Agent Memory with Bayesian Trust Defense Against Memory Poisoning
por: Bhardwaj, Varun Pratap
Publicado: (2026)
por: Bhardwaj, Varun Pratap
Publicado: (2026)
Data Poisoning Attacks on Off-Policy Policy Evaluation Methods
por: Lobo, Elita, et al.
Publicado: (2024)
por: Lobo, Elita, et al.
Publicado: (2024)
The Stronger the Diffusion Model, the Easier the Backdoor: Data Poisoning to Induce Copyright Breaches Without Adjusting Finetuning Pipeline
por: Wang, Haonan, et al.
Publicado: (2024)
por: Wang, Haonan, et al.
Publicado: (2024)
PID: Prompt-Independent Data Protection Against Latent Diffusion Models
por: Li, Ang, et al.
Publicado: (2024)
por: Li, Ang, et al.
Publicado: (2024)
Data to Defense: The Role of Curation in Customizing LLMs Against Jailbreaking Attacks
por: Liu, Xiaoqun, et al.
Publicado: (2024)
por: Liu, Xiaoqun, et al.
Publicado: (2024)
Supply-Chain Poisoning Attacks Against LLM Coding Agent Skill Ecosystems
por: Qu, Yubin, et al.
Publicado: (2026)
por: Qu, Yubin, et al.
Publicado: (2026)
Defending Against Weight-Poisoning Backdoor Attacks for Parameter-Efficient Fine-Tuning
por: Zhao, Shuai, et al.
Publicado: (2024)
por: Zhao, Shuai, et al.
Publicado: (2024)
Poison Once, Exploit Forever: Environment-Injected Memory Poisoning Attacks on Web Agents
por: Zou, Wei, et al.
Publicado: (2026)
por: Zou, Wei, et al.
Publicado: (2026)
FedNIA: Noise-Induced Activation Analysis for Mitigating Data Poisoning in FL
por: Hallaji, Ehsan, et al.
Publicado: (2025)
por: Hallaji, Ehsan, et al.
Publicado: (2025)
Concealing Backdoor Model Updates in Federated Learning by Trigger-Optimized Data Poisoning
por: Zhang, Yujie, et al.
Publicado: (2024)
por: Zhang, Yujie, et al.
Publicado: (2024)
Reasoning-Style Poisoning of LLM Agents via Stealthy Style Transfer: Process-Level Attacks and Runtime Monitoring in RSV Space
por: Zhou, Xingfu, et al.
Publicado: (2025)
por: Zhou, Xingfu, et al.
Publicado: (2025)
Persistent Pre-Training Poisoning of LLMs
por: Zhang, Yiming, et al.
Publicado: (2024)
por: Zhang, Yiming, et al.
Publicado: (2024)
On The Dangers of Poisoned LLMs In Security Automation
por: Karlsen, Patrick, et al.
Publicado: (2025)
por: Karlsen, Patrick, et al.
Publicado: (2025)
Virus Infection Attack on LLMs: Your Poisoning Can Spread "VIA" Synthetic Data
por: Liang, Zi, et al.
Publicado: (2025)
por: Liang, Zi, et al.
Publicado: (2025)
SAFELOC: Overcoming Data Poisoning Attacks in Heterogeneous Federated Machine Learning for Indoor Localization
por: Singampalli, Akhil, et al.
Publicado: (2024)
por: Singampalli, Akhil, et al.
Publicado: (2024)
Machine Unlearning Fails to Remove Data Poisoning Attacks
por: Pawelczyk, Martin, et al.
Publicado: (2024)
por: Pawelczyk, Martin, et al.
Publicado: (2024)
CSC: Turning the Adversary's Poison against Itself
por: Shi, Yuchen, et al.
Publicado: (2026)
por: Shi, Yuchen, et al.
Publicado: (2026)
Detecting Data Poisoning in Code Generation LLMs via Black-Box, Vulnerability-Oriented Scanning
por: Yan, Shenao, et al.
Publicado: (2026)
por: Yan, Shenao, et al.
Publicado: (2026)
Ejemplares similares
-
LLMs Can Covertly Sandbag on Capability Evaluations Against Chain-of-Thought Monitoring
por: Li, Chloe, et al.
Publicado: (2025) -
Shadowcast: Stealthy Data Poisoning Attacks Against Vision-Language Models
por: Xu, Yuancheng, et al.
Publicado: (2024) -
How Reliable Are AI Attackers Against a Fixed Vulnerable Target? A 400-Run Empirical Study of LLM Penetration Testing Consistency
por: Erdem, Galip Tolga
Publicado: (2026) -
Data Poisoning in Deep Learning: A Survey
por: Zhao, Pinlong, et al.
Publicado: (2025) -
Have You Poisoned My Data? Defending Neural Networks against Data Poisoning
por: De Gaspari, Fabio, et al.
Publicado: (2024)