From Theory to Practice: Evaluating Data Poisoning Attacks and Defenses in In-Context Learning on Social Media Health Discourse
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jhuma, Rabeya Amin, Faisal, Mostafa Mohaimen Akand |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VAGUEGAN: Stealthy Poisoning and Backdoor Attacks on Image Generative Pipelines
par: Faisal, Mostafa Mohaimen Akand, et autres
Publié: (2025)
par: Faisal, Mostafa Mohaimen Akand, et autres
Publié: (2025)
Comparative sentiment analysis of public perception: Monkeypox vs. COVID-19 behavioral insights
par: Faisal, Mostafa Mohaimen Akand, et autres
Publié: (2025)
par: Faisal, Mostafa Mohaimen Akand, et autres
Publié: (2025)
SecureLearn -- An Attack-agnostic Defense for Multiclass Machine Learning Against Data Poisoning Attacks
par: Paracha, Anum, et autres
Publié: (2025)
par: Paracha, Anum, et autres
Publié: (2025)
Can Federated Learning Safeguard Private Data in LLM Training? Vulnerabilities, Attacks, and Defense Evaluation
par: Guo, Wenkai, et autres
Publié: (2025)
par: Guo, Wenkai, et autres
Publié: (2025)
SCOUT: A Defense Against Data Poisoning Attacks in Fine-Tuned Language Models
par: Afane, Mohamed, et autres
Publié: (2025)
par: Afane, Mohamed, et autres
Publié: (2025)
Can In-Context Reinforcement Learning Recover From Reward Poisoning Attacks?
par: Sasnauskas, Paulius, et autres
Publié: (2025)
par: Sasnauskas, Paulius, et autres
Publié: (2025)
A Data-Driven Defense against Edge-case Model Poisoning Attacks on Federated Learning
par: Purohit, Kiran, et autres
Publié: (2023)
par: Purohit, Kiran, et autres
Publié: (2023)
Self-Evaluation as a Defense Against Adversarial Attacks on LLMs
par: Brown, Hannah, et autres
Publié: (2024)
par: Brown, Hannah, et autres
Publié: (2024)
Learning to Poison Large Language Models for Downstream Manipulation
par: Zhou, Xiangyu, et autres
Publié: (2024)
par: Zhou, Xiangyu, et autres
Publié: (2024)
AutoDefense: Multi-Agent LLM Defense against Jailbreak Attacks
par: Zeng, Yifan, et autres
Publié: (2024)
par: Zeng, Yifan, et autres
Publié: (2024)
SoK: Benchmarking Poisoning Attacks and Defenses in Federated Learning
par: Zhang, Heyi, et autres
Publié: (2025)
par: Zhang, Heyi, et autres
Publié: (2025)
Best-of-Venom: Attacking RLHF by Injecting Poisoned Preference Data
par: Baumgärtner, Tim, et autres
Publié: (2024)
par: Baumgärtner, Tim, et autres
Publié: (2024)
Scalable Defense against In-the-wild Jailbreaking Attacks with Safety Context Retrieval
par: Chen, Taiye, et autres
Publié: (2025)
par: Chen, Taiye, et autres
Publié: (2025)
Poison with Style: A Practical Poisoning Attack on Code Large Language Models
par: Tran, Khang, et autres
Publié: (2026)
par: Tran, Khang, et autres
Publié: (2026)
Stealthy Poisoning Attacks Bypass Defenses in Regression Settings
par: Carnerero-Cano, Javier, et autres
Publié: (2026)
par: Carnerero-Cano, Javier, et autres
Publié: (2026)
Data Reconstruction Attacks and Defenses: A Systematic Evaluation
par: Liu, Sheng, et autres
Publié: (2024)
par: Liu, Sheng, et autres
Publié: (2024)
Provable Watermarking for Data Poisoning Attacks
par: Zhu, Yifan, et autres
Publié: (2025)
par: Zhu, Yifan, et autres
Publié: (2025)
FedMID: A Data-Free Method for Using Intermediate Outputs as a Defense Mechanism Against Poisoning Attacks in Federated Learning
par: Han, Sungwon, et autres
Publié: (2024)
par: Han, Sungwon, et autres
Publié: (2024)
Sybil-based Virtual Data Poisoning Attacks in Federated Learning
par: Zhu, Changxun, et autres
Publié: (2025)
par: Zhu, Changxun, et autres
Publié: (2025)
Poisoning Attacks and Defenses to Federated Unlearning
par: Wang, Wenbin, et autres
Publié: (2025)
par: Wang, Wenbin, et autres
Publié: (2025)
Indiscriminate Data Poisoning Attacks on Neural Networks
par: Lu, Yiwei, et autres
Publié: (2022)
par: Lu, Yiwei, et autres
Publié: (2022)
Break the Breakout: Reinventing LM Defense Against Jailbreak Attacks with Self-Refinement
par: Kim, Heegyu, et autres
Publié: (2024)
par: Kim, Heegyu, et autres
Publié: (2024)
Enhancing Prompt Injection Attacks to LLMs via Poisoning Alignment
par: Shao, Zedian, et autres
Publié: (2024)
par: Shao, Zedian, et autres
Publié: (2024)
Semantic Chameleon: Corpus-Dependent Poisoning Attacks and Defenses in RAG Systems
par: Thornton, Scott
Publié: (2026)
par: Thornton, Scott
Publié: (2026)
GShield: Mitigating Poisoning Attacks in Federated Learning
par: M., Sameera K., et autres
Publié: (2025)
par: M., Sameera K., et autres
Publié: (2025)
Inverting Gradient Attacks Makes Powerful Data Poisoning
par: Bouaziz, Wassim, et autres
Publié: (2024)
par: Bouaziz, Wassim, et autres
Publié: (2024)
Devil's Hand: Data Poisoning Attacks to Locally Private Graph Learning Protocols
par: He, Longzhu, et autres
Publié: (2025)
par: He, Longzhu, et autres
Publié: (2025)
Formalizing and Benchmarking Prompt Injection Attacks and Defenses
par: Liu, Yupei, et autres
Publié: (2023)
par: Liu, Yupei, et autres
Publié: (2023)
Data Poisoning Attacks on Off-Policy Policy Evaluation Methods
par: Lobo, Elita, et autres
Publié: (2024)
par: Lobo, Elita, et autres
Publié: (2024)
RLShield: Practical Multi-Agent RL for Financial Cyber Defense with Attack-Surface MDPs and Real-Time Response Orchestration
par: Nayak, Srikumar
Publié: (2026)
par: Nayak, Srikumar
Publié: (2026)
Data-centric NLP Backdoor Defense from the Lens of Memorization
par: Wang, Zhenting, et autres
Publié: (2024)
par: Wang, Zhenting, et autres
Publié: (2024)
Indiscriminate Data Poisoning Attacks on Pre-trained Feature Extractors
par: Lu, Yiwei, et autres
Publié: (2024)
par: Lu, Yiwei, et autres
Publié: (2024)
Data Poisoning Attacks in Intelligent Transportation Systems: A Survey
par: Wang, Feilong, et autres
Publié: (2024)
par: Wang, Feilong, et autres
Publié: (2024)
Poisoning Attacks to Local Differential Privacy Protocols for Trajectory Data
par: Hsu, I-Jung, et autres
Publié: (2025)
par: Hsu, I-Jung, et autres
Publié: (2025)
Local Environment Poisoning Attacks on Federated Reinforcement Learning
par: Ma, Evelyn, et autres
Publié: (2023)
par: Ma, Evelyn, et autres
Publié: (2023)
Transferable Availability Poisoning Attacks
par: Liu, Yiyong, et autres
Publié: (2023)
par: Liu, Yiyong, et autres
Publié: (2023)
Synthetic Tabular Data: Methods, Attacks and Defenses
par: Cormode, Graham, et autres
Publié: (2025)
par: Cormode, Graham, et autres
Publié: (2025)
P2P: A Poison-to-Poison Remedy for Reliable Backdoor Defense in LLMs
par: Zhao, Shuai, et autres
Publié: (2025)
par: Zhao, Shuai, et autres
Publié: (2025)
Denial-of-Service Poisoning Attacks against Large Language Models
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
Practical Poisoning Attacks against Retrieval-Augmented Generation
par: Zhang, Baolei, et autres
Publié: (2025)
par: Zhang, Baolei, et autres
Publié: (2025)
Documents similaires
-
VAGUEGAN: Stealthy Poisoning and Backdoor Attacks on Image Generative Pipelines
par: Faisal, Mostafa Mohaimen Akand, et autres
Publié: (2025) -
Comparative sentiment analysis of public perception: Monkeypox vs. COVID-19 behavioral insights
par: Faisal, Mostafa Mohaimen Akand, et autres
Publié: (2025) -
SecureLearn -- An Attack-agnostic Defense for Multiclass Machine Learning Against Data Poisoning Attacks
par: Paracha, Anum, et autres
Publié: (2025) -
Can Federated Learning Safeguard Private Data in LLM Training? Vulnerabilities, Attacks, and Defense Evaluation
par: Guo, Wenkai, et autres
Publié: (2025) -
SCOUT: A Defense Against Data Poisoning Attacks in Fine-Tuned Language Models
par: Afane, Mohamed, et autres
Publié: (2025)