The Hidden Threat in Plain Text: Attacking RAG Data Loaders
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Castagnaro, Alberto, Salviati, Umberto, Conti, Mauro, Pajola, Luca, Pizzi, Simeone |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Offensive AI: Enhancing Directory Brute-forcing Attack with the Use of Language Models
par: Castagnaro, Alberto, et autres
Publié: (2024)
par: Castagnaro, Alberto, et autres
Publié: (2024)
E-PhishGen: Unlocking Novel Research in Phishing Email Detection
par: Pajola, Luca, et autres
Publié: (2025)
par: Pajola, Luca, et autres
Publié: (2025)
Exploiting AI for Attacks: On the Interplay between Adversarial AI and Offensive AI
par: Schröer, Saskia Laura, et autres
Publié: (2025)
par: Schröer, Saskia Laura, et autres
Publié: (2025)
From Beats to Breaches:How Offensive AI Infers Sensitive User Information from Playlists
par: Cecconello, Stefano, et autres
Publié: (2026)
par: Cecconello, Stefano, et autres
Publié: (2026)
Misleading Large Language Models used (or misused) in Scientific Peer-Reviewing via Hidden Prompt-Injection Attacks
par: Collu, Matteo Gioele, et autres
Publié: (2025)
par: Collu, Matteo Gioele, et autres
Publié: (2025)
RAG Security and Privacy: Formalizing the Threat Model and Attack Surface
par: Arzanipour, Atousa, et autres
Publié: (2025)
par: Arzanipour, Atousa, et autres
Publié: (2025)
Subject Data Auditing via Source Inference Attack in Cross-Silo Federated Learning
par: Li, Jiaxin, et autres
Publié: (2024)
par: Li, Jiaxin, et autres
Publié: (2024)
RAG-targeted Adversarial Attack on LLM-based Threat Detection and Mitigation Framework
par: Ikbarieh, Seif, et autres
Publié: (2025)
par: Ikbarieh, Seif, et autres
Publié: (2025)
DUMB and DUMBer: Is Adversarial Training Worth It in the Real World?
par: Marchiori, Francesco, et autres
Publié: (2025)
par: Marchiori, Francesco, et autres
Publié: (2025)
WeiDetect: Weibull Distribution-Based Defense against Poisoning Attacks in Federated Learning for Network Intrusion Detection Systems
par: M., Sameera K., et autres
Publié: (2025)
par: M., Sameera K., et autres
Publié: (2025)
Threats, Attacks, and Defenses in Machine Unlearning: A Survey
par: Liu, Ziyao, et autres
Publié: (2024)
par: Liu, Ziyao, et autres
Publié: (2024)
ATAG: AI-Agent Application Threat Assessment with Attack Graphs
par: Gandhi, Parth Atulbhai, et autres
Publié: (2025)
par: Gandhi, Parth Atulbhai, et autres
Publié: (2025)
Beyond RAG for Cyber Threat Intelligence: A Systematic Evaluation of Graph-Based and Agentic Retrieval
par: Hamzic, Dzenan, et autres
Publié: (2026)
par: Hamzic, Dzenan, et autres
Publié: (2026)
Energy-Latency Attacks: A New Adversarial Threat to Deep Learning
par: Meftah, Hanene F. Z. Brachemi, et autres
Publié: (2025)
par: Meftah, Hanene F. Z. Brachemi, et autres
Publié: (2025)
Membership Privacy Evaluation in Deep Spiking Neural Networks
par: Li, Jiaxin, et autres
Publié: (2024)
par: Li, Jiaxin, et autres
Publié: (2024)
LeakDojo: Decoding the Leakage Threats of RAG Systems
par: Zhang, Maosen, et autres
Publié: (2026)
par: Zhang, Maosen, et autres
Publié: (2026)
Unleashing Worms and Extracting Data: Escalating the Outcome of Attacks against RAG-based Inference in Scale and Severity Using Jailbreaking
par: Cohen, Stav, et autres
Publié: (2024)
par: Cohen, Stav, et autres
Publié: (2024)
Do Multimodal RAG Systems Leak Data? A Comprehensive Evaluation of Membership Inference and Image Caption Retrieval Attacks
par: Al-Lawati, Ali, et autres
Publié: (2026)
par: Al-Lawati, Ali, et autres
Publié: (2026)
Hidden in the Metadata: Stealth Poisoning Attacks on Multimodal Retrieval-Augmented Generation
par: Edemacu, Kennedy, et autres
Publié: (2026)
par: Edemacu, Kennedy, et autres
Publié: (2026)
FragBench: Cross-Session Attacks Hidden in Benign-Looking Fragments
par: Mehta, Astha, et autres
Publié: (2026)
par: Mehta, Astha, et autres
Publié: (2026)
A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations
par: Zhou, Yihe, et autres
Publié: (2025)
par: Zhou, Yihe, et autres
Publié: (2025)
PR-Attack: Coordinated Prompt-RAG Attacks on Retrieval-Augmented Generation in Large Language Models via Bilevel Optimization
par: Jiao, Yang, et autres
Publié: (2025)
par: Jiao, Yang, et autres
Publié: (2025)
Bleeding Pathways: Vanishing Discriminability in LLM Hidden States Fuels Jailbreak Attacks
par: Zhang, Yingjie, et autres
Publié: (2025)
par: Zhang, Yingjie, et autres
Publié: (2025)
Cascade: Composing Software-Hardware Attack Gadgets for Adversarial Threat Amplification in Compound AI Systems
par: Banerjee, Sarbartha, et autres
Publié: (2026)
par: Banerjee, Sarbartha, et autres
Publié: (2026)
Silent Leaks: Implicit Knowledge Extraction Attack on RAG Systems through Benign Queries
par: Wang, Yuhao, et autres
Publié: (2025)
par: Wang, Yuhao, et autres
Publié: (2025)
Refusal Before Decoding: Detecting and Exploiting Refusal Signals in Intermediate LLM Activations
par: Collu, Matteo Gioele, et autres
Publié: (2026)
par: Collu, Matteo Gioele, et autres
Publié: (2026)
Moshi Moshi? A Model Selection Hijacking Adversarial Attack
par: Petrucci, Riccardo, et autres
Publié: (2025)
par: Petrucci, Riccardo, et autres
Publié: (2025)
Federated Learning Under Attack: Exposing Vulnerabilities through Data Poisoning Attacks in Computer Networks
par: Nowroozi, Ehsan, et autres
Publié: (2024)
par: Nowroozi, Ehsan, et autres
Publié: (2024)
E-MIA: Exam-Style Black-Box Membership Inference Attacks against RAG Systems
par: Guan, Zelin, et autres
Publié: (2026)
par: Guan, Zelin, et autres
Publié: (2026)
Technical Report: Exploring the Emerging Threats of the Agent Skill Ecosystem
par: Beurer-Kellner, Luca, et autres
Publié: (2026)
par: Beurer-Kellner, Luca, et autres
Publié: (2026)
Dealing Doubt: Unveiling Threat Models in Gradient Inversion Attacks under Federated Learning, A Survey and Taxonomy
par: Shi, Yichuan, et autres
Publié: (2024)
par: Shi, Yichuan, et autres
Publié: (2024)
"All of Me": Mining Users' Attributes from their Public Spotify Playlists
par: Tricomi, Pier Paolo, et autres
Publié: (2024)
par: Tricomi, Pier Paolo, et autres
Publié: (2024)
Towards Robust Stability Prediction in Smart Grids: GAN-based Approach under Data Constraints and Adversarial Challenges
par: Efatinasab, Emad, et autres
Publié: (2025)
par: Efatinasab, Emad, et autres
Publié: (2025)
Injecting Bias into Text Classification Models using Backdoor Attacks
par: Yavuz, A. Dilara, et autres
Publié: (2024)
par: Yavuz, A. Dilara, et autres
Publié: (2024)
TH-Bench: Evaluating Evading Attacks via Humanizing AI Text on Machine-Generated Text Detectors
par: Zheng, Jingyi, et autres
Publié: (2025)
par: Zheng, Jingyi, et autres
Publié: (2025)
Data Poisoning Vulnerabilities Across Healthcare AI Architectures: A Security Threat Analysis
par: Abtahi, Farhad, et autres
Publié: (2025)
par: Abtahi, Farhad, et autres
Publié: (2025)
Nightshade: Prompt-Specific Poisoning Attacks on Text-to-Image Generative Models
par: Shan, Shawn, et autres
Publié: (2023)
par: Shan, Shawn, et autres
Publié: (2023)
Semantic-level Backdoor Attack against Text-to-Image Diffusion Models
par: Chen, Tianxin, et autres
Publié: (2026)
par: Chen, Tianxin, et autres
Publié: (2026)
ThreatGPT: An Agentic AI Framework for Enhancing Public Safety through Threat Modeling
par: Zisad, Sharif Noor, et autres
Publié: (2025)
par: Zisad, Sharif Noor, et autres
Publié: (2025)
Mobile Application Threats and Security
par: Mirzoev, Timur, et autres
Publié: (2025)
par: Mirzoev, Timur, et autres
Publié: (2025)
Documents similaires
-
Offensive AI: Enhancing Directory Brute-forcing Attack with the Use of Language Models
par: Castagnaro, Alberto, et autres
Publié: (2024) -
E-PhishGen: Unlocking Novel Research in Phishing Email Detection
par: Pajola, Luca, et autres
Publié: (2025) -
Exploiting AI for Attacks: On the Interplay between Adversarial AI and Offensive AI
par: Schröer, Saskia Laura, et autres
Publié: (2025) -
From Beats to Breaches:How Offensive AI Infers Sensitive User Information from Playlists
par: Cecconello, Stefano, et autres
Publié: (2026) -
Misleading Large Language Models used (or misused) in Scientific Peer-Reviewing via Hidden Prompt-Injection Attacks
par: Collu, Matteo Gioele, et autres
Publié: (2025)