RAGShield: Detecting Numerical Claim Manipulation in Government RAG Systems
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Patil, KrishnaSaiReddy |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CivicShield: A Cross-Domain Defense-in-Depth Framework for Securing Government-Facing AI Chatbots Against Multi-Turn Adversarial Attacks
par: Patil, KrishnaSaiReddy
Publié: (2026)
par: Patil, KrishnaSaiReddy
Publié: (2026)
SentinelAgent: Intent-Verified Delegation Chains for Securing Federal Multi-Agent AI Systems
par: Patil, KrishnaSaiReddy
Publié: (2026)
par: Patil, KrishnaSaiReddy
Publié: (2026)
An Attack Method for Medical Insurance Claim Fraud Detection based on Generative Adversarial Network
par: Pang, Yining, et autres
Publié: (2025)
par: Pang, Yining, et autres
Publié: (2025)
AI-Driven Cybersecurity Threats: A Survey of Emerging Risks and Defensive Strategies
par: Erukude, Sai Teja, et autres
Publié: (2026)
par: Erukude, Sai Teja, et autres
Publié: (2026)
The Aegis Protocol: A Foundational Security Framework for Autonomous AI Agents
par: Adapala, Sai Teja Reddy, et autres
Publié: (2025)
par: Adapala, Sai Teja Reddy, et autres
Publié: (2025)
Adversarial Hubness Detector: Detecting Hubness Poisoning in Retrieval-Augmented Generation Systems
par: Habler, Idan, et autres
Publié: (2026)
par: Habler, Idan, et autres
Publié: (2026)
False Claims against Model Ownership Resolution
par: Liu, Jian, et autres
Publié: (2023)
par: Liu, Jian, et autres
Publié: (2023)
Advanced Real-Time Fraud Detection Using RAG-Based LLMs
par: Singh, Gurjot, et autres
Publié: (2025)
par: Singh, Gurjot, et autres
Publié: (2025)
Modeling the Attack: Detecting AI-Generated Text by Quantifying Adversarial Perturbations
par: Teja, Lekkala Sai, et autres
Publié: (2025)
par: Teja, Lekkala Sai, et autres
Publié: (2025)
DECEIVE-AFC: Adversarial Claim Attacks against Search-Enabled LLM-based Fact-Checking Systems
par: Ou, Haoran, et autres
Publié: (2026)
par: Ou, Haoran, et autres
Publié: (2026)
RAG-targeted Adversarial Attack on LLM-based Threat Detection and Mitigation Framework
par: Ikbarieh, Seif, et autres
Publié: (2025)
par: Ikbarieh, Seif, et autres
Publié: (2025)
Benchmarking Large Language Models for Zero-shot and Few-shot Phishing URL Detection
par: Hasan, Najmul, et autres
Publié: (2026)
par: Hasan, Najmul, et autres
Publié: (2026)
ReliabilityRAG: Effective and Provably Robust Defense for RAG-based Web-Search
par: Shen, Zeyu, et autres
Publié: (2025)
par: Shen, Zeyu, et autres
Publié: (2025)
MCP Guardian: A Security-First Layer for Safeguarding MCP-Based AI System
par: Kumar, Sonu, et autres
Publié: (2025)
par: Kumar, Sonu, et autres
Publié: (2025)
MA-IDS: Multi-Agent RAG Framework for IoT Network Intrusion Detection with an Experience Library
par: Islam, Md Shamimul, et autres
Publié: (2026)
par: Islam, Md Shamimul, et autres
Publié: (2026)
LogSHIELD: A Graph-based Real-time Anomaly Detection Framework using Frequency Analysis
par: Roy, Krishna Chandra, et autres
Publié: (2024)
par: Roy, Krishna Chandra, et autres
Publié: (2024)
Detecting Various DeFi Price Manipulations with LLM Reasoning
par: Zhong, Juantao, et autres
Publié: (2025)
par: Zhong, Juantao, et autres
Publié: (2025)
EchoLeak: The First Real-World Zero-Click Prompt Injection Exploit in a Production LLM System
par: Reddy, Pavan, et autres
Publié: (2025)
par: Reddy, Pavan, et autres
Publié: (2025)
Silent Leaks: Implicit Knowledge Extraction Attack on RAG Systems through Benign Queries
par: Wang, Yuhao, et autres
Publié: (2025)
par: Wang, Yuhao, et autres
Publié: (2025)
E-MIA: Exam-Style Black-Box Membership Inference Attacks against RAG Systems
par: Guan, Zelin, et autres
Publié: (2026)
par: Guan, Zelin, et autres
Publié: (2026)
Enhancing SQL Injection Detection and Prevention Using Generative Models
par: Dasari, Naga Sai, et autres
Publié: (2025)
par: Dasari, Naga Sai, et autres
Publié: (2025)
P$^2$RAG: Efficient Privacy-Preserving RAG Service Supporting Arbitrary Top-$k$ Retrieval
par: Ming, Yulong, et autres
Publié: (2026)
par: Ming, Yulong, et autres
Publié: (2026)
SynRAG: A Large Language Model Framework for Executable Query Generation in Heterogeneous SIEM System
par: Saju, Md Hasan, et autres
Publié: (2025)
par: Saju, Md Hasan, et autres
Publié: (2025)
Benchmarking Security Risk Detection and Verification in Open Agentic Skill Ecosystems
par: Hossain, Ismail, et autres
Publié: (2026)
par: Hossain, Ismail, et autres
Publié: (2026)
AAGATE: A NIST AI RMF-Aligned Governance Platform for Agentic AI
par: Huang, Ken, et autres
Publié: (2025)
par: Huang, Ken, et autres
Publié: (2025)
Securing GenAI Multi-Agent Systems Against Tool Squatting: A Zero Trust Registry-Based Approach
par: Narajala, Vineeth Sai, et autres
Publié: (2025)
par: Narajala, Vineeth Sai, et autres
Publié: (2025)
Context Lineage Assurance for Non-Human Identities in Critical Multi-Agent Systems
par: Malkapuram, Sumana, et autres
Publié: (2025)
par: Malkapuram, Sumana, et autres
Publié: (2025)
SecureRAG-RTL: A Retrieval-Augmented, Multi-Agent, Zero-Shot LLM-Driven Framework for Hardware Vulnerability Detection
par: Hasan, Touseef, et autres
Publié: (2026)
par: Hasan, Touseef, et autres
Publié: (2026)
Do Multimodal RAG Systems Leak Data? A Comprehensive Evaluation of Membership Inference and Image Caption Retrieval Attacks
par: Al-Lawati, Ali, et autres
Publié: (2026)
par: Al-Lawati, Ali, et autres
Publié: (2026)
Privacy-Aware RAG: Secure and Isolated Knowledge Retrieval
par: Zhou, Pengcheng, et autres
Publié: (2025)
par: Zhou, Pengcheng, et autres
Publié: (2025)
Safeguarding Multimodal Knowledge Copyright in the RAG-as-a-Service Environment
par: Chen, Tianyu, et autres
Publié: (2025)
par: Chen, Tianyu, et autres
Publié: (2025)
ConfusedPilot: Confused Deputy Risks in RAG-based LLMs
par: RoyChowdhury, Ayush, et autres
Publié: (2024)
par: RoyChowdhury, Ayush, et autres
Publié: (2024)
ARCeR: an Agentic RAG for the Automated Definition of Cyber Ranges
par: Lupinacci, Matteo, et autres
Publié: (2025)
par: Lupinacci, Matteo, et autres
Publié: (2025)
The Hidden Threat in Plain Text: Attacking RAG Data Loaders
par: Castagnaro, Alberto, et autres
Publié: (2025)
par: Castagnaro, Alberto, et autres
Publié: (2025)
RAG Security and Privacy: Formalizing the Threat Model and Attack Surface
par: Arzanipour, Atousa, et autres
Publié: (2025)
par: Arzanipour, Atousa, et autres
Publié: (2025)
Privacy-Preserving AI-Enabled Decentralized Learning and Employment Records System
par: Xu, Yuqiao, et autres
Publié: (2026)
par: Xu, Yuqiao, et autres
Publié: (2026)
Breaking Minds, Breaking Systems: Jailbreaking Large Language Models via Human-like Psychological Manipulation
par: Liu, Zehao, et autres
Publié: (2025)
par: Liu, Zehao, et autres
Publié: (2025)
Through the Stealth Lens: Attention-Aware Defenses Against Poisoning in RAG
par: Choudhary, Sarthak, et autres
Publié: (2025)
par: Choudhary, Sarthak, et autres
Publié: (2025)
AiRacleX: Automated Detection of Price Oracle Manipulations via LLM-Driven Knowledge Mining and Prompt Generation
par: Gao, Bo, et autres
Publié: (2025)
par: Gao, Bo, et autres
Publié: (2025)
LeakDojo: Decoding the Leakage Threats of RAG Systems
par: Zhang, Maosen, et autres
Publié: (2026)
par: Zhang, Maosen, et autres
Publié: (2026)
Documents similaires
-
CivicShield: A Cross-Domain Defense-in-Depth Framework for Securing Government-Facing AI Chatbots Against Multi-Turn Adversarial Attacks
par: Patil, KrishnaSaiReddy
Publié: (2026) -
SentinelAgent: Intent-Verified Delegation Chains for Securing Federal Multi-Agent AI Systems
par: Patil, KrishnaSaiReddy
Publié: (2026) -
An Attack Method for Medical Insurance Claim Fraud Detection based on Generative Adversarial Network
par: Pang, Yining, et autres
Publié: (2025) -
AI-Driven Cybersecurity Threats: A Survey of Emerging Risks and Defensive Strategies
par: Erukude, Sai Teja, et autres
Publié: (2026) -
The Aegis Protocol: A Foundational Security Framework for Autonomous AI Agents
par: Adapala, Sai Teja Reddy, et autres
Publié: (2025)