Token-wise Influential Training Data Retrieval for Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Lin, Huawei, Long, Jikai, Xu, Zhaozhuo, Zhao, Weijie |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
BadRAG: Identifying Vulnerabilities in Retrieval Augmented Generation of Large Language Models
by: Xue, Jiaqi, et al.
Published: (2024)
by: Xue, Jiaqi, et al.
Published: (2024)
Measuring Copyright Risks of Large Language Model via Partial Information Probing
by: Zhao, Weijie, et al.
Published: (2024)
by: Zhao, Weijie, et al.
Published: (2024)
SoK: Agentic Retrieval-Augmented Generation (RAG): Taxonomy, Architectures, Evaluation, and Research Directions
by: Mishra, Saroj, et al.
Published: (2026)
by: Mishra, Saroj, et al.
Published: (2026)
HijackRAG: Hijacking Attacks against Retrieval-Augmented Large Language Models
by: Zhang, Yucheng, et al.
Published: (2024)
by: Zhang, Yucheng, et al.
Published: (2024)
DiscourseFlip: An Oblique Discourse-Level Opinion Manipulation Attack against Black-box Retrieval-Augmented Generation
by: Gong, Yuyang, et al.
Published: (2026)
by: Gong, Yuyang, et al.
Published: (2026)
Improving User Privacy in Personalized Generation: Client-Side Retrieval-Augmented Modification of Server-Side Generated Speculations
by: Salemi, Alireza, et al.
Published: (2026)
by: Salemi, Alireza, et al.
Published: (2026)
Towards Copyright Protection for Knowledge Bases of Retrieval-augmented Language Models via Reasoning
by: Guo, Junfeng, et al.
Published: (2025)
by: Guo, Junfeng, et al.
Published: (2025)
SafeRAG: Benchmarking Security in Retrieval-Augmented Generation of Large Language Model
by: Liang, Xun, et al.
Published: (2025)
by: Liang, Xun, et al.
Published: (2025)
PII-Bench: Evaluating Query-Aware Privacy Protection Systems
by: Shen, Hao, et al.
Published: (2025)
by: Shen, Hao, et al.
Published: (2025)
One Single Hub Text Breaks CLIP: Identifying Vulnerabilities in Cross-Modal Encoders via Hubness
by: Deguchi, Hiroyuki, et al.
Published: (2026)
by: Deguchi, Hiroyuki, et al.
Published: (2026)
TITAN: Graph-Executable Reasoning for Cyber Threat Intelligence
by: Simoni, Marco, et al.
Published: (2025)
by: Simoni, Marco, et al.
Published: (2025)
Riddle Me This! Stealthy Membership Inference for Retrieval-Augmented Generation
by: Naseh, Ali, et al.
Published: (2025)
by: Naseh, Ali, et al.
Published: (2025)
Mask-based Membership Inference Attacks for Retrieval-Augmented Generation
by: Liu, Mingrui, et al.
Published: (2024)
by: Liu, Mingrui, et al.
Published: (2024)
Grounded Cache Routing for Retrieval-Augmented Generation: When Is It Safe to Reuse an Answer?
by: Shah, Syed Huma
Published: (2026)
by: Shah, Syed Huma
Published: (2026)
PIR-RAG: A System for Private Information Retrieval in Retrieval-Augmented Generation
by: Wang, Baiqiang, et al.
Published: (2025)
by: Wang, Baiqiang, et al.
Published: (2025)
Protecting Copyrighted Material with Unique Identifiers in Large Language Model Training
by: Zhao, Shuai, et al.
Published: (2024)
by: Zhao, Shuai, et al.
Published: (2024)
Synthetic Query Generation for Privacy-Preserving Deep Retrieval Systems using Differentially Private Language Models
by: Carranza, Aldo Gael, et al.
Published: (2023)
by: Carranza, Aldo Gael, et al.
Published: (2023)
TableGuard -- Securing Structured & Unstructured Data
by: Sharma, Anantha, et al.
Published: (2024)
by: Sharma, Anantha, et al.
Published: (2024)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
by: Xu, Shicheng, et al.
Published: (2024)
by: Xu, Shicheng, et al.
Published: (2024)
Towards Contextual Sensitive Data Detection
by: Telkamp, Liang, et al.
Published: (2025)
by: Telkamp, Liang, et al.
Published: (2025)
Retrieval-Augmented Review Generation for Poisoning Recommender Systems
by: Yang, Shiyi, et al.
Published: (2025)
by: Yang, Shiyi, et al.
Published: (2025)
EmojiPrompt: Generative Prompt Obfuscation for Privacy-Preserving Communication with Cloud-based LLMs
by: Lin, Sam, et al.
Published: (2024)
by: Lin, Sam, et al.
Published: (2024)
Exposing Privacy Risks in Graph Retrieval-Augmented Generation
by: Liu, Jiale, et al.
Published: (2025)
by: Liu, Jiale, et al.
Published: (2025)
Topic-FlipRAG: Topic-Orientated Adversarial Opinion Manipulation Attacks to Retrieval-Augmented Generation Models
by: Gong, Yuyang, et al.
Published: (2025)
by: Gong, Yuyang, et al.
Published: (2025)
MoRSE: Bridging the Gap in Cybersecurity Expertise with Retrieval Augmented Generation
by: Simoni, Marco, et al.
Published: (2024)
by: Simoni, Marco, et al.
Published: (2024)
A Theory for Token-Level Harmonization in Retrieval-Augmented Generation
by: Xu, Shicheng, et al.
Published: (2024)
by: Xu, Shicheng, et al.
Published: (2024)
User-Side Realization
by: Sato, Ryoma
Published: (2024)
by: Sato, Ryoma
Published: (2024)
SQuaD: The Software Quality Dataset
by: Robredo, Mikel, et al.
Published: (2025)
by: Robredo, Mikel, et al.
Published: (2025)
Membership Inference Attacks on LLM-based Recommender Systems
by: He, Jiajie, et al.
Published: (2025)
by: He, Jiajie, et al.
Published: (2025)
ChineseHarm-Bench: A Chinese Harmful Content Detection Benchmark
by: Liu, Kangwei, et al.
Published: (2025)
by: Liu, Kangwei, et al.
Published: (2025)
Nautilus Compass: Black-box Persona Drift Detection for Production LLM Agents
by: Wang, Chunxiao
Published: (2026)
by: Wang, Chunxiao
Published: (2026)
A Decentralized Retrieval Augmented Generation System with Source Reliabilities Secured on Blockchain
by: Lu, Yining, et al.
Published: (2025)
by: Lu, Yining, et al.
Published: (2025)
VisualLeakBench: Auditing the Fragility of Large Vision-Language Models against PII Leakage and Social Engineering
by: Wang, Youting, et al.
Published: (2026)
by: Wang, Youting, et al.
Published: (2026)
MAWSEO: Adversarial Wiki Search Poisoning for Illicit Online Promotion
by: Lin, Zilong, et al.
Published: (2023)
by: Lin, Zilong, et al.
Published: (2023)
A Scenario-Oriented Survey of Federated Recommender Systems: Techniques, Challenges, and Future Directions
by: Mi, Yunqi, et al.
Published: (2025)
by: Mi, Yunqi, et al.
Published: (2025)
CyberCane: Neuro-Symbolic RAG for Privacy-Preserving Phishing Detection with Formal Ontology Reasoning
by: Hakim, Safayat Bin, et al.
Published: (2026)
by: Hakim, Safayat Bin, et al.
Published: (2026)
Cryptanalysis and improvement of multimodal data encryption by machine-learning-based system
by: Tolba, Zakaria
Published: (2024)
by: Tolba, Zakaria
Published: (2024)
Securing RAG: A Risk Assessment and Mitigation Framework
by: Ammann, Lukas, et al.
Published: (2025)
by: Ammann, Lukas, et al.
Published: (2025)
Influence of Parallelism in Vector-Multiplication Units on Correlation Power Analysis
by: Brosch, Manuel, et al.
Published: (2026)
by: Brosch, Manuel, et al.
Published: (2026)
Artificial Intelligence enhanced Security Problems in Real-Time Scenario using Blowfish Algorithm
by: Chinnam, Yuvaraju, et al.
Published: (2024)
by: Chinnam, Yuvaraju, et al.
Published: (2024)
Similar Items
-
BadRAG: Identifying Vulnerabilities in Retrieval Augmented Generation of Large Language Models
by: Xue, Jiaqi, et al.
Published: (2024) -
Measuring Copyright Risks of Large Language Model via Partial Information Probing
by: Zhao, Weijie, et al.
Published: (2024) -
SoK: Agentic Retrieval-Augmented Generation (RAG): Taxonomy, Architectures, Evaluation, and Research Directions
by: Mishra, Saroj, et al.
Published: (2026) -
HijackRAG: Hijacking Attacks against Retrieval-Augmented Large Language Models
by: Zhang, Yucheng, et al.
Published: (2024) -
DiscourseFlip: An Oblique Discourse-Level Opinion Manipulation Attack against Black-box Retrieval-Augmented Generation
by: Gong, Yuyang, et al.
Published: (2026)