TracLLM: A Generic Framework for Attributing Long Context LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yanting, Zou, Wei, Geng, Runpeng, Jia, Jinyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PISanitizer: Preventing Prompt Injection to Long-Context LLMs via Prompt Sanitization
par: Geng, Runpeng, et autres
Publié: (2025)
par: Geng, Runpeng, et autres
Publié: (2025)
PIArena: A Platform for Prompt Injection Evaluation
par: Geng, Runpeng, et autres
Publié: (2026)
par: Geng, Runpeng, et autres
Publié: (2026)
PISmith: Reinforcement Learning-based Red Teaming for Prompt Injection Defenses
par: Yin, Chenlong, et autres
Publié: (2026)
par: Yin, Chenlong, et autres
Publié: (2026)
PoisonedRAG: Knowledge Corruption Attacks to Retrieval-Augmented Generation of Large Language Models
par: Zou, Wei, et autres
Publié: (2024)
par: Zou, Wei, et autres
Publié: (2024)
Formalizing and Benchmarking Prompt Injection Attacks and Defenses
par: Liu, Yupei, et autres
Publié: (2023)
par: Liu, Yupei, et autres
Publié: (2023)
AgentWatcher: A Rule-based Prompt Injection Monitor
par: Wang, Yanting, et autres
Publié: (2026)
par: Wang, Yanting, et autres
Publié: (2026)
AttnTrace: Contextual Attribution of Prompt Injection and Knowledge Corruption
par: Wang, Yanting, et autres
Publié: (2025)
par: Wang, Yanting, et autres
Publié: (2025)
TrojFM: Resource-efficient Backdoor Attacks against Very Large Foundation Models
par: Nie, Yuzhou., et autres
Publié: (2024)
par: Nie, Yuzhou., et autres
Publié: (2024)
TASO: Jailbreak LLMs via Alternative Template and Suffix Optimization
par: Wang, Yanting, et autres
Publié: (2025)
par: Wang, Yanting, et autres
Publié: (2025)
PIShield: Detecting Prompt Injection Attacks via Intrinsic LLM Features
par: Zou, Wei, et autres
Publié: (2025)
par: Zou, Wei, et autres
Publié: (2025)
TrojanDec: Data-free Detection of Trojan Inputs in Self-supervised Learning
par: Liu, Yupei, et autres
Publié: (2025)
par: Liu, Yupei, et autres
Publié: (2025)
Sovereign Context Protocol: An Open Attribution Layer for Human-Generated Content in the Age of Large Language Models
par: Panchigar, Praneel, et autres
Publié: (2026)
par: Panchigar, Praneel, et autres
Publié: (2026)
ACE: A Model Poisoning Attack on Contribution Evaluation Methods in Federated Learning
par: Xu, Zhangchen, et autres
Publié: (2024)
par: Xu, Zhangchen, et autres
Publié: (2024)
UniC-RAG: Universal Knowledge Corruption Attacks to Retrieval-Augmented Generation
par: Geng, Runpeng, et autres
Publié: (2025)
par: Geng, Runpeng, et autres
Publié: (2025)
Fast Exact Unlearning for In-Context Learning Data for LLMs
par: Muresanu, Andrei I., et autres
Publié: (2024)
par: Muresanu, Andrei I., et autres
Publié: (2024)
The Erasure Illusion: Stress-Testing the Generalization of LLM Forgetting Evaluation
par: Jia, Hengrui, et autres
Publié: (2025)
par: Jia, Hengrui, et autres
Publié: (2025)
LAMD: Context-driven Android Malware Detection and Classification with LLMs
par: Qian, Xingzhi, et autres
Publié: (2025)
par: Qian, Xingzhi, et autres
Publié: (2025)
A Unified Framework for LLM Watermarks
par: Gloaguen, Thibaud, et autres
Publié: (2026)
par: Gloaguen, Thibaud, et autres
Publié: (2026)
EnsembleSHAP: Faithful and Certifiably Robust Attribution for Random Subspace Method
par: Wang, Yanting, et autres
Publié: (2026)
par: Wang, Yanting, et autres
Publié: (2026)
SecInfer: Preventing Prompt Injection via Inference-time Scaling
par: Liu, Yupei, et autres
Publié: (2025)
par: Liu, Yupei, et autres
Publié: (2025)
SPRINT: Robust Model Attribution of Generated Images via Secret Pixel Reconstruction
par: Yao, Kai, et autres
Publié: (2025)
par: Yao, Kai, et autres
Publié: (2025)
MCP Safety Audit: LLMs with the Model Context Protocol Allow Major Security Exploits
par: Radosevich, Brandon, et autres
Publié: (2025)
par: Radosevich, Brandon, et autres
Publié: (2025)
Fuzz-Testing Meets LLM-Based Agents: An Automated and Efficient Framework for Jailbreaking Text-To-Image Generation Models
par: Dong, Yingkai, et autres
Publié: (2024)
par: Dong, Yingkai, et autres
Publié: (2024)
Honeyval: A Comprehensive Evaluation Framework for LLM-powered HTTP Honeypots
par: Vero, Mark, et autres
Publié: (2026)
par: Vero, Mark, et autres
Publié: (2026)
CTIGuardian: A Few-Shot Framework for Mitigating Privacy Leakage in Fine-Tuned LLMs
par: Arachchige, Shashie Dilhara Batan, et autres
Publié: (2025)
par: Arachchige, Shashie Dilhara Batan, et autres
Publié: (2025)
InfiCoEvalChain: A Blockchain-Based Decentralized Framework for Collaborative LLM Evaluation
par: Yang, Yifan, et autres
Publié: (2026)
par: Yang, Yifan, et autres
Publié: (2026)
ST-DPGAN: A Privacy-preserving Framework for Spatiotemporal Data Generation
par: Shao, Wei, et autres
Publié: (2024)
par: Shao, Wei, et autres
Publié: (2024)
Attribute Inference Attacks for Federated Regression Tasks
par: Diana, Francesco, et autres
Publié: (2024)
par: Diana, Francesco, et autres
Publié: (2024)
Federated In-Context LLM Agent Learning
par: Wu, Panlong, et autres
Publié: (2024)
par: Wu, Panlong, et autres
Publié: (2024)
A Multi-Dimensional Quality Scoring Framework for Decentralized LLM Inference with Proof of Quality
par: Tian, Arther, et autres
Publié: (2026)
par: Tian, Arther, et autres
Publié: (2026)
Differentially Private Synthetic Data Generation Using Context-Aware GANs
par: Kotal, Anantaa, et autres
Publié: (2025)
par: Kotal, Anantaa, et autres
Publié: (2025)
A Backdoor-based Explainable AI Benchmark for High Fidelity Evaluation of Attributions
par: Yang, Peiyu, et autres
Publié: (2024)
par: Yang, Peiyu, et autres
Publié: (2024)
Enhancing Reliability in LLM-Based Secure Code Generation
par: Kharma, Mohammed F., et autres
Publié: (2026)
par: Kharma, Mohammed F., et autres
Publié: (2026)
UDora: A Unified Red Teaming Framework against LLM Agents by Dynamically Hijacking Their Own Reasoning
par: Zhang, Jiawei, et autres
Publié: (2025)
par: Zhang, Jiawei, et autres
Publié: (2025)
Purifying Generative LLMs from Backdoors without Prior Knowledge or Clean Reference
par: Li, Jianwei, et autres
Publié: (2026)
par: Li, Jianwei, et autres
Publié: (2026)
Odysseus: Jailbreaking Commercial Multimodal LLM-integrated Systems via Dual Steganography
par: Li, Songze, et autres
Publié: (2025)
par: Li, Songze, et autres
Publié: (2025)
Advanced Persistent Threats (APT) Attribution Using Deep Reinforcement Learning
par: Basnet, Animesh Singh, et autres
Publié: (2024)
par: Basnet, Animesh Singh, et autres
Publié: (2024)
FCert: Certifiably Robust Few-Shot Classification in the Era of Foundation Models
par: Wang, Yanting, et autres
Publié: (2024)
par: Wang, Yanting, et autres
Publié: (2024)
An Empirical Evaluation of LLM-Generated Code Security Across Prompting Methods
par: Kharma, Mohammed, et autres
Publié: (2026)
par: Kharma, Mohammed, et autres
Publié: (2026)
DPrivBench: Benchmarking LLMs' Reasoning for Differential Privacy
par: Wang, Erchi, et autres
Publié: (2026)
par: Wang, Erchi, et autres
Publié: (2026)
Documents similaires
-
PISanitizer: Preventing Prompt Injection to Long-Context LLMs via Prompt Sanitization
par: Geng, Runpeng, et autres
Publié: (2025) -
PIArena: A Platform for Prompt Injection Evaluation
par: Geng, Runpeng, et autres
Publié: (2026) -
PISmith: Reinforcement Learning-based Red Teaming for Prompt Injection Defenses
par: Yin, Chenlong, et autres
Publié: (2026) -
PoisonedRAG: Knowledge Corruption Attacks to Retrieval-Augmented Generation of Large Language Models
par: Zou, Wei, et autres
Publié: (2024) -
Formalizing and Benchmarking Prompt Injection Attacks and Defenses
par: Liu, Yupei, et autres
Publié: (2023)