CAMP: Cumulative Agentic Masking and Pruning for Privacy Protection in Multi-Turn LLM Conversations
Fuente:
arXiv
Salvato in:
| Autore principale: | Panjwani, Aman |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Harmful Terms and Where to Find Them: Measuring and Modeling Unfavorable Financial Terms and Conditions in Shopping Websites at Scale
di: Tsai, Elisa, et al.
Pubblicazione: (2025)
di: Tsai, Elisa, et al.
Pubblicazione: (2025)
AlignDP: Hybrid Differential Privacy with Rarity-Aware Protection for LLMs
di: Gaikwad, Madhava
Pubblicazione: (2025)
di: Gaikwad, Madhava
Pubblicazione: (2025)
CEKER: A Generalizable LLM Framework for Literature Analysis with a Case Study in Unikernel Security
di: Wollman, Alex, et al.
Pubblicazione: (2024)
di: Wollman, Alex, et al.
Pubblicazione: (2024)
Hiding in Plain Sight: Query Obfuscation via Random Multilingual Searches
di: Firc, Anton, et al.
Pubblicazione: (2025)
di: Firc, Anton, et al.
Pubblicazione: (2025)
Who Shares What? An Empirical Analysis of Security Conference Content Across Academia and Industry
di: Walter, Lukas, et al.
Pubblicazione: (2024)
di: Walter, Lukas, et al.
Pubblicazione: (2024)
Context-aware Privacy Bounds for Linear Queries
di: Zhao, Heng, et al.
Pubblicazione: (2026)
di: Zhao, Heng, et al.
Pubblicazione: (2026)
Toward Secure and Compliant AI: Organizational Standards and Protocols for NLP Model Lifecycle Management
di: Arora, Sunil, et al.
Pubblicazione: (2025)
di: Arora, Sunil, et al.
Pubblicazione: (2025)
Adaptive Defense Orchestration for RAG: A Sentinel-Strategist Architecture against Multi-Vector Attacks
di: Pallerla, Pranav, et al.
Pubblicazione: (2026)
di: Pallerla, Pranav, et al.
Pubblicazione: (2026)
CRED-1: An Open Multi-Signal Domain Credibility Dataset for Automated Pre-Bunking of Online Misinformation
di: Loth, Alexander, et al.
Pubblicazione: (2026)
di: Loth, Alexander, et al.
Pubblicazione: (2026)
JPS: Jailbreak Multimodal Large Language Models with Collaborative Visual Perturbation and Textual Steering
di: Chen, Renmiao, et al.
Pubblicazione: (2025)
di: Chen, Renmiao, et al.
Pubblicazione: (2025)
Whisper Leak: a side-channel attack on Large Language Models
di: McDonald, Geoff, et al.
Pubblicazione: (2025)
di: McDonald, Geoff, et al.
Pubblicazione: (2025)
Terminal Wrench: A Dataset of 331 Reward-Hackable Environments and 3,632 Exploit Trajectories
di: Bercovich, Ivan, et al.
Pubblicazione: (2026)
di: Bercovich, Ivan, et al.
Pubblicazione: (2026)
An Ethically Grounded LLM-Based Approach to Insider Threat Synthesis and Detection
di: Gelman, Haywood, et al.
Pubblicazione: (2025)
di: Gelman, Haywood, et al.
Pubblicazione: (2025)
Industrialized Deception: The Collateral Effects of LLM-Generated Misinformation on Digital Ecosystems
di: Loth, Alexander, et al.
Pubblicazione: (2026)
di: Loth, Alexander, et al.
Pubblicazione: (2026)
Tatemae: Detecting Alignment Faking via Tool Selection in LLMs
di: Leonesi, Matteo, et al.
Pubblicazione: (2026)
di: Leonesi, Matteo, et al.
Pubblicazione: (2026)
Safeguarding Virtual Healthcare: A Novel Attacker-Centric Model for Data Security and Privacy
di: Herath, Suvineetha, et al.
Pubblicazione: (2024)
di: Herath, Suvineetha, et al.
Pubblicazione: (2024)
Powerful Training-Free Membership Inference Against Autoregressive Language Models
di: Ilić, David, et al.
Pubblicazione: (2026)
di: Ilić, David, et al.
Pubblicazione: (2026)
Big Help or Big Brother? Auditing Tracking, Profiling, and Personalization in Generative AI Assistants
di: Vekaria, Yash, et al.
Pubblicazione: (2025)
di: Vekaria, Yash, et al.
Pubblicazione: (2025)
KidsNanny: A Two-Stage Multimodal Content Moderation Pipeline Integrating Visual Classification, Object Detection, OCR, and Contextual Reasoning for Child Safety
di: Panchal, Viraj, et al.
Pubblicazione: (2026)
di: Panchal, Viraj, et al.
Pubblicazione: (2026)
Scalable and Ethical Insider Threat Detection through Data Synthesis and Analysis by LLMs
di: Gelman, Haywood, et al.
Pubblicazione: (2025)
di: Gelman, Haywood, et al.
Pubblicazione: (2025)
Deterministic Fuzzy Triage for Legal Compliance Classification and Evidence Retrieval
di: Atri, Rian
Pubblicazione: (2026)
di: Atri, Rian
Pubblicazione: (2026)
Cultural Encoding in Large Language Models: The Existence Gap in AI-Mediated Brand Discovery
di: Junyao, Huang, et al.
Pubblicazione: (2025)
di: Junyao, Huang, et al.
Pubblicazione: (2025)
From Native Memes to Global Moderation: Cross-Cultural Evaluation of Vision-Language Models for Hateful Meme Detection
di: Wang, Mo, et al.
Pubblicazione: (2026)
di: Wang, Mo, et al.
Pubblicazione: (2026)
The Cultural Gene of Large Language Models: A Study on the Impact of Cross-Corpus Training on Model Values and Biases
di: Fenech-Borg, Emanuel Z., et al.
Pubblicazione: (2025)
di: Fenech-Borg, Emanuel Z., et al.
Pubblicazione: (2025)
Towards Modeling Cybersecurity Behavior of Humans in Organizations
di: Kürtz, Klaas Ole
Pubblicazione: (2026)
di: Kürtz, Klaas Ole
Pubblicazione: (2026)
How Few-shot Demonstrations Affect Prompt-based Defenses Against LLM Jailbreak Attacks
di: Wang, Yanshu, et al.
Pubblicazione: (2026)
di: Wang, Yanshu, et al.
Pubblicazione: (2026)
Predicting Known Vulnerabilities from Attack Descriptions Using Sentence Transformers
di: Othman, Refat
Pubblicazione: (2026)
di: Othman, Refat
Pubblicazione: (2026)
Towards Agentic Investigation of Security Alerts
di: Eilertsen, Even, et al.
Pubblicazione: (2026)
di: Eilertsen, Even, et al.
Pubblicazione: (2026)
VectorSmuggle: Steganographic Exfiltration in Embedding Stores and a Cryptographic Provenance Defense
di: Wanger, Jascha
Pubblicazione: (2026)
di: Wanger, Jascha
Pubblicazione: (2026)
BioRefusalAudit: Auditing Biosecurity Refusal Depth Using General and Domain-Fine-Tuned Sparse Autoencoders
di: DeLeeuw, Caleb
Pubblicazione: (2026)
di: DeLeeuw, Caleb
Pubblicazione: (2026)
AIRTBench: Measuring Autonomous AI Red Teaming Capabilities in Language Models
di: Dawson, Ads, et al.
Pubblicazione: (2025)
di: Dawson, Ads, et al.
Pubblicazione: (2025)
The Automation Advantage in AI Red Teaming
di: Mulla, Rob, et al.
Pubblicazione: (2025)
di: Mulla, Rob, et al.
Pubblicazione: (2025)
Qwerty AI: Explainable Automated Age Rating and Content Safety Assessment for Russian-Language Screenplays
di: Zmanovskii, Nikita
Pubblicazione: (2025)
di: Zmanovskii, Nikita
Pubblicazione: (2025)
MASH: Evading Black-Box AI-Generated Text Detectors via Style Humanization
di: Gu, Yongtong, et al.
Pubblicazione: (2026)
di: Gu, Yongtong, et al.
Pubblicazione: (2026)
Benchmarking Large Language Models for IoC Recovery under Adversarial Code Obfuscation and Encryption
di: Morales, Jaime, et al.
Pubblicazione: (2026)
di: Morales, Jaime, et al.
Pubblicazione: (2026)
Cyber Defense Benchmark: Agentic Threat Hunting Evaluation for LLMs in SecOps
di: Chona, Alankrit, et al.
Pubblicazione: (2026)
di: Chona, Alankrit, et al.
Pubblicazione: (2026)
On-Device Generative AI for GDPR-Compliant Visual Monitoring: Natural Language Alerts from Local Object Detection
di: Schappacher-Tilp, Gudrun, et al.
Pubblicazione: (2026)
di: Schappacher-Tilp, Gudrun, et al.
Pubblicazione: (2026)
When Large Language Models are More PersuasiveThan Incentivized Humans, and Why
di: Schoenegger, Philipp, et al.
Pubblicazione: (2025)
di: Schoenegger, Philipp, et al.
Pubblicazione: (2025)
Documenting SME Processes with Conversational AI: From Tacit Knowledge to BPMN
di: Radhakrishnan, Unnikrishnan
Pubblicazione: (2025)
di: Radhakrishnan, Unnikrishnan
Pubblicazione: (2025)
Watermarking for AI Content Detection: A Review on Text, Visual, and Audio Modalities
di: Cao, Lele
Pubblicazione: (2025)
di: Cao, Lele
Pubblicazione: (2025)
Documenti analoghi
-
Harmful Terms and Where to Find Them: Measuring and Modeling Unfavorable Financial Terms and Conditions in Shopping Websites at Scale
di: Tsai, Elisa, et al.
Pubblicazione: (2025) -
AlignDP: Hybrid Differential Privacy with Rarity-Aware Protection for LLMs
di: Gaikwad, Madhava
Pubblicazione: (2025) -
CEKER: A Generalizable LLM Framework for Literature Analysis with a Case Study in Unikernel Security
di: Wollman, Alex, et al.
Pubblicazione: (2024) -
Hiding in Plain Sight: Query Obfuscation via Random Multilingual Searches
di: Firc, Anton, et al.
Pubblicazione: (2025) -
Who Shares What? An Empirical Analysis of Security Conference Content Across Academia and Industry
di: Walter, Lukas, et al.
Pubblicazione: (2024)