PromptAudit: Auditing Prompt Sensitivity in LLM-Based Vulnerability Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Camarato, Steffen J., Hmaiti, Yahya, Ghadamian, Mandana, Mohaisen, David |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
An Empirical Evaluation of LLM-Generated Code Security Across Prompting Methods
par: Kharma, Mohammed, et autres
Publié: (2026)
par: Kharma, Mohammed, et autres
Publié: (2026)
AutoPDL: Automatic Prompt Optimization for LLM Agents
par: Spiess, Claudio, et autres
Publié: (2025)
par: Spiess, Claudio, et autres
Publié: (2025)
SWAP: Towards Copyright Auditing of Soft Prompts via Sequential Watermarking
par: Yang, Wenyuan, et autres
Publié: (2025)
par: Yang, Wenyuan, et autres
Publié: (2025)
Enhancing Vulnerability Reports with Automated and Augmented Description Summarization
par: Althebeiti, Hattan, et autres
Publié: (2025)
par: Althebeiti, Hattan, et autres
Publié: (2025)
Checkpoint-GCG: Auditing and Attacking Fine-Tuning-Based Prompt Injection Defenses
par: Yang, Xiaoxue, et autres
Publié: (2025)
par: Yang, Xiaoxue, et autres
Publié: (2025)
Large Language Models in Cybersecurity: Applications, Vulnerabilities, and Defense Techniques
par: Jaffal, Niveen O., et autres
Publié: (2025)
par: Jaffal, Niveen O., et autres
Publié: (2025)
Adversarial Vulnerability Under Temporal Concept Drift: A Longitudinal Study of Android Malware Detection
par: Sabbah, Ahmed, et autres
Publié: (2026)
par: Sabbah, Ahmed, et autres
Publié: (2026)
Enhancing Reliability in LLM-Based Secure Code Generation
par: Kharma, Mohammed F., et autres
Publié: (2026)
par: Kharma, Mohammed F., et autres
Publié: (2026)
Efficient but Vulnerable: Benchmarking and Defending LLM Batch Prompting Attack
par: Yue, Murong, et autres
Publié: (2025)
par: Yue, Murong, et autres
Publié: (2025)
Code Comprehension then Auditing for Unsupervised LLM Evaluation
par: Patel, Bhrij, et autres
Publié: (2024)
par: Patel, Bhrij, et autres
Publié: (2024)
Empirical Evaluation of Concept Drift in ML-Based Android Malware Detection
par: Sabbah, Ahmed, et autres
Publié: (2025)
par: Sabbah, Ahmed, et autres
Publié: (2025)
Adversarial Reward Auditing for Active Detection and Mitigation of Reward Hacking
par: Beigi, Mohammad, et autres
Publié: (2026)
par: Beigi, Mohammad, et autres
Publié: (2026)
Representation Without Reward: A JEPA Audit for LLM Fine-Tuning
par: Sengupta, Biswa
Publié: (2026)
par: Sengupta, Biswa
Publié: (2026)
Reliability Auditing for Downstream LLM tasks in Psychiatry: LLM-Generated Hospitalization Risk Scores
par: Panda, Shevya, et autres
Publié: (2026)
par: Panda, Shevya, et autres
Publié: (2026)
Representation-Based Data Quality Audits for Audio
par: Gonzalez-Jimenez, Alvaro, et autres
Publié: (2025)
par: Gonzalez-Jimenez, Alvaro, et autres
Publié: (2025)
How Not to Detect Prompt Injections with an LLM
par: Choudhary, Sarthak, et autres
Publié: (2025)
par: Choudhary, Sarthak, et autres
Publié: (2025)
Beyond Prompt-Induced Lies: Investigating LLM Deception on Benign Prompts
par: Wu, Zhaomin, et autres
Publié: (2025)
par: Wu, Zhaomin, et autres
Publié: (2025)
Systematically Analyzing Prompt Injection Vulnerabilities in Diverse LLM Architectures
par: Benjamin, Victoria, et autres
Publié: (2024)
par: Benjamin, Victoria, et autres
Publié: (2024)
Textual Bayes: Quantifying Prompt Uncertainty in LLM-Based Systems
par: Ross, Brendan Leigh, et autres
Publié: (2025)
par: Ross, Brendan Leigh, et autres
Publié: (2025)
Memories Retrieved from Many Paths: A Multi-Prefix Framework for Robust Detection of Training Data Leakage in Large Language Models
par: Dang, Trung Cuong, et autres
Publié: (2025)
par: Dang, Trung Cuong, et autres
Publié: (2025)
Auto-Prompt Ensemble for LLM Judge
par: Li, Jiajie, et autres
Publié: (2025)
par: Li, Jiajie, et autres
Publié: (2025)
CreditAudit: 2$^\text{nd}$ Dimension for LLM Evaluation and Selection
par: Song, Yiliang, et autres
Publié: (2026)
par: Song, Yiliang, et autres
Publié: (2026)
Are My Optimized Prompts Compromised? Exploring Vulnerabilities of LLM-based Optimizers
par: Zhao, Andrew, et autres
Publié: (2025)
par: Zhao, Andrew, et autres
Publié: (2025)
Auditing Language Model Unlearning via Information Decomposition
par: Goel, Anmol, et autres
Publié: (2026)
par: Goel, Anmol, et autres
Publié: (2026)
Auditing Approximate Machine Unlearning for Differentially Private Models
par: Gu, Yuechun, et autres
Publié: (2025)
par: Gu, Yuechun, et autres
Publié: (2025)
Mind the Gaps: Auditing and Reducing Group Inequity in Large-Scale Mobility Prediction
par: Kumar, Ashwin, et autres
Publié: (2025)
par: Kumar, Ashwin, et autres
Publié: (2025)
Unsupervised Outlier Detection in Audit Analytics: A Case Study Using USA Spending Data
par: Li, Buhe, et autres
Publié: (2025)
par: Li, Buhe, et autres
Publié: (2025)
Representing Prompting Patterns with PDL: Compliance Agent Case Study
par: Vaziri, Mandana, et autres
Publié: (2025)
par: Vaziri, Mandana, et autres
Publié: (2025)
Predictive Auditing of Hidden Tokens in LLM APIs via Reasoning Length Estimation
par: Wang, Ziyao, et autres
Publié: (2025)
par: Wang, Ziyao, et autres
Publié: (2025)
Revisiting Prompt Sensitivity in Large Language Models for Text Classification: The Role of Prompt Underspecification
par: Pecher, Branislav, et autres
Publié: (2026)
par: Pecher, Branislav, et autres
Publié: (2026)
Refinement Provenance Inference: Detecting LLM-Refined Training Prompts from Model Behavior
par: Yin, Bo, et autres
Publié: (2026)
par: Yin, Bo, et autres
Publié: (2026)
LLM-Empowered Class Imbalanced Graph Prompt Learning for Online Drug Trafficking Detection
par: Ma, Tianyi, et autres
Publié: (2025)
par: Ma, Tianyi, et autres
Publié: (2025)
Bypassing the Rationale: Causal Auditing of Implicit Reasoning in Language Models
par: Sathyanarayanan, Anish, et autres
Publié: (2026)
par: Sathyanarayanan, Anish, et autres
Publié: (2026)
Privacy Auditing of Large Language Models
par: Panda, Ashwinee, et autres
Publié: (2025)
par: Panda, Ashwinee, et autres
Publié: (2025)
Auditing language models for hidden objectives
par: Marks, Samuel, et autres
Publié: (2025)
par: Marks, Samuel, et autres
Publié: (2025)
Auditing and Generating Synthetic Data with Controllable Trust Trade-offs
par: Belgodere, Brian, et autres
Publié: (2023)
par: Belgodere, Brian, et autres
Publié: (2023)
Auditing Fairness by Betting
par: Chugg, Ben, et autres
Publié: (2023)
par: Chugg, Ben, et autres
Publié: (2023)
Green Prompting: Characterizing Prompt-driven Energy Costs of LLM Inference
par: Adamska, Marta, et autres
Publié: (2025)
par: Adamska, Marta, et autres
Publié: (2025)
Embodied Red Teaming for Auditing Robotic Foundation Models
par: Karnik, Sathwik, et autres
Publié: (2024)
par: Karnik, Sathwik, et autres
Publié: (2024)
Operationalizing Data Minimization for Privacy-Preserving LLM Prompting
par: Zhou, Jijie, et autres
Publié: (2025)
par: Zhou, Jijie, et autres
Publié: (2025)
Documents similaires
-
An Empirical Evaluation of LLM-Generated Code Security Across Prompting Methods
par: Kharma, Mohammed, et autres
Publié: (2026) -
AutoPDL: Automatic Prompt Optimization for LLM Agents
par: Spiess, Claudio, et autres
Publié: (2025) -
SWAP: Towards Copyright Auditing of Soft Prompts via Sequential Watermarking
par: Yang, Wenyuan, et autres
Publié: (2025) -
Enhancing Vulnerability Reports with Automated and Augmented Description Summarization
par: Althebeiti, Hattan, et autres
Publié: (2025) -
Checkpoint-GCG: Auditing and Attacking Fine-Tuning-Based Prompt Injection Defenses
par: Yang, Xiaoxue, et autres
Publié: (2025)