Symmetry Defeats Auditing
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Merrill, Nick, Medley, Zeke |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Defeating Prompt Injections by Design
von: Debenedetti, Edoardo, et al.
Veröffentlicht: (2025)
von: Debenedetti, Edoardo, et al.
Veröffentlicht: (2025)
FTSmartAudit: A Knowledge Distillation-Enhanced Framework for Automated Smart Contract Auditing Using Fine-Tuned LLMs
von: Wei, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Wei, Zhiyuan, et al.
Veröffentlicht: (2024)
SafeRedirect: Defeating Internal Safety Collapse via Task-Completion Redirection in Frontier LLMs
von: Pan, Chao, et al.
Veröffentlicht: (2026)
von: Pan, Chao, et al.
Veröffentlicht: (2026)
On the Evidentiary Limits of Membership Inference for Copyright Auditing
von: Ertan, Murat Bilgehan, et al.
Veröffentlicht: (2026)
von: Ertan, Murat Bilgehan, et al.
Veröffentlicht: (2026)
Detecting Adversarial Fine-tuning with Auditing Agents
von: Egler, Sarah, et al.
Veröffentlicht: (2025)
von: Egler, Sarah, et al.
Veröffentlicht: (2025)
Narrow Secret Loyalty Dodges Black-Box Audits
von: Lamerton, Alfie, et al.
Veröffentlicht: (2026)
von: Lamerton, Alfie, et al.
Veröffentlicht: (2026)
An Empirical Audit of k-NAF Budget Accounting for Anchored Decoding
von: Vijayavallabh, J.
Veröffentlicht: (2026)
von: Vijayavallabh, J.
Veröffentlicht: (2026)
A Trajectory-Based Safety Audit of Clawdbot (OpenClaw)
von: Chen, Tianyu, et al.
Veröffentlicht: (2026)
von: Chen, Tianyu, et al.
Veröffentlicht: (2026)
Structured Security Auditing and Robustness Enhancement for Untrusted Agent Skills
von: Lv, Lijia, et al.
Veröffentlicht: (2026)
von: Lv, Lijia, et al.
Veröffentlicht: (2026)
Adaptive Plan-Execute Framework for Smart Contract Security Auditing
von: Wei, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Wei, Zhiyuan, et al.
Veröffentlicht: (2025)
Information-Dense Reasoning for Efficient and Auditable Security Alert Triage
von: Zhao, Guangze, et al.
Veröffentlicht: (2025)
von: Zhao, Guangze, et al.
Veröffentlicht: (2025)
IMMACULATE: A Practical LLM Auditing Framework via Verifiable Computation
von: Guo, Yanpei, et al.
Veröffentlicht: (2026)
von: Guo, Yanpei, et al.
Veröffentlicht: (2026)
Agent Audit: A Security Analysis System for LLM Agent Applications
von: Zhang, Haiyue, et al.
Veröffentlicht: (2026)
von: Zhang, Haiyue, et al.
Veröffentlicht: (2026)
AudAgent: Automated Auditing of Privacy Policy Compliance in AI Agents
von: Zheng, Ye, et al.
Veröffentlicht: (2025)
von: Zheng, Ye, et al.
Veröffentlicht: (2025)
Large Language Model based Smart Contract Auditing with LLMBugScanner
von: Yuan, Yining, et al.
Veröffentlicht: (2025)
von: Yuan, Yining, et al.
Veröffentlicht: (2025)
SC-Bench: A Large-Scale Dataset for Smart Contract Auditing
von: Xia, Shihao, et al.
Veröffentlicht: (2024)
von: Xia, Shihao, et al.
Veröffentlicht: (2024)
SmartLLM: Smart Contract Auditing using Custom Generative AI
von: Kevin, Jun, et al.
Veröffentlicht: (2025)
von: Kevin, Jun, et al.
Veröffentlicht: (2025)
Committed SAE-Feature Traces for Audited-Session Substitution Detection in Hosted LLMs
von: Liu, Ziyang
Veröffentlicht: (2026)
von: Liu, Ziyang
Veröffentlicht: (2026)
Audit-LLM: Multi-Agent Collaboration for Log-based Insider Threat Detection
von: Song, Chengyu, et al.
Veröffentlicht: (2024)
von: Song, Chengyu, et al.
Veröffentlicht: (2024)
AMDS: Attack-Aware Multi-Stage Defense System for Network Intrusion Detection with Two-Stage Adaptive Weight Learning
von: Olukola, Oluseyi, et al.
Veröffentlicht: (2026)
von: Olukola, Oluseyi, et al.
Veröffentlicht: (2026)
PrivacyPeek: Auditing What LLM-Based Agents Acquire, Not Just What They Say
von: Zhang, Mingxuan, et al.
Veröffentlicht: (2026)
von: Zhang, Mingxuan, et al.
Veröffentlicht: (2026)
Subject Data Auditing via Source Inference Attack in Cross-Silo Federated Learning
von: Li, Jiaxin, et al.
Veröffentlicht: (2024)
von: Li, Jiaxin, et al.
Veröffentlicht: (2024)
Anonymity Unveiled: A Practical Framework for Auditing Data Use in Deep Learning Models
von: Chen, Zitao, et al.
Veröffentlicht: (2024)
von: Chen, Zitao, et al.
Veröffentlicht: (2024)
Automating Security Audit Using Large Language Model based Agent: An Exploration Experiment
von: Chin, Jia Hui, et al.
Veröffentlicht: (2025)
von: Chin, Jia Hui, et al.
Veröffentlicht: (2025)
Do Androids Dream of Breaking the Game? Systematically Auditing AI Agent Benchmarks with BenchJack
von: Wang, Hao, et al.
Veröffentlicht: (2026)
von: Wang, Hao, et al.
Veröffentlicht: (2026)
Invisible Tokens, Visible Bills: The Urgent Need to Audit Hidden Operations in Opaque LLM Services
von: Sun, Guoheng, et al.
Veröffentlicht: (2025)
von: Sun, Guoheng, et al.
Veröffentlicht: (2025)
Data Provenance Auditing of Fine-Tuned Large Language Models with a Text-Preserving Technique
von: Li, Yanming, et al.
Veröffentlicht: (2025)
von: Li, Yanming, et al.
Veröffentlicht: (2025)
A2-DIDM: Privacy-preserving Accumulator-enabled Auditing for Distributed Identity of DNN Model
von: Xie, Tianxiu, et al.
Veröffentlicht: (2024)
von: Xie, Tianxiu, et al.
Veröffentlicht: (2024)
Zero-Knowledge Audit for Internet of Agents: Privacy-Preserving Communication Verification with Model Context Protocol
von: Jing, Guanlin, et al.
Veröffentlicht: (2025)
von: Jing, Guanlin, et al.
Veröffentlicht: (2025)
ESAA-Security: An Event-Sourced, Verifiable Architecture for Agent-Assisted Security Audits of AI-Generated Code
von: Filho, Elzo Brito dos Santos
Veröffentlicht: (2026)
von: Filho, Elzo Brito dos Santos
Veröffentlicht: (2026)
Defending against Stegomalware in Deep Neural Networks with Permutation Symmetry
von: Torpmann-Hagen, Birk, et al.
Veröffentlicht: (2025)
von: Torpmann-Hagen, Birk, et al.
Veröffentlicht: (2025)
Redefining AI Red Teaming in the Agentic Era: From Weeks to Hours
von: Dheekonda, Raja Sekhar Rao, et al.
Veröffentlicht: (2026)
von: Dheekonda, Raja Sekhar Rao, et al.
Veröffentlicht: (2026)
Private, Verifiable, and Auditable AI Systems
von: South, Tobin
Veröffentlicht: (2025)
von: South, Tobin
Veröffentlicht: (2025)
Privacy Auditing of Large Language Models
von: Panda, Ashwinee, et al.
Veröffentlicht: (2025)
von: Panda, Ashwinee, et al.
Veröffentlicht: (2025)
Tight Auditing of Differential Privacy in MST and AIM
von: Ganev, Georgi, et al.
Veröffentlicht: (2026)
von: Ganev, Georgi, et al.
Veröffentlicht: (2026)
Black-Box Access is Insufficient for Rigorous AI Audits
von: Casper, Stephen, et al.
Veröffentlicht: (2024)
von: Casper, Stephen, et al.
Veröffentlicht: (2024)
Auditing Data Membership in Reinforcement Learning With Verifiable Rewards
von: Liu, Yule, et al.
Veröffentlicht: (2025)
von: Liu, Yule, et al.
Veröffentlicht: (2025)
Beyond Jailbreaking: Auditing Contextual Privacy in LLM Agents
von: Das, Saswat, et al.
Veröffentlicht: (2025)
von: Das, Saswat, et al.
Veröffentlicht: (2025)
Who's the Evil Twin? Differential Auditing for Undesired Behavior
von: Balappanawar, Ishwar, et al.
Veröffentlicht: (2025)
von: Balappanawar, Ishwar, et al.
Veröffentlicht: (2025)
Auditing Pay-Per-Token in Large Language Models
von: Velasco, Ander Artola, et al.
Veröffentlicht: (2025)
von: Velasco, Ander Artola, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Defeating Prompt Injections by Design
von: Debenedetti, Edoardo, et al.
Veröffentlicht: (2025) -
FTSmartAudit: A Knowledge Distillation-Enhanced Framework for Automated Smart Contract Auditing Using Fine-Tuned LLMs
von: Wei, Zhiyuan, et al.
Veröffentlicht: (2024) -
SafeRedirect: Defeating Internal Safety Collapse via Task-Completion Redirection in Frontier LLMs
von: Pan, Chao, et al.
Veröffentlicht: (2026) -
On the Evidentiary Limits of Membership Inference for Copyright Auditing
von: Ertan, Murat Bilgehan, et al.
Veröffentlicht: (2026) -
Detecting Adversarial Fine-tuning with Auditing Agents
von: Egler, Sarah, et al.
Veröffentlicht: (2025)