IMMACULATE: A Practical LLM Auditing Framework via Verifiable Computation
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Yanpei, Qu, Wenjie, Wu, Linyu, Zhai, Shengfang, Wang, Lionel Z., Xu, Ming, Liu, Yue, Yuan, Binhang, Song, Dawn, Zhang, Jiaheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Securing LLM Agents Need Intent-to-Execution Integrity
di: Qu, Wenjie, et al.
Pubblicazione: (2026)
di: Qu, Wenjie, et al.
Pubblicazione: (2026)
DMark: Order-Agnostic Watermarking for Diffusion Large Language Models
di: Wu, Linyu, et al.
Pubblicazione: (2025)
di: Wu, Linyu, et al.
Pubblicazione: (2025)
RepoMark: A Data-Usage Auditing Framework for Code Large Language Models
di: Qu, Wenjie, et al.
Pubblicazione: (2025)
di: Qu, Wenjie, et al.
Pubblicazione: (2025)
Silent Leaks: Implicit Knowledge Extraction Attack on RAG Systems through Benign Queries
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
Prompt Inversion Attack against Collaborative Inference of Large Language Models
di: Qu, Wenjie, et al.
Pubblicazione: (2025)
di: Qu, Wenjie, et al.
Pubblicazione: (2025)
Efficient Input-level Backdoor Defense on Text-to-Image Synthesis via Neuron Activation Variation
di: Zhai, Shengfang, et al.
Pubblicazione: (2025)
di: Zhai, Shengfang, et al.
Pubblicazione: (2025)
Self-Sovereign Agent
di: Qu, Wenjie, et al.
Pubblicazione: (2026)
di: Qu, Wenjie, et al.
Pubblicazione: (2026)
Sparse Autoencoder as a Zero-Shot Classifier for Concept Erasing in Text-to-Image Diffusion Models
di: Tian, Zhihua, et al.
Pubblicazione: (2025)
di: Tian, Zhihua, et al.
Pubblicazione: (2025)
RulePilot: An LLM-Powered Agent for Security Rule Generation
di: Wang, Hongtai, et al.
Pubblicazione: (2025)
di: Wang, Hongtai, et al.
Pubblicazione: (2025)
GuardReasoner-Omni: A Reasoning-based Multi-modal Guardrail for Text, Image, Video, and Audio
di: Zhu, Zhenhao, et al.
Pubblicazione: (2026)
di: Zhu, Zhenhao, et al.
Pubblicazione: (2026)
ExtendAttack: Attacking Servers of LRMs via Extending Reasoning
di: Zhu, Zhenhao, et al.
Pubblicazione: (2025)
di: Zhu, Zhenhao, et al.
Pubblicazione: (2025)
ARuleCon: Agentic Security Rule Conversion
di: Xu, Ming, et al.
Pubblicazione: (2026)
di: Xu, Ming, et al.
Pubblicazione: (2026)
BadDLM: Backdooring Diffusion Language Models with Diverse Targets
di: Zhai, Shengfang, et al.
Pubblicazione: (2026)
di: Zhai, Shengfang, et al.
Pubblicazione: (2026)
GuardReasoner: Towards Reasoning-based LLM Safeguards
di: Liu, Yue, et al.
Pubblicazione: (2025)
di: Liu, Yue, et al.
Pubblicazione: (2025)
Auditing Data Membership in Reinforcement Learning With Verifiable Rewards
di: Liu, Yule, et al.
Pubblicazione: (2025)
di: Liu, Yule, et al.
Pubblicazione: (2025)
Are You Getting What You Pay For? Auditing Model Substitution in LLM APIs
di: Cai, Will, et al.
Pubblicazione: (2025)
di: Cai, Will, et al.
Pubblicazione: (2025)
VeriLLM: A Lightweight Framework for Publicly Verifiable Decentralized Inference
di: Wang, Ke, et al.
Pubblicazione: (2025)
di: Wang, Ke, et al.
Pubblicazione: (2025)
Trusted Compute Units: A Framework for Chained Verifiable Computations
di: Castillo, Fernando, et al.
Pubblicazione: (2025)
di: Castillo, Fernando, et al.
Pubblicazione: (2025)
MemPot: Defending Against Memory Extraction Attack with Optimized Honeypots
di: Wang, Yuhao, et al.
Pubblicazione: (2026)
di: Wang, Yuhao, et al.
Pubblicazione: (2026)
Life-Cycle Routing Vulnerabilities of LLM Router
di: Lin, Qiqi, et al.
Pubblicazione: (2025)
di: Lin, Qiqi, et al.
Pubblicazione: (2025)
Progent: Securing AI Agents with Privilege Control
di: Shi, Tianneng, et al.
Pubblicazione: (2025)
di: Shi, Tianneng, et al.
Pubblicazione: (2025)
DiffAudit: Auditing Privacy Practices of Online Services for Children and Adolescents
di: Figueira, Olivia, et al.
Pubblicazione: (2024)
di: Figueira, Olivia, et al.
Pubblicazione: (2024)
Position: LLM Watermarking Should Align Stakeholders' Incentives for Practical Adoption
di: Liu, Yepeng, et al.
Pubblicazione: (2025)
di: Liu, Yepeng, et al.
Pubblicazione: (2025)
Time-Delayed Publicly Verifiable Quantum Computation for Classical Verifiers
di: Mohammed, Ameer, et al.
Pubblicazione: (2026)
di: Mohammed, Ameer, et al.
Pubblicazione: (2026)
Verifiable Privacy-Preserving Computing
di: Bontekoe, Tariq, et al.
Pubblicazione: (2023)
di: Bontekoe, Tariq, et al.
Pubblicazione: (2023)
Echoes within the Reasoning: Stealthy and Effective Watermarking via Chain of Thought
di: Lu, Jiacheng, et al.
Pubblicazione: (2026)
di: Lu, Jiacheng, et al.
Pubblicazione: (2026)
AEGIS: No Tool Call Left Unchecked -- A Pre-Execution Firewall and Audit Layer for AI Agents
di: Yuan, Aojie, et al.
Pubblicazione: (2026)
di: Yuan, Aojie, et al.
Pubblicazione: (2026)
GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
di: Liu, Yue, et al.
Pubblicazione: (2025)
di: Liu, Yue, et al.
Pubblicazione: (2025)
AliMark: Enhancing Robustness of Sentence-Level Watermarking Against Text Paraphrasing
di: Li, Yuexin, et al.
Pubblicazione: (2026)
di: Li, Yuexin, et al.
Pubblicazione: (2026)
State of the Art Report: Verified Computation
di: Woodcock, Jim, et al.
Pubblicazione: (2023)
di: Woodcock, Jim, et al.
Pubblicazione: (2023)
MalTool: Malicious Tool Attacks on LLM Agents
di: Hu, Yuepeng, et al.
Pubblicazione: (2026)
di: Hu, Yuepeng, et al.
Pubblicazione: (2026)
LLM-CEG: Extending the Classification Error Gauge Framework for Privacy Auditing of Large Language Models
di: Mivule, Kato
Pubblicazione: (2026)
di: Mivule, Kato
Pubblicazione: (2026)
Sealing the Audit-Runtime Gap for LLM Skills
di: Shen, Tingda, et al.
Pubblicazione: (2026)
di: Shen, Tingda, et al.
Pubblicazione: (2026)
A Framework for Formalizing LLM Agent Security
di: Siu, Vincent, et al.
Pubblicazione: (2026)
di: Siu, Vincent, et al.
Pubblicazione: (2026)
Private, Verifiable, and Auditable AI Systems
di: South, Tobin
Pubblicazione: (2025)
di: South, Tobin
Pubblicazione: (2025)
SA2FE: A Secure, Anonymous, Auditable, and Fair Edge Computing Service Offloading Framework
di: Wang, Xiaojian, et al.
Pubblicazione: (2025)
di: Wang, Xiaojian, et al.
Pubblicazione: (2025)
Agent Audit: A Security Analysis System for LLM Agent Applications
di: Zhang, Haiyue, et al.
Pubblicazione: (2026)
di: Zhang, Haiyue, et al.
Pubblicazione: (2026)
Do Androids Dream of Breaking the Game? Systematically Auditing AI Agent Benchmarks with BenchJack
di: Wang, Hao, et al.
Pubblicazione: (2026)
di: Wang, Hao, et al.
Pubblicazione: (2026)
Discovering Universal Semantic Triggers for Text-to-Image Synthesis
di: Zhai, Shengfang, et al.
Pubblicazione: (2024)
di: Zhai, Shengfang, et al.
Pubblicazione: (2024)
Provably Robust Multi-bit Watermarking for AI-generated Text
di: Qu, Wenjie, et al.
Pubblicazione: (2024)
di: Qu, Wenjie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Securing LLM Agents Need Intent-to-Execution Integrity
di: Qu, Wenjie, et al.
Pubblicazione: (2026) -
DMark: Order-Agnostic Watermarking for Diffusion Large Language Models
di: Wu, Linyu, et al.
Pubblicazione: (2025) -
RepoMark: A Data-Usage Auditing Framework for Code Large Language Models
di: Qu, Wenjie, et al.
Pubblicazione: (2025) -
Silent Leaks: Implicit Knowledge Extraction Attack on RAG Systems through Benign Queries
di: Wang, Yuhao, et al.
Pubblicazione: (2025) -
Prompt Inversion Attack against Collaborative Inference of Large Language Models
di: Qu, Wenjie, et al.
Pubblicazione: (2025)