Who's the Evil Twin? Differential Auditing for Undesired Behavior
Fuente:
arXiv
Salvato in:
| Autori principali: | Balappanawar, Ishwar, Vattikuti, Venkata Hasith, Kintzley, Greta, Azimi-Mancel, Ronan, Golechha, Satvik |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Tight Auditing of Differential Privacy in MST and AIM
di: Ganev, Georgi, et al.
Pubblicazione: (2026)
di: Ganev, Georgi, et al.
Pubblicazione: (2026)
RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content
di: Yuan, Zhuowen, et al.
Pubblicazione: (2024)
di: Yuan, Zhuowen, et al.
Pubblicazione: (2024)
Progress Measures for Grokking on Real-world Tasks
di: Golechha, Satvik
Pubblicazione: (2024)
di: Golechha, Satvik
Pubblicazione: (2024)
Privacy Auditing of Large Language Models
di: Panda, Ashwinee, et al.
Pubblicazione: (2025)
di: Panda, Ashwinee, et al.
Pubblicazione: (2025)
Auditable Homomorphic-based Decentralized Collaborative AI with Attribute-based Differential Privacy
di: Yeh, Lo-Yao, et al.
Pubblicazione: (2024)
di: Yeh, Lo-Yao, et al.
Pubblicazione: (2024)
SWAP: Towards Copyright Auditing of Soft Prompts via Sequential Watermarking
di: Yang, Wenyuan, et al.
Pubblicazione: (2025)
di: Yang, Wenyuan, et al.
Pubblicazione: (2025)
DATABench: Evaluating Dataset Auditing in Deep Learning from an Adversarial Perspective
di: Shao, Shuo, et al.
Pubblicazione: (2025)
di: Shao, Shuo, et al.
Pubblicazione: (2025)
Hide in Plain Sight: Clean-Label Backdoor for Auditing Membership Inference
di: Chen, Depeng, et al.
Pubblicazione: (2024)
di: Chen, Depeng, et al.
Pubblicazione: (2024)
Predictive Auditing of Hidden Tokens in LLM APIs via Reasoning Length Estimation
di: Wang, Ziyao, et al.
Pubblicazione: (2025)
di: Wang, Ziyao, et al.
Pubblicazione: (2025)
Smart Water Security with AI and Blockchain-Enhanced Digital Twins
di: Homaei, Mohammadhossein, et al.
Pubblicazione: (2025)
di: Homaei, Mohammadhossein, et al.
Pubblicazione: (2025)
MCP Safety Audit: LLMs with the Model Context Protocol Allow Major Security Exploits
di: Radosevich, Brandon, et al.
Pubblicazione: (2025)
di: Radosevich, Brandon, et al.
Pubblicazione: (2025)
Fair Play for Individuals, Foul Play for Groups? Auditing Anonymization's Impact on ML Fairness
di: Arcolezi, Héber H., et al.
Pubblicazione: (2025)
di: Arcolezi, Héber H., et al.
Pubblicazione: (2025)
TrustChain: A Blockchain Framework for Auditing and Verifying Aggregators in Decentralized Federated Learning
di: Hallaji, Ehsan, et al.
Pubblicazione: (2025)
di: Hallaji, Ehsan, et al.
Pubblicazione: (2025)
A White-Box Adversarial Attack Against a Digital Twin
di: Patterson, Wilson, et al.
Pubblicazione: (2022)
di: Patterson, Wilson, et al.
Pubblicazione: (2022)
Twin Auto-Encoder Model for Learning Separable Representation in Cyberattack Detection
di: Dinh, Phai Vu, et al.
Pubblicazione: (2024)
di: Dinh, Phai Vu, et al.
Pubblicazione: (2024)
A Review of Digital Twins and their Application in Cybersecurity based on Artificial Intelligence
di: Homaei, MohammadHossein, et al.
Pubblicazione: (2023)
di: Homaei, MohammadHossein, et al.
Pubblicazione: (2023)
AuditVotes: A Framework Towards More Deployable Certified Robustness for Graph Neural Networks
di: Lai, Yuni, et al.
Pubblicazione: (2025)
di: Lai, Yuni, et al.
Pubblicazione: (2025)
Privacy Auditing of Multi-domain Graph Pre-trained Model under Membership Inference Attacks
di: Luo, Jiayi, et al.
Pubblicazione: (2025)
di: Luo, Jiayi, et al.
Pubblicazione: (2025)
The Dark Side of Digital Twins: Adversarial Attacks on AI-Driven Water Forecasting
di: Homaei, Mohammadhossein, et al.
Pubblicazione: (2025)
di: Homaei, Mohammadhossein, et al.
Pubblicazione: (2025)
RAG with Differential Privacy
di: Grislain, Nicolas
Pubblicazione: (2024)
di: Grislain, Nicolas
Pubblicazione: (2024)
Differentially Private Model Merging
di: Yin, Qichuan, et al.
Pubblicazione: (2026)
di: Yin, Qichuan, et al.
Pubblicazione: (2026)
Differentially Private Worst-group Risk Minimization
di: Zhou, Xinyu, et al.
Pubblicazione: (2024)
di: Zhou, Xinyu, et al.
Pubblicazione: (2024)
Improved Algorithms for Differentially Private Language Model Alignment
di: Chen, Keyu, et al.
Pubblicazione: (2025)
di: Chen, Keyu, et al.
Pubblicazione: (2025)
Differentially Private Iterative Screening Rules for Linear Regression
di: Khanna, Amol, et al.
Pubblicazione: (2025)
di: Khanna, Amol, et al.
Pubblicazione: (2025)
Mind the Gap: Mixtures of Gaussians in Approximate Differential Privacy
di: Liu, Huikang, et al.
Pubblicazione: (2026)
di: Liu, Huikang, et al.
Pubblicazione: (2026)
Differentially Private Deep Model-Based Reinforcement Learning
di: Rio, Alexandre, et al.
Pubblicazione: (2024)
di: Rio, Alexandre, et al.
Pubblicazione: (2024)
Near-Optimal Reinforcement Learning with Shuffle Differential Privacy
di: Bai, Shaojie, et al.
Pubblicazione: (2024)
di: Bai, Shaojie, et al.
Pubblicazione: (2024)
Provable Differentially Private Computation of the Cross-Attention Mechanism
di: Ke, Yekun, et al.
Pubblicazione: (2024)
di: Ke, Yekun, et al.
Pubblicazione: (2024)
Differentially Private In-Context Learning with Nearest Neighbor Search
di: Koskela, Antti, et al.
Pubblicazione: (2025)
di: Koskela, Antti, et al.
Pubblicazione: (2025)
Evaluating Differentially Private Generation of Domain-Specific Text
di: Sun, Yidan, et al.
Pubblicazione: (2025)
di: Sun, Yidan, et al.
Pubblicazione: (2025)
DPrivBench: Benchmarking LLMs' Reasoning for Differential Privacy
di: Wang, Erchi, et al.
Pubblicazione: (2026)
di: Wang, Erchi, et al.
Pubblicazione: (2026)
Differential Privacy Mechanisms in Neural Tangent Kernel Regression
di: Gu, Jiuxiang, et al.
Pubblicazione: (2024)
di: Gu, Jiuxiang, et al.
Pubblicazione: (2024)
Differentially Private Synthetic Data Release for Topics API Outputs
di: Dick, Travis, et al.
Pubblicazione: (2025)
di: Dick, Travis, et al.
Pubblicazione: (2025)
Differential Privacy-Driven Framework for Enhancing Heart Disease Prediction
di: Otoum, Yazan, et al.
Pubblicazione: (2025)
di: Otoum, Yazan, et al.
Pubblicazione: (2025)
Differentially Private Block-wise Gradient Shuffle for Deep Learning
di: Zagardo, David
Pubblicazione: (2024)
di: Zagardo, David
Pubblicazione: (2024)
Position: Challenges and Opportunities for Differential Privacy in the U.S. Federal Government
di: Khanna, Amol, et al.
Pubblicazione: (2024)
di: Khanna, Amol, et al.
Pubblicazione: (2024)
Privacy-Preserving Federated Learning with Differentially Private Hyperdimensional Computing
di: Piran, Fardin Jalil, et al.
Pubblicazione: (2024)
di: Piran, Fardin Jalil, et al.
Pubblicazione: (2024)
Federated Split Learning for Human Activity Recognition with Differential Privacy
di: Ndeko, Josue, et al.
Pubblicazione: (2024)
di: Ndeko, Josue, et al.
Pubblicazione: (2024)
Data-adaptive Differentially Private Prompt Synthesis for In-Context Learning
di: Gao, Fengyu, et al.
Pubblicazione: (2024)
di: Gao, Fengyu, et al.
Pubblicazione: (2024)
Gaussian DP for Reporting Differential Privacy Guarantees in Machine Learning
di: Gomez, Juan Felipe, et al.
Pubblicazione: (2025)
di: Gomez, Juan Felipe, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Tight Auditing of Differential Privacy in MST and AIM
di: Ganev, Georgi, et al.
Pubblicazione: (2026) -
RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content
di: Yuan, Zhuowen, et al.
Pubblicazione: (2024) -
Progress Measures for Grokking on Real-world Tasks
di: Golechha, Satvik
Pubblicazione: (2024) -
Privacy Auditing of Large Language Models
di: Panda, Ashwinee, et al.
Pubblicazione: (2025) -
Auditable Homomorphic-based Decentralized Collaborative AI with Attribute-based Differential Privacy
di: Yeh, Lo-Yao, et al.
Pubblicazione: (2024)