Who's the Evil Twin? Differential Auditing for Undesired Behavior
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Balappanawar, Ishwar, Vattikuti, Venkata Hasith, Kintzley, Greta, Azimi-Mancel, Ronan, Golechha, Satvik |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Tight Auditing of Differential Privacy in MST and AIM
par: Ganev, Georgi, et autres
Publié: (2026)
par: Ganev, Georgi, et autres
Publié: (2026)
RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content
par: Yuan, Zhuowen, et autres
Publié: (2024)
par: Yuan, Zhuowen, et autres
Publié: (2024)
Progress Measures for Grokking on Real-world Tasks
par: Golechha, Satvik
Publié: (2024)
par: Golechha, Satvik
Publié: (2024)
Privacy Auditing of Large Language Models
par: Panda, Ashwinee, et autres
Publié: (2025)
par: Panda, Ashwinee, et autres
Publié: (2025)
Auditable Homomorphic-based Decentralized Collaborative AI with Attribute-based Differential Privacy
par: Yeh, Lo-Yao, et autres
Publié: (2024)
par: Yeh, Lo-Yao, et autres
Publié: (2024)
SWAP: Towards Copyright Auditing of Soft Prompts via Sequential Watermarking
par: Yang, Wenyuan, et autres
Publié: (2025)
par: Yang, Wenyuan, et autres
Publié: (2025)
DATABench: Evaluating Dataset Auditing in Deep Learning from an Adversarial Perspective
par: Shao, Shuo, et autres
Publié: (2025)
par: Shao, Shuo, et autres
Publié: (2025)
Hide in Plain Sight: Clean-Label Backdoor for Auditing Membership Inference
par: Chen, Depeng, et autres
Publié: (2024)
par: Chen, Depeng, et autres
Publié: (2024)
Predictive Auditing of Hidden Tokens in LLM APIs via Reasoning Length Estimation
par: Wang, Ziyao, et autres
Publié: (2025)
par: Wang, Ziyao, et autres
Publié: (2025)
Smart Water Security with AI and Blockchain-Enhanced Digital Twins
par: Homaei, Mohammadhossein, et autres
Publié: (2025)
par: Homaei, Mohammadhossein, et autres
Publié: (2025)
MCP Safety Audit: LLMs with the Model Context Protocol Allow Major Security Exploits
par: Radosevich, Brandon, et autres
Publié: (2025)
par: Radosevich, Brandon, et autres
Publié: (2025)
Fair Play for Individuals, Foul Play for Groups? Auditing Anonymization's Impact on ML Fairness
par: Arcolezi, Héber H., et autres
Publié: (2025)
par: Arcolezi, Héber H., et autres
Publié: (2025)
TrustChain: A Blockchain Framework for Auditing and Verifying Aggregators in Decentralized Federated Learning
par: Hallaji, Ehsan, et autres
Publié: (2025)
par: Hallaji, Ehsan, et autres
Publié: (2025)
A White-Box Adversarial Attack Against a Digital Twin
par: Patterson, Wilson, et autres
Publié: (2022)
par: Patterson, Wilson, et autres
Publié: (2022)
Twin Auto-Encoder Model for Learning Separable Representation in Cyberattack Detection
par: Dinh, Phai Vu, et autres
Publié: (2024)
par: Dinh, Phai Vu, et autres
Publié: (2024)
A Review of Digital Twins and their Application in Cybersecurity based on Artificial Intelligence
par: Homaei, MohammadHossein, et autres
Publié: (2023)
par: Homaei, MohammadHossein, et autres
Publié: (2023)
AuditVotes: A Framework Towards More Deployable Certified Robustness for Graph Neural Networks
par: Lai, Yuni, et autres
Publié: (2025)
par: Lai, Yuni, et autres
Publié: (2025)
Privacy Auditing of Multi-domain Graph Pre-trained Model under Membership Inference Attacks
par: Luo, Jiayi, et autres
Publié: (2025)
par: Luo, Jiayi, et autres
Publié: (2025)
The Dark Side of Digital Twins: Adversarial Attacks on AI-Driven Water Forecasting
par: Homaei, Mohammadhossein, et autres
Publié: (2025)
par: Homaei, Mohammadhossein, et autres
Publié: (2025)
RAG with Differential Privacy
par: Grislain, Nicolas
Publié: (2024)
par: Grislain, Nicolas
Publié: (2024)
Differentially Private Model Merging
par: Yin, Qichuan, et autres
Publié: (2026)
par: Yin, Qichuan, et autres
Publié: (2026)
Differentially Private Worst-group Risk Minimization
par: Zhou, Xinyu, et autres
Publié: (2024)
par: Zhou, Xinyu, et autres
Publié: (2024)
Improved Algorithms for Differentially Private Language Model Alignment
par: Chen, Keyu, et autres
Publié: (2025)
par: Chen, Keyu, et autres
Publié: (2025)
Differentially Private Iterative Screening Rules for Linear Regression
par: Khanna, Amol, et autres
Publié: (2025)
par: Khanna, Amol, et autres
Publié: (2025)
Mind the Gap: Mixtures of Gaussians in Approximate Differential Privacy
par: Liu, Huikang, et autres
Publié: (2026)
par: Liu, Huikang, et autres
Publié: (2026)
Differentially Private Deep Model-Based Reinforcement Learning
par: Rio, Alexandre, et autres
Publié: (2024)
par: Rio, Alexandre, et autres
Publié: (2024)
Near-Optimal Reinforcement Learning with Shuffle Differential Privacy
par: Bai, Shaojie, et autres
Publié: (2024)
par: Bai, Shaojie, et autres
Publié: (2024)
Provable Differentially Private Computation of the Cross-Attention Mechanism
par: Ke, Yekun, et autres
Publié: (2024)
par: Ke, Yekun, et autres
Publié: (2024)
Differentially Private In-Context Learning with Nearest Neighbor Search
par: Koskela, Antti, et autres
Publié: (2025)
par: Koskela, Antti, et autres
Publié: (2025)
Evaluating Differentially Private Generation of Domain-Specific Text
par: Sun, Yidan, et autres
Publié: (2025)
par: Sun, Yidan, et autres
Publié: (2025)
DPrivBench: Benchmarking LLMs' Reasoning for Differential Privacy
par: Wang, Erchi, et autres
Publié: (2026)
par: Wang, Erchi, et autres
Publié: (2026)
Differential Privacy Mechanisms in Neural Tangent Kernel Regression
par: Gu, Jiuxiang, et autres
Publié: (2024)
par: Gu, Jiuxiang, et autres
Publié: (2024)
Differentially Private Synthetic Data Release for Topics API Outputs
par: Dick, Travis, et autres
Publié: (2025)
par: Dick, Travis, et autres
Publié: (2025)
Differential Privacy-Driven Framework for Enhancing Heart Disease Prediction
par: Otoum, Yazan, et autres
Publié: (2025)
par: Otoum, Yazan, et autres
Publié: (2025)
Differentially Private Block-wise Gradient Shuffle for Deep Learning
par: Zagardo, David
Publié: (2024)
par: Zagardo, David
Publié: (2024)
Position: Challenges and Opportunities for Differential Privacy in the U.S. Federal Government
par: Khanna, Amol, et autres
Publié: (2024)
par: Khanna, Amol, et autres
Publié: (2024)
Privacy-Preserving Federated Learning with Differentially Private Hyperdimensional Computing
par: Piran, Fardin Jalil, et autres
Publié: (2024)
par: Piran, Fardin Jalil, et autres
Publié: (2024)
Federated Split Learning for Human Activity Recognition with Differential Privacy
par: Ndeko, Josue, et autres
Publié: (2024)
par: Ndeko, Josue, et autres
Publié: (2024)
Data-adaptive Differentially Private Prompt Synthesis for In-Context Learning
par: Gao, Fengyu, et autres
Publié: (2024)
par: Gao, Fengyu, et autres
Publié: (2024)
Gaussian DP for Reporting Differential Privacy Guarantees in Machine Learning
par: Gomez, Juan Felipe, et autres
Publié: (2025)
par: Gomez, Juan Felipe, et autres
Publié: (2025)
Documents similaires
-
Tight Auditing of Differential Privacy in MST and AIM
par: Ganev, Georgi, et autres
Publié: (2026) -
RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content
par: Yuan, Zhuowen, et autres
Publié: (2024) -
Progress Measures for Grokking on Real-world Tasks
par: Golechha, Satvik
Publié: (2024) -
Privacy Auditing of Large Language Models
par: Panda, Ashwinee, et autres
Publié: (2025) -
Auditable Homomorphic-based Decentralized Collaborative AI with Attribute-based Differential Privacy
par: Yeh, Lo-Yao, et autres
Publié: (2024)