Adversarial Attacks on Data Attribution
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Xinhe, Hu, Pingbang, Deng, Junwei, Ma, Jiaqi W. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
$\texttt{dattri}$: A Library for Efficient Data Attribution
por: Deng, Junwei, et al.
Publicado: (2024)
por: Deng, Junwei, et al.
Publicado: (2024)
How Faithful Is Trajectory-Based Data Attribution? Error Sources, Remedies, and Practical Guidelines
por: Deng, Junwei, et al.
Publicado: (2026)
por: Deng, Junwei, et al.
Publicado: (2026)
GraSS: Scalable Data Attribution with Gradient Sparsification and Sparse Projection
por: Hu, Pingbang, et al.
Publicado: (2025)
por: Hu, Pingbang, et al.
Publicado: (2025)
A Versatile Influence Function for Data Attribution with Non-Decomposable Loss
por: Deng, Junwei, et al.
Publicado: (2024)
por: Deng, Junwei, et al.
Publicado: (2024)
A Reliable Cryptographic Framework for Empirical Machine Unlearning Evaluation
por: Tu, Yiwen, et al.
Publicado: (2024)
por: Tu, Yiwen, et al.
Publicado: (2024)
Most Influential Subset Selection: Challenges, Promises, and Beyond
por: Hu, Yuzheng, et al.
Publicado: (2024)
por: Hu, Yuzheng, et al.
Publicado: (2024)
Exploring Training Data Attribution under Limited Access Constraints
por: Zhang, Shiyuan, et al.
Publicado: (2025)
por: Zhang, Shiyuan, et al.
Publicado: (2025)
Dr. Post-Training: A Data Regularization Perspective on LLM Post-Training
por: Hu, Pingbang, et al.
Publicado: (2026)
por: Hu, Pingbang, et al.
Publicado: (2026)
A Unified Theory of Random Projection for Influence Functions
por: Hu, Pingbang, et al.
Publicado: (2026)
por: Hu, Pingbang, et al.
Publicado: (2026)
Pseudo-Nonlinear Data Augmentation: A Constrained Energy Minimization Viewpoint
por: Hu, Pingbang, et al.
Publicado: (2024)
por: Hu, Pingbang, et al.
Publicado: (2024)
Efficient Ensembles Improve Training Data Attribution
por: Deng, Junwei, et al.
Publicado: (2024)
por: Deng, Junwei, et al.
Publicado: (2024)
Taming Hyperparameter Sensitivity in Data Attribution: Practical Selection Without Costly Retraining
por: Wang, Weiyi, et al.
Publicado: (2025)
por: Wang, Weiyi, et al.
Publicado: (2025)
Explainability-Guided Defense: Attribution-Aware Model Refinement Against Adversarial Data Attacks
por: Wang, Longwei, et al.
Publicado: (2026)
por: Wang, Longwei, et al.
Publicado: (2026)
Detecting and Filtering Unsafe Training Data via Data Attribution with Denoised Representation
por: Pan, Yijun, et al.
Publicado: (2025)
por: Pan, Yijun, et al.
Publicado: (2025)
Daunce: Data Attribution through Uncertainty Estimation
por: Pan, Xingyuan, et al.
Publicado: (2025)
por: Pan, Xingyuan, et al.
Publicado: (2025)
OATS: Online Data Augmentation for Time Series Foundation Models
por: Deng, Junwei, et al.
Publicado: (2026)
por: Deng, Junwei, et al.
Publicado: (2026)
Measuring Fine-Grained Relatedness in Multitask Learning via Data Attribution
por: Tu, Yiwen, et al.
Publicado: (2025)
por: Tu, Yiwen, et al.
Publicado: (2025)
A Snapshot of Influence: A Local Data Attribution Framework for Online Reinforcement Learning
por: Hu, Yuzheng, et al.
Publicado: (2025)
por: Hu, Yuzheng, et al.
Publicado: (2025)
Adversarial Semantic and Label Perturbation Attack for Pedestrian Attribute Recognition
por: Kong, Weizhe, et al.
Publicado: (2025)
por: Kong, Weizhe, et al.
Publicado: (2025)
A Controlled Diagnostic Study of Hardware-Induced Distortions in Hardware-Aware Training
por: Fang, Yunxuan, et al.
Publicado: (2026)
por: Fang, Yunxuan, et al.
Publicado: (2026)
Adversarial Bias: Data Poisoning Attacks on Fairness
por: Chan, Eunice, et al.
Publicado: (2025)
por: Chan, Eunice, et al.
Publicado: (2025)
Identifying Adversary Characteristics from an Observed Attack
por: Choi, Soyon, et al.
Publicado: (2026)
por: Choi, Soyon, et al.
Publicado: (2026)
Unifying Image Counterfactuals and Feature Attributions with Latent-Space Adversarial Attacks
por: Goldwasser, Jeremy, et al.
Publicado: (2025)
por: Goldwasser, Jeremy, et al.
Publicado: (2025)
Who Gets Credit or Blame? Attributing Accountability in Modern AI Systems
por: Zhang, Shichang, et al.
Publicado: (2025)
por: Zhang, Shichang, et al.
Publicado: (2025)
TabAttackBench: A Benchmark for Adversarial Attacks on Tabular Data
por: He, Zhipeng, et al.
Publicado: (2025)
por: He, Zhipeng, et al.
Publicado: (2025)
When Adaptation Fails: A Gradient-Based Diagnosis of Collapsed Gating in Vision-Language Prompt Learning
por: Fang, Yunxuan, et al.
Publicado: (2026)
por: Fang, Yunxuan, et al.
Publicado: (2026)
Stochastic Bandits Robust to Adversarial Attacks
por: Wang, Xuchuang, et al.
Publicado: (2024)
por: Wang, Xuchuang, et al.
Publicado: (2024)
MARAGE: Transferable Multi-Model Adversarial Attack for Retrieval-Augmented Generation Data Extraction
por: Hu, Xiao, et al.
Publicado: (2025)
por: Hu, Xiao, et al.
Publicado: (2025)
PASA: Attack Agnostic Unsupervised Adversarial Detection using Prediction & Attribution Sensitivity Analysis
por: Bhusal, Dipkamal, et al.
Publicado: (2024)
por: Bhusal, Dipkamal, et al.
Publicado: (2024)
Exploiting Missing Data Remediation Strategies using Adversarial Missingness Attacks
por: Koyuncu, Deniz, et al.
Publicado: (2024)
por: Koyuncu, Deniz, et al.
Publicado: (2024)
Enhancing Adversarial Attacks via Parameter Adaptive Adversarial Attack
por: Jin, Zhibo, et al.
Publicado: (2024)
por: Jin, Zhibo, et al.
Publicado: (2024)
Crafting Imperceptible On-Manifold Adversarial Attacks for Tabular Data
por: He, Zhipeng, et al.
Publicado: (2025)
por: He, Zhipeng, et al.
Publicado: (2025)
Improving the Transferability of Adversarial Attacks by an Input Transpose
por: Wan, Qing, et al.
Publicado: (2025)
por: Wan, Qing, et al.
Publicado: (2025)
Adversarial Attacks for Drift Detection
por: Hinder, Fabian, et al.
Publicado: (2024)
por: Hinder, Fabian, et al.
Publicado: (2024)
Attack by Unlearning: Unlearning-Induced Adversarial Attacks on Graph Neural Networks
por: Zhang, Jiahao, et al.
Publicado: (2026)
por: Zhang, Jiahao, et al.
Publicado: (2026)
DARD: Dice Adversarial Robustness Distillation against Adversarial Attacks
por: Zou, Jing, et al.
Publicado: (2025)
por: Zou, Jing, et al.
Publicado: (2025)
In-Context Data Distillation with TabPFN
por: Ma, Junwei, et al.
Publicado: (2024)
por: Ma, Junwei, et al.
Publicado: (2024)
Towards Interpretable Adversarial Examples via Sparse Adversarial Attack
por: Lin, Fudong, et al.
Publicado: (2025)
por: Lin, Fudong, et al.
Publicado: (2025)
A Linear Reconstruction Approach for Attribute Inference Attacks against Synthetic Data
por: Annamalai, Meenatchi Sundaram Muthu Selva, et al.
Publicado: (2023)
por: Annamalai, Meenatchi Sundaram Muthu Selva, et al.
Publicado: (2023)
Adversarial Attacks and Dimensionality in Text Classifiers
por: Chattopadhyay, Nandish, et al.
Publicado: (2024)
por: Chattopadhyay, Nandish, et al.
Publicado: (2024)
Ejemplares similares
-
$\texttt{dattri}$: A Library for Efficient Data Attribution
por: Deng, Junwei, et al.
Publicado: (2024) -
How Faithful Is Trajectory-Based Data Attribution? Error Sources, Remedies, and Practical Guidelines
por: Deng, Junwei, et al.
Publicado: (2026) -
GraSS: Scalable Data Attribution with Gradient Sparsification and Sparse Projection
por: Hu, Pingbang, et al.
Publicado: (2025) -
A Versatile Influence Function for Data Attribution with Non-Decomposable Loss
por: Deng, Junwei, et al.
Publicado: (2024) -
A Reliable Cryptographic Framework for Empirical Machine Unlearning Evaluation
por: Tu, Yiwen, et al.
Publicado: (2024)