Mitigating Error Amplification in Fast Adversarial Training
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhao, Mengnan, Zhang, Lihe, Wang, Bo, Zheng, Tianhang, Zhong, Hong, Min, Geyong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Unveiling the Backdoor Mechanism Hidden Behind Catastrophic Overfitting in Fast Adversarial Training
von: Zhao, Mengnan, et al.
Veröffentlicht: (2026)
von: Zhao, Mengnan, et al.
Veröffentlicht: (2026)
Catastrophic Overfitting: A Potential Blessing in Disguise
von: Zhao, Mengnan, et al.
Veröffentlicht: (2024)
von: Zhao, Mengnan, et al.
Veröffentlicht: (2024)
Detecting Adversarial Data via Provable Adversarial Noise Amplification
von: Mumcu, Furkan, et al.
Veröffentlicht: (2026)
von: Mumcu, Furkan, et al.
Veröffentlicht: (2026)
Asking Forever: Universal Activations Behind Turn Amplification in Conversational LLMs
von: Coalson, Zachary, et al.
Veröffentlicht: (2026)
von: Coalson, Zachary, et al.
Veröffentlicht: (2026)
Channel-Level Semantic Perturbations: Unlearnable Examples for Diverse Training Paradigms
von: Wang, Bo, et al.
Veröffentlicht: (2026)
von: Wang, Bo, et al.
Veröffentlicht: (2026)
Vulnerability-Aware Robust Multimodal Adversarial Training
von: Zhang, Junrui, et al.
Veröffentlicht: (2025)
von: Zhang, Junrui, et al.
Veröffentlicht: (2025)
CoreUnlearn: Rethinking Concept Unlearning through Disentangled Component-Level Erasure in Text-guided Diffusion Models
von: Zhao, Mengnan, et al.
Veröffentlicht: (2026)
von: Zhao, Mengnan, et al.
Veröffentlicht: (2026)
CryptoTrain: Fast Secure Training on Encrypted Dataset
von: Xue, Jiaqi, et al.
Veröffentlicht: (2024)
von: Xue, Jiaqi, et al.
Veröffentlicht: (2024)
FedReview: A Review Mechanism for Rejecting Poisoned Updates in Federated Learning
von: Zheng, Tianhang, et al.
Veröffentlicht: (2024)
von: Zheng, Tianhang, et al.
Veröffentlicht: (2024)
Pre-trained Encoder Inference: Revealing Upstream Encoders In Downstream Machine Learning Services
von: Fu, Shaopeng, et al.
Veröffentlicht: (2024)
von: Fu, Shaopeng, et al.
Veröffentlicht: (2024)
Efficient Jailbreaking of Large Models by Freeze Training: Lower Layers Exhibit Greater Sensitivity to Harmful Content
von: Shen, Hongyuan, et al.
Veröffentlicht: (2025)
von: Shen, Hongyuan, et al.
Veröffentlicht: (2025)
Generalist++: A Meta-learning Framework for Mitigating Trade-off in Adversarial Training
von: Wang, Yisen, et al.
Veröffentlicht: (2025)
von: Wang, Yisen, et al.
Veröffentlicht: (2025)
Exploring and Mitigating Adversarial Manipulation of Voting-Based Leaderboards
von: Huang, Yangsibo, et al.
Veröffentlicht: (2025)
von: Huang, Yangsibo, et al.
Veröffentlicht: (2025)
FedGA: Federated Learning with Gradient Alignment for Error Asymmetry Mitigation
von: Xiao, Chenguang, et al.
Veröffentlicht: (2024)
von: Xiao, Chenguang, et al.
Veröffentlicht: (2024)
Unified Mechanism-Specific Amplification by Subsampling and Group Privacy Amplification
von: Schuchardt, Jan, et al.
Veröffentlicht: (2024)
von: Schuchardt, Jan, et al.
Veröffentlicht: (2024)
Persona-Conditioned Adversarial Prompting: Multi-Identity Red-Teaming for Adversarial Discovery and Mitigation
von: Morasso, Cristian, et al.
Veröffentlicht: (2026)
von: Morasso, Cristian, et al.
Veröffentlicht: (2026)
Generalization Properties of Adversarial Training for $\ell_0$-Bounded Adversarial Attacks
von: Delgosha, Payam, et al.
Veröffentlicht: (2024)
von: Delgosha, Payam, et al.
Veröffentlicht: (2024)
Fine-Tuning Personalization in Federated Learning to Mitigate Adversarial Clients
von: Allouah, Youssef, et al.
Veröffentlicht: (2024)
von: Allouah, Youssef, et al.
Veröffentlicht: (2024)
On the Effectiveness of Adversarial Training on Malware Classifiers
von: Bostani, Hamid, et al.
Veröffentlicht: (2024)
von: Bostani, Hamid, et al.
Veröffentlicht: (2024)
Steering Beyond the Support: Adversarial Training on Unsupervised Jailbroken Activation Simulation
von: Chen, Luoyu, et al.
Veröffentlicht: (2026)
von: Chen, Luoyu, et al.
Veröffentlicht: (2026)
Certifiable Black-Box Attacks with Randomized Adversarial Examples: Breaking Defenses with Provable Confidence
von: Hong, Hanbin, et al.
Veröffentlicht: (2023)
von: Hong, Hanbin, et al.
Veröffentlicht: (2023)
Mitigating the Structural Bias in Graph Adversarial Defenses
von: Fang, Junyuan, et al.
Veröffentlicht: (2025)
von: Fang, Junyuan, et al.
Veröffentlicht: (2025)
Privacy Amplification for Matrix Mechanisms
von: Choquette-Choo, Christopher A., et al.
Veröffentlicht: (2023)
von: Choquette-Choo, Christopher A., et al.
Veröffentlicht: (2023)
Comprehensive Survey on Adversarial Examples in Cybersecurity: Impacts, Challenges, and Mitigation Strategies
von: Li, Li
Veröffentlicht: (2024)
von: Li, Li
Veröffentlicht: (2024)
Efficient Adversarial Training in LLMs with Continuous Attacks
von: Xhonneux, Sophie, et al.
Veröffentlicht: (2024)
von: Xhonneux, Sophie, et al.
Veröffentlicht: (2024)
Understanding and Improving Continuous Adversarial Training for LLMs via In-context Learning Theory
von: Fu, Shaopeng, et al.
Veröffentlicht: (2026)
von: Fu, Shaopeng, et al.
Veröffentlicht: (2026)
Short-length Adversarial Training Helps LLMs Defend Long-length Jailbreak Attacks: Theoretical and Empirical Evidence
von: Fu, Shaopeng, et al.
Veröffentlicht: (2025)
von: Fu, Shaopeng, et al.
Veröffentlicht: (2025)
Breaking Agents: Compromising Autonomous LLM Agents Through Malfunction Amplification
von: Zhang, Boyang, et al.
Veröffentlicht: (2024)
von: Zhang, Boyang, et al.
Veröffentlicht: (2024)
MAED: Mathematical Activation Error Detection for Mitigating Physical Fault Attacks in DNN Inference
von: Ahmadi, Kasra, et al.
Veröffentlicht: (2026)
von: Ahmadi, Kasra, et al.
Veröffentlicht: (2026)
A Fast, Performant, Secure Distributed Training Framework For Large Language Model
von: Huang, Wei, et al.
Veröffentlicht: (2024)
von: Huang, Wei, et al.
Veröffentlicht: (2024)
Personalized Privacy Amplification via Importance Sampling
von: Fay, Dominik, et al.
Veröffentlicht: (2023)
von: Fay, Dominik, et al.
Veröffentlicht: (2023)
Elevating Defenses: Bridging Adversarial Training and Watermarking for Model Resilience
von: Thakkar, Janvi, et al.
Veröffentlicht: (2023)
von: Thakkar, Janvi, et al.
Veröffentlicht: (2023)
Differentially Private SGD Without Clipping Bias: An Error-Feedback Approach
von: Zhang, Xinwei, et al.
Veröffentlicht: (2023)
von: Zhang, Xinwei, et al.
Veröffentlicht: (2023)
TA3: Testing Against Adversarial Attacks on Machine Learning Models
von: Jin, Yuanzhe, et al.
Veröffentlicht: (2024)
von: Jin, Yuanzhe, et al.
Veröffentlicht: (2024)
Leveraging Randomness in Model and Data Partitioning for Privacy Amplification
von: Dong, Andy, et al.
Veröffentlicht: (2025)
von: Dong, Andy, et al.
Veröffentlicht: (2025)
Privacy Amplification for the Gaussian Mechanism via Bounded Support
von: Hu, Shengyuan, et al.
Veröffentlicht: (2024)
von: Hu, Shengyuan, et al.
Veröffentlicht: (2024)
Robustness-Congruent Adversarial Training for Secure Machine Learning Model Updates
von: Angioni, Daniele, et al.
Veröffentlicht: (2024)
von: Angioni, Daniele, et al.
Veröffentlicht: (2024)
Salsa Fresca: Angular Embeddings and Pre-Training for ML Attacks on Learning With Errors
von: Stevens, Samuel, et al.
Veröffentlicht: (2024)
von: Stevens, Samuel, et al.
Veröffentlicht: (2024)
Adaptive Meta-learning-based Adversarial Training for Robust Automatic Modulation Classification
von: Bamdad, Amirmohammad, et al.
Veröffentlicht: (2025)
von: Bamdad, Amirmohammad, et al.
Veröffentlicht: (2025)
Functional Encryption in Secure Neural Network Training: Data Leakage and Practical Mitigations
von: Ioniţă, Alexandru, et al.
Veröffentlicht: (2025)
von: Ioniţă, Alexandru, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Unveiling the Backdoor Mechanism Hidden Behind Catastrophic Overfitting in Fast Adversarial Training
von: Zhao, Mengnan, et al.
Veröffentlicht: (2026) -
Catastrophic Overfitting: A Potential Blessing in Disguise
von: Zhao, Mengnan, et al.
Veröffentlicht: (2024) -
Detecting Adversarial Data via Provable Adversarial Noise Amplification
von: Mumcu, Furkan, et al.
Veröffentlicht: (2026) -
Asking Forever: Universal Activations Behind Turn Amplification in Conversational LLMs
von: Coalson, Zachary, et al.
Veröffentlicht: (2026) -
Channel-Level Semantic Perturbations: Unlearnable Examples for Diverse Training Paradigms
von: Wang, Bo, et al.
Veröffentlicht: (2026)