Adversarial Vulnerability as a Consequence of On-Manifold Inseparibility
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Haldar, Rajdeep, Xing, Yue, Song, Qifan, Lin, Guang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Effect of Ambient-Intrinsic Dimension Gap on Adversarial Vulnerability
par: Haldar, Rajdeep, et autres
Publié: (2024)
par: Haldar, Rajdeep, et autres
Publié: (2024)
f-GRPO and Beyond: Divergence-Based Reinforcement Learning Algorithms for General LLM Alignment
par: Haldar, Rajdeep, et autres
Publié: (2026)
par: Haldar, Rajdeep, et autres
Publié: (2026)
LLM Safety Alignment is Divergence Estimation in Disguise
par: Haldar, Rajdeep, et autres
Publié: (2025)
par: Haldar, Rajdeep, et autres
Publié: (2025)
Better Representations via Adversarial Training in Pre-Training: A Theoretical Perspective
par: Xing, Yue, et autres
Publié: (2024)
par: Xing, Yue, et autres
Publié: (2024)
Fair Supervised Learning with A Simple Random Sampler of Sensitive Attributes
par: Sohn, Jinwon, et autres
Publié: (2023)
par: Sohn, Jinwon, et autres
Publié: (2023)
Task-tailored Pre-processing: Fair Downstream Supervised Learning
par: Sohn, Jinwon, et autres
Publié: (2026)
par: Sohn, Jinwon, et autres
Publié: (2026)
Parallelly Tempered Generative Adversarial Nets: Toward Stabilized Gradients
par: Sohn, Jinwon, et autres
Publié: (2024)
par: Sohn, Jinwon, et autres
Publié: (2024)
Theoretical Understanding of In-Context Learning in Shallow Transformers with Unstructured Data
par: Xing, Yue, et autres
Publié: (2024)
par: Xing, Yue, et autres
Publié: (2024)
SQS: Bayesian DNN Compression through Sparse Quantized Sub-distributions
par: Wang, Ziyi, et autres
Publié: (2025)
par: Wang, Ziyi, et autres
Publié: (2025)
Bayesian Federated Learning with Hamiltonian Monte Carlo: Algorithm and Theory
par: Liang, Jiajun, et autres
Publié: (2024)
par: Liang, Jiajun, et autres
Publié: (2024)
Adversarial Autoencoders in Operator Learning
par: Enyeart, Dustin, et autres
Publié: (2024)
par: Enyeart, Dustin, et autres
Publié: (2024)
Ensuring Calibration Robustness in Split Conformal Prediction Under Adversarial Attacks
par: Qian, Xunlei, et autres
Publié: (2025)
par: Qian, Xunlei, et autres
Publié: (2025)
Generalized Discrete Diffusion with Self-Correction
par: Wang, Linxuan, et autres
Publié: (2026)
par: Wang, Linxuan, et autres
Publié: (2026)
Impact of Positional Encoding: Clean and Adversarial Rademacher Complexity for Transformers under In-Context Regression
par: He, Weiyi, et autres
Publié: (2025)
par: He, Weiyi, et autres
Publié: (2025)
Spurious Correlation Learning in Preference Optimization: Mechanisms, Consequences, and Mitigation via Tie Training
par: Moya, Christian, et autres
Publié: (2026)
par: Moya, Christian, et autres
Publié: (2026)
Quantifying Membership Disclosure Risk for Tabular Synthetic Data Using Kernel Density Estimators
par: Pathak, Rajdeep, et autres
Publié: (2026)
par: Pathak, Rajdeep, et autres
Publié: (2026)
Deep Generative Spatiotemporal Engression for Probabilistic Forecasting of Epidemics
par: Pathak, Rajdeep, et autres
Publié: (2026)
par: Pathak, Rajdeep, et autres
Publié: (2026)
Adversarial Reward Auditing for Active Detection and Mitigation of Reward Hacking
par: Beigi, Mohammad, et autres
Publié: (2026)
par: Beigi, Mohammad, et autres
Publié: (2026)
Adversarial Purification by Consistency-aware Latent Space Optimization on Data Manifolds
par: Zhang, Shuhai, et autres
Publié: (2024)
par: Zhang, Shuhai, et autres
Publié: (2024)
Vulnerability-Aware Robust Multimodal Adversarial Training
par: Zhang, Junrui, et autres
Publié: (2025)
par: Zhang, Junrui, et autres
Publié: (2025)
Unveiling and Mitigating Adversarial Vulnerabilities in Iterative Optimizers
par: Sofer, Elad, et autres
Publié: (2025)
par: Sofer, Elad, et autres
Publié: (2025)
Crafting Imperceptible On-Manifold Adversarial Attacks for Tabular Data
par: He, Zhipeng, et autres
Publié: (2025)
par: He, Zhipeng, et autres
Publié: (2025)
Manifold-Constrained Adversarial Training for Long-Tailed Robustness via Geometric Alignment
par: Xian, Guanmeng, et autres
Publié: (2026)
par: Xian, Guanmeng, et autres
Publié: (2026)
A Geometric Framework for Adversarial Vulnerability in Machine Learning
par: Bell, Brian
Publié: (2024)
par: Bell, Brian
Publié: (2024)
How to Enhance Downstream Adversarial Robustness (almost) without Touching the Pre-Trained Foundation Model?
par: Liu, Meiqi, et autres
Publié: (2025)
par: Liu, Meiqi, et autres
Publié: (2025)
Enhancing Low-Precision Sampling via Stochastic Gradient Hamiltonian Monte Carlo
par: Wang, Ziyi, et autres
Publié: (2023)
par: Wang, Ziyi, et autres
Publié: (2023)
Unveiling the Vulnerability of Graph-LLMs: An Interpretable Multi-Dimensional Adversarial Attack on TAGs
par: Fan, Bowen, et autres
Publié: (2025)
par: Fan, Bowen, et autres
Publié: (2025)
Rectifying Adversarial Examples Using Their Vulnerabilities
par: Morimoto, Fumiya, et autres
Publié: (2026)
par: Morimoto, Fumiya, et autres
Publié: (2026)
Model-Free Adversarial Purification via Coarse-To-Fine Tensor Network Representation
par: Lin, Guang, et autres
Publié: (2025)
par: Lin, Guang, et autres
Publié: (2025)
Score Matching for Truncated Density Estimation on a Manifold
par: Williams, Daniel J., et autres
Publié: (2022)
par: Williams, Daniel J., et autres
Publié: (2022)
Golyadkin's Torment: Doppelgängers and Adversarial Vulnerability
par: Kamberov, George I.
Publié: (2024)
par: Kamberov, George I.
Publié: (2024)
Transcending Adversarial Perturbations: Manifold-Aided Adversarial Examples with Legitimate Semantics
par: Li, Shuai, et autres
Publié: (2024)
par: Li, Shuai, et autres
Publié: (2024)
Flow Battery Manifold Design with Heterogeneous Inputs Through Generative Adversarial Neural Networks
par: Seng, Eric, et autres
Publié: (2025)
par: Seng, Eric, et autres
Publié: (2025)
MEPT: Mixture of Expert Prompt Tuning as a Manifold Mapper
par: Zeng, Runjia, et autres
Publié: (2025)
par: Zeng, Runjia, et autres
Publié: (2025)
Superposition as Lossy Compression: Measure with Sparse Autoencoders and Connect to Adversarial Vulnerability
par: Bereska, Leonard, et autres
Publié: (2025)
par: Bereska, Leonard, et autres
Publié: (2025)
Are Modern Speech Enhancement Systems Vulnerable to Adversarial Attacks?
par: Makarov, Rostislav, et autres
Publié: (2025)
par: Makarov, Rostislav, et autres
Publié: (2025)
Knowledge Distillation Detection for Open-weights Models
par: Shi, Qin, et autres
Publié: (2025)
par: Shi, Qin, et autres
Publié: (2025)
Scale-Aware Adversarial Analysis: A Diagnostic for Generative AI in Multiscale Complex Systems
par: Zhao, Mengke, et autres
Publié: (2026)
par: Zhao, Mengke, et autres
Publié: (2026)
Error Slice Discovery via Manifold Compactness
par: Yu, Han, et autres
Publié: (2025)
par: Yu, Han, et autres
Publié: (2025)
HGAN-SDEs: Learning Neural Stochastic Differential Equations with Hermite-Guided Adversarial Training
par: Xu, Yuanjian, et autres
Publié: (2025)
par: Xu, Yuanjian, et autres
Publié: (2025)
Documents similaires
-
Effect of Ambient-Intrinsic Dimension Gap on Adversarial Vulnerability
par: Haldar, Rajdeep, et autres
Publié: (2024) -
f-GRPO and Beyond: Divergence-Based Reinforcement Learning Algorithms for General LLM Alignment
par: Haldar, Rajdeep, et autres
Publié: (2026) -
LLM Safety Alignment is Divergence Estimation in Disguise
par: Haldar, Rajdeep, et autres
Publié: (2025) -
Better Representations via Adversarial Training in Pre-Training: A Theoretical Perspective
par: Xing, Yue, et autres
Publié: (2024) -
Fair Supervised Learning with A Simple Random Sampler of Sensitive Attributes
par: Sohn, Jinwon, et autres
Publié: (2023)