Stealing Training Data from Large Language Models in Decentralized Training through Activation Inversion Attack
Fuente:
arXiv
Guardado en:
| Autores principales: | Dai, Chenxi, Lu, Lin, Zhou, Pan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Transpose Attack: Stealing Datasets with Bidirectional Training
por: Amit, Guy, et al.
Publicado: (2023)
por: Amit, Guy, et al.
Publicado: (2023)
Stealing Training Graphs from Graph Neural Networks
por: Lin, Minhua, et al.
Publicado: (2024)
por: Lin, Minhua, et al.
Publicado: (2024)
GRID: Protecting Training Graph from Link Stealing Attacks on GNN Models
por: Lou, Jiadong, et al.
Publicado: (2025)
por: Lou, Jiadong, et al.
Publicado: (2025)
Merger-as-a-Stealer: Stealing Targeted PII from Aligned LLMs with Model Merging
por: Lu, Lin, et al.
Publicado: (2025)
por: Lu, Lin, et al.
Publicado: (2025)
Prompt Stealing Attacks Against Large Language Models
por: Sha, Zeyang, et al.
Publicado: (2024)
por: Sha, Zeyang, et al.
Publicado: (2024)
Large Language Models Merging for Enhancing the Link Stealing Attack on Graph Neural Networks
por: Guan, Faqian, et al.
Publicado: (2024)
por: Guan, Faqian, et al.
Publicado: (2024)
Prompt Inversion Attack against Collaborative Inference of Large Language Models
por: Qu, Wenjie, et al.
Publicado: (2025)
por: Qu, Wenjie, et al.
Publicado: (2025)
Large Language Model Watermark Stealing With Mixed Integer Programming
por: Zhang, Zhaoxi, et al.
Publicado: (2024)
por: Zhang, Zhaoxi, et al.
Publicado: (2024)
A Model Stealing Attack Against Multi-Exit Networks
por: Pan, Li, et al.
Publicado: (2023)
por: Pan, Li, et al.
Publicado: (2023)
KinGuard: Hierarchical Kinship-Aware Fingerprinting to Defend Against Large Language Model Stealing
por: Xu, Zhenhua, et al.
Publicado: (2026)
por: Xu, Zhenhua, et al.
Publicado: (2026)
Defending Against Neural Network Model Inversion Attacks via Data Poisoning
por: Zhou, Shuai, et al.
Publicado: (2024)
por: Zhou, Shuai, et al.
Publicado: (2024)
Stealing the Invisible: Unveiling Pre-Trained CNN Models through Adversarial Examples and Timing Side-Channels
por: Shukla, Shubhi, et al.
Publicado: (2024)
por: Shukla, Shubhi, et al.
Publicado: (2024)
JBShield: Defending Large Language Models from Jailbreak Attacks through Activated Concept Analysis and Manipulation
por: Zhang, Shenyi, et al.
Publicado: (2025)
por: Zhang, Shenyi, et al.
Publicado: (2025)
ARES: Scalable and Practical Gradient Inversion Attack in Federated Learning through Activation Recovery
por: Gong, Zirui, et al.
Publicado: (2026)
por: Gong, Zirui, et al.
Publicado: (2026)
Stealing Part of a Production Language Model
por: Carlini, Nicholas, et al.
Publicado: (2024)
por: Carlini, Nicholas, et al.
Publicado: (2024)
Secret Stealing Attacks on Local LLM Fine-Tuning through Supply-Chain Model Code Backdoors
por: Li, Zi, et al.
Publicado: (2026)
por: Li, Zi, et al.
Publicado: (2026)
Towards Effective Prompt Stealing Attack against Text-to-Image Diffusion Models
por: Zhao, Shiqian, et al.
Publicado: (2025)
por: Zhao, Shiqian, et al.
Publicado: (2025)
Watermark Stealing in Large Language Models
por: Jovanović, Nikola, et al.
Publicado: (2024)
por: Jovanović, Nikola, et al.
Publicado: (2024)
Efficient Data-Free Model Stealing with Label Diversity
por: Liu, Yiyong, et al.
Publicado: (2024)
por: Liu, Yiyong, et al.
Publicado: (2024)
Merge Hijacking: Backdoor Attacks to Model Merging of Large Language Models
por: Yuan, Zenghui, et al.
Publicado: (2025)
por: Yuan, Zenghui, et al.
Publicado: (2025)
Rotated Robustness: A Training-Free Defense against Bit-Flip Attacks on Large Language Models
por: Liu, Deng, et al.
Publicado: (2026)
por: Liu, Deng, et al.
Publicado: (2026)
Large Language Models for Link Stealing Attacks Against Graph Neural Networks
por: Guan, Faqian, et al.
Publicado: (2024)
por: Guan, Faqian, et al.
Publicado: (2024)
Stealing Trust: Unraveling Blind Message Attacks in Web3 Authentication
por: Yan, Kailun, et al.
Publicado: (2024)
por: Yan, Kailun, et al.
Publicado: (2024)
BadTemplate: A Training-Free Backdoor Attack via Chat Template Against Large Language Models
por: Wang, Zihan, et al.
Publicado: (2026)
por: Wang, Zihan, et al.
Publicado: (2026)
Prompt Stealing Attacks Against Text-to-Image Generation Models
por: Shen, Xinyue, et al.
Publicado: (2023)
por: Shen, Xinyue, et al.
Publicado: (2023)
Steering in the Shadows: Causal Amplification for Activation Space Attacks in Large Language Models
por: Xu, Zhiyuan, et al.
Publicado: (2025)
por: Xu, Zhiyuan, et al.
Publicado: (2025)
Black-Box Skill Stealing Attack from Proprietary LLM Agents: An Empirical Study
por: Wang, Zihan, et al.
Publicado: (2026)
por: Wang, Zihan, et al.
Publicado: (2026)
DM4Steal: Diffusion Model For Link Stealing Attack On Graph Neural Networks
por: Chen, Jinyin, et al.
Publicado: (2024)
por: Chen, Jinyin, et al.
Publicado: (2024)
Hijacking Attacks against Neural Networks by Analyzing Training Data
por: Ge, Yunjie, et al.
Publicado: (2024)
por: Ge, Yunjie, et al.
Publicado: (2024)
BadToken: Token-level Backdoor Attacks to Multi-modal Large Language Models
por: Yuan, Zenghui, et al.
Publicado: (2025)
por: Yuan, Zenghui, et al.
Publicado: (2025)
Medical Multimodal Model Stealing Attacks via Adversarial Domain Alignment
por: Shen, Yaling, et al.
Publicado: (2025)
por: Shen, Yaling, et al.
Publicado: (2025)
Uncovering Privacy Vulnerabilities through Analytical Gradient Inversion Attacks
por: Eltaras, Tamer Ahmed, et al.
Publicado: (2025)
por: Eltaras, Tamer Ahmed, et al.
Publicado: (2025)
Model Stealing Attack against Graph Classification with Authenticity, Uncertainty and Diversity
por: Zhu, Zhihao, et al.
Publicado: (2023)
por: Zhu, Zhihao, et al.
Publicado: (2023)
Beyond A Fixed Seal: Adaptive Stealing Watermark in Large Language Models
por: Zhang, Shuhao, et al.
Publicado: (2026)
por: Zhang, Shuhao, et al.
Publicado: (2026)
BESA: Boosting Encoder Stealing Attack with Perturbation Recovery
por: Ren, Xuhao, et al.
Publicado: (2025)
por: Ren, Xuhao, et al.
Publicado: (2025)
Model Inversion Attack against Federated Unlearning
por: Zhou, Lei, et al.
Publicado: (2025)
por: Zhou, Lei, et al.
Publicado: (2025)
InputSnatch: Stealing Input in LLM Services via Timing Side-Channel Attacks
por: Zheng, Xinyao, et al.
Publicado: (2024)
por: Zheng, Xinyao, et al.
Publicado: (2024)
GraphSteal: Structural Knowledge Stealing from Graph RAG via Traversal Reconstruction
por: Gu, Jinze, et al.
Publicado: (2026)
por: Gu, Jinze, et al.
Publicado: (2026)
AutoJailbreak: Exploring Jailbreak Attacks and Defenses through a Dependency Lens
por: Lu, Lin, et al.
Publicado: (2024)
por: Lu, Lin, et al.
Publicado: (2024)
Virtual Context: Enhancing Jailbreak Attacks with Special Token Injection
por: Zhou, Yuqi, et al.
Publicado: (2024)
por: Zhou, Yuqi, et al.
Publicado: (2024)
Ejemplares similares
-
Transpose Attack: Stealing Datasets with Bidirectional Training
por: Amit, Guy, et al.
Publicado: (2023) -
Stealing Training Graphs from Graph Neural Networks
por: Lin, Minhua, et al.
Publicado: (2024) -
GRID: Protecting Training Graph from Link Stealing Attacks on GNN Models
por: Lou, Jiadong, et al.
Publicado: (2025) -
Merger-as-a-Stealer: Stealing Targeted PII from Aligned LLMs with Model Merging
por: Lu, Lin, et al.
Publicado: (2025) -
Prompt Stealing Attacks Against Large Language Models
por: Sha, Zeyang, et al.
Publicado: (2024)