SentinelLMs: Encrypted Input Adaptation and Fine-tuning of Language Models for Private and Secure Inference
Fuente:
arXiv
Guardado en:
| Autores principales: | Mishra, Abhijit, Li, Mingda, Deo, Soham |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ObfuscaTune: Obfuscated Offsite Fine-tuning and Inference of Proprietary LLMs on Private Datasets
por: Frikha, Ahmed, et al.
Publicado: (2024)
por: Frikha, Ahmed, et al.
Publicado: (2024)
A Study of Backdoors in Instruction Fine-tuned Language Models
por: Raghuram, Jayaram, et al.
Publicado: (2024)
por: Raghuram, Jayaram, et al.
Publicado: (2024)
I can't see it but I can Fine-tune it: On Encrypted Fine-tuning of Transformers using Fully Homomorphic Encryption
por: Panzade, Prajwal, et al.
Publicado: (2024)
por: Panzade, Prajwal, et al.
Publicado: (2024)
Window-based Membership Inference Attacks Against Fine-tuned Large Language Models
por: Chen, Yuetian, et al.
Publicado: (2026)
por: Chen, Yuetian, et al.
Publicado: (2026)
DESIGN: Encrypted GNN Inference via Server-Side Input Graph Pruning
por: Zhao, Kaixiang, et al.
Publicado: (2025)
por: Zhao, Kaixiang, et al.
Publicado: (2025)
Virus: Harmful Fine-tuning Attack for Large Language Models Bypassing Guardrail Moderation
por: Huang, Tiansheng, et al.
Publicado: (2025)
por: Huang, Tiansheng, et al.
Publicado: (2025)
LoRA-Leak: Membership Inference Attacks Against LoRA Fine-tuned Language Models
por: Ran, Delong, et al.
Publicado: (2025)
por: Ran, Delong, et al.
Publicado: (2025)
SecureRouter: Encrypted Routing for Efficient Secure Inference
por: Zhang, Yukuan, et al.
Publicado: (2026)
por: Zhang, Yukuan, et al.
Publicado: (2026)
How Private is Your Attention? Bridging Privacy with In-Context Learning
por: Bonnerjee, Soham, et al.
Publicado: (2025)
por: Bonnerjee, Soham, et al.
Publicado: (2025)
Clustering and Median Aggregation Improve Differentially Private Inference
por: Amin, Kareem, et al.
Publicado: (2025)
por: Amin, Kareem, et al.
Publicado: (2025)
Can Differentially Private Fine-tuning LLMs Protect Against Privacy Attacks?
por: Du, Hao, et al.
Publicado: (2025)
por: Du, Hao, et al.
Publicado: (2025)
Large Language Model Sentinel: LLM Agent for Adversarial Purification
por: Lin, Guang, et al.
Publicado: (2024)
por: Lin, Guang, et al.
Publicado: (2024)
Private Fine-tuning of Large Language Models with Zeroth-order Optimization
por: Tang, Xinyu, et al.
Publicado: (2024)
por: Tang, Xinyu, et al.
Publicado: (2024)
Teach LLMs to Phish: Stealing Private Information from Language Models
por: Panda, Ashwinee, et al.
Publicado: (2024)
por: Panda, Ashwinee, et al.
Publicado: (2024)
Obliviate: Neutralizing Task-agnostic Backdoors within the Parameter-efficient Fine-tuning Paradigm
por: Kim, Jaehan, et al.
Publicado: (2024)
por: Kim, Jaehan, et al.
Publicado: (2024)
Efficient Decoding Methods for Language Models on Encrypted Data
por: Avitan, Matan, et al.
Publicado: (2025)
por: Avitan, Matan, et al.
Publicado: (2025)
The Dark Side of Human Feedback: Poisoning Large Language Models via User Inputs
por: Chen, Bocheng, et al.
Publicado: (2024)
por: Chen, Bocheng, et al.
Publicado: (2024)
MAPLE: Metadata Augmented Private Language Evolution
por: Chien, Eli, et al.
Publicado: (2026)
por: Chien, Eli, et al.
Publicado: (2026)
Privately Learning from Graphs with Applications in Fine-tuning Large Language Models
por: Yin, Haoteng, et al.
Publicado: (2024)
por: Yin, Haoteng, et al.
Publicado: (2024)
Case Study: Fine-tuning Small Language Models for Accurate and Private CWE Detection in Python Code
por: Bappy, Md. Azizul Hakim, et al.
Publicado: (2025)
por: Bappy, Md. Azizul Hakim, et al.
Publicado: (2025)
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
por: Huang, Tiansheng, et al.
Publicado: (2024)
por: Huang, Tiansheng, et al.
Publicado: (2024)
Characterizing the Training Dynamics of Private Fine-tuning with Langevin diffusion
por: Ke, Shuqi, et al.
Publicado: (2024)
por: Ke, Shuqi, et al.
Publicado: (2024)
Beyond Gradient and Priors in Privacy Attacks: Leveraging Pooler Layer Inputs of Language Models in Federated Learning
por: Li, Jianwei, et al.
Publicado: (2023)
por: Li, Jianwei, et al.
Publicado: (2023)
STShield: Single-Token Sentinel for Real-Time Jailbreak Detection in Large Language Models
por: Wang, Xunguang, et al.
Publicado: (2025)
por: Wang, Xunguang, et al.
Publicado: (2025)
PACZero: PAC-Private Fine-Tuning of Language Models via Sign Quantization
por: Ertan, Murat Bilgehan, et al.
Publicado: (2026)
por: Ertan, Murat Bilgehan, et al.
Publicado: (2026)
SVIP: Towards Verifiable Inference of Open-source Large Language Models
por: Sun, Yifan, et al.
Publicado: (2024)
por: Sun, Yifan, et al.
Publicado: (2024)
Fine-Tuning Language Models with Differential Privacy through Adaptive Noise Allocation
por: Li, Xianzhi, et al.
Publicado: (2024)
por: Li, Xianzhi, et al.
Publicado: (2024)
Securing Multi-turn Conversational Language Models From Distributed Backdoor Triggers
por: Tong, Terry, et al.
Publicado: (2024)
por: Tong, Terry, et al.
Publicado: (2024)
Token-level Data Selection for Safe LLM Fine-tuning
por: Li, Yanping, et al.
Publicado: (2026)
por: Li, Yanping, et al.
Publicado: (2026)
Encrypted Large Model Inference: The Equivariant Encryption Paradigm
por: Buban, James, et al.
Publicado: (2025)
por: Buban, James, et al.
Publicado: (2025)
Pharmacist: Safety Alignment Data Curation for Large Language Models against Harmful Fine-tuning
por: Liu, Guozhi, et al.
Publicado: (2025)
por: Liu, Guozhi, et al.
Publicado: (2025)
The Janus Interface: How Fine-Tuning in Large Language Models Amplifies the Privacy Risks
por: Chen, Xiaoyi, et al.
Publicado: (2023)
por: Chen, Xiaoyi, et al.
Publicado: (2023)
Taylor Unswift: Secured Weight Release for Large Language Models via Taylor Expansion
por: Wang, Guanchu, et al.
Publicado: (2024)
por: Wang, Guanchu, et al.
Publicado: (2024)
Dynamic Orthogonal Continual Fine-tuning for Mitigating Catastrophic Forgettings
por: Zhang, Zhixin, et al.
Publicado: (2025)
por: Zhang, Zhixin, et al.
Publicado: (2025)
Adversarial Intent is a Latent Variable: Stateful Trust Inference for Securing Multimodal Agentic RAG
por: Singh, Inderjeet, et al.
Publicado: (2026)
por: Singh, Inderjeet, et al.
Publicado: (2026)
Safety Anchor: Defending Harmful Fine-tuning via Geometric Bottlenecks
por: Lu, Guoxin, et al.
Publicado: (2026)
por: Lu, Guoxin, et al.
Publicado: (2026)
Context-Aware Membership Inference Attacks against Pre-trained Large Language Models
por: Chang, Hongyan, et al.
Publicado: (2024)
por: Chang, Hongyan, et al.
Publicado: (2024)
Linearizing Models for Efficient yet Robust Private Inference
por: Sarkar, Sreetama, et al.
Publicado: (2024)
por: Sarkar, Sreetama, et al.
Publicado: (2024)
Differentially Private Learning Needs Better Model Initialization and Self-Distillation
por: Ngong, Ivoline C., et al.
Publicado: (2024)
por: Ngong, Ivoline C., et al.
Publicado: (2024)
DP-LAC: Lightweight Adaptive Clipping for Differentially Private Federated Fine-tuning of Language Models
por: Mehmood, Haaris, et al.
Publicado: (2026)
por: Mehmood, Haaris, et al.
Publicado: (2026)
Ejemplares similares
-
ObfuscaTune: Obfuscated Offsite Fine-tuning and Inference of Proprietary LLMs on Private Datasets
por: Frikha, Ahmed, et al.
Publicado: (2024) -
A Study of Backdoors in Instruction Fine-tuned Language Models
por: Raghuram, Jayaram, et al.
Publicado: (2024) -
I can't see it but I can Fine-tune it: On Encrypted Fine-tuning of Transformers using Fully Homomorphic Encryption
por: Panzade, Prajwal, et al.
Publicado: (2024) -
Window-based Membership Inference Attacks Against Fine-tuned Large Language Models
por: Chen, Yuetian, et al.
Publicado: (2026) -
DESIGN: Encrypted GNN Inference via Server-Side Input Graph Pruning
por: Zhao, Kaixiang, et al.
Publicado: (2025)