CipherPrune: Efficient and Scalable Private Transformer Inference
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Yancheng, Xue, Jiaqi, Zheng, Mengxin, Xie, Mimi, Zhang, Mingzhe, Jiang, Lei, Lou, Qian |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
RobPI: Robust Private Inference against Malicious Client
von: Xue, Jiaqi, et al.
Veröffentlicht: (2026)
von: Xue, Jiaqi, et al.
Veröffentlicht: (2026)
CR-UTP: Certified Robustness against Universal Text Perturbations on Large Language Models
von: Lou, Qian, et al.
Veröffentlicht: (2024)
von: Lou, Qian, et al.
Veröffentlicht: (2024)
DictPFL: Efficient and Private Federated Learning on Encrypted Gradients
von: Xue, Jiaqi, et al.
Veröffentlicht: (2025)
von: Xue, Jiaqi, et al.
Veröffentlicht: (2025)
TFHE-Coder: Evaluating LLM-agentic Fully Homomorphic Encryption Code Generation
von: Kumar, Mayank, et al.
Veröffentlicht: (2025)
von: Kumar, Mayank, et al.
Veröffentlicht: (2025)
Securing Transformer-based AI Execution via Unified TEEs and Crypto-protected Accelerators
von: Xue, Jiaqi, et al.
Veröffentlicht: (2025)
von: Xue, Jiaqi, et al.
Veröffentlicht: (2025)
BadFair: Backdoored Fairness Attacks with Group-conditioned Triggers
von: Xue, Jiaqi, et al.
Veröffentlicht: (2024)
von: Xue, Jiaqi, et al.
Veröffentlicht: (2024)
CryptoTrain: Fast Secure Training on Encrypted Dataset
von: Xue, Jiaqi, et al.
Veröffentlicht: (2024)
von: Xue, Jiaqi, et al.
Veröffentlicht: (2024)
SSL-Cleanse: Trojan Detection and Mitigation in Self-Supervised Learning
von: Zheng, Mengxin, et al.
Veröffentlicht: (2023)
von: Zheng, Mengxin, et al.
Veröffentlicht: (2023)
SecureRouter: Encrypted Routing for Efficient Secure Inference
von: Zhang, Yukuan, et al.
Veröffentlicht: (2026)
von: Zhang, Yukuan, et al.
Veröffentlicht: (2026)
Ditto: Quantization-aware Secure Inference of Transformers upon MPC
von: Wu, Haoqi, et al.
Veröffentlicht: (2024)
von: Wu, Haoqi, et al.
Veröffentlicht: (2024)
zkVC: Fast Zero-Knowledge Proof for Private and Verifiable Computing
von: Zhang, Yancheng, et al.
Veröffentlicht: (2025)
von: Zhang, Yancheng, et al.
Veröffentlicht: (2025)
PRO: Enabling Precise and Robust Text Watermark for Open-Source LLMs
von: Xue, Jiaqi, et al.
Veröffentlicht: (2025)
von: Xue, Jiaqi, et al.
Veröffentlicht: (2025)
Private and Communication-Efficient Federated Learning based on Differentially Private Sketches
von: Zhang, Meifan, et al.
Veröffentlicht: (2024)
von: Zhang, Meifan, et al.
Veröffentlicht: (2024)
CipherFormer: Efficient Transformer Private Inference with Low Round Complexity
von: Wang, Weize, et al.
Veröffentlicht: (2024)
von: Wang, Weize, et al.
Veröffentlicht: (2024)
DESIGN: Encrypted GNN Inference via Server-Side Input Graph Pruning
von: Zhao, Kaixiang, et al.
Veröffentlicht: (2025)
von: Zhao, Kaixiang, et al.
Veröffentlicht: (2025)
BadRAG: Identifying Vulnerabilities in Retrieval Augmented Generation of Large Language Models
von: Xue, Jiaqi, et al.
Veröffentlicht: (2024)
von: Xue, Jiaqi, et al.
Veröffentlicht: (2024)
AdaPI: Facilitating DNN Model Adaptivity for Efficient Private Inference in Edge Computing
von: Zhou, Tong, et al.
Veröffentlicht: (2024)
von: Zhou, Tong, et al.
Veröffentlicht: (2024)
Private, Efficient and Scalable Kernel Learning for Medical Image Analysis
von: Hannemann, Anika, et al.
Veröffentlicht: (2024)
von: Hannemann, Anika, et al.
Veröffentlicht: (2024)
MetaCipher: A Time-Persistent and Universal Multi-Agent Framework for Cipher-Based Jailbreak Attacks for LLMs
von: Chen, Boyuan, et al.
Veröffentlicht: (2025)
von: Chen, Boyuan, et al.
Veröffentlicht: (2025)
Comet: A Communication-efficient and Performant Approximation for Private Transformer Inference
von: Xu, Xiangrui, et al.
Veröffentlicht: (2024)
von: Xu, Xiangrui, et al.
Veröffentlicht: (2024)
DeepShare: Sharing ReLU Across Channels and Layers for Efficient Private Inference
von: Bornfeld, Yonathan, et al.
Veröffentlicht: (2025)
von: Bornfeld, Yonathan, et al.
Veröffentlicht: (2025)
Secure Transformer Inference Protocol
von: Yuan, Mu, et al.
Veröffentlicht: (2023)
von: Yuan, Mu, et al.
Veröffentlicht: (2023)
Optimized Tradeoffs for Private Prediction with Majority Ensembling
von: Jiang, Shuli, et al.
Veröffentlicht: (2024)
von: Jiang, Shuli, et al.
Veröffentlicht: (2024)
Delving into Differentially Private Transformer
von: Ding, Youlong, et al.
Veröffentlicht: (2024)
von: Ding, Youlong, et al.
Veröffentlicht: (2024)
Cascade: Token-Sharded Private LLM Inference
von: Thomas, Rahul, et al.
Veröffentlicht: (2025)
von: Thomas, Rahul, et al.
Veröffentlicht: (2025)
Noise-Aware Differentially Private Variational Inference
von: Alrawajfeh, Talal, et al.
Veröffentlicht: (2024)
von: Alrawajfeh, Talal, et al.
Veröffentlicht: (2024)
Deep Learning-Assisted Improved Differential Fault Attacks on Lightweight Stream Ciphers
von: Lim, Kok Ping, et al.
Veröffentlicht: (2026)
von: Lim, Kok Ping, et al.
Veröffentlicht: (2026)
Differentially Private Federated Learning without Noise Addition: When is it Possible?
von: Zhang, Jiang, et al.
Veröffentlicht: (2024)
von: Zhang, Jiang, et al.
Veröffentlicht: (2024)
Linearizing Models for Efficient yet Robust Private Inference
von: Sarkar, Sreetama, et al.
Veröffentlicht: (2024)
von: Sarkar, Sreetama, et al.
Veröffentlicht: (2024)
AERO: Entropy-Guided Framework for Private LLM Inference
von: Jha, Nandan Kumar, et al.
Veröffentlicht: (2024)
von: Jha, Nandan Kumar, et al.
Veröffentlicht: (2024)
Secure Aggregation is Not Private Against Membership Inference Attacks
von: Ngo, Khac-Hoang, et al.
Veröffentlicht: (2024)
von: Ngo, Khac-Hoang, et al.
Veröffentlicht: (2024)
A Machine Learning-Based Framework for Assessing Cryptographic Indistinguishability of Lightweight Block Ciphers
von: Dani, Jimmy, et al.
Veröffentlicht: (2024)
von: Dani, Jimmy, et al.
Veröffentlicht: (2024)
OmniLytics+: A Secure, Efficient, and Affordable Blockchain Data Market for Machine Learning through Off-Chain Processing
von: Li, Songze, et al.
Veröffentlicht: (2024)
von: Li, Songze, et al.
Veröffentlicht: (2024)
TruncFormer: Private LLM Inference Using Only Truncations
von: Yubeaton, Patrick, et al.
Veröffentlicht: (2024)
von: Yubeaton, Patrick, et al.
Veröffentlicht: (2024)
Practical and Private Hybrid ML Inference with Fully Homomorphic Encryption
von: Biswas, Sayan, et al.
Veröffentlicht: (2025)
von: Biswas, Sayan, et al.
Veröffentlicht: (2025)
xMLP: Revolutionizing Private Inference with Exclusive Square Activation
von: Li, Jiajie, et al.
Veröffentlicht: (2024)
von: Li, Jiajie, et al.
Veröffentlicht: (2024)
SecFormer: Fast and Accurate Privacy-Preserving Inference for Transformer Models via SMPC
von: Luo, Jinglong, et al.
Veröffentlicht: (2024)
von: Luo, Jinglong, et al.
Veröffentlicht: (2024)
SpinML: Customized Synthetic Data Generation for Private Training of Specialized ML Models
von: Zhang, Jiang, et al.
Veröffentlicht: (2025)
von: Zhang, Jiang, et al.
Veröffentlicht: (2025)
Revisiting Gradient Pruning: A Dual Realization for Defending against Gradient Attacks
von: Xue, Lulu, et al.
Veröffentlicht: (2024)
von: Xue, Lulu, et al.
Veröffentlicht: (2024)
Differentially Private Random Feature Model
von: Liao, Chunyang, et al.
Veröffentlicht: (2024)
von: Liao, Chunyang, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
RobPI: Robust Private Inference against Malicious Client
von: Xue, Jiaqi, et al.
Veröffentlicht: (2026) -
CR-UTP: Certified Robustness against Universal Text Perturbations on Large Language Models
von: Lou, Qian, et al.
Veröffentlicht: (2024) -
DictPFL: Efficient and Private Federated Learning on Encrypted Gradients
von: Xue, Jiaqi, et al.
Veröffentlicht: (2025) -
TFHE-Coder: Evaluating LLM-agentic Fully Homomorphic Encryption Code Generation
von: Kumar, Mayank, et al.
Veröffentlicht: (2025) -
Securing Transformer-based AI Execution via Unified TEEs and Crypto-protected Accelerators
von: Xue, Jiaqi, et al.
Veröffentlicht: (2025)