PermLLM: Private Inference of Large Language Models within 3 Seconds under WAN
Fuente:
arXiv
Saved in:
| Main Authors: | Zheng, Fei, Chen, Chaochao, Han, Zhongxuan, Zheng, Xiaolin |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Kangaroo: A Private and Amortized Inference Framework over WAN for Large-Scale Decision Tree Evaluation
by: Xu, Wei, et al.
Published: (2025)
by: Xu, Wei, et al.
Published: (2025)
Federated Learning on Non-iid Data via Local and Global Distillation
by: Zheng, Xiaolin, et al.
Published: (2023)
by: Zheng, Xiaolin, et al.
Published: (2023)
Accelerating Private Large Transformers Inference through Fine-grained Collaborative Computation
by: Chen, Yuntian, et al.
Published: (2024)
by: Chen, Yuntian, et al.
Published: (2024)
Efficient and High-Accuracy Private CNN Inference with Helper-Assisted Malicious Security
by: Wang, Kaiwen, et al.
Published: (2025)
by: Wang, Kaiwen, et al.
Published: (2025)
PADER: Paillier-based Secure Decentralized Social Recommendation
by: Chen, Chaochao, et al.
Published: (2026)
by: Chen, Chaochao, et al.
Published: (2026)
Safely Learning with Private Data: A Federated Learning Framework for Large Language Model
by: Zheng, JiaYing, et al.
Published: (2024)
by: Zheng, JiaYing, et al.
Published: (2024)
Comet: Accelerating Private Inference for Large Language Model by Predicting Activation Sparsity
by: Yan, Guang, et al.
Published: (2025)
by: Yan, Guang, et al.
Published: (2025)
Practical Secure Inference Algorithm for Fine-tuned Large Language Model Based on Fully Homomorphic Encryption
by: Ruoyan, Zhang, et al.
Published: (2025)
by: Ruoyan, Zhang, et al.
Published: (2025)
KinGuard: Hierarchical Kinship-Aware Fingerprinting to Defend Against Large Language Model Stealing
by: Xu, Zhenhua, et al.
Published: (2026)
by: Xu, Zhenhua, et al.
Published: (2026)
Differentially Private Subspace Fine-Tuning for Large Language Models
by: Zheng, Lele, et al.
Published: (2026)
by: Zheng, Lele, et al.
Published: (2026)
SD-WAN over MPLS: A Comprehensive Performance Analysis and Security with Insights into the Future of SD-WAN
by: Tahenni, Abdellah, et al.
Published: (2023)
by: Tahenni, Abdellah, et al.
Published: (2023)
NeuPerm: Disrupting Malware Hidden in Neural Network Parameters by Leveraging Permutation Symmetry
by: Gilkarov, Daniel, et al.
Published: (2025)
by: Gilkarov, Daniel, et al.
Published: (2025)
PRIVMARK: Private Large Language Models Watermarking with MPC
by: Fargues, Thomas, et al.
Published: (2025)
by: Fargues, Thomas, et al.
Published: (2025)
RobPI: Robust Private Inference against Malicious Client
by: Xue, Jiaqi, et al.
Published: (2026)
by: Xue, Jiaqi, et al.
Published: (2026)
PermRust: A Token-based Permission System for Rust
by: Gehring, Lukas, et al.
Published: (2025)
by: Gehring, Lukas, et al.
Published: (2025)
AdaPI: Facilitating DNN Model Adaptivity for Efficient Private Inference in Edge Computing
by: Zhou, Tong, et al.
Published: (2024)
by: Zhou, Tong, et al.
Published: (2024)
Inferentially-Private Private Information
by: Wang, Shuaiqi, et al.
Published: (2024)
by: Wang, Shuaiqi, et al.
Published: (2024)
MPCache: MPC-Friendly KV Cache Eviction for Efficient Private LLM Inference
by: Zeng, Wenxuan, et al.
Published: (2025)
by: Zeng, Wenxuan, et al.
Published: (2025)
Cascade: Token-Sharded Private LLM Inference
by: Thomas, Rahul, et al.
Published: (2025)
by: Thomas, Rahul, et al.
Published: (2025)
LoRaWAN attack in military use case
by: Derache, Georges, et al.
Published: (2024)
by: Derache, Georges, et al.
Published: (2024)
DCS Chain: A Flexible Private Blockchain System
by: Zheng, Jianwu, et al.
Published: (2024)
by: Zheng, Jianwu, et al.
Published: (2024)
Prompt Inference Attack on Distributed Large Language Model Inference Frameworks
by: Luo, Xinjian, et al.
Published: (2025)
by: Luo, Xinjian, et al.
Published: (2025)
AERO: Entropy-Guided Framework for Private LLM Inference
by: Jha, Nandan Kumar, et al.
Published: (2024)
by: Jha, Nandan Kumar, et al.
Published: (2024)
CipherPrune: Efficient and Scalable Private Transformer Inference
by: Zhang, Yancheng, et al.
Published: (2025)
by: Zhang, Yancheng, et al.
Published: (2025)
Prompt Public Large Language Models to Synthesize Data for Private On-device Applications
by: Wu, Shanshan, et al.
Published: (2024)
by: Wu, Shanshan, et al.
Published: (2024)
EvoDefense: Co-Evolving Black-Box Defense with Large Language Models
by: Li, Yu, et al.
Published: (2026)
by: Li, Yu, et al.
Published: (2026)
Predicting memorization within Large Language Models fine-tuned for classification
by: Dentan, Jérémie, et al.
Published: (2024)
by: Dentan, Jérémie, et al.
Published: (2024)
Differentially Private and Communication Efficient Large Language Model Split Inference via Stochastic Quantization and Soft Prompt
by: Gu, Yujie, et al.
Published: (2026)
by: Gu, Yujie, et al.
Published: (2026)
TruncFormer: Private LLM Inference Using Only Truncations
by: Yubeaton, Patrick, et al.
Published: (2024)
by: Yubeaton, Patrick, et al.
Published: (2024)
InferDPT: Privacy-Preserving Inference for Closed-box Large Language Model
by: Tong, Meng, et al.
Published: (2023)
by: Tong, Meng, et al.
Published: (2023)
User Inference Attacks on Large Language Models
by: Kandpal, Nikhil, et al.
Published: (2023)
by: Kandpal, Nikhil, et al.
Published: (2023)
Membership Inference Attacks Against Video Large Language Models
by: Song, Wei, et al.
Published: (2026)
by: Song, Wei, et al.
Published: (2026)
ConfusionPrompt: Practical Private Inference for Online Large Language Models
by: Mai, Peihua, et al.
Published: (2023)
by: Mai, Peihua, et al.
Published: (2023)
Cachemir: Fully Homomorphic Encrypted Inference of Generative Large Language Model with KV Cache
by: Yu, Ye, et al.
Published: (2026)
by: Yu, Ye, et al.
Published: (2026)
Membership Inference Attacks Against Vision-Language Models
by: Hu, Yuke, et al.
Published: (2025)
by: Hu, Yuke, et al.
Published: (2025)
Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models
by: Chen, Zeyuan, et al.
Published: (2026)
by: Chen, Zeyuan, et al.
Published: (2026)
Defenses at Odds: Measuring and Explaining Defense Conflicts in Large Language Models
by: Meng, Xiangtao, et al.
Published: (2026)
by: Meng, Xiangtao, et al.
Published: (2026)
Prompt Inversion Attack against Collaborative Inference of Large Language Models
by: Qu, Wenjie, et al.
Published: (2025)
by: Qu, Wenjie, et al.
Published: (2025)
Harnessing Sparsification in Federated Learning: A Secure, Efficient, and Differentially Private Realization
by: Xu, Shuangqing, et al.
Published: (2025)
by: Xu, Shuangqing, et al.
Published: (2025)
Protecting Split Learning by Potential Energy Loss
by: Zheng, Fei, et al.
Published: (2022)
by: Zheng, Fei, et al.
Published: (2022)
Similar Items
-
Kangaroo: A Private and Amortized Inference Framework over WAN for Large-Scale Decision Tree Evaluation
by: Xu, Wei, et al.
Published: (2025) -
Federated Learning on Non-iid Data via Local and Global Distillation
by: Zheng, Xiaolin, et al.
Published: (2023) -
Accelerating Private Large Transformers Inference through Fine-grained Collaborative Computation
by: Chen, Yuntian, et al.
Published: (2024) -
Efficient and High-Accuracy Private CNN Inference with Helper-Assisted Malicious Security
by: Wang, Kaiwen, et al.
Published: (2025) -
PADER: Paillier-based Secure Decentralized Social Recommendation
by: Chen, Chaochao, et al.
Published: (2026)