SecPE: Secure Prompt Ensembling for Private and Robust Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Jiawen, Chen, Kejia, Feng, Zunlei, Lou, Jian, Song, Mingli, Liu, Jian, Yang, Xiaohu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Activation Approximations Can Incur Safety Vulnerabilities Even in Aligned LLMs: Comprehensive Analysis and Defense
von: Zhang, Jiawen, et al.
Veröffentlicht: (2025)
von: Zhang, Jiawen, et al.
Veröffentlicht: (2025)
Mitigating Many-shot Jailbreak Attacks with One Single Demonstration
von: Chen, Kejia, et al.
Veröffentlicht: (2026)
von: Chen, Kejia, et al.
Veröffentlicht: (2026)
A Certified Robust Watermark For Large Language Models
von: Feng, Xianheng, et al.
Veröffentlicht: (2024)
von: Feng, Xianheng, et al.
Veröffentlicht: (2024)
Securing Large Language Models: Addressing Bias, Misinformation, and Prompt Attacks
von: Peng, Benji, et al.
Veröffentlicht: (2024)
von: Peng, Benji, et al.
Veröffentlicht: (2024)
SecReEvalBench: A Multi-turned Security Resilience Evaluation Benchmark for Large Language Models
von: Cui, Huining, et al.
Veröffentlicht: (2025)
von: Cui, Huining, et al.
Veröffentlicht: (2025)
Improving Adversarial Robustness via Feature Pattern Consistency Constraint
von: Hu, Jiacong, et al.
Veröffentlicht: (2024)
von: Hu, Jiacong, et al.
Veröffentlicht: (2024)
HardSecBench: Benchmarking the Security Awareness of LLMs for Hardware Code Generation
von: Chen, Qirui, et al.
Veröffentlicht: (2026)
von: Chen, Qirui, et al.
Veröffentlicht: (2026)
SecDTD: Dynamic Token Drop for Secure Transformers Inference
von: Cai, Yifei, et al.
Veröffentlicht: (2026)
von: Cai, Yifei, et al.
Veröffentlicht: (2026)
Meta SecAlign: A Secure Foundation LLM Against Prompt Injection Attacks
von: Chen, Sizhe, et al.
Veröffentlicht: (2025)
von: Chen, Sizhe, et al.
Veröffentlicht: (2025)
CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models
von: Wahréus, Johan, et al.
Veröffentlicht: (2025)
von: Wahréus, Johan, et al.
Veröffentlicht: (2025)
SecPI: Secure Code Generation with Reasoning Models via Security Reasoning Internalization
von: Wang, Hao, et al.
Veröffentlicht: (2026)
von: Wang, Hao, et al.
Veröffentlicht: (2026)
PRIVMARK: Private Large Language Models Watermarking with MPC
von: Fargues, Thomas, et al.
Veröffentlicht: (2025)
von: Fargues, Thomas, et al.
Veröffentlicht: (2025)
SecGoal: A Benchmark for Extracting Formalizable Security Goals from Protocol Documents
von: Huang, Dawei, et al.
Veröffentlicht: (2026)
von: Huang, Dawei, et al.
Veröffentlicht: (2026)
SoK: Taxonomy and Evaluation of Prompt Security in Large Language Models
von: Hong, Hanbin, et al.
Veröffentlicht: (2025)
von: Hong, Hanbin, et al.
Veröffentlicht: (2025)
Adversary-Aware DPO: Enhancing Safety Alignment in Vision Language Models via Adversarial Training
von: Weng, Fenghua, et al.
Veröffentlicht: (2025)
von: Weng, Fenghua, et al.
Veröffentlicht: (2025)
Rotated Robustness: A Training-Free Defense against Bit-Flip Attacks on Large Language Models
von: Liu, Deng, et al.
Veröffentlicht: (2026)
von: Liu, Deng, et al.
Veröffentlicht: (2026)
CellSecInspector: Safeguarding Cellular Networks via Automated Security Analysis on Specifications
von: Xie, Ke, et al.
Veröffentlicht: (2025)
von: Xie, Ke, et al.
Veröffentlicht: (2025)
SecIC3: Customizing IC3 for Hardware Security Verification
von: Tan, Qinhan, et al.
Veröffentlicht: (2026)
von: Tan, Qinhan, et al.
Veröffentlicht: (2026)
Federated Large Language Models: Feasibility, Robustness, Security and Future Directions
von: Jiang, Wenhao, et al.
Veröffentlicht: (2025)
von: Jiang, Wenhao, et al.
Veröffentlicht: (2025)
A Cross-Modal Prompt Injection Attack against Large Vision-Language Models with Image-Only Perturbation
von: Yang, Hao, et al.
Veröffentlicht: (2026)
von: Yang, Hao, et al.
Veröffentlicht: (2026)
SecAlign: Defending Against Prompt Injection with Preference Optimization
von: Chen, Sizhe, et al.
Veröffentlicht: (2024)
von: Chen, Sizhe, et al.
Veröffentlicht: (2024)
CyberSecEval 2: A Wide-Ranging Cybersecurity Evaluation Suite for Large Language Models
von: Bhatt, Manish, et al.
Veröffentlicht: (2024)
von: Bhatt, Manish, et al.
Veröffentlicht: (2024)
PCEvolve: Private Contrastive Evolution for Synthetic Dataset Generation via Few-Shot Private Data and Generative APIs
von: Zhang, Jianqing, et al.
Veröffentlicht: (2025)
von: Zhang, Jianqing, et al.
Veröffentlicht: (2025)
SecCodePRM: A Process Reward Model for Code Security
von: Yu, Weichen, et al.
Veröffentlicht: (2026)
von: Yu, Weichen, et al.
Veröffentlicht: (2026)
Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security
von: Dai, Muzhi, et al.
Veröffentlicht: (2025)
von: Dai, Muzhi, et al.
Veröffentlicht: (2025)
SecInfer: Preventing Prompt Injection via Inference-time Scaling
von: Liu, Yupei, et al.
Veröffentlicht: (2025)
von: Liu, Yupei, et al.
Veröffentlicht: (2025)
λ-SecAgg: Partial Vector Freezing for Lightweight Secure Aggregation in Federated Learning
von: Zhang, Siqing, et al.
Veröffentlicht: (2023)
von: Zhang, Siqing, et al.
Veröffentlicht: (2023)
CredSec: A Blockchain-based Secure Credential Management System for University Adoption
von: Habib, Md. Ahsan, et al.
Veröffentlicht: (2024)
von: Habib, Md. Ahsan, et al.
Veröffentlicht: (2024)
PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts
von: Zhu, Kaijie, et al.
Veröffentlicht: (2023)
von: Zhu, Kaijie, et al.
Veröffentlicht: (2023)
Chain-of-Thought Prompting of Large Language Models for Discovering and Fixing Software Vulnerabilities
von: Nong, Yu, et al.
Veröffentlicht: (2024)
von: Nong, Yu, et al.
Veröffentlicht: (2024)
Anticipating Adversary Behavior in DevSecOps Scenarios through Large Language Models
von: Caballero, Mario Marín, et al.
Veröffentlicht: (2026)
von: Caballero, Mario Marín, et al.
Veröffentlicht: (2026)
SecTracer: A Framework for Uncovering the Root Causes of Network Intrusions via Security Provenance
von: Lee, Seunghyeon, et al.
Veröffentlicht: (2025)
von: Lee, Seunghyeon, et al.
Veröffentlicht: (2025)
Efficiently Achieving Secure Model Training and Secure Aggregation to Ensure Bidirectional Privacy-Preservation in Federated Learning
von: Yang, Xue, et al.
Veröffentlicht: (2024)
von: Yang, Xue, et al.
Veröffentlicht: (2024)
SecMoE: Communication-Efficient Secure MoE Inference via Select-Then-Compute
von: Shen, Bowen, et al.
Veröffentlicht: (2026)
von: Shen, Bowen, et al.
Veröffentlicht: (2026)
BMC4TimeSec: Verification Of Timed Security Protocols
von: Zbrzezny, Agnieszka M.
Veröffentlicht: (2026)
von: Zbrzezny, Agnieszka M.
Veröffentlicht: (2026)
CS-Eval: A Comprehensive Large Language Model Benchmark for CyberSecurity
von: Yu, Zhengmin, et al.
Veröffentlicht: (2024)
von: Yu, Zhengmin, et al.
Veröffentlicht: (2024)
Large Language Models for Cyber Security
von: Somani, Raunak, et al.
Veröffentlicht: (2025)
von: Somani, Raunak, et al.
Veröffentlicht: (2025)
Efficient Byzantine-Robust Privacy-Preserving Federated Learning via Dimension Compression
von: Qin, Xian, et al.
Veröffentlicht: (2025)
von: Qin, Xian, et al.
Veröffentlicht: (2025)
EM-MIAs: Enhancing Membership Inference Attacks in Large Language Models through Ensemble Modeling
von: Song, Zichen, et al.
Veröffentlicht: (2024)
von: Song, Zichen, et al.
Veröffentlicht: (2024)
Large Language Models for Blockchain Security: A Systematic Literature Review
von: He, Zheyuan, et al.
Veröffentlicht: (2024)
von: He, Zheyuan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Activation Approximations Can Incur Safety Vulnerabilities Even in Aligned LLMs: Comprehensive Analysis and Defense
von: Zhang, Jiawen, et al.
Veröffentlicht: (2025) -
Mitigating Many-shot Jailbreak Attacks with One Single Demonstration
von: Chen, Kejia, et al.
Veröffentlicht: (2026) -
A Certified Robust Watermark For Large Language Models
von: Feng, Xianheng, et al.
Veröffentlicht: (2024) -
Securing Large Language Models: Addressing Bias, Misinformation, and Prompt Attacks
von: Peng, Benji, et al.
Veröffentlicht: (2024) -
SecReEvalBench: A Multi-turned Security Resilience Evaluation Benchmark for Large Language Models
von: Cui, Huining, et al.
Veröffentlicht: (2025)