Enregistré dans:
| Auteurs principaux: | Lin, Zilong, Cui, Jian, Liao, Xiaojing, Wang, XiaoFeng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2401.03315 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MAWSEO: Adversarial Wiki Search Poisoning for Illicit Online Promotion
par: Lin, Zilong, et autres
Publié: (2023)
par: Lin, Zilong, et autres
Publié: (2023)
Consiglieres in the Shadow: Understanding the Use of Uncensored Large Language Models in Cybercrimes
par: Lin, Zilong, et autres
Publié: (2025)
par: Lin, Zilong, et autres
Publié: (2025)
Leveraging Large Language Models to Detect npm Malicious Packages
par: Zahan, Nusrat, et autres
Publié: (2024)
par: Zahan, Nusrat, et autres
Publié: (2024)
Invisible Prompts, Visible Threats: Malicious Font Injection in External Resources for Large Language Models
par: Xiong, Junjie, et autres
Publié: (2025)
par: Xiong, Junjie, et autres
Publié: (2025)
Hallucinating AI Hijacking Attack: Large Language Models and Malicious Code Recommenders
par: Noever, David, et autres
Publié: (2024)
par: Noever, David, et autres
Publié: (2024)
Hide Your Malicious Goal Into Benign Narratives: Jailbreak Large Language Models through Carrier Articles
par: Wang, Zhilong, et autres
Publié: (2024)
par: Wang, Zhilong, et autres
Publié: (2024)
Hidden You Malicious Goal Into Benign Narratives: Jailbreak Large Language Models through Logic Chain Injection
par: Wang, Zhilong, et autres
Publié: (2024)
par: Wang, Zhilong, et autres
Publié: (2024)
A-MemGuard: A Proactive Defense Framework for LLM-Based Agent Memory
par: Wei, Qianshan, et autres
Publié: (2025)
par: Wei, Qianshan, et autres
Publié: (2025)
The Janus Interface: How Fine-Tuning in Large Language Models Amplifies the Privacy Risks
par: Chen, Xiaoyi, et autres
Publié: (2023)
par: Chen, Xiaoyi, et autres
Publié: (2023)
SafeMLRM: Demystifying Safety in Multi-modal Large Reasoning Models
par: Fang, Junfeng, et autres
Publié: (2025)
par: Fang, Junfeng, et autres
Publié: (2025)
Automatically Generating Rules of Malicious Software Packages via Large Language Model
par: Zhang, XiangRui, et autres
Publié: (2025)
par: Zhang, XiangRui, et autres
Publié: (2025)
Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm
par: Pang, Yan, et autres
Publié: (2025)
par: Pang, Yan, et autres
Publié: (2025)
Stealthy Backdoor Attack to Real-world Models in Android Apps
par: Wei, Jiali, et autres
Publié: (2025)
par: Wei, Jiali, et autres
Publié: (2025)
Real-time ML-based Defense Against Malicious Payload in Reconfigurable Embedded Systems
par: Stahle-Smith, Rye, et autres
Publié: (2025)
par: Stahle-Smith, Rye, et autres
Publié: (2025)
SecPE: Secure Prompt Ensembling for Private and Robust Large Language Models
par: Zhang, Jiawen, et autres
Publié: (2025)
par: Zhang, Jiawen, et autres
Publié: (2025)
SDD: Self-Degraded Defense against Malicious Fine-tuning
par: Chen, Zixuan, et autres
Publié: (2025)
par: Chen, Zixuan, et autres
Publié: (2025)
Mobile GUI Agents under Real-world Threats: Are We There Yet?
par: Liu, Guohong, et autres
Publié: (2025)
par: Liu, Guohong, et autres
Publié: (2025)
A Graph-Attentive LSTM Model for Malicious URL Detection
par: Hossain, Md. Ifthekhar, et autres
Publié: (2025)
par: Hossain, Md. Ifthekhar, et autres
Publié: (2025)
Beyond Content Safety: Real-Time Monitoring for Reasoning Vulnerabilities in Large Language Models
par: Wang, Xunguang, et autres
Publié: (2026)
par: Wang, Xunguang, et autres
Publié: (2026)
Selective Amnesia: On Efficient, High-Fidelity and Blind Suppression of Backdoor Effects in Trojaned Machine Learning Models
par: Zhu, Rui, et autres
Publié: (2022)
par: Zhu, Rui, et autres
Publié: (2022)
Large Language Models powered Malicious Traffic Detection: Architecture, Opportunities and Case Study
par: Zhang, Xinggong, et autres
Publié: (2025)
par: Zhang, Xinggong, et autres
Publié: (2025)
Evolving Jailbreaks: Automated Multi-Objective Long-Tail Attacks on Large Language Models
par: Hong, Wenjing, et autres
Publié: (2026)
par: Hong, Wenjing, et autres
Publié: (2026)
Blockchain Data Analysis in the Era of Large-Language Models
par: Toyoda, Kentaroh, et autres
Publié: (2024)
par: Toyoda, Kentaroh, et autres
Publié: (2024)
Benchmarking Safety Risks of Knowledge-Intensive Reasoning under Malicious Knowledge Editing
par: Mao, Qinghua, et autres
Publié: (2026)
par: Mao, Qinghua, et autres
Publié: (2026)
A Vision for Access Control in LLM-based Agent Systems
par: Li, Xinfeng, et autres
Publié: (2025)
par: Li, Xinfeng, et autres
Publié: (2025)
Distilled Large Language Model in Confidential Computing Environment for System-on-Chip Design
par: Ben, Dong, et autres
Publié: (2025)
par: Ben, Dong, et autres
Publié: (2025)
EnJa: Ensemble Jailbreak on Large Language Models
par: Zhang, Jiahao, et autres
Publié: (2024)
par: Zhang, Jiahao, et autres
Publié: (2024)
SafePickle: Robust and Generic ML Detection of Malicious Pickle-based ML Models
par: Ohayon, Hillel, et autres
Publié: (2026)
par: Ohayon, Hillel, et autres
Publié: (2026)
Recent Advances in Attack and Defense Approaches of Large Language Models
par: Cui, Jing, et autres
Publié: (2024)
par: Cui, Jing, et autres
Publié: (2024)
Neural-Inspired Advances in Integral Cryptanalysis
par: Zhang, Liu, et autres
Publié: (2025)
par: Zhang, Liu, et autres
Publié: (2025)
Watermarking Techniques for Large Language Models: A Survey
par: Liang, Yuqing, et autres
Publié: (2024)
par: Liang, Yuqing, et autres
Publié: (2024)
Enhancing GraphQL Security by Detecting Malicious Queries Using Large Language Models, Sentence Transformers, and Convolutional Neural Networks
par: Perera, Irash, et autres
Publié: (2025)
par: Perera, Irash, et autres
Publié: (2025)
VeriLoRA: Fine-Tuning Large Language Models with Verifiable Security via Zero-Knowledge Proofs
par: Liao, Guofu, et autres
Publié: (2025)
par: Liao, Guofu, et autres
Publié: (2025)
AI Safety vs. AI Security: Demystifying the Distinction and Boundaries
par: Lin, Zhiqiang, et autres
Publié: (2025)
par: Lin, Zhiqiang, et autres
Publié: (2025)
A Survey on Data Security in Large Language Models
par: Chen, Kang, et autres
Publié: (2025)
par: Chen, Kang, et autres
Publié: (2025)
A Sentence Relation-Based Approach to Sanitizing Malicious Instructions
par: Datta, Soumil, et autres
Publié: (2026)
par: Datta, Soumil, et autres
Publié: (2026)
RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent
par: Xu, Huiyu, et autres
Publié: (2024)
par: Xu, Huiyu, et autres
Publié: (2024)
Model-based Large Language Model Customization as Service
par: Wu, Zhaomin, et autres
Publié: (2024)
par: Wu, Zhaomin, et autres
Publié: (2024)
DrLLM: Prompt-Enhanced Distributed Denial-of-Service Resistance Method with Large Language Models
par: Yin, Zhenyu, et autres
Publié: (2024)
par: Yin, Zhenyu, et autres
Publié: (2024)
CryptoX : Compositional Reasoning Evaluation of Large Language Models
par: Shi, Jiajun, et autres
Publié: (2025)
par: Shi, Jiajun, et autres
Publié: (2025)
Documents similaires
-
MAWSEO: Adversarial Wiki Search Poisoning for Illicit Online Promotion
par: Lin, Zilong, et autres
Publié: (2023) -
Consiglieres in the Shadow: Understanding the Use of Uncensored Large Language Models in Cybercrimes
par: Lin, Zilong, et autres
Publié: (2025) -
Leveraging Large Language Models to Detect npm Malicious Packages
par: Zahan, Nusrat, et autres
Publié: (2024) -
Invisible Prompts, Visible Threats: Malicious Font Injection in External Resources for Large Language Models
par: Xiong, Junjie, et autres
Publié: (2025) -
Hallucinating AI Hijacking Attack: Large Language Models and Malicious Code Recommenders
par: Noever, David, et autres
Publié: (2024)