Gespeichert in:
| Hauptverfasser: | Mahendru, Sakshi, Pandit, Tejul |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2406.06663 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Venn Diagram Prompting : Accelerating Comprehension with Scaffolding Effect
von: Mahendru, Sakshi, et al.
Veröffentlicht: (2024)
von: Mahendru, Sakshi, et al.
Veröffentlicht: (2024)
KnowPhish: Large Language Models Meet Multimodal Knowledge Graphs for Enhancing Reference-Based Phishing Detection
von: Li, Yuexin, et al.
Veröffentlicht: (2024)
von: Li, Yuexin, et al.
Veröffentlicht: (2024)
Interpretable Ransomware Detection Using Hybrid Large Language Models: A Comparative Analysis of BERT, RoBERTa, and DeBERTa Through LIME and SHAP
von: Ngoie, Elodie Mutombo, et al.
Veröffentlicht: (2025)
von: Ngoie, Elodie Mutombo, et al.
Veröffentlicht: (2025)
Lateral Phishing With Large Language Models: A Large Organization Comparative Study
von: Bethany, Mazal, et al.
Veröffentlicht: (2024)
von: Bethany, Mazal, et al.
Veröffentlicht: (2024)
Securing Large Language Models (LLMs) from Prompt Injection Attacks
von: Suri, Omar Farooq Khan, et al.
Veröffentlicht: (2025)
von: Suri, Omar Farooq Khan, et al.
Veröffentlicht: (2025)
Teach LLMs to Phish: Stealing Private Information from Language Models
von: Panda, Ashwinee, et al.
Veröffentlicht: (2024)
von: Panda, Ashwinee, et al.
Veröffentlicht: (2024)
PhishNet: A Phishing Website Detection Tool using XGBoost
von: Kumar, Prashant, et al.
Veröffentlicht: (2024)
von: Kumar, Prashant, et al.
Veröffentlicht: (2024)
Every Character Counts: From Vulnerability to Defense in Phishing Detection
von: Chiper, Maria, et al.
Veröffentlicht: (2025)
von: Chiper, Maria, et al.
Veröffentlicht: (2025)
Robust and Secure Code Watermarking for Large Language Models via ML/Crypto Codesign
von: Zhang, Ruisi, et al.
Veröffentlicht: (2025)
von: Zhang, Ruisi, et al.
Veröffentlicht: (2025)
Prompted Contextual Vectors for Spear-Phishing Detection
von: Nahmias, Daniel, et al.
Veröffentlicht: (2024)
von: Nahmias, Daniel, et al.
Veröffentlicht: (2024)
Detecting Pretraining Data from Large Language Models
von: Shi, Weijia, et al.
Veröffentlicht: (2023)
von: Shi, Weijia, et al.
Veröffentlicht: (2023)
Token-Specific Watermarking with Enhanced Detectability and Semantic Coherence for Large Language Models
von: Huo, Mingjia, et al.
Veröffentlicht: (2024)
von: Huo, Mingjia, et al.
Veröffentlicht: (2024)
Digger: Detecting Copyright Content Mis-usage in Large Language Model Training
von: Li, Haodong, et al.
Veröffentlicht: (2024)
von: Li, Haodong, et al.
Veröffentlicht: (2024)
A Watermark for Large Language Models
von: Kirchenbauer, John, et al.
Veröffentlicht: (2023)
von: Kirchenbauer, John, et al.
Veröffentlicht: (2023)
Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens
von: Zhang, Anqi, et al.
Veröffentlicht: (2024)
von: Zhang, Anqi, et al.
Veröffentlicht: (2024)
Model Provenance Testing for Large Language Models
von: Nikolic, Ivica, et al.
Veröffentlicht: (2025)
von: Nikolic, Ivica, et al.
Veröffentlicht: (2025)
Publicly-Detectable Watermarking for Language Models
von: Fairoze, Jaiden, et al.
Veröffentlicht: (2023)
von: Fairoze, Jaiden, et al.
Veröffentlicht: (2023)
On the Reliability of Watermarks for Large Language Models
von: Kirchenbauer, John, et al.
Veröffentlicht: (2023)
von: Kirchenbauer, John, et al.
Veröffentlicht: (2023)
TOSSS: a CVE-based Software Security Benchmark for Large Language Models
von: Damie, Marc, et al.
Veröffentlicht: (2026)
von: Damie, Marc, et al.
Veröffentlicht: (2026)
Exploring Vulnerabilities and Protections in Large Language Models: A Survey
von: Liu, Frank Weizhen, et al.
Veröffentlicht: (2024)
von: Liu, Frank Weizhen, et al.
Veröffentlicht: (2024)
Topic-Based Watermarks for Large Language Models
von: Nemecek, Alexander, et al.
Veröffentlicht: (2024)
von: Nemecek, Alexander, et al.
Veröffentlicht: (2024)
Representation Bending for Large Language Model Safety
von: Yousefpour, Ashkan, et al.
Veröffentlicht: (2025)
von: Yousefpour, Ashkan, et al.
Veröffentlicht: (2025)
User Inference Attacks on Large Language Models
von: Kandpal, Nikhil, et al.
Veröffentlicht: (2023)
von: Kandpal, Nikhil, et al.
Veröffentlicht: (2023)
A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models
von: Wu, Yihan, et al.
Veröffentlicht: (2023)
von: Wu, Yihan, et al.
Veröffentlicht: (2023)
Confidence Elicitation: A New Attack Vector for Large Language Models
von: Formento, Brian, et al.
Veröffentlicht: (2025)
von: Formento, Brian, et al.
Veröffentlicht: (2025)
Taylor Unswift: Secured Weight Release for Large Language Models via Taylor Expansion
von: Wang, Guanchu, et al.
Veröffentlicht: (2024)
von: Wang, Guanchu, et al.
Veröffentlicht: (2024)
Learning to Poison Large Language Models for Downstream Manipulation
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2024)
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2024)
Watermarks for Embeddings-as-a-Service Large Language Models
von: Shetty, Anudeex
Veröffentlicht: (2025)
von: Shetty, Anudeex
Veröffentlicht: (2025)
Composite Backdoor Attacks Against Large Language Models
von: Huang, Hai, et al.
Veröffentlicht: (2023)
von: Huang, Hai, et al.
Veröffentlicht: (2023)
Detecting and Understanding Vulnerabilities in Language Models via Mechanistic Interpretability
von: García-Carrasco, Jorge, et al.
Veröffentlicht: (2024)
von: García-Carrasco, Jorge, et al.
Veröffentlicht: (2024)
Improved Techniques for Optimization-Based Jailbreaking on Large Language Models
von: Jia, Xiaojun, et al.
Veröffentlicht: (2024)
von: Jia, Xiaojun, et al.
Veröffentlicht: (2024)
An Early Categorization of Prompt Injection Attacks on Large Language Models
von: Rossi, Sippo, et al.
Veröffentlicht: (2024)
von: Rossi, Sippo, et al.
Veröffentlicht: (2024)
Differentially Private Next-Token Prediction of Large Language Models
von: Flemings, James, et al.
Veröffentlicht: (2024)
von: Flemings, James, et al.
Veröffentlicht: (2024)
TFL: Targeted Bit-Flip Attack on Large Language Model
von: Guo, Jingkai, et al.
Veröffentlicht: (2026)
von: Guo, Jingkai, et al.
Veröffentlicht: (2026)
VERA: Variational Inference Framework for Jailbreaking Large Language Models
von: Lochab, Anamika, et al.
Veröffentlicht: (2025)
von: Lochab, Anamika, et al.
Veröffentlicht: (2025)
Hijacking Large Language Models via Adversarial In-Context Learning
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2023)
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2023)
Privacy Preserving In-Context-Learning Framework for Large Language Models
von: Bhusal, Bishnu, et al.
Veröffentlicht: (2025)
von: Bhusal, Bishnu, et al.
Veröffentlicht: (2025)
Jailbreak-Zero: A Path to Pareto Optimal Red Teaming for Large Language Models
von: Hu, Kai, et al.
Veröffentlicht: (2025)
von: Hu, Kai, et al.
Veröffentlicht: (2025)
SafeCOMM: A Study on Safety Degradation in Fine-Tuned Telecom Large Language Models
von: Djuhera, Aladin, et al.
Veröffentlicht: (2025)
von: Djuhera, Aladin, et al.
Veröffentlicht: (2025)
Advancing Adversarial Suffix Transfer Learning on Aligned Large Language Models
von: Liu, Hongfu, et al.
Veröffentlicht: (2024)
von: Liu, Hongfu, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Venn Diagram Prompting : Accelerating Comprehension with Scaffolding Effect
von: Mahendru, Sakshi, et al.
Veröffentlicht: (2024) -
KnowPhish: Large Language Models Meet Multimodal Knowledge Graphs for Enhancing Reference-Based Phishing Detection
von: Li, Yuexin, et al.
Veröffentlicht: (2024) -
Interpretable Ransomware Detection Using Hybrid Large Language Models: A Comparative Analysis of BERT, RoBERTa, and DeBERTa Through LIME and SHAP
von: Ngoie, Elodie Mutombo, et al.
Veröffentlicht: (2025) -
Lateral Phishing With Large Language Models: A Large Organization Comparative Study
von: Bethany, Mazal, et al.
Veröffentlicht: (2024) -
Securing Large Language Models (LLMs) from Prompt Injection Attacks
von: Suri, Omar Farooq Khan, et al.
Veröffentlicht: (2025)