Prompt Obfuscation for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Pape, David, Mavali, Sina, Eisenhofer, Thorsten, Schönherr, Lea |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
No More, No Less: Task Alignment in Terminal Agents
por: Mavali, Sina, et al.
Publicado: (2026)
por: Mavali, Sina, et al.
Publicado: (2026)
Whispers in the Machine: Confidentiality in Agentic Systems
por: Evertz, Jonathan, et al.
Publicado: (2024)
por: Evertz, Jonathan, et al.
Publicado: (2024)
Adversarial Observations in Weather Forecasting
por: Imgrund, Erik, et al.
Publicado: (2025)
por: Imgrund, Erik, et al.
Publicado: (2025)
Hardware-Triggered Backdoors
por: Möller, Jonas, et al.
Publicado: (2026)
por: Möller, Jonas, et al.
Publicado: (2026)
Trust Me, I Know This Function: Hijacking LLM Static Analysis using Bias
por: Bernstein, Shir, et al.
Publicado: (2025)
por: Bernstein, Shir, et al.
Publicado: (2025)
Learned-Database Systems Security
por: Schuster, Roei, et al.
Publicado: (2022)
por: Schuster, Roei, et al.
Publicado: (2022)
LLM Security and Safety: Insights from Homotopy-Inspired Prompt Obfuscation
por: Lazo, Luis, et al.
Publicado: (2026)
por: Lazo, Luis, et al.
Publicado: (2026)
HexaCoder: Secure Code Generation via Oracle-Guided Synthetic Training Data
por: Hajipour, Hossein, et al.
Publicado: (2024)
por: Hajipour, Hossein, et al.
Publicado: (2024)
Command-line Obfuscation Detection using Small Language Models
por: Outrata, Vojtech, et al.
Publicado: (2024)
por: Outrata, Vojtech, et al.
Publicado: (2024)
Injecting Undetectable Backdoors in Obfuscated Neural Networks and Language Models
por: Kalavasis, Alkis, et al.
Publicado: (2024)
por: Kalavasis, Alkis, et al.
Publicado: (2024)
LLM-based Vulnerability Discovery through the Lens of Code Metrics
por: Weissberg, Felix, et al.
Publicado: (2025)
por: Weissberg, Felix, et al.
Publicado: (2025)
Good-Enough LLM Obfuscation (GELO)
por: Belikov, Anatoly, et al.
Publicado: (2026)
por: Belikov, Anatoly, et al.
Publicado: (2026)
Adversarial Robustness of AI-Generated Image Detectors in the Real World
por: Mavali, Sina, et al.
Publicado: (2024)
por: Mavali, Sina, et al.
Publicado: (2024)
BadChain: Backdoor Chain-of-Thought Prompting for Large Language Models
por: Xiang, Zhen, et al.
Publicado: (2024)
por: Xiang, Zhen, et al.
Publicado: (2024)
Identifying Obfuscated Code through Graph-Based Semantic Analysis of Binary Code
por: Cohen, Roxane, et al.
Publicado: (2025)
por: Cohen, Roxane, et al.
Publicado: (2025)
PrivDiffuser: Privacy-Guided Diffusion Model for Data Obfuscation in Sensor Networks
por: Yang, Xin, et al.
Publicado: (2024)
por: Yang, Xin, et al.
Publicado: (2024)
Backdoored Retrievers for Prompt Injection Attacks on Retrieval Augmented Generation of Large Language Models
por: Clop, Cody, et al.
Publicado: (2024)
por: Clop, Cody, et al.
Publicado: (2024)
AutoAdv: Automated Adversarial Prompting for Multi-Turn Jailbreaking of Large Language Models
por: Reddy, Aashray, et al.
Publicado: (2025)
por: Reddy, Aashray, et al.
Publicado: (2025)
"Do Anything Now": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models
por: Shen, Xinyue, et al.
Publicado: (2023)
por: Shen, Xinyue, et al.
Publicado: (2023)
CLOAK: Contrastive Guidance for Latent Diffusion-Based Data Obfuscation
por: Yang, Xin, et al.
Publicado: (2025)
por: Yang, Xin, et al.
Publicado: (2025)
A Systematic Study of Code Obfuscation Against LLM-based Vulnerability Detection
por: Li, Xiao, et al.
Publicado: (2025)
por: Li, Xiao, et al.
Publicado: (2025)
LATTEO: A Framework to Support Learning Asynchronously Tempered with Trusted Execution and Obfuscation
por: Kumar, Abhinav, et al.
Publicado: (2025)
por: Kumar, Abhinav, et al.
Publicado: (2025)
PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts
por: Zhu, Kaijie, et al.
Publicado: (2023)
por: Zhu, Kaijie, et al.
Publicado: (2023)
Prompt Injection Attacks on Large Language Models in Oncology
por: Clusmann, Jan, et al.
Publicado: (2024)
por: Clusmann, Jan, et al.
Publicado: (2024)
JULI: Jailbreak Large Language Models by Self-Introspection
por: Wang, Jesson, et al.
Publicado: (2025)
por: Wang, Jesson, et al.
Publicado: (2025)
Concept-ROT: Poisoning Concepts in Large Language Models with Model Editing
por: Grimes, Keltin, et al.
Publicado: (2024)
por: Grimes, Keltin, et al.
Publicado: (2024)
LabObf: A Label Protection Scheme for Vertical Federated Learning Through Label Obfuscation
por: He, Ying, et al.
Publicado: (2024)
por: He, Ying, et al.
Publicado: (2024)
Breaking Obfuscation: Cluster-Aware Graph with LLM-Aided Recovery for Malicious JavaScript Detection
por: Liang, Zhihong, et al.
Publicado: (2025)
por: Liang, Zhihong, et al.
Publicado: (2025)
An Early Categorization of Prompt Injection Attacks on Large Language Models
por: Rossi, Sippo, et al.
Publicado: (2024)
por: Rossi, Sippo, et al.
Publicado: (2024)
Evaluating Large Language Models in Vulnerability Detection Under Variable Context Windows
por: Lin, Jie, et al.
Publicado: (2025)
por: Lin, Jie, et al.
Publicado: (2025)
Chasing Shadows: Pitfalls in LLM Security Research
por: Evertz, Jonathan, et al.
Publicado: (2025)
por: Evertz, Jonathan, et al.
Publicado: (2025)
PLeak: Prompt Leaking Attacks against Large Language Model Applications
por: Hui, Bo, et al.
Publicado: (2024)
por: Hui, Bo, et al.
Publicado: (2024)
Securing Large Language Models (LLMs) from Prompt Injection Attacks
por: Suri, Omar Farooq Khan, et al.
Publicado: (2025)
por: Suri, Omar Farooq Khan, et al.
Publicado: (2025)
Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection
por: Yan, Jun, et al.
Publicado: (2023)
por: Yan, Jun, et al.
Publicado: (2023)
Output Supervision Can Obfuscate the Chain of Thought
por: Drori, Jacob, et al.
Publicado: (2025)
por: Drori, Jacob, et al.
Publicado: (2025)
Prompt, Divide, and Conquer: Bypassing Large Language Model Safety Filters via Segmented and Distributed Prompt Processing
por: Wahréus, Johan, et al.
Publicado: (2025)
por: Wahréus, Johan, et al.
Publicado: (2025)
Rag and Roll: An End-to-End Evaluation of Indirect Prompt Manipulations in LLM-based Application Frameworks
por: De Stefano, Gianluca, et al.
Publicado: (2024)
por: De Stefano, Gianluca, et al.
Publicado: (2024)
On Large Language Model Continual Unlearning
por: Gao, Chongyang, et al.
Publicado: (2024)
por: Gao, Chongyang, et al.
Publicado: (2024)
Signal Watermark on Large Language Models
por: Xu, Zhenyu, et al.
Publicado: (2024)
por: Xu, Zhenyu, et al.
Publicado: (2024)
Scalable Fingerprinting of Large Language Models
por: Nasery, Anshul, et al.
Publicado: (2025)
por: Nasery, Anshul, et al.
Publicado: (2025)
Ejemplares similares
-
No More, No Less: Task Alignment in Terminal Agents
por: Mavali, Sina, et al.
Publicado: (2026) -
Whispers in the Machine: Confidentiality in Agentic Systems
por: Evertz, Jonathan, et al.
Publicado: (2024) -
Adversarial Observations in Weather Forecasting
por: Imgrund, Erik, et al.
Publicado: (2025) -
Hardware-Triggered Backdoors
por: Möller, Jonas, et al.
Publicado: (2026) -
Trust Me, I Know This Function: Hijacking LLM Static Analysis using Bias
por: Bernstein, Shir, et al.
Publicado: (2025)