Learning to Inject: Automated Prompt Injection via Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Xin, Zhang, Jie, Tramèr, Florian |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
by: Shin, Yongjae, et al.
Published: (2026)
by: Shin, Yongjae, et al.
Published: (2026)
WebInject: Prompt Injection Attack to Web Agents
by: Wang, Xilong, et al.
Published: (2025)
by: Wang, Xilong, et al.
Published: (2025)
Evolutionary System Prompt Learning for Reinforcement Learning in LLMs
by: Zhang, Lunjun, et al.
Published: (2026)
by: Zhang, Lunjun, et al.
Published: (2026)
The Jailbreak Tax: How Useful are Your Jailbreak Outputs?
by: Nikolić, Kristina, et al.
Published: (2025)
by: Nikolić, Kristina, et al.
Published: (2025)
Automated Reinforcement Learning: An Overview
by: Afshar, Reza Refaei, et al.
Published: (2022)
by: Afshar, Reza Refaei, et al.
Published: (2022)
Injecting Imbalance Sensitivity for Multi-Task Learning
by: Zhou, Zhipeng, et al.
Published: (2025)
by: Zhou, Zhipeng, et al.
Published: (2025)
PIP: Prototypes-Injected Prompt for Federated Class Incremental Learning
by: Ma'sum, Muhammad Anwar, et al.
Published: (2024)
by: Ma'sum, Muhammad Anwar, et al.
Published: (2024)
Towards Automated Semantic Interpretability in Reinforcement Learning via Vision-Language Models
by: Li, Zhaoxin, et al.
Published: (2025)
by: Li, Zhaoxin, et al.
Published: (2025)
Query-Based Adversarial Prompt Generation
by: Hayase, Jonathan, et al.
Published: (2024)
by: Hayase, Jonathan, et al.
Published: (2024)
Universal Jailbreak Backdoors from Poisoned Human Feedback
by: Rando, Javier, et al.
Published: (2023)
by: Rando, Javier, et al.
Published: (2023)
Enhancing Large Language Models for Time-Series Forecasting via Vector-Injected In-Context Learning
by: Zhang, Jianqi, et al.
Published: (2026)
by: Zhang, Jianqi, et al.
Published: (2026)
Offline Reinforcement Learning with Penalized Action Noise Injection
by: Oh, JunHyeok, et al.
Published: (2025)
by: Oh, JunHyeok, et al.
Published: (2025)
Behavior Injection: Preparing Language Models for Reinforcement Learning
by: Cen, Zhepeng, et al.
Published: (2025)
by: Cen, Zhepeng, et al.
Published: (2025)
Discovery of False Data Injection Schemes on Frequency Controllers with Reinforcement Learning
by: Prasad, Romesh, et al.
Published: (2024)
by: Prasad, Romesh, et al.
Published: (2024)
Automating Agent Hijacking via Structural Template Injection
by: Deng, Xinhao, et al.
Published: (2026)
by: Deng, Xinhao, et al.
Published: (2026)
Personalized Federated Continual Learning via Multi-granularity Prompt
by: Yu, Hao, et al.
Published: (2024)
by: Yu, Hao, et al.
Published: (2024)
Affordance-Guided Reinforcement Learning via Visual Prompting
by: Lee, Olivia Y., et al.
Published: (2024)
by: Lee, Olivia Y., et al.
Published: (2024)
Continual Adversarial Reinforcement Learning (CARL) of False Data Injection detection: forgetting and explainability
by: Aslami, Pooja, et al.
Published: (2024)
by: Aslami, Pooja, et al.
Published: (2024)
Hierarchical Meta-Reinforcement Learning via Automated Macro-Action Discovery
by: Cho, Minjae, et al.
Published: (2024)
by: Cho, Minjae, et al.
Published: (2024)
PRewrite: Prompt Rewriting with Reinforcement Learning
by: Kong, Weize, et al.
Published: (2024)
by: Kong, Weize, et al.
Published: (2024)
UI-S1: Advancing GUI Automation via Semi-online Reinforcement Learning
by: Lu, Zhengxi, et al.
Published: (2025)
by: Lu, Zhengxi, et al.
Published: (2025)
AEGIS : Automated Co-Evolutionary Framework for Guarding Prompt Injections Schema
by: Liu, Ting-Chun, et al.
Published: (2025)
by: Liu, Ting-Chun, et al.
Published: (2025)
Learning Future Representation with Synthetic Observations for Sample-efficient Reinforcement Learning
by: Liu, Xin, et al.
Published: (2024)
by: Liu, Xin, et al.
Published: (2024)
DeepDFA: Injecting Temporal Logic in Deep Learning for Sequential Subsymbolic Applications
by: Umili, Elena, et al.
Published: (2026)
by: Umili, Elena, et al.
Published: (2026)
RLBayes: a Bayesian Network Structure Learning Algorithm via Reinforcement Learning-Based Search Strategy
by: Wang, Mingcan, et al.
Published: (2025)
by: Wang, Mingcan, et al.
Published: (2025)
Automating the Refinement of Reinforcement Learning Specifications
by: Ambadkar, Tanmay, et al.
Published: (2025)
by: Ambadkar, Tanmay, et al.
Published: (2025)
Exploring and Addressing Reward Confusion in Offline Preference Learning
by: Chen, Xin, et al.
Published: (2024)
by: Chen, Xin, et al.
Published: (2024)
Pitfalls in Evaluating Language Model Forecasters
by: Paleka, Daniel, et al.
Published: (2025)
by: Paleka, Daniel, et al.
Published: (2025)
ARM-FM: Automated Reward Machines via Foundation Models for Compositional Reinforcement Learning
by: Castanyer, Roger Creus, et al.
Published: (2025)
by: Castanyer, Roger Creus, et al.
Published: (2025)
Deep Reinforcement Learning with Task-Adaptive Retrieval via Hypernetwork
by: Jin, Yonggang, et al.
Published: (2023)
by: Jin, Yonggang, et al.
Published: (2023)
AutoGL: A Library for Automated Graph Learning
by: Zhang, Ziwei, et al.
Published: (2021)
by: Zhang, Ziwei, et al.
Published: (2021)
TTVS: Boosting Self-Exploring Reinforcement Learning via Test-time Variational Synthesis
by: Bai, Sikai, et al.
Published: (2026)
by: Bai, Sikai, et al.
Published: (2026)
Cognitive Chunking for Soft Prompts: Accelerating Compressor Learning via Block-wise Causal Masking
by: Liu, Guojie, et al.
Published: (2026)
by: Liu, Guojie, et al.
Published: (2026)
Hypergraph Attacks via Injecting Homogeneous Nodes into Elite Hyperedges
by: He, Meixia, et al.
Published: (2024)
by: He, Meixia, et al.
Published: (2024)
Teaching Language Models to Critique via Reinforcement Learning
by: Xie, Zhihui, et al.
Published: (2025)
by: Xie, Zhihui, et al.
Published: (2025)
Automated Graph Machine Learning: Approaches, Libraries, Benchmarks and Directions
by: Wang, Xin, et al.
Published: (2022)
by: Wang, Xin, et al.
Published: (2022)
Automating Curriculum Learning for Reinforcement Learning using a Skill-Based Bayesian Network
by: Hsiao, Vincent, et al.
Published: (2025)
by: Hsiao, Vincent, et al.
Published: (2025)
Semi-supervised Anomaly Detection via Adaptive Reinforcement Learning-Enabled Method with Causal Inference for Sensor Signals
by: Chen, Xiangwei, et al.
Published: (2024)
by: Chen, Xiangwei, et al.
Published: (2024)
Understanding Prompt Tuning and In-Context Learning via Meta-Learning
by: Genewein, Tim, et al.
Published: (2025)
by: Genewein, Tim, et al.
Published: (2025)
Reinforced Interactive Continual Learning via Real-time Noisy Human Feedback
by: Yang, Yutao, et al.
Published: (2025)
by: Yang, Yutao, et al.
Published: (2025)
Similar Items
-
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
by: Shin, Yongjae, et al.
Published: (2026) -
WebInject: Prompt Injection Attack to Web Agents
by: Wang, Xilong, et al.
Published: (2025) -
Evolutionary System Prompt Learning for Reinforcement Learning in LLMs
by: Zhang, Lunjun, et al.
Published: (2026) -
The Jailbreak Tax: How Useful are Your Jailbreak Outputs?
by: Nikolić, Kristina, et al.
Published: (2025) -
Automated Reinforcement Learning: An Overview
by: Afshar, Reza Refaei, et al.
Published: (2022)