Reward-Preserving Attacks For Robust Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Schott, Lucas, Gherbi, Elies, Hajri, Hatem, Lamprier, Sylvain |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Robust Deep Reinforcement Learning Through Adversarial Attacks and Training : A Survey
by: Schott, Lucas, et al.
Published: (2024)
by: Schott, Lucas, et al.
Published: (2024)
Offline Reinforcement Learning of High-Quality Behaviors Under Robust Style Alignment
by: Petitbois, Mathieu, et al.
Published: (2026)
by: Petitbois, Mathieu, et al.
Published: (2026)
Imagine Beyond! Distributionally Robust Auto-Encoding for State Space Coverage in Online Reinforcement Learning
by: Castanet, Nicolas, et al.
Published: (2025)
by: Castanet, Nicolas, et al.
Published: (2025)
Black-Box Combinatorial Optimization with Order-Invariant Reinforcement Learning
by: Goudet, Olivier, et al.
Published: (2025)
by: Goudet, Olivier, et al.
Published: (2025)
Grounding Large Language Models in Interactive Environments with Online Reinforcement Learning
by: Carta, Thomas, et al.
Published: (2023)
by: Carta, Thomas, et al.
Published: (2023)
Offline Learning of Controllable Diverse Behaviors
by: Petitbois, Mathieu, et al.
Published: (2025)
by: Petitbois, Mathieu, et al.
Published: (2025)
Navigation with QPHIL: Quantizing Planner for Hierarchical Implicit Q-Learning
by: Canesse, Alexi, et al.
Published: (2024)
by: Canesse, Alexi, et al.
Published: (2024)
Reinforcement Learning for Aligning Large Language Models Agents with Interactive Environments: Quantifying and Mitigating Prompt Overfitting
by: Aissi, Mohamed Salim, et al.
Published: (2024)
by: Aissi, Mohamed Salim, et al.
Published: (2024)
Deinterleaving of Discrete Renewal Process Mixtures with Application to Electronic Support Measures
by: Pinsolle, Jean, et al.
Published: (2024)
by: Pinsolle, Jean, et al.
Published: (2024)
Reward Under Attack: Analyzing the Robustness and Hackability of Process Reward Models
by: Tiwari, Rishabh, et al.
Published: (2026)
by: Tiwari, Rishabh, et al.
Published: (2026)
Provably Sample-Efficient Robust Reinforcement Learning with Average Reward
by: Roch, Zachary, et al.
Published: (2025)
by: Roch, Zachary, et al.
Published: (2025)
Privacy-Preserving Reinforcement Learning from Human Feedback via Decoupled Reward Modeling
by: Cho, Young Hyun, et al.
Published: (2026)
by: Cho, Young Hyun, et al.
Published: (2026)
Agentic Adversarial QA for Improving Domain-Specific LLMs
by: Grari, Vincent, et al.
Published: (2026)
by: Grari, Vincent, et al.
Published: (2026)
HERAKLES: Hierarchical Skill Compilation for Open-ended LLM Agents
by: Carta, Thomas, et al.
Published: (2025)
by: Carta, Thomas, et al.
Published: (2025)
Can In-Context Reinforcement Learning Recover From Reward Poisoning Attacks?
by: Sasnauskas, Paulius, et al.
Published: (2025)
by: Sasnauskas, Paulius, et al.
Published: (2025)
ACT: Agentic Classification Tree
by: Grari, Vincent, et al.
Published: (2025)
by: Grari, Vincent, et al.
Published: (2025)
Robust Thompson Sampling Algorithms Against Reward Poisoning Attacks
by: Xu, Yinglun, et al.
Published: (2024)
by: Xu, Yinglun, et al.
Published: (2024)
Beware Untrusted Simulators -- Reward-Free Backdoor Attacks in Reinforcement Learning
by: Rathbun, Ethan, et al.
Published: (2026)
by: Rathbun, Ethan, et al.
Published: (2026)
Sample Complexity of Distributionally Robust Average-Reward Reinforcement Learning
by: Chen, Zijun, et al.
Published: (2025)
by: Chen, Zijun, et al.
Published: (2025)
A Transformer Model for Predicting Chemical Products from Generic SMARTS Templates with Data Augmentation
by: Ozer, Derin, et al.
Published: (2025)
by: Ozer, Derin, et al.
Published: (2025)
Finite-Sample Analysis of Policy Evaluation for Robust Average Reward Reinforcement Learning
by: Xu, Yang, et al.
Published: (2025)
by: Xu, Yang, et al.
Published: (2025)
Reward-Conditioned Reinforcement Learning
by: Nauman, Michal, et al.
Published: (2026)
by: Nauman, Michal, et al.
Published: (2026)
SAC-GLAM: Improving Online RL for LLM agents with Soft Actor-Critic and Hindsight Relabeling
by: Gaven, Loris, et al.
Published: (2024)
by: Gaven, Loris, et al.
Published: (2024)
Robust Reinforcement Learning Objectives for Sequential Recommender Systems
by: Mozifian, Melissa, et al.
Published: (2023)
by: Mozifian, Melissa, et al.
Published: (2023)
Similarity as Reward Alignment: Robust and Versatile Preference-based Reinforcement Learning
by: Rajaram, Sara, et al.
Published: (2025)
by: Rajaram, Sara, et al.
Published: (2025)
Reinforcement Learning with LTL and $ω$-Regular Objectives via Optimality-Preserving Translation to Average Rewards
by: Le, Xuan-Bach, et al.
Published: (2024)
by: Le, Xuan-Bach, et al.
Published: (2024)
Reinforcement Learning from Bagged Reward
by: Tang, Yuting, et al.
Published: (2024)
by: Tang, Yuting, et al.
Published: (2024)
The Value of Reward Lookahead in Reinforcement Learning
by: Merlis, Nadav, et al.
Published: (2024)
by: Merlis, Nadav, et al.
Published: (2024)
Informativeness of Reward Functions in Reinforcement Learning
by: Devidze, Rati, et al.
Published: (2024)
by: Devidze, Rati, et al.
Published: (2024)
Reward Design for Reinforcement Learning Agents
by: Devidze, Rati
Published: (2025)
by: Devidze, Rati
Published: (2025)
To the Max: Reinventing Reward in Reinforcement Learning
by: Veviurko, Grigorii, et al.
Published: (2024)
by: Veviurko, Grigorii, et al.
Published: (2024)
Universal Black-Box Reward Poisoning Attack against Offline Reinforcement Learning
by: Xu, Yinglun, et al.
Published: (2024)
by: Xu, Yinglun, et al.
Published: (2024)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
by: Xu, Yang, et al.
Published: (2025)
by: Xu, Yang, et al.
Published: (2025)
Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards
by: Huang, Yu, et al.
Published: (2026)
by: Huang, Yu, et al.
Published: (2026)
The Distributional Reward Critic Framework for Reinforcement Learning Under Perturbed Rewards
by: Chen, Xi, et al.
Published: (2024)
by: Chen, Xi, et al.
Published: (2024)
DyJR: Preserving Diversity in Reinforcement Learning with Verifiable Rewards via Dynamic Jensen-Shannon Replay
by: Li, Long, et al.
Published: (2026)
by: Li, Long, et al.
Published: (2026)
Robust Offline Reinforcement learning with Heavy-Tailed Rewards
by: Zhu, Jin, et al.
Published: (2023)
by: Zhu, Jin, et al.
Published: (2023)
RDA: Reward Design Agent for Reinforcement Learning
by: Lee, Hojoon, et al.
Published: (2026)
by: Lee, Hojoon, et al.
Published: (2026)
Binary Rewards and Reinforcement Learning: Fundamental Challenges
by: Dymetman, Marc
Published: (2026)
by: Dymetman, Marc
Published: (2026)
Reward-Zero: Language Embedding Driven Implicit Reward Mechanisms for Reinforcement Learning
by: Zhang, Heng, et al.
Published: (2026)
by: Zhang, Heng, et al.
Published: (2026)
Similar Items
-
Robust Deep Reinforcement Learning Through Adversarial Attacks and Training : A Survey
by: Schott, Lucas, et al.
Published: (2024) -
Offline Reinforcement Learning of High-Quality Behaviors Under Robust Style Alignment
by: Petitbois, Mathieu, et al.
Published: (2026) -
Imagine Beyond! Distributionally Robust Auto-Encoding for State Space Coverage in Online Reinforcement Learning
by: Castanet, Nicolas, et al.
Published: (2025) -
Black-Box Combinatorial Optimization with Order-Invariant Reinforcement Learning
by: Goudet, Olivier, et al.
Published: (2025) -
Grounding Large Language Models in Interactive Environments with Online Reinforcement Learning
by: Carta, Thomas, et al.
Published: (2023)