Sparse Offline Reinforcement Learning with Corruption Robustness
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tran, Nam Phuong, Nika, Andi, Radanovic, Goran, Tran-Thanh, Long, Mandal, Debmalya |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Corruption Robust Offline Reinforcement Learning with Human Feedback
par: Mandal, Debmalya, et autres
Publié: (2024)
par: Mandal, Debmalya, et autres
Publié: (2024)
Corruption-Robust Offline Two-Player Zero-Sum Markov Games
par: Nika, Andi, et autres
Publié: (2024)
par: Nika, Andi, et autres
Publié: (2024)
Corruption-robust Offline Multi-agent Reinforcement Learning From Human Feedback
par: Nika, Andi, et autres
Publié: (2026)
par: Nika, Andi, et autres
Publié: (2026)
On Corruption-Robustness in Performative Reinforcement Learning
par: Pollatos, Vasilis, et autres
Publié: (2025)
par: Pollatos, Vasilis, et autres
Publié: (2025)
Performative Reinforcement Learning with Linear Markov Decision Process
par: Mandal, Debmalya, et autres
Publié: (2024)
par: Mandal, Debmalya, et autres
Publié: (2024)
Distributionally Robust Reinforcement Learning with Human Feedback
par: Mandal, Debmalya, et autres
Publié: (2025)
par: Mandal, Debmalya, et autres
Publié: (2025)
Reward Model Learning vs. Direct Policy Optimization: A Comparative Analysis of Learning from Human Preferences
par: Nika, Andi, et autres
Publié: (2024)
par: Nika, Andi, et autres
Publié: (2024)
Policy Teaching via Data Poisoning in Learning from Human Preferences
par: Nika, Andi, et autres
Publié: (2025)
par: Nika, Andi, et autres
Publié: (2025)
Symmetric Linear Bandits with Hidden Symmetry
par: Tran, Nam Phuong, et autres
Publié: (2024)
par: Tran, Nam Phuong, et autres
Publié: (2024)
Performative Reinforcement Learning in Gradually Shifting Environments
par: Rank, Ben, et autres
Publié: (2024)
par: Rank, Ben, et autres
Publié: (2024)
Learning the Expected Core of Strictly Convex Stochastic Cooperative Games
par: Tran, Nam Phuong, et autres
Publié: (2024)
par: Tran, Nam Phuong, et autres
Publié: (2024)
Stochastic Principal-Agent Problems: Efficient Computation and Learning
par: Gan, Jiarui, et autres
Publié: (2023)
par: Gan, Jiarui, et autres
Publié: (2023)
Independent Learning in Performative Markov Potential Games
par: Sahitaj, Rilind, et autres
Publié: (2025)
par: Sahitaj, Rilind, et autres
Publié: (2025)
Can In-Context Reinforcement Learning Recover From Reward Poisoning Attacks?
par: Sasnauskas, Paulius, et autres
Publié: (2025)
par: Sasnauskas, Paulius, et autres
Publié: (2025)
Corruption-Robust Offline Reinforcement Learning with General Function Approximation
par: Ye, Chenlu, et autres
Publié: (2023)
par: Ye, Chenlu, et autres
Publié: (2023)
Benchmarking the Robustness of Agentic Systems to Adversarially-Induced Harms
par: Nöther, Jonathan, et autres
Publié: (2025)
par: Nöther, Jonathan, et autres
Publié: (2025)
Reward Design for Justifiable Sequential Decision-Making
par: Sukovic, Aleksa, et autres
Publié: (2024)
par: Sukovic, Aleksa, et autres
Publié: (2024)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
par: Yang, Rui, et autres
Publié: (2023)
par: Yang, Rui, et autres
Publié: (2023)
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
par: Liu, Zeyuan, et autres
Publié: (2025)
par: Liu, Zeyuan, et autres
Publié: (2025)
Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints
par: Nöther, Jonathan, et autres
Publié: (2025)
par: Nöther, Jonathan, et autres
Publié: (2025)
Reinforcement Learning for Durable Algorithmic Recourse
par: Ceccon, Marina, et autres
Publié: (2025)
par: Ceccon, Marina, et autres
Publié: (2025)
Strategyproof Reinforcement Learning from Human Feedback
par: Buening, Thomas Kleine, et autres
Publié: (2025)
par: Buening, Thomas Kleine, et autres
Publié: (2025)
Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
par: Xu, Le, et autres
Publié: (2025)
par: Xu, Le, et autres
Publié: (2025)
Uncertainty-based Offline Variational Bayesian Reinforcement Learning for Robustness under Diverse Data Corruptions
par: Yang, Rui, et autres
Publié: (2024)
par: Yang, Rui, et autres
Publié: (2024)
Safety Game: Inference-Time Alignment of Black-Box LLMs via Constrained Optimization
par: Nguyen, Tuan, et autres
Publié: (2025)
par: Nguyen, Tuan, et autres
Publié: (2025)
Learning Embeddings for Sequential Tasks Using Population of Agents
par: Mahajan, Mridul, et autres
Publié: (2023)
par: Mahajan, Mridul, et autres
Publié: (2023)
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
par: Xu, Jiawei, et autres
Publié: (2024)
par: Xu, Jiawei, et autres
Publié: (2024)
MaMa: A Game-Theoretic Approach for Designing Safe Agentic Systems
par: Nöther, Jonathan, et autres
Publié: (2026)
par: Nöther, Jonathan, et autres
Publié: (2026)
Agent-Specific Effects: A Causal Effect Propagation Analysis in Multi-Agent MDPs
par: Triantafyllou, Stelios, et autres
Publié: (2023)
par: Triantafyllou, Stelios, et autres
Publié: (2023)
Epistemic Robust Offline Reinforcement Learning
par: Chenreddy, Abhilash Reddy, et autres
Publié: (2026)
par: Chenreddy, Abhilash Reddy, et autres
Publié: (2026)
Robust Reinforcement Learning from Corrupted Human Feedback
par: Bukharin, Alexander, et autres
Publié: (2024)
par: Bukharin, Alexander, et autres
Publié: (2024)
Offline Multitask Representation Learning for Reinforcement Learning
par: Ishfaq, Haque, et autres
Publié: (2024)
par: Ishfaq, Haque, et autres
Publié: (2024)
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
par: Nguyen, Thanh, et autres
Publié: (2024)
par: Nguyen, Thanh, et autres
Publié: (2024)
Robust SDE Parameter Estimation Under Missing Time Information Setting
par: Van Tran, Long, et autres
Publié: (2026)
par: Van Tran, Long, et autres
Publié: (2026)
Pruning at Initialisation through the lens of Graphon Limit: Convergence, Expressivity, and Generalisation
par: Pham, Hoang, et autres
Publié: (2026)
par: Pham, Hoang, et autres
Publié: (2026)
A Model Selection Approach for Corruption Robust Reinforcement Learning
par: Wei, Chen-Yu, et autres
Publié: (2021)
par: Wei, Chen-Yu, et autres
Publié: (2021)
One-Step Flow Q-Learning: Addressing the Diffusion Policy Bottleneck in Offline Reinforcement Learning
par: Nguyen, Thanh, et autres
Publié: (2025)
par: Nguyen, Thanh, et autres
Publié: (2025)
Contextual Combinatorial Bandits with Changing Action Sets via Gaussian Processes
par: Nika, Andi, et autres
Publié: (2021)
par: Nika, Andi, et autres
Publié: (2021)
Towards Robust Model-Based Reinforcement Learning Against Adversarial Corruption
par: Ye, Chenlu, et autres
Publié: (2024)
par: Ye, Chenlu, et autres
Publié: (2024)
Online Optimization for Offline Safe Reinforcement Learning
par: Chemingui, Yassine, et autres
Publié: (2025)
par: Chemingui, Yassine, et autres
Publié: (2025)
Documents similaires
-
Corruption Robust Offline Reinforcement Learning with Human Feedback
par: Mandal, Debmalya, et autres
Publié: (2024) -
Corruption-Robust Offline Two-Player Zero-Sum Markov Games
par: Nika, Andi, et autres
Publié: (2024) -
Corruption-robust Offline Multi-agent Reinforcement Learning From Human Feedback
par: Nika, Andi, et autres
Publié: (2026) -
On Corruption-Robustness in Performative Reinforcement Learning
par: Pollatos, Vasilis, et autres
Publié: (2025) -
Performative Reinforcement Learning with Linear Markov Decision Process
par: Mandal, Debmalya, et autres
Publié: (2024)