Safe, Efficient, and Robust Reinforcement Learning for Ranking and Diffusion Models
Fuente:
arXiv
Guardado en:
| Autor principal: | Gupta, Shashank |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Practical and Robust Safety Guarantees for Advanced Counterfactual Learning to Rank
por: Gupta, Shashank, et al.
Publicado: (2024)
por: Gupta, Shashank, et al.
Publicado: (2024)
Proximal Ranking Policy Optimization for Practical Safety in Counterfactual Learning to Rank
por: Gupta, Shashank, et al.
Publicado: (2024)
por: Gupta, Shashank, et al.
Publicado: (2024)
Safe and Robust Reinforcement Learning: Principles and Practice
por: Yamagata, Taku, et al.
Publicado: (2024)
por: Yamagata, Taku, et al.
Publicado: (2024)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
por: Zheng, Yinan, et al.
Publicado: (2024)
por: Zheng, Yinan, et al.
Publicado: (2024)
Robust Shielding for Safe Reinforcement Learning
por: Court, Edwin Hamel-De le, et al.
Publicado: (2026)
por: Court, Edwin Hamel-De le, et al.
Publicado: (2026)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
por: Galesloot, Maris F. L., et al.
Publicado: (2026)
por: Galesloot, Maris F. L., et al.
Publicado: (2026)
Attractor Patch Networks: Reducing Catastrophic Forgetting with Routed Low-Rank Patch Experts
por: Shashank
Publicado: (2026)
por: Shashank
Publicado: (2026)
Heterogeneity-Aware Client Selection Methodology For Efficient Federated Learning
por: Balivada, Nihal, et al.
Publicado: (2026)
por: Balivada, Nihal, et al.
Publicado: (2026)
Robust Reinforcement Learning under Diffusion Models for Data with Jumps
por: Jiang, Chenyang, et al.
Publicado: (2024)
por: Jiang, Chenyang, et al.
Publicado: (2024)
Conditional Sequence Modeling for Safe Reinforcement Learning
por: Bai, Wensong, et al.
Publicado: (2026)
por: Bai, Wensong, et al.
Publicado: (2026)
How Does the Lagrangian Guide Safe Reinforcement Learning through Diffusion Models?
por: Cheng, Xiaoyuan, et al.
Publicado: (2026)
por: Cheng, Xiaoyuan, et al.
Publicado: (2026)
CIMRL: Combining IMitation and Reinforcement Learning for Safe Autonomous Driving
por: Booher, Jonathan, et al.
Publicado: (2024)
por: Booher, Jonathan, et al.
Publicado: (2024)
Optimal Transport Perturbations for Safe Reinforcement Learning with Robustness Guarantees
por: Queeney, James, et al.
Publicado: (2023)
por: Queeney, James, et al.
Publicado: (2023)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
por: Chen, Rufeng, et al.
Publicado: (2026)
por: Chen, Rufeng, et al.
Publicado: (2026)
Safe In-Context Reinforcement Learning
por: Moeini, Amir, et al.
Publicado: (2025)
por: Moeini, Amir, et al.
Publicado: (2025)
Counterfactually Safe Reinforcement Learning
por: Li, Jingyi, et al.
Publicado: (2026)
por: Li, Jingyi, et al.
Publicado: (2026)
Adversarial Diffusion for Robust Reinforcement Learning
por: Foffano, Daniele, et al.
Publicado: (2025)
por: Foffano, Daniele, et al.
Publicado: (2025)
Avoid Catastrophic Forgetting with Rank-1 Fisher from Diffusion Models
por: Wang, Zekun, et al.
Publicado: (2025)
por: Wang, Zekun, et al.
Publicado: (2025)
Efficient Online Reinforcement Learning for Diffusion Policy
por: Ma, Haitong, et al.
Publicado: (2025)
por: Ma, Haitong, et al.
Publicado: (2025)
Policy Bifurcation in Safe Reinforcement Learning
por: Zou, Wenjun, et al.
Publicado: (2024)
por: Zou, Wenjun, et al.
Publicado: (2024)
Sampling-based Safe Reinforcement Learning for Nonlinear Dynamical Systems
por: Suttle, Wesley A., et al.
Publicado: (2024)
por: Suttle, Wesley A., et al.
Publicado: (2024)
Fuz-RL: A Fuzzy-Guided Robust Framework for Safe Reinforcement Learning under Uncertainty
por: Wan, Xu, et al.
Publicado: (2026)
por: Wan, Xu, et al.
Publicado: (2026)
Efficient Reward Identification In Max Entropy Reinforcement Learning with Sparsity and Rank Priors
por: Shehab, Mohamad Louai, et al.
Publicado: (2025)
por: Shehab, Mohamad Louai, et al.
Publicado: (2025)
Robust Entropy Search for Safe Efficient Bayesian Optimization
por: Weichert, Dorina, et al.
Publicado: (2024)
por: Weichert, Dorina, et al.
Publicado: (2024)
Hyper: Hyperparameter Robust Efficient Exploration in Reinforcement Learning
por: Wang, Yiran, et al.
Publicado: (2024)
por: Wang, Yiran, et al.
Publicado: (2024)
SafeDreamer: Safe Reinforcement Learning with World Models
por: Huang, Weidong, et al.
Publicado: (2023)
por: Huang, Weidong, et al.
Publicado: (2023)
Feasibility Consistent Representation Learning for Safe Reinforcement Learning
por: Cen, Zhepeng, et al.
Publicado: (2024)
por: Cen, Zhepeng, et al.
Publicado: (2024)
Vulnerability Analysis of Safe Reinforcement Learning via Inverse Constrained Reinforcement Learning
por: Fan, Jialiang, et al.
Publicado: (2026)
por: Fan, Jialiang, et al.
Publicado: (2026)
Ranking-aware Reinforcement Learning for Ordinal Ranking
por: Hao, Aiming, et al.
Publicado: (2026)
por: Hao, Aiming, et al.
Publicado: (2026)
Meta-reinforcement learning with minimum attention
por: Gupta, Shashank, et al.
Publicado: (2025)
por: Gupta, Shashank, et al.
Publicado: (2025)
Additive Control Variates Dominate Self-Normalisation in Off-Policy Evaluation
por: Jeunen, Olivier, et al.
Publicado: (2026)
por: Jeunen, Olivier, et al.
Publicado: (2026)
d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning
por: Zhao, Siyan, et al.
Publicado: (2025)
por: Zhao, Siyan, et al.
Publicado: (2025)
Neuro-Symbolic Generative Diffusion Models for Physically Grounded, Robust, and Safe Generation
por: Christopher, Jacob K., et al.
Publicado: (2025)
por: Christopher, Jacob K., et al.
Publicado: (2025)
A Simple and Effective Reinforcement Learning Method for Text-to-Image Diffusion Fine-tuning
por: Gupta, Shashank, et al.
Publicado: (2025)
por: Gupta, Shashank, et al.
Publicado: (2025)
Provably Sample-Efficient Robust Reinforcement Learning with Average Reward
por: Roch, Zachary, et al.
Publicado: (2025)
por: Roch, Zachary, et al.
Publicado: (2025)
Progressive Safeguards for Safe and Model-Agnostic Reinforcement Learning
por: Omi, Nabil, et al.
Publicado: (2024)
por: Omi, Nabil, et al.
Publicado: (2024)
On the Quantization Robustness of Diffusion Language Models in Coding Benchmarks
por: Gupta, Aarav, et al.
Publicado: (2026)
por: Gupta, Aarav, et al.
Publicado: (2026)
Maestro: Uncovering Low-Rank Structures via Trainable Decomposition
por: Horvath, Samuel, et al.
Publicado: (2023)
por: Horvath, Samuel, et al.
Publicado: (2023)
Dynamic Model Predictive Shielding for Provably Safe Reinforcement Learning
por: Banerjee, Arko, et al.
Publicado: (2024)
por: Banerjee, Arko, et al.
Publicado: (2024)
Verified Safe Reinforcement Learning for Neural Network Dynamic Models
por: Wu, Junlin, et al.
Publicado: (2024)
por: Wu, Junlin, et al.
Publicado: (2024)
Ejemplares similares
-
Practical and Robust Safety Guarantees for Advanced Counterfactual Learning to Rank
por: Gupta, Shashank, et al.
Publicado: (2024) -
Proximal Ranking Policy Optimization for Practical Safety in Counterfactual Learning to Rank
por: Gupta, Shashank, et al.
Publicado: (2024) -
Safe and Robust Reinforcement Learning: Principles and Practice
por: Yamagata, Taku, et al.
Publicado: (2024) -
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
por: Zheng, Yinan, et al.
Publicado: (2024) -
Robust Shielding for Safe Reinforcement Learning
por: Court, Edwin Hamel-De le, et al.
Publicado: (2026)