Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Gu, Shangding, Sel, Bilgehan, Ding, Yuhao, Wang, Lu, Lin, Qingwei, Knoll, Alois, Jin, Ming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation
por: Gu, Shangding, et al.
Publicado: (2024)
por: Gu, Shangding, et al.
Publicado: (2024)
A Review of Safe Reinforcement Learning: Methods, Theory and Applications
por: Gu, Shangding, et al.
Publicado: (2022)
por: Gu, Shangding, et al.
Publicado: (2022)
Enhancing Efficiency of Safe Reinforcement Learning via Sample Manipulation
por: Gu, Shangding, et al.
Publicado: (2024)
por: Gu, Shangding, et al.
Publicado: (2024)
A CMDP-within-online framework for Meta-Safe Reinforcement Learning
por: Khattar, Vanshaj, et al.
Publicado: (2024)
por: Khattar, Vanshaj, et al.
Publicado: (2024)
Reinforcement Learning with Backtracking Feedback
por: Sel, Bilgehan, et al.
Publicado: (2026)
por: Sel, Bilgehan, et al.
Publicado: (2026)
An Offline Adaptation Framework for Constrained Multi-Objective Reinforcement Learning
por: Lin, Qian, et al.
Publicado: (2024)
por: Lin, Qian, et al.
Publicado: (2024)
Skin-in-the-Game: Decision Making via Multi-Stakeholder Alignment in LLMs
por: Sel, Bilgehan, et al.
Publicado: (2024)
por: Sel, Bilgehan, et al.
Publicado: (2024)
Long Context, Less Focus: A Scaling Gap in LLMs Revealed through Privacy and Personalization
por: Gu, Shangding
Publicado: (2026)
por: Gu, Shangding
Publicado: (2026)
Data Uniformity Improves Training Efficiency and More, with a Convergence Framework Beyond the NTK Regime
por: Wang, Yuqing, et al.
Publicado: (2025)
por: Wang, Yuqing, et al.
Publicado: (2025)
AgenticPay: A Multi-Agent LLM Negotiation System for Buyer-Seller Transactions
por: Liu, Xianyang, et al.
Publicado: (2026)
por: Liu, Xianyang, et al.
Publicado: (2026)
Multi-Objective Optimization for Privacy-Utility Balance in Differentially Private Federated Learning
por: Ranaweera, Kanishka, et al.
Publicado: (2025)
por: Ranaweera, Kanishka, et al.
Publicado: (2025)
Robust Gymnasium: A Unified Modular Benchmark for Robust Reinforcement Learning
por: Gu, Shangding, et al.
Publicado: (2025)
por: Gu, Shangding, et al.
Publicado: (2025)
Safe Multi-Agent Reinforcement Learning with Bilevel Optimization in Autonomous Driving
por: Zheng, Zhi, et al.
Publicado: (2024)
por: Zheng, Zhi, et al.
Publicado: (2024)
Demonstration Guided Multi-Objective Reinforcement Learning
por: Lu, Junlin, et al.
Publicado: (2024)
por: Lu, Junlin, et al.
Publicado: (2024)
LLMs Can Plan Only If We Tell Them
por: Sel, Bilgehan, et al.
Publicado: (2025)
por: Sel, Bilgehan, et al.
Publicado: (2025)
StyleBench: Evaluating thinking styles in Large Language Models
por: Guo, Junyu, et al.
Publicado: (2025)
por: Guo, Junyu, et al.
Publicado: (2025)
LLMs Should Express Uncertainty Explicitly
por: Guo, Junyu, et al.
Publicado: (2026)
por: Guo, Junyu, et al.
Publicado: (2026)
Safe Continual Domain Adaptation after Sim2Real Transfer of Reinforcement Learning Policies in Robotics
por: Josifovski, Josip, et al.
Publicado: (2025)
por: Josifovski, Josip, et al.
Publicado: (2025)
A Meta-Learning Approach for Multi-Objective Reinforcement Learning in Sustainable Home Environments
por: Lu, Junlin, et al.
Publicado: (2024)
por: Lu, Junlin, et al.
Publicado: (2024)
Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk
por: Ying, Chengyang, et al.
Publicado: (2022)
por: Ying, Chengyang, et al.
Publicado: (2022)
TeaMs-RL: Teaching LLMs to Generate Better Instruction Datasets via Reinforcement Learning
por: Gu, Shangding, et al.
Publicado: (2024)
por: Gu, Shangding, et al.
Publicado: (2024)
Multi-Objective Loss Balancing for Physics-Informed Deep Learning
por: Bischof, Rafael, et al.
Publicado: (2021)
por: Bischof, Rafael, et al.
Publicado: (2021)
Multi-Objective Reinforcement Learning for Water Management
por: Osika, Zuzanna, et al.
Publicado: (2025)
por: Osika, Zuzanna, et al.
Publicado: (2025)
Constrained Reinforcement Learning for Safe Heat Pump Control
por: Zhang, Baohe, et al.
Publicado: (2024)
por: Zhang, Baohe, et al.
Publicado: (2024)
Offline Inverse Constrained Reinforcement Learning for Safe-Critical Decision Making in Healthcare
por: Fang, Nan, et al.
Publicado: (2024)
por: Fang, Nan, et al.
Publicado: (2024)
Constrained Reinforcement Learning with Average Reward Objective: Model-Based and Model-Free Algorithms
por: Aggarwal, Vaneet, et al.
Publicado: (2024)
por: Aggarwal, Vaneet, et al.
Publicado: (2024)
TREX: Trajectory Explanations for Multi-Objective Reinforcement Learning
por: Rajapakse, Dilina, et al.
Publicado: (2026)
por: Rajapakse, Dilina, et al.
Publicado: (2026)
Interpretability by Design for Efficient Multi-Objective Reinforcement Learning
por: Xia, Qiyue, et al.
Publicado: (2025)
por: Xia, Qiyue, et al.
Publicado: (2025)
State-Constrained Offline Reinforcement Learning
por: Hepburn, Charles A., et al.
Publicado: (2024)
por: Hepburn, Charles A., et al.
Publicado: (2024)
BiSeg-SAM: Weakly-Supervised Post-Processing Framework for Boosting Binary Segmentation in Segment Anything Models
por: Su, Encheng, et al.
Publicado: (2025)
por: Su, Encheng, et al.
Publicado: (2025)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
por: Ji, Jiaming, et al.
Publicado: (2025)
por: Ji, Jiaming, et al.
Publicado: (2025)
In Search for Architectures and Loss Functions in Multi-Objective Reinforcement Learning
por: Terekhov, Mikhail, et al.
Publicado: (2024)
por: Terekhov, Mikhail, et al.
Publicado: (2024)
Hybrid Action Based Reinforcement Learning for Multi-Objective Compatible Autonomous Driving
por: Jin, Guizhe, et al.
Publicado: (2025)
por: Jin, Guizhe, et al.
Publicado: (2025)
Polychromic Objectives for Reinforcement Learning
por: Hamid, Jubayer Ibn, et al.
Publicado: (2025)
por: Hamid, Jubayer Ibn, et al.
Publicado: (2025)
Beyond Scalar Rewards: Distributional Reinforcement Learning with Preordered Objectives for Safe and Reliable Autonomous Driving
por: Abouelazm, Ahmed, et al.
Publicado: (2026)
por: Abouelazm, Ahmed, et al.
Publicado: (2026)
Handling Long and Richly Constrained Tasks through Constrained Hierarchical Reinforcement Learning
por: Lu, Yuxiao, et al.
Publicado: (2023)
por: Lu, Yuxiao, et al.
Publicado: (2023)
TOPPO: Rethinking PPO for Multi-Task Reinforcement Learning with Critic Balancing
por: Li, Yuanpeng, et al.
Publicado: (2026)
por: Li, Yuanpeng, et al.
Publicado: (2026)
Navigating Trade-offs: Policy Summarization for Multi-Objective Reinforcement Learning
por: Osika, Zuzanna, et al.
Publicado: (2024)
por: Osika, Zuzanna, et al.
Publicado: (2024)
FairDICE: Fairness-Driven Offline Multi-Objective Reinforcement Learning
por: Kim, Woosung, et al.
Publicado: (2025)
por: Kim, Woosung, et al.
Publicado: (2025)
Scalable Multi-Objective and Meta Reinforcement Learning via Gradient Estimation
por: Zhang, Zhenshuo, et al.
Publicado: (2025)
por: Zhang, Zhenshuo, et al.
Publicado: (2025)
Ejemplares similares
-
Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation
por: Gu, Shangding, et al.
Publicado: (2024) -
A Review of Safe Reinforcement Learning: Methods, Theory and Applications
por: Gu, Shangding, et al.
Publicado: (2022) -
Enhancing Efficiency of Safe Reinforcement Learning via Sample Manipulation
por: Gu, Shangding, et al.
Publicado: (2024) -
A CMDP-within-online framework for Meta-Safe Reinforcement Learning
por: Khattar, Vanshaj, et al.
Publicado: (2024) -
Reinforcement Learning with Backtracking Feedback
por: Sel, Bilgehan, et al.
Publicado: (2026)