Optimistic Reinforcement Learning with Quantile Objectives
Fuente:
arXiv
Salvato in:
| Autori principali: | Alipour-Vaezi, Mohammad, Zhong, Huaiyang, Tsui, Kwok-Leung, Khodadadian, Sajad |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Data-Driven Portfolio Management for Motion Pictures Industry: A New Data-Driven Optimization Methodology Using a Large Language Model as the Expert
di: Alipour-Vaezi, Mohammad, et al.
Pubblicazione: (2024)
di: Alipour-Vaezi, Mohammad, et al.
Pubblicazione: (2024)
Tail Distribution of Regret in Optimistic Reinforcement Learning
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025)
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025)
Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning
di: McCarthy, James, et al.
Pubblicazione: (2025)
di: McCarthy, James, et al.
Pubblicazione: (2025)
Tilted Quantile Gradient Updates for Quantile-Constrained Reinforcement Learning
di: Li, Chenglin, et al.
Pubblicazione: (2024)
di: Li, Chenglin, et al.
Pubblicazione: (2024)
Designing Interpretable ML System to Enhance Trust in Healthcare: A Systematic Review to Proposed Responsible Clinician-AI-Collaboration Framework
di: Nasarian, Elham, et al.
Pubblicazione: (2023)
di: Nasarian, Elham, et al.
Pubblicazione: (2023)
Quantile Geometry Regularization for Distributional Reinforcement Learning
di: Zhang, Zhaofan, et al.
Pubblicazione: (2026)
di: Zhang, Zhaofan, et al.
Pubblicazione: (2026)
Quantile Markov Decision Process
di: Li, Xiaocheng, et al.
Pubblicazione: (2017)
di: Li, Xiaocheng, et al.
Pubblicazione: (2017)
What Matters in Data for DPO?
di: Pan, Yu, et al.
Pubblicazione: (2025)
di: Pan, Yu, et al.
Pubblicazione: (2025)
Kernel-Based Function Approximation for Average Reward Reinforcement Learning: An Optimist No-Regret Algorithm
di: Vakili, Sattar, et al.
Pubblicazione: (2024)
di: Vakili, Sattar, et al.
Pubblicazione: (2024)
Provable Last-Iterate Convergence for Multi-Objective Safe LLM Alignment via Optimistic Primal-Dual
di: Li, Yining, et al.
Pubblicazione: (2026)
di: Li, Yining, et al.
Pubblicazione: (2026)
Polychromic Objectives for Reinforcement Learning
di: Hamid, Jubayer Ibn, et al.
Pubblicazione: (2025)
di: Hamid, Jubayer Ibn, et al.
Pubblicazione: (2025)
Optimistic Rates for Learning from Label Proportions
di: Li, Gene, et al.
Pubblicazione: (2024)
di: Li, Gene, et al.
Pubblicazione: (2024)
Optimistic Policy Regularization
di: Pham, Mai, et al.
Pubblicazione: (2026)
di: Pham, Mai, et al.
Pubblicazione: (2026)
A General-Purpose Theorem for High-Probability Bounds of Stochastic Approximation with Polyak Averaging
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025)
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025)
Optimistic World Models: Efficient Exploration in Model-Based Deep Reinforcement Learning
di: Mete, Akshay, et al.
Pubblicazione: (2026)
di: Mete, Akshay, et al.
Pubblicazione: (2026)
Reinforcement Learning with $ω$-Regular Objectives and Constraints
di: Wagner, Dominik, et al.
Pubblicazione: (2025)
di: Wagner, Dominik, et al.
Pubblicazione: (2025)
Multi-Objective Reinforcement Learning for Water Management
di: Osika, Zuzanna, et al.
Pubblicazione: (2025)
di: Osika, Zuzanna, et al.
Pubblicazione: (2025)
Demonstration Guided Multi-Objective Reinforcement Learning
di: Lu, Junlin, et al.
Pubblicazione: (2024)
di: Lu, Junlin, et al.
Pubblicazione: (2024)
Enhancing IoT Security Against DDoS Attacks through Federated Learning
di: Shirvani, Ghazaleh, et al.
Pubblicazione: (2024)
di: Shirvani, Ghazaleh, et al.
Pubblicazione: (2024)
Federated Stochastic Approximation under Markov Noise and Heterogeneity: Applications in Reinforcement Learning
di: Khodadadian, Sajad, et al.
Pubblicazione: (2022)
di: Khodadadian, Sajad, et al.
Pubblicazione: (2022)
Optimistic Regret Bounds for Online Learning in Adversarial Markov Decision Processes
di: Moon, Sang Bin, et al.
Pubblicazione: (2024)
di: Moon, Sang Bin, et al.
Pubblicazione: (2024)
Optimistic Policy Learning under Pessimistic Adversaries with Regret and Violation Guarantees
di: Ganguly, Sourav, et al.
Pubblicazione: (2026)
di: Ganguly, Sourav, et al.
Pubblicazione: (2026)
Interpretability by Design for Efficient Multi-Objective Reinforcement Learning
di: Xia, Qiyue, et al.
Pubblicazione: (2025)
di: Xia, Qiyue, et al.
Pubblicazione: (2025)
TREX: Trajectory Explanations for Multi-Objective Reinforcement Learning
di: Rajapakse, Dilina, et al.
Pubblicazione: (2026)
di: Rajapakse, Dilina, et al.
Pubblicazione: (2026)
Spatial-Temporal Reinforcement Learning for Network Routing with Non-Markovian Traffic
di: Wang, Molly, et al.
Pubblicazione: (2025)
di: Wang, Molly, et al.
Pubblicazione: (2025)
Optimal Singular Damage: Efficient LLM Inference in Low Storage Regimes
di: Alipour, Mohammadsajad, et al.
Pubblicazione: (2025)
di: Alipour, Mohammadsajad, et al.
Pubblicazione: (2025)
Optimistic Gradient Learning with Hessian Corrections for High-Dimensional Black-Box Optimization
di: Kfir, Yedidya, et al.
Pubblicazione: (2025)
di: Kfir, Yedidya, et al.
Pubblicazione: (2025)
An Offline Adaptation Framework for Constrained Multi-Objective Reinforcement Learning
di: Lin, Qian, et al.
Pubblicazione: (2024)
di: Lin, Qian, et al.
Pubblicazione: (2024)
In Search for Architectures and Loss Functions in Multi-Objective Reinforcement Learning
di: Terekhov, Mikhail, et al.
Pubblicazione: (2024)
di: Terekhov, Mikhail, et al.
Pubblicazione: (2024)
Belief States for Cooperative Multi-Agent Reinforcement Learning under Partial Observability
di: Pritz, Paul J., et al.
Pubblicazione: (2025)
di: Pritz, Paul J., et al.
Pubblicazione: (2025)
RLP: Reinforcement as a Pretraining Objective
di: Hatamizadeh, Ali, et al.
Pubblicazione: (2025)
di: Hatamizadeh, Ali, et al.
Pubblicazione: (2025)
An Optimistic Algorithm for online CMDPS with Anytime Adversarial Constraints
di: Zhu, Jiahui, et al.
Pubblicazione: (2025)
di: Zhu, Jiahui, et al.
Pubblicazione: (2025)
FairDICE: Fairness-Driven Offline Multi-Objective Reinforcement Learning
di: Kim, Woosung, et al.
Pubblicazione: (2025)
di: Kim, Woosung, et al.
Pubblicazione: (2025)
Scalable Multi-Objective and Meta Reinforcement Learning via Gradient Estimation
di: Zhang, Zhenshuo, et al.
Pubblicazione: (2025)
di: Zhang, Zhenshuo, et al.
Pubblicazione: (2025)
Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
di: Gu, Shangding, et al.
Pubblicazione: (2024)
di: Gu, Shangding, et al.
Pubblicazione: (2024)
Navigating Trade-offs: Policy Summarization for Multi-Objective Reinforcement Learning
di: Osika, Zuzanna, et al.
Pubblicazione: (2024)
di: Osika, Zuzanna, et al.
Pubblicazione: (2024)
FBOS-RL: Feedback-Driven Bi-Objective Synergistic Reinforcement Learning
di: Zhang, Xikai, et al.
Pubblicazione: (2026)
di: Zhang, Xikai, et al.
Pubblicazione: (2026)
Combining Multi-Objective Bayesian Optimization with Reinforcement Learning for TinyML
di: Deutel, Mark, et al.
Pubblicazione: (2023)
di: Deutel, Mark, et al.
Pubblicazione: (2023)
STEMO: Early Spatio-temporal Forecasting with Multi-Objective Reinforcement Learning
di: Shao, Wei, et al.
Pubblicazione: (2024)
di: Shao, Wei, et al.
Pubblicazione: (2024)
A Unifying Post-Processing Framework for Multi-Objective Learn-to-Defer Problems
di: Charusaie, Mohammad-Amin, et al.
Pubblicazione: (2024)
di: Charusaie, Mohammad-Amin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Data-Driven Portfolio Management for Motion Pictures Industry: A New Data-Driven Optimization Methodology Using a Large Language Model as the Expert
di: Alipour-Vaezi, Mohammad, et al.
Pubblicazione: (2024) -
Tail Distribution of Regret in Optimistic Reinforcement Learning
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025) -
Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning
di: McCarthy, James, et al.
Pubblicazione: (2025) -
Tilted Quantile Gradient Updates for Quantile-Constrained Reinforcement Learning
di: Li, Chenglin, et al.
Pubblicazione: (2024) -
Designing Interpretable ML System to Enhance Trust in Healthcare: A Systematic Review to Proposed Responsible Clinician-AI-Collaboration Framework
di: Nasarian, Elham, et al.
Pubblicazione: (2023)