Anytime-Competitive Reinforcement Learning with Policy Prior
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Jianyi, Li, Pengfei, Li, Tongxin, Wierman, Adam, Ren, Shaolei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning-Augmented Decentralized Online Convex Optimization in Networks
di: Li, Pengfei, et al.
Pubblicazione: (2023)
di: Li, Pengfei, et al.
Pubblicazione: (2023)
Online Budgeted Matching with General Bids
di: Yang, Jianyi, et al.
Pubblicazione: (2024)
di: Yang, Jianyi, et al.
Pubblicazione: (2024)
Safe Exploitative Play with Untrusted Type Beliefs
di: Li, Tongxin, et al.
Pubblicazione: (2024)
di: Li, Tongxin, et al.
Pubblicazione: (2024)
Learning-Augmented Online Control for Decarbonizing Water Infrastructures
di: Yang, Jianyi, et al.
Pubblicazione: (2025)
di: Yang, Jianyi, et al.
Pubblicazione: (2025)
Building Socially-Equitable Public Models
di: Liu, Yejia, et al.
Pubblicazione: (2024)
di: Liu, Yejia, et al.
Pubblicazione: (2024)
Fairness-Regularized Online Optimization with Switching Costs
di: Li, Pengfei, et al.
Pubblicazione: (2025)
di: Li, Pengfei, et al.
Pubblicazione: (2025)
Reinforcement Learning with Imperfect Transition Predictions: A Bellman-Jensen Approach
di: Lu, Chenbei, et al.
Pubblicazione: (2025)
di: Lu, Chenbei, et al.
Pubblicazione: (2025)
Towards Environmentally Equitable AI via Geographical Load Balancing
di: Li, Pengfei, et al.
Pubblicazione: (2023)
di: Li, Pengfei, et al.
Pubblicazione: (2023)
Towards Socially and Environmentally Responsible AI
di: Li, Pengfei, et al.
Pubblicazione: (2024)
di: Li, Pengfei, et al.
Pubblicazione: (2024)
Making AI Less "Thirsty": Uncovering and Addressing the Secret Water Footprint of AI Models
di: Li, Pengfei, et al.
Pubblicazione: (2023)
di: Li, Pengfei, et al.
Pubblicazione: (2023)
Towards Environmentally Equitable AI
di: Hajiesmaili, Mohammad, et al.
Pubblicazione: (2024)
di: Hajiesmaili, Mohammad, et al.
Pubblicazione: (2024)
WaterAdmin: Orchestrating Community Water Distribution Optimization via AI Agents
di: Wen, Jiaqi, et al.
Pubblicazione: (2026)
di: Wen, Jiaqi, et al.
Pubblicazione: (2026)
Model-Free Robust $ϕ$-Divergence Reinforcement Learning Using Both Offline and Online Data
di: Panaganti, Kishan, et al.
Pubblicazione: (2024)
di: Panaganti, Kishan, et al.
Pubblicazione: (2024)
Policy-Based Trajectory Clustering in Offline Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2025)
di: Hu, Hao, et al.
Pubblicazione: (2025)
Predicting Public Health Impacts of Electricity Usage
di: Liu, Yejia, et al.
Pubblicazione: (2025)
di: Liu, Yejia, et al.
Pubblicazione: (2025)
Small Bottle, Big Pipe: Quantifying and Addressing the Impact of Data Centers on Public Water Systems
di: Han, Yuelin, et al.
Pubblicazione: (2026)
di: Han, Yuelin, et al.
Pubblicazione: (2026)
Overcoming the Curse of Dimensionality in Reinforcement Learning Through Approximate Factorization
di: Lu, Chenbei, et al.
Pubblicazione: (2024)
di: Lu, Chenbei, et al.
Pubblicazione: (2024)
Sample-Efficient Robust Multi-Agent Reinforcement Learning in the Face of Environmental Uncertainty
di: Shi, Laixi, et al.
Pubblicazione: (2024)
di: Shi, Laixi, et al.
Pubblicazione: (2024)
Anytime-Constrained Reinforcement Learning
di: McMahan, Jeremy, et al.
Pubblicazione: (2023)
di: McMahan, Jeremy, et al.
Pubblicazione: (2023)
Hybrid Transfer Reinforcement Learning: Provable Sample Efficiency from Shifted-Dynamics Data
di: Qu, Chengrui, et al.
Pubblicazione: (2024)
di: Qu, Chengrui, et al.
Pubblicazione: (2024)
Distributionally Robust Constrained Reinforcement Learning under Strong Duality
di: Zhang, Zhengfei, et al.
Pubblicazione: (2024)
di: Zhang, Zhengfei, et al.
Pubblicazione: (2024)
A Water Efficiency Dataset for African Data Centers
di: Shumba, Noah, et al.
Pubblicazione: (2024)
di: Shumba, Noah, et al.
Pubblicazione: (2024)
Enhancing Efficiency of Safe Reinforcement Learning via Sample Manipulation
di: Gu, Shangding, et al.
Pubblicazione: (2024)
di: Gu, Shangding, et al.
Pubblicazione: (2024)
Learning-Augmented Competitive Algorithms for Spatiotemporal Online Allocation with Deadline Constraints
di: Lechowicz, Adam, et al.
Pubblicazione: (2024)
di: Lechowicz, Adam, et al.
Pubblicazione: (2024)
Breaking the Curse of Multiagency in Robust Multi-Agent Reinforcement Learning
di: Shi, Laixi, et al.
Pubblicazione: (2024)
di: Shi, Laixi, et al.
Pubblicazione: (2024)
Efficient Policy Optimization in Robust Constrained MDPs with Iteration Complexity Guarantees
di: Ganguly, Sourav, et al.
Pubblicazione: (2025)
di: Ganguly, Sourav, et al.
Pubblicazione: (2025)
The Unpaid Toll: Estimating and Addressing the Public Health Impact of Data Centers
di: Han, Yuelin, et al.
Pubblicazione: (2024)
di: Han, Yuelin, et al.
Pubblicazione: (2024)
Policy Improvement Reinforcement Learning
di: Wang, Huaiyang, et al.
Pubblicazione: (2026)
di: Wang, Huaiyang, et al.
Pubblicazione: (2026)
SCaLE: Switching Cost aware Learning and Exploration
di: Bhuyan, Neelkamal, et al.
Pubblicazione: (2026)
di: Bhuyan, Neelkamal, et al.
Pubblicazione: (2026)
Prediction-Specific Design of Learning-Augmented Algorithms
di: Li, Sizhe, et al.
Pubblicazione: (2025)
di: Li, Sizhe, et al.
Pubblicazione: (2025)
Policy Bifurcation in Safe Reinforcement Learning
di: Zou, Wenjun, et al.
Pubblicazione: (2024)
di: Zou, Wenjun, et al.
Pubblicazione: (2024)
Competitive Algorithms for Multi-Agent Ski-Rental Problems
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
Graphon Mean-Field Subsampling for Cooperative Heterogeneous Multi-Agent Reinforcement Learning
di: Anand, Emile, et al.
Pubblicazione: (2026)
di: Anand, Emile, et al.
Pubblicazione: (2026)
Learning the Uncertainty Sets for Control Dynamics via Set Membership: A Non-Asymptotic Analysis
di: Li, Yingying, et al.
Pubblicazione: (2023)
di: Li, Yingying, et al.
Pubblicazione: (2023)
Bandits with Anytime Knapsacks
di: Elumar, Eray Can, et al.
Pubblicazione: (2025)
di: Elumar, Eray Can, et al.
Pubblicazione: (2025)
Out-of-Distribution-Aware Electric Vehicle Charging
di: Li, Tongxin, et al.
Pubblicazione: (2023)
di: Li, Tongxin, et al.
Pubblicazione: (2023)
Conformal Risk Training: End-to-End Optimization of Conformal Risk Control
di: Yeh, Christopher, et al.
Pubblicazione: (2025)
di: Yeh, Christopher, et al.
Pubblicazione: (2025)
3D-Learning: Diffusion-Augmented Distributionally Robust Decision-Focused Learning
di: Wen, Jiaqi, et al.
Pubblicazione: (2026)
di: Wen, Jiaqi, et al.
Pubblicazione: (2026)
Robust Gymnasium: A Unified Modular Benchmark for Robust Reinforcement Learning
di: Gu, Shangding, et al.
Pubblicazione: (2025)
di: Gu, Shangding, et al.
Pubblicazione: (2025)
Truncated Rectified Flow Policy for Reinforcement Learning with One-Step Sampling
di: Zhou, Xubin, et al.
Pubblicazione: (2026)
di: Zhou, Xubin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Learning-Augmented Decentralized Online Convex Optimization in Networks
di: Li, Pengfei, et al.
Pubblicazione: (2023) -
Online Budgeted Matching with General Bids
di: Yang, Jianyi, et al.
Pubblicazione: (2024) -
Safe Exploitative Play with Untrusted Type Beliefs
di: Li, Tongxin, et al.
Pubblicazione: (2024) -
Learning-Augmented Online Control for Decarbonizing Water Infrastructures
di: Yang, Jianyi, et al.
Pubblicazione: (2025) -
Building Socially-Equitable Public Models
di: Liu, Yejia, et al.
Pubblicazione: (2024)