Enregistré dans:
| Auteurs principaux: | Liao, Luofeng, Fu, Zuyue, Yang, Zhuoran, Wang, Yixin, Kolar, Mladen, Wang, Zhaoran |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2102.09907 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes
par: Lu, Miao, et autres
Publié: (2022)
par: Lu, Miao, et autres
Publié: (2022)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
par: Bai, Chenjia, et autres
Publié: (2024)
par: Bai, Chenjia, et autres
Publié: (2024)
An Instrumental Value for Data Production and its Application to Data Pricing
par: Ai, Rui, et autres
Publié: (2024)
par: Ai, Rui, et autres
Publié: (2024)
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning
par: Zhang, Dake, et autres
Publié: (2024)
par: Zhang, Dake, et autres
Publié: (2024)
Reinforcement Learning from Partial Observation: Linear Function Approximation with Provable Sample Efficiency
par: Cai, Qi, et autres
Publié: (2022)
par: Cai, Qi, et autres
Publié: (2022)
Contrastive UCB: Provably Efficient Contrastive Self-Supervised Learning in Online Reinforcement Learning
par: Qiu, Shuang, et autres
Publié: (2022)
par: Qiu, Shuang, et autres
Publié: (2022)
Double Duality: Variational Primal-Dual Policy Optimization for Constrained Reinforcement Learning
par: Li, Zihao, et autres
Publié: (2024)
par: Li, Zihao, et autres
Publié: (2024)
Federated Offline Reinforcement Learning
par: Zhou, Doudou, et autres
Publié: (2022)
par: Zhou, Doudou, et autres
Publié: (2022)
SMART: A Spectral Transfer Approach to Multi-Task Learning
par: Zhao, Boxin, et autres
Publié: (2026)
par: Zhao, Boxin, et autres
Publié: (2026)
Trans-Glasso: A Transfer Learning Approach to Precision Matrix Estimation
par: Zhao, Boxin, et autres
Publié: (2024)
par: Zhao, Boxin, et autres
Publié: (2024)
Embed to Control Partially Observed Systems: Representation Learning with Provable Sample Efficiency
par: Wang, Lingxiao, et autres
Publié: (2022)
par: Wang, Lingxiao, et autres
Publié: (2022)
Gradient Clipping Beyond Vector Norms: A Spectral Approach for Matrix-Valued Parameters
par: Yukhimchuk, Alexander, et autres
Publié: (2026)
par: Yukhimchuk, Alexander, et autres
Publié: (2026)
A Reinforcement Learning Approach in Multi-Phase Second-Price Auction Design
par: Ai, Rui, et autres
Publié: (2022)
par: Ai, Rui, et autres
Publié: (2022)
High-dimensional Functional Graphical Model Structure Learning via Neighborhood Selection Approach
par: Zhao, Boxin, et autres
Publié: (2021)
par: Zhao, Boxin, et autres
Publié: (2021)
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning
par: Di, Qiwei, et autres
Publié: (2023)
par: Di, Qiwei, et autres
Publié: (2023)
Can Temporal-Difference and Q-Learning Learn Representation? A Mean-Field Theory
par: Zhang, Yufeng, et autres
Publié: (2020)
par: Zhang, Yufeng, et autres
Publié: (2020)
Learning Dynamic Mechanisms in Unknown Environments: A Reinforcement Learning Approach
par: Qiu, Shuang, et autres
Publié: (2022)
par: Qiu, Shuang, et autres
Publié: (2022)
Provably Efficient Exploration in Policy Optimization
par: Cai, Qi, et autres
Publié: (2019)
par: Cai, Qi, et autres
Publié: (2019)
Policy learning "without" overlap: Pessimism and generalized empirical Bernstein's inequality
par: Jin, Ying, et autres
Publié: (2022)
par: Jin, Ying, et autres
Publié: (2022)
Variational Transport: A Convergent Particle-BasedAlgorithm for Distributional Optimization
par: Yang, Zhuoran, et autres
Publié: (2020)
par: Yang, Zhuoran, et autres
Publié: (2020)
High-Dimensional Markov-switching Ordinary Differential Processes
par: Tsai, Katherine, et autres
Publié: (2024)
par: Tsai, Katherine, et autres
Publié: (2024)
Optimistic Policy Optimization is Provably Efficient in Non-stationary MDPs
par: Zhong, Han, et autres
Publié: (2021)
par: Zhong, Han, et autres
Publié: (2021)
Wasserstein Flow Meets Replicator Dynamics: A Mean-Field Analysis of Representation Learning in Actor-Critic
par: Zhang, Yufeng, et autres
Publié: (2021)
par: Zhang, Yufeng, et autres
Publié: (2021)
Contextual Dynamic Pricing with Strategic Buyers
par: Liu, Pangpang, et autres
Publié: (2023)
par: Liu, Pangpang, et autres
Publié: (2023)
Provable Accelerated Bayesian Optimization with Knowledge Transfer
par: Lin, Haitao, et autres
Publié: (2025)
par: Lin, Haitao, et autres
Publié: (2025)
Confounded Causal Imitation Learning with Instrumental Variables
par: Zeng, Yan, et autres
Publié: (2025)
par: Zeng, Yan, et autres
Publié: (2025)
Active Advantage-Aligned Online Reinforcement Learning with Offline Data
par: Liu, Xuefeng, et autres
Publié: (2025)
par: Liu, Xuefeng, et autres
Publié: (2025)
A Mean-Field Analysis of Neural Stochastic Gradient Descent-Ascent for Functional Minimax Optimization
par: Zhu, Yuchen, et autres
Publié: (2024)
par: Zhu, Yuchen, et autres
Publié: (2024)
Adaptive Client Sampling in Federated Learning via Online Learning with Bandit Feedback
par: Zhao, Boxin, et autres
Publié: (2021)
par: Zhao, Boxin, et autres
Publié: (2021)
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
par: Wang, Danyang, et autres
Publié: (2024)
par: Wang, Danyang, et autres
Publié: (2024)
High-Dimensional Differential Parameter Inference in Exponential Family using Time Score Matching
par: Williams, Daniel J., et autres
Publié: (2024)
par: Williams, Daniel J., et autres
Publié: (2024)
Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts
par: Qiao, Zhongjian, et autres
Publié: (2025)
par: Qiao, Zhongjian, et autres
Publié: (2025)
AdAdaGrad: Adaptive Batch Size Schemes for Adaptive Gradient Methods
par: Lau, Tim Tsz-Kit, et autres
Publié: (2024)
par: Lau, Tim Tsz-Kit, et autres
Publié: (2024)
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning
par: Chen, Xuyang, et autres
Publié: (2025)
par: Chen, Xuyang, et autres
Publié: (2025)
Policy-Guided Causal State Representation for Offline Reinforcement Learning Recommendation
par: Wang, Siyu, et autres
Publié: (2025)
par: Wang, Siyu, et autres
Publié: (2025)
Personalized Binomial DAGs Learning with Network Structured Covariates
par: Zhao, Boxin, et autres
Publié: (2024)
par: Zhao, Boxin, et autres
Publié: (2024)
Making Offline RL Online: Collaborative World Models for Offline Visual Reinforcement Learning
par: Wang, Qi, et autres
Publié: (2023)
par: Wang, Qi, et autres
Publié: (2023)
MACCA: Offline Multi-agent Reinforcement Learning with Causal Credit Assignment
par: Wang, Ziyan, et autres
Publié: (2023)
par: Wang, Ziyan, et autres
Publié: (2023)
Causal GNNs: A GNN-Driven Instrumental Variable Approach for Causal Inference in Networks
par: Du, Xiaojing, et autres
Publié: (2024)
par: Du, Xiaojing, et autres
Publié: (2024)
CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation
par: Zhang, Zhengzhe, et autres
Publié: (2025)
par: Zhang, Zhengzhe, et autres
Publié: (2025)
Documents similaires
-
Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes
par: Lu, Miao, et autres
Publié: (2022) -
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
par: Bai, Chenjia, et autres
Publié: (2024) -
An Instrumental Value for Data Production and its Application to Data Pricing
par: Ai, Rui, et autres
Publié: (2024) -
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning
par: Zhang, Dake, et autres
Publié: (2024) -
Reinforcement Learning from Partial Observation: Linear Function Approximation with Provable Sample Efficiency
par: Cai, Qi, et autres
Publié: (2022)