A Fast Convergence Theory for Offline Decision Making
Fuente:
arXiv
Salvato in:
| Autori principali: | Mao, Chenjie, Zhang, Qiaosheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On The Statistical Complexity of Offline Decision-Making
di: Nguyen-Tang, Thanh, et al.
Pubblicazione: (2025)
di: Nguyen-Tang, Thanh, et al.
Pubblicazione: (2025)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
di: Wang, Changhong, et al.
Pubblicazione: (2024)
di: Wang, Changhong, et al.
Pubblicazione: (2024)
DSADF: Thinking Fast and Slow for Decision Making
di: Dou, Zhihao, et al.
Pubblicazione: (2025)
di: Dou, Zhihao, et al.
Pubblicazione: (2025)
Wait-Less Offline Tuning and Re-solving for Online Decision Making
di: Sun, Jingruo, et al.
Pubblicazione: (2024)
di: Sun, Jingruo, et al.
Pubblicazione: (2024)
Is Offline Decision Making Possible with Only Few Samples? Reliable Decisions in Data-Starved Bandits via Trust Region Enhancement
di: Zhang, Ruiqi, et al.
Pubblicazione: (2024)
di: Zhang, Ruiqi, et al.
Pubblicazione: (2024)
Offline Inverse Constrained Reinforcement Learning for Safe-Critical Decision Making in Healthcare
di: Fang, Nan, et al.
Pubblicazione: (2024)
di: Fang, Nan, et al.
Pubblicazione: (2024)
Martingale Posterior Neural Networks for Fast Sequential Decision Making
di: Duran-Martin, Gerardo, et al.
Pubblicazione: (2025)
di: Duran-Martin, Gerardo, et al.
Pubblicazione: (2025)
Community Detection for Contextual-LSBM: Theoretical Limitations of Misclassification Rate and Efficient Algorithms
di: Jin, Dian, et al.
Pubblicazione: (2025)
di: Jin, Dian, et al.
Pubblicazione: (2025)
Making Offline RL Online: Collaborative World Models for Offline Visual Reinforcement Learning
di: Wang, Qi, et al.
Pubblicazione: (2023)
di: Wang, Qi, et al.
Pubblicazione: (2023)
Misclassification Rate and Privacy-Utility Trade-offs in Graph Convolutional Networks via Subsampling Stability
di: Zhang, Yexin, et al.
Pubblicazione: (2026)
di: Zhang, Yexin, et al.
Pubblicazione: (2026)
Diffusion-Based Offline RL for Improved Decision-Making in Augmented ARC Task
di: Kim, Yunho, et al.
Pubblicazione: (2024)
di: Kim, Yunho, et al.
Pubblicazione: (2024)
Sample-Efficient Reinforcement Learning from Human Feedback via Information-Directed Sampling
di: Qi, Han, et al.
Pubblicazione: (2025)
di: Qi, Han, et al.
Pubblicazione: (2025)
Graph Feedback Bandits on Similar Arms: With and Without Graph Structures
di: Qi, Han, et al.
Pubblicazione: (2025)
di: Qi, Han, et al.
Pubblicazione: (2025)
HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
Semi-Decentralized Federated Edge Learning for Fast Convergence on Non-IID Data
di: Sun, Yuchang, et al.
Pubblicazione: (2021)
di: Sun, Yuchang, et al.
Pubblicazione: (2021)
Robust Offline Reinforcement Learning for Non-Markovian Decision Processes
di: Huang, Ruiquan, et al.
Pubblicazione: (2024)
di: Huang, Ruiquan, et al.
Pubblicazione: (2024)
A Review of Causal Decision Making
di: Ge, Lin, et al.
Pubblicazione: (2025)
di: Ge, Lin, et al.
Pubblicazione: (2025)
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning
di: Yan, Teng, et al.
Pubblicazione: (2024)
di: Yan, Teng, et al.
Pubblicazione: (2024)
Bulk-Calibrated Credal Ambiguity Sets: Fast, Tractable Decision Making under Out-of-Sample Contamination
di: Chen, Mengqi, et al.
Pubblicazione: (2026)
di: Chen, Mengqi, et al.
Pubblicazione: (2026)
A Tutorial: An Intuitive Explanation of Offline Reinforcement Learning Theory
di: Che, Fengdi
Pubblicazione: (2025)
di: Che, Fengdi
Pubblicazione: (2025)
Matrix Completion with Hypergraphs:Sharp Thresholds and Efficient Algorithms
di: Ma, Zhongtian, et al.
Pubblicazione: (2024)
di: Ma, Zhongtian, et al.
Pubblicazione: (2024)
Making Reliable and Flexible Decisions in Long-tailed Classification
di: Li, Bolian, et al.
Pubblicazione: (2025)
di: Li, Bolian, et al.
Pubblicazione: (2025)
Gated Graph Attention Networks with Learnable Temperature
di: Ma, Zhongtian, et al.
Pubblicazione: (2026)
di: Ma, Zhongtian, et al.
Pubblicazione: (2026)
When should we prefer Decision Transformers for Offline Reinforcement Learning?
di: Bhargava, Prajjwal, et al.
Pubblicazione: (2023)
di: Bhargava, Prajjwal, et al.
Pubblicazione: (2023)
Risk-Aware Decision Making in Restless Bandits: Theory and Algorithms for Planning and Learning
di: Akbarzadeh, Nima, et al.
Pubblicazione: (2024)
di: Akbarzadeh, Nima, et al.
Pubblicazione: (2024)
Solving Continual Offline Reinforcement Learning with Decision Transformer
di: Huang, Kaixin, et al.
Pubblicazione: (2024)
di: Huang, Kaixin, et al.
Pubblicazione: (2024)
Solving Offline Reinforcement Learning with Decision Tree Regression
di: Koirala, Prajwal, et al.
Pubblicazione: (2024)
di: Koirala, Prajwal, et al.
Pubblicazione: (2024)
Mamba as Decision Maker: Exploring Multi-scale Sequence Modeling in Offline Reinforcement Learning
di: Cao, Jiahang, et al.
Pubblicazione: (2024)
di: Cao, Jiahang, et al.
Pubblicazione: (2024)
Covariance-Aware Transformers for Quadratic Programming and Decision Making
di: Tire, Kutay, et al.
Pubblicazione: (2026)
di: Tire, Kutay, et al.
Pubblicazione: (2026)
Graph Attention is Not Always Beneficial: A Theoretical Analysis of Graph Attention Mechanisms via Contextual Stochastic Block Models
di: Ma, Zhongtian, et al.
Pubblicazione: (2024)
di: Ma, Zhongtian, et al.
Pubblicazione: (2024)
Aligning Learning and Endogenous Decision-Making
di: Cristian, Rares, et al.
Pubblicazione: (2025)
di: Cristian, Rares, et al.
Pubblicazione: (2025)
Learning Decisions Offline from Censored Observations with ε-insensitive Operational Costs
di: Chen, Minxia, et al.
Pubblicazione: (2024)
di: Chen, Minxia, et al.
Pubblicazione: (2024)
Debiased Offline Representation Learning for Fast Online Adaptation in Non-stationary Dynamics
di: Zhang, Xinyu, et al.
Pubblicazione: (2024)
di: Zhang, Xinyu, et al.
Pubblicazione: (2024)
Constrained Online Decision-Making: A Unified Framework
di: Hu, Haichen, et al.
Pubblicazione: (2025)
di: Hu, Haichen, et al.
Pubblicazione: (2025)
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
di: Mao, Liyuan, et al.
Pubblicazione: (2024)
di: Mao, Liyuan, et al.
Pubblicazione: (2024)
Generative Models in Decision Making: A Survey
di: Shao, Xinyu, et al.
Pubblicazione: (2025)
di: Shao, Xinyu, et al.
Pubblicazione: (2025)
On the Exponential Convergence for Offline RLHF with Pairwise Comparisons
di: Chen, Zhirui, et al.
Pubblicazione: (2024)
di: Chen, Zhirui, et al.
Pubblicazione: (2024)
Gen-DFL: Decision-Focused Generative Learning for Robust Decision Making
di: Wang, Prince Zizhuang, et al.
Pubblicazione: (2025)
di: Wang, Prince Zizhuang, et al.
Pubblicazione: (2025)
SPARKLE: A Nonparametric Approach for Online Decision-Making with High-Dimensional Covariates
di: Wang, Wenjia, et al.
Pubblicazione: (2025)
di: Wang, Wenjia, et al.
Pubblicazione: (2025)
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
di: Fan, Ziqing, et al.
Pubblicazione: (2024)
di: Fan, Ziqing, et al.
Pubblicazione: (2024)
Documenti analoghi
-
On The Statistical Complexity of Offline Decision-Making
di: Nguyen-Tang, Thanh, et al.
Pubblicazione: (2025) -
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
di: Wang, Changhong, et al.
Pubblicazione: (2024) -
DSADF: Thinking Fast and Slow for Decision Making
di: Dou, Zhihao, et al.
Pubblicazione: (2025) -
Wait-Less Offline Tuning and Re-solving for Online Decision Making
di: Sun, Jingruo, et al.
Pubblicazione: (2024) -
Is Offline Decision Making Possible with Only Few Samples? Reliable Decisions in Data-Starved Bandits via Trust Region Enhancement
di: Zhang, Ruiqi, et al.
Pubblicazione: (2024)