Sample-Efficiency in Multi-Batch Reinforcement Learning: The Need for Dimension-Dependent Adaptivity
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Johnson, Emmeran, Pike-Burke, Ciara, Rebeschini, Patrick |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Stochastic Shortest Path with Sparse Adversarial Costs
von: Johnson, Emmeran, et al.
Veröffentlicht: (2025)
von: Johnson, Emmeran, et al.
Veröffentlicht: (2025)
On the necessity of adaptive regularisation:Optimal anytime online learning on $\boldsymbol{\ell_p}$-balls
von: Johnson, Emmeran, et al.
Veröffentlicht: (2025)
von: Johnson, Emmeran, et al.
Veröffentlicht: (2025)
Scalable On-Policy Reinforcement Learning via Adaptive Batch Scaling
von: Park, Jongchan
Veröffentlicht: (2026)
von: Park, Jongchan
Veröffentlicht: (2026)
Batch Bayesian Active Learning with Partial Batch Label Sampling
von: Hu, Kangping, et al.
Veröffentlicht: (2025)
von: Hu, Kangping, et al.
Veröffentlicht: (2025)
Boosting Sample Efficiency and Generalization in Multi-agent Reinforcement Learning via Equivariance
von: McClellan, Joshua, et al.
Veröffentlicht: (2024)
von: McClellan, Joshua, et al.
Veröffentlicht: (2024)
Adaptive Batch-Wise Sample Scheduling for Direct Preference Optimization
von: Huang, Zixuan, et al.
Veröffentlicht: (2025)
von: Huang, Zixuan, et al.
Veröffentlicht: (2025)
Meta-Learning Objectives for Preference Optimization
von: Alfano, Carlo, et al.
Veröffentlicht: (2024)
von: Alfano, Carlo, et al.
Veröffentlicht: (2024)
Fixed-Confidence Multiple Change Point Identification under Bandit Feedback
von: Lazzaro, Joseph, et al.
Veröffentlicht: (2025)
von: Lazzaro, Joseph, et al.
Veröffentlicht: (2025)
Fixed-Budget Change Point Identification in Piecewise Constant Bandits
von: Lazzaro, Joseph, et al.
Veröffentlicht: (2025)
von: Lazzaro, Joseph, et al.
Veröffentlicht: (2025)
LEASE: Offline Preference-based Reinforcement Learning with High Sample Efficiency
von: Liu, Xiao-Yin, et al.
Veröffentlicht: (2024)
von: Liu, Xiao-Yin, et al.
Veröffentlicht: (2024)
On the Sample Efficiency of Abstractions and Potential-Based Reward Shaping in Reinforcement Learning
von: Canonaco, Giuseppe, et al.
Veröffentlicht: (2024)
von: Canonaco, Giuseppe, et al.
Veröffentlicht: (2024)
Towards Batch-to-Streaming Deep Reinforcement Learning for Continuous Control
von: De Monte, Riccardo, et al.
Veröffentlicht: (2026)
von: De Monte, Riccardo, et al.
Veröffentlicht: (2026)
Scaling Off-Policy Reinforcement Learning with Batch and Weight Normalization
von: Palenicek, Daniel, et al.
Veröffentlicht: (2025)
von: Palenicek, Daniel, et al.
Veröffentlicht: (2025)
Reverse Forward Curriculum Learning for Extreme Sample and Demonstration Efficiency in Reinforcement Learning
von: Tao, Stone, et al.
Veröffentlicht: (2024)
von: Tao, Stone, et al.
Veröffentlicht: (2024)
Search-Based Adversarial Estimates for Improving Sample Efficiency in Off-Policy Reinforcement Learning
von: Malato, Federico, et al.
Veröffentlicht: (2025)
von: Malato, Federico, et al.
Veröffentlicht: (2025)
Demonstration Guided Multi-Objective Reinforcement Learning
von: Lu, Junlin, et al.
Veröffentlicht: (2024)
von: Lu, Junlin, et al.
Veröffentlicht: (2024)
Adaptive and Robust DBSCAN with Multi-agent Reinforcement Learning
von: Peng, Hao, et al.
Veröffentlicht: (2025)
von: Peng, Hao, et al.
Veröffentlicht: (2025)
BatchTopK Sparse Autoencoders
von: Bussmann, Bart, et al.
Veröffentlicht: (2024)
von: Bussmann, Bart, et al.
Veröffentlicht: (2024)
Easy Samples Are All You Need: Self-Evolving LLMs via Data-Efficient Reinforcement Learning
von: Yu, Zhiyin, et al.
Veröffentlicht: (2026)
von: Yu, Zhiyin, et al.
Veröffentlicht: (2026)
Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search
von: Najib, Amna, et al.
Veröffentlicht: (2024)
von: Najib, Amna, et al.
Veröffentlicht: (2024)
Learning Fair And Effective Points-Based Rewards Programs
von: Hssaine, Chamsi, et al.
Veröffentlicht: (2025)
von: Hssaine, Chamsi, et al.
Veröffentlicht: (2025)
A Meta-Learning Approach for Multi-Objective Reinforcement Learning in Sustainable Home Environments
von: Lu, Junlin, et al.
Veröffentlicht: (2024)
von: Lu, Junlin, et al.
Veröffentlicht: (2024)
Speculative Sampling with Reinforcement Learning
von: Wang, Chenan, et al.
Veröffentlicht: (2026)
von: Wang, Chenan, et al.
Veröffentlicht: (2026)
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
von: Xie, Hong, et al.
Veröffentlicht: (2026)
von: Xie, Hong, et al.
Veröffentlicht: (2026)
Adaptive Multi-Agent Deep Reinforcement Learning for Timely Healthcare Interventions
von: Shaik, Thanveer, et al.
Veröffentlicht: (2023)
von: Shaik, Thanveer, et al.
Veröffentlicht: (2023)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
SamBaTen: Sampling-based Batch Incremental Tensor Decomposition
von: Gujral, Ekta, et al.
Veröffentlicht: (2017)
von: Gujral, Ekta, et al.
Veröffentlicht: (2017)
Beyond Training: Optimizing Reinforcement Learning Based Job Shop Scheduling Through Adaptive Action Sampling
von: de Puiseau, Constantin Waubert, et al.
Veröffentlicht: (2024)
von: de Puiseau, Constantin Waubert, et al.
Veröffentlicht: (2024)
Adaptive Multi-Fidelity Reinforcement Learning for Variance Reduction in Engineering Design Optimization
von: Agrawal, Akash, et al.
Veröffentlicht: (2025)
von: Agrawal, Akash, et al.
Veröffentlicht: (2025)
Shared-unique Features and Task-aware Prioritized Sampling on Multi-task Reinforcement Learning
von: Lin, Po-Shao, et al.
Veröffentlicht: (2024)
von: Lin, Po-Shao, et al.
Veröffentlicht: (2024)
A Survey of Explainable Reinforcement Learning: Targets, Methods and Needs
von: Saulières, Léo
Veröffentlicht: (2025)
von: Saulières, Léo
Veröffentlicht: (2025)
Reinforcement Learning in Dynamic Treatment Regimes Needs Critical Reexamination
von: Luo, Zhiyao, et al.
Veröffentlicht: (2024)
von: Luo, Zhiyao, et al.
Veröffentlicht: (2024)
Locally Differentially Private Thresholding Bandits
von: Barbara, Annalisa, et al.
Veröffentlicht: (2025)
von: Barbara, Annalisa, et al.
Veröffentlicht: (2025)
When and why randomised exploration works (in linear bandits)
von: Abeille, Marc, et al.
Veröffentlicht: (2025)
von: Abeille, Marc, et al.
Veröffentlicht: (2025)
QuACK: A Multipurpose Queuing Algorithm for Cooperative $k$-Armed Bandits
von: Howson, Benjamin, et al.
Veröffentlicht: (2024)
von: Howson, Benjamin, et al.
Veröffentlicht: (2024)
Reasoner for Real-World Event Detection: Scaling Reinforcement Learning via Adaptive Perplexity-Aware Sampling Strategy
von: Zhang, Xiaoyun, et al.
Veröffentlicht: (2025)
von: Zhang, Xiaoyun, et al.
Veröffentlicht: (2025)
On The Sample Complexity Bounds In Bilevel Reinforcement Learning
von: Gaur, Mudit, et al.
Veröffentlicht: (2025)
von: Gaur, Mudit, et al.
Veröffentlicht: (2025)
Trust the Batch, On- or Off-Policy: Adaptive Policy Optimization for RL Post-Training
von: Fakoor, Rasool, et al.
Veröffentlicht: (2026)
von: Fakoor, Rasool, et al.
Veröffentlicht: (2026)
Momentum-Based Federated Reinforcement Learning with Interaction and Communication Efficiency
von: Yue, Sheng, et al.
Veröffentlicht: (2024)
von: Yue, Sheng, et al.
Veröffentlicht: (2024)
Subgoal-based Reward Shaping to Improve Efficiency in Reinforcement Learning
von: Okudo, Takato, et al.
Veröffentlicht: (2021)
von: Okudo, Takato, et al.
Veröffentlicht: (2021)
Ähnliche Einträge
-
Stochastic Shortest Path with Sparse Adversarial Costs
von: Johnson, Emmeran, et al.
Veröffentlicht: (2025) -
On the necessity of adaptive regularisation:Optimal anytime online learning on $\boldsymbol{\ell_p}$-balls
von: Johnson, Emmeran, et al.
Veröffentlicht: (2025) -
Scalable On-Policy Reinforcement Learning via Adaptive Batch Scaling
von: Park, Jongchan
Veröffentlicht: (2026) -
Batch Bayesian Active Learning with Partial Batch Label Sampling
von: Hu, Kangping, et al.
Veröffentlicht: (2025) -
Boosting Sample Efficiency and Generalization in Multi-agent Reinforcement Learning via Equivariance
von: McClellan, Joshua, et al.
Veröffentlicht: (2024)