Variance Reduction via Resampling and Experience Replay
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Han, Jiale, Dai, Xiaowu, Zhu, Yuhua |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Variance Reduction Based Experience Replay for Policy Optimization
par: Zheng, Hua, et autres
Publié: (2026)
par: Zheng, Hua, et autres
Publié: (2026)
Online Auction Design Using Distribution-Free Uncertainty Quantification with Applications to E-Commerce
par: Han, Jiale, et autres
Publié: (2024)
par: Han, Jiale, et autres
Publié: (2024)
A Robust Multi-Item Auction Design with Statistical Learning
par: Han, Jiale, et autres
Publié: (2023)
par: Han, Jiale, et autres
Publié: (2023)
Incentivizing Truthful Language Models via Peer Elicitation Games
par: Chen, Baiting, et autres
Publié: (2025)
par: Chen, Baiting, et autres
Publié: (2025)
On the Convergence of Experience Replay in Policy Optimization: Characterizing Bias, Variance, and Finite-Time Convergence
par: Zheng, Hua, et autres
Publié: (2021)
par: Zheng, Hua, et autres
Publié: (2021)
Uncertainty Prioritized Experience Replay
par: Carrasco-Davis, Rodrigo, et autres
Publié: (2025)
par: Carrasco-Davis, Rodrigo, et autres
Publié: (2025)
Revisiting Experience Replayable Conditions
par: Kobayashi, Taisuke
Publié: (2024)
par: Kobayashi, Taisuke
Publié: (2024)
Post-Regularization Confidence Bands for Ordinary Differential Equations
par: Dai, Xiaowu, et autres
Publié: (2021)
par: Dai, Xiaowu, et autres
Publié: (2021)
Reliability-Adjusted Prioritized Experience Replay
par: Pleiss, Leonard S., et autres
Publié: (2025)
par: Pleiss, Leonard S., et autres
Publié: (2025)
Maximum Entropy Hindsight Experience Replay
par: Crowder, Douglas C., et autres
Publié: (2024)
par: Crowder, Douglas C., et autres
Publié: (2024)
Finite-Time Analysis of Temporal Difference Learning with Experience Replay
par: Lim, Han-Dong, et autres
Publié: (2023)
par: Lim, Han-Dong, et autres
Publié: (2023)
Experience Replay with Random Reshuffling
par: Fujita, Yasuhiro
Publié: (2025)
par: Fujita, Yasuhiro
Publié: (2025)
VLM-Guided Experience Replay
par: Sharony, Elad, et autres
Publié: (2026)
par: Sharony, Elad, et autres
Publié: (2026)
Enabling On-Device Learning via Experience Replay with Efficient Dataset Condensation
par: Xu, Gelei, et autres
Publié: (2024)
par: Xu, Gelei, et autres
Publié: (2024)
SPRINT: Stochastic Performative Prediction With Variance Reduction
par: Xie, Tian, et autres
Publié: (2025)
par: Xie, Tian, et autres
Publié: (2025)
Non-Uniform Memory Sampling in Experience Replay
par: Krutsylo, Andrii
Publié: (2025)
par: Krutsylo, Andrii
Publié: (2025)
Efficient RL Training for LLMs with Experience Replay
par: Arnal, Charles, et autres
Publié: (2026)
par: Arnal, Charles, et autres
Publié: (2026)
On the Limitation and Experience Replay for GNNs in Continual Learning
par: Su, Junwei, et autres
Publié: (2023)
par: Su, Junwei, et autres
Publié: (2023)
Ranked Set Sampling-Based Multilayer Perceptron: Improving Generalization via Variance-Based Bounds
par: Li, Feijiang, et autres
Publié: (2025)
par: Li, Feijiang, et autres
Publié: (2025)
Auto-bidding under Return-on-Spend Constraints with Uncertainty Quantification
par: Han, Jiale, et autres
Publié: (2025)
par: Han, Jiale, et autres
Publié: (2025)
Hindsight Experience Replay Accelerates Proximal Policy Optimization
par: Crowder, Douglas C., et autres
Publié: (2024)
par: Crowder, Douglas C., et autres
Publié: (2024)
A Tighter Convergence Proof of Reverse Experience Replay
par: Jiang, Nan, et autres
Publié: (2024)
par: Jiang, Nan, et autres
Publié: (2024)
vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
par: Zhu, Yiwen, et autres
Publié: (2024)
par: Zhu, Yiwen, et autres
Publié: (2024)
ROER: Regularized Optimal Experience Replay
par: Li, Changling, et autres
Publié: (2024)
par: Li, Changling, et autres
Publié: (2024)
Fairness-aware kidney exchange and kidney paired donation
par: Zhang, Mingrui, et autres
Publié: (2025)
par: Zhang, Mingrui, et autres
Publié: (2025)
A Data Envelopment Analysis Approach for Assessing Fairness in Resource Allocation: Application to Kidney Exchange Programs
par: Kaazempur-Mofrad, Ali, et autres
Publié: (2024)
par: Kaazempur-Mofrad, Ali, et autres
Publié: (2024)
Conformal Risk Minimization with Variance Reduction
par: Noorani, Sima, et autres
Publié: (2024)
par: Noorani, Sima, et autres
Publié: (2024)
SelfReplay: Adapting Self-Supervised Sensory Models via Adaptive Meta-Task Replay
par: Yoon, Hyungjun, et autres
Publié: (2024)
par: Yoon, Hyungjun, et autres
Publié: (2024)
Preliminary Tests of the Anticipatory Classifier System with Hindsight Experience Replay
par: Unold, Olgierd, et autres
Publié: (2026)
par: Unold, Olgierd, et autres
Publié: (2026)
Effect Decomposition of Functional-Output Computer Experiments via Orthogonal Additive Gaussian Processes
par: Tan, Yu, et autres
Publié: (2025)
par: Tan, Yu, et autres
Publié: (2025)
Ctrl-Z: Controlling AI Agents via Resampling
par: Bhatt, Aryan, et autres
Publié: (2025)
par: Bhatt, Aryan, et autres
Publié: (2025)
On the Reduction of Variance and Overestimation of Deep Q-Learning
par: Sabry, Mohammed, et autres
Publié: (2019)
par: Sabry, Mohammed, et autres
Publié: (2019)
Mastering the Game of Go with Self-play Experience Replay
par: Liu, Jingbin, et autres
Publié: (2026)
par: Liu, Jingbin, et autres
Publié: (2026)
Non-Convex Optimization in Federated Learning via Variance Reduction and Adaptive Learning
par: Thakur, Dipanwita, et autres
Publié: (2024)
par: Thakur, Dipanwita, et autres
Publié: (2024)
AdaER: An Adaptive Experience Replay Approach for Continual Lifelong Learning
par: Li, Xingyu, et autres
Publié: (2023)
par: Li, Xingyu, et autres
Publié: (2023)
Controllable Generation via Locally Constrained Resampling
par: Ahmed, Kareem, et autres
Publié: (2024)
par: Ahmed, Kareem, et autres
Publié: (2024)
Prediction-Powered Conditional Inference
par: Sui, Yang, et autres
Publié: (2026)
par: Sui, Yang, et autres
Publié: (2026)
Catastrophic Forgetting Mitigation via Discrepancy-Weighted Experience Replay
par: Xu, Xinrun, et autres
Publié: (2025)
par: Xu, Xinrun, et autres
Publié: (2025)
Variance Reduction for the Independent Metropolis Sampler
par: Liu, Siran, et autres
Publié: (2024)
par: Liu, Siran, et autres
Publié: (2024)
On Variance Reduction in Learning Mean Flows
par: Lu, Juanwu, et autres
Publié: (2026)
par: Lu, Juanwu, et autres
Publié: (2026)
Documents similaires
-
Variance Reduction Based Experience Replay for Policy Optimization
par: Zheng, Hua, et autres
Publié: (2026) -
Online Auction Design Using Distribution-Free Uncertainty Quantification with Applications to E-Commerce
par: Han, Jiale, et autres
Publié: (2024) -
A Robust Multi-Item Auction Design with Statistical Learning
par: Han, Jiale, et autres
Publié: (2023) -
Incentivizing Truthful Language Models via Peer Elicitation Games
par: Chen, Baiting, et autres
Publié: (2025) -
On the Convergence of Experience Replay in Policy Optimization: Characterizing Bias, Variance, and Finite-Time Convergence
par: Zheng, Hua, et autres
Publié: (2021)