Partition Tree Weighting for Non-Stationary Stochastic Bandits
Fuente:
arXiv
Salvato in:
| Autori principali: | Veness, Joel, Hutter, Marcus, Gyorgy, Andras, Grau-Moya, Jordi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Incentivized Exploration of Non-Stationary Stochastic Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2024)
di: Chakraborty, Sourav, et al.
Pubblicazione: (2024)
Learning Universal Predictors
di: Grau-Moya, Jordi, et al.
Pubblicazione: (2024)
di: Grau-Moya, Jordi, et al.
Pubblicazione: (2024)
Understanding Prompt Tuning and In-Context Learning via Meta-Learning
di: Genewein, Tim, et al.
Pubblicazione: (2025)
di: Genewein, Tim, et al.
Pubblicazione: (2025)
Non-Stationary Learning of Neural Networks with Automatic Soft Parameter Reset
di: Galashov, Alexandre, et al.
Pubblicazione: (2024)
di: Galashov, Alexandre, et al.
Pubblicazione: (2024)
Non-Stationary Latent Auto-Regressive Bandits
di: Trella, Anna L., et al.
Pubblicazione: (2024)
di: Trella, Anna L., et al.
Pubblicazione: (2024)
Amortized Planning with Large-Scale Transformers: A Case Study on Chess
di: Ruoss, Anian, et al.
Pubblicazione: (2024)
di: Ruoss, Anian, et al.
Pubblicazione: (2024)
Language Modeling Is Compression
di: Delétang, Grégoire, et al.
Pubblicazione: (2023)
di: Delétang, Grégoire, et al.
Pubblicazione: (2023)
Smooth Non-Stationary Bandits
di: Jia, Su, et al.
Pubblicazione: (2023)
di: Jia, Su, et al.
Pubblicazione: (2023)
Compression via Pre-trained Transformers: A Study on Byte-Level Multimodal Data
di: Heurtel-Depeiges, David, et al.
Pubblicazione: (2024)
di: Heurtel-Depeiges, David, et al.
Pubblicazione: (2024)
LLMs are Greedy Agents: Effects of RL Fine-tuning on Decision-Making Abilities
di: Schmied, Thomas, et al.
Pubblicazione: (2025)
di: Schmied, Thomas, et al.
Pubblicazione: (2025)
Beyond Statistical Learning: Exact Learning Is Essential for General Intelligence
di: György, András, et al.
Pubblicazione: (2025)
di: György, András, et al.
Pubblicazione: (2025)
Isotuning With Applications To Scale-Free Online Learning
di: Orseau, Laurent, et al.
Pubblicazione: (2021)
di: Orseau, Laurent, et al.
Pubblicazione: (2021)
Levin Tree Search with Context Models
di: Orseau, Laurent, et al.
Pubblicazione: (2023)
di: Orseau, Laurent, et al.
Pubblicazione: (2023)
Noise Balance and Stationary Distribution of Stochastic Gradient Descent
di: Ziyin, Liu, et al.
Pubblicazione: (2023)
di: Ziyin, Liu, et al.
Pubblicazione: (2023)
Fusing Reward and Dueling Feedback in Stochastic Bandits
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
A Complete Characterization of Learnability for Stochastic Noisy Bandits
di: Hanneke, Steve, et al.
Pubblicazione: (2024)
di: Hanneke, Steve, et al.
Pubblicazione: (2024)
In-Context Learning for Non-Stationary MIMO Equalization
di: Jiang, Jiachen, et al.
Pubblicazione: (2025)
di: Jiang, Jiachen, et al.
Pubblicazione: (2025)
Improving LLM-based Global Optimization with Search Space Partitioning
di: Schwanke, Andrej, et al.
Pubblicazione: (2025)
di: Schwanke, Andrej, et al.
Pubblicazione: (2025)
Detection Augmented Bandit Procedures for Piecewise Stationary MABs: A Modular Approach
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)
Almost Minimax Optimal Best Arm Identification in Piecewise Stationary Linear Bandits
di: Hou, Yunlong, et al.
Pubblicazione: (2024)
di: Hou, Yunlong, et al.
Pubblicazione: (2024)
To Believe or Not to Believe Your LLM
di: Yadkori, Yasin Abbasi, et al.
Pubblicazione: (2024)
di: Yadkori, Yasin Abbasi, et al.
Pubblicazione: (2024)
BanditLP: Large-Scale Stochastic Optimization for Personalized Recommendations
di: Nguyen, Phuc, et al.
Pubblicazione: (2026)
di: Nguyen, Phuc, et al.
Pubblicazione: (2026)
Kalman Filter for Online Classification of Non-Stationary Data
di: Titsias, Michalis K., et al.
Pubblicazione: (2023)
di: Titsias, Michalis K., et al.
Pubblicazione: (2023)
Weight-Entanglement Meets Gradient-Based Neural Architecture Search
di: Sukthanker, Rhea Sanjay, et al.
Pubblicazione: (2023)
di: Sukthanker, Rhea Sanjay, et al.
Pubblicazione: (2023)
Multi-Label Transfer Learning in Non-Stationary Data Streams
di: Du, Honghui, et al.
Pubblicazione: (2025)
di: Du, Honghui, et al.
Pubblicazione: (2025)
Decision Making in Non-Stationary Environments with Policy-Augmented Search
di: Pettet, Ava, et al.
Pubblicazione: (2024)
di: Pettet, Ava, et al.
Pubblicazione: (2024)
Inverse Reinforcement Learning from Non-Stationary Learning Agents
di: Sivakumar, Kavinayan P., et al.
Pubblicazione: (2024)
di: Sivakumar, Kavinayan P., et al.
Pubblicazione: (2024)
Online Reinforcement Learning in Non-Stationary Context-Driven Environments
di: Hamadanian, Pouya, et al.
Pubblicazione: (2023)
di: Hamadanian, Pouya, et al.
Pubblicazione: (2023)
Stochastic Submodular Bandits with Delayed Composite Anonymous Bandit Feedback
di: Pedramfar, Mohammad, et al.
Pubblicazione: (2023)
di: Pedramfar, Mohammad, et al.
Pubblicazione: (2023)
Sandbagging in a Simple Survival Bandit Problem
di: Dyer, Joel, et al.
Pubblicazione: (2025)
di: Dyer, Joel, et al.
Pubblicazione: (2025)
Tree Ensembles for Contextual Bandits
di: Nilsson, Hannes, et al.
Pubblicazione: (2024)
di: Nilsson, Hannes, et al.
Pubblicazione: (2024)
Polynomial Threshold Functions of Bounded Tree-Width: Some Explainability and Complexity Aspects
di: Chubarian, Karine, et al.
Pubblicazione: (2025)
di: Chubarian, Karine, et al.
Pubblicazione: (2025)
Causally Abstracted Multi-armed Bandits
di: Zennaro, Fabio Massimo, et al.
Pubblicazione: (2024)
di: Zennaro, Fabio Massimo, et al.
Pubblicazione: (2024)
MARLINE: Multi-Source Mapping Transfer Learning for Non-Stationary Environments
di: Du, Honghui, et al.
Pubblicazione: (2025)
di: Du, Honghui, et al.
Pubblicazione: (2025)
EventTSF: Event-Aware Non-Stationary Time Series Forecasting
di: Ge, Yunfeng, et al.
Pubblicazione: (2025)
di: Ge, Yunfeng, et al.
Pubblicazione: (2025)
Is Prior-Free Black-Box Non-Stationary Reinforcement Learning Feasible?
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2024)
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2024)
c-TPE: Tree-structured Parzen Estimator with Inequality Constraints for Expensive Hyperparameter Optimization
di: Watanabe, Shuhei, et al.
Pubblicazione: (2022)
di: Watanabe, Shuhei, et al.
Pubblicazione: (2022)
Stochastic Weight Sharing for Bayesian Neural Networks
di: Lin, Moule, et al.
Pubblicazione: (2025)
di: Lin, Moule, et al.
Pubblicazione: (2025)
Demystifying Online Clustering of Bandits: Enhanced Exploration Under Stochastic and Smoothed Adversarial Contexts
di: Li, Zhuohua, et al.
Pubblicazione: (2025)
di: Li, Zhuohua, et al.
Pubblicazione: (2025)
Variance-Dependent Regret Bounds for Non-stationary Linear Bandits
di: Wang, Zhiyong, et al.
Pubblicazione: (2024)
di: Wang, Zhiyong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Incentivized Exploration of Non-Stationary Stochastic Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2024) -
Learning Universal Predictors
di: Grau-Moya, Jordi, et al.
Pubblicazione: (2024) -
Understanding Prompt Tuning and In-Context Learning via Meta-Learning
di: Genewein, Tim, et al.
Pubblicazione: (2025) -
Non-Stationary Learning of Neural Networks with Automatic Soft Parameter Reset
di: Galashov, Alexandre, et al.
Pubblicazione: (2024) -
Non-Stationary Latent Auto-Regressive Bandits
di: Trella, Anna L., et al.
Pubblicazione: (2024)