Contextual Bandit Optimization with Pre-Trained Neural Networks
Fuente:
arXiv
Salvato in:
| Autore principale: | Terekhov, Mikhail |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Neural Exploitation and Exploration of Contextual Bandits
di: Ban, Yikun, et al.
Pubblicazione: (2023)
di: Ban, Yikun, et al.
Pubblicazione: (2023)
Uncertainty of Joint Neural Contextual Bandit
di: Guo, Hongbo, et al.
Pubblicazione: (2024)
di: Guo, Hongbo, et al.
Pubblicazione: (2024)
In Search for Architectures and Loss Functions in Multi-Objective Reinforcement Learning
di: Terekhov, Mikhail, et al.
Pubblicazione: (2024)
di: Terekhov, Mikhail, et al.
Pubblicazione: (2024)
Neural Risk-sensitive Satisficing in Contextual Bandits
di: Ito, Shogo, et al.
Pubblicazione: (2025)
di: Ito, Shogo, et al.
Pubblicazione: (2025)
Optimal Regret for Policy Optimization in Contextual Bandits
di: Levy, Orin, et al.
Pubblicazione: (2026)
di: Levy, Orin, et al.
Pubblicazione: (2026)
Neural Contextual Bandits Under Delayed Feedback Constraints
di: Moghimi, Mohammadali, et al.
Pubblicazione: (2025)
di: Moghimi, Mohammadali, et al.
Pubblicazione: (2025)
Decentralized Contextual Bandits with Network Adaptivity
di: Deng, Chuyun, et al.
Pubblicazione: (2025)
di: Deng, Chuyun, et al.
Pubblicazione: (2025)
Exploiting Concavity Information in Gaussian Process Contextual Bandit Optimization
di: Li, Kevin, et al.
Pubblicazione: (2025)
di: Li, Kevin, et al.
Pubblicazione: (2025)
Online Continuous Hyperparameter Optimization for Generalized Linear Contextual Bandits
di: Kang, Yue, et al.
Pubblicazione: (2023)
di: Kang, Yue, et al.
Pubblicazione: (2023)
Risk-Aware Continuous Control with Neural Contextual Bandits
di: Ayala-Romero, Jose A., et al.
Pubblicazione: (2023)
di: Ayala-Romero, Jose A., et al.
Pubblicazione: (2023)
Quantum-Enhanced Neural Contextual Bandit Algorithms
di: Huang, Yuqi, et al.
Pubblicazione: (2026)
di: Huang, Yuqi, et al.
Pubblicazione: (2026)
Sparse Nonparametric Contextual Bandits
di: Flynn, Hamish, et al.
Pubblicazione: (2025)
di: Flynn, Hamish, et al.
Pubblicazione: (2025)
Active Human Feedback Collection via Neural Contextual Dueling Bandits
di: Verma, Arun, et al.
Pubblicazione: (2025)
di: Verma, Arun, et al.
Pubblicazione: (2025)
Variance-Aware Linear UCB with Deep Representation for Neural Contextual Bandits
di: Bui, Ha Manh, et al.
Pubblicazione: (2024)
di: Bui, Ha Manh, et al.
Pubblicazione: (2024)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)
Linear Contextual Bandits with Interference
di: Xu, Yang, et al.
Pubblicazione: (2024)
di: Xu, Yang, et al.
Pubblicazione: (2024)
Learning pure quantum states (almost) without regret
di: Lumbreras, Josep, et al.
Pubblicazione: (2024)
di: Lumbreras, Josep, et al.
Pubblicazione: (2024)
Contextual Linear Bandits with Delay as Payoff
di: Zhang, Mengxiao, et al.
Pubblicazione: (2025)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2025)
Group-Sensitive Offline Contextual Bandits
di: Guo, Yihong, et al.
Pubblicazione: (2025)
di: Guo, Yihong, et al.
Pubblicazione: (2025)
Multiplayer Information Asymmetric Contextual Bandits
di: Chang, William, et al.
Pubblicazione: (2025)
di: Chang, William, et al.
Pubblicazione: (2025)
Differentially Private Kernelized Contextual Bandits
di: Pavlovic, Nikola, et al.
Pubblicazione: (2025)
di: Pavlovic, Nikola, et al.
Pubblicazione: (2025)
Contextual Bandits for Unbounded Context Distributions
di: Zhao, Puning, et al.
Pubblicazione: (2024)
di: Zhao, Puning, et al.
Pubblicazione: (2024)
Contextual Bandits with Stage-wise Constraints
di: Pacchiano, Aldo, et al.
Pubblicazione: (2024)
di: Pacchiano, Aldo, et al.
Pubblicazione: (2024)
Constrained Contextual Bandits with Adversarial Contexts
di: Sarkar, Dhruv, et al.
Pubblicazione: (2026)
di: Sarkar, Dhruv, et al.
Pubblicazione: (2026)
Designing an Interpretable Interface for Contextual Bandits
di: Maher, Andrew, et al.
Pubblicazione: (2024)
di: Maher, Andrew, et al.
Pubblicazione: (2024)
Learning Rate Optimization for Deep Neural Networks Using Lipschitz Bandits
di: Priyanka, Padma, et al.
Pubblicazione: (2024)
di: Priyanka, Padma, et al.
Pubblicazione: (2024)
Calibrated Recommendations with Contextual Bandits
di: Feijer, Diego, et al.
Pubblicazione: (2025)
di: Feijer, Diego, et al.
Pubblicazione: (2025)
Batched Nonparametric Contextual Bandits
di: Jiang, Rong, et al.
Pubblicazione: (2024)
di: Jiang, Rong, et al.
Pubblicazione: (2024)
Tree Ensembles for Contextual Bandits
di: Nilsson, Hannes, et al.
Pubblicazione: (2024)
di: Nilsson, Hannes, et al.
Pubblicazione: (2024)
Single Index Bandits: Generalized Linear Contextual Bandits with Unknown Reward Functions
di: Kang, Yue, et al.
Pubblicazione: (2025)
di: Kang, Yue, et al.
Pubblicazione: (2025)
PAC Off-Policy Prediction of Contextual Bandits
di: Wan, Yilong, et al.
Pubblicazione: (2025)
di: Wan, Yilong, et al.
Pubblicazione: (2025)
Exploration via Feature Perturbation in Contextual Bandits
di: Yi, Seouh-won, et al.
Pubblicazione: (2025)
di: Yi, Seouh-won, et al.
Pubblicazione: (2025)
Fast Best-in-Class Regret for Contextual Bandits
di: Girard, Samuel, et al.
Pubblicazione: (2025)
di: Girard, Samuel, et al.
Pubblicazione: (2025)
Offline Contextual Bandit with Counterfactual Sample Identification
di: Gilotte, Alexandre, et al.
Pubblicazione: (2025)
di: Gilotte, Alexandre, et al.
Pubblicazione: (2025)
Competing Bandits in Decentralized Contextual Matching Markets
di: Parikh, Satush, et al.
Pubblicazione: (2024)
di: Parikh, Satush, et al.
Pubblicazione: (2024)
Efficient Contextual Bandits with Uninformed Feedback Graphs
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
Thompson Sampling in Partially Observable Contextual Bandits
di: Park, Hongju, et al.
Pubblicazione: (2024)
di: Park, Hongju, et al.
Pubblicazione: (2024)
Offline Contextual Bandits in the Presence of New Actions
di: Kishimoto, Ren, et al.
Pubblicazione: (2026)
di: Kishimoto, Ren, et al.
Pubblicazione: (2026)
Active Learning for Stochastic Contextual Linear Bandits
di: Brunskill, Emma, et al.
Pubblicazione: (2026)
di: Brunskill, Emma, et al.
Pubblicazione: (2026)
Fairness and Privacy Guarantees in Federated Contextual Bandits
di: Solanki, Sambhav, et al.
Pubblicazione: (2024)
di: Solanki, Sambhav, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Neural Exploitation and Exploration of Contextual Bandits
di: Ban, Yikun, et al.
Pubblicazione: (2023) -
Uncertainty of Joint Neural Contextual Bandit
di: Guo, Hongbo, et al.
Pubblicazione: (2024) -
In Search for Architectures and Loss Functions in Multi-Objective Reinforcement Learning
di: Terekhov, Mikhail, et al.
Pubblicazione: (2024) -
Neural Risk-sensitive Satisficing in Contextual Bandits
di: Ito, Shogo, et al.
Pubblicazione: (2025) -
Optimal Regret for Policy Optimization in Contextual Bandits
di: Levy, Orin, et al.
Pubblicazione: (2026)