Optimal Thresholding Linear Bandit
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rivera, Eduardo Ochoa, Tewari, Ambuj |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Near Optimal Pure Exploration in Logistic Bandits
par: Rivera, Eduardo Ochoa, et autres
Publié: (2024)
par: Rivera, Eduardo Ochoa, et autres
Publié: (2024)
Online Conformal Prediction: Enforcing monotonicity via Online Optimization
par: Rivera, Eduardo Ochoa, et autres
Publié: (2026)
par: Rivera, Eduardo Ochoa, et autres
Publié: (2026)
Leveraging Offline Data in Linear Latent Contextual Bandits
par: Kausik, Chinmaya, et autres
Publié: (2024)
par: Kausik, Chinmaya, et autres
Publié: (2024)
Conformal Prediction for Ensembles: Improving Efficiency via Score-Based Aggregation
par: Rivera, Eduardo Ochoa, et autres
Publié: (2024)
par: Rivera, Eduardo Ochoa, et autres
Publié: (2024)
An Asymptotically Optimal Algorithm for the Convex Hull Membership Problem
par: Qiao, Gang, et autres
Publié: (2023)
par: Qiao, Gang, et autres
Publié: (2023)
A Primal-Dual Algorithm for Offline Constrained Reinforcement Learning with Linear MDPs
par: Hong, Kihyuk, et autres
Publié: (2024)
par: Hong, Kihyuk, et autres
Publié: (2024)
If generative AI is the answer, what is the question?
par: Tewari, Ambuj
Publié: (2025)
par: Tewari, Ambuj
Publié: (2025)
Controlling Statistical, Discretization, and Truncation Errors in Learning Fourier Linear Operators
par: Subedi, Unique, et autres
Publié: (2024)
par: Subedi, Unique, et autres
Publié: (2024)
Latency-Aware Contextual Bandit: Application to Cryo-EM Data Collection
par: Wei, Lai, et autres
Publié: (2024)
par: Wei, Lai, et autres
Publié: (2024)
A Computationally Efficient Algorithm for Infinite-Horizon Average-Reward Linear MDPs
par: Hong, Kihyuk, et autres
Publié: (2025)
par: Hong, Kihyuk, et autres
Publié: (2025)
Online Infinite-Dimensional Regression: Learning Linear Operators
par: Raman, Vinod, et autres
Publié: (2023)
par: Raman, Vinod, et autres
Publié: (2023)
Multiclass Online Learnability under Bandit Feedback
par: Raman, Ananth, et autres
Publié: (2023)
par: Raman, Ananth, et autres
Publié: (2023)
Generator-Mediated Bandits: Thompson Sampling for GenAI-Powered Adaptive Interventions
par: Brooks, Marc, et autres
Publié: (2025)
par: Brooks, Marc, et autres
Publié: (2025)
On the Benefits of Active Data Collection in Operator Learning
par: Subedi, Unique, et autres
Publié: (2024)
par: Subedi, Unique, et autres
Publié: (2024)
On the Minimax Regret in Online Ranking with Top-k Feedback
par: Zhang, Mingyuan, et autres
Publié: (2023)
par: Zhang, Mingyuan, et autres
Publié: (2023)
Operator Learning: A Statistical Perspective
par: Subedi, Unique, et autres
Publié: (2025)
par: Subedi, Unique, et autres
Publié: (2025)
Distribution-Free Robust Predict-Then-Optimize in Function Spaces
par: Patel, Yash, et autres
Publié: (2026)
par: Patel, Yash, et autres
Publié: (2026)
Learning to Partially Defer for Sequences
par: Rayan, Sahana, et autres
Publié: (2025)
par: Rayan, Sahana, et autres
Publié: (2025)
Is Zero-Shot Super-Resolution Possible in Operator Learning?
par: Subedi, Unique, et autres
Publié: (2026)
par: Subedi, Unique, et autres
Publié: (2026)
Compute Aligned Training: Optimizing for Test Time Inference
par: Ousherovitch, Adam, et autres
Publié: (2026)
par: Ousherovitch, Adam, et autres
Publié: (2026)
On Next-Token Prediction in LLMs: How End Goals Determine the Consistency of Decoding Algorithms
par: Trauger, Jacob, et autres
Publié: (2025)
par: Trauger, Jacob, et autres
Publié: (2025)
Online Classification with Predictions
par: Raman, Vinod, et autres
Publié: (2024)
par: Raman, Vinod, et autres
Publié: (2024)
Quantum Learning Theory Beyond Batch Binary Classification
par: Mohan, Preetham, et autres
Publié: (2023)
par: Mohan, Preetham, et autres
Publié: (2023)
Generation through the lens of learning theory
par: Li, Jiaxun, et autres
Publié: (2024)
par: Li, Jiaxun, et autres
Publié: (2024)
The Complexity of Sequential Prediction in Dynamical Systems
par: Raman, Vinod, et autres
Publié: (2024)
par: Raman, Vinod, et autres
Publié: (2024)
Smoothed Online Classification can be Harder than Batch Classification
par: Raman, Vinod, et autres
Publié: (2024)
par: Raman, Vinod, et autres
Publié: (2024)
Online Learning with Set-Valued Feedback
par: Raman, Vinod, et autres
Publié: (2023)
par: Raman, Vinod, et autres
Publié: (2023)
A Combinatorial Characterization of Supervised Online Learnability
par: Raman, Vinod, et autres
Publié: (2023)
par: Raman, Vinod, et autres
Publié: (2023)
Offline Constrained Reinforcement Learning under Partial Data Coverage
par: Ko, Seokmin, et autres
Publié: (2025)
par: Ko, Seokmin, et autres
Publié: (2025)
A Characterization of Multioutput Learnability
par: Raman, Vinod, et autres
Publié: (2023)
par: Raman, Vinod, et autres
Publié: (2023)
Operator Learning for Schrödinger Equation: Unitarity, Error Bounds, and Time Generalization
par: Patel, Yash, et autres
Publié: (2025)
par: Patel, Yash, et autres
Publié: (2025)
Continuum Transformers Perform In-Context Learning by Operator Gradient Descent
par: Mishra, Abhiti, et autres
Publié: (2025)
par: Mishra, Abhiti, et autres
Publié: (2025)
On Generation in Metric Spaces
par: Li, Jiaxun, et autres
Publié: (2026)
par: Li, Jiaxun, et autres
Publié: (2026)
Characterizing the Multiclass Learnability of Forgiving 0-1 Loss Functions
par: Trauger, Jacob, et autres
Publié: (2025)
par: Trauger, Jacob, et autres
Publié: (2025)
Reinforcement Learning for Infinite-Horizon Average-Reward Linear MDPs via Approximation by Discounted-Reward MDPs
par: Hong, Kihyuk, et autres
Publié: (2024)
par: Hong, Kihyuk, et autres
Publié: (2024)
A Greedy PDE Router for Blending Neural Operators and Classical Methods
par: Rayan, Sahana, et autres
Publié: (2025)
par: Rayan, Sahana, et autres
Publié: (2025)
Learning Infinite-Horizon Average-Reward Linear Mixture MDPs of Bounded Span
par: Chae, Woojin, et autres
Publié: (2024)
par: Chae, Woojin, et autres
Publié: (2024)
On the Computational Complexity of Private High-dimensional Model Selection
par: Roy, Saptarshi, et autres
Publié: (2023)
par: Roy, Saptarshi, et autres
Publié: (2023)
Understanding Best Subset Selection: A Tale of Two C(omplex)ities
par: Roy, Saptarshi, et autres
Publié: (2023)
par: Roy, Saptarshi, et autres
Publié: (2023)
Joint Learning of Linear Time-Invariant Dynamical Systems
par: Modi, Aditya, et autres
Publié: (2021)
par: Modi, Aditya, et autres
Publié: (2021)
Documents similaires
-
Near Optimal Pure Exploration in Logistic Bandits
par: Rivera, Eduardo Ochoa, et autres
Publié: (2024) -
Online Conformal Prediction: Enforcing monotonicity via Online Optimization
par: Rivera, Eduardo Ochoa, et autres
Publié: (2026) -
Leveraging Offline Data in Linear Latent Contextual Bandits
par: Kausik, Chinmaya, et autres
Publié: (2024) -
Conformal Prediction for Ensembles: Improving Efficiency via Score-Based Aggregation
par: Rivera, Eduardo Ochoa, et autres
Publié: (2024) -
An Asymptotically Optimal Algorithm for the Convex Hull Membership Problem
par: Qiao, Gang, et autres
Publié: (2023)