Constrained Online Decision-Making: A Unified Framework
Fuente:
arXiv
Saved in:
| Main Authors: | Hu, Haichen, Simchi-Levi, David, Azizan, Navid |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Pre-Trained AI Model Assisted Online Decision-Making under Missing Covariates: A Theoretical Perspective
by: Hu, Haichen, et al.
Published: (2025)
by: Hu, Haichen, et al.
Published: (2025)
Contextual Online Decision Making with Infinite-Dimensional Functional Regression
by: Hu, Haichen, et al.
Published: (2025)
by: Hu, Haichen, et al.
Published: (2025)
Perturbing the Derivative: Doubly Wild Refitting for Model-Free Evaluation of Opaque Machine Learning Predictors
by: Hu, Haichen, et al.
Published: (2025)
by: Hu, Haichen, et al.
Published: (2025)
Perturbing the Derivative: Wild Refitting for Model-Free Evaluation of Machine Learning Models under Bregman Losses
by: Hu, Haichen, et al.
Published: (2025)
by: Hu, Haichen, et al.
Published: (2025)
Interleaved Resampling and Refitting: Data and Compute-Efficient Evaluation of Black-Box Predictors
by: Hu, Haichen, et al.
Published: (2026)
by: Hu, Haichen, et al.
Published: (2026)
Model-Based Reinforcement Learning with Double Oracle Efficiency in Policy Optimization and Offline Estimation
by: Hu, Haichen, et al.
Published: (2026)
by: Hu, Haichen, et al.
Published: (2026)
Offline Oracle-Efficient Learning for Contextual MDPs via Layerwise Exploration-Exploitation Tradeoff
by: Qian, Jian, et al.
Published: (2024)
by: Qian, Jian, et al.
Published: (2024)
Reverse Flow Matching: A Unified Framework for Online Reinforcement Learning with Diffusion and Flow Policies
by: Li, Zeyang, et al.
Published: (2026)
by: Li, Zeyang, et al.
Published: (2026)
HardNet: Hard-Constrained Neural Networks with Universal Approximation Guarantees
by: Min, Youngjae, et al.
Published: (2024)
by: Min, Youngjae, et al.
Published: (2024)
LMI-Net: Linear Matrix Inequality--Constrained Neural Networks via Differentiable Projection Layers
by: Tang, Sunbochen, et al.
Published: (2026)
by: Tang, Sunbochen, et al.
Published: (2026)
ECO: Energy-Constrained Operator Learning for Chaotic Dynamics with Boundedness Guarantees
by: Goertzen, Andrea, et al.
Published: (2025)
by: Goertzen, Andrea, et al.
Published: (2025)
The Value of Information in Resource-Constrained Pricing
by: Ao, Ruicheng, et al.
Published: (2026)
by: Ao, Ruicheng, et al.
Published: (2026)
HardFlow: Hard-Constrained Sampling for Flow-Matching Models via Trajectory Optimization
by: Li, Zeyang, et al.
Published: (2025)
by: Li, Zeyang, et al.
Published: (2025)
A Unified Approach to Controlling Implicit Regularization via Mirror Descent
by: Sun, Haoyuan, et al.
Published: (2023)
by: Sun, Haoyuan, et al.
Published: (2023)
Online Learning for Equilibrium Pricing in Markets under Incomplete Information
by: Jalota, Devansh, et al.
Published: (2023)
by: Jalota, Devansh, et al.
Published: (2023)
Safe Multi-Agent Reinforcement Learning with Convergence to Generalized Nash Equilibrium
by: Li, Zeyang, et al.
Published: (2024)
by: Li, Zeyang, et al.
Published: (2024)
Personalized Collaborative Learning with Affinity-Based Variance Reduction
by: Zhang, Chenyu, et al.
Published: (2025)
by: Zhang, Chenyu, et al.
Published: (2025)
Online Resource Allocation with Average Budget Constraints
by: Ao, Ruicheng, et al.
Published: (2024)
by: Ao, Ruicheng, et al.
Published: (2024)
Beyond ATE: Multi-Criteria Design for A/B Testing
by: Li, Jiachun, et al.
Published: (2025)
by: Li, Jiachun, et al.
Published: (2025)
From Confounding to Learning: Dynamic Service Fee Pricing on Third-Party Platforms
by: Ai, Rui, et al.
Published: (2025)
by: Ai, Rui, et al.
Published: (2025)
Optimal Adaptive Experimental Design for Estimating Treatment Effect
by: Li, Jiachun, et al.
Published: (2024)
by: Li, Jiachun, et al.
Published: (2024)
On the Role of Transformer Feed-Forward Layers in Nonlinear In-Context Learning
by: Sun, Haoyuan, et al.
Published: (2025)
by: Sun, Haoyuan, et al.
Published: (2025)
ORFit: One-Pass Learning via Bridging Orthogonal Gradient Descent and Recursive Least-Squares
by: Min, Youngjae, et al.
Published: (2022)
by: Min, Youngjae, et al.
Published: (2022)
A Simple and Optimal Policy Design with Safety against Heavy-Tailed Risk for Stochastic Bandits
by: Simchi-Levi, David, et al.
Published: (2022)
by: Simchi-Levi, David, et al.
Published: (2022)
Prediction-Guided Active Experiments
by: Ao, Ruicheng, et al.
Published: (2024)
by: Ao, Ruicheng, et al.
Published: (2024)
Improving the Estimation of Lifetime Effects in A/B Testing via Treatment Locality
by: Chen, Shuze, et al.
Published: (2024)
by: Chen, Shuze, et al.
Published: (2024)
Learning to Price with Resource Constraints: From Full Information to Machine-Learned Prices
by: Ao, Ruicheng, et al.
Published: (2025)
by: Ao, Ruicheng, et al.
Published: (2025)
Partial Identification under Missing Data Using Weak Shadow Variables from Pretrained Models
by: Chen, Hongyu, et al.
Published: (2026)
by: Chen, Hongyu, et al.
Published: (2026)
Sobolev Norm Learning Rates for Conditional Mean Embeddings
by: Talwai, Prem, et al.
Published: (2021)
by: Talwai, Prem, et al.
Published: (2021)
On the Optimal Regret of Locally Private Linear Contextual Bandit
by: Li, Jiachun, et al.
Published: (2024)
by: Li, Jiachun, et al.
Published: (2024)
PPI-SVRG: Unifying Prediction-Powered Inference and Variance Reduction for Semi-Supervised Optimization
by: Ao, Ruicheng, et al.
Published: (2026)
by: Ao, Ruicheng, et al.
Published: (2026)
HardNet++: Nonlinear Constraint Enforcement in Neural Networks
by: Goertzen, Andrea, et al.
Published: (2026)
by: Goertzen, Andrea, et al.
Published: (2026)
Optimizing LLM Inference: Fluid-Guided Online Scheduling with Memory Constraints
by: Ao, Ruicheng, et al.
Published: (2025)
by: Ao, Ruicheng, et al.
Published: (2025)
Regret Distribution in Stochastic Bandits: Optimal Trade-off between Expectation and Tail Risk
by: Simchi-Levi, David, et al.
Published: (2023)
by: Simchi-Levi, David, et al.
Published: (2023)
Privacy Preserving Adaptive Experiment Design
by: Li, Jiachun, et al.
Published: (2024)
by: Li, Jiachun, et al.
Published: (2024)
On the Reliability Limits of LLM-Based Multi-Agent Planning
by: Ao, Ruicheng, et al.
Published: (2026)
by: Ao, Ruicheng, et al.
Published: (2026)
ORLoopBench: Solver-in-the-Loop Benchmarks for Self-Correction and Behavioral Rationality in Operations Research
by: Ao, Ruicheng, et al.
Published: (2026)
by: Ao, Ruicheng, et al.
Published: (2026)
OptiRepair: Closed-Loop Diagnosis and Repair of Supply Chain Optimization Models with LLM Agents
by: Ao, Ruicheng, et al.
Published: (2026)
by: Ao, Ruicheng, et al.
Published: (2026)
SketchOGD: Memory-Efficient Continual Learning
by: Min, Youngjae, et al.
Published: (2023)
by: Min, Youngjae, et al.
Published: (2023)
Blind Network Revenue Management and Bandits with Knapsacks under Limited Switches
by: Simchi-Levi, David, et al.
Published: (2019)
by: Simchi-Levi, David, et al.
Published: (2019)
Similar Items
-
Pre-Trained AI Model Assisted Online Decision-Making under Missing Covariates: A Theoretical Perspective
by: Hu, Haichen, et al.
Published: (2025) -
Contextual Online Decision Making with Infinite-Dimensional Functional Regression
by: Hu, Haichen, et al.
Published: (2025) -
Perturbing the Derivative: Doubly Wild Refitting for Model-Free Evaluation of Opaque Machine Learning Predictors
by: Hu, Haichen, et al.
Published: (2025) -
Perturbing the Derivative: Wild Refitting for Model-Free Evaluation of Machine Learning Models under Bregman Losses
by: Hu, Haichen, et al.
Published: (2025) -
Interleaved Resampling and Refitting: Data and Compute-Efficient Evaluation of Black-Box Predictors
by: Hu, Haichen, et al.
Published: (2026)