Stochastic Online Instrumental Variable Regression: Regrets for Endogeneity and Bandit Feedback
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Della Vecchia, Riccardo, Basu, Debabrota |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cooperative Online Learning with Feedback Graphs
par: Cesa-Bianchi, Nicolò, et autres
Publié: (2021)
par: Cesa-Bianchi, Nicolò, et autres
Publié: (2021)
Concentrated Differential Privacy for Bandits
par: Azize, Achraf, et autres
Publié: (2023)
par: Azize, Achraf, et autres
Publié: (2023)
Learning to Explore with Lagrangians for Bandits under Unknown Linear Constraints
par: Das, Udvas, et autres
Publié: (2024)
par: Das, Udvas, et autres
Publié: (2024)
Isoperimetry is All We Need: Langevin Posterior Sampling for RL with Sublinear Regret
par: Jorge, Emilio, et autres
Publié: (2024)
par: Jorge, Emilio, et autres
Publié: (2024)
Optimal Regret of Bernoulli Bandits under Global Differential Privacy
par: Azize, Achraf, et autres
Publié: (2025)
par: Azize, Achraf, et autres
Publié: (2025)
FLIPHAT: Joint Differential Privacy for High Dimensional Sparse Linear Bandits
par: Chakraborty, Sunrit, et autres
Publié: (2024)
par: Chakraborty, Sunrit, et autres
Publié: (2024)
Bandits with Stochastic Experts: Constant Regret, Empirical Experts and Episodes
par: Sharma, Nihal, et autres
Publié: (2021)
par: Sharma, Nihal, et autres
Publié: (2021)
Pure Exploration in Bandits with Linear Constraints
par: Carlsson, Emil, et autres
Publié: (2023)
par: Carlsson, Emil, et autres
Publié: (2023)
Preference-based Pure Exploration
par: Shukla, Apurv, et autres
Publié: (2024)
par: Shukla, Apurv, et autres
Publié: (2024)
Stochastic Online Conformal Prediction with Semi-Bandit Feedback
par: Ge, Haosen, et autres
Publié: (2024)
par: Ge, Haosen, et autres
Publié: (2024)
Near-optimal Regret Using Policy Optimization in Online MDPs with Aggregate Bandit Feedback
par: Lancewicki, Tal, et autres
Publié: (2025)
par: Lancewicki, Tal, et autres
Publié: (2025)
Optimal High-Probability Regret for Online Convex Optimization with Two-Point Bandit Feedback
par: Ye, Haishan
Publié: (2026)
par: Ye, Haishan
Publié: (2026)
Error Propagation in Dynamic Programming: From Stochastic Control to Option Pricing
par: Della Vecchia, Andrea, et autres
Publié: (2025)
par: Della Vecchia, Andrea, et autres
Publié: (2025)
Nonparametric Instrumental Variable Regression through Stochastic Approximate Gradients
par: Fonseca, Yuri, et autres
Publié: (2024)
par: Fonseca, Yuri, et autres
Publié: (2024)
Improved Regret for Bandit Convex Optimization with Delayed Feedback
par: Wan, Yuanyu, et autres
Publié: (2024)
par: Wan, Yuanyu, et autres
Publié: (2024)
Information Capacity Regret Bounds for Bandits with Mediator Feedback
par: Eldowa, Khaled, et autres
Publié: (2024)
par: Eldowa, Khaled, et autres
Publié: (2024)
Some Targets Are Harder to Identify than Others: Quantifying the Target-dependent Membership Leakage
par: Azize, Achraf, et autres
Publié: (2024)
par: Azize, Achraf, et autres
Publié: (2024)
Auditing Fairness under Model Updates: Fundamental Complexity and Property-Preserving Updates
par: Ajarra, Ayoub, et autres
Publié: (2026)
par: Ajarra, Ayoub, et autres
Publié: (2026)
Batch Ensemble for Variance Dependent Regret in Stochastic Bandits
par: Cassel, Asaf, et autres
Publié: (2024)
par: Cassel, Asaf, et autres
Publié: (2024)
Individual Regret in Cooperative Stochastic Multi-Armed Bandits
par: Barnea, Idan, et autres
Publié: (2024)
par: Barnea, Idan, et autres
Publié: (2024)
p-Mean Regret for Stochastic Bandits
par: Krishna, Anand, et autres
Publié: (2024)
par: Krishna, Anand, et autres
Publié: (2024)
Improved Best-of-Both-Worlds Regret for Bandits with Delayed Feedback
par: Schlisselberg, Ofir, et autres
Publié: (2025)
par: Schlisselberg, Ofir, et autres
Publié: (2025)
Near-Optimal Regret in Linear MDPs with Aggregate Bandit Feedback
par: Cassel, Asaf, et autres
Publié: (2024)
par: Cassel, Asaf, et autres
Publié: (2024)
Distributed Online Bandit Nonconvex Optimization with One-Point Residual Feedback via Dynamic Regret
par: Hua, Youqing, et autres
Publié: (2024)
par: Hua, Youqing, et autres
Publié: (2024)
Doubly Optimal No-Regret Online Learning in Strongly Monotone Games with Bandit Feedback
par: Ba, Wenjia, et autres
Publié: (2021)
par: Ba, Wenjia, et autres
Publié: (2021)
Sublinear Algorithms for Wasserstein and Total Variation Distances: Applications to Fairness and Privacy Auditing
par: Basu, Debabrota, et autres
Publié: (2025)
par: Basu, Debabrota, et autres
Publié: (2025)
Stochastic Optimization Algorithms for Instrumental Variable Regression with Streaming Data
par: Chen, Xuxing, et autres
Publié: (2024)
par: Chen, Xuxing, et autres
Publié: (2024)
Lipschitz Bandits with Stochastic Delayed Feedback
par: Liu, Zhongxuan, et autres
Publié: (2025)
par: Liu, Zhongxuan, et autres
Publié: (2025)
Computational Efficiency under Covariate Shift in Kernel Ridge Regression
par: Della Vecchia, Andrea, et autres
Publié: (2025)
par: Della Vecchia, Andrea, et autres
Publié: (2025)
Logarithmic Regret for Unconstrained Submodular Maximization Stochastic Bandit
par: Zhou, Julien, et autres
Publié: (2024)
par: Zhou, Julien, et autres
Publié: (2024)
Dimension Agnostic Testing of Survey Data Credibility through the Lens of Regression
par: Basu, Debabrota, et autres
Publié: (2025)
par: Basu, Debabrota, et autres
Publié: (2025)
Geometry-Aware Instrumental Variable Regression
par: Kremer, Heiner, et autres
Publié: (2024)
par: Kremer, Heiner, et autres
Publié: (2024)
Regret Bounds for Adversarial Contextual Bandits with General Function Approximation and Delayed Feedback
par: Levy, Orin, et autres
Publié: (2025)
par: Levy, Orin, et autres
Publié: (2025)
Online Learning on Hidden-Convex Losses via Algorithmic Equivalence: Optimal Regret, Geometric Barrier, and Bandit Feedback
par: Barakat, Anas, et autres
Publié: (2026)
par: Barakat, Anas, et autres
Publié: (2026)
Variance-Aware Regret Bounds for Stochastic Contextual Dueling Bandits
par: Di, Qiwei, et autres
Publié: (2023)
par: Di, Qiwei, et autres
Publié: (2023)
DOT: Dynamic Knob Selection and Online Sampling for Automated Database Tuning
par: Wang, Yifan, et autres
Publié: (2026)
par: Wang, Yifan, et autres
Publié: (2026)
Biased Dueling Bandits with Stochastic Delayed Feedback
par: Yi, Bongsoo, et autres
Publié: (2024)
par: Yi, Bongsoo, et autres
Publié: (2024)
On the Minimax Regret in Online Ranking with Top-k Feedback
par: Zhang, Mingyuan, et autres
Publié: (2023)
par: Zhang, Mingyuan, et autres
Publié: (2023)
Stochastic $k$-Submodular Bandits with Full Bandit Feedback
par: Nie, Guanyu, et autres
Publié: (2024)
par: Nie, Guanyu, et autres
Publié: (2024)
Thompson Sampling for Stochastic Bandits with Noisy Contexts: An Information-Theoretic Regret Analysis
par: Jose, Sharu Theresa, et autres
Publié: (2024)
par: Jose, Sharu Theresa, et autres
Publié: (2024)
Documents similaires
-
Cooperative Online Learning with Feedback Graphs
par: Cesa-Bianchi, Nicolò, et autres
Publié: (2021) -
Concentrated Differential Privacy for Bandits
par: Azize, Achraf, et autres
Publié: (2023) -
Learning to Explore with Lagrangians for Bandits under Unknown Linear Constraints
par: Das, Udvas, et autres
Publié: (2024) -
Isoperimetry is All We Need: Langevin Posterior Sampling for RL with Sublinear Regret
par: Jorge, Emilio, et autres
Publié: (2024) -
Optimal Regret of Bernoulli Bandits under Global Differential Privacy
par: Azize, Achraf, et autres
Publié: (2025)