Online Estimation via Offline Estimation: An Information-Theoretic Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Foster, Dylan J., Han, Yanjun, Qian, Jian, Rakhlin, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Assouad, Fano, and Le Cam with Interaction: A Unifying Lower Bound Framework and Characterization for Bandit Learnability
par: Chen, Fan, et autres
Publié: (2024)
par: Chen, Fan, et autres
Publié: (2024)
Refined Risk Bounds for Unbounded Losses via Transductive Priors
par: Qian, Jian, et autres
Publié: (2024)
par: Qian, Jian, et autres
Publié: (2024)
Self-Normalized Martingales and Uniform Regret Bounds for Linear Regression
par: Chen, Fan, et autres
Publié: (2026)
par: Chen, Fan, et autres
Publié: (2026)
Outcome-Based Online Reinforcement Learning: Algorithms and Fundamental Limits
par: Chen, Fan, et autres
Publié: (2025)
par: Chen, Fan, et autres
Publié: (2025)
On the Variance, Admissibility, and Stability of Empirical Risk Minimization
par: Kur, Gil, et autres
Publié: (2023)
par: Kur, Gil, et autres
Publié: (2023)
A Gapped Scale-Sensitive Dimension and Lower Bounds for Offset Rademacher Complexity
par: Jia, Zeyu, et autres
Publié: (2025)
par: Jia, Zeyu, et autres
Publié: (2025)
Decision Making in Changing Environments: Robustness, Query-Based Learning, and Differential Privacy
par: Chen, Fan, et autres
Publié: (2025)
par: Chen, Fan, et autres
Publié: (2025)
Offline Estimation of Controlled Markov Chains: Minimaxity and Sample Complexity
par: Banerjee, Imon, et autres
Publié: (2022)
par: Banerjee, Imon, et autres
Publié: (2022)
High-accuracy sampling for diffusion models and log-concave distributions
par: Chen, Fan, et autres
Publié: (2026)
par: Chen, Fan, et autres
Publié: (2026)
Theoretical Insights into CycleGAN: Analyzing Approximation and Estimation Errors in Unpaired Data Generation
par: Sun, Luwei, et autres
Publié: (2024)
par: Sun, Luwei, et autres
Publié: (2024)
Theoretical Guarantees for the Subspace-Constrained Tyler's Estimator
par: Lerman, Gilad, et autres
Publié: (2024)
par: Lerman, Gilad, et autres
Publié: (2024)
Interactive Learning of Single-Index Models via Stochastic Gradient Descent
par: Rajaraman, Nived, et autres
Publié: (2026)
par: Rajaraman, Nived, et autres
Publié: (2026)
High-Probability Minimax Adaptive Estimation in Besov Spaces via Online-to-Batch
par: Liautaud, Paul, et autres
Publié: (2026)
par: Liautaud, Paul, et autres
Publié: (2026)
Online and Offline Robust Multivariate Linear Regression
par: Godichon-Baggioni, Antoine, et autres
Publié: (2024)
par: Godichon-Baggioni, Antoine, et autres
Publié: (2024)
Convergence of Statistical Estimators via Mutual Information Bounds
par: Khribch, El Mahdi, et autres
Publié: (2024)
par: Khribch, El Mahdi, et autres
Publié: (2024)
Online Estimation with Rolling Validation: Adaptive Nonparametric Estimation with Streaming Data
par: Zhang, Tianyu, et autres
Publié: (2023)
par: Zhang, Tianyu, et autres
Publié: (2023)
Online Covariance Estimation in Averaged SGD: Improved Batch-Mean Rates and Minimax Optimality via Trajectory Regression
par: Ni, Yijin, et autres
Publié: (2026)
par: Ni, Yijin, et autres
Publié: (2026)
Optimal Confidence Band for Kernel Gradient Flow Estimator
par: Cheng, Yuqian, et autres
Publié: (2026)
par: Cheng, Yuqian, et autres
Publié: (2026)
A Unified Information-Theoretic Framework for Meta-Learning Generalization
par: Wen, Wen, et autres
Publié: (2025)
par: Wen, Wen, et autres
Publié: (2025)
Is Behavior Cloning All You Need? Understanding Horizon in Imitation Learning
par: Foster, Dylan J., et autres
Publié: (2024)
par: Foster, Dylan J., et autres
Publié: (2024)
The Power of Resets in Online Reinforcement Learning
par: Mhammedi, Zakaria, et autres
Publié: (2024)
par: Mhammedi, Zakaria, et autres
Publié: (2024)
Online Performance Estimation with Unlabeled Data: A Bayesian Application of the Hui-Walter Paradigm
par: Slote, Kevin, et autres
Publié: (2024)
par: Slote, Kevin, et autres
Publié: (2024)
Ratio Covers of Convex Sets and Optimal Mixture Density Estimation
par: Compton, Spencer, et autres
Publié: (2026)
par: Compton, Spencer, et autres
Publié: (2026)
Doubly Robust Interval Estimation for Optimal Policy Evaluation in Online Learning
par: Shen, Ye, et autres
Publié: (2021)
par: Shen, Ye, et autres
Publié: (2021)
A Unified View on Learning Unnormalized Distributions via Noise-Contrastive Estimation
par: Ryu, J. Jon, et autres
Publié: (2024)
par: Ryu, J. Jon, et autres
Publié: (2024)
Near-Optimal Learning and Planning in Separated Latent MDPs
par: Chen, Fan, et autres
Publié: (2024)
par: Chen, Fan, et autres
Publié: (2024)
High-accuracy log-concave sampling with stochastic queries
par: Chen, Fan, et autres
Publié: (2026)
par: Chen, Fan, et autres
Publié: (2026)
Diffusion-based Denoising Beats Vanilla Score Matching in Parameter Estimation: A Theoretical Explanation
par: Schwienhorst, Benedikt Lütke, et autres
Publié: (2026)
par: Schwienhorst, Benedikt Lütke, et autres
Publié: (2026)
$L^1$ Estimation: On the Optimality of Linear Estimators
par: Barnes, Leighton P., et autres
Publié: (2023)
par: Barnes, Leighton P., et autres
Publié: (2023)
A Unified Framework for Pattern Recovery in Penalized and Thresholded Estimation and its Geometry
par: Graczyk, Piotr, et autres
Publié: (2023)
par: Graczyk, Piotr, et autres
Publié: (2023)
Nonparametric Estimation of Joint Entropy via Partitioned Sample-Spacing
par: Ho, Jungwoo, et autres
Publié: (2025)
par: Ho, Jungwoo, et autres
Publié: (2025)
Beyond Covariance Matrix: The Statistical Complexity of Private Linear Regression
par: Chen, Fan, et autres
Publié: (2025)
par: Chen, Fan, et autres
Publié: (2025)
Is a Good Foundation Necessary for Efficient Reinforcement Learning? The Computational Role of the Base Model in Exploration
par: Foster, Dylan J., et autres
Publié: (2025)
par: Foster, Dylan J., et autres
Publié: (2025)
Conformal Robust Set Estimation
par: Cholaquidis, Alejandro, et autres
Publié: (2026)
par: Cholaquidis, Alejandro, et autres
Publié: (2026)
Residual-as-Teacher: Mitigating Bias Propagation in Student--Teacher Estimation
par: Yamamoto, Kakei, et autres
Publié: (2026)
par: Yamamoto, Kakei, et autres
Publié: (2026)
Statistical Complexity and Optimal Algorithms for Non-linear Ridge Bandits
par: Rajaraman, Nived, et autres
Publié: (2023)
par: Rajaraman, Nived, et autres
Publié: (2023)
Online Experimental Design With Estimation-Regret Trade-off Under Network Interference
par: Zhang, Zhiheng, et autres
Publié: (2024)
par: Zhang, Zhiheng, et autres
Publié: (2024)
Estimating the normal-inverse-Wishart distribution
par: So, Jonathan
Publié: (2024)
par: So, Jonathan
Publié: (2024)
Centrality Estimators for Probability Density Functions
par: Ziou, Djemel
Publié: (2024)
par: Ziou, Djemel
Publié: (2024)
Distribution Estimation under the Infinity Norm
par: Kontorovich, Aryeh, et autres
Publié: (2024)
par: Kontorovich, Aryeh, et autres
Publié: (2024)
Documents similaires
-
Assouad, Fano, and Le Cam with Interaction: A Unifying Lower Bound Framework and Characterization for Bandit Learnability
par: Chen, Fan, et autres
Publié: (2024) -
Refined Risk Bounds for Unbounded Losses via Transductive Priors
par: Qian, Jian, et autres
Publié: (2024) -
Self-Normalized Martingales and Uniform Regret Bounds for Linear Regression
par: Chen, Fan, et autres
Publié: (2026) -
Outcome-Based Online Reinforcement Learning: Algorithms and Fundamental Limits
par: Chen, Fan, et autres
Publié: (2025) -
On the Variance, Admissibility, and Stability of Empirical Risk Minimization
par: Kur, Gil, et autres
Publié: (2023)