Statistical Learning Theory in Lean 4: Empirical Processes from Scratch
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yuanhe, Lee, Jason D., Liu, Fanghui |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Lean Formalization of Generalization Error Bound by Rademacher Complexity and Dudley's Entropy Integral
par: Sonoda, Sho, et autres
Publié: (2025)
par: Sonoda, Sho, et autres
Publié: (2025)
Self-Regularized Learning Methods
par: Schölpple, Max, et autres
Publié: (2026)
par: Schölpple, Max, et autres
Publié: (2026)
Unveiling the Statistical Foundations of Chain-of-Thought Prompting Methods
par: Hu, Xinyang, et autres
Publié: (2024)
par: Hu, Xinyang, et autres
Publié: (2024)
Statistical Learning Theory for Distributional Classification
par: Fiedler, Christian
Publié: (2026)
par: Fiedler, Christian
Publié: (2026)
Retrieval-Augmented Generation as Noisy In-Context Learning: A Unified Theory and Risk Bounds
par: Guo, Yang, et autres
Publié: (2025)
par: Guo, Yang, et autres
Publié: (2025)
A Statistical Theory of Contrastive Learning via Approximate Sufficient Statistics
par: Lin, Licong, et autres
Publié: (2025)
par: Lin, Licong, et autres
Publié: (2025)
The $φ$ Curve: The Shape of Generalization through the Lens of Norm-based Capacity Control
par: Wang, Yichen, et autres
Publié: (2025)
par: Wang, Yichen, et autres
Publié: (2025)
Quantifying perturbation impacts for large language models
par: Rauba, Paulius, et autres
Publié: (2024)
par: Rauba, Paulius, et autres
Publié: (2024)
A Statistical Hypothesis Testing Framework for Data Misappropriation Detection in Large Language Models
par: Cai, Yinpeng, et autres
Publié: (2025)
par: Cai, Yinpeng, et autres
Publié: (2025)
A Statistical Case Against Empirical Human-AI Alignment
par: Rodemann, Julian, et autres
Publié: (2025)
par: Rodemann, Julian, et autres
Publié: (2025)
Benign overfitting in Fixed Dimension via Physics-Informed Learning with Smooth Inductive Bias
par: Wong, Honam, et autres
Publié: (2024)
par: Wong, Honam, et autres
Publié: (2024)
Statistically Optimal Generative Modeling with Maximum Deviation from the Empirical Distribution
par: Vardanyan, Elen, et autres
Publié: (2023)
par: Vardanyan, Elen, et autres
Publié: (2023)
Extrapolation in Statistical Learning with Extreme Value Theory
par: Engelke, Sebastian, et autres
Publié: (2026)
par: Engelke, Sebastian, et autres
Publié: (2026)
Towards Efficient Online Exploration for Reinforcement Learning with Human Feedback
par: Li, Gen, et autres
Publié: (2025)
par: Li, Gen, et autres
Publié: (2025)
High-Dimensional Statistics: Reflections on Progress and Open Problems
par: Maleki, Arian, et autres
Publié: (2026)
par: Maleki, Arian, et autres
Publié: (2026)
Towards a Statistical Understanding of Neural Networks: Beyond the Neural Tangent Kernel Theories
par: Zhang, Haobo, et autres
Publié: (2024)
par: Zhang, Haobo, et autres
Publié: (2024)
Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining
par: Lin, Licong, et autres
Publié: (2023)
par: Lin, Licong, et autres
Publié: (2023)
Hallucinations are inevitable but can be made statistically negligible
par: Suzuki, Atsushi, et autres
Publié: (2025)
par: Suzuki, Atsushi, et autres
Publié: (2025)
Review and Prospect of Algebraic Research in Equivalent Framework between Statistical Mechanics and Machine Learning Theory
par: Watanabe, Sumio
Publié: (2024)
par: Watanabe, Sumio
Publié: (2024)
Is a Good Foundation Necessary for Efficient Reinforcement Learning? The Computational Role of the Base Model in Exploration
par: Foster, Dylan J., et autres
Publié: (2025)
par: Foster, Dylan J., et autres
Publié: (2025)
Robust Detection of Watermarks for Large Language Models Under Human Edits
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Reasoning with Sampling: Cutting at Decision Points
par: Zhou, Felix, et autres
Publié: (2026)
par: Zhou, Felix, et autres
Publié: (2026)
A Survey on Statistical Theory of Deep Learning: Approximation, Training Dynamics, and Generative Models
par: Suh, Namjoon, et autres
Publié: (2024)
par: Suh, Namjoon, et autres
Publié: (2024)
Computational-Statistical Gaps for Improper Learning in Sparse Linear Regression
par: Buhai, Rares-Darius, et autres
Publié: (2024)
par: Buhai, Rares-Darius, et autres
Publié: (2024)
The Statistical Accuracy of Neural Posterior and Likelihood Estimation
par: Frazier, David T., et autres
Publié: (2024)
par: Frazier, David T., et autres
Publié: (2024)
Extended Fiducial Inference: Toward an Automated Process of Statistical Inference
par: Liang, Faming, et autres
Publié: (2024)
par: Liang, Faming, et autres
Publié: (2024)
Process-Driven Autoformalization in Lean 4
par: Lu, Jianqiao, et autres
Publié: (2024)
par: Lu, Jianqiao, et autres
Publié: (2024)
A Statistical Theory of Contrastive Pre-training and Multimodal Generative AI
par: Oko, Kazusato, et autres
Publié: (2025)
par: Oko, Kazusato, et autres
Publié: (2025)
Block Empirical Likelihood Inference for Longitudinal Generalized Partially Linear Single-Index Models
par: Zhang, Tianni, et autres
Publié: (2026)
par: Zhang, Tianni, et autres
Publié: (2026)
Statistical Agnostic Regression: a machine learning method to validate regression models
par: Gorriz, Juan M, et autres
Publié: (2024)
par: Gorriz, Juan M, et autres
Publié: (2024)
Reject, Resample, Repeat: Understanding Parallel Reasoning in Language Model Inference
par: Golowich, Noah, et autres
Publié: (2026)
par: Golowich, Noah, et autres
Publié: (2026)
Counterfactual reasoning: an analysis of in-context emergence
par: Miller, Moritz, et autres
Publié: (2025)
par: Miller, Moritz, et autres
Publié: (2025)
Don't Pass@k: A Bayesian Framework for Large Language Model Evaluation
par: Hariri, Mohsen, et autres
Publié: (2025)
par: Hariri, Mohsen, et autres
Publié: (2025)
The Coverage Principle: How Pre-Training Enables Post-Training
par: Chen, Fan, et autres
Publié: (2025)
par: Chen, Fan, et autres
Publié: (2025)
Optimal Detection for Language Watermarks with Pseudorandom Collision
par: Cai, T. Tony, et autres
Publié: (2025)
par: Cai, T. Tony, et autres
Publié: (2025)
From Formal Language Theory to Statistical Learning: Finite Observability of Subregular Languages
par: Hayashi, Katsuhiko, et autres
Publié: (2025)
par: Hayashi, Katsuhiko, et autres
Publié: (2025)
Computational Complexity of Statistics: New Insights from Low-Degree Polynomials
par: Wein, Alexander S.
Publié: (2025)
par: Wein, Alexander S.
Publié: (2025)
Unveil Conditional Diffusion Models with Classifier-free Guidance: A Sharp Statistical Theory
par: Fu, Hengyu, et autres
Publié: (2024)
par: Fu, Hengyu, et autres
Publié: (2024)
Differentially Private Two-Stage Empirical Risk Minimization with Applications to Individualized Treatment Rule
par: Lee, Joowon, et autres
Publié: (2026)
par: Lee, Joowon, et autres
Publié: (2026)
Statistical learning on measures: an application to persistence diagrams
par: Hacquard, Olympio, et autres
Publié: (2023)
par: Hacquard, Olympio, et autres
Publié: (2023)
Documents similaires
-
Lean Formalization of Generalization Error Bound by Rademacher Complexity and Dudley's Entropy Integral
par: Sonoda, Sho, et autres
Publié: (2025) -
Self-Regularized Learning Methods
par: Schölpple, Max, et autres
Publié: (2026) -
Unveiling the Statistical Foundations of Chain-of-Thought Prompting Methods
par: Hu, Xinyang, et autres
Publié: (2024) -
Statistical Learning Theory for Distributional Classification
par: Fiedler, Christian
Publié: (2026) -
Retrieval-Augmented Generation as Noisy In-Context Learning: A Unified Theory and Risk Bounds
par: Guo, Yang, et autres
Publié: (2025)