Variation Due to Regularization Tractably Recovers Bayesian Deep Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | McInerney, James, Kallus, Nathan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Entropy After </Think> for reasoning model early exiting
par: Wang, Xi, et autres
Publié: (2025)
par: Wang, Xi, et autres
Publié: (2025)
Optimization of Epsilon-Greedy Exploration
par: Che, Ethan, et autres
Publié: (2025)
par: Che, Ethan, et autres
Publié: (2025)
Adjusting Regression Models for Conditional Uncertainty Calibration
par: Gao, Ruijiang, et autres
Publié: (2024)
par: Gao, Ruijiang, et autres
Publié: (2024)
Switching the Loss Reduces the Cost in Batch (Offline) Reinforcement Learning
par: Ayoub, Alex, et autres
Publié: (2024)
par: Ayoub, Alex, et autres
Publié: (2024)
A Statistical-Modelling Approach to Feedforward Neural Network Model Selection
par: McInerney, Andrew, et autres
Publié: (2022)
par: McInerney, Andrew, et autres
Publié: (2022)
Semiparametric Preference Optimization: Your Language Model is Secretly a Single-Index Model
par: Kallus, Nathan
Publié: (2025)
par: Kallus, Nathan
Publié: (2025)
Robust and Agnostic Learning of Conditional Distributional Treatment Effects
par: Kallus, Nathan, et autres
Publié: (2022)
par: Kallus, Nathan, et autres
Publié: (2022)
Bellman Calibration for $V$-Learning in Offline Reinforcement Learning
par: van der Laan, Lars, et autres
Publié: (2025)
par: van der Laan, Lars, et autres
Publié: (2025)
Estimating Heterogeneous Treatment Effects by Combining Weak Instruments and Observational Data
par: Oprescu, Miruna, et autres
Publié: (2024)
par: Oprescu, Miruna, et autres
Publié: (2024)
On the role of surrogates in the efficient estimation of treatment effects with limited outcome data
par: Kallus, Nathan, et autres
Publié: (2020)
par: Kallus, Nathan, et autres
Publié: (2020)
The Central Role of the Loss Function in Reinforcement Learning
par: Wang, Kaiwen, et autres
Publié: (2024)
par: Wang, Kaiwen, et autres
Publié: (2024)
SymCircuit: Bayesian Structure Inference for Tractable Probabilistic Circuits via Entropy-Regularized Reinforcement Learning
par: Ju, Y. Sungtaek
Publié: (2026)
par: Ju, Y. Sungtaek
Publié: (2026)
Demistifying Inference after Adaptive Experiments
par: Bibaut, Aurélien, et autres
Publié: (2024)
par: Bibaut, Aurélien, et autres
Publié: (2024)
A Reductions Approach to Risk-Sensitive Reinforcement Learning with Optimized Certainty Equivalents
par: Wang, Kaiwen, et autres
Publié: (2024)
par: Wang, Kaiwen, et autres
Publié: (2024)
Multi-Armed Bandits with Interference
par: Jia, Su, et autres
Publié: (2024)
par: Jia, Su, et autres
Publié: (2024)
Stationary Reweighting Yields Local Convergence of Soft Fitted Q-Iteration
par: van der Laan, Lars, et autres
Publié: (2025)
par: van der Laan, Lars, et autres
Publié: (2025)
Fitted $Q$ Evaluation Without Bellman Completeness via Stationary Weighting
par: van der Laan, Lars, et autres
Publié: (2025)
par: van der Laan, Lars, et autres
Publié: (2025)
Tractable Offline Learning of Regular Decision Processes
par: Deb, Ahana, et autres
Publié: (2024)
par: Deb, Ahana, et autres
Publié: (2024)
Exploration in the Limit
par: Cho, Brian M., et autres
Publié: (2025)
par: Cho, Brian M., et autres
Publié: (2025)
Peeking with PEAK: Sequential, Nonparametric Composite Hypothesis Tests for Means of Multiple Data Streams
par: Cho, Brian, et autres
Publié: (2024)
par: Cho, Brian, et autres
Publié: (2024)
Variational Deep Learning via Implicit Regularization
par: Wenger, Jonathan, et autres
Publié: (2025)
par: Wenger, Jonathan, et autres
Publié: (2025)
Positive Distribution Shift as a Framework for Understanding Tractable Learning
par: Medvedev, Marko, et autres
Publié: (2026)
par: Medvedev, Marko, et autres
Publié: (2026)
Teaching Knowledge Management (SIG KM).
par: McInerney, Claire
Publié: (2000)
par: McInerney, Claire
Publié: (2000)
Efficient Inference for Inverse Reinforcement Learning and Dynamic Discrete Choice Models
par: van der Laan, Lars, et autres
Publié: (2025)
par: van der Laan, Lars, et autres
Publié: (2025)
Is Cosine-Similarity of Embeddings Really About Similarity?
par: Steck, Harald, et autres
Publié: (2024)
par: Steck, Harald, et autres
Publié: (2024)
The Context Gathering Decision Process: A POMDP Framework for Agentic Search
par: Kausik, Chinmaya, et autres
Publié: (2026)
par: Kausik, Chinmaya, et autres
Publié: (2026)
Low-Rank MDPs with Continuous Action Spaces
par: Bennett, Andrew, et autres
Publié: (2023)
par: Bennett, Andrew, et autres
Publié: (2023)
Variational Linearized Laplace Approximation for Bayesian Deep Learning
par: Ortega, Luis A., et autres
Publié: (2023)
par: Ortega, Luis A., et autres
Publié: (2023)
SNPL: Simultaneous Policy Learning and Evaluation for Safe Multi-Objective Policy Improvement
par: Cho, Brian, et autres
Publié: (2025)
par: Cho, Brian, et autres
Publié: (2025)
More Benefits of Being Distributional: Second-Order Bounds for Reinforcement Learning
par: Wang, Kaiwen, et autres
Publié: (2024)
par: Wang, Kaiwen, et autres
Publié: (2024)
Inverse Reinforcement Learning with Just Classification and a Few Regressions
par: van der Laan, Lars, et autres
Publié: (2025)
par: van der Laan, Lars, et autres
Publié: (2025)
Efficient Adaptive Experimentation with Noncompliance
par: Oprescu, Miruna, et autres
Publié: (2025)
par: Oprescu, Miruna, et autres
Publié: (2025)
Simulation-Based Inference for Adaptive Experiments
par: Cho, Brian M, et autres
Publié: (2025)
par: Cho, Brian M, et autres
Publié: (2025)
GAAVI: Global Asymptotic Anytime Valid Inference for the Conditional Mean Function
par: Cho, Brian M, et autres
Publié: (2026)
par: Cho, Brian M, et autres
Publié: (2026)
Functional Natural Policy Gradients
par: Bibaut, Aurelien, et autres
Publié: (2026)
par: Bibaut, Aurelien, et autres
Publié: (2026)
Reward Transfer from Inverse Reinforcement Learning: A Coupled Minimax Approach
par: Hao, Guang-Yuan, et autres
Publié: (2026)
par: Hao, Guang-Yuan, et autres
Publié: (2026)
Clustered Switchback Designs for Experimentation Under Spatio-temporal Interference
par: Jia, Su, et autres
Publié: (2023)
par: Jia, Su, et autres
Publié: (2023)
Near-Optimal Non-Parametric Sequential Tests and Confidence Sequences with Possibly Dependent Observations
par: Bibaut, Aurelien, et autres
Publié: (2022)
par: Bibaut, Aurelien, et autres
Publié: (2022)
Characterizing Learning in Deep Neural Networks using Tractable Algorithmic Complexity Analysis
par: Bakhtiarifard, Pedram, et autres
Publié: (2026)
par: Bakhtiarifard, Pedram, et autres
Publié: (2026)
Environmental Scanning and the Information Manager.
par: Newsome, James, et autres
Publié: (1990)
par: Newsome, James, et autres
Publié: (1990)
Documents similaires
-
Entropy After </Think> for reasoning model early exiting
par: Wang, Xi, et autres
Publié: (2025) -
Optimization of Epsilon-Greedy Exploration
par: Che, Ethan, et autres
Publié: (2025) -
Adjusting Regression Models for Conditional Uncertainty Calibration
par: Gao, Ruijiang, et autres
Publié: (2024) -
Switching the Loss Reduces the Cost in Batch (Offline) Reinforcement Learning
par: Ayoub, Alex, et autres
Publié: (2024) -
A Statistical-Modelling Approach to Feedforward Neural Network Model Selection
par: McInerney, Andrew, et autres
Publié: (2022)