Variational Inference Failures Under Model Symmetries: Permutation Invariant Posteriors for Bayesian Neural Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Gelberg, Yoav, van der Ouderaa, Tycho F. A., van der Wilk, Mark, Gal, Yarin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Noether's razor: Learning Conserved Quantities
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2024)
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2024)
Symmetry Guarantees Statistic Recovery in Variational Inference
di: Marks, Daniel, et al.
Pubblicazione: (2026)
di: Marks, Daniel, et al.
Pubblicazione: (2026)
Leech Lattice Vector Quantization for Efficient LLM Compression
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2026)
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2026)
The Neural Tangent Kernel for Classification
di: Plenk, Jonathan, et al.
Pubblicazione: (2026)
di: Plenk, Jonathan, et al.
Pubblicazione: (2026)
Training Transformers for KV Cache Compressibility
di: Gelberg, Yoav, et al.
Pubblicazione: (2026)
di: Gelberg, Yoav, et al.
Pubblicazione: (2026)
Pyramid Vector Quantization for LLMs
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2024)
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2024)
Bivariate Causal Discovery using Bayesian Model Selection
di: Dhir, Anish, et al.
Pubblicazione: (2023)
di: Dhir, Anish, et al.
Pubblicazione: (2023)
The LLM Surgeon
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2023)
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2023)
SynDaCaTE: A Synthetic Dataset For Evaluating Part-Whole Hierarchical Inference
di: Levi, Jake, et al.
Pubblicazione: (2025)
di: Levi, Jake, et al.
Pubblicazione: (2025)
Inverse-Free Sparse Variational Gaussian Processes
di: Cortinovis, Stefano, et al.
Pubblicazione: (2026)
di: Cortinovis, Stefano, et al.
Pubblicazione: (2026)
Continuous Bayesian Model Selection for Multivariate Causal Discovery
di: Dhir, Anish, et al.
Pubblicazione: (2024)
di: Dhir, Anish, et al.
Pubblicazione: (2024)
A Meta-Learning Approach to Bayesian Causal Discovery
di: Dhir, Anish, et al.
Pubblicazione: (2024)
di: Dhir, Anish, et al.
Pubblicazione: (2024)
Adjusting Model Size in Continual Gaussian Processes: How Big is Big Enough?
di: Pescador-Barrios, Guiomar, et al.
Pubblicazione: (2024)
di: Pescador-Barrios, Guiomar, et al.
Pubblicazione: (2024)
A Distributed Gaussian Process Model for Multi-Robot Mapping
di: Nabarro, Seth, et al.
Pubblicazione: (2026)
di: Nabarro, Seth, et al.
Pubblicazione: (2026)
Iterative Deployment Improves Planning Skills in LLMs
di: Corrêa, Augusto B., et al.
Pubblicazione: (2025)
di: Corrêa, Augusto B., et al.
Pubblicazione: (2025)
Learning in Deep Factor Graphs with Gaussian Belief Propagation
di: Nabarro, Seth, et al.
Pubblicazione: (2023)
di: Nabarro, Seth, et al.
Pubblicazione: (2023)
System-Aware Neural ODE Processes for Few-Shot Bayesian Optimization
di: Qing, Jixiang, et al.
Pubblicazione: (2024)
di: Qing, Jixiang, et al.
Pubblicazione: (2024)
Large-scale Score-based Variational Posterior Inference for Bayesian Deep Neural Networks
di: Kim, Minyoung
Pubblicazione: (2026)
di: Kim, Minyoung
Pubblicazione: (2026)
Transfer Learning Bayesian Optimization to Design Competitor DNA Molecules for Use in Diagnostic Assays
di: Sedgwick, Ruby, et al.
Pubblicazione: (2024)
di: Sedgwick, Ruby, et al.
Pubblicazione: (2024)
A Compact Representation for Bayesian Neural Networks By Removing Permutation Symmetry
di: Xiao, Tim Z., et al.
Pubblicazione: (2023)
di: Xiao, Tim Z., et al.
Pubblicazione: (2023)
Temporal-Difference Variational Continual Learning
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
Targeted Deep Architectures: A TMLE-Based Framework for Robust Causal Inference in Neural Networks
di: Li, Yi, et al.
Pubblicazione: (2025)
di: Li, Yi, et al.
Pubblicazione: (2025)
Deep Bayesian Active Learning for Preference Modeling in Large Language Models
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
Recommendations for Baselines and Benchmarking Approximate Gaussian Processes
di: Ober, Sebastian W., et al.
Pubblicazione: (2024)
di: Ober, Sebastian W., et al.
Pubblicazione: (2024)
A Study of Posterior Stability for Time-Series Latent Diffusion
di: Li, Yangming, et al.
Pubblicazione: (2024)
di: Li, Yangming, et al.
Pubblicazione: (2024)
Learning on LoRAs: GL-Equivariant Processing of Low-Rank Weight Spaces for Large Finetuned Models
di: Putterman, Theo, et al.
Pubblicazione: (2024)
di: Putterman, Theo, et al.
Pubblicazione: (2024)
A Framework for Variational Inference of Lightweight Bayesian Neural Networks with Heteroscedastic Uncertainties
di: Schodt, David J., et al.
Pubblicazione: (2024)
di: Schodt, David J., et al.
Pubblicazione: (2024)
Muon is Not That Special: Random or Inverted Spectra Work Just as Well
di: Shumaylov, Zakhar, et al.
Pubblicazione: (2026)
di: Shumaylov, Zakhar, et al.
Pubblicazione: (2026)
Training Bayesian Neural Networks with Sparse Subspace Variational Inference
di: Li, Junbo, et al.
Pubblicazione: (2024)
di: Li, Junbo, et al.
Pubblicazione: (2024)
Transition Constrained Bayesian Optimization via Markov Decision Processes
di: Folch, Jose Pablo, et al.
Pubblicazione: (2024)
di: Folch, Jose Pablo, et al.
Pubblicazione: (2024)
Robust Bayesian Inference via Variational Approximations of Generalized Rho-Posteriors
di: Khribch, EL Mahdi, et al.
Pubblicazione: (2026)
di: Khribch, EL Mahdi, et al.
Pubblicazione: (2026)
Rethinking Aleatoric and Epistemic Uncertainty
di: Smith, Freddie Bickford, et al.
Pubblicazione: (2024)
di: Smith, Freddie Bickford, et al.
Pubblicazione: (2024)
Deep Hierarchical Learning with Nested Subspace Networks for Large Language Models
di: Rauba, Paulius, et al.
Pubblicazione: (2025)
di: Rauba, Paulius, et al.
Pubblicazione: (2025)
Posterior Inference on Shallow Infinitely Wide Bayesian Neural Networks under Weights with Unbounded Variance
di: Loría, Jorge, et al.
Pubblicazione: (2023)
di: Loría, Jorge, et al.
Pubblicazione: (2023)
Few-sample Variational Inference of Bayesian Neural Networks with Arbitrary Nonlinearities
di: Schodt, David J.
Pubblicazione: (2024)
di: Schodt, David J.
Pubblicazione: (2024)
Calibeating Prediction-Powered Inference
di: van der Laan, Lars, et al.
Pubblicazione: (2026)
di: van der Laan, Lars, et al.
Pubblicazione: (2026)
On the Interplay of Priors and Overparametrization in Bayesian Neural Network Posteriors
di: Kobialka, Julius, et al.
Pubblicazione: (2026)
di: Kobialka, Julius, et al.
Pubblicazione: (2026)
Hyperparameter Trajectory Inference with Conditional Lagrangian Optimal Transport
di: Amad, Harry, et al.
Pubblicazione: (2026)
di: Amad, Harry, et al.
Pubblicazione: (2026)
Model Selection with Model Zoo via Graph Learning
di: Li, Ziyu, et al.
Pubblicazione: (2024)
di: Li, Ziyu, et al.
Pubblicazione: (2024)
Beyond Next Token Probabilities: Learnable, Fast Detection of Hallucinations and Data Contamination on LLM Output Distributions
di: Bar-Shalom, Guy, et al.
Pubblicazione: (2025)
di: Bar-Shalom, Guy, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Noether's razor: Learning Conserved Quantities
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2024) -
Symmetry Guarantees Statistic Recovery in Variational Inference
di: Marks, Daniel, et al.
Pubblicazione: (2026) -
Leech Lattice Vector Quantization for Efficient LLM Compression
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2026) -
The Neural Tangent Kernel for Classification
di: Plenk, Jonathan, et al.
Pubblicazione: (2026) -
Training Transformers for KV Cache Compressibility
di: Gelberg, Yoav, et al.
Pubblicazione: (2026)