Calibrating Transformers via Sparse Gaussian Processes
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Wenlong, Li, Yingzhen |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Recurrent Memory for Online Interdomain Gaussian Processes
by: Chen, Wenlong, et al.
Published: (2025)
by: Chen, Wenlong, et al.
Published: (2025)
Spectral Transformer Neural Processes
by: Chen, Xianhe, et al.
Published: (2026)
by: Chen, Xianhe, et al.
Published: (2026)
HiBBO: HiPPO-based Space Consistency for High-dimensional Bayesian Optimisation
by: Xuan, Junyu, et al.
Published: (2025)
by: Xuan, Junyu, et al.
Published: (2025)
Bayesian Computation in Deep Learning
by: Chen, Wenlong, et al.
Published: (2025)
by: Chen, Wenlong, et al.
Published: (2025)
Your Image is Secretly the Last Frame of a Pseudo Video
by: Chen, Wenlong, et al.
Published: (2024)
by: Chen, Wenlong, et al.
Published: (2024)
Locally Regularized Sparse Graph by Fast Proximal Gradient Descent
by: Sun, Dongfang, et al.
Published: (2024)
by: Sun, Dongfang, et al.
Published: (2024)
Discrete Neural Flow Samplers with Locally Equivariant Transformer
by: Ou, Zijing, et al.
Published: (2025)
by: Ou, Zijing, et al.
Published: (2025)
Sparse Gaussian Neural Processes
by: Rochussen, Tommy, et al.
Published: (2025)
by: Rochussen, Tommy, et al.
Published: (2025)
Scalable Bayesian Optimization via Focalized Sparse Gaussian Processes
by: Wei, Yunyue, et al.
Published: (2024)
by: Wei, Yunyue, et al.
Published: (2024)
Efficient Visual Transformer by Learnable Token Merging
by: Wang, Yancheng, et al.
Published: (2024)
by: Wang, Yancheng, et al.
Published: (2024)
Compact Vision Transformer by Reduction of Kernel Complexity
by: Wang, Yancheng, et al.
Published: (2025)
by: Wang, Yancheng, et al.
Published: (2025)
Calibrated Computation-Aware Gaussian Processes
by: Hegde, Disha, et al.
Published: (2024)
by: Hegde, Disha, et al.
Published: (2024)
Sparse Orthogonal Variational Inference for Gaussian Processes
by: Shi, Jiaxin, et al.
Published: (2019)
by: Shi, Jiaxin, et al.
Published: (2019)
Inverse-Free Sparse Variational Gaussian Processes
by: Cortinovis, Stefano, et al.
Published: (2026)
by: Cortinovis, Stefano, et al.
Published: (2026)
Inference-Time Scaling of Discrete Diffusion Models via Importance Weighting and Optimal Proposal Design
by: Ou, Zijing, et al.
Published: (2025)
by: Ou, Zijing, et al.
Published: (2025)
Variational Uncertainty Decomposition for In-Context Learning
by: Jayasekera, I. Shavindra, et al.
Published: (2025)
by: Jayasekera, I. Shavindra, et al.
Published: (2025)
Kernel Multigrid: Accelerate Back-fitting via Sparse Gaussian Process Regression
by: Zou, Lu, et al.
Published: (2024)
by: Zou, Lu, et al.
Published: (2024)
Neural Flow Samplers with Shortcut Models
by: Chen, Wuhao, et al.
Published: (2025)
by: Chen, Wuhao, et al.
Published: (2025)
Compact Memory for Continual Logistic Regression
by: Jung, Yohan, et al.
Published: (2025)
by: Jung, Yohan, et al.
Published: (2025)
Sparse Techniques for Regression in Deep Gaussian Processes
by: Latz, Jonas, et al.
Published: (2025)
by: Latz, Jonas, et al.
Published: (2025)
New Bounds for Sparse Variational Gaussian Processes
by: Titsias, Michalis K.
Published: (2025)
by: Titsias, Michalis K.
Published: (2025)
Gaussian Processes Sampling with Sparse Grids under Additive Schwarz Preconditioner
by: Chen, Haoyuan, et al.
Published: (2024)
by: Chen, Haoyuan, et al.
Published: (2024)
Shallow Neural Networks Learn Low-Degree Spherical Polynomials with Feature Learning by Learnable Channel Attention
by: Yang, Yingzhen
Published: (2025)
by: Yang, Yingzhen
Published: (2025)
Numerically Stable Sparse Gaussian Processes via Minimum Separation using Cover Trees
by: Terenin, Alexander, et al.
Published: (2022)
by: Terenin, Alexander, et al.
Published: (2022)
Simplex-to-Euclidean Bijection for Conjugate and Calibrated Multiclass Gaussian Process
by: Williams, Bernardo, et al.
Published: (2026)
by: Williams, Bernardo, et al.
Published: (2026)
Calibrated Inference for the Conditional Average Treatment Effect in the Few-Placebo Regime via Gaussian Processes
by: Uehara, Eichi
Published: (2026)
by: Uehara, Eichi
Published: (2026)
Improved Generalization Bounds for Transductive Learning by Transductive Local Complexity and Its Applications
by: Yang, Yingzhen
Published: (2023)
by: Yang, Yingzhen
Published: (2023)
Sparse Gaussian Processes: Structured Approximations and Power-EP Revisited
by: Bui, Thang D., et al.
Published: (2025)
by: Bui, Thang D., et al.
Published: (2025)
Projective Proximal Gradient Descent for A Class of Nonconvex Nonsmooth Optimization Problems: Fast Convergence Without Kurdyka-Lojasiewicz (KL) Property
by: Yang, Yingzhen, et al.
Published: (2023)
by: Yang, Yingzhen, et al.
Published: (2023)
Sharp Generalization for Nonparametric Regression in Interpolation Space by Over-Parameterized Neural Networks Trained with Preconditioned Gradient Descent and Early Stopping
by: Yang, Yingzhen, et al.
Published: (2024)
by: Yang, Yingzhen, et al.
Published: (2024)
Gradient Descent Finds Over-Parameterized Neural Networks with Sharp Generalization for Nonparametric Regression
by: Yang, Yingzhen, et al.
Published: (2024)
by: Yang, Yingzhen, et al.
Published: (2024)
Gradient Descent with Projection Finds Over-Parameterized Neural Networks for Learning Low-Degree Polynomials with Nearly Minimax Optimal Rate
by: Yang, Yingzhen, et al.
Published: (2026)
by: Yang, Yingzhen, et al.
Published: (2026)
Interdomain Attention: Beyond Token-Level Key-Value Memory
by: Kiyohara, Naoki, et al.
Published: (2026)
by: Kiyohara, Naoki, et al.
Published: (2026)
Symbolic Regression on Sparse and Noisy Data with Gaussian Processes
by: Hsin, Junette, et al.
Published: (2023)
by: Hsin, Junette, et al.
Published: (2023)
In-Context Compositional Learning via Sparse Coding Transformer
by: Chen, Wei, et al.
Published: (2025)
by: Chen, Wei, et al.
Published: (2025)
Regime-Adaptive Bayesian Optimization via Dirichlet Process Mixtures of Gaussian Processes
by: Zhang, Yan, et al.
Published: (2026)
by: Zhang, Yan, et al.
Published: (2026)
Scalable Bayesian Optimization with Sparse Gaussian Process Models
by: Yang, Ang
Published: (2020)
by: Yang, Ang
Published: (2020)
Efficient Graph Condensation via Gaussian Process
by: Wang, Lin, et al.
Published: (2025)
by: Wang, Lin, et al.
Published: (2025)
Goal-Oriented Lower-Tail Calibration of Gaussian Processes for Bayesian Optimization
by: Pion, Aurélien, et al.
Published: (2026)
by: Pion, Aurélien, et al.
Published: (2026)
Energy-Based Modelling for Discrete and Mixed Data via Heat Equations on Structured Spaces
by: Schröder, Tobias, et al.
Published: (2024)
by: Schröder, Tobias, et al.
Published: (2024)
Similar Items
-
Recurrent Memory for Online Interdomain Gaussian Processes
by: Chen, Wenlong, et al.
Published: (2025) -
Spectral Transformer Neural Processes
by: Chen, Xianhe, et al.
Published: (2026) -
HiBBO: HiPPO-based Space Consistency for High-dimensional Bayesian Optimisation
by: Xuan, Junyu, et al.
Published: (2025) -
Bayesian Computation in Deep Learning
by: Chen, Wenlong, et al.
Published: (2025) -
Your Image is Secretly the Last Frame of a Pseudo Video
by: Chen, Wenlong, et al.
Published: (2024)