Calibrating Transformers via Sparse Gaussian Processes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Wenlong, Li, Yingzhen |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Recurrent Memory for Online Interdomain Gaussian Processes
par: Chen, Wenlong, et autres
Publié: (2025)
par: Chen, Wenlong, et autres
Publié: (2025)
Spectral Transformer Neural Processes
par: Chen, Xianhe, et autres
Publié: (2026)
par: Chen, Xianhe, et autres
Publié: (2026)
HiBBO: HiPPO-based Space Consistency for High-dimensional Bayesian Optimisation
par: Xuan, Junyu, et autres
Publié: (2025)
par: Xuan, Junyu, et autres
Publié: (2025)
Bayesian Computation in Deep Learning
par: Chen, Wenlong, et autres
Publié: (2025)
par: Chen, Wenlong, et autres
Publié: (2025)
Your Image is Secretly the Last Frame of a Pseudo Video
par: Chen, Wenlong, et autres
Publié: (2024)
par: Chen, Wenlong, et autres
Publié: (2024)
Locally Regularized Sparse Graph by Fast Proximal Gradient Descent
par: Sun, Dongfang, et autres
Publié: (2024)
par: Sun, Dongfang, et autres
Publié: (2024)
Discrete Neural Flow Samplers with Locally Equivariant Transformer
par: Ou, Zijing, et autres
Publié: (2025)
par: Ou, Zijing, et autres
Publié: (2025)
Sparse Gaussian Neural Processes
par: Rochussen, Tommy, et autres
Publié: (2025)
par: Rochussen, Tommy, et autres
Publié: (2025)
Scalable Bayesian Optimization via Focalized Sparse Gaussian Processes
par: Wei, Yunyue, et autres
Publié: (2024)
par: Wei, Yunyue, et autres
Publié: (2024)
Efficient Visual Transformer by Learnable Token Merging
par: Wang, Yancheng, et autres
Publié: (2024)
par: Wang, Yancheng, et autres
Publié: (2024)
Compact Vision Transformer by Reduction of Kernel Complexity
par: Wang, Yancheng, et autres
Publié: (2025)
par: Wang, Yancheng, et autres
Publié: (2025)
Calibrated Computation-Aware Gaussian Processes
par: Hegde, Disha, et autres
Publié: (2024)
par: Hegde, Disha, et autres
Publié: (2024)
Sparse Orthogonal Variational Inference for Gaussian Processes
par: Shi, Jiaxin, et autres
Publié: (2019)
par: Shi, Jiaxin, et autres
Publié: (2019)
Inverse-Free Sparse Variational Gaussian Processes
par: Cortinovis, Stefano, et autres
Publié: (2026)
par: Cortinovis, Stefano, et autres
Publié: (2026)
Inference-Time Scaling of Discrete Diffusion Models via Importance Weighting and Optimal Proposal Design
par: Ou, Zijing, et autres
Publié: (2025)
par: Ou, Zijing, et autres
Publié: (2025)
Variational Uncertainty Decomposition for In-Context Learning
par: Jayasekera, I. Shavindra, et autres
Publié: (2025)
par: Jayasekera, I. Shavindra, et autres
Publié: (2025)
Kernel Multigrid: Accelerate Back-fitting via Sparse Gaussian Process Regression
par: Zou, Lu, et autres
Publié: (2024)
par: Zou, Lu, et autres
Publié: (2024)
Neural Flow Samplers with Shortcut Models
par: Chen, Wuhao, et autres
Publié: (2025)
par: Chen, Wuhao, et autres
Publié: (2025)
Compact Memory for Continual Logistic Regression
par: Jung, Yohan, et autres
Publié: (2025)
par: Jung, Yohan, et autres
Publié: (2025)
Sparse Techniques for Regression in Deep Gaussian Processes
par: Latz, Jonas, et autres
Publié: (2025)
par: Latz, Jonas, et autres
Publié: (2025)
New Bounds for Sparse Variational Gaussian Processes
par: Titsias, Michalis K.
Publié: (2025)
par: Titsias, Michalis K.
Publié: (2025)
Gaussian Processes Sampling with Sparse Grids under Additive Schwarz Preconditioner
par: Chen, Haoyuan, et autres
Publié: (2024)
par: Chen, Haoyuan, et autres
Publié: (2024)
Shallow Neural Networks Learn Low-Degree Spherical Polynomials with Feature Learning by Learnable Channel Attention
par: Yang, Yingzhen
Publié: (2025)
par: Yang, Yingzhen
Publié: (2025)
Numerically Stable Sparse Gaussian Processes via Minimum Separation using Cover Trees
par: Terenin, Alexander, et autres
Publié: (2022)
par: Terenin, Alexander, et autres
Publié: (2022)
Simplex-to-Euclidean Bijection for Conjugate and Calibrated Multiclass Gaussian Process
par: Williams, Bernardo, et autres
Publié: (2026)
par: Williams, Bernardo, et autres
Publié: (2026)
Calibrated Inference for the Conditional Average Treatment Effect in the Few-Placebo Regime via Gaussian Processes
par: Uehara, Eichi
Publié: (2026)
par: Uehara, Eichi
Publié: (2026)
Improved Generalization Bounds for Transductive Learning by Transductive Local Complexity and Its Applications
par: Yang, Yingzhen
Publié: (2023)
par: Yang, Yingzhen
Publié: (2023)
Sparse Gaussian Processes: Structured Approximations and Power-EP Revisited
par: Bui, Thang D., et autres
Publié: (2025)
par: Bui, Thang D., et autres
Publié: (2025)
Projective Proximal Gradient Descent for A Class of Nonconvex Nonsmooth Optimization Problems: Fast Convergence Without Kurdyka-Lojasiewicz (KL) Property
par: Yang, Yingzhen, et autres
Publié: (2023)
par: Yang, Yingzhen, et autres
Publié: (2023)
Sharp Generalization for Nonparametric Regression in Interpolation Space by Over-Parameterized Neural Networks Trained with Preconditioned Gradient Descent and Early Stopping
par: Yang, Yingzhen, et autres
Publié: (2024)
par: Yang, Yingzhen, et autres
Publié: (2024)
Gradient Descent Finds Over-Parameterized Neural Networks with Sharp Generalization for Nonparametric Regression
par: Yang, Yingzhen, et autres
Publié: (2024)
par: Yang, Yingzhen, et autres
Publié: (2024)
Gradient Descent with Projection Finds Over-Parameterized Neural Networks for Learning Low-Degree Polynomials with Nearly Minimax Optimal Rate
par: Yang, Yingzhen, et autres
Publié: (2026)
par: Yang, Yingzhen, et autres
Publié: (2026)
Interdomain Attention: Beyond Token-Level Key-Value Memory
par: Kiyohara, Naoki, et autres
Publié: (2026)
par: Kiyohara, Naoki, et autres
Publié: (2026)
Symbolic Regression on Sparse and Noisy Data with Gaussian Processes
par: Hsin, Junette, et autres
Publié: (2023)
par: Hsin, Junette, et autres
Publié: (2023)
In-Context Compositional Learning via Sparse Coding Transformer
par: Chen, Wei, et autres
Publié: (2025)
par: Chen, Wei, et autres
Publié: (2025)
Regime-Adaptive Bayesian Optimization via Dirichlet Process Mixtures of Gaussian Processes
par: Zhang, Yan, et autres
Publié: (2026)
par: Zhang, Yan, et autres
Publié: (2026)
Scalable Bayesian Optimization with Sparse Gaussian Process Models
par: Yang, Ang
Publié: (2020)
par: Yang, Ang
Publié: (2020)
Efficient Graph Condensation via Gaussian Process
par: Wang, Lin, et autres
Publié: (2025)
par: Wang, Lin, et autres
Publié: (2025)
Goal-Oriented Lower-Tail Calibration of Gaussian Processes for Bayesian Optimization
par: Pion, Aurélien, et autres
Publié: (2026)
par: Pion, Aurélien, et autres
Publié: (2026)
Energy-Based Modelling for Discrete and Mixed Data via Heat Equations on Structured Spaces
par: Schröder, Tobias, et autres
Publié: (2024)
par: Schröder, Tobias, et autres
Publié: (2024)
Documents similaires
-
Recurrent Memory for Online Interdomain Gaussian Processes
par: Chen, Wenlong, et autres
Publié: (2025) -
Spectral Transformer Neural Processes
par: Chen, Xianhe, et autres
Publié: (2026) -
HiBBO: HiPPO-based Space Consistency for High-dimensional Bayesian Optimisation
par: Xuan, Junyu, et autres
Publié: (2025) -
Bayesian Computation in Deep Learning
par: Chen, Wenlong, et autres
Publié: (2025) -
Your Image is Secretly the Last Frame of a Pseudo Video
par: Chen, Wenlong, et autres
Publié: (2024)