Bayesian Computation in Deep Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Wenlong, Li, Bolian, Zhang, Ruqi, Li, Yingzhen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Making Reliable and Flexible Decisions in Long-tailed Classification
por: Li, Bolian, et al.
Publicado: (2025)
por: Li, Bolian, et al.
Publicado: (2025)
Entropy-MCMC: Sampling from Flat Basins with Ease
por: Li, Bolian, et al.
Publicado: (2023)
por: Li, Bolian, et al.
Publicado: (2023)
Uniform-Correct Policy Optimization: Breaking RLVR's Indifference to Diversity
por: Lochab, Anamika, et al.
Publicado: (2026)
por: Lochab, Anamika, et al.
Publicado: (2026)
ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time
por: Ding, Yi, et al.
Publicado: (2024)
por: Ding, Yi, et al.
Publicado: (2024)
HiBBO: HiPPO-based Space Consistency for High-dimensional Bayesian Optimisation
por: Xuan, Junyu, et al.
Publicado: (2025)
por: Xuan, Junyu, et al.
Publicado: (2025)
Calibrating Transformers via Sparse Gaussian Processes
por: Chen, Wenlong, et al.
Publicado: (2023)
por: Chen, Wenlong, et al.
Publicado: (2023)
Learning Self-Correction in Vision-Language Models via Rollout Augmentation
por: Ding, Yi, et al.
Publicado: (2026)
por: Ding, Yi, et al.
Publicado: (2026)
Cascade Reward Sampling for Efficient Decoding-Time Alignment
por: Li, Bolian, et al.
Publicado: (2024)
por: Li, Bolian, et al.
Publicado: (2024)
Stacey: Promoting Stochastic Steepest Descent via Accelerated $\ell_p$-Smooth Nonconvex Optimization
por: Luo, Xinyu, et al.
Publicado: (2025)
por: Luo, Xinyu, et al.
Publicado: (2025)
Addressing Performance Saturation for LLM RL via Precise Entropy Curve Control
por: Li, Bolian, et al.
Publicado: (2026)
por: Li, Bolian, et al.
Publicado: (2026)
Your Image is Secretly the Last Frame of a Pseudo Video
por: Chen, Wenlong, et al.
Publicado: (2024)
por: Chen, Wenlong, et al.
Publicado: (2024)
Training Bayesian Neural Networks with Sparse Subspace Variational Inference
por: Li, Junbo, et al.
Publicado: (2024)
por: Li, Junbo, et al.
Publicado: (2024)
Variational Uncertainty Decomposition for In-Context Learning
por: Jayasekera, I. Shavindra, et al.
Publicado: (2025)
por: Jayasekera, I. Shavindra, et al.
Publicado: (2025)
Probabilistic Learning and Generation in Deep Sequence Models
por: Chen, Wenlong
Publicado: (2026)
por: Chen, Wenlong
Publicado: (2026)
Position: Bayesian Deep Learning is Needed in the Age of Large-Scale AI
por: Papamarkou, Theodore, et al.
Publicado: (2024)
por: Papamarkou, Theodore, et al.
Publicado: (2024)
Reheated Gradient-based Discrete Sampling for Combinatorial Optimization
por: Li, Muheng, et al.
Publicado: (2025)
por: Li, Muheng, et al.
Publicado: (2025)
Gradient Descent with Projection Finds Over-Parameterized Neural Networks for Learning Low-Degree Polynomials with Nearly Minimax Optimal Rate
por: Yang, Yingzhen, et al.
Publicado: (2026)
por: Yang, Yingzhen, et al.
Publicado: (2026)
Shallow Neural Networks Learn Low-Degree Spherical Polynomials with Feature Learning by Learnable Channel Attention
por: Yang, Yingzhen
Publicado: (2025)
por: Yang, Yingzhen
Publicado: (2025)
Neural Flow Samplers with Shortcut Models
por: Chen, Wuhao, et al.
Publicado: (2025)
por: Chen, Wuhao, et al.
Publicado: (2025)
Discrete Neural Flow Samplers with Locally Equivariant Transformer
por: Ou, Zijing, et al.
Publicado: (2025)
por: Ou, Zijing, et al.
Publicado: (2025)
Improved Generalization Bounds for Transductive Learning by Transductive Local Complexity and Its Applications
por: Yang, Yingzhen
Publicado: (2023)
por: Yang, Yingzhen
Publicado: (2023)
Spectral Transformer Neural Processes
por: Chen, Xianhe, et al.
Publicado: (2026)
por: Chen, Xianhe, et al.
Publicado: (2026)
Compact Memory for Continual Logistic Regression
por: Jung, Yohan, et al.
Publicado: (2025)
por: Jung, Yohan, et al.
Publicado: (2025)
Recurrent Memory for Online Interdomain Gaussian Processes
por: Chen, Wenlong, et al.
Publicado: (2025)
por: Chen, Wenlong, et al.
Publicado: (2025)
Sharp Generalization for Nonparametric Regression in Interpolation Space by Over-Parameterized Neural Networks Trained with Preconditioned Gradient Descent and Early Stopping
por: Yang, Yingzhen, et al.
Publicado: (2024)
por: Yang, Yingzhen, et al.
Publicado: (2024)
Gradient Descent Finds Over-Parameterized Neural Networks with Sharp Generalization for Nonparametric Regression
por: Yang, Yingzhen, et al.
Publicado: (2024)
por: Yang, Yingzhen, et al.
Publicado: (2024)
Projective Proximal Gradient Descent for A Class of Nonconvex Nonsmooth Optimization Problems: Fast Convergence Without Kurdyka-Lojasiewicz (KL) Property
por: Yang, Yingzhen, et al.
Publicado: (2023)
por: Yang, Yingzhen, et al.
Publicado: (2023)
Neural Stochastic Flows: Solver-Free Modelling and Inference for SDE Solutions
por: Kiyohara, Naoki, et al.
Publicado: (2025)
por: Kiyohara, Naoki, et al.
Publicado: (2025)
Inference-Time Scaling of Discrete Diffusion Models via Importance Weighting and Optimal Proposal Design
por: Ou, Zijing, et al.
Publicado: (2025)
por: Ou, Zijing, et al.
Publicado: (2025)
Slithering Through Gaps: Capturing Discrete Isolated Modes via Logistic Bridging
por: Mohanty, Pinaki, et al.
Publicado: (2026)
por: Mohanty, Pinaki, et al.
Publicado: (2026)
CoT-UQ: Improving Response-wise Uncertainty Quantification in LLMs with Chain-of-Thought
por: Zhang, Boxuan, et al.
Publicado: (2025)
por: Zhang, Boxuan, et al.
Publicado: (2025)
Streamlining Prediction in Bayesian Deep Learning
por: Li, Rui, et al.
Publicado: (2024)
por: Li, Rui, et al.
Publicado: (2024)
Interdomain Attention: Beyond Token-Level Key-Value Memory
por: Kiyohara, Naoki, et al.
Publicado: (2026)
por: Kiyohara, Naoki, et al.
Publicado: (2026)
Controlled LLM Decoding via Discrete Auto-regressive Biasing
por: Pynadath, Patrick, et al.
Publicado: (2025)
por: Pynadath, Patrick, et al.
Publicado: (2025)
Energy-Based Reward Models for Robust Language Model Alignment
por: Lochab, Anamika, et al.
Publicado: (2025)
por: Lochab, Anamika, et al.
Publicado: (2025)
Why Any-Order Autoregressive Models Need Two-Stream Attention: A Structural-Semantic Tradeoff
por: Pynadath, Patrick, et al.
Publicado: (2026)
por: Pynadath, Patrick, et al.
Publicado: (2026)
Structured Coupling for Flow Matching
por: Sumba, Xavier, et al.
Publicado: (2026)
por: Sumba, Xavier, et al.
Publicado: (2026)
On the Identifiability of Switching Dynamical Systems
por: Balsells-Rodas, Carles, et al.
Publicado: (2023)
por: Balsells-Rodas, Carles, et al.
Publicado: (2023)
Addressing the Inconsistency in Bayesian Deep Learning via Generalized Laplace Approximation
por: Chen, Yinsong, et al.
Publicado: (2024)
por: Chen, Yinsong, et al.
Publicado: (2024)
Graph Contrastive Learning with Low-Rank Regularization and Low-Rank Attention for Noisy Node Classification
por: Wang, Yancheng, et al.
Publicado: (2024)
por: Wang, Yancheng, et al.
Publicado: (2024)
Ejemplares similares
-
Making Reliable and Flexible Decisions in Long-tailed Classification
por: Li, Bolian, et al.
Publicado: (2025) -
Entropy-MCMC: Sampling from Flat Basins with Ease
por: Li, Bolian, et al.
Publicado: (2023) -
Uniform-Correct Policy Optimization: Breaking RLVR's Indifference to Diversity
por: Lochab, Anamika, et al.
Publicado: (2026) -
ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time
por: Ding, Yi, et al.
Publicado: (2024) -
HiBBO: HiPPO-based Space Consistency for High-dimensional Bayesian Optimisation
por: Xuan, Junyu, et al.
Publicado: (2025)