Gaussian mixture layers for neural networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Chewi, Sinho, Rigollet, Philippe, Yan, Yuling |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Statistical optimal transport
di: Chewi, Sinho, et al.
Pubblicazione: (2024)
di: Chewi, Sinho, et al.
Pubblicazione: (2024)
Complexity of Non-Log-Concave Sampling in Fisher Information
di: Chewi, Sinho, et al.
Pubblicazione: (2026)
di: Chewi, Sinho, et al.
Pubblicazione: (2026)
A proximal gradient algorithm for composite log-concave sampling
di: Liu, Linghai, et al.
Pubblicazione: (2026)
di: Liu, Linghai, et al.
Pubblicazione: (2026)
Sampling from Constrained Gibbs Measures: with Applications to High-Dimensional Bayesian Inference
di: Wang, Ruixiao, et al.
Pubblicazione: (2026)
di: Wang, Ruixiao, et al.
Pubblicazione: (2026)
High-accuracy sampling for diffusion models and log-concave distributions
di: Chen, Fan, et al.
Pubblicazione: (2026)
di: Chen, Fan, et al.
Pubblicazione: (2026)
Shifted Composition III: Local Error Framework for KL Divergence
di: Altschuler, Jason M., et al.
Pubblicazione: (2024)
di: Altschuler, Jason M., et al.
Pubblicazione: (2024)
Algorithms for mean-field variational inference via polyhedral optimization in the Wasserstein space
di: Jiang, Yiheng, et al.
Pubblicazione: (2023)
di: Jiang, Yiheng, et al.
Pubblicazione: (2023)
Variational inference via radial transport
di: Ghafourpour, Luca, et al.
Pubblicazione: (2026)
di: Ghafourpour, Luca, et al.
Pubblicazione: (2026)
On the number of modes of Gaussian kernel density estimators
di: Geshkovski, Borjan, et al.
Pubblicazione: (2024)
di: Geshkovski, Borjan, et al.
Pubblicazione: (2024)
Fast parallel sampling under isoperimetry
di: Anari, Nima, et al.
Pubblicazione: (2024)
di: Anari, Nima, et al.
Pubblicazione: (2024)
Stability of the Kim--Milman flow map
di: Chewi, Sinho, et al.
Pubblicazione: (2025)
di: Chewi, Sinho, et al.
Pubblicazione: (2025)
DDPM Score Matching and Distribution Learning
di: Chewi, Sinho, et al.
Pubblicazione: (2025)
di: Chewi, Sinho, et al.
Pubblicazione: (2025)
Algorithmic warm starts for Hamiltonian Monte Carlo
di: Zhang, Matthew S., et al.
Pubblicazione: (2026)
di: Zhang, Matthew S., et al.
Pubblicazione: (2026)
Sampling from the Mean-Field Stationary Distribution
di: Kook, Yunbum, et al.
Pubblicazione: (2024)
di: Kook, Yunbum, et al.
Pubblicazione: (2024)
Analysis of Langevin Monte Carlo from Poincaré to Log-Sobolev
di: Chewi, Sinho, et al.
Pubblicazione: (2021)
di: Chewi, Sinho, et al.
Pubblicazione: (2021)
High-accuracy log-concave sampling with stochastic queries
di: Chen, Fan, et al.
Pubblicazione: (2026)
di: Chen, Fan, et al.
Pubblicazione: (2026)
Sublinear iterations can suffice even for DDPMs
di: Zhang, Matthew S., et al.
Pubblicazione: (2025)
di: Zhang, Matthew S., et al.
Pubblicazione: (2025)
On the Approximation Accuracy of Gaussian Variational Inference
di: Katsevich, Anya, et al.
Pubblicazione: (2023)
di: Katsevich, Anya, et al.
Pubblicazione: (2023)
On the best approximation by finite Gaussian mixtures
di: Ma, Yun, et al.
Pubblicazione: (2024)
di: Ma, Yun, et al.
Pubblicazione: (2024)
PAC-Bayesian risk bounds for fully connected deep neural network with Gaussian priors
di: Mai, The Tien
Pubblicazione: (2025)
di: Mai, The Tien
Pubblicazione: (2025)
Universality laws for Gaussian mixtures in generalized linear models
di: Dandi, Yatin, et al.
Pubblicazione: (2023)
di: Dandi, Yatin, et al.
Pubblicazione: (2023)
Scaling Limits of Long-Context Transformers
di: Bruno, Giuseppe, et al.
Pubblicazione: (2026)
di: Bruno, Giuseppe, et al.
Pubblicazione: (2026)
Propagation of Chaos in Contextual Flow Maps
di: Chen, Shi, et al.
Pubblicazione: (2026)
di: Chen, Shi, et al.
Pubblicazione: (2026)
Gaussian random field approximation via Stein's method with applications to wide random neural networks
di: Balasubramanian, Krishnakumar, et al.
Pubblicazione: (2023)
di: Balasubramanian, Krishnakumar, et al.
Pubblicazione: (2023)
On the rates of convergence for learning with convolutional neural networks
di: Yang, Yunfei, et al.
Pubblicazione: (2024)
di: Yang, Yunfei, et al.
Pubblicazione: (2024)
O(d/T) Convergence Theory for Diffusion Probabilistic Models under Minimal Assumptions
di: Li, Gen, et al.
Pubblicazione: (2024)
di: Li, Gen, et al.
Pubblicazione: (2024)
Adapting to Unknown Low-Dimensional Structures in Score-Based Diffusion Models
di: Li, Gen, et al.
Pubblicazione: (2024)
di: Li, Gen, et al.
Pubblicazione: (2024)
When can weak latent factors be statistically inferred?
di: Fan, Jianqing, et al.
Pubblicazione: (2024)
di: Fan, Jianqing, et al.
Pubblicazione: (2024)
On the VC dimension of deep group convolutional neural networks
di: Sepliarskaia, Anna, et al.
Pubblicazione: (2024)
di: Sepliarskaia, Anna, et al.
Pubblicazione: (2024)
Inference for Heteroskedastic PCA with Missing Data
di: Yan, Yuling, et al.
Pubblicazione: (2021)
di: Yan, Yuling, et al.
Pubblicazione: (2021)
Entrywise Inference for Missing Panel Data: A Simple and Instance-Optimal Approach
di: Yan, Yuling, et al.
Pubblicazione: (2024)
di: Yan, Yuling, et al.
Pubblicazione: (2024)
Mind the spikes: Benign overfitting of kernels and neural networks in fixed dimension
di: Haas, Moritz, et al.
Pubblicazione: (2023)
di: Haas, Moritz, et al.
Pubblicazione: (2023)
Posterior and variational inference for deep neural networks with heavy-tailed weights
di: Castillo, Ismaël, et al.
Pubblicazione: (2024)
di: Castillo, Ismaël, et al.
Pubblicazione: (2024)
How many samples are needed to train a deep neural network?
di: Golestaneh, Pegah, et al.
Pubblicazione: (2024)
di: Golestaneh, Pegah, et al.
Pubblicazione: (2024)
A Score-Based Density Formula, with Applications in Diffusion Generative Models
di: Li, Gen, et al.
Pubblicazione: (2024)
di: Li, Gen, et al.
Pubblicazione: (2024)
Nonparametric regression using over-parameterized shallow ReLU neural networks
di: Yang, Yunfei, et al.
Pubblicazione: (2023)
di: Yang, Yunfei, et al.
Pubblicazione: (2023)
The loss landscape of deep linear neural networks: a second-order analysis
di: Achour, El Mehdi, et al.
Pubblicazione: (2021)
di: Achour, El Mehdi, et al.
Pubblicazione: (2021)
Precise gradient descent training dynamics for finite-width multi-layer neural networks
di: Han, Qiyang, et al.
Pubblicazione: (2025)
di: Han, Qiyang, et al.
Pubblicazione: (2025)
A Rod Flow Model for Adam at the Edge of Stability
di: Regis, Eric, et al.
Pubblicazione: (2026)
di: Regis, Eric, et al.
Pubblicazione: (2026)
Rod Flow: A Continuous-Time Model for Gradient Descent at the Edge of Stability
di: Regis, Eric, et al.
Pubblicazione: (2026)
di: Regis, Eric, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Statistical optimal transport
di: Chewi, Sinho, et al.
Pubblicazione: (2024) -
Complexity of Non-Log-Concave Sampling in Fisher Information
di: Chewi, Sinho, et al.
Pubblicazione: (2026) -
A proximal gradient algorithm for composite log-concave sampling
di: Liu, Linghai, et al.
Pubblicazione: (2026) -
Sampling from Constrained Gibbs Measures: with Applications to High-Dimensional Bayesian Inference
di: Wang, Ruixiao, et al.
Pubblicazione: (2026) -
High-accuracy sampling for diffusion models and log-concave distributions
di: Chen, Fan, et al.
Pubblicazione: (2026)