Mixtures of Gaussian Process Experts with SMC$^2$
Fuente:
arXiv
Salvato in:
| Autori principali: | Härkönen, Teemu, Wade, Sara, Law, Kody, Roininen, Lassi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fast Deep Mixtures of Gaussian Process Experts
di: Etienam, Clement, et al.
Pubblicazione: (2020)
di: Etienam, Clement, et al.
Pubblicazione: (2020)
Log-Gaussian Gamma Processes for Training Bayesian Neural Networks in Raman and CARS Spectroscopies
di: Härkönen, Teemu, et al.
Pubblicazione: (2023)
di: Härkönen, Teemu, et al.
Pubblicazione: (2023)
A Log-Gaussian Cox Process with Sequential Monte Carlo for Line Narrowing in Spectroscopy
di: Härkönen, Teemu, et al.
Pubblicazione: (2022)
di: Härkönen, Teemu, et al.
Pubblicazione: (2022)
Comparison of parallel SMC and MCMC for Bayesian deep learning
di: Liang, Xinzhu, et al.
Pubblicazione: (2024)
di: Liang, Xinzhu, et al.
Pubblicazione: (2024)
Bayesian inversion with Student's t priors based on Gaussian scale mixtures
di: Senchukova, Angelina, et al.
Pubblicazione: (2024)
di: Senchukova, Angelina, et al.
Pubblicazione: (2024)
Gaussian Process-Gated Hierarchical Mixtures of Experts
di: Liu, Yuhao, et al.
Pubblicazione: (2023)
di: Liu, Yuhao, et al.
Pubblicazione: (2023)
Statistical Estimation of Mean Lorentzian Line Width in Spectra by Gaussian Processes
di: Kuitunen, Erik, et al.
Pubblicazione: (2024)
di: Kuitunen, Erik, et al.
Pubblicazione: (2024)
Exponential Concentration in Stochastic Approximation
di: Law, Kody, et al.
Pubblicazione: (2022)
di: Law, Kody, et al.
Pubblicazione: (2022)
Bayesian Deep Learning with Multilevel Trace-class Neural Networks
di: Chada, Neil K., et al.
Pubblicazione: (2022)
di: Chada, Neil K., et al.
Pubblicazione: (2022)
Identifiability and amortized inference limitations in Kuramoto models
di: Hannula, Emma, et al.
Pubblicazione: (2026)
di: Hannula, Emma, et al.
Pubblicazione: (2026)
Estimation of log-Gaussian gamma processes with iterated posterior linearization and Hamiltonian Monte Carlo
di: Härkönen, Teemu, et al.
Pubblicazione: (2026)
di: Härkönen, Teemu, et al.
Pubblicazione: (2026)
Statistical Batch-Based Bearing Fault Detection
di: Jorry, Victoria, et al.
Pubblicazione: (2024)
di: Jorry, Victoria, et al.
Pubblicazione: (2024)
Mixture of Lookup Experts
di: Jie, Shibo, et al.
Pubblicazione: (2025)
di: Jie, Shibo, et al.
Pubblicazione: (2025)
Model Selection for Gaussian-gated Gaussian Mixture of Experts Using Dendrograms of Mixing Measures
di: Thai, Tuan, et al.
Pubblicazione: (2025)
di: Thai, Tuan, et al.
Pubblicazione: (2025)
Partially stochastic deep learning with uncertainty quantification for model predictive heating control
di: Hannula, Emma, et al.
Pubblicazione: (2025)
di: Hannula, Emma, et al.
Pubblicazione: (2025)
Mixture Compressor for Mixture-of-Experts LLMs Gains More
di: Huang, Wei, et al.
Pubblicazione: (2024)
di: Huang, Wei, et al.
Pubblicazione: (2024)
Approximation Rates and VC-Dimension Bounds for (P)ReLU MLP Mixture of Experts
di: Kratsios, Anastasis, et al.
Pubblicazione: (2024)
di: Kratsios, Anastasis, et al.
Pubblicazione: (2024)
Scalable Bayesian Monte Carlo: fast uncertainty estimation beyond deep ensembles
di: Liang, Xinzhu, et al.
Pubblicazione: (2025)
di: Liang, Xinzhu, et al.
Pubblicazione: (2025)
Mixture of Nested Experts: Adaptive Processing of Visual Tokens
di: Jain, Gagan, et al.
Pubblicazione: (2024)
di: Jain, Gagan, et al.
Pubblicazione: (2024)
Nexus: Specialization meets Adaptability for Efficiently Training Mixture of Experts
di: Gritsch, Nikolas, et al.
Pubblicazione: (2024)
di: Gritsch, Nikolas, et al.
Pubblicazione: (2024)
Coupling Experts and Routers in Mixture-of-Experts via an Auxiliary Loss
di: Lv, Ang, et al.
Pubblicazione: (2025)
di: Lv, Ang, et al.
Pubblicazione: (2025)
Chain-of-Experts: Unlocking the Communication Power of Mixture-of-Experts Models
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
$\infty$-MoE: Generalizing Mixture of Experts to Infinite Experts
di: Takashiro, Shota, et al.
Pubblicazione: (2026)
di: Takashiro, Shota, et al.
Pubblicazione: (2026)
Preserving Long-Tailed Expert Information in Mixture-of-Experts Tuning
di: He, Haoze, et al.
Pubblicazione: (2026)
di: He, Haoze, et al.
Pubblicazione: (2026)
On Parameter Estimation in Deviated Gaussian Mixture of Experts
di: Nguyen, Huy, et al.
Pubblicazione: (2024)
di: Nguyen, Huy, et al.
Pubblicazione: (2024)
Mixture of Experts Made Intrinsically Interpretable
di: Yang, Xingyi, et al.
Pubblicazione: (2025)
di: Yang, Xingyi, et al.
Pubblicazione: (2025)
Maximum Score Routing For Mixture-of-Experts
di: Dong, Bowen, et al.
Pubblicazione: (2025)
di: Dong, Bowen, et al.
Pubblicazione: (2025)
Mixture of LoRA Experts
di: Wu, Xun, et al.
Pubblicazione: (2024)
di: Wu, Xun, et al.
Pubblicazione: (2024)
Optimizing Pre-Training Data Mixtures with Mixtures of Data Expert Models
di: Belenki, Lior, et al.
Pubblicazione: (2025)
di: Belenki, Lior, et al.
Pubblicazione: (2025)
Diversifying the Expert Knowledge for Task-Agnostic Pruning in Sparse Mixture-of-Experts
di: Zhang, Zeliang, et al.
Pubblicazione: (2024)
di: Zhang, Zeliang, et al.
Pubblicazione: (2024)
Routers Learn the Geometry of Their Experts: Geometric Coupling in Sparse Mixture-of-Experts
di: Ahrac, Sagi, et al.
Pubblicazione: (2026)
di: Ahrac, Sagi, et al.
Pubblicazione: (2026)
Is Temperature Sample Efficient for Softmax Gaussian Mixture of Experts?
di: Nguyen, Huy, et al.
Pubblicazione: (2024)
di: Nguyen, Huy, et al.
Pubblicazione: (2024)
Bayesian Mixture of Experts For Large Language Models
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
di: Dialameh, Maryam, et al.
Pubblicazione: (2025)
MoFE: Mixture of Frozen Experts Architecture
di: Seo, Jean, et al.
Pubblicazione: (2025)
di: Seo, Jean, et al.
Pubblicazione: (2025)
Slicing and Dicing: Configuring Optimal Mixtures of Experts
di: Li, Margaret, et al.
Pubblicazione: (2026)
di: Li, Margaret, et al.
Pubblicazione: (2026)
Shortcut-connected Expert Parallelism for Accelerating Mixture-of-Experts
di: Cai, Weilin, et al.
Pubblicazione: (2024)
di: Cai, Weilin, et al.
Pubblicazione: (2024)
When Are Experts Misrouted? Counterfactual Routing Analysis in Mixture-of-Experts Language Models
di: Yoon, Youngsik, et al.
Pubblicazione: (2026)
di: Yoon, Youngsik, et al.
Pubblicazione: (2026)
GatePro: Parameter-Free Expert Selection Optimization for Mixture-of-Experts Models
di: Zheng, Chen, et al.
Pubblicazione: (2025)
di: Zheng, Chen, et al.
Pubblicazione: (2025)
SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts
di: Muzio, Alexandre, et al.
Pubblicazione: (2024)
di: Muzio, Alexandre, et al.
Pubblicazione: (2024)
Dendrograms of Mixing Measures for Softmax-Gated Gaussian Mixture of Experts: Consistency without Model Sweeps
di: Hai, Do Tien, et al.
Pubblicazione: (2025)
di: Hai, Do Tien, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Fast Deep Mixtures of Gaussian Process Experts
di: Etienam, Clement, et al.
Pubblicazione: (2020) -
Log-Gaussian Gamma Processes for Training Bayesian Neural Networks in Raman and CARS Spectroscopies
di: Härkönen, Teemu, et al.
Pubblicazione: (2023) -
A Log-Gaussian Cox Process with Sequential Monte Carlo for Line Narrowing in Spectroscopy
di: Härkönen, Teemu, et al.
Pubblicazione: (2022) -
Comparison of parallel SMC and MCMC for Bayesian deep learning
di: Liang, Xinzhu, et al.
Pubblicazione: (2024) -
Bayesian inversion with Student's t priors based on Gaussian scale mixtures
di: Senchukova, Angelina, et al.
Pubblicazione: (2024)