The VampPrior Mixture Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Stirn, Andrew A., Knowles, David A. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hierarchical VAE with a Diffusion-based VampPrior
par: Kuzina, Anna, et autres
Publié: (2024)
par: Kuzina, Anna, et autres
Publié: (2024)
A Bayesian Mixture Model of Temporal Point Processes with Determinantal Point Process Prior
par: Dong, Yiwei, et autres
Publié: (2024)
par: Dong, Yiwei, et autres
Publié: (2024)
End-To-End Learning of Gaussian Mixture Priors for Diffusion Sampler
par: Blessing, Denis, et autres
Publié: (2025)
par: Blessing, Denis, et autres
Publié: (2025)
Energy Guided Geometric Flow Matching
par: Zweig, Aaron, et autres
Publié: (2025)
par: Zweig, Aaron, et autres
Publié: (2025)
Self-Adaptive Graph Mixture of Models
par: Meena, Mohit, et autres
Publié: (2025)
par: Meena, Mohit, et autres
Publié: (2025)
Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors
par: Fang, Luyang, et autres
Publié: (2026)
par: Fang, Luyang, et autres
Publié: (2026)
MC#: Mixture Compressor for Mixture-of-Experts Large Models
par: Huang, Wei, et autres
Publié: (2025)
par: Huang, Wei, et autres
Publié: (2025)
PriorZero: Bridging Language Priors and World Models for Decision Making
par: Xiong, Junyu, et autres
Publié: (2026)
par: Xiong, Junyu, et autres
Publié: (2026)
MixtureKit: A General Framework for Composing, Training, and Visualizing Mixture-of-Experts Models
par: Chamma, Ahmad, et autres
Publié: (2025)
par: Chamma, Ahmad, et autres
Publié: (2025)
Continuous Mixtures of Tractable Probabilistic Models
par: Correia, Alvaro H. C., et autres
Publié: (2022)
par: Correia, Alvaro H. C., et autres
Publié: (2022)
Mixture of Experts in Large Language Models
par: Zhang, Danyang, et autres
Publié: (2025)
par: Zhang, Danyang, et autres
Publié: (2025)
Bayesian Concept Bottleneck Models with LLM Priors
par: Feng, Jean, et autres
Publié: (2024)
par: Feng, Jean, et autres
Publié: (2024)
SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data
par: Romeo, Carlo, et autres
Publié: (2026)
par: Romeo, Carlo, et autres
Publié: (2026)
Mixture of Experts in a Mixture of RL settings
par: Willi, Timon, et autres
Publié: (2024)
par: Willi, Timon, et autres
Publié: (2024)
Position: The Future of Bayesian Prediction Is Prior-Fitted
par: Müller, Samuel, et autres
Publié: (2025)
par: Müller, Samuel, et autres
Publié: (2025)
Hybrid Attribution Priors for Explainable and Robust Model Training
par: Zhang, Zhuoran, et autres
Publié: (2025)
par: Zhang, Zhuoran, et autres
Publié: (2025)
Efficiently Editing Mixture-of-Experts Models with Compressed Experts
par: He, Yifei, et autres
Publié: (2025)
par: He, Yifei, et autres
Publié: (2025)
Subtractive Mixture Models via Squaring: Representation and Learning
par: Loconte, Lorenzo, et autres
Publié: (2023)
par: Loconte, Lorenzo, et autres
Publié: (2023)
Masked Generative Priors Improve World Models Sequence Modelling Capabilities
par: Meo, Cristian, et autres
Publié: (2024)
par: Meo, Cristian, et autres
Publié: (2024)
Score-of-Mixture Training: Training One-Step Generative Models Made Simple via Score Estimation of Mixture Distributions
par: Jayashankar, Tejas, et autres
Publié: (2025)
par: Jayashankar, Tejas, et autres
Publié: (2025)
Large Language Models are Effective Priors for Causal Graph Discovery
par: Darvariu, Victor-Alexandru, et autres
Publié: (2024)
par: Darvariu, Victor-Alexandru, et autres
Publié: (2024)
Comparing Prior and Learned Time Representations in Transformer Models of Timeseries
par: Koliou, Natalia, et autres
Publié: (2024)
par: Koliou, Natalia, et autres
Publié: (2024)
Latent Introspection: Models Can Detect Prior Concept Injections
par: Pearson-Vogel, Theia, et autres
Publié: (2026)
par: Pearson-Vogel, Theia, et autres
Publié: (2026)
Potential Energy based Mixture Model for Noisy Label Learning
par: Wang, Zijia, et autres
Publié: (2024)
par: Wang, Zijia, et autres
Publié: (2024)
Optimal Transport for Domain Adaptation through Gaussian Mixture Models
par: Montesuma, Eduardo Fernandes, et autres
Publié: (2024)
par: Montesuma, Eduardo Fernandes, et autres
Publié: (2024)
Mixture of Masters: Sparse Chess Language Models with Player Routing
par: Frisoni, Giacomo, et autres
Publié: (2026)
par: Frisoni, Giacomo, et autres
Publié: (2026)
Modeling Choice via Self-Attention
par: Ko, Joohwan, et autres
Publié: (2023)
par: Ko, Joohwan, et autres
Publié: (2023)
MixGCN: Scalable GCN Training by Mixture of Parallelism and Mixture of Accelerators
par: Wan, Cheng, et autres
Publié: (2025)
par: Wan, Cheng, et autres
Publié: (2025)
EquiTabPFN: A Target-Permutation Equivariant Prior Fitted Networks
par: Arbel, Michael, et autres
Publié: (2025)
par: Arbel, Michael, et autres
Publié: (2025)
Mixture of Raytraced Experts
par: Perin, Andrea, et autres
Publié: (2025)
par: Perin, Andrea, et autres
Publié: (2025)
Solving Prior Distribution Mismatch in Diffusion Models via Optimal Transport
par: Wang, Zhanpeng, et autres
Publié: (2024)
par: Wang, Zhanpeng, et autres
Publié: (2024)
NoiseAR: AutoRegressing Initial Noise Prior for Diffusion Models
par: Li, Zeming, et autres
Publié: (2025)
par: Li, Zeming, et autres
Publié: (2025)
STRCMP: Integrating Graph Structural Priors with Language Models for Combinatorial Optimization
par: Li, Xijun, et autres
Publié: (2025)
par: Li, Xijun, et autres
Publié: (2025)
Not All Models Suit Expert Offloading: On Local Routing Consistency of Mixture-of-Expert Models
par: Liang, Jingcong, et autres
Publié: (2025)
par: Liang, Jingcong, et autres
Publié: (2025)
Multivariate Beta Mixture Model: Probabilistic Clustering With Flexible Cluster Shapes
par: Hsu, Yung-Peng, et autres
Publié: (2024)
par: Hsu, Yung-Peng, et autres
Publié: (2024)
Peirce in the Machine: How Mixture of Experts Models Perform Hypothesis Construction
par: Rushing, Bruce
Publié: (2024)
par: Rushing, Bruce
Publié: (2024)
Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models
par: Guo, Yongxin, et autres
Publié: (2024)
par: Guo, Yongxin, et autres
Publié: (2024)
PERFT: Parameter-Efficient Routed Fine-Tuning for Mixture-of-Expert Model
par: Liu, Yilun, et autres
Publié: (2024)
par: Liu, Yilun, et autres
Publié: (2024)
Modeling Expert Interactions in Sparse Mixture of Experts via Graph Structures
par: Nguyen-Nhat, Minh-Khoi, et autres
Publié: (2025)
par: Nguyen-Nhat, Minh-Khoi, et autres
Publié: (2025)
Unveiling Hidden Collaboration within Mixture-of-Experts in Large Language Models
par: Tang, Yuanbo, et autres
Publié: (2025)
par: Tang, Yuanbo, et autres
Publié: (2025)
Documents similaires
-
Hierarchical VAE with a Diffusion-based VampPrior
par: Kuzina, Anna, et autres
Publié: (2024) -
A Bayesian Mixture Model of Temporal Point Processes with Determinantal Point Process Prior
par: Dong, Yiwei, et autres
Publié: (2024) -
End-To-End Learning of Gaussian Mixture Priors for Diffusion Sampler
par: Blessing, Denis, et autres
Publié: (2025) -
Energy Guided Geometric Flow Matching
par: Zweig, Aaron, et autres
Publié: (2025) -
Self-Adaptive Graph Mixture of Models
par: Meena, Mohit, et autres
Publié: (2025)