Enregistré dans:
| Auteur principal: | Vandermeulen, Robert A. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2508.21396 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Set Learning for Accurate and Calibrated Models
par: Muttenthaler, Lukas, et autres
Publié: (2023)
par: Muttenthaler, Lukas, et autres
Publié: (2023)
Machine Learning the 6d Supergravity Landscape
par: Brady, Nathan, et autres
Publié: (2025)
par: Brady, Nathan, et autres
Publié: (2025)
A Theoretical Framework for Modular Learning of Robust Generative Models
par: Cortes, Corinna, et autres
Publié: (2026)
par: Cortes, Corinna, et autres
Publié: (2026)
Heterogeneous graph attention network improves cancer multiomics integration
par: Tabakhi, Sina, et autres
Publié: (2024)
par: Tabakhi, Sina, et autres
Publié: (2024)
Human alignment of neural network representations
par: Muttenthaler, Lukas, et autres
Publié: (2022)
par: Muttenthaler, Lukas, et autres
Publié: (2022)
Train Separately, Merge Together: Modular Post-Training with Mixture-of-Experts
par: Morrison, Jacob, et autres
Publié: (2026)
par: Morrison, Jacob, et autres
Publié: (2026)
Mixture-of-World Models: Scaling Multi-Task Reinforcement Learning with Modular Latent Dynamics
par: Zhang, Boxuan, et autres
Publié: (2026)
par: Zhang, Boxuan, et autres
Publié: (2026)
Mixture of Cognitive Reasoners: Modular Reasoning with Brain-Like Specialization
par: AlKhamissi, Badr, et autres
Publié: (2025)
par: AlKhamissi, Badr, et autres
Publié: (2025)
Theoretical Insights for Diffusion Guidance: A Case Study for Gaussian Mixture Models
par: Wu, Yuchen, et autres
Publié: (2024)
par: Wu, Yuchen, et autres
Publié: (2024)
Prime Convolutional Model: Breaking the Ground for Theoretical Explainability
par: Panelli, Francesco, et autres
Publié: (2025)
par: Panelli, Francesco, et autres
Publié: (2025)
Theoretical Error Analysis of Entropy Approximation for Gaussian Mixtures
par: Furuya, Takashi, et autres
Publié: (2022)
par: Furuya, Takashi, et autres
Publié: (2022)
An Information Theoretic Approach to Interaction-Grounded Learning
par: Hu, Xiaoyan, et autres
Publié: (2024)
par: Hu, Xiaoyan, et autres
Publié: (2024)
Theoretical Guarantees for Variational Inference with Fixed-Variance Mixture of Gaussians
par: Huix, Tom, et autres
Publié: (2024)
par: Huix, Tom, et autres
Publié: (2024)
Mixture-of-Experts with Gradient Conflict-Driven Subspace Topology Pruning for Emergent Modularity
par: Gan, Yuxing, et autres
Publié: (2025)
par: Gan, Yuxing, et autres
Publié: (2025)
Improved Balanced Classification with Theoretically Grounded Loss Functions
par: Cortes, Corinna, et autres
Publié: (2025)
par: Cortes, Corinna, et autres
Publié: (2025)
Efficient Quantization of Mixture-of-Experts with Theoretical Generalization Guarantees
par: Chowdhury, Mohammed Nowaz Rabbani, et autres
Publié: (2026)
par: Chowdhury, Mohammed Nowaz Rabbani, et autres
Publié: (2026)
Mixture-of-Transformers Learn Faster: A Theoretical Study on Classification Problems
par: Li, Hongbo, et autres
Publié: (2025)
par: Li, Hongbo, et autres
Publié: (2025)
Why Do You Grok? A Theoretical Analysis of Grokking Modular Addition
par: Mohamadi, Mohamad Amin, et autres
Publié: (2024)
par: Mohamadi, Mohamad Amin, et autres
Publié: (2024)
Breaking the curse of dimensionality in structured density estimation
par: Vandermeulen, Robert A., et autres
Publié: (2024)
par: Vandermeulen, Robert A., et autres
Publié: (2024)
Robust Heterogeneous Analog-Digital Computing for Mixture-of-Experts Models with Theoretical Generalization Guarantees
par: Chowdhury, Mohammed Nowaz Rabbani, et autres
Publié: (2026)
par: Chowdhury, Mohammed Nowaz Rabbani, et autres
Publié: (2026)
Theoretically Grounded Pruning of Large Ground Sets for Constrained, Discrete Optimization
par: Nath, Ankur, et autres
Publié: (2024)
par: Nath, Ankur, et autres
Publié: (2024)
Differentially Private Training of Mixture of Experts Models
par: Tholoniat, Pierre, et autres
Publié: (2024)
par: Tholoniat, Pierre, et autres
Publié: (2024)
Dimension-independent rates for structured neural density estimation
par: Vandermeulen, Robert A., et autres
Publié: (2024)
par: Vandermeulen, Robert A., et autres
Publié: (2024)
Sparse Mixture-of-Experts for Compositional Generalization: Empirical Evidence and Theoretical Foundations of Optimal Sparsity
par: Zhao, Jinze, et autres
Publié: (2024)
par: Zhao, Jinze, et autres
Publié: (2024)
Theoretically Grounded Loss Functions and Algorithms for Score-Based Multi-Class Abstention
par: Mao, Anqi, et autres
Publié: (2023)
par: Mao, Anqi, et autres
Publié: (2023)
Continuous Mixtures of Tractable Probabilistic Models
par: Correia, Alvaro H. C., et autres
Publié: (2022)
par: Correia, Alvaro H. C., et autres
Publié: (2022)
The VampPrior Mixture Model
par: Stirn, Andrew A., et autres
Publié: (2024)
par: Stirn, Andrew A., et autres
Publié: (2024)
Modular Jump Gaussian Processes
par: Flowers, Anna R., et autres
Publié: (2025)
par: Flowers, Anna R., et autres
Publié: (2025)
Federated Gaussian Mixture Models
par: Pettersson, Sophia Zhang, et autres
Publié: (2025)
par: Pettersson, Sophia Zhang, et autres
Publié: (2025)
Mixtures of Transparent Local Models
par: Diaby, Niffa Cheick Oumar, et autres
Publié: (2026)
par: Diaby, Niffa Cheick Oumar, et autres
Publié: (2026)
BI-DCGAN: A Theoretically Grounded Bayesian Framework for Efficient and Diverse GANs
par: Valizadeh, Mahsa, et autres
Publié: (2025)
par: Valizadeh, Mahsa, et autres
Publié: (2025)
The Need for an External Observer Formalizing the Sufficiency Gap: A Mathematical Extension of Mixture Identifiability and Contextual Grounding in Sequence Models
par: Corielli, Francesco
Publié: (2026)
par: Corielli, Francesco
Publié: (2026)
Loss Given Default Prediction Under Measurement-Induced Mixture Distributions: An Information-Theoretic Approach
par: Marín, Javier
Publié: (2025)
par: Marín, Javier
Publié: (2025)
MC#: Mixture Compressor for Mixture-of-Experts Large Models
par: Huang, Wei, et autres
Publié: (2025)
par: Huang, Wei, et autres
Publié: (2025)
Slicing the Gaussian Mixture Wasserstein Distance
par: Piening, Moritz, et autres
Publié: (2025)
par: Piening, Moritz, et autres
Publié: (2025)
Self-Adaptive Graph Mixture of Models
par: Meena, Mohit, et autres
Publié: (2025)
par: Meena, Mohit, et autres
Publié: (2025)
Temporally Extended Mixture-of-Experts Models
par: Shen, Zeyu, et autres
Publié: (2026)
par: Shen, Zeyu, et autres
Publié: (2026)
Amortized Bayesian Mixture Models
par: Kucharský, Šimon, et autres
Publié: (2025)
par: Kucharský, Šimon, et autres
Publié: (2025)
Deep Equilibrium Models are Almost Equivalent to Not-so-deep Explicit Models for High-dimensional Gaussian Mixtures
par: Ling, Zenan, et autres
Publié: (2024)
par: Ling, Zenan, et autres
Publié: (2024)
Theoretically Grounded Framework for LLM Watermarking: A Distribution-Adaptive Approach
par: He, Haiyun, et autres
Publié: (2024)
par: He, Haiyun, et autres
Publié: (2024)
Documents similaires
-
Set Learning for Accurate and Calibrated Models
par: Muttenthaler, Lukas, et autres
Publié: (2023) -
Machine Learning the 6d Supergravity Landscape
par: Brady, Nathan, et autres
Publié: (2025) -
A Theoretical Framework for Modular Learning of Robust Generative Models
par: Cortes, Corinna, et autres
Publié: (2026) -
Heterogeneous graph attention network improves cancer multiomics integration
par: Tabakhi, Sina, et autres
Publié: (2024) -
Human alignment of neural network representations
par: Muttenthaler, Lukas, et autres
Publié: (2022)