Approximation Rates and VC-Dimension Bounds for (P)ReLU MLP Mixture of Experts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kratsios, Anastasis, Borde, Haitz Sáez de Ocáriz, Furuya, Takashi, Law, Marc T. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Neural Snowflakes: Universal Latent Graph Inference via Trainable Latent Geometries
par: Borde, Haitz Sáez de Ocáriz, et autres
Publié: (2023)
par: Borde, Haitz Sáez de Ocáriz, et autres
Publié: (2023)
Is In-Context Universality Enough? MLPs are Also Universal In-Context
par: Kratsios, Anastasis, et autres
Publié: (2025)
par: Kratsios, Anastasis, et autres
Publié: (2025)
Approximation Rates in Besov Norms and Sample-Complexity of Kolmogorov-Arnold Networks with Residual Connections
par: Kratsios, Anastasis, et autres
Publié: (2025)
par: Kratsios, Anastasis, et autres
Publié: (2025)
Bridging the Gap Between Approximation and Learning via Optimal Approximation by ReLU MLPs of Maximal Regularity
par: Hong, Ruiyang, et autres
Publié: (2024)
par: Hong, Ruiyang, et autres
Publié: (2024)
Neural Spacetimes for DAG Representation Learning
par: Borde, Haitz Sáez de Ocáriz, et autres
Publié: (2024)
par: Borde, Haitz Sáez de Ocáriz, et autres
Publié: (2024)
Sharp Generalization Bounds for Foundation Models with Asymmetric Randomized Low-Rank Adapters
par: Kratsios, Anastasis, et autres
Publié: (2025)
par: Kratsios, Anastasis, et autres
Publié: (2025)
Keep It Light! Simplifying Image Clustering Via Text-Free Adapters
par: Li, Yicen, et autres
Publié: (2025)
par: Li, Yicen, et autres
Publié: (2025)
Expressivity and Approximation Properties of Deep Neural Networks with ReLU$^k$ Activation
par: He, Juncai, et autres
Publié: (2023)
par: He, Juncai, et autres
Publié: (2023)
Every Feedforward Neural Network Definable in an o-Minimal Structure Has Finite Sample Complexity
par: Kratsios, Anastasis, et autres
Publié: (2026)
par: Kratsios, Anastasis, et autres
Publié: (2026)
The Geometry of ReLU Networks through the ReLU Transition Graph
par: Dhayalkar, Sahil Rajesh
Publié: (2025)
par: Dhayalkar, Sahil Rajesh
Publié: (2025)
Competition-based Adaptive ReLU for Deep Neural Networks
par: Chen, Junjia, et autres
Publié: (2024)
par: Chen, Junjia, et autres
Publié: (2024)
ReLU-KAN: New Kolmogorov-Arnold Networks that Only Need Matrix Addition, Dot Multiplication, and ReLU
par: Qiu, Qi, et autres
Publié: (2024)
par: Qiu, Qi, et autres
Publié: (2024)
On Space Folds of ReLU Neural Networks
par: Lewandowski, Michal, et autres
Publié: (2025)
par: Lewandowski, Michal, et autres
Publié: (2025)
Low-dimensional approximations of the conditional law of Volterra processes: a non-positive curvature approach
par: Arabpour, Reza, et autres
Publié: (2024)
par: Arabpour, Reza, et autres
Publié: (2024)
Towards Lower Bounds on the Depth of ReLU Neural Networks
par: Hertrich, Christoph, et autres
Publié: (2021)
par: Hertrich, Christoph, et autres
Publié: (2021)
From Tempered to Benign Overfitting in ReLU Neural Networks
par: Kornowski, Guy, et autres
Publié: (2023)
par: Kornowski, Guy, et autres
Publié: (2023)
Causal Explanations from the Geometric Properties of ReLU Neural Networks
par: Woods, Hector, et autres
Publié: (2026)
par: Woods, Hector, et autres
Publié: (2026)
Structure-Preserving Reconstruction of Convex Lipschitz Functionals on Hilbert Spaces from Finite Samples
par: Kratsios, Anastasis
Publié: (2026)
par: Kratsios, Anastasis
Publié: (2026)
Polynomial Scaling is Possible For Neural Operator Approximations of Structured Families of BSDEs
par: Furuya, Takashi, et autres
Publié: (2024)
par: Furuya, Takashi, et autres
Publié: (2024)
On the Depth of Monotone ReLU Neural Networks and ICNNs
par: Bakaev, Egor, et autres
Publié: (2025)
par: Bakaev, Egor, et autres
Publié: (2025)
Zorro: A Flexible and Differentiable Parametric Family of Activation Functions That Extends ReLU and GELU
par: Roodschild, Matias, et autres
Publié: (2024)
par: Roodschild, Matias, et autres
Publié: (2024)
KAN versus MLP on Irregular or Noisy Functions
par: Zeng, Chen, et autres
Publié: (2024)
par: Zeng, Chen, et autres
Publié: (2024)
Beyond Universal Approximation Theorems: Algorithmic Uniform Approximation by Neural Networks Trained with Noisy Data
par: Kratsios, Anastasis, et autres
Publié: (2025)
par: Kratsios, Anastasis, et autres
Publié: (2025)
Sign Gradient Descent-based Neuronal Dynamics: ANN-to-SNN Conversion Beyond ReLU Network
par: Oh, Hyunseok, et autres
Publié: (2024)
par: Oh, Hyunseok, et autres
Publié: (2024)
Efficient Approximation to Analytic and $L^p$ functions by Height-Augmented ReLU Networks
par: Li, ZeYu, et autres
Publié: (2026)
par: Li, ZeYu, et autres
Publié: (2026)
Provable Unlearning with Gradient Ascent on Two-Layer ReLU Neural Networks
par: Melamed, Odelia, et autres
Publié: (2025)
par: Melamed, Odelia, et autres
Publié: (2025)
Transformers Can Solve Non-Linear and Non-Markovian Filtering Problems in Continuous Time For Conditionally Gaussian Signals
par: Horvath, Blanka, et autres
Publié: (2023)
par: Horvath, Blanka, et autres
Publié: (2023)
Deep Learning using Rectified Linear Units (ReLU)
par: Agarap, Abien Fred
Publié: (2018)
par: Agarap, Abien Fred
Publié: (2018)
Statistical Guarantees for Reasoning Probes on Looped Boolean Circuits
par: Kratsios, Anastasis, et autres
Publié: (2026)
par: Kratsios, Anastasis, et autres
Publié: (2026)
Approximating Matrix Functions with Deep Neural Networks and Transformers
par: Padmanabhan, Rahul, et autres
Publié: (2026)
par: Padmanabhan, Rahul, et autres
Publié: (2026)
Higher-Order Transformer Derivative Estimates for Explicit Pathwise Learning Guarantees
par: Limmer, Yannick, et autres
Publié: (2024)
par: Limmer, Yannick, et autres
Publié: (2024)
The Computational Complexity of Counting Linear Regions in ReLU Neural Networks
par: Stargalla, Moritz, et autres
Publié: (2025)
par: Stargalla, Moritz, et autres
Publié: (2025)
Geometry-induced Regularization in Deep ReLU Neural Networks
par: Bona-Pellissier, Joachim, et autres
Publié: (2024)
par: Bona-Pellissier, Joachim, et autres
Publié: (2024)
Quantifying The Limits of AI Reasoning: Systematic Neural Network Representations of Algorithms
par: Kratsios, Anastasis, et autres
Publié: (2025)
par: Kratsios, Anastasis, et autres
Publié: (2025)
QuAKE: Speeding up Model Inference Using Quick and Approximate Kernels for Exponential Non-Linearities
par: Narayanaswami, Sai Kiran, et autres
Publié: (2024)
par: Narayanaswami, Sai Kiran, et autres
Publié: (2024)
SO-PIFRNN: Self-optimization physics-informed Fourier-features randomized neural network for solving partial differential equations
par: Linghu, Jiale, et autres
Publié: (2025)
par: Linghu, Jiale, et autres
Publié: (2025)
Efficient Design of Compliant Mechanisms Using Multi-Objective Optimization
par: Humer, Alexander, et autres
Publié: (2025)
par: Humer, Alexander, et autres
Publié: (2025)
From LIF to QIF: Toward Differentiable Spiking Neurons for Scientific Machine Learning
par: Wan, Ruyin, et autres
Publié: (2025)
par: Wan, Ruyin, et autres
Publié: (2025)
A Wachspress-based transfinite formulation for exactly enforcing Dirichlet boundary conditions on convex polygonal domains in physics-informed neural networks
par: Sukumar, N., et autres
Publié: (2026)
par: Sukumar, N., et autres
Publié: (2026)
ReLU Neural Networks of Polynomial Size for Exact Maximum Flow Computation
par: Hertrich, Christoph, et autres
Publié: (2021)
par: Hertrich, Christoph, et autres
Publié: (2021)
Documents similaires
-
Neural Snowflakes: Universal Latent Graph Inference via Trainable Latent Geometries
par: Borde, Haitz Sáez de Ocáriz, et autres
Publié: (2023) -
Is In-Context Universality Enough? MLPs are Also Universal In-Context
par: Kratsios, Anastasis, et autres
Publié: (2025) -
Approximation Rates in Besov Norms and Sample-Complexity of Kolmogorov-Arnold Networks with Residual Connections
par: Kratsios, Anastasis, et autres
Publié: (2025) -
Bridging the Gap Between Approximation and Learning via Optimal Approximation by ReLU MLPs of Maximal Regularity
par: Hong, Ruiyang, et autres
Publié: (2024) -
Neural Spacetimes for DAG Representation Learning
par: Borde, Haitz Sáez de Ocáriz, et autres
Publié: (2024)