Why ReLU? A Bit-Model Dichotomy for Deep Network Training
Fuente:
arXiv
Guardado en:
| Autores principales: | Doron-Arad, Ilan, Mossel, Elchanan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Online Realizable Regression and Applications for ReLU Networks
por: Doron-Arad, Ilan, et al.
Publicado: (2026)
por: Doron-Arad, Ilan, et al.
Publicado: (2026)
A Theory of Online Learning with Autoregressive Chain-of-Thought Reasoning
por: Doron-Arad, Ilan, et al.
Publicado: (2026)
por: Doron-Arad, Ilan, et al.
Publicado: (2026)
On the Hardness of Training Deep Neural Networks Discretely
por: Doron-Arad, Ilan
Publicado: (2024)
por: Doron-Arad, Ilan
Publicado: (2024)
Discrete Functional Geometry of ReLU Networks via ReLU Transition Graphs
por: Dhayalkar, Sahil Rajesh
Publicado: (2025)
por: Dhayalkar, Sahil Rajesh
Publicado: (2025)
The Geometry of ReLU Networks through the ReLU Transition Graph
por: Dhayalkar, Sahil Rajesh
Publicado: (2025)
por: Dhayalkar, Sahil Rajesh
Publicado: (2025)
A Mathematical Model for Curriculum Learning for Parities
por: Cornacchia, Elisabetta, et al.
Publicado: (2023)
por: Cornacchia, Elisabetta, et al.
Publicado: (2023)
SurvReLU: Inherently Interpretable Survival Analysis via Deep ReLU Networks
por: Sun, Xiaotong, et al.
Publicado: (2024)
por: Sun, Xiaotong, et al.
Publicado: (2024)
Training a Two Layer ReLU Network Analytically
por: Barbu, Adrian
Publicado: (2023)
por: Barbu, Adrian
Publicado: (2023)
On the Local Complexity of Linear Regions in Deep ReLU Networks
por: Patel, Niket, et al.
Publicado: (2024)
por: Patel, Niket, et al.
Publicado: (2024)
Implicit Hypersurface Approximation Capacity in Deep ReLU Networks
por: Vallin, Jonatan, et al.
Publicado: (2024)
por: Vallin, Jonatan, et al.
Publicado: (2024)
N-ReLU: Zero-Mean Stochastic Extension of ReLU
por: Manik, Md Motaleb Hossen, et al.
Publicado: (2025)
por: Manik, Md Motaleb Hossen, et al.
Publicado: (2025)
The Resurrection of the ReLU
por: Horuz, Coşku Can, et al.
Publicado: (2025)
por: Horuz, Coşku Can, et al.
Publicado: (2025)
Deep Network Approximation: Beyond ReLU to Diverse Activation Functions
por: Zhang, Shijun, et al.
Publicado: (2023)
por: Zhang, Shijun, et al.
Publicado: (2023)
Why Smooth Stability Assumptions Fail for ReLU Learning
por: Katende, Ronald
Publicado: (2025)
por: Katende, Ronald
Publicado: (2025)
Benign Overfitting for Regression with Trained Two-Layer ReLU Networks
por: Park, Junhyung, et al.
Publicado: (2024)
por: Park, Junhyung, et al.
Publicado: (2024)
Convex Formulations for Training Two-Layer ReLU Neural Networks
por: Prakhya, Karthik, et al.
Publicado: (2024)
por: Prakhya, Karthik, et al.
Publicado: (2024)
Pathwise Explanation of ReLU Neural Networks
por: Lim, Seongwoo, et al.
Publicado: (2025)
por: Lim, Seongwoo, et al.
Publicado: (2025)
Online Learning of Neural Networks
por: Daniely, Amit, et al.
Publicado: (2025)
por: Daniely, Amit, et al.
Publicado: (2025)
Optimal Sets and Solution Paths of ReLU Networks
por: Mishkin, Aaron, et al.
Publicado: (2023)
por: Mishkin, Aaron, et al.
Publicado: (2023)
On Size-Independent Sample Complexity of ReLU Networks
por: Sellke, Mark
Publicado: (2023)
por: Sellke, Mark
Publicado: (2023)
Convexity in ReLU Neural Networks: beyond ICNNs?
por: Gagneux, Anne, et al.
Publicado: (2025)
por: Gagneux, Anne, et al.
Publicado: (2025)
Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks
por: Lee, Hyungu, et al.
Publicado: (2025)
por: Lee, Hyungu, et al.
Publicado: (2025)
Sobolev Approximation of Deep ReLU Networks in Log-Barron Space
por: Song, Changhoon, et al.
Publicado: (2026)
por: Song, Changhoon, et al.
Publicado: (2026)
Beyond ReLU: Chebyshev-DQN for Enhanced Deep Q-Networks
por: Yazdannik, Saman, et al.
Publicado: (2025)
por: Yazdannik, Saman, et al.
Publicado: (2025)
Some Theoretical Limitations of t-SNE
por: Li, Rupert, et al.
Publicado: (2026)
por: Li, Rupert, et al.
Publicado: (2026)
Neural Scaling Laws of Deep ReLU and Deep Operator Network: A Theoretical Study
por: Liu, Hao, et al.
Publicado: (2024)
por: Liu, Hao, et al.
Publicado: (2024)
Component-based Sketching for Deep ReLU Nets
por: Wang, Di, et al.
Publicado: (2024)
por: Wang, Di, et al.
Publicado: (2024)
Stochastic Bandits with ReLU Neural Networks
por: Xu, Kan, et al.
Publicado: (2024)
por: Xu, Kan, et al.
Publicado: (2024)
On Space Folds of ReLU Neural Networks
por: Lewandowski, Michal, et al.
Publicado: (2025)
por: Lewandowski, Michal, et al.
Publicado: (2025)
Dense ReLU Neural Networks for Temporal-spatial Model
por: Padilla, Carlos Misael Madrid, et al.
Publicado: (2024)
por: Padilla, Carlos Misael Madrid, et al.
Publicado: (2024)
ReLU-KAN: New Kolmogorov-Arnold Networks that Only Need Matrix Addition, Dot Multiplication, and ReLU
por: Qiu, Qi, et al.
Publicado: (2024)
por: Qiu, Qi, et al.
Publicado: (2024)
Unveiling the Training Dynamics of ReLU Networks through a Linear Lens
por: Ye, Longqing
Publicado: (2025)
por: Ye, Longqing
Publicado: (2025)
Topological Expressivity of ReLU Neural Networks
por: Ergen, Ekin, et al.
Publicado: (2023)
por: Ergen, Ekin, et al.
Publicado: (2023)
Three Quantization Regimes for ReLU Networks
por: Ou, Weigutian, et al.
Publicado: (2024)
por: Ou, Weigutian, et al.
Publicado: (2024)
Brownian ReLU(Br-ReLU): A New Activation Function for a Long-Short Term Memory (LSTM) Network
por: Awiakye-Marfo, George, et al.
Publicado: (2026)
por: Awiakye-Marfo, George, et al.
Publicado: (2026)
Complexity of Linear Regions in Self-supervised Deep ReLU Networks
por: Muthivhi, Mufhumudzi, et al.
Publicado: (2026)
por: Muthivhi, Mufhumudzi, et al.
Publicado: (2026)
Deep ReLU Networks Have Surprisingly Simple Polytopes
por: Fan, Feng-Lei, et al.
Publicado: (2023)
por: Fan, Feng-Lei, et al.
Publicado: (2023)
Convergence of Adam in Deep ReLU Networks via Directional Complexity and Kakeya Bounds
por: Sridhar, Anupama, et al.
Publicado: (2025)
por: Sridhar, Anupama, et al.
Publicado: (2025)
Hidden Minima in Two-Layer ReLU Networks
por: Arjevani, Yossi
Publicado: (2023)
por: Arjevani, Yossi
Publicado: (2023)
Sufficient Conditions for Stability of Minimum-Norm Interpolating Deep ReLU Networks
por: Harzli, Ouns El, et al.
Publicado: (2026)
por: Harzli, Ouns El, et al.
Publicado: (2026)
Ejemplares similares
-
Online Realizable Regression and Applications for ReLU Networks
por: Doron-Arad, Ilan, et al.
Publicado: (2026) -
A Theory of Online Learning with Autoregressive Chain-of-Thought Reasoning
por: Doron-Arad, Ilan, et al.
Publicado: (2026) -
On the Hardness of Training Deep Neural Networks Discretely
por: Doron-Arad, Ilan
Publicado: (2024) -
Discrete Functional Geometry of ReLU Networks via ReLU Transition Graphs
por: Dhayalkar, Sahil Rajesh
Publicado: (2025) -
The Geometry of ReLU Networks through the ReLU Transition Graph
por: Dhayalkar, Sahil Rajesh
Publicado: (2025)