Mathematical Foundations of Neural Tangents and Infinite-Width Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Mysore, Rachana, Girish, Preksha, Jayaram, Kavitha, Kumar, Shrey, Bagal, Shravan Sanjeev, Shastry, Shreya Aravind |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Persistent Topological Structures and Cohomological Flows as a Mathematical Framework for Brain-Inspired Representation Learning
di: Girish, Preksha, et al.
Pubblicazione: (2025)
di: Girish, Preksha, et al.
Pubblicazione: (2025)
Geometric-Stochastic Multimodal Deep Learning for Predictive Modeling of SUDEP and Stroke Vulnerability
di: Girish, Preksha, et al.
Pubblicazione: (2025)
di: Girish, Preksha, et al.
Pubblicazione: (2025)
DecompKAN: Decomposed Patch-KAN for Long-Term Time Series Forecasting
di: Mysore, Naveen
Pubblicazione: (2026)
di: Mysore, Naveen
Pubblicazione: (2026)
Temporal Functional Circuits: From Spline Plots to Faithful Explanations in KAN Forecasting
di: Mysore, Naveen
Pubblicazione: (2026)
di: Mysore, Naveen
Pubblicazione: (2026)
Complex-Valued Phase-Coherent Transformer
di: Hioki, Leona
Pubblicazione: (2026)
di: Hioki, Leona
Pubblicazione: (2026)
torchsom: The Reference PyTorch Library for Self-Organizing Maps
di: Berthier, Louis, et al.
Pubblicazione: (2025)
di: Berthier, Louis, et al.
Pubblicazione: (2025)
CellARC: Measuring Intelligence with Cellular Automata
di: Lžičař, Miroslav
Pubblicazione: (2025)
di: Lžičař, Miroslav
Pubblicazione: (2025)
Explicit Dropout: Deterministic Regularization for Transformer Architectures
di: Agrawal, Vidhi, et al.
Pubblicazione: (2026)
di: Agrawal, Vidhi, et al.
Pubblicazione: (2026)
Massive Redundancy in Gradient Transport Enables Sparse Online Learning
di: Merin, Aur Shalev
Pubblicazione: (2026)
di: Merin, Aur Shalev
Pubblicazione: (2026)
Optimizing Inference in Transformer-Based Models: A Multi-Method Benchmark
di: Ho, Siu Hang, et al.
Pubblicazione: (2025)
di: Ho, Siu Hang, et al.
Pubblicazione: (2025)
Is Cambodia the World's Largest Cashew Producer?
di: Chaya, Veasna, et al.
Pubblicazione: (2024)
di: Chaya, Veasna, et al.
Pubblicazione: (2024)
CVCM Track Circuits Pre-emptive Failure Diagnostics for Predictive Maintenance Using Deep Neural Networks
di: Mukherjee, Debdeep, et al.
Pubblicazione: (2025)
di: Mukherjee, Debdeep, et al.
Pubblicazione: (2025)
H-Model: Dynamic Neural Architectures for Adaptive Processing
di: Hospodarchuk, Dmytro
Pubblicazione: (2025)
di: Hospodarchuk, Dmytro
Pubblicazione: (2025)
Neural Encoding for Image Recall: Human-Like Memory
di: Foussereau, Virgile, et al.
Pubblicazione: (2024)
di: Foussereau, Virgile, et al.
Pubblicazione: (2024)
EchoLSTM: A Self-Reflective Recurrent Network for Stabilizing Long-Range Memory
di: K, Prasanth K, et al.
Pubblicazione: (2025)
di: K, Prasanth K, et al.
Pubblicazione: (2025)
Adaptive Negative Scheduling for Graph Contrastive Learning
di: Ali, Adnan, et al.
Pubblicazione: (2026)
di: Ali, Adnan, et al.
Pubblicazione: (2026)
The Impact of Data Characteristics on GNN Evaluation for Detecting Fake News
di: Karn, Isha, et al.
Pubblicazione: (2025)
di: Karn, Isha, et al.
Pubblicazione: (2025)
The Normalized Difference Layer: A Differentiable Spectral Index Formulation for Deep Learning
di: Lotfi, Ali, et al.
Pubblicazione: (2026)
di: Lotfi, Ali, et al.
Pubblicazione: (2026)
Predicting Traffic Accident Severity with Deep Neural Networks
di: Bibb, Meghan, et al.
Pubblicazione: (2025)
di: Bibb, Meghan, et al.
Pubblicazione: (2025)
TGraphX: Tensor-Aware Graph Neural Network for Multi-Dimensional Feature Learning
di: Sajjadi, Arash, et al.
Pubblicazione: (2025)
di: Sajjadi, Arash, et al.
Pubblicazione: (2025)
Contract-Driven QoE Auditing for Speech and Singing Services: From MOS Regression to Service Graphs
di: Du, Wenzhang
Pubblicazione: (2025)
di: Du, Wenzhang
Pubblicazione: (2025)
multivariateGPT: a decoder-only transformer for multivariate categorical and numeric data
di: Loza, Andrew J., et al.
Pubblicazione: (2025)
di: Loza, Andrew J., et al.
Pubblicazione: (2025)
VDW-GNNs: Vector diffusion wavelets for geometric graph neural networks
di: Johnson, David R., et al.
Pubblicazione: (2025)
di: Johnson, David R., et al.
Pubblicazione: (2025)
Scaling Laws in the Tiny Regime: How Small Models Change Their Mistakes
di: Alnemari, Mohammed, et al.
Pubblicazione: (2026)
di: Alnemari, Mohammed, et al.
Pubblicazione: (2026)
Revisiting Non-separable Binary Classification and its Applications in Anomaly Detection
di: Lau, Matthew, et al.
Pubblicazione: (2023)
di: Lau, Matthew, et al.
Pubblicazione: (2023)
Tricks and Plug-ins for Gradient Boosting with Transformers
di: Fang, Biyi, et al.
Pubblicazione: (2025)
di: Fang, Biyi, et al.
Pubblicazione: (2025)
Reproducibility and Geometric Intrinsic Dimensionality: An Investigation on Graph Neural Network Research
di: Hille, Tobias, et al.
Pubblicazione: (2024)
di: Hille, Tobias, et al.
Pubblicazione: (2024)
Predictive Modeling of Maritime Radar Data Using Transformer Architecture
di: Qesaraku, Bjorna, et al.
Pubblicazione: (2025)
di: Qesaraku, Bjorna, et al.
Pubblicazione: (2025)
Prediction-space knowledge markets for communication-efficient federated learning on multimedia tasks
di: Du, Wenzhang
Pubblicazione: (2025)
di: Du, Wenzhang
Pubblicazione: (2025)
Functional Similarity Metric for Neural Networks: Overcoming Parametric Ambiguity via Activation Region Analysis
di: Hennadii, Kutomanov
Pubblicazione: (2026)
di: Hennadii, Kutomanov
Pubblicazione: (2026)
Optimized Gradient Clipping for Noisy Label Learning
di: Ye, Xichen, et al.
Pubblicazione: (2024)
di: Ye, Xichen, et al.
Pubblicazione: (2024)
Scalable, Technology-Agnostic Diagnosis and Predictive Maintenance for Point Machine using Deep Learning
di: Di Santi, Eduardo, et al.
Pubblicazione: (2025)
di: Di Santi, Eduardo, et al.
Pubblicazione: (2025)
Efficient Morphology-Control Co-Design via Stackelberg Proximal Policy Optimization
di: Dai, Yanning, et al.
Pubblicazione: (2026)
di: Dai, Yanning, et al.
Pubblicazione: (2026)
An in-depth look at approximation via deep and narrow neural networks
di: Dommel, Joris, et al.
Pubblicazione: (2025)
di: Dommel, Joris, et al.
Pubblicazione: (2025)
Rethinking Visual Intelligence: Insights from Video Pretraining
di: Acuaviva, Pablo, et al.
Pubblicazione: (2025)
di: Acuaviva, Pablo, et al.
Pubblicazione: (2025)
Leaf Spectral Reflectance Prediction Using Multi-Head Attention Neural Networks
di: Farajpoor, Parastoo, et al.
Pubblicazione: (2026)
di: Farajpoor, Parastoo, et al.
Pubblicazione: (2026)
Thinking Machines: Mathematical Reasoning in the Age of LLMs
di: Asperti, Andrea, et al.
Pubblicazione: (2025)
di: Asperti, Andrea, et al.
Pubblicazione: (2025)
Loss shaping enhances exact gradient learning with Eventprop in spiking neural networks
di: Nowotny, Thomas, et al.
Pubblicazione: (2022)
di: Nowotny, Thomas, et al.
Pubblicazione: (2022)
Pulse-Driven Neural Architecture: Learnable Oscillatory Dynamics for Robust Continuous-Time Sequence Processing
di: Sharma, Paras
Pubblicazione: (2026)
di: Sharma, Paras
Pubblicazione: (2026)
The Inhibitor: ReLU and Addition-Based Attention for Efficient Transformers under Fully Homomorphic Encryption on the Torus
di: Brännvall, Rickard, et al.
Pubblicazione: (2023)
di: Brännvall, Rickard, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Persistent Topological Structures and Cohomological Flows as a Mathematical Framework for Brain-Inspired Representation Learning
di: Girish, Preksha, et al.
Pubblicazione: (2025) -
Geometric-Stochastic Multimodal Deep Learning for Predictive Modeling of SUDEP and Stroke Vulnerability
di: Girish, Preksha, et al.
Pubblicazione: (2025) -
DecompKAN: Decomposed Patch-KAN for Long-Term Time Series Forecasting
di: Mysore, Naveen
Pubblicazione: (2026) -
Temporal Functional Circuits: From Spline Plots to Faithful Explanations in KAN Forecasting
di: Mysore, Naveen
Pubblicazione: (2026) -
Complex-Valued Phase-Coherent Transformer
di: Hioki, Leona
Pubblicazione: (2026)