The Domain Mixed Unit: A New Neural Arithmetic Layer
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Curry, Paul |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IntSeqBERT: Learning Arithmetic Structure in OEIS via Modulo-Spectrum Embeddings
par: Nakasho, Kazuhisa
Publié: (2026)
par: Nakasho, Kazuhisa
Publié: (2026)
A Constraint-Preserving Neural Network Approach for Solving Mean-Field Games Equilibrium
par: Liu, Jinwei, et autres
Publié: (2025)
par: Liu, Jinwei, et autres
Publié: (2025)
The Inhibitor: ReLU and Addition-Based Attention for Efficient Transformers under Fully Homomorphic Encryption on the Torus
par: Brännvall, Rickard, et autres
Publié: (2023)
par: Brännvall, Rickard, et autres
Publié: (2023)
Deep Hedging Under Non-Convexity: Limitations and a Case for AlphaZero
par: Maggiolo, Matteo, et autres
Publié: (2025)
par: Maggiolo, Matteo, et autres
Publié: (2025)
Stage-wise Dynamics of Classifier-Free Guidance in Diffusion Models
par: Jin, Cheng, et autres
Publié: (2025)
par: Jin, Cheng, et autres
Publié: (2025)
FeNeC: Enhancing Continual Learning via Feature Clustering with Neighbor- or Logit-Based Classification
par: Książek, Kamil, et autres
Publié: (2025)
par: Książek, Kamil, et autres
Publié: (2025)
X-Factor: Quality Is a Dataset-Intrinsic Property
par: Couch, Josiah, et autres
Publié: (2025)
par: Couch, Josiah, et autres
Publié: (2025)
Deep learning four decades of human migration
par: Gaskin, Thomas, et autres
Publié: (2025)
par: Gaskin, Thomas, et autres
Publié: (2025)
Your contrastive learning problem is secretly a distribution alignment problem
par: Chen, Zihao, et autres
Publié: (2025)
par: Chen, Zihao, et autres
Publié: (2025)
Drift-Resilient TabPFN: In-Context Learning Temporal Distribution Shifts on Tabular Data
par: Helli, Kai, et autres
Publié: (2024)
par: Helli, Kai, et autres
Publié: (2024)
Developing Explainable Machine Learning Model using Augmented Concept Activation Vector
par: Hassanpour, Reza, et autres
Publié: (2024)
par: Hassanpour, Reza, et autres
Publié: (2024)
Just In Time Transformers
par: Benali, Ahmed Ala Eddine, et autres
Publié: (2024)
par: Benali, Ahmed Ala Eddine, et autres
Publié: (2024)
Correction and Corruption: A Two-Rate View of Error Flow in LLM Protocols
par: Reitich, Fernando
Publié: (2026)
par: Reitich, Fernando
Publié: (2026)
From Features to Graphs: Exploring Graph Structures and Pairwise Interactions via GNNs
par: Yamchote, Phaphontee, et autres
Publié: (2025)
par: Yamchote, Phaphontee, et autres
Publié: (2025)
Distinguished In Uniform: Self Attention Vs. Virtual Nodes
par: Rosenbluth, Eran, et autres
Publié: (2024)
par: Rosenbluth, Eran, et autres
Publié: (2024)
Multi-Level Fusion Graph Neural Network for Molecule Property Prediction
par: Liu, XiaYu, et autres
Publié: (2025)
par: Liu, XiaYu, et autres
Publié: (2025)
Concept Prerequisite Relation Prediction by Using Permutation-Equivariant Directed Graph Neural Networks
par: Qu, Xiran, et autres
Publié: (2023)
par: Qu, Xiran, et autres
Publié: (2023)
Layer-Parallel Training for Transformers
par: Jiang, Shuai, et autres
Publié: (2026)
par: Jiang, Shuai, et autres
Publié: (2026)
Enhancing Predictive Accuracy in Tennis: Integrating Fuzzy Logic and CV-GRNN for Dynamic Match Outcome and Player Momentum Analysis
par: Li, Kechen, et autres
Publié: (2025)
par: Li, Kechen, et autres
Publié: (2025)
When Does Content-Based Routing Work? Representation Requirements for Selective Attention in Hybrid Sequence Models
par: Basu, Abhinaba
Publié: (2026)
par: Basu, Abhinaba
Publié: (2026)
An Improved Adaptive PID Optimizer with Enhanced Convergence and Stability for Deep Learning
par: Saini, Saurabh, et autres
Publié: (2026)
par: Saini, Saurabh, et autres
Publié: (2026)
MAcPNN: Mutual Assisted Learning on Data Streams with Temporal Dependence
par: Giannini, Federico, et autres
Publié: (2026)
par: Giannini, Federico, et autres
Publié: (2026)
Territory Paint Wars: Diagnosing and Mitigating Failure Modes in Competitive Multi-Agent PPO
par: Singh, Diyansha
Publié: (2026)
par: Singh, Diyansha
Publié: (2026)
Advances in Set Function Learning: A Survey of Techniques and Applications
par: Xie, Jiahao, et autres
Publié: (2025)
par: Xie, Jiahao, et autres
Publié: (2025)
Time Series Predictions in Unmonitored Sites: A Survey of Machine Learning Techniques in Water Resources
par: Willard, Jared D., et autres
Publié: (2023)
par: Willard, Jared D., et autres
Publié: (2023)
Neural Concept Verifier: Scaling Prover-Verifier Games via Concept Encodings
par: Turan, Berkant, et autres
Publié: (2025)
par: Turan, Berkant, et autres
Publié: (2025)
Repetition Makes Perfect: Recurrent Graph Neural Networks Match Message-Passing Limit
par: Rosenbluth, Eran, et autres
Publié: (2025)
par: Rosenbluth, Eran, et autres
Publié: (2025)
Lost in Aggregation: On a Fundamental Expressivity Limit of Message-Passing Graph Neural Networks
par: Rosenbluth, Eran
Publié: (2026)
par: Rosenbluth, Eran
Publié: (2026)
GLL: A Differentiable Graph Learning Layer for Neural Networks
par: Brown, Jason, et autres
Publié: (2024)
par: Brown, Jason, et autres
Publié: (2024)
Learning from Preferences and Mixed Demonstrations in General Settings
par: Brown, Jason R, et autres
Publié: (2025)
par: Brown, Jason R, et autres
Publié: (2025)
Optimizing Inference in Transformer-Based Models: A Multi-Method Benchmark
par: Ho, Siu Hang, et autres
Publié: (2025)
par: Ho, Siu Hang, et autres
Publié: (2025)
Backpropagation Through Time For Networks With Long-Term Dependencies
par: Bird, George, et autres
Publié: (2021)
par: Bird, George, et autres
Publié: (2021)
cPNN: Continuous Progressive Neural Networks for Evolving Streaming Time Series
par: Giannini, Federico, et autres
Publié: (2026)
par: Giannini, Federico, et autres
Publié: (2026)
Lost or Hidden? A Concept-Level Forgetting in Supervised Continual Learning
par: Filus, Katarzyna, et autres
Publié: (2026)
par: Filus, Katarzyna, et autres
Publié: (2026)
Explicit Dropout: Deterministic Regularization for Transformer Architectures
par: Agrawal, Vidhi, et autres
Publié: (2026)
par: Agrawal, Vidhi, et autres
Publié: (2026)
Massive Redundancy in Gradient Transport Enables Sparse Online Learning
par: Merin, Aur Shalev
Publié: (2026)
par: Merin, Aur Shalev
Publié: (2026)
RG-TTA: Regime-Guided Meta-Control for Test-Time Adaptation in Streaming Time Series
par: Kumar, Indar, et autres
Publié: (2026)
par: Kumar, Indar, et autres
Publié: (2026)
HGTUL: A Hypergraph-based Model For Trajectory User Linking
par: Chang, Fengjie, et autres
Publié: (2025)
par: Chang, Fengjie, et autres
Publié: (2025)
A Machine Learning Framework for Turbofan Health Estimation via Inverse Problem Formulation
par: Leyli-Abadi, Milad, et autres
Publié: (2026)
par: Leyli-Abadi, Milad, et autres
Publié: (2026)
Game-Theoretic Gradient Control for Robust Neural Network Training
par: Zaitseva, Maria, et autres
Publié: (2025)
par: Zaitseva, Maria, et autres
Publié: (2025)
Documents similaires
-
IntSeqBERT: Learning Arithmetic Structure in OEIS via Modulo-Spectrum Embeddings
par: Nakasho, Kazuhisa
Publié: (2026) -
A Constraint-Preserving Neural Network Approach for Solving Mean-Field Games Equilibrium
par: Liu, Jinwei, et autres
Publié: (2025) -
The Inhibitor: ReLU and Addition-Based Attention for Efficient Transformers under Fully Homomorphic Encryption on the Torus
par: Brännvall, Rickard, et autres
Publié: (2023) -
Deep Hedging Under Non-Convexity: Limitations and a Case for AlphaZero
par: Maggiolo, Matteo, et autres
Publié: (2025) -
Stage-wise Dynamics of Classifier-Free Guidance in Diffusion Models
par: Jin, Cheng, et autres
Publié: (2025)