The Domain Mixed Unit: A New Neural Arithmetic Layer
Fuente:
arXiv
Guardado en:
| Autor principal: | Curry, Paul |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
IntSeqBERT: Learning Arithmetic Structure in OEIS via Modulo-Spectrum Embeddings
por: Nakasho, Kazuhisa
Publicado: (2026)
por: Nakasho, Kazuhisa
Publicado: (2026)
A Constraint-Preserving Neural Network Approach for Solving Mean-Field Games Equilibrium
por: Liu, Jinwei, et al.
Publicado: (2025)
por: Liu, Jinwei, et al.
Publicado: (2025)
The Inhibitor: ReLU and Addition-Based Attention for Efficient Transformers under Fully Homomorphic Encryption on the Torus
por: Brännvall, Rickard, et al.
Publicado: (2023)
por: Brännvall, Rickard, et al.
Publicado: (2023)
Deep Hedging Under Non-Convexity: Limitations and a Case for AlphaZero
por: Maggiolo, Matteo, et al.
Publicado: (2025)
por: Maggiolo, Matteo, et al.
Publicado: (2025)
Stage-wise Dynamics of Classifier-Free Guidance in Diffusion Models
por: Jin, Cheng, et al.
Publicado: (2025)
por: Jin, Cheng, et al.
Publicado: (2025)
FeNeC: Enhancing Continual Learning via Feature Clustering with Neighbor- or Logit-Based Classification
por: Książek, Kamil, et al.
Publicado: (2025)
por: Książek, Kamil, et al.
Publicado: (2025)
X-Factor: Quality Is a Dataset-Intrinsic Property
por: Couch, Josiah, et al.
Publicado: (2025)
por: Couch, Josiah, et al.
Publicado: (2025)
Deep learning four decades of human migration
por: Gaskin, Thomas, et al.
Publicado: (2025)
por: Gaskin, Thomas, et al.
Publicado: (2025)
Your contrastive learning problem is secretly a distribution alignment problem
por: Chen, Zihao, et al.
Publicado: (2025)
por: Chen, Zihao, et al.
Publicado: (2025)
Drift-Resilient TabPFN: In-Context Learning Temporal Distribution Shifts on Tabular Data
por: Helli, Kai, et al.
Publicado: (2024)
por: Helli, Kai, et al.
Publicado: (2024)
Developing Explainable Machine Learning Model using Augmented Concept Activation Vector
por: Hassanpour, Reza, et al.
Publicado: (2024)
por: Hassanpour, Reza, et al.
Publicado: (2024)
Just In Time Transformers
por: Benali, Ahmed Ala Eddine, et al.
Publicado: (2024)
por: Benali, Ahmed Ala Eddine, et al.
Publicado: (2024)
Correction and Corruption: A Two-Rate View of Error Flow in LLM Protocols
por: Reitich, Fernando
Publicado: (2026)
por: Reitich, Fernando
Publicado: (2026)
From Features to Graphs: Exploring Graph Structures and Pairwise Interactions via GNNs
por: Yamchote, Phaphontee, et al.
Publicado: (2025)
por: Yamchote, Phaphontee, et al.
Publicado: (2025)
Distinguished In Uniform: Self Attention Vs. Virtual Nodes
por: Rosenbluth, Eran, et al.
Publicado: (2024)
por: Rosenbluth, Eran, et al.
Publicado: (2024)
Multi-Level Fusion Graph Neural Network for Molecule Property Prediction
por: Liu, XiaYu, et al.
Publicado: (2025)
por: Liu, XiaYu, et al.
Publicado: (2025)
Concept Prerequisite Relation Prediction by Using Permutation-Equivariant Directed Graph Neural Networks
por: Qu, Xiran, et al.
Publicado: (2023)
por: Qu, Xiran, et al.
Publicado: (2023)
Layer-Parallel Training for Transformers
por: Jiang, Shuai, et al.
Publicado: (2026)
por: Jiang, Shuai, et al.
Publicado: (2026)
Enhancing Predictive Accuracy in Tennis: Integrating Fuzzy Logic and CV-GRNN for Dynamic Match Outcome and Player Momentum Analysis
por: Li, Kechen, et al.
Publicado: (2025)
por: Li, Kechen, et al.
Publicado: (2025)
When Does Content-Based Routing Work? Representation Requirements for Selective Attention in Hybrid Sequence Models
por: Basu, Abhinaba
Publicado: (2026)
por: Basu, Abhinaba
Publicado: (2026)
An Improved Adaptive PID Optimizer with Enhanced Convergence and Stability for Deep Learning
por: Saini, Saurabh, et al.
Publicado: (2026)
por: Saini, Saurabh, et al.
Publicado: (2026)
MAcPNN: Mutual Assisted Learning on Data Streams with Temporal Dependence
por: Giannini, Federico, et al.
Publicado: (2026)
por: Giannini, Federico, et al.
Publicado: (2026)
Territory Paint Wars: Diagnosing and Mitigating Failure Modes in Competitive Multi-Agent PPO
por: Singh, Diyansha
Publicado: (2026)
por: Singh, Diyansha
Publicado: (2026)
Advances in Set Function Learning: A Survey of Techniques and Applications
por: Xie, Jiahao, et al.
Publicado: (2025)
por: Xie, Jiahao, et al.
Publicado: (2025)
Time Series Predictions in Unmonitored Sites: A Survey of Machine Learning Techniques in Water Resources
por: Willard, Jared D., et al.
Publicado: (2023)
por: Willard, Jared D., et al.
Publicado: (2023)
Neural Concept Verifier: Scaling Prover-Verifier Games via Concept Encodings
por: Turan, Berkant, et al.
Publicado: (2025)
por: Turan, Berkant, et al.
Publicado: (2025)
Repetition Makes Perfect: Recurrent Graph Neural Networks Match Message-Passing Limit
por: Rosenbluth, Eran, et al.
Publicado: (2025)
por: Rosenbluth, Eran, et al.
Publicado: (2025)
Lost in Aggregation: On a Fundamental Expressivity Limit of Message-Passing Graph Neural Networks
por: Rosenbluth, Eran
Publicado: (2026)
por: Rosenbluth, Eran
Publicado: (2026)
GLL: A Differentiable Graph Learning Layer for Neural Networks
por: Brown, Jason, et al.
Publicado: (2024)
por: Brown, Jason, et al.
Publicado: (2024)
Learning from Preferences and Mixed Demonstrations in General Settings
por: Brown, Jason R, et al.
Publicado: (2025)
por: Brown, Jason R, et al.
Publicado: (2025)
Optimizing Inference in Transformer-Based Models: A Multi-Method Benchmark
por: Ho, Siu Hang, et al.
Publicado: (2025)
por: Ho, Siu Hang, et al.
Publicado: (2025)
Backpropagation Through Time For Networks With Long-Term Dependencies
por: Bird, George, et al.
Publicado: (2021)
por: Bird, George, et al.
Publicado: (2021)
cPNN: Continuous Progressive Neural Networks for Evolving Streaming Time Series
por: Giannini, Federico, et al.
Publicado: (2026)
por: Giannini, Federico, et al.
Publicado: (2026)
Lost or Hidden? A Concept-Level Forgetting in Supervised Continual Learning
por: Filus, Katarzyna, et al.
Publicado: (2026)
por: Filus, Katarzyna, et al.
Publicado: (2026)
Explicit Dropout: Deterministic Regularization for Transformer Architectures
por: Agrawal, Vidhi, et al.
Publicado: (2026)
por: Agrawal, Vidhi, et al.
Publicado: (2026)
Massive Redundancy in Gradient Transport Enables Sparse Online Learning
por: Merin, Aur Shalev
Publicado: (2026)
por: Merin, Aur Shalev
Publicado: (2026)
RG-TTA: Regime-Guided Meta-Control for Test-Time Adaptation in Streaming Time Series
por: Kumar, Indar, et al.
Publicado: (2026)
por: Kumar, Indar, et al.
Publicado: (2026)
HGTUL: A Hypergraph-based Model For Trajectory User Linking
por: Chang, Fengjie, et al.
Publicado: (2025)
por: Chang, Fengjie, et al.
Publicado: (2025)
A Machine Learning Framework for Turbofan Health Estimation via Inverse Problem Formulation
por: Leyli-Abadi, Milad, et al.
Publicado: (2026)
por: Leyli-Abadi, Milad, et al.
Publicado: (2026)
Game-Theoretic Gradient Control for Robust Neural Network Training
por: Zaitseva, Maria, et al.
Publicado: (2025)
por: Zaitseva, Maria, et al.
Publicado: (2025)
Ejemplares similares
-
IntSeqBERT: Learning Arithmetic Structure in OEIS via Modulo-Spectrum Embeddings
por: Nakasho, Kazuhisa
Publicado: (2026) -
A Constraint-Preserving Neural Network Approach for Solving Mean-Field Games Equilibrium
por: Liu, Jinwei, et al.
Publicado: (2025) -
The Inhibitor: ReLU and Addition-Based Attention for Efficient Transformers under Fully Homomorphic Encryption on the Torus
por: Brännvall, Rickard, et al.
Publicado: (2023) -
Deep Hedging Under Non-Convexity: Limitations and a Case for AlphaZero
por: Maggiolo, Matteo, et al.
Publicado: (2025) -
Stage-wise Dynamics of Classifier-Free Guidance in Diffusion Models
por: Jin, Cheng, et al.
Publicado: (2025)