Want to train KANS at scale? Now UKAN!
Fuente:
arXiv
Salvato in:
| Autori principali: | Moradzadeh, Alireza, Veccham, Srimukh Prasad, Wawrzyniak, Lukasz, Macklin, Miles, Paliwal, Saee G. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multitask finetuning and acceleration of chemical pretrained models for small molecule drug property prediction
di: Adrian, Matthew, et al.
Pubblicazione: (2025)
di: Adrian, Matthew, et al.
Pubblicazione: (2025)
Molecule Generation with Fragment Retrieval Augmentation
di: Lee, Seul, et al.
Pubblicazione: (2024)
di: Lee, Seul, et al.
Pubblicazione: (2024)
Exploring Synthesizable Chemical Space with Iterative Pathway Refinements
di: Lee, Seul, et al.
Pubblicazione: (2025)
di: Lee, Seul, et al.
Pubblicazione: (2025)
GenMol: A Drug Discovery Generalist with Discrete Diffusion
di: Lee, Seul, et al.
Pubblicazione: (2025)
di: Lee, Seul, et al.
Pubblicazione: (2025)
DualBind: A Dual-Loss Framework for Protein-Ligand Binding Affinity Prediction
di: Liu, Meng, et al.
Pubblicazione: (2024)
di: Liu, Meng, et al.
Pubblicazione: (2024)
Applications of Modular Co-Design for De Novo 3D Molecule Generation
di: Reidenbach, Danny, et al.
Pubblicazione: (2025)
di: Reidenbach, Danny, et al.
Pubblicazione: (2025)
LinkLogic: A New Method and Benchmark for Explainable Knowledge Graph Predictions
di: Kumar-Singh, Niraj, et al.
Pubblicazione: (2024)
di: Kumar-Singh, Niraj, et al.
Pubblicazione: (2024)
KANS: Knowledge Discovery Graph Attention Network for Soft Sensing in Multivariate Industrial Processes
di: Tew, Hwa Hui, et al.
Pubblicazione: (2025)
di: Tew, Hwa Hui, et al.
Pubblicazione: (2025)
Neural Robot Dynamics
di: Xu, Jie, et al.
Pubblicazione: (2025)
di: Xu, Jie, et al.
Pubblicazione: (2025)
Physics-Informed Neural Network for Concrete Manufacturing Process Optimization
di: Varghese, Sam, et al.
Pubblicazione: (2024)
di: Varghese, Sam, et al.
Pubblicazione: (2024)
If You Want to Be Robust, Be Wary of Initialization
di: Ennadir, Sofiane, et al.
Pubblicazione: (2025)
di: Ennadir, Sofiane, et al.
Pubblicazione: (2025)
Wanting to be Understood
di: Fernando, Chrisantha, et al.
Pubblicazione: (2025)
di: Fernando, Chrisantha, et al.
Pubblicazione: (2025)
SimAvatar: Simulation-Ready Avatars with Layered Hair and Clothing
di: Li, Xueting, et al.
Pubblicazione: (2024)
di: Li, Xueting, et al.
Pubblicazione: (2024)
Ultrametric Cluster Hierarchies: I Want 'em All!
di: Draganov, Andrew, et al.
Pubblicazione: (2025)
di: Draganov, Andrew, et al.
Pubblicazione: (2025)
Data-efficient pre-training by scaling synthetic megadocs
di: Kim, Konwoo, et al.
Pubblicazione: (2026)
di: Kim, Konwoo, et al.
Pubblicazione: (2026)
PLUM: Adapting Pre-trained Language Models for Industrial-scale Generative Recommendations
di: He, Ruining, et al.
Pubblicazione: (2025)
di: He, Ruining, et al.
Pubblicazione: (2025)
Uncertainty propagation through trained multi-layer perceptrons: Exact analytical results
di: Thompson, Andrew, et al.
Pubblicazione: (2026)
di: Thompson, Andrew, et al.
Pubblicazione: (2026)
Don't Stop Me Now: Embedding Based Scheduling for LLMs
di: Shahout, Rana, et al.
Pubblicazione: (2024)
di: Shahout, Rana, et al.
Pubblicazione: (2024)
BioNeMo Framework: a modular, high-performance library for AI model development in drug discovery
di: John, Peter St., et al.
Pubblicazione: (2024)
di: John, Peter St., et al.
Pubblicazione: (2024)
annbatch unlocks terabyte-scale training of biological data in anndata
di: Gold, Ilan, et al.
Pubblicazione: (2026)
di: Gold, Ilan, et al.
Pubblicazione: (2026)
Language models scale reliably with over-training and on downstream tasks
di: Gadre, Samir Yitzhak, et al.
Pubblicazione: (2024)
di: Gadre, Samir Yitzhak, et al.
Pubblicazione: (2024)
Selective Pre-training for Private Fine-tuning
di: Yu, Da, et al.
Pubblicazione: (2023)
di: Yu, Da, et al.
Pubblicazione: (2023)
Oja's plasticity rule overcomes several challenges of training neural networks under biological constraints
di: Shervani-Tabar, Navid, et al.
Pubblicazione: (2024)
di: Shervani-Tabar, Navid, et al.
Pubblicazione: (2024)
Merge Now, Regret Later: The Hidden Cost of Model Merging is Adversarial Transferability
di: Gangwal, Ankit, et al.
Pubblicazione: (2025)
di: Gangwal, Ankit, et al.
Pubblicazione: (2025)
How to Achieve the Intended Aim of Deep Clustering Now, without Deep Learning
di: Ting, Kai Ming, et al.
Pubblicazione: (2026)
di: Ting, Kai Ming, et al.
Pubblicazione: (2026)
Near-field Beam training for Extremely Large-scale MIMO Based on Deep Learning
di: Nie, Jiali, et al.
Pubblicazione: (2024)
di: Nie, Jiali, et al.
Pubblicazione: (2024)
What should post-training optimize? A test-time scaling law perspective
di: Li, Muheng, et al.
Pubblicazione: (2026)
di: Li, Muheng, et al.
Pubblicazione: (2026)
Why Self-Supervised Encoders Want to Be Normal
di: Domb, Yuval
Pubblicazione: (2026)
di: Domb, Yuval
Pubblicazione: (2026)
Act Now: A Novel Online Forecasting Framework for Large-Scale Streaming Data
di: Liang, Daojun, et al.
Pubblicazione: (2024)
di: Liang, Daojun, et al.
Pubblicazione: (2024)
Right Now, Wrong Then: Non-Stationary Direct Preference Optimization under Preference Drift
di: Son, Seongho, et al.
Pubblicazione: (2024)
di: Son, Seongho, et al.
Pubblicazione: (2024)
Can You Hear Me Now? A Benchmark for Long-Range Graph Propagation
di: Miglior, Luca, et al.
Pubblicazione: (2025)
di: Miglior, Luca, et al.
Pubblicazione: (2025)
Position: The Time for Sampling Is Now! Charting a New Course for Bayesian Deep Learning
di: Sommer, Emanuel, et al.
Pubblicazione: (2026)
di: Sommer, Emanuel, et al.
Pubblicazione: (2026)
Come Together, But Not Right Now: A Progressive Strategy to Boost Low-Rank Adaptation
di: Zhuang, Zhan, et al.
Pubblicazione: (2025)
di: Zhuang, Zhan, et al.
Pubblicazione: (2025)
tsGT: Stochastic Time Series Modeling With Transformer
di: Kuciński, Łukasz, et al.
Pubblicazione: (2024)
di: Kuciński, Łukasz, et al.
Pubblicazione: (2024)
RapidDock: Unlocking Proteome-scale Molecular Docking
di: Powalski, Rafał, et al.
Pubblicazione: (2024)
di: Powalski, Rafał, et al.
Pubblicazione: (2024)
Convergence of variational Monte Carlo simulation and scale-invariant pre-training
di: Abrahamsen, Nilin, et al.
Pubblicazione: (2023)
di: Abrahamsen, Nilin, et al.
Pubblicazione: (2023)
Quasi Monte Carlo methods enable extremely low-dimensional deep generative models
di: Martinez, Miles, et al.
Pubblicazione: (2026)
di: Martinez, Miles, et al.
Pubblicazione: (2026)
Do traveling waves make good positional encodings?
di: van de Geijn, Chase, et al.
Pubblicazione: (2025)
di: van de Geijn, Chase, et al.
Pubblicazione: (2025)
Clifford Algebraic Rotor Embeddings : Maybe embeddings should start to CARE
di: Sriram, Sameeksha, et al.
Pubblicazione: (2025)
di: Sriram, Sameeksha, et al.
Pubblicazione: (2025)
In Search of the Successful Interpolation: On the Role of Sharpness in CLIP Generalization
di: Abdollahpoorrostam, Alireza
Pubblicazione: (2024)
di: Abdollahpoorrostam, Alireza
Pubblicazione: (2024)
Documenti analoghi
-
Multitask finetuning and acceleration of chemical pretrained models for small molecule drug property prediction
di: Adrian, Matthew, et al.
Pubblicazione: (2025) -
Molecule Generation with Fragment Retrieval Augmentation
di: Lee, Seul, et al.
Pubblicazione: (2024) -
Exploring Synthesizable Chemical Space with Iterative Pathway Refinements
di: Lee, Seul, et al.
Pubblicazione: (2025) -
GenMol: A Drug Discovery Generalist with Discrete Diffusion
di: Lee, Seul, et al.
Pubblicazione: (2025) -
DualBind: A Dual-Loss Framework for Protein-Ligand Binding Affinity Prediction
di: Liu, Meng, et al.
Pubblicazione: (2024)