IFNSO: Iteration-Free Newton-Schulz Orthogonalization
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Chen, Zhao, Qianxi, Yuan, Xiaochen, Zhang, Hong, Yuan, Ding, Wu, Yanbin, Li, Xiying |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A second-order method landing on the Stiefel manifold via Newton$\unicode{x2013}$Schulz iteration
di: Xiong, Xinhui, et al.
Pubblicazione: (2026)
di: Xiong, Xinhui, et al.
Pubblicazione: (2026)
Advancing the Understanding of Fixed Point Iterations in Deep Neural Networks: A Detailed Analytical Study
di: Ke, Yekun, et al.
Pubblicazione: (2024)
di: Ke, Yekun, et al.
Pubblicazione: (2024)
Learning to Discover Iterative Spectral Algorithms
di: Liu, Zihang, et al.
Pubblicazione: (2026)
di: Liu, Zihang, et al.
Pubblicazione: (2026)
Better Neural PDE Solvers Through Data-Free Mesh Movers
di: Hu, Peiyan, et al.
Pubblicazione: (2023)
di: Hu, Peiyan, et al.
Pubblicazione: (2023)
Low-Rank Compression of Pretrained Models via Randomized Subspace Iteration
di: Pourkamali-Anaraki, Farhad
Pubblicazione: (2026)
di: Pourkamali-Anaraki, Farhad
Pubblicazione: (2026)
Autoregression-Free Neural Operators for Time-Dependent PDEs
di: Zhang, Jiaquan, et al.
Pubblicazione: (2026)
di: Zhang, Jiaquan, et al.
Pubblicazione: (2026)
DeepContour: A Hybrid Deep Learning Framework for Accelerating Generalized Eigenvalue Problem Solving via Efficient Contour Design
di: Chen, Yeqiu, et al.
Pubblicazione: (2025)
di: Chen, Yeqiu, et al.
Pubblicazione: (2025)
Accelerating Data Generation for Neural Operators via Krylov Subspace Recycling
di: Wang, Hong, et al.
Pubblicazione: (2024)
di: Wang, Hong, et al.
Pubblicazione: (2024)
Core-Halo Decomposition: Decentralizing Large-Scale Fixed-Point Problems
di: Haixiang, et al.
Pubblicazione: (2026)
di: Haixiang, et al.
Pubblicazione: (2026)
Transformers Can Implement Preconditioned Richardson Iteration for In-Context Gaussian Kernel Regression
di: Yan, Mingsong, et al.
Pubblicazione: (2026)
di: Yan, Mingsong, et al.
Pubblicazione: (2026)
Critical Sampling for Robust Evolution Operator Learning of Unknown Dynamical Systems
di: Zhang, Ce, et al.
Pubblicazione: (2023)
di: Zhang, Ce, et al.
Pubblicazione: (2023)
ELM-DeepONets: Backpropagation-Free Training of Deep Operator Networks via Extreme Learning Machines
di: Son, Hwijae
Pubblicazione: (2025)
di: Son, Hwijae
Pubblicazione: (2025)
STNet: Spectral Transformation Network for Solving Operator Eigenvalue Problem
di: Wang, Hong, et al.
Pubblicazione: (2025)
di: Wang, Hong, et al.
Pubblicazione: (2025)
Accelerating Eigenvalue Dataset Generation via Chebyshev Subspace Filter
di: Wang, Hong, et al.
Pubblicazione: (2025)
di: Wang, Hong, et al.
Pubblicazione: (2025)
Deep Learning-Enhanced Preconditioning for Efficient Conjugate Gradient Solvers in Large-Scale PDE Systems
di: Li, Rui, et al.
Pubblicazione: (2024)
di: Li, Rui, et al.
Pubblicazione: (2024)
SPIKE: Stable Physics-Informed Kernel Evolution Method for Solving Hyperbolic Conservation Laws
di: Su, Hua, et al.
Pubblicazione: (2025)
di: Su, Hua, et al.
Pubblicazione: (2025)
AlgoFormer: An Efficient Transformer Framework with Algorithmic Structures
di: Gao, Yihang, et al.
Pubblicazione: (2024)
di: Gao, Yihang, et al.
Pubblicazione: (2024)
Characteristic Learning for Provable One Step Generation
di: Ding, Zhao, et al.
Pubblicazione: (2024)
di: Ding, Zhao, et al.
Pubblicazione: (2024)
Unveiling the Power of Multiple Gossip Steps: A Stability-Based Generalization Analysis in Decentralized Training
di: Li, Qinglun, et al.
Pubblicazione: (2025)
di: Li, Qinglun, et al.
Pubblicazione: (2025)
ProFlow: Zero-Shot Physics-Consistent Sampling via Proximal Flow Guidance
di: Yu, Zichao, et al.
Pubblicazione: (2026)
di: Yu, Zichao, et al.
Pubblicazione: (2026)
Solving PDEs With Deep Neural Nets under General Boundary Conditions
di: Zhang, Chenggong
Pubblicazione: (2025)
di: Zhang, Chenggong
Pubblicazione: (2025)
Unisolver: PDE-Conditional Transformers Towards Universal Neural PDE Solvers
di: Zhou, Hang, et al.
Pubblicazione: (2024)
di: Zhou, Hang, et al.
Pubblicazione: (2024)
V-ABFT: Variance-Based Adaptive Threshold for Fault-Tolerant Matrix Multiplication in Mixed-Precision Deep Learning
di: Gao, Yiheng, et al.
Pubblicazione: (2026)
di: Gao, Yiheng, et al.
Pubblicazione: (2026)
Branching Strategies Based on Subgraph GNNs: A Study on Theoretical Promise versus Practical Reality
di: Zhou, Junru, et al.
Pubblicazione: (2025)
di: Zhou, Junru, et al.
Pubblicazione: (2025)
Mitigating spectral bias for the multiscale operator learning
di: Liu, Xinliang, et al.
Pubblicazione: (2022)
di: Liu, Xinliang, et al.
Pubblicazione: (2022)
A Mathematical Explanation of Transformers
di: Tai, Xue-Cheng, et al.
Pubblicazione: (2025)
di: Tai, Xue-Cheng, et al.
Pubblicazione: (2025)
FlashSinkhorn: IO-Aware Entropic Optimal Transport on GPU
di: Ye, Felix X. -F., et al.
Pubblicazione: (2026)
di: Ye, Felix X. -F., et al.
Pubblicazione: (2026)
Neural Control Variates with Automatic Integration
di: Li, Zilu, et al.
Pubblicazione: (2024)
di: Li, Zilu, et al.
Pubblicazione: (2024)
P$^2$C$^2$Net: PDE-Preserved Coarse Correction Network for efficient prediction of spatiotemporal dynamics
di: Wang, Qi, et al.
Pubblicazione: (2024)
di: Wang, Qi, et al.
Pubblicazione: (2024)
Online Pseudo-average Shifting Attention(PASA) for Robust Low-precision LLM Inference: Algorithms and Numerical Analysis
di: Cheng, Long, et al.
Pubblicazione: (2025)
di: Cheng, Long, et al.
Pubblicazione: (2025)
Data-Driven Prediction of Dynamic Interactions Between Robot Appendage and Granular Material
di: Wang, Guanjin, et al.
Pubblicazione: (2025)
di: Wang, Guanjin, et al.
Pubblicazione: (2025)
A Practical Approach to Causal Inference over Time
di: Cinquini, Martina, et al.
Pubblicazione: (2024)
di: Cinquini, Martina, et al.
Pubblicazione: (2024)
A Mathematical Guide to Operator Learning
di: Boullé, Nicolas, et al.
Pubblicazione: (2023)
di: Boullé, Nicolas, et al.
Pubblicazione: (2023)
Truncated Matrix Completion - An Empirical Study
di: Naik, Rishhabh, et al.
Pubblicazione: (2025)
di: Naik, Rishhabh, et al.
Pubblicazione: (2025)
BWLer: Barycentric Weight Layer Elucidates a Precision-Conditioning Tradeoff for PINNs
di: Liu, Jerry, et al.
Pubblicazione: (2025)
di: Liu, Jerry, et al.
Pubblicazione: (2025)
Random weights of DNNs and emergence of fixed points
di: Berlyand, L., et al.
Pubblicazione: (2025)
di: Berlyand, L., et al.
Pubblicazione: (2025)
Deriving Transformer Architectures as Implicit Multinomial Regression
di: Actor, Jonas A., et al.
Pubblicazione: (2025)
di: Actor, Jonas A., et al.
Pubblicazione: (2025)
Sparse $L^1$-Autoencoders for Scientific Data Compression
di: Chung, Matthias, et al.
Pubblicazione: (2024)
di: Chung, Matthias, et al.
Pubblicazione: (2024)
Graph Neural Networks for Emulation of Finite-Element Ice Dynamics in Greenland and Antarctic Ice Sheets
di: Koo, Younghyun, et al.
Pubblicazione: (2024)
di: Koo, Younghyun, et al.
Pubblicazione: (2024)
Neural Operators with Localized Integral and Differential Kernels
di: Liu-Schiaffini, Miguel, et al.
Pubblicazione: (2024)
di: Liu-Schiaffini, Miguel, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A second-order method landing on the Stiefel manifold via Newton$\unicode{x2013}$Schulz iteration
di: Xiong, Xinhui, et al.
Pubblicazione: (2026) -
Advancing the Understanding of Fixed Point Iterations in Deep Neural Networks: A Detailed Analytical Study
di: Ke, Yekun, et al.
Pubblicazione: (2024) -
Learning to Discover Iterative Spectral Algorithms
di: Liu, Zihang, et al.
Pubblicazione: (2026) -
Better Neural PDE Solvers Through Data-Free Mesh Movers
di: Hu, Peiyan, et al.
Pubblicazione: (2023) -
Low-Rank Compression of Pretrained Models via Randomized Subspace Iteration
di: Pourkamali-Anaraki, Farhad
Pubblicazione: (2026)