Data-induced multiscale losses and efficient multirate gradient descent schemes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Juncai, Liu, Liangchen, Tsai, Yen-Hsi Richard |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DeepInverse: A Python package for solving imaging inverse problems with deep learning
par: Tachella, Julián, et autres
Publié: (2025)
par: Tachella, Julián, et autres
Publié: (2025)
WAKESET: A Large-Scale, High-Reynolds Number Flow Dataset for Machine Learning of Turbulent Wake Dynamics
par: Cooper-Baldock, Zachary, et autres
Publié: (2026)
par: Cooper-Baldock, Zachary, et autres
Publié: (2026)
On the Convergence Behavior of Preconditioned Gradient Descent Toward the Rich Learning Regime
par: Jiang, Shuai, et autres
Publié: (2026)
par: Jiang, Shuai, et autres
Publié: (2026)
When can a neural operator replace a coarse solve? Architectural principles for two-level preconditioning
par: Melchers, Hugo, et autres
Publié: (2026)
par: Melchers, Hugo, et autres
Publié: (2026)
The Polar Express: Optimal Matrix Sign Methods and Their Application to the Muon Algorithm
par: Amsel, Noah, et autres
Publié: (2025)
par: Amsel, Noah, et autres
Publié: (2025)
Tensor-Train Operator Inference
par: Danis, Engin, et autres
Publié: (2025)
par: Danis, Engin, et autres
Publié: (2025)
Polyharmonic Cascade
par: Bakhvalov, Yuriy N.
Publié: (2025)
par: Bakhvalov, Yuriy N.
Publié: (2025)
Non-convergence to the optimal risk for Adam and stochastic gradient descent optimization in the training of deep neural networks
par: Do, Thang, et autres
Publié: (2025)
par: Do, Thang, et autres
Publié: (2025)
Learning Hamiltonian flows from numerical integrators and examples
par: Fang, Rui, et autres
Publié: (2025)
par: Fang, Rui, et autres
Publié: (2025)
Numerical Solution of Mixed-Dimensional PDEs Using a Neural Preconditioner
par: Dimola, Nunzio, et autres
Publié: (2025)
par: Dimola, Nunzio, et autres
Publié: (2025)
Sparse Training of Neural Networks based on Multilevel Mirror Descent
par: Lunk, Yannick, et autres
Publié: (2026)
par: Lunk, Yannick, et autres
Publié: (2026)
Learning a generalized multiscale prolongation operator
par: Liu, Yucheng, et autres
Publié: (2024)
par: Liu, Yucheng, et autres
Publié: (2024)
RANDSMAPs: Random-Feature/multi-Scale Neural Decoders with Mass Preservation
par: Patsatzis, Dimitrios G., et autres
Publié: (2026)
par: Patsatzis, Dimitrios G., et autres
Publié: (2026)
Kourkoutas-Beta: A Sunspike-Driven Adam Optimizer with Desert Flair
par: Kassinos, Stavros C.
Publié: (2025)
par: Kassinos, Stavros C.
Publié: (2025)
NeurOptimisation: The Spiking Way to Evolve
par: Cruz-Duarte, Jorge Mario, et autres
Publié: (2025)
par: Cruz-Duarte, Jorge Mario, et autres
Publié: (2025)
Alternately-optimized SNN method for acoustic scattering problem in unbounded domain
par: Song, Haoming, et autres
Publié: (2025)
par: Song, Haoming, et autres
Publié: (2025)
Active Learning for Conditional Generative Compressed Sensing
par: DeLise, Alexander, et autres
Publié: (2026)
par: DeLise, Alexander, et autres
Publié: (2026)
Physics-Informed Learning of Microvascular Flow Models using Graph Neural Networks
par: Botta, Paolo, et autres
Publié: (2025)
par: Botta, Paolo, et autres
Publié: (2025)
The Age of Sensorial Zero Trust: Why We Can No Longer Trust Our Senses
par: Xavier, Fabio Correa
Publié: (2025)
par: Xavier, Fabio Correa
Publié: (2025)
Sparsifying dimensionality reduction of PDE solution data with Bregman learning
par: Heeringa, Tjeerd Jan, et autres
Publié: (2024)
par: Heeringa, Tjeerd Jan, et autres
Publié: (2024)
$δ$-STEAL: LLM Stealing Attack with Local Differential Privacy
par: Dang, Kieu, et autres
Publié: (2025)
par: Dang, Kieu, et autres
Publié: (2025)
Adaptive Kernel Methods
par: Dózsa, Tamás, et autres
Publié: (2026)
par: Dózsa, Tamás, et autres
Publié: (2026)
Representing LLMs in Prompt Semantic Task Space
par: Kashani, Idan, et autres
Publié: (2025)
par: Kashani, Idan, et autres
Publié: (2025)
Deep Neural Networks with General Activations: Super-Convergence in Sobolev Norms
par: Yang, Yahong, et autres
Publié: (2025)
par: Yang, Yahong, et autres
Publié: (2025)
Structured Multidimensional Representation Learning for Large Language Models
par: Ichi, Alaa El, et autres
Publié: (2026)
par: Ichi, Alaa El, et autres
Publié: (2026)
i-DEQ: A stable inertial deep equilibrium model for image restoration
par: Clerc, Antonin, et autres
Publié: (2026)
par: Clerc, Antonin, et autres
Publié: (2026)
Deep Legendre Transform
par: Minabutdinov, Aleksey, et autres
Publié: (2025)
par: Minabutdinov, Aleksey, et autres
Publié: (2025)
Layer-Parallel Training for Transformers
par: Jiang, Shuai, et autres
Publié: (2026)
par: Jiang, Shuai, et autres
Publié: (2026)
Optimal Linear Baseline Models for Scientific Machine Learning
par: DeLise, Alexander, et autres
Publié: (2025)
par: DeLise, Alexander, et autres
Publié: (2025)
Sketched and Truncated Polynomial Krylov Subspace Methods: Matrix Sylvester Equations
par: Palitta, Davide, et autres
Publié: (2023)
par: Palitta, Davide, et autres
Publié: (2023)
Multirate Stein Variational Gradient Descent for Efficient Bayesian Sampling
par: Sarshar, Arash
Publié: (2026)
par: Sarshar, Arash
Publié: (2026)
DrivAer Transformer: A high-precision and fast prediction method for vehicle aerodynamic drag coefficient based on the DrivAerNet++ dataset
par: He, Jiaqi, et autres
Publié: (2025)
par: He, Jiaqi, et autres
Publié: (2025)
G-Sim: Generative Simulations with Large Language Models and Gradient-Free Calibration
par: Holt, Samuel, et autres
Publié: (2025)
par: Holt, Samuel, et autres
Publié: (2025)
Local properties of neural networks through the lens of layer-wise Hessians
par: Bolshim, Maxim, et autres
Publié: (2025)
par: Bolshim, Maxim, et autres
Publié: (2025)
ZetA: A Riemann Zeta-Scaled Extension of Adam for Deep Learning
par: BC, Samiksha
Publié: (2025)
par: BC, Samiksha
Publié: (2025)
Inter-Layer Hessian Analysis of Neural Networks with DAG Architectures
par: Bolshim, Maxim, et autres
Publié: (2026)
par: Bolshim, Maxim, et autres
Publié: (2026)
Stochastic Estimation of the Layer-wise Hessian Trace for Monitoring Neural-network Training
par: Bolshim, Maxim, et autres
Publié: (2026)
par: Bolshim, Maxim, et autres
Publié: (2026)
Neural Preconditioning via Krylov Subspace Geometry
par: Dimola, Nunzio, et autres
Publié: (2025)
par: Dimola, Nunzio, et autres
Publié: (2025)
Total Generalized Variation regularization closes the gap between neural-eld and classical methods in seismic travel-time tomography
par: Kurosawa, Isao
Publié: (2026)
par: Kurosawa, Isao
Publié: (2026)
Regime-Aware Time Weighting for Physics-Informed Neural Networks
par: Turinici, Gabriel
Publié: (2024)
par: Turinici, Gabriel
Publié: (2024)
Documents similaires
-
DeepInverse: A Python package for solving imaging inverse problems with deep learning
par: Tachella, Julián, et autres
Publié: (2025) -
WAKESET: A Large-Scale, High-Reynolds Number Flow Dataset for Machine Learning of Turbulent Wake Dynamics
par: Cooper-Baldock, Zachary, et autres
Publié: (2026) -
On the Convergence Behavior of Preconditioned Gradient Descent Toward the Rich Learning Regime
par: Jiang, Shuai, et autres
Publié: (2026) -
When can a neural operator replace a coarse solve? Architectural principles for two-level preconditioning
par: Melchers, Hugo, et autres
Publié: (2026) -
The Polar Express: Optimal Matrix Sign Methods and Their Application to the Muon Algorithm
par: Amsel, Noah, et autres
Publié: (2025)