A Riemannian Optimization Perspective of the Gauss-Newton Method for Feedforward Neural Networks
Fuente:
arXiv
Salvato in:
| Autore principale: | Cayci, Semih |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Non-Asymptotic Optimization and Generalization Bounds for Stochastic Gauss-Newton in Overparameterized Models
di: Cayci, Semih
Pubblicazione: (2025)
di: Cayci, Semih
Pubblicazione: (2025)
Finite-Time Analysis of Gradient Descent for Shallow Transformers
di: Arda, Enes, et al.
Pubblicazione: (2026)
di: Arda, Enes, et al.
Pubblicazione: (2026)
Convergence of Gradient Descent for Recurrent Neural Networks: A Nonasymptotic Analysis
di: Cayci, Semih, et al.
Pubblicazione: (2024)
di: Cayci, Semih, et al.
Pubblicazione: (2024)
Optimal Control Operator Perspective and a Neural Adaptive Spectral Method
di: Feng, Mingquan, et al.
Pubblicazione: (2024)
di: Feng, Mingquan, et al.
Pubblicazione: (2024)
Optimizing Inventory Routing: A Decision-Focused Learning Approach using Neural Networks
di: Islam, MD Shafikul, et al.
Pubblicazione: (2023)
di: Islam, MD Shafikul, et al.
Pubblicazione: (2023)
Recurrent Natural Policy Gradient for POMDPs
di: Cayci, Semih, et al.
Pubblicazione: (2024)
di: Cayci, Semih, et al.
Pubblicazione: (2024)
Convergence of Stochastic Gradient Langevin Dynamics in the Lazy Training Regime
di: Oberweis, Noah, et al.
Pubblicazione: (2025)
di: Oberweis, Noah, et al.
Pubblicazione: (2025)
Bridging Control with Neural Network Verifier alpha-beta-CROWN: A Tutorial
di: Li, Haoyu, et al.
Pubblicazione: (2026)
di: Li, Haoyu, et al.
Pubblicazione: (2026)
On the Convergence of Overparameterized Problems: Inherent Properties of the Compositional Structure of Neural Networks
di: de Oliveira, Arthur Castello Branco, et al.
Pubblicazione: (2025)
di: de Oliveira, Arthur Castello Branco, et al.
Pubblicazione: (2025)
Distributionally Robust Safety Verification of Neural Networks via Worst-Case CVaR
di: Kishida, Masako
Pubblicazione: (2025)
di: Kishida, Masako
Pubblicazione: (2025)
Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
di: Cayci, Semih, et al.
Pubblicazione: (2021)
di: Cayci, Semih, et al.
Pubblicazione: (2021)
Regularized Gauss-Newton for Optimizing Overparameterized Neural Networks
di: Adeoye, Adeyemi D., et al.
Pubblicazione: (2024)
di: Adeoye, Adeyemi D., et al.
Pubblicazione: (2024)
Revisiting LQR Control from the Perspective of Receding-Horizon Policy Gradient
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2023)
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2023)
Primitive Agentic First-Order Optimization
di: Sala, R.
Pubblicazione: (2024)
di: Sala, R.
Pubblicazione: (2024)
Differentiable Distributionally Robust Optimization Layers
di: Ma, Xutao, et al.
Pubblicazione: (2024)
di: Ma, Xutao, et al.
Pubblicazione: (2024)
The Newton-Muon Optimizer
di: Du, Zhehang, et al.
Pubblicazione: (2026)
di: Du, Zhehang, et al.
Pubblicazione: (2026)
From Automation to Autonomy in Smart Manufacturing: A Bayesian Optimization Framework for Modeling Multi-Objective Experimentation and Sequential Decision Making
di: Asru, Avijit Saha, et al.
Pubblicazione: (2025)
di: Asru, Avijit Saha, et al.
Pubblicazione: (2025)
Riemannian Bilevel Optimization
di: Dutta, Sanchayan, et al.
Pubblicazione: (2024)
di: Dutta, Sanchayan, et al.
Pubblicazione: (2024)
Stability of Primal-Dual Gradient Flow Dynamics for Multi-Block Convex Optimization Problems
di: Ozaslan, Ibrahim K., et al.
Pubblicazione: (2024)
di: Ozaslan, Ibrahim K., et al.
Pubblicazione: (2024)
Every Call is Precious: Global Optimization of Black-Box Functions with Unknown Lipschitz Constants
di: Fourati, Fares, et al.
Pubblicazione: (2025)
di: Fourati, Fares, et al.
Pubblicazione: (2025)
Differentiable Optimization for Deep Learning-Enhanced DC Approximation of AC Optimal Power Flow
di: Rosemberg, Andrew, et al.
Pubblicazione: (2025)
di: Rosemberg, Andrew, et al.
Pubblicazione: (2025)
Intersection of Reinforcement Learning and Bayesian Optimization for Intelligent Control of Industrial Processes: A Safe MPC-based DPG using Multi-Objective BO
di: Esfahani, Hossein Nejatbakhsh, et al.
Pubblicazione: (2025)
di: Esfahani, Hossein Nejatbakhsh, et al.
Pubblicazione: (2025)
Multi-Year Maintenance Planning for Large-Scale Infrastructure Systems: A Novel Network Deep Q-Learning Approach
di: Fard, Amir, et al.
Pubblicazione: (2025)
di: Fard, Amir, et al.
Pubblicazione: (2025)
Lyapunov Function Consistent Adaptive Network Signal Control with Back Pressure and Reinforcement Learning
di: Ma, Chaolun, et al.
Pubblicazione: (2022)
di: Ma, Chaolun, et al.
Pubblicazione: (2022)
DeMuon: A Decentralized Muon for Matrix Optimization over Graphs
di: He, Chuan, et al.
Pubblicazione: (2025)
di: He, Chuan, et al.
Pubblicazione: (2025)
Lyapunov-stable Neural Control for State and Output Feedback: A Novel Formulation
di: Yang, Lujie, et al.
Pubblicazione: (2024)
di: Yang, Lujie, et al.
Pubblicazione: (2024)
Adaptive Neural-Operator Backstepping Control of a Benchmark Hyperbolic PDE
di: Lamarque, Maxence, et al.
Pubblicazione: (2024)
di: Lamarque, Maxence, et al.
Pubblicazione: (2024)
Distributed Optimization via Energy Conservation Laws in Dilated Coordinates
di: Baranwal, Mayank, et al.
Pubblicazione: (2024)
di: Baranwal, Mayank, et al.
Pubblicazione: (2024)
Gain Scheduling with a Neural Operator for a Transport PDE with Nonlinear Recirculation
di: Lamarque, Maxence, et al.
Pubblicazione: (2024)
di: Lamarque, Maxence, et al.
Pubblicazione: (2024)
Parallel Differentiable Reachability for Learning and Planning with Certified Neural Dynamics and Controllers
di: Shen, Keyi, et al.
Pubblicazione: (2026)
di: Shen, Keyi, et al.
Pubblicazione: (2026)
Neural-Rendezvous: Provably Robust Guidance and Control to Encounter Interstellar Objects
di: Tsukamoto, Hiroyasu, et al.
Pubblicazione: (2022)
di: Tsukamoto, Hiroyasu, et al.
Pubblicazione: (2022)
Decentralized Riemannian Conjugate Gradient Method on the Stiefel Manifold
di: Chen, Jun, et al.
Pubblicazione: (2023)
di: Chen, Jun, et al.
Pubblicazione: (2023)
Adaptive Smooth Tchebycheff Attention for Multi-Objective Policy Optimization
di: Murillo-Gonzalez, Alejandro, et al.
Pubblicazione: (2026)
di: Murillo-Gonzalez, Alejandro, et al.
Pubblicazione: (2026)
How Well Can Transformers Emulate In-context Newton's Method?
di: Giannou, Angeliki, et al.
Pubblicazione: (2024)
di: Giannou, Angeliki, et al.
Pubblicazione: (2024)
ART for Diffusion Sampling: A Reinforcement Learning Approach to Timestep Schedule
di: Huang, Yilie, et al.
Pubblicazione: (2026)
di: Huang, Yilie, et al.
Pubblicazione: (2026)
WARP: A Benchmark for Primal-Dual Warm-Starting of Interior-Point Solvers
di: Suri, Dhruv, et al.
Pubblicazione: (2026)
di: Suri, Dhruv, et al.
Pubblicazione: (2026)
Stabilizing reinforcement learning control: A modular framework for optimizing over all stable behavior
di: Lawrence, Nathan P., et al.
Pubblicazione: (2023)
di: Lawrence, Nathan P., et al.
Pubblicazione: (2023)
DiscoverDCP: A Data-Driven Approach for Construction of Disciplined Convex Programs via Symbolic Regression
di: Myhre, Sveinung
Pubblicazione: (2025)
di: Myhre, Sveinung
Pubblicazione: (2025)
gridfm-datakit-v1: A Python Library for Scalable and Realistic Power Flow and Optimal Power Flow Data Generation
di: Puech, Alban, et al.
Pubblicazione: (2025)
di: Puech, Alban, et al.
Pubblicazione: (2025)
Optimizing the Optimizer for Physics-Informed Neural Networks and Kolmogorov-Arnold Networks
di: Kiyani, Elham, et al.
Pubblicazione: (2025)
di: Kiyani, Elham, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Non-Asymptotic Optimization and Generalization Bounds for Stochastic Gauss-Newton in Overparameterized Models
di: Cayci, Semih
Pubblicazione: (2025) -
Finite-Time Analysis of Gradient Descent for Shallow Transformers
di: Arda, Enes, et al.
Pubblicazione: (2026) -
Convergence of Gradient Descent for Recurrent Neural Networks: A Nonasymptotic Analysis
di: Cayci, Semih, et al.
Pubblicazione: (2024) -
Optimal Control Operator Perspective and a Neural Adaptive Spectral Method
di: Feng, Mingquan, et al.
Pubblicazione: (2024) -
Optimizing Inventory Routing: A Decision-Focused Learning Approach using Neural Networks
di: Islam, MD Shafikul, et al.
Pubblicazione: (2023)