Better Hessians Matter: Studying the Impact of Curvature Approximations in Influence Functions
Fuente:
arXiv
Salvato in:
| Autori principali: | Hong, Steve, Eschenhagen, Runa, Mlodozeniec, Bruno, Turner, Richard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Influence Functions for Scalable Data Attribution in Diffusion Models
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2024)
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2024)
Kronecker-Factored Approximate Curvature for Modern Neural Network Architectures
di: Eschenhagen, Runa, et al.
Pubblicazione: (2023)
di: Eschenhagen, Runa, et al.
Pubblicazione: (2023)
Kronecker-factored Approximate Curvature (KFAC) From Scratch
di: Dangel, Felix, et al.
Pubblicazione: (2025)
di: Dangel, Felix, et al.
Pubblicazione: (2025)
Spectral-factorized Positive-definite Curvature Learning for NN Training
di: Lin, Wu, et al.
Pubblicazione: (2025)
di: Lin, Wu, et al.
Pubblicazione: (2025)
Probabilistic Modelling is Sufficient for Causal Inference
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)
Position: Curvature Matrices Should Be Democratized via Linear Operators
di: Dangel, Felix, et al.
Pubblicazione: (2025)
di: Dangel, Felix, et al.
Pubblicazione: (2025)
Distributional Training Data Attribution: What do Influence Functions Sample?
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)
Can We Remove the Square-Root in Adaptive Gradient Methods? A Second-Order Perspective
di: Lin, Wu, et al.
Pubblicazione: (2024)
di: Lin, Wu, et al.
Pubblicazione: (2024)
Incremental Transformer Neural Processes
di: Mortimer, Philip, et al.
Pubblicazione: (2026)
di: Mortimer, Philip, et al.
Pubblicazione: (2026)
Structured Inverse-Free Natural Gradient: Memory-Efficient & Numerically-Stable KFAC
di: Lin, Wu, et al.
Pubblicazione: (2023)
di: Lin, Wu, et al.
Pubblicazione: (2023)
Purifying Shampoo: Investigating Shampoo's Heuristics by Decomposing its Preconditioner
di: Eschenhagen, Runa, et al.
Pubblicazione: (2025)
di: Eschenhagen, Runa, et al.
Pubblicazione: (2025)
Clarifying Shampoo: Adapting Spectral Descent to Stochasticity and the Parameter Trajectory
di: Eschenhagen, Runa, et al.
Pubblicazione: (2026)
di: Eschenhagen, Runa, et al.
Pubblicazione: (2026)
Denoising Diffusion Probabilistic Models in Six Simple Steps
di: Turner, Richard E., et al.
Pubblicazione: (2024)
di: Turner, Richard E., et al.
Pubblicazione: (2024)
Bayesian Influence Functions for Hessian-Free Data Attribution
di: Kreer, Philipp Alexander, et al.
Pubblicazione: (2025)
di: Kreer, Philipp Alexander, et al.
Pubblicazione: (2025)
Revisit, Extend, and Enhance Hessian-Free Influence Functions
di: Yang, Ziao, et al.
Pubblicazione: (2024)
di: Yang, Ziao, et al.
Pubblicazione: (2024)
Understanding and Improving Shampoo and SOAP via Kullback-Leibler Minimization
di: Lin, Wu, et al.
Pubblicazione: (2025)
di: Lin, Wu, et al.
Pubblicazione: (2025)
Better Training Data Attribution via Better Inverse Hessian-Vector Products
di: Wang, Andrew, et al.
Pubblicazione: (2025)
di: Wang, Andrew, et al.
Pubblicazione: (2025)
Revisiting Zeroth-Order Hessian Approximation: A Single-Step Policy Optimization Lens
di: Qiu, Junbin, et al.
Pubblicazione: (2026)
di: Qiu, Junbin, et al.
Pubblicazione: (2026)
A Generative Model of Symmetry Transformations
di: Allingham, James Urquhart, et al.
Pubblicazione: (2024)
di: Allingham, James Urquhart, et al.
Pubblicazione: (2024)
Warm Start Marginal Likelihood Optimisation for Iterative Gaussian Processes
di: Lin, Jihao Andreas, et al.
Pubblicazione: (2024)
di: Lin, Jihao Andreas, et al.
Pubblicazione: (2024)
Implicit meta-learning may lead language models to trust more reliable sources
di: Krasheninnikov, Dmitrii, et al.
Pubblicazione: (2023)
di: Krasheninnikov, Dmitrii, et al.
Pubblicazione: (2023)
Gradient-Normalized Smoothness for Optimization with Approximate Hessians
di: Semenov, Andrei, et al.
Pubblicazione: (2025)
di: Semenov, Andrei, et al.
Pubblicazione: (2025)
Rotary Position Encodings for Graphs
di: Reid, Isaac, et al.
Pubblicazione: (2025)
di: Reid, Isaac, et al.
Pubblicazione: (2025)
Improving Linear System Solvers for Hyperparameter Optimisation in Iterative Gaussian Processes
di: Lin, Jihao Andreas, et al.
Pubblicazione: (2024)
di: Lin, Jihao Andreas, et al.
Pubblicazione: (2024)
FAGH: Accelerating Federated Learning with Approximated Global Hessian
di: Sen, Mrinmay, et al.
Pubblicazione: (2024)
di: Sen, Mrinmay, et al.
Pubblicazione: (2024)
Subspace-based Approximate Hessian Method for Zeroth-Order Optimization
di: Kim, Dongyoon, et al.
Pubblicazione: (2025)
di: Kim, Dongyoon, et al.
Pubblicazione: (2025)
Revisiting Scalable Hessian Diagonal Approximations for Applications in Reinforcement Learning
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024)
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024)
Approximately Equivariant Neural Processes
di: Ashman, Matthew, et al.
Pubblicazione: (2024)
di: Ashman, Matthew, et al.
Pubblicazione: (2024)
Projected Hessian Learning: Fast Curvature Supervision for Accurate Machine-Learning Interatomic Potentials
di: Rodriguez, Austin, et al.
Pubblicazione: (2026)
di: Rodriguez, Austin, et al.
Pubblicazione: (2026)
Mimicking Better by Matching the Approximate Action Distribution
di: Ramos, João A. Cândido, et al.
Pubblicazione: (2023)
di: Ramos, João A. Cândido, et al.
Pubblicazione: (2023)
Completed Hyperparameter Transfer across Modules, Width, Depth, Batch and Duration
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)
SASSHA: Sharpness-aware Adaptive Second-order Optimization with Stable Hessian Approximation
di: Shin, Dahun, et al.
Pubblicazione: (2025)
di: Shin, Dahun, et al.
Pubblicazione: (2025)
Unraveling the Hessian: A Key to Smooth Convergence in Loss Function Landscapes
di: Kiselev, Nikita, et al.
Pubblicazione: (2024)
di: Kiselev, Nikita, et al.
Pubblicazione: (2024)
The Approximate Fisher Influence Function: Faster Estimation of Data Influence in Statistical Models
di: Lev, Omri, et al.
Pubblicazione: (2024)
di: Lev, Omri, et al.
Pubblicazione: (2024)
Closing the Curvature Gap: Full Transformer Hessians and Their Implications for Scaling Laws
di: Petrov, Egor, et al.
Pubblicazione: (2025)
di: Petrov, Egor, et al.
Pubblicazione: (2025)
MAC: An Efficient Gradient Preconditioning using Mean Activation Approximated Curvature
di: Seung, Hyunseok, et al.
Pubblicazione: (2025)
di: Seung, Hyunseok, et al.
Pubblicazione: (2025)
Efficient Curvature-Aware Hypergradient Approximation for Bilevel Optimization
di: Dong, Youran, et al.
Pubblicazione: (2025)
di: Dong, Youran, et al.
Pubblicazione: (2025)
Unbiased Online Curvature Approximation for Regularized Graph Continual Learning
di: Yin, Jie, et al.
Pubblicazione: (2025)
di: Yin, Jie, et al.
Pubblicazione: (2025)
Kronecker-Factored Approximate Curvature for Physics-Informed Neural Networks
di: Dangel, Felix, et al.
Pubblicazione: (2024)
di: Dangel, Felix, et al.
Pubblicazione: (2024)
Online estimation of the inverse of the Hessian for stochastic optimization with application to universal stochastic Newton algorithms
di: Godichon-Baggioni, Antoine, et al.
Pubblicazione: (2024)
di: Godichon-Baggioni, Antoine, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Influence Functions for Scalable Data Attribution in Diffusion Models
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2024) -
Kronecker-Factored Approximate Curvature for Modern Neural Network Architectures
di: Eschenhagen, Runa, et al.
Pubblicazione: (2023) -
Kronecker-factored Approximate Curvature (KFAC) From Scratch
di: Dangel, Felix, et al.
Pubblicazione: (2025) -
Spectral-factorized Positive-definite Curvature Learning for NN Training
di: Lin, Wu, et al.
Pubblicazione: (2025) -
Probabilistic Modelling is Sufficient for Causal Inference
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)