Zero Generalization Error Theorem for Random Interpolators via Algebraic Geometry
Fuente:
arXiv
Salvato in:
| Autori principali: | Yoshida, Naoki, Ishikawa, Isao, Imaizumi, Masaaki |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Effect of Random Learning Rate: Theoretical Analysis of SGD Dynamics in Non-Convex Optimization via Stationary Distribution
di: Yoshida, Naoki, et al.
Pubblicazione: (2024)
di: Yoshida, Naoki, et al.
Pubblicazione: (2024)
Approximation of Permutation Invariant Polynomials by Transformers: Efficient Construction in Column-Size
di: Takeshita, Naoki, et al.
Pubblicazione: (2025)
di: Takeshita, Naoki, et al.
Pubblicazione: (2025)
Neuron Block Dynamics for XOR Classification with Zero-Margin
di: Braun, Guillaume, et al.
Pubblicazione: (2026)
di: Braun, Guillaume, et al.
Pubblicazione: (2026)
Spectrum-Adaptive Generalization Bounds for Trained Deep Transformers
di: Sakai, Mana, et al.
Pubblicazione: (2026)
di: Sakai, Mana, et al.
Pubblicazione: (2026)
Bayesian Analysis for Over-parameterized Linear Model via Effective Spectra
di: Wakayama, Tomoya, et al.
Pubblicazione: (2023)
di: Wakayama, Tomoya, et al.
Pubblicazione: (2023)
High-dimensional Contextual Bandit Problem without Sparsity
di: Komiyama, Junpei, et al.
Pubblicazione: (2023)
di: Komiyama, Junpei, et al.
Pubblicazione: (2023)
High-Dimensional Limit of Stochastic Gradient Flow via Dynamical Mean-Field Theory
di: Nishiyama, Sota, et al.
Pubblicazione: (2026)
di: Nishiyama, Sota, et al.
Pubblicazione: (2026)
Infinite-Width Limit of a Single Attention Layer: Analysis via Tensor Programs
di: Sakai, Mana, et al.
Pubblicazione: (2025)
di: Sakai, Mana, et al.
Pubblicazione: (2025)
Why High-rank Neural Networks Generalize?: An Algebraic Framework with RKHSs
di: Hashimoto, Yuka, et al.
Pubblicazione: (2025)
di: Hashimoto, Yuka, et al.
Pubblicazione: (2025)
Benign Overfitting in Time Series Linear Models with Over-Parameterization
di: Nakakita, Shogo, et al.
Pubblicazione: (2022)
di: Nakakita, Shogo, et al.
Pubblicazione: (2022)
Extended Wasserstein-GAN Approach to Causal Distribution Learning: Density-Free Estimation and Minimax Optimality
di: Tamano, Shu, et al.
Pubblicazione: (2026)
di: Tamano, Shu, et al.
Pubblicazione: (2026)
Finite-Sample Inference for Sparsely Permuted Linear Regression
di: Ota, Hirofumi, et al.
Pubblicazione: (2026)
di: Ota, Hirofumi, et al.
Pubblicazione: (2026)
Precise Dynamics of Diagonal Linear Networks: A Unifying Analysis by Dynamical Mean-Field Theory
di: Nishiyama, Sota, et al.
Pubblicazione: (2025)
di: Nishiyama, Sota, et al.
Pubblicazione: (2025)
Minimax Rates of Estimation for Optimal Transport Map between Infinite-Dimensional Spaces
di: Ponnoprat, Donlapark, et al.
Pubblicazione: (2025)
di: Ponnoprat, Donlapark, et al.
Pubblicazione: (2025)
Anti Mode-Collapse in Mean-Field Transformer via Auxiliary Variables
di: Imaizumi, Masaaki, et al.
Pubblicazione: (2026)
di: Imaizumi, Masaaki, et al.
Pubblicazione: (2026)
Optimal Dynamic Regret by Transformers for Non-Stationary Reinforcement Learning
di: Chen, Baiyuan, et al.
Pubblicazione: (2025)
di: Chen, Baiyuan, et al.
Pubblicazione: (2025)
Automatic Domain Adaptation by Transformers in In-Context Learning
di: Hataya, Ryuichiro, et al.
Pubblicazione: (2024)
di: Hataya, Ryuichiro, et al.
Pubblicazione: (2024)
Effect of Weight Quantization on Learning Models by Typical Case Analysis
di: Kashiwamura, Shuhei, et al.
Pubblicazione: (2024)
di: Kashiwamura, Shuhei, et al.
Pubblicazione: (2024)
Precise gradient descent training dynamics for finite-width multi-layer neural networks
di: Han, Qiyang, et al.
Pubblicazione: (2025)
di: Han, Qiyang, et al.
Pubblicazione: (2025)
High-dimensional Nonparametric Contextual Bandit Problem
di: Iwazaki, Shogo, et al.
Pubblicazione: (2025)
di: Iwazaki, Shogo, et al.
Pubblicazione: (2025)
Deep Ridgelet Transform and Unified Universality Theorem for Deep and Shallow Joint-Group-Equivariant Machines
di: Sonoda, Sho, et al.
Pubblicazione: (2024)
di: Sonoda, Sho, et al.
Pubblicazione: (2024)
Learning a Single Index Model from Anisotropic Data with vanilla Stochastic Gradient Descent
di: Braun, Guillaume, et al.
Pubblicazione: (2025)
di: Braun, Guillaume, et al.
Pubblicazione: (2025)
Spectral Gradient Descent Mitigates Anisotropy-Driven Misalignment: A Case Study in Phase Retrieval
di: Braun, Guillaume, et al.
Pubblicazione: (2026)
di: Braun, Guillaume, et al.
Pubblicazione: (2026)
Minimax Optimal Estimation of Transport-Growth Pairs in Unbalanced Optimal Transport
di: Ponnoprat, Donlapark, et al.
Pubblicazione: (2026)
di: Ponnoprat, Donlapark, et al.
Pubblicazione: (2026)
Dichotomy of Feature Learning and Unlearning: Fast-Slow Analysis on Neural Networks with Stochastic Gradient Descent
di: Imai, Shota, et al.
Pubblicazione: (2026)
di: Imai, Shota, et al.
Pubblicazione: (2026)
SAN: Inducing Metrizability of GAN with Discriminative Normalized Linear Layer
di: Takida, Yuhta, et al.
Pubblicazione: (2023)
di: Takida, Yuhta, et al.
Pubblicazione: (2023)
Fast Escape, Slow Convergence: Learning Dynamics of Phase Retrieval under Power-Law Data
di: Braun, Guillaume, et al.
Pubblicazione: (2025)
di: Braun, Guillaume, et al.
Pubblicazione: (2025)
Federated Learning with Relative Fairness
di: Nakakita, Shogo, et al.
Pubblicazione: (2024)
di: Nakakita, Shogo, et al.
Pubblicazione: (2024)
Demystifying MaskGIT Sampler and Beyond: Adaptive Order Selection in Masked Diffusion
di: Hayakawa, Satoshi, et al.
Pubblicazione: (2025)
di: Hayakawa, Satoshi, et al.
Pubblicazione: (2025)
A unified Fourier slice method to derive ridgelet transform for a variety of depth-2 neural networks
di: Sonoda, Sho, et al.
Pubblicazione: (2024)
di: Sonoda, Sho, et al.
Pubblicazione: (2024)
Distillation of Discrete Diffusion through Dimensional Correlations
di: Hayakawa, Satoshi, et al.
Pubblicazione: (2024)
di: Hayakawa, Satoshi, et al.
Pubblicazione: (2024)
Algebraic Evaluation Theorems
di: Corrada-Emmanuel, Andrés
Pubblicazione: (2024)
di: Corrada-Emmanuel, Andrés
Pubblicazione: (2024)
Algebraic and Statistical Properties of the Ordinary Least Squares Interpolator
di: Shen, Dennis, et al.
Pubblicazione: (2023)
di: Shen, Dennis, et al.
Pubblicazione: (2023)
Finite-dimensional approximations of push-forwards on locally analytic functionals
di: Ishikawa, Isao
Pubblicazione: (2024)
di: Ishikawa, Isao
Pubblicazione: (2024)
Training-Induced Escape from Token Clustering in a Mean-Field Formulation of Transformers
di: Isobe, Noboru, et al.
Pubblicazione: (2026)
di: Isobe, Noboru, et al.
Pubblicazione: (2026)
CITE: Anytime-Valid Statistical Inference in LLM Self-Consistency
di: Ota, Hirofumi, et al.
Pubblicazione: (2026)
di: Ota, Hirofumi, et al.
Pubblicazione: (2026)
Why and When Deep is Better than Shallow: Implementation-Agnostic State-Transition Model of Deep Learning
di: Sonoda, Sho, et al.
Pubblicazione: (2025)
di: Sonoda, Sho, et al.
Pubblicazione: (2025)
Dynamic Structure Estimation from Bandit Feedback using Nonvanishing Exponential Sums
di: Ohnishi, Motoya, et al.
Pubblicazione: (2022)
di: Ohnishi, Motoya, et al.
Pubblicazione: (2022)
The Price of Linear Time: Error Analysis of Structured Kernel Interpolation
di: Moreno, Alexander, et al.
Pubblicazione: (2025)
di: Moreno, Alexander, et al.
Pubblicazione: (2025)
Generative Modeling through Koopman Spectral Analysis: An Operator-Theoretic Perspective
di: Xu, Yuanchao, et al.
Pubblicazione: (2025)
di: Xu, Yuanchao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Effect of Random Learning Rate: Theoretical Analysis of SGD Dynamics in Non-Convex Optimization via Stationary Distribution
di: Yoshida, Naoki, et al.
Pubblicazione: (2024) -
Approximation of Permutation Invariant Polynomials by Transformers: Efficient Construction in Column-Size
di: Takeshita, Naoki, et al.
Pubblicazione: (2025) -
Neuron Block Dynamics for XOR Classification with Zero-Margin
di: Braun, Guillaume, et al.
Pubblicazione: (2026) -
Spectrum-Adaptive Generalization Bounds for Trained Deep Transformers
di: Sakai, Mana, et al.
Pubblicazione: (2026) -
Bayesian Analysis for Over-parameterized Linear Model via Effective Spectra
di: Wakayama, Tomoya, et al.
Pubblicazione: (2023)