Understanding Nonlinear Implicit Bias via Region Counts in Input Space
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Jingwei, Xu, Jing, Wang, Zifan, Zhang, Huishuai, Zhang, Jingzhao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Capacity-Aware Mixture Law Enables Efficient LLM Data Optimization
di: Li, Jingwei, et al.
Pubblicazione: (2026)
di: Li, Jingwei, et al.
Pubblicazione: (2026)
Scalable Model Merging with Progressive Layer-wise Distillation
di: Xu, Jing, et al.
Pubblicazione: (2025)
di: Xu, Jing, et al.
Pubblicazione: (2025)
OLion: Approaching the Hadamard Ideal by Intersecting Spectral and $\ell_{\infty}$ Implicit Biases
di: Wang, Zixiao, et al.
Pubblicazione: (2026)
di: Wang, Zixiao, et al.
Pubblicazione: (2026)
Random Masking Finds Winning Tickets for Parameter Efficient Fine-tuning
di: Xu, Jing, et al.
Pubblicazione: (2024)
di: Xu, Jing, et al.
Pubblicazione: (2024)
Towards Black-Box Membership Inference Attack for Diffusion Models
di: Li, Jingwei, et al.
Pubblicazione: (2024)
di: Li, Jingwei, et al.
Pubblicazione: (2024)
De-Anonymization at Scale via Tournament-Style Attribution
di: Zhang, Lirui, et al.
Pubblicazione: (2026)
di: Zhang, Lirui, et al.
Pubblicazione: (2026)
On Finding Small Hyper-Gradients in Bilevel Optimization: Hardness Results and Improved Analysis
di: Chen, Lesi, et al.
Pubblicazione: (2023)
di: Chen, Lesi, et al.
Pubblicazione: (2023)
Functionally Constrained Algorithm Solves Convex Simple Bilevel Problems
di: Zhang, Huaqing, et al.
Pubblicazione: (2024)
di: Zhang, Huaqing, et al.
Pubblicazione: (2024)
Beyond Parameter Count: Implicit Bias in Soft Mixture of Experts
di: Chung, Youngseog, et al.
Pubblicazione: (2024)
di: Chung, Youngseog, et al.
Pubblicazione: (2024)
Rewarded Region Replay (R3) for Policy Learning with Discrete Action Space
di: Li, Bangzheng, et al.
Pubblicazione: (2024)
di: Li, Bangzheng, et al.
Pubblicazione: (2024)
Learning to Generate Formally Verifiable Step-by-Step Logic Reasoning via Structured Formal Intermediaries
di: Chen, Luoxin, et al.
Pubblicazione: (2026)
di: Chen, Luoxin, et al.
Pubblicazione: (2026)
Fast and Multiphase Rates for Nearest Neighbor Classifiers
di: Yang, Pengkun, et al.
Pubblicazione: (2023)
di: Yang, Pengkun, et al.
Pubblicazione: (2023)
Understanding Multimodal Hallucination with Parameter-Free Representation Alignment
di: Wang, Yueqian, et al.
Pubblicazione: (2024)
di: Wang, Yueqian, et al.
Pubblicazione: (2024)
The Implicit Bias of Adam on Separable Data
di: Zhang, Chenyang, et al.
Pubblicazione: (2024)
di: Zhang, Chenyang, et al.
Pubblicazione: (2024)
AdamS: Momentum Itself Can Be A Normalizer for LLM Pretraining and Post-training
di: Zhang, Huishuai, et al.
Pubblicazione: (2025)
di: Zhang, Huishuai, et al.
Pubblicazione: (2025)
On the Generalization Properties of Diffusion Models
di: Li, Puheng, et al.
Pubblicazione: (2023)
di: Li, Puheng, et al.
Pubblicazione: (2023)
Efficient Sampling on Riemannian Manifolds via Langevin MCMC
di: Cheng, Xiang, et al.
Pubblicazione: (2024)
di: Cheng, Xiang, et al.
Pubblicazione: (2024)
On the Condition Number Dependency in Bilevel Optimization
di: Chen, Lesi, et al.
Pubblicazione: (2025)
di: Chen, Lesi, et al.
Pubblicazione: (2025)
Implicit Bias in Deep Linear Discriminant Analysis
di: Li, Jiawen
Pubblicazione: (2026)
di: Li, Jiawen
Pubblicazione: (2026)
The Implicit Bias of Structured State Space Models Can Be Poisoned With Clean Labels
di: Slutzky, Yonatan, et al.
Pubblicazione: (2024)
di: Slutzky, Yonatan, et al.
Pubblicazione: (2024)
Gradient Descent with Polyak's Momentum Finds Flatter Minima via Large Catapults
di: Phunyaphibarn, Prin, et al.
Pubblicazione: (2023)
di: Phunyaphibarn, Prin, et al.
Pubblicazione: (2023)
Molecular Representations in Implicit Functional Space via Hyper-Networks
di: Wang, Zehong, et al.
Pubblicazione: (2026)
di: Wang, Zehong, et al.
Pubblicazione: (2026)
Research and Implementation of Data Enhancement Techniques for Graph Neural Networks
di: Gu, Jingzhao, et al.
Pubblicazione: (2024)
di: Gu, Jingzhao, et al.
Pubblicazione: (2024)
Fast Conditional Mixing of MCMC Algorithms for Non-log-concave Distributions
di: Cheng, Xiang, et al.
Pubblicazione: (2023)
di: Cheng, Xiang, et al.
Pubblicazione: (2023)
The Implicit Bias of Logit Regularization
di: Beck, Alon, et al.
Pubblicazione: (2026)
di: Beck, Alon, et al.
Pubblicazione: (2026)
Learning Implicit Bias in Generative Spaces for Accelerating Protein Dynamics Emulation
di: Cheng, Kaihui, et al.
Pubblicazione: (2026)
di: Cheng, Kaihui, et al.
Pubblicazione: (2026)
How Implicit Bias Accumulates and Propagates in LLM Long-term Memory
di: Ma, Yiming, et al.
Pubblicazione: (2026)
di: Ma, Yiming, et al.
Pubblicazione: (2026)
Optimal Implicit Bias in Linear Regression
di: Varma, Kanumuri Nithin, et al.
Pubblicazione: (2025)
di: Varma, Kanumuri Nithin, et al.
Pubblicazione: (2025)
From Sparse Dependence to Sparse Attention: Unveiling How Chain-of-Thought Enhances Transformer Sample Efficiency
di: Wen, Kaiyue, et al.
Pubblicazione: (2024)
di: Wen, Kaiyue, et al.
Pubblicazione: (2024)
The Implicit Bias of Gradient Descent on Separable Multiclass Data
di: Ravi, Hrithik, et al.
Pubblicazione: (2024)
di: Ravi, Hrithik, et al.
Pubblicazione: (2024)
Online Preference Alignment for Language Models via Count-based Exploration
di: Bai, Chenjia, et al.
Pubblicazione: (2025)
di: Bai, Chenjia, et al.
Pubblicazione: (2025)
Discovering Bias in Latent Space: An Unsupervised Debiasing Approach
di: Adila, Dyah, et al.
Pubblicazione: (2024)
di: Adila, Dyah, et al.
Pubblicazione: (2024)
Data Difficulty and the Generalization--Extrapolation Tradeoff in LLM Fine-Tuning
di: Liu, Siyuan, et al.
Pubblicazione: (2026)
di: Liu, Siyuan, et al.
Pubblicazione: (2026)
The Implicit Bias of Steepest Descent with Mini-batch Stochastic Gradient
di: Li, Jichu, et al.
Pubblicazione: (2026)
di: Li, Jichu, et al.
Pubblicazione: (2026)
OmniBridge: Unified Multimodal Understanding, Generation, and Retrieval via Latent Space Alignment
di: Xiao, Teng, et al.
Pubblicazione: (2025)
di: Xiao, Teng, et al.
Pubblicazione: (2025)
Faster Gradient Methods for Highly-Smooth Stochastic Bilevel Optimization
di: Chen, Lesi, et al.
Pubblicazione: (2025)
di: Chen, Lesi, et al.
Pubblicazione: (2025)
Hyperbolic Aware Minimization: Implicit Bias for Sparsity
di: Jacobs, Tom, et al.
Pubblicazione: (2025)
di: Jacobs, Tom, et al.
Pubblicazione: (2025)
The Price of Implicit Bias in Adversarially Robust Generalization
di: Tsilivis, Nikolaos, et al.
Pubblicazione: (2024)
di: Tsilivis, Nikolaos, et al.
Pubblicazione: (2024)
Can Implicit Bias Imply Adversarial Robustness?
di: Min, Hancheng, et al.
Pubblicazione: (2024)
di: Min, Hancheng, et al.
Pubblicazione: (2024)
The Implicit Bias of Gradient Descent on Separable Data
di: Soudry, Daniel, et al.
Pubblicazione: (2017)
di: Soudry, Daniel, et al.
Pubblicazione: (2017)
Documenti analoghi
-
Capacity-Aware Mixture Law Enables Efficient LLM Data Optimization
di: Li, Jingwei, et al.
Pubblicazione: (2026) -
Scalable Model Merging with Progressive Layer-wise Distillation
di: Xu, Jing, et al.
Pubblicazione: (2025) -
OLion: Approaching the Hadamard Ideal by Intersecting Spectral and $\ell_{\infty}$ Implicit Biases
di: Wang, Zixiao, et al.
Pubblicazione: (2026) -
Random Masking Finds Winning Tickets for Parameter Efficient Fine-tuning
di: Xu, Jing, et al.
Pubblicazione: (2024) -
Towards Black-Box Membership Inference Attack for Diffusion Models
di: Li, Jingwei, et al.
Pubblicazione: (2024)