Enregistré dans:
| Auteurs principaux: | Xu, Yizhou, Ziyin, Liu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2401.07085 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Remove Symmetries to Control Model Expressivity and Improve Optimization
par: Ziyin, Liu, et autres
Publié: (2024)
par: Ziyin, Liu, et autres
Publié: (2024)
Parameter Symmetry Potentially Unifies Deep Learning Theory
par: Ziyin, Liu, et autres
Publié: (2025)
par: Ziyin, Liu, et autres
Publié: (2025)
Noise Balance and Stationary Distribution of Stochastic Gradient Descent
par: Ziyin, Liu, et autres
Publié: (2023)
par: Ziyin, Liu, et autres
Publié: (2023)
When Does Learning Renormalize? Sufficient Conditions for Power Law Spectral Dynamics
par: Zhang, Yizhou
Publié: (2025)
par: Zhang, Yizhou
Publié: (2025)
Scaling Laws and Spectra of Shallow Neural Networks in the Feature Learning Regime
par: Defilippis, Leonardo, et autres
Publié: (2025)
par: Defilippis, Leonardo, et autres
Publié: (2025)
Compositional Generalization via Forced Rendering of Disentangled Latents
par: Liang, Qiyao, et autres
Publié: (2025)
par: Liang, Qiyao, et autres
Publié: (2025)
Learning Hierarchical Polynomials of Multiple Nonlinear Features with Three-Layer Networks
par: Fu, Hengyu, et autres
Publié: (2024)
par: Fu, Hengyu, et autres
Publié: (2024)
Finite Sample Analysis of Linear Temporal Difference Learning with Arbitrary Features
par: Xie, Zixuan, et autres
Publié: (2025)
par: Xie, Zixuan, et autres
Publié: (2025)
Enhancing Imbalanced Node Classification via Curriculum-Guided Feature Learning and Three-Stage Attention Network
par: Fofanah, Abdul Joseph, et autres
Publié: (2026)
par: Fofanah, Abdul Joseph, et autres
Publié: (2026)
Understanding the Emergence of Multimodal Representation Alignment
par: Tjandrasuwita, Megan, et autres
Publié: (2025)
par: Tjandrasuwita, Megan, et autres
Publié: (2025)
Universal One-third Time Scaling in Learning Peaked Distributions
par: Liu, Yizhou, et autres
Publié: (2026)
par: Liu, Yizhou, et autres
Publié: (2026)
The Weight Gram Matrix Captures Sequential Feature Linearization in Deep Networks
par: Cha, Taehun, et autres
Publié: (2026)
par: Cha, Taehun, et autres
Publié: (2026)
Feature contamination: Neural networks learn uncorrelated features and fail to generalize
par: Zhang, Tianren, et autres
Publié: (2024)
par: Zhang, Tianren, et autres
Publié: (2024)
Self-cross Feature based Spiking Neural Networks for Efficient Few-shot Learning
par: Xu, Qi, et autres
Publié: (2025)
par: Xu, Qi, et autres
Publié: (2025)
Almost Sure Convergence of Linear Temporal Difference Learning with Arbitrary Features
par: Wang, Jiuqi, et autres
Publié: (2024)
par: Wang, Jiuqi, et autres
Publié: (2024)
Thermodynamic Irreversibility of Training Algorithms
par: Ziyin, Liu, et autres
Publié: (2026)
par: Ziyin, Liu, et autres
Publié: (2026)
Shortcut Features as Top Eigenfunctions of NTK: A Linear Neural Network Case and More
par: Lim, Jinwoo, et autres
Publié: (2026)
par: Lim, Jinwoo, et autres
Publié: (2026)
Hamiltonian Mechanics of Feature Learning: Bottleneck Structure in Leaky ResNets
par: Jacot, Arthur, et autres
Publié: (2024)
par: Jacot, Arthur, et autres
Publié: (2024)
Learning Probabilities of Causation with Mask-Augmented Data
par: Wang, Shuai, et autres
Publié: (2025)
par: Wang, Shuai, et autres
Publié: (2025)
Three Pathways to Neurosymbolic Reinforcement Learning with Interpretable Model and Policy Networks
par: Graf, Peter, et autres
Publié: (2024)
par: Graf, Peter, et autres
Publié: (2024)
Data Curation Through the Lens of Spectral Dynamics: Static Limits, Dynamic Acceleration, and Practical Oracles
par: Zhang, Yizhou, et autres
Publié: (2025)
par: Zhang, Yizhou, et autres
Publié: (2025)
Learning Distinguishable Representations in Deep Q-Networks for Linear Transfer
par: Sathish, Sooraj, et autres
Publié: (2025)
par: Sathish, Sooraj, et autres
Publié: (2025)
TANGNN: a Concise, Scalable and Effective Graph Neural Networks with Top-m Attention Mechanism for Graph Representation Learning
par: E, Jiawei, et autres
Publié: (2024)
par: E, Jiawei, et autres
Publié: (2024)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
par: Tang, Cheng, et autres
Publié: (2024)
par: Tang, Cheng, et autres
Publié: (2024)
Feature Repulsion and Spectral Lock-in: An Empirical Study of Two-Layer Network Grokking
par: Xu, Yongzhong
Publié: (2026)
par: Xu, Yongzhong
Publié: (2026)
Transform then Explore: a Simple and Effective Technique for Exploratory Combinatorial Optimization with Reinforcement Learning
par: Pu, Tianle, et autres
Publié: (2024)
par: Pu, Tianle, et autres
Publié: (2024)
On the Learning Dynamics of Two-layer Linear Networks with Label Noise SGD
par: Zhang, Tongcheng, et autres
Publié: (2026)
par: Zhang, Tongcheng, et autres
Publié: (2026)
TimeDiT: General-purpose Diffusion Transformers for Time Series Foundation Model
par: Cao, Defu, et autres
Publié: (2024)
par: Cao, Defu, et autres
Publié: (2024)
Identifying General Mechanism Shifts in Linear Causal Representations
par: Chen, Tianyu, et autres
Publié: (2024)
par: Chen, Tianyu, et autres
Publié: (2024)
Continual Model-Based Reinforcement Learning with Hypernetworks
par: Huang, Yizhou, et autres
Publié: (2020)
par: Huang, Yizhou, et autres
Publié: (2020)
Operator Feature Neural Network for Symbolic Regression
par: Deng, Yusong, et autres
Publié: (2024)
par: Deng, Yusong, et autres
Publié: (2024)
Latent Context Compilation: Distilling Long Context into Compact Portable Memory
par: Li, Zeju, et autres
Publié: (2026)
par: Li, Zeju, et autres
Publié: (2026)
Superposition Yields Robust Neural Scaling
par: Liu, Yizhou, et autres
Publié: (2025)
par: Liu, Yizhou, et autres
Publié: (2025)
Provable Effects of Data Replay in Continual Learning: A Feature Learning Perspective
par: Ding, Meng, et autres
Publié: (2026)
par: Ding, Meng, et autres
Publié: (2026)
Three Dogmas of Reinforcement Learning
par: Abel, David, et autres
Publié: (2024)
par: Abel, David, et autres
Publié: (2024)
Contextual Linear Bandits under Noisy Features: Towards Bayesian Oracles
par: Kim, Jung-hun, et autres
Publié: (2017)
par: Kim, Jung-hun, et autres
Publié: (2017)
Solving Deep Reinforcement Learning Tasks with Evolution Strategies and Linear Policy Networks
par: Wong, Annie, et autres
Publié: (2024)
par: Wong, Annie, et autres
Publié: (2024)
Feature Learning Dynamics in Infinite-Depth Neural Networks
par: Yao, Zihan, et autres
Publié: (2025)
par: Yao, Zihan, et autres
Publié: (2025)
Learning Unified Distance Metric for Heterogeneous Attribute Data Clustering
par: Zhang, Yiqun, et autres
Publié: (2026)
par: Zhang, Yiqun, et autres
Publié: (2026)
Continual Driving Policy Optimization with Closed-Loop Individualized Curricula
par: Niu, Haoyi, et autres
Publié: (2023)
par: Niu, Haoyi, et autres
Publié: (2023)
Documents similaires
-
Remove Symmetries to Control Model Expressivity and Improve Optimization
par: Ziyin, Liu, et autres
Publié: (2024) -
Parameter Symmetry Potentially Unifies Deep Learning Theory
par: Ziyin, Liu, et autres
Publié: (2025) -
Noise Balance and Stationary Distribution of Stochastic Gradient Descent
par: Ziyin, Liu, et autres
Publié: (2023) -
When Does Learning Renormalize? Sufficient Conditions for Power Law Spectral Dynamics
par: Zhang, Yizhou
Publié: (2025) -
Scaling Laws and Spectra of Shallow Neural Networks in the Feature Learning Regime
par: Defilippis, Leonardo, et autres
Publié: (2025)