Guardado en:
| Autores principales: | He, Jianliang, Wang, Leda, Chen, Siyu, Yang, Zhuoran |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.16849 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Unveiling Induction Heads: Provable Training Dynamics and Feature Learning in Transformers
por: Chen, Siyu, et al.
Publicado: (2024)
por: Chen, Siyu, et al.
Publicado: (2024)
Wasserstein Flow Meets Replicator Dynamics: A Mean-Field Analysis of Representation Learning in Actor-Critic
por: Zhang, Yufeng, et al.
Publicado: (2021)
por: Zhang, Yufeng, et al.
Publicado: (2021)
Training Dynamics of Multi-Head Softmax Attention for In-Context Learning: Emergence, Convergence, and Optimality
por: Chen, Siyu, et al.
Publicado: (2024)
por: Chen, Siyu, et al.
Publicado: (2024)
TwIST: Rigging the Lottery in Transformers with Independent Subnetwork Training
por: Menezes, Michael, et al.
Publicado: (2025)
por: Menezes, Michael, et al.
Publicado: (2025)
Principled Penalty-based Methods for Bilevel Reinforcement Learning and RLHF
por: Shen, Han, et al.
Publicado: (2024)
por: Shen, Han, et al.
Publicado: (2024)
A Theoretical Framework for Grokking: Interpolation followed by Riemannian Norm Minimisation
por: Boursier, Etienne, et al.
Publicado: (2025)
por: Boursier, Etienne, et al.
Publicado: (2025)
Reinforcement Learning from Partial Observation: Linear Function Approximation with Provable Sample Efficiency
por: Cai, Qi, et al.
Publicado: (2022)
por: Cai, Qi, et al.
Publicado: (2022)
Symmetric Mean-field Langevin Dynamics for Distributional Minimax Problems
por: Kim, Juno, et al.
Publicado: (2023)
por: Kim, Juno, et al.
Publicado: (2023)
Can Temporal-Difference and Q-Learning Learn Representation? A Mean-Field Theory
por: Zhang, Yufeng, et al.
Publicado: (2020)
por: Zhang, Yufeng, et al.
Publicado: (2020)
A Mean-Field Analysis of Neural Stochastic Gradient Descent-Ascent for Functional Minimax Optimization
por: Zhu, Yuchen, et al.
Publicado: (2024)
por: Zhu, Yuchen, et al.
Publicado: (2024)
Provably Efficient Exploration in Policy Optimization
por: Cai, Qi, et al.
Publicado: (2019)
por: Cai, Qi, et al.
Publicado: (2019)
Bridging Lottery Ticket and Grokking: Understanding Grokking from Inner Structure of Networks
por: Minegishi, Gouki, et al.
Publicado: (2023)
por: Minegishi, Gouki, et al.
Publicado: (2023)
Learning Dynamic Mechanisms in Unknown Environments: A Reinforcement Learning Approach
por: Qiu, Shuang, et al.
Publicado: (2022)
por: Qiu, Shuang, et al.
Publicado: (2022)
Double Duality: Variational Primal-Dual Policy Optimization for Constrained Reinforcement Learning
por: Li, Zihao, et al.
Publicado: (2024)
por: Li, Zihao, et al.
Publicado: (2024)
Variational Transport: A Convergent Particle-BasedAlgorithm for Distributional Optimization
por: Yang, Zhuoran, et al.
Publicado: (2020)
por: Yang, Zhuoran, et al.
Publicado: (2020)
Grokking or Glitching? How Low-Precision Drives Slingshot Loss Spikes
por: Hanqing, Liu, et al.
Publicado: (2026)
por: Hanqing, Liu, et al.
Publicado: (2026)
Grokking as Structural Inference: Transformers Need Bayesian Lottery Tickets
por: Hidajat, Kai, et al.
Publicado: (2026)
por: Hidajat, Kai, et al.
Publicado: (2026)
Fourier Learning Machines: Nonharmonic Fourier-Based Neural Networks for Scientific Machine Learning
por: Rubel, Mominul, et al.
Publicado: (2025)
por: Rubel, Mominul, et al.
Publicado: (2025)
Modular Distributed Nonconvex Learning with Error Feedback
por: Carnevale, Guido, et al.
Publicado: (2025)
por: Carnevale, Guido, et al.
Publicado: (2025)
Feature Augmentation of GNNs for ILPs: Local Uniqueness Suffices
por: Han, Qingyu, et al.
Publicado: (2025)
por: Han, Qingyu, et al.
Publicado: (2025)
Guided by the Experts: Provable Feature Learning Dynamic of Soft-Routed Mixture-of-Experts
por: Liao, Fangshuo, et al.
Publicado: (2025)
por: Liao, Fangshuo, et al.
Publicado: (2025)
Reinforcement Learning under Latent Dynamics: Toward Statistical and Algorithmic Modularity
por: Amortila, Philip, et al.
Publicado: (2024)
por: Amortila, Philip, et al.
Publicado: (2024)
Dynamic Controlled Variables Based Dynamic Self-Optimizing Control
por: Zhou, Chenchen, et al.
Publicado: (2026)
por: Zhou, Chenchen, et al.
Publicado: (2026)
Which Features are Best for Successor Features?
por: Ollivier, Yann
Publicado: (2025)
por: Ollivier, Yann
Publicado: (2025)
A Modular Algorithm for Non-Stationary Online Convex-Concave Optimization
por: Meng, Qing-xin, et al.
Publicado: (2025)
por: Meng, Qing-xin, et al.
Publicado: (2025)
Implicit Regularization of Gradient Flow on One-Layer Softmax Attention
por: Sheen, Heejune, et al.
Publicado: (2024)
por: Sheen, Heejune, et al.
Publicado: (2024)
Shallow Neural Networks Learn Low-Degree Spherical Polynomials with Feature Learning by Learnable Channel Attention
por: Yang, Yingzhen
Publicado: (2025)
por: Yang, Yingzhen
Publicado: (2025)
Decision-Dependent Stochastic Optimization: The Role of Distribution Dynamics
por: He, Zhiyu, et al.
Publicado: (2025)
por: He, Zhiyu, et al.
Publicado: (2025)
Enhancing Unsupervised Feature Selection via Double Sparsity Constrained Optimization
por: Xiu, Xianchao, et al.
Publicado: (2025)
por: Xiu, Xianchao, et al.
Publicado: (2025)
A Re-solving Heuristic for Dynamic Assortment Optimization with Knapsack Constraints
por: Chen, Xi, et al.
Publicado: (2024)
por: Chen, Xi, et al.
Publicado: (2024)
A Theory of Feature Learning in Kernel Models
por: Chen, Yunlu, et al.
Publicado: (2023)
por: Chen, Yunlu, et al.
Publicado: (2023)
A Mechanism Study of Delayed Loss Spikes in Batch-Normalized Linear Models
por: Gao, Peifeng, et al.
Publicado: (2026)
por: Gao, Peifeng, et al.
Publicado: (2026)
Multi-level Monte-Carlo Gradient Methods for Stochastic Optimization with Biased Oracles
por: Hu, Yifan, et al.
Publicado: (2024)
por: Hu, Yifan, et al.
Publicado: (2024)
Bi-Sparse Unsupervised Feature Selection
por: Xiu, Xianchao, et al.
Publicado: (2024)
por: Xiu, Xianchao, et al.
Publicado: (2024)
Feature-Based Interpretable Surrogates for Optimization
por: Goerigk, Marc, et al.
Publicado: (2024)
por: Goerigk, Marc, et al.
Publicado: (2024)
Over-parameterised Shallow Neural Networks with Asymmetrical Node Scaling: Global Convergence Guarantees and Feature Learning
por: Caron, Francois, et al.
Publicado: (2023)
por: Caron, Francois, et al.
Publicado: (2023)
Negative Imaginary Neural ODEs: Learning to Control Mechanical Systems with Stability Guarantees
por: Shi, Kanghong, et al.
Publicado: (2025)
por: Shi, Kanghong, et al.
Publicado: (2025)
Random Features Approximation for Control-Affine Systems
por: Kazemian, Kimia, et al.
Publicado: (2024)
por: Kazemian, Kimia, et al.
Publicado: (2024)
A Compositional Kernel Model for Feature Learning
por: Ruan, Feng, et al.
Publicado: (2025)
por: Ruan, Feng, et al.
Publicado: (2025)
Supervised Feature Compression based on Counterfactual Analysis
por: Piccialli, Veronica, et al.
Publicado: (2022)
por: Piccialli, Veronica, et al.
Publicado: (2022)
Ejemplares similares
-
Unveiling Induction Heads: Provable Training Dynamics and Feature Learning in Transformers
por: Chen, Siyu, et al.
Publicado: (2024) -
Wasserstein Flow Meets Replicator Dynamics: A Mean-Field Analysis of Representation Learning in Actor-Critic
por: Zhang, Yufeng, et al.
Publicado: (2021) -
Training Dynamics of Multi-Head Softmax Attention for In-Context Learning: Emergence, Convergence, and Optimality
por: Chen, Siyu, et al.
Publicado: (2024) -
TwIST: Rigging the Lottery in Transformers with Independent Subnetwork Training
por: Menezes, Michael, et al.
Publicado: (2025) -
Principled Penalty-based Methods for Bilevel Reinforcement Learning and RLHF
por: Shen, Han, et al.
Publicado: (2024)