Enregistré dans:
| Auteurs principaux: | Bu, Zhiqi, Xu, Shiyun, Mao, Jialin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.07145 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Understanding Forgetting in LLM Supervised Fine-Tuning and Preference Learning -- A Convex Optimization Perspective
par: Fernando, Heshan, et autres
Publié: (2024)
par: Fernando, Heshan, et autres
Publié: (2024)
Gradient descent with generalized Newton's method
par: Bu, Zhiqi, et autres
Publié: (2024)
par: Bu, Zhiqi, et autres
Publié: (2024)
Variational Learning is Effective for Large Deep Networks
par: Shen, Yuesong, et autres
Publié: (2024)
par: Shen, Yuesong, et autres
Publié: (2024)
Grokking or Glitching? How Low-Precision Drives Slingshot Loss Spikes
par: Hanqing, Liu, et autres
Publié: (2026)
par: Hanqing, Liu, et autres
Publié: (2026)
Deep Reinforcement Learning: A Convex Optimization Approach
par: Gattami, Ather
Publié: (2024)
par: Gattami, Ather
Publié: (2024)
Wasserstein Distributionally Robust Regret Optimization for Reinforcement Learning from Human Feedback
par: Wang, Yikai, et autres
Publié: (2026)
par: Wang, Yikai, et autres
Publié: (2026)
The Surprising Agreement Between Convex Optimization Theory and Learning-Rate Scheduling for Large Model Training
par: Schaipp, Fabian, et autres
Publié: (2025)
par: Schaipp, Fabian, et autres
Publié: (2025)
ACING: Actor-Critic for Instruction Learning in Black-Box LLMs
par: Kharrat, Salma, et autres
Publié: (2024)
par: Kharrat, Salma, et autres
Publié: (2024)
Muon in Associative Memory Learning: Training Dynamics and Scaling Laws
par: Li, Binghui, et autres
Publié: (2026)
par: Li, Binghui, et autres
Publié: (2026)
Reinforcement Learning from Human Feedback with Active Queries
par: Ji, Kaixuan, et autres
Publié: (2024)
par: Ji, Kaixuan, et autres
Publié: (2024)
In-Context Learning with Representations: Contextual Generalization of Trained Transformers
par: Yang, Tong, et autres
Publié: (2024)
par: Yang, Tong, et autres
Publié: (2024)
CRONOS: Enhancing Deep Learning with Scalable GPU Accelerated Convex Neural Networks
par: Feng, Miria, et autres
Publié: (2024)
par: Feng, Miria, et autres
Publié: (2024)
When and How Unlabeled Data Provably Improve In-Context Learning
par: Li, Yingcong, et autres
Publié: (2025)
par: Li, Yingcong, et autres
Publié: (2025)
Online Learning on Hidden-Convex Losses via Algorithmic Equivalence: Optimal Regret, Geometric Barrier, and Bandit Feedback
par: Barakat, Anas, et autres
Publié: (2026)
par: Barakat, Anas, et autres
Publié: (2026)
Unveiling Induction Heads: Provable Training Dynamics and Feature Learning in Transformers
par: Chen, Siyu, et autres
Publié: (2024)
par: Chen, Siyu, et autres
Publié: (2024)
Gating is Weighting: Understanding Gated Linear Attention through In-context Learning
par: Li, Yingcong, et autres
Publié: (2025)
par: Li, Yingcong, et autres
Publié: (2025)
AutoGD: Automatic Learning Rate Selection for Gradient Descent
par: Surjanovic, Nikola, et autres
Publié: (2025)
par: Surjanovic, Nikola, et autres
Publié: (2025)
Optimal Rates for Robust Stochastic Convex Optimization
par: Gao, Changyu, et autres
Publié: (2024)
par: Gao, Changyu, et autres
Publié: (2024)
Learning to optimize: A tutorial for continuous and mixed-integer optimization
par: Chen, Xiaohan, et autres
Publié: (2024)
par: Chen, Xiaohan, et autres
Publié: (2024)
Sophia: A Scalable Stochastic Second-order Optimizer for Language Model Pre-training
par: Liu, Hong, et autres
Publié: (2023)
par: Liu, Hong, et autres
Publié: (2023)
A Unified Understanding of Offline Data Selection and Online Self-refining Generation for Post-training LLMs
par: Xiao, Quan, et autres
Publié: (2025)
par: Xiao, Quan, et autres
Publié: (2025)
AutoSGD: Automatic Learning Rate Selection for Stochastic Gradient Descent
par: Surjanovic, Nikola, et autres
Publié: (2025)
par: Surjanovic, Nikola, et autres
Publié: (2025)
CLASP: An online learning algorithm for Convex Losses And Squared Penalties
par: Ferreira, Ricardo N., et autres
Publié: (2026)
par: Ferreira, Ricardo N., et autres
Publié: (2026)
Private Federated Learning Without a Trusted Server: Optimal Algorithms for Convex Losses
par: Lowy, Andrew, et autres
Publié: (2021)
par: Lowy, Andrew, et autres
Publié: (2021)
Sign-Based Optimizers Are Effective Under Heavy-Tailed Noise
par: Yu, Dingzhi, et autres
Publié: (2026)
par: Yu, Dingzhi, et autres
Publié: (2026)
Adapprox: Adaptive Approximation in Adam Optimization via Randomized Low-Rank Matrices
par: Zhao, Pengxiang, et autres
Publié: (2024)
par: Zhao, Pengxiang, et autres
Publié: (2024)
COS-DPO: Conditioned One-Shot Multi-Objective Fine-Tuning Framework
par: Ren, Yinuo, et autres
Publié: (2024)
par: Ren, Yinuo, et autres
Publié: (2024)
Distributional Surgery for Language Model Activations
par: Nguyen, Bao, et autres
Publié: (2025)
par: Nguyen, Bao, et autres
Publié: (2025)
FOCUS: First Order Concentrated Updating Scheme
par: Liu, Yizhou, et autres
Publié: (2025)
par: Liu, Yizhou, et autres
Publié: (2025)
Heavy-Tailed Class Imbalance and Why Adam Outperforms Gradient Descent on Language Models
par: Kunstner, Frederik, et autres
Publié: (2024)
par: Kunstner, Frederik, et autres
Publié: (2024)
SUMO: Subspace-Aware Moment-Orthogonalization for Accelerating Memory-Efficient LLM Training
par: Refael, Yehonathan, et autres
Publié: (2025)
par: Refael, Yehonathan, et autres
Publié: (2025)
Accelerated Rates between Stochastic and Adversarial Online Convex Optimization
par: Sachs, Sarah, et autres
Publié: (2023)
par: Sachs, Sarah, et autres
Publié: (2023)
Interpreting Adaptive Gradient Methods by Parameter Scaling for Learning-Rate-Free Optimization
par: Suh, Min-Kook, et autres
Publié: (2024)
par: Suh, Min-Kook, et autres
Publié: (2024)
BOOOM: Loss-Function-Agnostic Black-Box Optimization over Orthonormal Manifolds for Machine Learning and Statistical Inference
par: Kim, Beomchang, et autres
Publié: (2026)
par: Kim, Beomchang, et autres
Publié: (2026)
Operator Splitting for Learning to Predict Equilibria in Convex Games
par: McKenzie, Daniel, et autres
Publié: (2021)
par: McKenzie, Daniel, et autres
Publié: (2021)
First-Order Sparse Convex Optimization: Better Rates with Sparse Updates
par: Garber, Dan
Publié: (2025)
par: Garber, Dan
Publié: (2025)
Learning Algorithm Hyperparameters for Fast Parametric Convex Optimization
par: Sambharya, Rajiv, et autres
Publié: (2024)
par: Sambharya, Rajiv, et autres
Publié: (2024)
Learning-Augmented Decentralized Online Convex Optimization in Networks
par: Li, Pengfei, et autres
Publié: (2023)
par: Li, Pengfei, et autres
Publié: (2023)
Universal Architectures for the Learning of Polyhedral Norms and Convex Regularizers
par: Unser, Michael, et autres
Publié: (2025)
par: Unser, Michael, et autres
Publié: (2025)
Online (Non-)Convex Learning via Tempered Optimism
par: Haddouche, Maxime, et autres
Publié: (2023)
par: Haddouche, Maxime, et autres
Publié: (2023)
Documents similaires
-
Understanding Forgetting in LLM Supervised Fine-Tuning and Preference Learning -- A Convex Optimization Perspective
par: Fernando, Heshan, et autres
Publié: (2024) -
Gradient descent with generalized Newton's method
par: Bu, Zhiqi, et autres
Publié: (2024) -
Variational Learning is Effective for Large Deep Networks
par: Shen, Yuesong, et autres
Publié: (2024) -
Grokking or Glitching? How Low-Precision Drives Slingshot Loss Spikes
par: Hanqing, Liu, et autres
Publié: (2026) -
Deep Reinforcement Learning: A Convex Optimization Approach
par: Gattami, Ather
Publié: (2024)