ARO: A New Lens On Matrix Optimization For Large Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Gong, Wenbo, Zazo, Javier, Luo, Qijun, Wang, Puqian, Hensman, James, Ma, Chao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MiMuon: Mixed Muon Optimizer with Improved Generalization for Large Models
por: Huang, Feihu, et al.
Publicado: (2026)
por: Huang, Feihu, et al.
Publicado: (2026)
Differentiable Distributionally Robust Optimization Layers
por: Ma, Xutao, et al.
Publicado: (2024)
por: Ma, Xutao, et al.
Publicado: (2024)
The Ky Fan Norms and Beyond: Dual Norms and Combinations for Matrix Optimization
por: Kravatskiy, Alexey, et al.
Publicado: (2025)
por: Kravatskiy, Alexey, et al.
Publicado: (2025)
From Large Language Models and Optimization to Decision Optimization CoPilot: A Research Manifesto
por: Wasserkrug, Segev, et al.
Publicado: (2024)
por: Wasserkrug, Segev, et al.
Publicado: (2024)
Data-Driven Portfolio Management for Motion Pictures Industry: A New Data-Driven Optimization Methodology Using a Large Language Model as the Expert
por: Alipour-Vaezi, Mohammad, et al.
Publicado: (2024)
por: Alipour-Vaezi, Mohammad, et al.
Publicado: (2024)
Uncovering Symmetry Transfer in Large Language Models via Layer-Peeled Optimization
por: Du, Zhehang, et al.
Publicado: (2026)
por: Du, Zhehang, et al.
Publicado: (2026)
Robustly Learning Monotone Single-Index Models
por: Wang, Puqian, et al.
Publicado: (2025)
por: Wang, Puqian, et al.
Publicado: (2025)
Neural Solver Selection for Combinatorial Optimization
por: Gao, Chengrui, et al.
Publicado: (2024)
por: Gao, Chengrui, et al.
Publicado: (2024)
Optimizer-Model Consistency: Full Finetuning with the Same Optimizer as Pretraining Forgets Less
por: Liu, Yuxing, et al.
Publicado: (2026)
por: Liu, Yuxing, et al.
Publicado: (2026)
Stochastic Optimization of Inventory at Large-scale Supply Chains
por: Jin, Zhaoyang Larry, et al.
Publicado: (2025)
por: Jin, Zhaoyang Larry, et al.
Publicado: (2025)
Quantization through Piecewise-Affine Regularization: Optimization and Statistical Guarantees
por: Ma, Jianhao, et al.
Publicado: (2025)
por: Ma, Jianhao, et al.
Publicado: (2025)
On the Optimal Construction of Unbiased Gradient Estimators for Zeroth-Order Optimization
por: Ma, Shaocong, et al.
Publicado: (2025)
por: Ma, Shaocong, et al.
Publicado: (2025)
Revisiting Zeroth-Order Optimization: Minimum-Variance Two-Point Estimators and Directionally Aligned Perturbations
por: Ma, Shaocong, et al.
Publicado: (2025)
por: Ma, Shaocong, et al.
Publicado: (2025)
New Hybrid Fine-Tuning Paradigm for LLMs: Algorithm Design and Convergence Analysis Framework
por: Ma, Shaocong, et al.
Publicado: (2026)
por: Ma, Shaocong, et al.
Publicado: (2026)
Self-Certifying Primal-Dual Optimization Proxies for Large-Scale Batch Economic Dispatch
por: Klamkin, Michael, et al.
Publicado: (2025)
por: Klamkin, Michael, et al.
Publicado: (2025)
OptiRepair: Closed-Loop Diagnosis and Repair of Supply Chain Optimization Models with LLM Agents
por: Ao, Ruicheng, et al.
Publicado: (2026)
por: Ao, Ruicheng, et al.
Publicado: (2026)
Constructing Industrial-Scale Optimization Modeling Benchmark
por: Li, Zhong, et al.
Publicado: (2026)
por: Li, Zhong, et al.
Publicado: (2026)
From Soliloquy to Agora: Memory-Enhanced LLM Agents with Decentralized Debate for Optimization Modeling
por: Lin, Jianghao, et al.
Publicado: (2026)
por: Lin, Jianghao, et al.
Publicado: (2026)
Learning-Guided Rolling Horizon Optimization for Long-Horizon Flexible Job-Shop Scheduling
por: Li, Sirui, et al.
Publicado: (2025)
por: Li, Sirui, et al.
Publicado: (2025)
A Minimalist Bayesian Framework for Stochastic Optimization
por: Wang, Kaizheng
Publicado: (2025)
por: Wang, Kaizheng
Publicado: (2025)
Solving General Natural-Language-Description Optimization Problems with Large Language Models
por: Zhang, Jihai, et al.
Publicado: (2024)
por: Zhang, Jihai, et al.
Publicado: (2024)
Global Convergence of Multiplicative Updates for the Matrix Mechanism: A Collaborative Proof with Gemini 3
por: Rush, Keith
Publicado: (2026)
por: Rush, Keith
Publicado: (2026)
DeMuon: A Decentralized Muon for Matrix Optimization over Graphs
por: He, Chuan, et al.
Publicado: (2025)
por: He, Chuan, et al.
Publicado: (2025)
Robust Reinforcement Learning in Finance: Modeling Market Impact with Elliptic Uncertainty Sets
por: Ma, Shaocong, et al.
Publicado: (2025)
por: Ma, Shaocong, et al.
Publicado: (2025)
LLM Serving Optimization with Variable Prefill and Decode Lengths
por: Wang, Meixuan, et al.
Publicado: (2025)
por: Wang, Meixuan, et al.
Publicado: (2025)
Isotropic Curvature Model for Understanding Deep Learning Optimization: Is Gradient Orthogonalization Optimal?
por: Su, Weijie
Publicado: (2025)
por: Su, Weijie
Publicado: (2025)
Unsupervised Training of Diffusion Models for Feasible Solution Generation in Neural Combinatorial Optimization
por: Hong, Seong-Hyun, et al.
Publicado: (2024)
por: Hong, Seong-Hyun, et al.
Publicado: (2024)
DT-PBO: an Interpretable Tree-based Surrogate Model for Preferential Bayesian Optimization
por: Leenders, Nick, et al.
Publicado: (2025)
por: Leenders, Nick, et al.
Publicado: (2025)
GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models
por: Zhao, Pengxiang, et al.
Publicado: (2025)
por: Zhao, Pengxiang, et al.
Publicado: (2025)
Contextual Distributionally Robust Optimization with Causal and Continuous Structure: An Interpretable and Tractable Approach
por: Zhang, Fenglin, et al.
Publicado: (2026)
por: Zhang, Fenglin, et al.
Publicado: (2026)
To Cool or not to Cool? Temperature Network Meets Large Foundation Models via DRO
por: Qiu, Zi-Hao, et al.
Publicado: (2024)
por: Qiu, Zi-Hao, et al.
Publicado: (2024)
Compressing Large Language Models using Low Rank and Low Precision Decomposition
por: Saha, Rajarshi, et al.
Publicado: (2024)
por: Saha, Rajarshi, et al.
Publicado: (2024)
Benchmarking PtO and PnO Methods in the Predictive Combinatorial Optimization Regime
por: Geng, Haoyu, et al.
Publicado: (2023)
por: Geng, Haoyu, et al.
Publicado: (2023)
Recursive Entropic Risk Optimization in Discounted MDPs: Sample Complexity Bounds with a Generative Model
por: Mortensen, Oliver, et al.
Publicado: (2025)
por: Mortensen, Oliver, et al.
Publicado: (2025)
Optimizing the Optimizer for Physics-Informed Neural Networks and Kolmogorov-Arnold Networks
por: Kiyani, Elham, et al.
Publicado: (2025)
por: Kiyani, Elham, et al.
Publicado: (2025)
The Newton-Muon Optimizer
por: Du, Zhehang, et al.
Publicado: (2026)
por: Du, Zhehang, et al.
Publicado: (2026)
Riemannian Bilevel Optimization
por: Dutta, Sanchayan, et al.
Publicado: (2024)
por: Dutta, Sanchayan, et al.
Publicado: (2024)
MetaOptimize: A Framework for Optimizing Step Sizes and Other Meta-parameters
por: Sharifnassab, Arsalan, et al.
Publicado: (2024)
por: Sharifnassab, Arsalan, et al.
Publicado: (2024)
AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models
por: Kutuzov, Nikolay, et al.
Publicado: (2025)
por: Kutuzov, Nikolay, et al.
Publicado: (2025)
StoSignSGD: Unbiased Structural Stochasticity Fixes SignSGD for Training Large Language Models
por: Yu, Dingzhi, et al.
Publicado: (2026)
por: Yu, Dingzhi, et al.
Publicado: (2026)
Ejemplares similares
-
MiMuon: Mixed Muon Optimizer with Improved Generalization for Large Models
por: Huang, Feihu, et al.
Publicado: (2026) -
Differentiable Distributionally Robust Optimization Layers
por: Ma, Xutao, et al.
Publicado: (2024) -
The Ky Fan Norms and Beyond: Dual Norms and Combinations for Matrix Optimization
por: Kravatskiy, Alexey, et al.
Publicado: (2025) -
From Large Language Models and Optimization to Decision Optimization CoPilot: A Research Manifesto
por: Wasserkrug, Segev, et al.
Publicado: (2024) -
Data-Driven Portfolio Management for Motion Pictures Industry: A New Data-Driven Optimization Methodology Using a Large Language Model as the Expert
por: Alipour-Vaezi, Mohammad, et al.
Publicado: (2024)