MKOR: Momentum-Enabled Kronecker-Factor-Based Optimizer Using Rank-1 Updates
Fuente:
arXiv
Guardado en:
| Autores principales: | Mozaffari, Mohammad, Li, Sikan, Zhang, Zhao, Dehnavi, Maryam Mehri |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SLoPe: Double-Pruned Sparse Plus Lazy Low-Rank Adapter Pretraining of LLMs
por: Mozaffari, Mohammad, et al.
Publicado: (2024)
por: Mozaffari, Mohammad, et al.
Publicado: (2024)
Conjugate-Gradient-like Based Adaptive Moment Estimation Optimization Algorithm for Deep Learning
por: Tian, Jiawu, et al.
Publicado: (2024)
por: Tian, Jiawu, et al.
Publicado: (2024)
Exposing Diversity Bias in Deep Generative Models: Statistical Origins and Correction of Diversity Error
por: Farnia, Farzan, et al.
Publicado: (2026)
por: Farnia, Farzan, et al.
Publicado: (2026)
Unsupervised Point Cloud Pre-Training via Contrasting and Clustering
por: Mei, Guofeng, et al.
Publicado: (2022)
por: Mei, Guofeng, et al.
Publicado: (2022)
LORE: Lagrangian-Optimized Robust Embeddings for Visual Encoders
por: Khodabandeh, Borna, et al.
Publicado: (2025)
por: Khodabandeh, Borna, et al.
Publicado: (2025)
Amortized Guidance for Image Inpainting with Pretrained Diffusion Models
por: Huang, Yilie, et al.
Publicado: (2026)
por: Huang, Yilie, et al.
Publicado: (2026)
SLiM: One-shot Quantization and Sparsity with Low-rank Approximation for LLM Weight Compression
por: Mozaffari, Mohammad, et al.
Publicado: (2024)
por: Mozaffari, Mohammad, et al.
Publicado: (2024)
PATCH: Learnable Tile-level Hybrid Sparsity for LLMs
por: Hourri, Younes, et al.
Publicado: (2025)
por: Hourri, Younes, et al.
Publicado: (2025)
Training-free Diffusion Model Alignment with Sampling Demons
por: Yeh, Po-Hung, et al.
Publicado: (2024)
por: Yeh, Po-Hung, et al.
Publicado: (2024)
EMC$^2$: Efficient MCMC Negative Sampling for Contrastive Learning with Global Convergence
por: Yau, Chung-Yiu, et al.
Publicado: (2024)
por: Yau, Chung-Yiu, et al.
Publicado: (2024)
Provably Learning Diverse Features in Multi-View Data with Midpoint Mixup
por: Chidambaram, Muthu, et al.
Publicado: (2022)
por: Chidambaram, Muthu, et al.
Publicado: (2022)
Pattern based learning and optimisation through pricing for bin packing problem
por: Zhang, Huayan, et al.
Publicado: (2024)
por: Zhang, Huayan, et al.
Publicado: (2024)
Dynamic Network Flow Optimization for Task Scheduling in PTZ Camera Surveillance Systems
por: Merati, Mohammad, et al.
Publicado: (2025)
por: Merati, Mohammad, et al.
Publicado: (2025)
OPTIMA: Optimal One-shot Pruning for LLMs via Quadratic Programming Reconstruction
por: Mozaffari, Mohammad, et al.
Publicado: (2025)
por: Mozaffari, Mohammad, et al.
Publicado: (2025)
Tensor Completion via Monotone Inclusion: Generalized Low-Rank Priors Meet Deep Denoisers
por: Chen, Peng, et al.
Publicado: (2025)
por: Chen, Peng, et al.
Publicado: (2025)
Tensor-Based Synchronization and the Low-Rankness of the Block Trifocal Tensor
por: Miao, Daniel, et al.
Publicado: (2024)
por: Miao, Daniel, et al.
Publicado: (2024)
A Robust Low-Rank Prior Model for Structured Cartoon-Texture Image Decomposition with Heavy-Tailed Noise
por: Tang, Weihao, et al.
Publicado: (2026)
por: Tang, Weihao, et al.
Publicado: (2026)
OCP-GN: A Scalable Second-order Optimizer for Stochastic Optimization
por: Zhong, Jindi, et al.
Publicado: (2025)
por: Zhong, Jindi, et al.
Publicado: (2025)
Real-Time Bundle Adjustment for Ultra-High-Resolution UAV Imagery Using Adaptive Patch-Based Feature Tracking
por: Iz, Selim Ahmet, et al.
Publicado: (2025)
por: Iz, Selim Ahmet, et al.
Publicado: (2025)
PyHySCO: GPU-Enabled Susceptibility Artifact Distortion Correction in Seconds
por: Julian, Abigail, et al.
Publicado: (2024)
por: Julian, Abigail, et al.
Publicado: (2024)
Identifying and Understanding Cross-Class Features in Adversarial Training
por: Wei, Zeming, et al.
Publicado: (2025)
por: Wei, Zeming, et al.
Publicado: (2025)
Decentralized Personalized Federated Learning
por: Kharrat, Salma, et al.
Publicado: (2024)
por: Kharrat, Salma, et al.
Publicado: (2024)
Calibrated Adversarial Sampling: Multi-Armed Bandit-Guided Generalization Against Unforeseen Attacks
por: Wang, Rui, et al.
Publicado: (2025)
por: Wang, Rui, et al.
Publicado: (2025)
SMI: Statistical Membership Inference for Reliable Unlearned Model Auditing
por: Sun, Jialong, et al.
Publicado: (2026)
por: Sun, Jialong, et al.
Publicado: (2026)
Low Rank Support Quaternion Matrix Machine
por: Chen, Wang, et al.
Publicado: (2025)
por: Chen, Wang, et al.
Publicado: (2025)
RODS: Robust Optimization Inspired Diffusion Sampling for Detecting and Reducing Hallucination in Generative Models
por: Tian, Yiqi, et al.
Publicado: (2025)
por: Tian, Yiqi, et al.
Publicado: (2025)
Deep Unrolled Meta-Learning for Multi-Coil and Multi-Modality MRI with Adaptive Optimization
por: Fouladvand, Merham, et al.
Publicado: (2025)
por: Fouladvand, Merham, et al.
Publicado: (2025)
A Brief Overview of Optimization-Based Algorithms for MRI Reconstruction Using Deep Learning
por: Bian, Wanyu
Publicado: (2024)
por: Bian, Wanyu
Publicado: (2024)
Low Rank Groupwise Deformations for Motion Tracking in Cardiac Cine MRI
por: Rendell, Sean, et al.
Publicado: (2024)
por: Rendell, Sean, et al.
Publicado: (2024)
Building Rome with Convex Optimization
por: Han, Haoyu, et al.
Publicado: (2025)
por: Han, Haoyu, et al.
Publicado: (2025)
Quaternion Nonlinear Transform-Induced Nuclear Norm for Low-Rank Tensor Completion
por: Karmakar, Biswarup, et al.
Publicado: (2026)
por: Karmakar, Biswarup, et al.
Publicado: (2026)
Integer Optimization of CT Trajectories using a Discrete Data Completeness Formulation
por: Schneider, Linda-Sophie, et al.
Publicado: (2024)
por: Schneider, Linda-Sophie, et al.
Publicado: (2024)
Canonical Factors for Hybrid Neural Fields
por: Yi, Brent, et al.
Publicado: (2023)
por: Yi, Brent, et al.
Publicado: (2023)
Double Momentum Method for Lower-Level Constrained Bilevel Optimization
por: Shi, Wanli, et al.
Publicado: (2024)
por: Shi, Wanli, et al.
Publicado: (2024)
Optimal Fiducial Marker Placement for Satellite Proximity Operations Using Observability Gramians
por: Andrews, Nicholas B., et al.
Publicado: (2025)
por: Andrews, Nicholas B., et al.
Publicado: (2025)
On Distributed Larger-Than-Memory Subset Selection With Pairwise Submodular Functions
por: Böther, Maximilian, et al.
Publicado: (2024)
por: Böther, Maximilian, et al.
Publicado: (2024)
FreeAugment: Data Augmentation Search Across All Degrees of Freedom
por: Bekor, Tom, et al.
Publicado: (2024)
por: Bekor, Tom, et al.
Publicado: (2024)
On the $O(\frac{\sqrt{d}}{T^{1/4}})$ Convergence Rate of RMSProp and Its Momentum Extension Measured by $\ell_1$ Norm
por: Li, Huan, et al.
Publicado: (2024)
por: Li, Huan, et al.
Publicado: (2024)
Hindsight-Guided Momentum (HGM) Optimizer: An Approach to Adaptive Learning Rate
por: Sarkar, Krisanu
Publicado: (2025)
por: Sarkar, Krisanu
Publicado: (2025)
Interpreting and Improving Diffusion Models from an Optimization Perspective
por: Permenter, Frank, et al.
Publicado: (2023)
por: Permenter, Frank, et al.
Publicado: (2023)
Ejemplares similares
-
SLoPe: Double-Pruned Sparse Plus Lazy Low-Rank Adapter Pretraining of LLMs
por: Mozaffari, Mohammad, et al.
Publicado: (2024) -
Conjugate-Gradient-like Based Adaptive Moment Estimation Optimization Algorithm for Deep Learning
por: Tian, Jiawu, et al.
Publicado: (2024) -
Exposing Diversity Bias in Deep Generative Models: Statistical Origins and Correction of Diversity Error
por: Farnia, Farzan, et al.
Publicado: (2026) -
Unsupervised Point Cloud Pre-Training via Contrasting and Clustering
por: Mei, Guofeng, et al.
Publicado: (2022) -
LORE: Lagrangian-Optimized Robust Embeddings for Visual Encoders
por: Khodabandeh, Borna, et al.
Publicado: (2025)