Q3R: Quadratic Reweighted Rank Regularizer for Effective Low-Rank Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Ghosh, Ipsita, Nguyen, Ethan, Kümmerle, Christian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Federated Dynamical Low-Rank Training with Global Loss Convergence Guarantees
di: Schotthöfer, Steffen, et al.
Pubblicazione: (2024)
di: Schotthöfer, Steffen, et al.
Pubblicazione: (2024)
Unbiased Gradient Low-Rank Projection
di: Pan, Rui, et al.
Pubblicazione: (2025)
di: Pan, Rui, et al.
Pubblicazione: (2025)
Recovering Simultaneously Structured Data via Non-Convex Iteratively Reweighted Least Squares
di: Kümmerle, Christian, et al.
Pubblicazione: (2023)
di: Kümmerle, Christian, et al.
Pubblicazione: (2023)
Compressing Large Language Models using Low Rank and Low Precision Decomposition
di: Saha, Rajarshi, et al.
Pubblicazione: (2024)
di: Saha, Rajarshi, et al.
Pubblicazione: (2024)
PoLAR: Polar-Decomposed Low-Rank Adapter Representation
di: Lion, Kai, et al.
Pubblicazione: (2025)
di: Lion, Kai, et al.
Pubblicazione: (2025)
One Rank at a Time: Cascading Error Dynamics in Sequential Learning
di: Vandchali, Mahtab Alizadeh, et al.
Pubblicazione: (2025)
di: Vandchali, Mahtab Alizadeh, et al.
Pubblicazione: (2025)
Robust Second-Order Nonconvex Optimization and Its Application to Low Rank Matrix Sensing
di: Li, Shuyao, et al.
Pubblicazione: (2024)
di: Li, Shuyao, et al.
Pubblicazione: (2024)
Asymptotic and Finite Sample Analysis of Nonexpansive Stochastic Approximations with Markovian Noise
di: Blaser, Ethan, et al.
Pubblicazione: (2024)
di: Blaser, Ethan, et al.
Pubblicazione: (2024)
Low-Rank Extragradient Method for Nonsmooth and Low-Rank Matrix Optimization Problems
di: Garber, Dan, et al.
Pubblicazione: (2022)
di: Garber, Dan, et al.
Pubblicazione: (2022)
Low-Rank Mirror-Prox for Nonsmooth and Low-Rank Matrix Optimization Problems
di: Garber, Dan, et al.
Pubblicazione: (2022)
di: Garber, Dan, et al.
Pubblicazione: (2022)
Data-driven Projection Generation for Efficiently Solving Heterogeneous Quadratic Programming Problems
di: Iwata, Tomoharu, et al.
Pubblicazione: (2025)
di: Iwata, Tomoharu, et al.
Pubblicazione: (2025)
Kernel-Free Universum Quadratic Surface Twin Support Vector Machines for Imbalanced Data
di: Moosaei, Hossein, et al.
Pubblicazione: (2024)
di: Moosaei, Hossein, et al.
Pubblicazione: (2024)
Comparing Few to Rank Many: Active Human Preference Learning using Randomized Frank-Wolfe
di: Thekumparampil, Kiran Koshy, et al.
Pubblicazione: (2024)
di: Thekumparampil, Kiran Koshy, et al.
Pubblicazione: (2024)
Sublinear Regret for a Class of Continuous-Time Linear-Quadratic Reinforcement Learning Problems
di: Huang, Yilie, et al.
Pubblicazione: (2024)
di: Huang, Yilie, et al.
Pubblicazione: (2024)
Quantization through Piecewise-Affine Regularization: Optimization and Statistical Guarantees
di: Ma, Jianhao, et al.
Pubblicazione: (2025)
di: Ma, Jianhao, et al.
Pubblicazione: (2025)
Implicit Regularization of Gradient Flow on One-Layer Softmax Attention
di: Sheen, Heejune, et al.
Pubblicazione: (2024)
di: Sheen, Heejune, et al.
Pubblicazione: (2024)
Universal Approximation Theorem for Deep Q-Learning via FBSDE System
di: Qi, Qian
Pubblicazione: (2025)
di: Qi, Qian
Pubblicazione: (2025)
Data-Driven Exploration for a Class of Continuous-Time Indefinite Linear--Quadratic Reinforcement Learning Problems
di: Huang, Yilie, et al.
Pubblicazione: (2025)
di: Huang, Yilie, et al.
Pubblicazione: (2025)
Nash Equilibria, Regularization and Computation in Optimal Transport-Based Distributionally Robust Optimization
di: Shafiee, Soroosh, et al.
Pubblicazione: (2023)
di: Shafiee, Soroosh, et al.
Pubblicazione: (2023)
Fitted Q-Iteration via Max-Plus-Linear Approximation
di: Liu, Y., et al.
Pubblicazione: (2024)
di: Liu, Y., et al.
Pubblicazione: (2024)
Random Subspace Cubic-Regularization Methods, with Applications to Low-Rank Functions
di: Cartis, Coralia, et al.
Pubblicazione: (2025)
di: Cartis, Coralia, et al.
Pubblicazione: (2025)
Reweighted Quasi Norm Regularized Low-Rank Factorization for Matrix Robust PCA
di: Qin, Zhenzhi, et al.
Pubblicazione: (2024)
di: Qin, Zhenzhi, et al.
Pubblicazione: (2024)
A Deep Q-Network Based on Radial Basis Functions for Multi-Echelon Inventory Management
di: Cheng, Liqiang, et al.
Pubblicazione: (2024)
di: Cheng, Liqiang, et al.
Pubblicazione: (2024)
Effective Frontiers: A Unification of Neural Scaling Laws
di: Zou, Jiaxuan, et al.
Pubblicazione: (2026)
di: Zou, Jiaxuan, et al.
Pubblicazione: (2026)
Training Infinitely Deep and Wide Transformers
di: Barboni, Raphaël, et al.
Pubblicazione: (2026)
di: Barboni, Raphaël, et al.
Pubblicazione: (2026)
Compact Lifted Relaxations for Low-Rank Optimization
di: Cory-Wright, Ryan, et al.
Pubblicazione: (2026)
di: Cory-Wright, Ryan, et al.
Pubblicazione: (2026)
Heaviside Low-Rank Support Matrix Machine
di: Xiu, Xianchao, et al.
Pubblicazione: (2026)
di: Xiu, Xianchao, et al.
Pubblicazione: (2026)
Q-Learning under Finite Model Uncertainty
di: Sester, Julian, et al.
Pubblicazione: (2024)
di: Sester, Julian, et al.
Pubblicazione: (2024)
Accelerating RLHF Training with Reward Variance Increase
di: Yang, Zonglin, et al.
Pubblicazione: (2025)
di: Yang, Zonglin, et al.
Pubblicazione: (2025)
Anytime Training with Schedule-Free Spectral Optimization
di: Apte, Anuj, et al.
Pubblicazione: (2026)
di: Apte, Anuj, et al.
Pubblicazione: (2026)
Understanding Sampler Stochasticity in Training Diffusion Models for RLHF
di: Sheng, Jiayuan, et al.
Pubblicazione: (2025)
di: Sheng, Jiayuan, et al.
Pubblicazione: (2025)
Training Safe Neural Networks with Global SDP Bounds
di: Soletskyi, Roman, et al.
Pubblicazione: (2024)
di: Soletskyi, Roman, et al.
Pubblicazione: (2024)
Qronos: Correcting the Past by Shaping the Future... in Post-Training Quantization
di: Zhang, Shihao, et al.
Pubblicazione: (2025)
di: Zhang, Shihao, et al.
Pubblicazione: (2025)
Multi-Year Maintenance Planning for Large-Scale Infrastructure Systems: A Novel Network Deep Q-Learning Approach
di: Fard, Amir, et al.
Pubblicazione: (2025)
di: Fard, Amir, et al.
Pubblicazione: (2025)
The Optimiser Hidden in Plain Sight: Training with the Loss Landscape's Induced Metric
di: Harvey, Thomas R.
Pubblicazione: (2025)
di: Harvey, Thomas R.
Pubblicazione: (2025)
Seesaw: Accelerating Training by Balancing Learning Rate and Batch Size Scheduling
di: Meterez, Alexandru, et al.
Pubblicazione: (2025)
di: Meterez, Alexandru, et al.
Pubblicazione: (2025)
The Sharpness Disparity Principle in Transformers for Accelerating Language Model Pre-Training
di: Wang, Jinbo, et al.
Pubblicazione: (2025)
di: Wang, Jinbo, et al.
Pubblicazione: (2025)
Efficient Model-Free Exploration in Low-Rank MDPs
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2023)
di: Mhammedi, Zakaria, et al.
Pubblicazione: (2023)
Low-Rank Extragradient Methods for Scalable Semidefinite Optimization
di: Garber, Dan, et al.
Pubblicazione: (2024)
di: Garber, Dan, et al.
Pubblicazione: (2024)
Provable Exactness for Asymmetric Low-Rank SDP Learning
di: Hu, Enliang
Pubblicazione: (2018)
di: Hu, Enliang
Pubblicazione: (2018)
Documenti analoghi
-
Federated Dynamical Low-Rank Training with Global Loss Convergence Guarantees
di: Schotthöfer, Steffen, et al.
Pubblicazione: (2024) -
Unbiased Gradient Low-Rank Projection
di: Pan, Rui, et al.
Pubblicazione: (2025) -
Recovering Simultaneously Structured Data via Non-Convex Iteratively Reweighted Least Squares
di: Kümmerle, Christian, et al.
Pubblicazione: (2023) -
Compressing Large Language Models using Low Rank and Low Precision Decomposition
di: Saha, Rajarshi, et al.
Pubblicazione: (2024) -
PoLAR: Polar-Decomposed Low-Rank Adapter Representation
di: Lion, Kai, et al.
Pubblicazione: (2025)