DiaBlo: Diagonal Blocks Are Sufficient For Finetuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Gurses, Selcuk, Zhang, Aozhong, Deng, Yanxia, Dong, Xun, Li, Xin, Wang, Naigang, Yin, Penghang, Yang, Zi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CLoQ: Enhancing Fine-Tuning of Quantized LLMs via Calibrated LoRA Initialization
di: Deng, Yanxia, et al.
Pubblicazione: (2025)
di: Deng, Yanxia, et al.
Pubblicazione: (2025)
MagR: Weight Magnitude Reduction for Enhancing Post-Training Quantization
di: Zhang, Aozhong, et al.
Pubblicazione: (2024)
di: Zhang, Aozhong, et al.
Pubblicazione: (2024)
Frayed RoPE and Long Inputs: A Geometric Perspective
di: Wertheimer, Davis, et al.
Pubblicazione: (2026)
di: Wertheimer, Davis, et al.
Pubblicazione: (2026)
Leveraging Large Language Models for Solving Rare MIP Challenges
di: Wang, Teng, et al.
Pubblicazione: (2024)
di: Wang, Teng, et al.
Pubblicazione: (2024)
Solving General Natural-Language-Description Optimization Problems with Large Language Models
di: Zhang, Jihai, et al.
Pubblicazione: (2024)
di: Zhang, Jihai, et al.
Pubblicazione: (2024)
Advances and Challenges in Semantic Textual Similarity: A Comprehensive Survey
di: Kumar, Lokendra, et al.
Pubblicazione: (2025)
di: Kumar, Lokendra, et al.
Pubblicazione: (2025)
Optimizer-Model Consistency: Full Finetuning with the Same Optimizer as Pretraining Forgets Less
di: Liu, Yuxing, et al.
Pubblicazione: (2026)
di: Liu, Yuxing, et al.
Pubblicazione: (2026)
A Block-Based Heuristic Algorithm for the Three-Dimensional Nuclear Waste Packing Problem
di: Wen, Yajie, et al.
Pubblicazione: (2025)
di: Wen, Yajie, et al.
Pubblicazione: (2025)
Unveiling Induction Heads: Provable Training Dynamics and Feature Learning in Transformers
di: Chen, Siyu, et al.
Pubblicazione: (2024)
di: Chen, Siyu, et al.
Pubblicazione: (2024)
Constraint-Anchored Attribution: Feasibility-Certified Counterfactuals and Bonferroni-PAC Sufficient Subsets for Neural CO Policies
di: Lafifi, Sohaib
Pubblicazione: (2026)
di: Lafifi, Sohaib
Pubblicazione: (2026)
A Method to Improve the Performance of Reinforcement Learning Based on the Y Operator for a Class of Stochastic Differential Equation-Based Child-Mother Systems
di: Yin, Cheng, et al.
Pubblicazione: (2023)
di: Yin, Cheng, et al.
Pubblicazione: (2023)
Data-Driven Exploration for a Class of Continuous-Time Indefinite Linear--Quadratic Reinforcement Learning Problems
di: Huang, Yilie, et al.
Pubblicazione: (2025)
di: Huang, Yilie, et al.
Pubblicazione: (2025)
ODE-based Learning to Optimize
di: Xie, Zhonglin, et al.
Pubblicazione: (2024)
di: Xie, Zhonglin, et al.
Pubblicazione: (2024)
ACING: Actor-Critic for Instruction Learning in Black-Box LLMs
di: Kharrat, Salma, et al.
Pubblicazione: (2024)
di: Kharrat, Salma, et al.
Pubblicazione: (2024)
ControlAgent: Automating Control System Design via Novel Integration of LLM Agents and Domain Expertise
di: Guo, Xingang, et al.
Pubblicazione: (2024)
di: Guo, Xingang, et al.
Pubblicazione: (2024)
Understanding Forgetting in LLM Supervised Fine-Tuning and Preference Learning -- A Convex Optimization Perspective
di: Fernando, Heshan, et al.
Pubblicazione: (2024)
di: Fernando, Heshan, et al.
Pubblicazione: (2024)
One-Shot Safety Alignment for Large Language Models via Optimal Dualization
di: Huang, Xinmeng, et al.
Pubblicazione: (2024)
di: Huang, Xinmeng, et al.
Pubblicazione: (2024)
Causal LLM Routing: End-to-End Regret Minimization from Observational Data
di: Tsiourvas, Asterios, et al.
Pubblicazione: (2025)
di: Tsiourvas, Asterios, et al.
Pubblicazione: (2025)
Reinforcement Learning from Human Feedback with Active Queries
di: Ji, Kaixuan, et al.
Pubblicazione: (2024)
di: Ji, Kaixuan, et al.
Pubblicazione: (2024)
Reward Collapse in Aligning Large Language Models
di: Song, Ziang, et al.
Pubblicazione: (2023)
di: Song, Ziang, et al.
Pubblicazione: (2023)
Variance-reduced Zeroth-Order Methods for Fine-Tuning Language Models
di: Gautam, Tanmay, et al.
Pubblicazione: (2024)
di: Gautam, Tanmay, et al.
Pubblicazione: (2024)
Variational Learning is Effective for Large Deep Networks
di: Shen, Yuesong, et al.
Pubblicazione: (2024)
di: Shen, Yuesong, et al.
Pubblicazione: (2024)
LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning
di: Pan, Rui, et al.
Pubblicazione: (2024)
di: Pan, Rui, et al.
Pubblicazione: (2024)
Transformers as Support Vector Machines
di: Tarzanagh, Davoud Ataee, et al.
Pubblicazione: (2023)
di: Tarzanagh, Davoud Ataee, et al.
Pubblicazione: (2023)
Gating is Weighting: Understanding Gated Linear Attention through In-context Learning
di: Li, Yingcong, et al.
Pubblicazione: (2025)
di: Li, Yingcong, et al.
Pubblicazione: (2025)
When and How Unlabeled Data Provably Improve In-Context Learning
di: Li, Yingcong, et al.
Pubblicazione: (2025)
di: Li, Yingcong, et al.
Pubblicazione: (2025)
Mechanics of Next Token Prediction with Self-Attention
di: Li, Yingcong, et al.
Pubblicazione: (2024)
di: Li, Yingcong, et al.
Pubblicazione: (2024)
When and Why SignSGD Outperforms SGD: A Theoretical Study Based on $\ell_1$-norm Lower Bounds
di: Tao, Hongyi, et al.
Pubblicazione: (2026)
di: Tao, Hongyi, et al.
Pubblicazione: (2026)
Fine-grained Analysis of In-context Linear Estimation: Data, Architecture, and Beyond
di: Li, Yingcong, et al.
Pubblicazione: (2024)
di: Li, Yingcong, et al.
Pubblicazione: (2024)
Sublinear Regret for a Class of Continuous-Time Linear-Quadratic Reinforcement Learning Problems
di: Huang, Yilie, et al.
Pubblicazione: (2024)
di: Huang, Yilie, et al.
Pubblicazione: (2024)
WANCO: Weak Adversarial Networks for Constrained Optimization problems
di: Bao, Gang, et al.
Pubblicazione: (2024)
di: Bao, Gang, et al.
Pubblicazione: (2024)
On the $O(\frac{\sqrt{d}}{T^{1/4}})$ Convergence Rate of RMSProp and Its Momentum Extension Measured by $\ell_1$ Norm
di: Li, Huan, et al.
Pubblicazione: (2024)
di: Li, Huan, et al.
Pubblicazione: (2024)
Wasserstein gradient flow for optimal probability measure decomposition
di: Han, Jiangze, et al.
Pubblicazione: (2024)
di: Han, Jiangze, et al.
Pubblicazione: (2024)
Reward-Directed Score-Based Diffusion Models via q-Learning
di: Gao, Xuefeng, et al.
Pubblicazione: (2024)
di: Gao, Xuefeng, et al.
Pubblicazione: (2024)
Stability of Primal-Dual Gradient Flow Dynamics for Multi-Block Convex Optimization Problems
di: Ozaslan, Ibrahim K., et al.
Pubblicazione: (2024)
di: Ozaslan, Ibrahim K., et al.
Pubblicazione: (2024)
Asynchronous Distributed Reinforcement Learning for LQR Control via Zeroth-Order Block Coordinate Descent
di: Jing, Gangshan, et al.
Pubblicazione: (2021)
di: Jing, Gangshan, et al.
Pubblicazione: (2021)
BenLOC: A Benchmark for Learning to Configure MIP Optimizers
di: Li, Hongpei, et al.
Pubblicazione: (2025)
di: Li, Hongpei, et al.
Pubblicazione: (2025)
Enhancing Stochastic Gradient Descent: A Unified Framework and Novel Acceleration Methods for Faster Convergence
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
Deep Reinforcement Learning Optimization for Uncertain Nonlinear Systems via Event-Triggered Robust Adaptive Dynamic Programming
di: Bai, Ningwei, et al.
Pubblicazione: (2025)
di: Bai, Ningwei, et al.
Pubblicazione: (2025)
To Cool or not to Cool? Temperature Network Meets Large Foundation Models via DRO
di: Qiu, Zi-Hao, et al.
Pubblicazione: (2024)
di: Qiu, Zi-Hao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
CLoQ: Enhancing Fine-Tuning of Quantized LLMs via Calibrated LoRA Initialization
di: Deng, Yanxia, et al.
Pubblicazione: (2025) -
MagR: Weight Magnitude Reduction for Enhancing Post-Training Quantization
di: Zhang, Aozhong, et al.
Pubblicazione: (2024) -
Frayed RoPE and Long Inputs: A Geometric Perspective
di: Wertheimer, Davis, et al.
Pubblicazione: (2026) -
Leveraging Large Language Models for Solving Rare MIP Challenges
di: Wang, Teng, et al.
Pubblicazione: (2024) -
Solving General Natural-Language-Description Optimization Problems with Large Language Models
di: Zhang, Jihai, et al.
Pubblicazione: (2024)