Universally Empowering Zeroth-Order Optimization via Adaptive Layer-wise Sampling
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Fei, Shen, Li, Ding, Liang, Xue, Chao, Liu, Ye, Ding, Changxing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Simultaneous Computation and Memory Efficient Zeroth-Order Optimizer for Fine-Tuning Large Language Models
di: Wang, Fei, et al.
Pubblicazione: (2024)
di: Wang, Fei, et al.
Pubblicazione: (2024)
Layer as Puzzle Pieces: Compressing Large Language Models through Layer Concatenation
di: Wang, Fei, et al.
Pubblicazione: (2025)
di: Wang, Fei, et al.
Pubblicazione: (2025)
TeZO: Empowering the Low-Rankness on the Temporal Dimension in the Zeroth-Order Optimization for Fine-tuning LLMs
di: Sun, Yan, et al.
Pubblicazione: (2025)
di: Sun, Yan, et al.
Pubblicazione: (2025)
HELENE: Hessian Layer-wise Clipping and Gradient Annealing for Accelerating Fine-tuning LLM with Zeroth-order Optimization
di: Zhao, Huaqin, et al.
Pubblicazione: (2024)
di: Zhao, Huaqin, et al.
Pubblicazione: (2024)
On Adaptivity in Zeroth-Order Optimization
di: Dbouk, Hassan, et al.
Pubblicazione: (2026)
di: Dbouk, Hassan, et al.
Pubblicazione: (2026)
LLM Zeroth-Order Fine-Tuning is an Inference Workload
di: Li, Zelin, et al.
Pubblicazione: (2026)
di: Li, Zelin, et al.
Pubblicazione: (2026)
Refining Adaptive Zeroth-Order Optimization at Ease
di: Shu, Yao, et al.
Pubblicazione: (2025)
di: Shu, Yao, et al.
Pubblicazione: (2025)
Zeroth-Order Optimization at the Edge of Stability
di: Song, Minhak, et al.
Pubblicazione: (2026)
di: Song, Minhak, et al.
Pubblicazione: (2026)
Efficient Federated RLHF via Zeroth-Order Policy Optimization
di: Wang, Deyi, et al.
Pubblicazione: (2026)
di: Wang, Deyi, et al.
Pubblicazione: (2026)
Private Zeroth-Order Optimization with Public Data
di: Gong, Xuchen, et al.
Pubblicazione: (2025)
di: Gong, Xuchen, et al.
Pubblicazione: (2025)
Model Evolution Under Zeroth-Order Optimization: A Neural Tangent Kernel Perspective
di: Zhang, Chen, et al.
Pubblicazione: (2026)
di: Zhang, Chen, et al.
Pubblicazione: (2026)
Learning Dynamics of Zeroth-Order Optimization: A Kernel Perspective
di: Li, Zhe, et al.
Pubblicazione: (2026)
di: Li, Zhe, et al.
Pubblicazione: (2026)
Zeroth-Order Optimization Finds Flat Minima
di: Zhang, Liang, et al.
Pubblicazione: (2025)
di: Zhang, Liang, et al.
Pubblicazione: (2025)
Beyond Human Data: Aligning Multimodal Large Language Models by Iterative Self-Evolution
di: Tan, Wentao, et al.
Pubblicazione: (2024)
di: Tan, Wentao, et al.
Pubblicazione: (2024)
Alternating Diffusion for Proximal Sampling with Zeroth Order Queries
di: Takagi, Hirohane, et al.
Pubblicazione: (2026)
di: Takagi, Hirohane, et al.
Pubblicazione: (2026)
The Multi-Query Paradox in Zeroth-Order Optimization
di: Lin, Wei, et al.
Pubblicazione: (2025)
di: Lin, Wei, et al.
Pubblicazione: (2025)
Position: Zeroth-Order Optimization in Deep Learning Is Underexplored, Not Underpowered
di: Liu, Sijia, et al.
Pubblicazione: (2026)
di: Liu, Sijia, et al.
Pubblicazione: (2026)
Robust and Efficient Zeroth-Order LLM Fine-Tuning via Adaptive Bayesian Subspace Optimizer
di: Feng, Jian, et al.
Pubblicazione: (2026)
di: Feng, Jian, et al.
Pubblicazione: (2026)
Learning a Zeroth-Order Optimizer for Fine-Tuning LLMs
di: Zhang, Kairun, et al.
Pubblicazione: (2025)
di: Zhang, Kairun, et al.
Pubblicazione: (2025)
Zeroth-Order Optimization is Secretly Single-Step Policy Optimization
di: Qiu, Junbin, et al.
Pubblicazione: (2025)
di: Qiu, Junbin, et al.
Pubblicazione: (2025)
Effortless Active Labeling for Long-Term Test-Time Adaptation
di: Wang, Guowei, et al.
Pubblicazione: (2025)
di: Wang, Guowei, et al.
Pubblicazione: (2025)
Second-Order Fine-Tuning without Pain for LLMs:A Hessian Informed Zeroth-Order Optimizer
di: Zhao, Yanjun, et al.
Pubblicazione: (2024)
di: Zhao, Yanjun, et al.
Pubblicazione: (2024)
Achieving Dimension-Free Communication in Federated Learning via Zeroth-Order Optimization
di: Li, Zhe, et al.
Pubblicazione: (2024)
di: Li, Zhe, et al.
Pubblicazione: (2024)
Privacy Amplification in Differentially Private Zeroth-Order Optimization with Hidden States
di: Chien, Eli, et al.
Pubblicazione: (2025)
di: Chien, Eli, et al.
Pubblicazione: (2025)
ChartMaster: Advancing Chart-to-Code Generation with Real-World Charts and Chart Similarity Reinforcement Learning
di: Tan, Wentao, et al.
Pubblicazione: (2025)
di: Tan, Wentao, et al.
Pubblicazione: (2025)
Powering Up Zeroth-Order Training via Subspace Gradient Orthogonalization
di: Lang, Yicheng, et al.
Pubblicazione: (2026)
di: Lang, Yicheng, et al.
Pubblicazione: (2026)
On-Device Fine-Tuning via Backprop-Free Zeroth-Order Optimization
di: Katti, Prabodh, et al.
Pubblicazione: (2025)
di: Katti, Prabodh, et al.
Pubblicazione: (2025)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
di: Liu, Zongkai, et al.
Pubblicazione: (2024)
di: Liu, Zongkai, et al.
Pubblicazione: (2024)
CurvZO: Adaptive Curvature-Guided Sparse Zeroth-Order Optimization for Efficient LLM Fine-Tuning
di: Wang, Shuo, et al.
Pubblicazione: (2026)
di: Wang, Shuo, et al.
Pubblicazione: (2026)
Stochastic Dimension-Free Zeroth-Order Estimator for High-Dimensional and High-Order PINNs
di: Liang, Zhangyong, et al.
Pubblicazione: (2026)
di: Liang, Zhangyong, et al.
Pubblicazione: (2026)
Compander-Aligned Query Geometry for Quantized Zeroth-Order Optimization
di: Shu, Yao, et al.
Pubblicazione: (2026)
di: Shu, Yao, et al.
Pubblicazione: (2026)
DeepZero: Scaling up Zeroth-Order Optimization for Deep Model Training
di: Chen, Aochuan, et al.
Pubblicazione: (2023)
di: Chen, Aochuan, et al.
Pubblicazione: (2023)
Stochastic Zeroth-Order Optimization under Strongly Convexity and Lipschitz Hessian: Minimax Sample Complexity
di: Yu, Qian, et al.
Pubblicazione: (2024)
di: Yu, Qian, et al.
Pubblicazione: (2024)
An Enhanced Zeroth-Order Stochastic Frank-Wolfe Framework for Constrained Finite-Sum Optimization
di: Ye, Haishan, et al.
Pubblicazione: (2025)
di: Ye, Haishan, et al.
Pubblicazione: (2025)
MISA: Memory-Efficient LLMs Optimization with Module-wise Importance Sampling
di: Liu, Yuxi, et al.
Pubblicazione: (2025)
di: Liu, Yuxi, et al.
Pubblicazione: (2025)
Stochastic Regret Guarantees for Online Zeroth- and First-Order Bilevel Optimization
di: Nazari, Parvin, et al.
Pubblicazione: (2025)
di: Nazari, Parvin, et al.
Pubblicazione: (2025)
DLink: Distilling Layer-wise and Dominant Knowledge from EEG Foundation Models
di: Wang, Jingyuan, et al.
Pubblicazione: (2026)
di: Wang, Jingyuan, et al.
Pubblicazione: (2026)
Zeroth-Order Sampling Methods for Non-Log-Concave Distributions: Alleviating Metastability by Denoising Diffusion
di: He, Ye, et al.
Pubblicazione: (2024)
di: He, Ye, et al.
Pubblicazione: (2024)
Certified Multi-Fidelity Zeroth-Order Optimization
di: de Montbrun, Étienne, et al.
Pubblicazione: (2023)
di: de Montbrun, Étienne, et al.
Pubblicazione: (2023)
Private Zeroth-Order Nonsmooth Nonconvex Optimization
di: Zhang, Qinzi, et al.
Pubblicazione: (2024)
di: Zhang, Qinzi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Simultaneous Computation and Memory Efficient Zeroth-Order Optimizer for Fine-Tuning Large Language Models
di: Wang, Fei, et al.
Pubblicazione: (2024) -
Layer as Puzzle Pieces: Compressing Large Language Models through Layer Concatenation
di: Wang, Fei, et al.
Pubblicazione: (2025) -
TeZO: Empowering the Low-Rankness on the Temporal Dimension in the Zeroth-Order Optimization for Fine-tuning LLMs
di: Sun, Yan, et al.
Pubblicazione: (2025) -
HELENE: Hessian Layer-wise Clipping and Gradient Annealing for Accelerating Fine-tuning LLM with Zeroth-order Optimization
di: Zhao, Huaqin, et al.
Pubblicazione: (2024) -
On Adaptivity in Zeroth-Order Optimization
di: Dbouk, Hassan, et al.
Pubblicazione: (2026)