XGrad: Boosting Gradient-Based Optimizers With Weight Prediction
Fuente:
arXiv
Salvato in:
| Autori principali: | Guan, Lei, Li, Dongsheng, Shi, Yanqi, Meng, Jian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PipeOptim: Ensuring Effective 1F1B Schedule with Optimizer-Dependent Weight Prediction
di: Guan, Lei, et al.
Pubblicazione: (2023)
di: Guan, Lei, et al.
Pubblicazione: (2023)
X-SAM: Boosting Sharpness-Aware Minimization with Dominant-Eigenvector Gradient Correction
di: Duan, Hongru, et al.
Pubblicazione: (2026)
di: Duan, Hongru, et al.
Pubblicazione: (2026)
WiSparse: Boosting LLM Inference Efficiency with Weight-Aware Mixed Activation Sparsity
di: Chen, Lei, et al.
Pubblicazione: (2026)
di: Chen, Lei, et al.
Pubblicazione: (2026)
Supervised Score-Based Modeling by Gradient Boosting
di: Zhao, Changyuan, et al.
Pubblicazione: (2024)
di: Zhao, Changyuan, et al.
Pubblicazione: (2024)
Enhancing DP-SGD through Non-monotonous Adaptive Scaling Gradient Weight
di: Huang, Tao, et al.
Pubblicazione: (2024)
di: Huang, Tao, et al.
Pubblicazione: (2024)
Understanding Gradient Boosting Classifier: Training, Prediction, and the Role of $γ_j$
di: Chen, Hung-Hsuan
Pubblicazione: (2024)
di: Chen, Hung-Hsuan
Pubblicazione: (2024)
Memory Determines Learning Direction: A Theory of Gradient-Based Optimization in State Space Models
di: Guan, JingChuan, et al.
Pubblicazione: (2025)
di: Guan, JingChuan, et al.
Pubblicazione: (2025)
Gradient Boosting Reinforcement Learning
di: Fuhrer, Benjamin, et al.
Pubblicazione: (2024)
di: Fuhrer, Benjamin, et al.
Pubblicazione: (2024)
Weight-Entanglement Meets Gradient-Based Neural Architecture Search
di: Sukthanker, Rhea Sanjay, et al.
Pubblicazione: (2023)
di: Sukthanker, Rhea Sanjay, et al.
Pubblicazione: (2023)
An Integrated Fusion Framework for Ensemble Learning Leveraging Gradient Boosting and Fuzzy Rule-Based Models
di: Li, Jinbo, et al.
Pubblicazione: (2025)
di: Li, Jinbo, et al.
Pubblicazione: (2025)
Optimal Transport-Based Token Weighting scheme for Enhanced Preference Optimization
di: Li, Meng, et al.
Pubblicazione: (2025)
di: Li, Meng, et al.
Pubblicazione: (2025)
Gradient Extrapolation-Based Policy Optimization
di: Swapnil, Ismam Nur, et al.
Pubblicazione: (2026)
di: Swapnil, Ismam Nur, et al.
Pubblicazione: (2026)
AXIL: Exact Instance Attribution for Gradient Boosting
di: Geertsema, Paul, et al.
Pubblicazione: (2023)
di: Geertsema, Paul, et al.
Pubblicazione: (2023)
When Losses Align: Gradient-Based Composite Loss Weighting for Efficient Pretraining
di: Karpukhin, Ivan, et al.
Pubblicazione: (2026)
di: Karpukhin, Ivan, et al.
Pubblicazione: (2026)
AttriReBoost: A Gradient-Free Propagation Optimization Method for Cold Start Mitigation in Attribute Missing Graphs
di: Li, Mengran, et al.
Pubblicazione: (2025)
di: Li, Mengran, et al.
Pubblicazione: (2025)
UTBoost: Gradient Boosted Decision Trees for Uplift Modeling
di: Gao, Junjie, et al.
Pubblicazione: (2023)
di: Gao, Junjie, et al.
Pubblicazione: (2023)
Gradient Boosting within a Single Attention Layer
di: Sargolzaei, Saleh
Pubblicazione: (2026)
di: Sargolzaei, Saleh
Pubblicazione: (2026)
FPBoost: Fully Parametric Gradient Boosting for Survival Analysis
di: Archetti, Alberto, et al.
Pubblicazione: (2024)
di: Archetti, Alberto, et al.
Pubblicazione: (2024)
Certification for Differentially Private Prediction in Gradient-Based Training
di: Wicker, Matthew, et al.
Pubblicazione: (2024)
di: Wicker, Matthew, et al.
Pubblicazione: (2024)
SecureBoost+: Large Scale and High-Performance Vertical Federated Gradient Boosting Decision Tree
di: Fan, Tao, et al.
Pubblicazione: (2021)
di: Fan, Tao, et al.
Pubblicazione: (2021)
Revealing Modular Gradient Noise Imbalance in LLMs: Calibrating Adam via Signal-to-Noise Ratio
di: Wen, Ziqing, et al.
Pubblicazione: (2026)
di: Wen, Ziqing, et al.
Pubblicazione: (2026)
Optimize Weight Rounding via Signed Gradient Descent for the Quantization of LLMs
di: Cheng, Wenhua, et al.
Pubblicazione: (2023)
di: Cheng, Wenhua, et al.
Pubblicazione: (2023)
ExtremeCast: Boosting Extreme Value Prediction for Global Weather Forecast
di: Xu, Wanghan, et al.
Pubblicazione: (2024)
di: Xu, Wanghan, et al.
Pubblicazione: (2024)
Quantum-Enhanced Multi-Task Learning with Learnable Weighting for Pharmacokinetic and Toxicity Prediction
di: Zhang, Han, et al.
Pubblicazione: (2025)
di: Zhang, Han, et al.
Pubblicazione: (2025)
Accelerating LMO-Based Optimization via Implicit Gradient Transport
di: Jang, Won-Jun, et al.
Pubblicazione: (2026)
di: Jang, Won-Jun, et al.
Pubblicazione: (2026)
Towards Differentiable Multilevel Optimization: A Gradient-Based Approach
di: Gu, Yuntian, et al.
Pubblicazione: (2024)
di: Gu, Yuntian, et al.
Pubblicazione: (2024)
Exploratory Memory-Augmented LLM Agent via Hybrid On- and Off-Policy Optimization
di: Liu, Zeyuan, et al.
Pubblicazione: (2026)
di: Liu, Zeyuan, et al.
Pubblicazione: (2026)
Optimizing Predictive AI in Physical Design Flows with Mini Pixel Batch Gradient Descent
di: Yang, Haoyu, et al.
Pubblicazione: (2024)
di: Yang, Haoyu, et al.
Pubblicazione: (2024)
Sequential Policy Gradient for Adaptive Hyperparameter Optimization
di: Li, Zheng, et al.
Pubblicazione: (2025)
di: Li, Zheng, et al.
Pubblicazione: (2025)
Boosting Cross-problem Generalization in Diffusion-Based Neural Combinatorial Solver via Inference Time Adaptation
di: Lei, Haoyu, et al.
Pubblicazione: (2025)
di: Lei, Haoyu, et al.
Pubblicazione: (2025)
Trust-Region Adaptive Policy Optimization
di: Su, Mingyu, et al.
Pubblicazione: (2025)
di: Su, Mingyu, et al.
Pubblicazione: (2025)
Preference-Based Gradient Estimation for ML-Guided Approximate Combinatorial Optimization
di: Mielke, Arman, et al.
Pubblicazione: (2025)
di: Mielke, Arman, et al.
Pubblicazione: (2025)
Offline Model-Based Optimization via Policy-Guided Gradient Search
di: Chemingui, Yassine, et al.
Pubblicazione: (2024)
di: Chemingui, Yassine, et al.
Pubblicazione: (2024)
MLCopilot: Unleashing the Power of Large Language Models in Solving Machine Learning Tasks
di: Zhang, Lei, et al.
Pubblicazione: (2023)
di: Zhang, Lei, et al.
Pubblicazione: (2023)
StylOch at PAN: Gradient-Boosted Trees with Frequency-Based Stylometric Features
di: Ochab, Jeremi K., et al.
Pubblicazione: (2025)
di: Ochab, Jeremi K., et al.
Pubblicazione: (2025)
Gradient Weight-normalized Low-rank Projection for Efficient LLM Training
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
TMetaNet: Topological Meta-Learning Framework for Dynamic Link Prediction
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
Pocket Foundation Models: Distilling TFMs into CPU-Ready Gradient-Boosted Trees
di: Tanna, Aditya, et al.
Pubblicazione: (2026)
di: Tanna, Aditya, et al.
Pubblicazione: (2026)
Cross-Entropy Optimization for Hyperparameter Optimization in Stochastic Gradient-based Approaches to Train Deep Neural Networks
di: Li, Kevin, et al.
Pubblicazione: (2024)
di: Li, Kevin, et al.
Pubblicazione: (2024)
GWT: Scalable Optimizer State Compression for Large Language Model Training
di: Wen, Ziqing, et al.
Pubblicazione: (2025)
di: Wen, Ziqing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PipeOptim: Ensuring Effective 1F1B Schedule with Optimizer-Dependent Weight Prediction
di: Guan, Lei, et al.
Pubblicazione: (2023) -
X-SAM: Boosting Sharpness-Aware Minimization with Dominant-Eigenvector Gradient Correction
di: Duan, Hongru, et al.
Pubblicazione: (2026) -
WiSparse: Boosting LLM Inference Efficiency with Weight-Aware Mixed Activation Sparsity
di: Chen, Lei, et al.
Pubblicazione: (2026) -
Supervised Score-Based Modeling by Gradient Boosting
di: Zhao, Changyuan, et al.
Pubblicazione: (2024) -
Enhancing DP-SGD through Non-monotonous Adaptive Scaling Gradient Weight
di: Huang, Tao, et al.
Pubblicazione: (2024)