Gradient descent with generalized Newton's method
Fuente:
arXiv
Salvato in:
| Autori principali: | Bu, Zhiqi, Xu, Shiyun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards hyperparameter-free optimization with differential privacy
di: Bu, Zhiqi, et al.
Pubblicazione: (2025)
di: Bu, Zhiqi, et al.
Pubblicazione: (2025)
Differentially Private Bias-Term Fine-tuning of Foundation Models
di: Bu, Zhiqi, et al.
Pubblicazione: (2022)
di: Bu, Zhiqi, et al.
Pubblicazione: (2022)
Classifier-guided Gradient Modulation for Enhanced Multimodal Learning
di: Guo, Zirun, et al.
Pubblicazione: (2024)
di: Guo, Zirun, et al.
Pubblicazione: (2024)
Improving Visual Grounding by Encouraging Consistent Gradient-based Explanations
di: Yang, Ziyan, et al.
Pubblicazione: (2022)
di: Yang, Ziyan, et al.
Pubblicazione: (2022)
Convex Dominance in Deep Learning I: A Scaling Law of Loss and Learning Rate
di: Bu, Zhiqi, et al.
Pubblicazione: (2026)
di: Bu, Zhiqi, et al.
Pubblicazione: (2026)
No Train, all Gain: Self-Supervised Gradients Improve Deep Frozen Representations
di: Simoncini, Walter, et al.
Pubblicazione: (2024)
di: Simoncini, Walter, et al.
Pubblicazione: (2024)
LLM as a Complementary Optimizer to Gradient Descent: A Case Study in Prompt Tuning
di: Guo, Zixian, et al.
Pubblicazione: (2024)
di: Guo, Zixian, et al.
Pubblicazione: (2024)
The Double Dilemma in Multi-Task Radiology Report Generation: A Gradient Dynamics Analysis and Solution
di: Zhang, Erjian, et al.
Pubblicazione: (2026)
di: Zhang, Erjian, et al.
Pubblicazione: (2026)
Towards Better Multi-head Attention via Channel-wise Sample Permutation
di: Yuan, Shen, et al.
Pubblicazione: (2024)
di: Yuan, Shen, et al.
Pubblicazione: (2024)
Lever LM: Configuring In-Context Sequence to Lever Large Vision Language Models
di: Yang, Xu, et al.
Pubblicazione: (2023)
di: Yang, Xu, et al.
Pubblicazione: (2023)
Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models
di: Xu, Qinwu, et al.
Pubblicazione: (2026)
di: Xu, Qinwu, et al.
Pubblicazione: (2026)
$\nabla τ$: Gradient-based and Task-Agnostic machine Unlearning
di: Trippa, Daniel, et al.
Pubblicazione: (2024)
di: Trippa, Daniel, et al.
Pubblicazione: (2024)
COAP: Memory-Efficient Training with Correlation-Aware Gradient Projection
di: Xiao, Jinqi, et al.
Pubblicazione: (2024)
di: Xiao, Jinqi, et al.
Pubblicazione: (2024)
Directional Gradient Projection for Robust Fine-Tuning of Foundation Models
di: Huang, Chengyue, et al.
Pubblicazione: (2025)
di: Huang, Chengyue, et al.
Pubblicazione: (2025)
Ethical-Lens: Curbing Malicious Usages of Open-Source Text-to-Image Models
di: Cai, Yuzhu, et al.
Pubblicazione: (2024)
di: Cai, Yuzhu, et al.
Pubblicazione: (2024)
Manager: Aggregating Insights from Unimodal Experts in Two-Tower VLMs and MLLMs
di: Xu, Xiao, et al.
Pubblicazione: (2025)
di: Xu, Xiao, et al.
Pubblicazione: (2025)
MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks
di: Wu, Yiming, et al.
Pubblicazione: (2024)
di: Wu, Yiming, et al.
Pubblicazione: (2024)
A Survey on Data Augmentation in Large Model Era
di: Zhou, Yue, et al.
Pubblicazione: (2024)
di: Zhou, Yue, et al.
Pubblicazione: (2024)
Exploring Semantic Perturbations on Grover
di: Ji, Ziqing, et al.
Pubblicazione: (2023)
di: Ji, Ziqing, et al.
Pubblicazione: (2023)
mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality
di: Ye, Qinghao, et al.
Pubblicazione: (2023)
di: Ye, Qinghao, et al.
Pubblicazione: (2023)
FedMLLM: Federated Fine-tuning MLLM on Multimodal Heterogeneity Data
di: Xu, Binqian, et al.
Pubblicazione: (2024)
di: Xu, Binqian, et al.
Pubblicazione: (2024)
BridgeTower: Building Bridges Between Encoders in Vision-Language Representation Learning
di: Xu, Xiao, et al.
Pubblicazione: (2022)
di: Xu, Xiao, et al.
Pubblicazione: (2022)
Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models
di: Xu, Xiao, et al.
Pubblicazione: (2024)
di: Xu, Xiao, et al.
Pubblicazione: (2024)
Explainable AI: Context-Aware Layer-Wise Integrated Gradients for Explaining Transformer Models
di: Mersha, Melkamu Abay, et al.
Pubblicazione: (2026)
di: Mersha, Melkamu Abay, et al.
Pubblicazione: (2026)
Multi-Task Model Merging via Adaptive Weight Disentanglement
di: Xiong, Feng, et al.
Pubblicazione: (2024)
di: Xiong, Feng, et al.
Pubblicazione: (2024)
TiMix: Text-aware Image Mixing for Effective Vision-Language Pre-training
di: Jiang, Chaoya, et al.
Pubblicazione: (2023)
di: Jiang, Chaoya, et al.
Pubblicazione: (2023)
MoLAN: A Unified Modality-Aware Noise Dynamic Editing Framework for Multimodal Sentiment Analysis
di: Xu, Xingle, et al.
Pubblicazione: (2025)
di: Xu, Xingle, et al.
Pubblicazione: (2025)
S-GRPO: Unified Post-Training for Large Vision-Language Models
di: Yan, Yuming, et al.
Pubblicazione: (2026)
di: Yan, Yuming, et al.
Pubblicazione: (2026)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
di: Liu, Xinyang, et al.
Pubblicazione: (2023)
di: Liu, Xinyang, et al.
Pubblicazione: (2023)
Compress to Impress: Efficient LLM Adaptation Using a Single Gradient Step on 100 Samples
di: Sreeram, Shiva, et al.
Pubblicazione: (2025)
di: Sreeram, Shiva, et al.
Pubblicazione: (2025)
Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension
di: Wang, Xiyao, et al.
Pubblicazione: (2024)
di: Wang, Xiyao, et al.
Pubblicazione: (2024)
Sparrow: Data-Efficient Video-LLM with Text-to-Image Augmentation
di: Yin, Shukang, et al.
Pubblicazione: (2024)
di: Yin, Shukang, et al.
Pubblicazione: (2024)
MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning
di: Liang, Yiqing, et al.
Pubblicazione: (2025)
di: Liang, Yiqing, et al.
Pubblicazione: (2025)
X-VILA: Cross-Modality Alignment for Large Language Model
di: Ye, Hanrong, et al.
Pubblicazione: (2024)
di: Ye, Hanrong, et al.
Pubblicazione: (2024)
Training morphological neural networks with gradient descent: some theoretical insights
di: Blusseau, Samy
Pubblicazione: (2024)
di: Blusseau, Samy
Pubblicazione: (2024)
VPO: Aligning Text-to-Video Generation Models with Prompt Optimization
di: Cheng, Jiale, et al.
Pubblicazione: (2025)
di: Cheng, Jiale, et al.
Pubblicazione: (2025)
C2-Evo: Co-Evolving Multimodal Data and Model for Self-Improving Reasoning
di: Chen, Xiuwei, et al.
Pubblicazione: (2025)
di: Chen, Xiuwei, et al.
Pubblicazione: (2025)
Reassessing the Role of Supervised Fine-Tuning: An Empirical Study in VLM Reasoning
di: Yu, Yongcan, et al.
Pubblicazione: (2025)
di: Yu, Yongcan, et al.
Pubblicazione: (2025)
Lumos : Empowering Multimodal LLMs with Scene Text Recognition
di: Shenoy, Ashish, et al.
Pubblicazione: (2024)
di: Shenoy, Ashish, et al.
Pubblicazione: (2024)
Open-Source Multimodal Moxin Models with Moxin-VLM and Moxin-VLA
di: Zhao, Pu, et al.
Pubblicazione: (2025)
di: Zhao, Pu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Towards hyperparameter-free optimization with differential privacy
di: Bu, Zhiqi, et al.
Pubblicazione: (2025) -
Differentially Private Bias-Term Fine-tuning of Foundation Models
di: Bu, Zhiqi, et al.
Pubblicazione: (2022) -
Classifier-guided Gradient Modulation for Enhanced Multimodal Learning
di: Guo, Zirun, et al.
Pubblicazione: (2024) -
Improving Visual Grounding by Encouraging Consistent Gradient-based Explanations
di: Yang, Ziyan, et al.
Pubblicazione: (2022) -
Convex Dominance in Deep Learning I: A Scaling Law of Loss and Learning Rate
di: Bu, Zhiqi, et al.
Pubblicazione: (2026)