Efficient Second-Order Neural Network Optimization via Adaptive Trust Region Methods
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Vo, James |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SOUL: Unlocking the Power of Second-Order Optimization for LLM Unlearning
par: Jia, Jinghan, et autres
Publié: (2024)
par: Jia, Jinghan, et autres
Publié: (2024)
Trust Region On-Policy Distillation
par: Xing, Xingrun, et autres
Publié: (2026)
par: Xing, Xingrun, et autres
Publié: (2026)
Prior-Informed Zeroth-Order Optimization with Adaptive Direction Alignment for Memory-Efficient LLM Fine-Tuning
par: Jin, Feihu, et autres
Publié: (2026)
par: Jin, Feihu, et autres
Publié: (2026)
TRE: Encouraging Exploration in the Trust Region
par: Huang, Chao, et autres
Publié: (2026)
par: Huang, Chao, et autres
Publié: (2026)
TRAM: Bridging Trust Regions and Sharpness Aware Minimization
par: Sherborne, Tom, et autres
Publié: (2023)
par: Sherborne, Tom, et autres
Publié: (2023)
PPO-BR: Dual-Signal Entropy-Reward Adaptation for Trust Region Policy Optimization
par: Rahman, Ben
Publié: (2025)
par: Rahman, Ben
Publié: (2025)
Revisiting Zeroth-Order Optimization for Memory-Efficient LLM Fine-Tuning: A Benchmark
par: Zhang, Yihua, et autres
Publié: (2024)
par: Zhang, Yihua, et autres
Publié: (2024)
On-Device Fine-Tuning via Backprop-Free Zeroth-Order Optimization
par: Katti, Prabodh, et autres
Publié: (2025)
par: Katti, Prabodh, et autres
Publié: (2025)
Efficient Reinforcement Finetuning via Adaptive Curriculum Learning
par: Shi, Taiwei, et autres
Publié: (2025)
par: Shi, Taiwei, et autres
Publié: (2025)
Simultaneous Computation and Memory Efficient Zeroth-Order Optimizer for Fine-Tuning Large Language Models
par: Wang, Fei, et autres
Publié: (2024)
par: Wang, Fei, et autres
Publié: (2024)
Data Efficient Evaluation of Large Language Models and Text-to-Image Models via Adaptive Sampling
par: Xu, Cong, et autres
Publié: (2024)
par: Xu, Cong, et autres
Publié: (2024)
ZOQO: Zero-Order Quantized Optimization
par: Bar, Noga, et autres
Publié: (2025)
par: Bar, Noga, et autres
Publié: (2025)
Hallmarks of Optimization Trajectories in Neural Networks: Directional Exploration and Redundancy
par: Singh, Sidak Pal, et autres
Publié: (2024)
par: Singh, Sidak Pal, et autres
Publié: (2024)
OrScale: Orthogonalised Optimization with Layer-Wise Trust-Ratio Scaling
par: Lou, Yuxuan, et autres
Publié: (2026)
par: Lou, Yuxuan, et autres
Publié: (2026)
Can We Trust the Performance Evaluation of Uncertainty Estimation Methods in Text Summarization?
par: He, Jianfeng, et autres
Publié: (2024)
par: He, Jianfeng, et autres
Publié: (2024)
3DGS$^2$-TR: Scalable Second-Order Trust-Region Method for 3D Gaussian Splatting
par: Hsiao, Roger, et autres
Publié: (2026)
par: Hsiao, Roger, et autres
Publié: (2026)
Data-Driven Variational Basis Learning Beyond Neural Networks: A Non-Neural Framework for Adaptive Basis Discovery
par: Kiruluta, Andrew
Publié: (2026)
par: Kiruluta, Andrew
Publié: (2026)
IIET: Efficient Numerical Transformer via Implicit Iterative Euler Method
par: Liu, Xinyu, et autres
Publié: (2025)
par: Liu, Xinyu, et autres
Publié: (2025)
BEATS: Optimizing LLM Mathematical Capabilities with BackVerify and Adaptive Disambiguate based Efficient Tree Search
par: Sun, Linzhuang, et autres
Publié: (2024)
par: Sun, Linzhuang, et autres
Publié: (2024)
Athena: Efficient Block-Wise Post-Training Quantization for Large Language Models Using Second-Order Matrix Derivative Information
par: Wang, Yanshu, et autres
Publié: (2024)
par: Wang, Yanshu, et autres
Publié: (2024)
An Efficient Sparse Fine-Tuning with Low Quantization Error via Neural Network Pruning
par: Li, Cen-Jhih, et autres
Publié: (2025)
par: Li, Cen-Jhih, et autres
Publié: (2025)
Batch-ICL: Effective, Efficient, and Order-Agnostic In-Context Learning
par: Zhang, Kaiyi, et autres
Publié: (2024)
par: Zhang, Kaiyi, et autres
Publié: (2024)
Adaptive Feature-based Low-Rank Compression of Large Language Models via Bayesian Optimization
par: Ji, Yixin, et autres
Publié: (2024)
par: Ji, Yixin, et autres
Publié: (2024)
Second-Order Information Matters: Revisiting Machine Unlearning for Large Language Models
par: Gu, Kang, et autres
Publié: (2024)
par: Gu, Kang, et autres
Publié: (2024)
Transformers Learn to Achieve Second-Order Convergence Rates for In-Context Linear Regression
par: Fu, Deqing, et autres
Publié: (2023)
par: Fu, Deqing, et autres
Publié: (2023)
Improving Next Tokens via Second-to-Last Predictions with Generate and Refine
par: Schneider, Johannes
Publié: (2024)
par: Schneider, Johannes
Publié: (2024)
Trust in One Round: Confidence Estimation for Large Language Models via Structural Signals
par: Yang, Pengyue, et autres
Publié: (2026)
par: Yang, Pengyue, et autres
Publié: (2026)
Trust Functions: Near-Lossless Weak-to-Strong Generalization by Learning When to Trust the Weak Teacher
par: Uzunoglu, Arda, et autres
Publié: (2026)
par: Uzunoglu, Arda, et autres
Publié: (2026)
Interactive Training: Feedback-Driven Neural Network Optimization
par: Zhang, Wentao, et autres
Publié: (2025)
par: Zhang, Wentao, et autres
Publié: (2025)
Efficient Neural Network Verification via Order Leading Exploration of Branch-and-Bound Trees
par: Zhang, Guanqin, et autres
Publié: (2025)
par: Zhang, Guanqin, et autres
Publié: (2025)
Adaptive Preference Optimization with Uncertainty-aware Utility Anchor
par: Wang, Xiaobo, et autres
Publié: (2025)
par: Wang, Xiaobo, et autres
Publié: (2025)
AdaZeta: Adaptive Zeroth-Order Tensor-Train Adaption for Memory-Efficient Large Language Models Fine-Tuning
par: Yang, Yifan, et autres
Publié: (2024)
par: Yang, Yifan, et autres
Publié: (2024)
Prompt Optimization via Adversarial In-Context Learning
par: Do, Xuan Long, et autres
Publié: (2023)
par: Do, Xuan Long, et autres
Publié: (2023)
AdaLomo: Low-memory Optimization with Adaptive Learning Rate
par: Lv, Kai, et autres
Publié: (2023)
par: Lv, Kai, et autres
Publié: (2023)
AE-LLM: Adaptive Efficiency Optimization for Large Language Models
par: Tanaka, Kaito, et autres
Publié: (2026)
par: Tanaka, Kaito, et autres
Publié: (2026)
LLM Prompt Duel Optimizer: Efficient Label-Free Prompt Optimization
par: Wu, Yuanchen, et autres
Publié: (2025)
par: Wu, Yuanchen, et autres
Publié: (2025)
Compressed Models are NOT Trust-equivalent to Their Large Counterparts
par: Rai, Rohit Raj, et autres
Publié: (2025)
par: Rai, Rohit Raj, et autres
Publié: (2025)
Adaptive Social Learning via Mode Policy Optimization for Language Agents
par: Wang, Minzheng, et autres
Publié: (2025)
par: Wang, Minzheng, et autres
Publié: (2025)
JudgeRLVR: Judge First, Generate Second for Efficient Reasoning
par: Duo, Jiangshan, et autres
Publié: (2026)
par: Duo, Jiangshan, et autres
Publié: (2026)
Unsupervised Data Validation Methods for Efficient Model Training
par: Paniv, Yurii
Publié: (2024)
par: Paniv, Yurii
Publié: (2024)
Documents similaires
-
SOUL: Unlocking the Power of Second-Order Optimization for LLM Unlearning
par: Jia, Jinghan, et autres
Publié: (2024) -
Trust Region On-Policy Distillation
par: Xing, Xingrun, et autres
Publié: (2026) -
Prior-Informed Zeroth-Order Optimization with Adaptive Direction Alignment for Memory-Efficient LLM Fine-Tuning
par: Jin, Feihu, et autres
Publié: (2026) -
TRE: Encouraging Exploration in the Trust Region
par: Huang, Chao, et autres
Publié: (2026) -
TRAM: Bridging Trust Regions and Sharpness Aware Minimization
par: Sherborne, Tom, et autres
Publié: (2023)