A Trainable Optimizer
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Ruiqi, Klabjan, Diego |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Divergence Results and Convergence of a Variance Reduced Version of ADAM
por: Wang, Ruiqi, et al.
Publicado: (2022)
por: Wang, Ruiqi, et al.
Publicado: (2022)
A Mirror Descent Perspective of Smoothed Sign Descent
por: Wang, Shuyang, et al.
Publicado: (2024)
por: Wang, Shuyang, et al.
Publicado: (2024)
Non-Convex Optimization with Spectral Radius Regularization
por: Sandler, Adam, et al.
Publicado: (2021)
por: Sandler, Adam, et al.
Publicado: (2021)
Rank-Accuracy Trade-off for LoRA: A Gradient-Flow Analysis
por: Rushka, Michael, et al.
Publicado: (2026)
por: Rushka, Michael, et al.
Publicado: (2026)
On the Convergence Rate of LoRA Gradient Descent
por: Mu, Siqiao, et al.
Publicado: (2025)
por: Mu, Siqiao, et al.
Publicado: (2025)
Descend or Rewind? Stochastic Gradient Descent Unlearning
por: Mu, Siqiao, et al.
Publicado: (2025)
por: Mu, Siqiao, et al.
Publicado: (2025)
On the Second-Order Convergence of Biased Policy Gradient Algorithms
por: Mu, Siqiao, et al.
Publicado: (2023)
por: Mu, Siqiao, et al.
Publicado: (2023)
IW-GAE: Importance Weighted Group Accuracy Estimation for Improved Calibration and Model Selection in Unsupervised Domain Adaptation
por: Joo, Taejong, et al.
Publicado: (2023)
por: Joo, Taejong, et al.
Publicado: (2023)
Rewind-to-Delete: Certified Machine Unlearning for Nonconvex Functions
por: Mu, Siqiao, et al.
Publicado: (2024)
por: Mu, Siqiao, et al.
Publicado: (2024)
Improving self-training under distribution shifts via anchored confidence with theoretical guarantees
por: Joo, Taejong, et al.
Publicado: (2024)
por: Joo, Taejong, et al.
Publicado: (2024)
Technical Debt in In-Context Learning: Diminishing Efficiency in Long Context
por: Joo, Taejong, et al.
Publicado: (2025)
por: Joo, Taejong, et al.
Publicado: (2025)
Communication-Efficient Federated Low-Rank Update Algorithm and its Connection to Implicit Regularization
por: Park, Haemin, et al.
Publicado: (2024)
por: Park, Haemin, et al.
Publicado: (2024)
LanFL: Differentially Private Federated Learning with Large Language Models using Synthetic Samples
por: Wu, Huiyu, et al.
Publicado: (2024)
por: Wu, Huiyu, et al.
Publicado: (2024)
Regret Bounds and Reinforcement Learning Exploration of EXP-based Algorithms
por: Xu, Mengfan, et al.
Publicado: (2020)
por: Xu, Mengfan, et al.
Publicado: (2020)
Decentralized Blockchain-based Robust Multi-agent Multi-armed Bandit
por: Xu, Mengfan, et al.
Publicado: (2024)
por: Xu, Mengfan, et al.
Publicado: (2024)
A Primal-Dual Algorithm for Hybrid Federated Learning
por: Overman, Tom, et al.
Publicado: (2022)
por: Overman, Tom, et al.
Publicado: (2022)
Federated Automated Feature Engineering
por: Overman, Tom, et al.
Publicado: (2024)
por: Overman, Tom, et al.
Publicado: (2024)
IIFE: Interaction Information Based Automated Feature Engineering
por: Overman, Tom, et al.
Publicado: (2024)
por: Overman, Tom, et al.
Publicado: (2024)
FedGA-Tree: Federated Decision Tree using Genetic Algorithm
por: Nguyen, Anh V, et al.
Publicado: (2025)
por: Nguyen, Anh V, et al.
Publicado: (2025)
Conditional Hierarchical Bayesian Tucker Decomposition for Genetic Data Analysis
por: Sandler, Adam, et al.
Publicado: (2019)
por: Sandler, Adam, et al.
Publicado: (2019)
Continuous-Time Analysis of Federated Averaging
por: Overman, Tom, et al.
Publicado: (2025)
por: Overman, Tom, et al.
Publicado: (2025)
Topic Analysis with Side Information: A Neural-Augmented LDA Approach
por: Fang, Biyi, et al.
Publicado: (2025)
por: Fang, Biyi, et al.
Publicado: (2025)
Multi-Layer Attention-Based Explainability via Transformers for Tabular Data
por: Gavito, Andrea Treviño, et al.
Publicado: (2023)
por: Gavito, Andrea Treviño, et al.
Publicado: (2023)
Video to Video Generative Adversarial Network for Few-shot Learning Based on Policy Gradient
por: Ma, Yintai, et al.
Publicado: (2024)
por: Ma, Yintai, et al.
Publicado: (2024)
Unsupervised Video Summarization via Iterative Training and Simplified GAN
por: Li, Hanqing, et al.
Publicado: (2023)
por: Li, Hanqing, et al.
Publicado: (2023)
Geometric Preconditioning and Curriculum Optimization for Trainable Variational Quantum Regression
por: Meng, Qingyu, et al.
Publicado: (2026)
por: Meng, Qingyu, et al.
Publicado: (2026)
Differentiable Calibration of Inexact Stochastic Simulation Models via Kernel Score Minimization
por: Su, Ziwei, et al.
Publicado: (2024)
por: Su, Ziwei, et al.
Publicado: (2024)
Hybrid FedGraph: An efficient hybrid federated learning algorithm using graph convolutional neural network
por: Jang, Jaeyeon, et al.
Publicado: (2024)
por: Jang, Jaeyeon, et al.
Publicado: (2024)
Trainable Transformer in Transformer
por: Panigrahi, Abhishek, et al.
Publicado: (2023)
por: Panigrahi, Abhishek, et al.
Publicado: (2023)
A Trainable Centrality Framework for Modern Data
por: Vu, Minh Duc, et al.
Publicado: (2025)
por: Vu, Minh Duc, et al.
Publicado: (2025)
Maestro: Uncovering Low-Rank Structures via Trainable Decomposition
por: Horvath, Samuel, et al.
Publicado: (2023)
por: Horvath, Samuel, et al.
Publicado: (2023)
Survival Analysis as Imprecise Classification with Trainable Kernels
por: Konstantinov, Andrei V., et al.
Publicado: (2025)
por: Konstantinov, Andrei V., et al.
Publicado: (2025)
SageBwd: A Trainable Low-bit Attention
por: Zhang, Jintao, et al.
Publicado: (2026)
por: Zhang, Jintao, et al.
Publicado: (2026)
Trainable Weight Averaging: Accelerating Training and Improving Generalization
por: Li, Tao, et al.
Publicado: (2022)
por: Li, Tao, et al.
Publicado: (2022)
Trainable Bitwise Soft Quantization for Input Feature Compression
por: Schrödter, Karsten, et al.
Publicado: (2026)
por: Schrödter, Karsten, et al.
Publicado: (2026)
Trainability issues in quantum policy gradients
por: Sequeira, André, et al.
Publicado: (2024)
por: Sequeira, André, et al.
Publicado: (2024)
Neural Network Training via Stochastic Alternating Minimization with Trainable Step Sizes
por: Yan, Chengcheng, et al.
Publicado: (2025)
por: Yan, Chengcheng, et al.
Publicado: (2025)
Trainable Dynamic Mask Sparse Attention
por: Shi, Jingze, et al.
Publicado: (2025)
por: Shi, Jingze, et al.
Publicado: (2025)
A Unified Noise-Curvature View of Loss of Trainability
por: Baveja, Gunbir Singh, et al.
Publicado: (2025)
por: Baveja, Gunbir Singh, et al.
Publicado: (2025)
Characterizing Trainability of Instantaneous Quantum Polynomial Circuit Born Machines
por: Shen, Kevin, et al.
Publicado: (2026)
por: Shen, Kevin, et al.
Publicado: (2026)
Ejemplares similares
-
Divergence Results and Convergence of a Variance Reduced Version of ADAM
por: Wang, Ruiqi, et al.
Publicado: (2022) -
A Mirror Descent Perspective of Smoothed Sign Descent
por: Wang, Shuyang, et al.
Publicado: (2024) -
Non-Convex Optimization with Spectral Radius Regularization
por: Sandler, Adam, et al.
Publicado: (2021) -
Rank-Accuracy Trade-off for LoRA: A Gradient-Flow Analysis
por: Rushka, Michael, et al.
Publicado: (2026) -
On the Convergence Rate of LoRA Gradient Descent
por: Mu, Siqiao, et al.
Publicado: (2025)