DFWLayer: Differentiable Frank-Wolfe Optimization Layer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Zixuan, Liu, Liu, Wang, Xueqian, Zhao, Peilin |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FW-Merging: Scaling Model Merging with Frank-Wolfe Optimization
par: Chen, Hao Mark, et autres
Publié: (2025)
par: Chen, Hao Mark, et autres
Publié: (2025)
Empirical evaluation of the Frank-Wolfe methods for constructing white-box adversarial attacks
par: Korotkova, Kristina, et autres
Publié: (2025)
par: Korotkova, Kristina, et autres
Publié: (2025)
Injecting Imbalance Sensitivity for Multi-Task Learning
par: Zhou, Zhipeng, et autres
Publié: (2025)
par: Zhou, Zhipeng, et autres
Publié: (2025)
HDT: Hierarchical Discrete Transformer for Multivariate Time Series Forecasting
par: Feng, Shibo, et autres
Publié: (2025)
par: Feng, Shibo, et autres
Publié: (2025)
Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
par: Ma, Guozheng, et autres
Publié: (2023)
par: Ma, Guozheng, et autres
Publié: (2023)
Robust Guided Diffusion for Offline Black-Box Optimization
par: Chen, Can Sam, et autres
Publié: (2024)
par: Chen, Can Sam, et autres
Publié: (2024)
DeepMF: Deep Motion Factorization for Closed-Loop Safety-Critical Driving Scenario Simulation
par: Li, Yizhe, et autres
Publié: (2024)
par: Li, Yizhe, et autres
Publié: (2024)
DP-FedAdamW: An Efficient Optimizer for Differentially Private Federated Large Models
par: Liu, Jin, et autres
Publié: (2026)
par: Liu, Jin, et autres
Publié: (2026)
Continual Optimization with Symmetry Teleportation for Multi-Task Learning
par: Zhou, Zhipeng, et autres
Publié: (2025)
par: Zhou, Zhipeng, et autres
Publié: (2025)
Multi-Task Vehicle Routing Solver via Mixture of Specialized Experts under State-Decomposable MDP
par: Pan, Yuxin, et autres
Publié: (2025)
par: Pan, Yuxin, et autres
Publié: (2025)
Probing Implicit Bias in Semi-gradient Q-learning: Visualizing the Effective Loss Landscapes via the Fokker--Planck Equation
par: Yin, Shuyu, et autres
Publié: (2024)
par: Yin, Shuyu, et autres
Publié: (2024)
DNAD: Differentiable Neural Architecture Distillation
par: Rao, Xuan, et autres
Publié: (2025)
par: Rao, Xuan, et autres
Publié: (2025)
Comparing Few to Rank Many: Active Human Preference Learning using Randomized Frank-Wolfe
par: Thekumparampil, Kiran Koshy, et autres
Publié: (2024)
par: Thekumparampil, Kiran Koshy, et autres
Publié: (2024)
Tree-Preconditioned Differentiable Optimization and Axioms as Layers
par: Liao, Yuexin
Publié: (2025)
par: Liao, Yuexin
Publié: (2025)
HELENE: Hessian Layer-wise Clipping and Gradient Annealing for Accelerating Fine-tuning LLM with Zeroth-order Optimization
par: Zhao, Huaqin, et autres
Publié: (2024)
par: Zhao, Huaqin, et autres
Publié: (2024)
Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set
par: Liu, Xinyu, et autres
Publié: (2025)
par: Liu, Xinyu, et autres
Publié: (2025)
What Makes Looped Transformers Perform Better Than Non-Recursive Ones
par: Gong, Zixuan, et autres
Publié: (2025)
par: Gong, Zixuan, et autres
Publié: (2025)
Gradient Flow Drifting: Generative Modeling via Wasserstein Gradient Flows of KDE-Approximated Divergences
par: Cao, Jiarui, et autres
Publié: (2026)
par: Cao, Jiarui, et autres
Publié: (2026)
Layer Specialization Underlying Compositional Reasoning in Transformers
par: Liu, Jing
Publié: (2025)
par: Liu, Jing
Publié: (2025)
Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples
par: Gao, Chengqian, et autres
Publié: (2025)
par: Gao, Chengqian, et autres
Publié: (2025)
Reactivation: Empirical NTK Dynamics Under Task Shifts
par: Liu, Yuzhi, et autres
Publié: (2025)
par: Liu, Yuzhi, et autres
Publié: (2025)
It's All Connected: A Journey Through Test-Time Memorization, Attentional Bias, Retention, and Online Optimization
par: Behrouz, Ali, et autres
Publié: (2025)
par: Behrouz, Ali, et autres
Publié: (2025)
SEGNO: Generalizing Equivariant Graph Neural Networks with Physical Inductive Biases
par: Liu, Yang, et autres
Publié: (2023)
par: Liu, Yang, et autres
Publié: (2023)
TEON: Tensorized Orthonormalization Beyond Layer-Wise Muon for Large Language Model Pre-Training
par: Zhang, Ruijie, et autres
Publié: (2026)
par: Zhang, Ruijie, et autres
Publié: (2026)
Differentiable Distributionally Robust Optimization Layers
par: Ma, Xutao, et autres
Publié: (2024)
par: Ma, Xutao, et autres
Publié: (2024)
DAMBench: A Multi-Modal Benchmark for Deep Learning-based Atmospheric Data Assimilation
par: Wang, Hao, et autres
Publié: (2025)
par: Wang, Hao, et autres
Publié: (2025)
Finite Sample Analysis of Linear Temporal Difference Learning with Arbitrary Features
par: Xie, Zixuan, et autres
Publié: (2025)
par: Xie, Zixuan, et autres
Publié: (2025)
UACER: An Uncertainty-Adaptive Critic Ensemble Framework for Robust Adversarial Reinforcement Learning
par: Wu, Jiaxi, et autres
Publié: (2025)
par: Wu, Jiaxi, et autres
Publié: (2025)
Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
par: Kong, Yilun, et autres
Publié: (2025)
par: Kong, Yilun, et autres
Publié: (2025)
Golden Layers and Where to Find Them: Improved Knowledge Editing for Large Language Models Via Layer Gradient Analysis
par: Datta, Shrestha, et autres
Publié: (2026)
par: Datta, Shrestha, et autres
Publié: (2026)
FX-DARTS: Designing Topology-unconstrained Architectures with Differentiable Architecture Search and Entropy-based Super-network Shrinking
par: Rao, Xuan, et autres
Publié: (2025)
par: Rao, Xuan, et autres
Publié: (2025)
Wavelet Fourier Diffuser: Frequency-Aware Diffusion Model for Reinforcement Learning
par: Luo, Yifu, et autres
Publié: (2025)
par: Luo, Yifu, et autres
Publié: (2025)
FoMEMO: Towards Foundation Models for Expensive Multi-objective Optimization
par: Yao, Yiming, et autres
Publié: (2025)
par: Yao, Yiming, et autres
Publié: (2025)
Layer-Aware Influence for Online Data Valuation Estimation
par: Yang, Ziao, et autres
Publié: (2025)
par: Yang, Ziao, et autres
Publié: (2025)
An Improved Grey Wolf Optimization Algorithm for Heart Disease Prediction
par: Niu, Sihan, et autres
Publié: (2024)
par: Niu, Sihan, et autres
Publié: (2024)
Robust Policy Expansion for Offline-to-Online RL under Diverse Data Corruption
par: He, Longxiang, et autres
Publié: (2025)
par: He, Longxiang, et autres
Publié: (2025)
When Fewer Layers Break More Chains: Layer Pruning Harms Test-Time Scaling in LLMs
par: Wang, Keyu, et autres
Publié: (2025)
par: Wang, Keyu, et autres
Publié: (2025)
Rethinking KL Regularization in RLHF: From Value Estimation to Gradient Optimization
par: Liu, Kezhao, et autres
Publié: (2025)
par: Liu, Kezhao, et autres
Publié: (2025)
The Wolf Within: Covert Injection of Malice into MLLM Societies via an MLLM Operative
par: Tan, Zhen, et autres
Publié: (2024)
par: Tan, Zhen, et autres
Publié: (2024)
ECHO: Entropy-Confidence Hybrid Optimization for Test-Time Reinforcement Learning
par: Zhao, Chu, et autres
Publié: (2026)
par: Zhao, Chu, et autres
Publié: (2026)
Documents similaires
-
FW-Merging: Scaling Model Merging with Frank-Wolfe Optimization
par: Chen, Hao Mark, et autres
Publié: (2025) -
Empirical evaluation of the Frank-Wolfe methods for constructing white-box adversarial attacks
par: Korotkova, Kristina, et autres
Publié: (2025) -
Injecting Imbalance Sensitivity for Multi-Task Learning
par: Zhou, Zhipeng, et autres
Publié: (2025) -
HDT: Hierarchical Discrete Transformer for Multivariate Time Series Forecasting
par: Feng, Shibo, et autres
Publié: (2025) -
Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
par: Ma, Guozheng, et autres
Publié: (2023)