Delve into the Applicability of Advanced Optimizers for Multi-Task Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Zhipeng, Cao, Linxiao, Wu, Pengcheng, Zhao, Peilin, Miao, Chunyan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Continual Optimization with Symmetry Teleportation for Multi-Task Learning
par: Zhou, Zhipeng, et autres
Publié: (2025)
par: Zhou, Zhipeng, et autres
Publié: (2025)
Injecting Imbalance Sensitivity for Multi-Task Learning
par: Zhou, Zhipeng, et autres
Publié: (2025)
par: Zhou, Zhipeng, et autres
Publié: (2025)
Test-Time Model Adaptation with Only Forward Passes
par: Niu, Shuaicheng, et autres
Publié: (2024)
par: Niu, Shuaicheng, et autres
Publié: (2024)
HYDRA: Hypergradient Data Relevance Analysis for Interpreting Deep Neural Networks
par: Chen, Yuanyuan, et autres
Publié: (2021)
par: Chen, Yuanyuan, et autres
Publié: (2021)
Understanding the Essence: Delving into Annotator Prototype Learning for Multi-Class Annotation Aggregation
par: Chen, Ju, et autres
Publié: (2025)
par: Chen, Ju, et autres
Publié: (2025)
Federated Nested Learning: Collaborative Training of Self-Referential Memories for Test-Time Adaptation
par: Chen, Hong, et autres
Publié: (2026)
par: Chen, Hong, et autres
Publié: (2026)
Delving into Differentially Private Transformer
par: Ding, Youlong, et autres
Publié: (2024)
par: Ding, Youlong, et autres
Publié: (2024)
HDT: Hierarchical Discrete Transformer for Multivariate Time Series Forecasting
par: Feng, Shibo, et autres
Publié: (2025)
par: Feng, Shibo, et autres
Publié: (2025)
TriForecaster: A Mixture of Experts Framework for Multi-Region Electric Load Forecasting with Tri-dimensional Specialization
par: Zhu, Zhaoyang, et autres
Publié: (2025)
par: Zhu, Zhaoyang, et autres
Publié: (2025)
Delving into Multi-modal Multi-task Foundation Models for Road Scene Understanding: From Learning Paradigm Perspectives
par: Luo, Sheng, et autres
Publié: (2024)
par: Luo, Sheng, et autres
Publié: (2024)
WeCon: An Efficient Weight-Conditioned Neural Solver for Multi-Objective Combinatorial Optimization Problems
par: Wu, Xuan, et autres
Publié: (2026)
par: Wu, Xuan, et autres
Publié: (2026)
PiKE: Adaptive Data Mixing for Large-Scale Multi-Task Learning Under Low Gradient Conflicts
par: Li, Zeman, et autres
Publié: (2025)
par: Li, Zeman, et autres
Publié: (2025)
Multi-Task Vehicle Routing Solver via Mixture of Specialized Experts under State-Decomposable MDP
par: Pan, Yuxin, et autres
Publié: (2025)
par: Pan, Yuxin, et autres
Publié: (2025)
Online Parallel Multi-Task Relationship Learning via Alternating Direction Method of Multipliers
par: Li, Ruiyu, et autres
Publié: (2024)
par: Li, Ruiyu, et autres
Publié: (2024)
Graph Topology Information Enhanced Heterogeneous Graph Representation Learning
par: Zhao, He, et autres
Publié: (2026)
par: Zhao, He, et autres
Publié: (2026)
Adapt in the Wild: Test-Time Entropy Minimization with Sharpness and Feature Regularization
par: Niu, Shuaicheng, et autres
Publié: (2025)
par: Niu, Shuaicheng, et autres
Publié: (2025)
Task-oriented Time Series Imputation Evaluation via Generalized Representers
par: Wang, Zhixian, et autres
Publié: (2024)
par: Wang, Zhixian, et autres
Publié: (2024)
SFPrompt: Communication-Efficient Split Federated Fine-Tuning for Large Pre-Trained Models over Resource-Limited Devices
par: Cao, Linxiao, et autres
Publié: (2024)
par: Cao, Linxiao, et autres
Publié: (2024)
Efficient Neural Combinatorial Optimization Solver for the Min-max Heterogeneous Capacitated Vehicle Routing Problem
par: Wu, Xuan, et autres
Publié: (2025)
par: Wu, Xuan, et autres
Publié: (2025)
Self-Bootstrapping for Versatile Test-Time Adaptation
par: Niu, Shuaicheng, et autres
Publié: (2025)
par: Niu, Shuaicheng, et autres
Publié: (2025)
Robust Multi-Task Learning with Excess Risks
par: He, Yifei, et autres
Publié: (2024)
par: He, Yifei, et autres
Publié: (2024)
HoME: Hierarchy of Multi-Gate Experts for Multi-Task Learning at Kuaishou
par: Wang, Xu, et autres
Publié: (2024)
par: Wang, Xu, et autres
Publié: (2024)
Distributionally Robust Multimodal Machine Learning
par: Yang, Peilin, et autres
Publié: (2025)
par: Yang, Peilin, et autres
Publié: (2025)
Improvement of Applicability in Student Performance Prediction Based on Transfer Learning
par: Zhao, Yan
Publié: (2024)
par: Zhao, Yan
Publié: (2024)
Multi-Scenario Combination Based on Multi-Agent Reinforcement Learning to Optimize the Advertising Recommendation System
par: Zhao, Yang, et autres
Publié: (2024)
par: Zhao, Yang, et autres
Publié: (2024)
DiTMoS: Delving into Diverse Tiny-Model Selection on Microcontrollers
par: Ma, Xiao, et autres
Publié: (2024)
par: Ma, Xiao, et autres
Publié: (2024)
CURLS: Causal Rule Learning for Subgroups with Significant Treatment Effect
par: Zhou, Jiehui, et autres
Publié: (2024)
par: Zhou, Jiehui, et autres
Publié: (2024)
Optimizing Multi-Task Learning for Accurate Spacecraft Pose Estimation
par: Evangelisti, Francesco, et autres
Publié: (2024)
par: Evangelisti, Francesco, et autres
Publié: (2024)
DFWLayer: Differentiable Frank-Wolfe Optimization Layer
par: Liu, Zixuan, et autres
Publié: (2023)
par: Liu, Zixuan, et autres
Publié: (2023)
Multi-Task Reward Learning from Human Ratings
par: Wu, Mingkang, et autres
Publié: (2025)
par: Wu, Mingkang, et autres
Publié: (2025)
Low-Dimensional Federated Knowledge Graph Embedding via Knowledge Distillation
par: Zhang, Xiaoxiong, et autres
Publié: (2024)
par: Zhang, Xiaoxiong, et autres
Publié: (2024)
Decentralized Multi-Task Online Convex Optimization Under Random Link Failures
par: Yan, Wenjing, et autres
Publié: (2024)
par: Yan, Wenjing, et autres
Publié: (2024)
Selective Task Group Updates for Multi-Task Optimization
par: Jeong, Wooseong, et autres
Publié: (2025)
par: Jeong, Wooseong, et autres
Publié: (2025)
GAIA: Delving into Gradient-based Attribution Abnormality for Out-of-distribution Detection
par: Chen, Jinggang, et autres
Publié: (2023)
par: Chen, Jinggang, et autres
Publié: (2023)
DELTA: Dual Consistency Delving with Topological Uncertainty for Active Graph Domain Adaptation
par: Wang, Pengyun, et autres
Publié: (2024)
par: Wang, Pengyun, et autres
Publié: (2024)
FreRA: A Frequency-Refined Augmentation for Contrastive Learning on Time Series Classification
par: Tian, Tian, et autres
Publié: (2025)
par: Tian, Tian, et autres
Publié: (2025)
Optimizing Value of Learning in Task-Oriented Federated Meta-Learning Systems
par: Wu, Bibo, et autres
Publié: (2025)
par: Wu, Bibo, et autres
Publié: (2025)
Audio-Reasoner: Improving Reasoning Capability in Large Audio Language Models
par: Xie, Zhifei, et autres
Publié: (2025)
par: Xie, Zhifei, et autres
Publié: (2025)
Sharper Risk Bound for Multi-Task Learning with Multi-Graph Dependent Data
par: Shao, Xiao, et autres
Publié: (2025)
par: Shao, Xiao, et autres
Publié: (2025)
Task-Agnostic Machine-Learning-Assisted Inference
par: Miao, Jiacheng, et autres
Publié: (2024)
par: Miao, Jiacheng, et autres
Publié: (2024)
Documents similaires
-
Continual Optimization with Symmetry Teleportation for Multi-Task Learning
par: Zhou, Zhipeng, et autres
Publié: (2025) -
Injecting Imbalance Sensitivity for Multi-Task Learning
par: Zhou, Zhipeng, et autres
Publié: (2025) -
Test-Time Model Adaptation with Only Forward Passes
par: Niu, Shuaicheng, et autres
Publié: (2024) -
HYDRA: Hypergradient Data Relevance Analysis for Interpreting Deep Neural Networks
par: Chen, Yuanyuan, et autres
Publié: (2021) -
Understanding the Essence: Delving into Annotator Prototype Learning for Multi-Class Annotation Aggregation
par: Chen, Ju, et autres
Publié: (2025)