Robust Multi-Task Learning with Excess Risks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Yifei, Zhou, Shiji, Zhang, Guojun, Yun, Hyokun, Xu, Yi, Zeng, Belinda, Chilimbi, Trishul, Zhao, Han |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AutoMixAlign: Adaptive Data Mixing for Multi-Task Preference Optimization in LLMs
par: Corrado, Nicholas E., et autres
Publié: (2025)
par: Corrado, Nicholas E., et autres
Publié: (2025)
Evolutionary Contrastive Distillation for Language Model Alignment
par: Katz-Samuels, Julian, et autres
Publié: (2024)
par: Katz-Samuels, Julian, et autres
Publié: (2024)
VidLA: Video-Language Alignment at Scale
par: Rizve, Mamshad Nayeem, et autres
Publié: (2024)
par: Rizve, Mamshad Nayeem, et autres
Publié: (2024)
DreamBlend: Advancing Personalized Fine-tuning of Text-to-Image Diffusion Models
par: Ram, Shwetha, et autres
Publié: (2024)
par: Ram, Shwetha, et autres
Publié: (2024)
InfoPO: On Mutual Information Maximization for Large Language Model Alignment
par: Xiao, Teng, et autres
Publié: (2025)
par: Xiao, Teng, et autres
Publié: (2025)
X-Former: Unifying Contrastive and Reconstruction Learning for MLLMs
par: Swetha, Sirnam, et autres
Publié: (2024)
par: Swetha, Sirnam, et autres
Publié: (2024)
Mitigating Accuracy-Robustness Trade-off via Balanced Multi-Teacher Adversarial Distillation
par: Zhao, Shiji, et autres
Publié: (2023)
par: Zhao, Shiji, et autres
Publié: (2023)
Tensorized Clustered LoRA Merging for Multi-Task Interference
par: Su, Zhan, et autres
Publié: (2025)
par: Su, Zhan, et autres
Publié: (2025)
Task Vector Bases: A Unified and Scalable Framework for Compressed Task Arithmetic
par: Zeng, Siqi, et autres
Publié: (2025)
par: Zeng, Siqi, et autres
Publié: (2025)
Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective
par: Zhang, Zhi, et autres
Publié: (2024)
par: Zhang, Zhi, et autres
Publié: (2024)
WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning
par: Wei, Zhepei, et autres
Publié: (2025)
par: Wei, Zhepei, et autres
Publié: (2025)
Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation
par: Wang, Cheems, et autres
Publié: (2024)
par: Wang, Cheems, et autres
Publié: (2024)
Lightweight and Robust Federated Data Valuation
par: Tang, Guojun, et autres
Publié: (2025)
par: Tang, Guojun, et autres
Publié: (2025)
Efficient Stochastic Approximation of Minimax Excess Risk Optimization
par: Zhang, Lijun, et autres
Publié: (2023)
par: Zhang, Lijun, et autres
Publié: (2023)
MergeBench: A Benchmark for Merging Domain-Specialized LLMs
par: He, Yifei, et autres
Publié: (2025)
par: He, Yifei, et autres
Publié: (2025)
Zeroth-Order Stochastic Mirror Descent Algorithms for Minimax Excess Risk Optimization
par: Gu, Zhihao, et autres
Publié: (2024)
par: Gu, Zhihao, et autres
Publié: (2024)
Moment Alignment: Unifying Gradient and Hessian Matching for Domain Generalization
par: Chen, Yuen, et autres
Publié: (2025)
par: Chen, Yuen, et autres
Publié: (2025)
Robust Bayesian Dynamic Programming for On-policy Risk-sensitive Reinforcement Learning
par: Han, Shanyu, et autres
Publié: (2025)
par: Han, Shanyu, et autres
Publié: (2025)
Improving Sampling Efficiency in RLVR through Adaptive Rollout and Response Reuse
par: Zhang, Yuheng, et autres
Publié: (2025)
par: Zhang, Yuheng, et autres
Publié: (2025)
Localize-and-Stitch: Efficient Model Merging via Sparse Task Arithmetic
par: He, Yifei, et autres
Publié: (2024)
par: He, Yifei, et autres
Publié: (2024)
Distributionally Robust Multi-Task Reinforcement Learning via Adaptive Task Sampling
par: Corrado, Nicholas E., et autres
Publié: (2026)
par: Corrado, Nicholas E., et autres
Publié: (2026)
Delve into the Applicability of Advanced Optimizers for Multi-Task Learning
par: Zhou, Zhipeng, et autres
Publié: (2026)
par: Zhou, Zhipeng, et autres
Publié: (2026)
Multi-Task Learning with Feature-Similarity Laplacian Graphs for Predicting Alzheimer's Disease Progression
par: Xu, Zixiang, et autres
Publié: (2025)
par: Xu, Zixiang, et autres
Publié: (2025)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
par: Xiong, Guojun, et autres
Publié: (2024)
par: Xiong, Guojun, et autres
Publié: (2024)
Sharper Risk Bound for Multi-Task Learning with Multi-Graph Dependent Data
par: Shao, Xiao, et autres
Publié: (2025)
par: Shao, Xiao, et autres
Publié: (2025)
MoSLD: An Extremely Parameter-Efficient Mixture-of-Shared LoRAs for Multi-Task Learning
par: Zhao, Lulu, et autres
Publié: (2024)
par: Zhao, Lulu, et autres
Publié: (2024)
Injecting Imbalance Sensitivity for Multi-Task Learning
par: Zhou, Zhipeng, et autres
Publié: (2025)
par: Zhou, Zhipeng, et autres
Publié: (2025)
Minimax Excess Risk of First-Order Methods for Statistical Learning with Data-Dependent Oracles
par: Scaman, Kevin, et autres
Publié: (2023)
par: Scaman, Kevin, et autres
Publié: (2023)
Efficient Utility-Preserving Machine Unlearning with Implicit Gradient Surgery
par: Zhou, Shiji, et autres
Publié: (2025)
par: Zhou, Shiji, et autres
Publié: (2025)
Multi-Task Corrupted Prediction for Learning Robust Audio-Visual Speech Representation
par: Kim, Sungnyun, et autres
Publié: (2025)
par: Kim, Sungnyun, et autres
Publié: (2025)
Ask a Strong LLM Judge when Your Reward Model is Uncertain
par: Xu, Zhenghao, et autres
Publié: (2025)
par: Xu, Zhenghao, et autres
Publié: (2025)
Robust-Multi-Task Gradient Boosting
par: Emami, Seyedsaman, et autres
Publié: (2025)
par: Emami, Seyedsaman, et autres
Publié: (2025)
Optimal Excess Risk Bounds for Empirical Risk Minimization on $p$-Norm Linear Regression
par: Hanchi, Ayoub El, et autres
Publié: (2023)
par: Hanchi, Ayoub El, et autres
Publié: (2023)
Enabling Asymmetric Knowledge Transfer in Multi-Task Learning with Self-Auxiliaries
par: Graffeuille, Olivier, et autres
Publié: (2024)
par: Graffeuille, Olivier, et autres
Publié: (2024)
Gradual Domain Adaptation: Theory and Algorithms
par: He, Yifei, et autres
Publié: (2023)
par: He, Yifei, et autres
Publié: (2023)
SWEET-RL: Training Multi-Turn LLM Agents on Collaborative Reasoning Tasks
par: Zhou, Yifei, et autres
Publié: (2025)
par: Zhou, Yifei, et autres
Publié: (2025)
Hidden Representation Clustering with Multi-Task Representation Learning towards Robust Online Budget Allocation
par: Wang, Xiaohan, et autres
Publié: (2025)
par: Wang, Xiaohan, et autres
Publié: (2025)
Improving Adversarial Robust Fairness via Anti-Bias Soft Label Distillation
par: Zhao, Shiji, et autres
Publié: (2023)
par: Zhao, Shiji, et autres
Publié: (2023)
Continual Optimization with Symmetry Teleportation for Multi-Task Learning
par: Zhou, Zhipeng, et autres
Publié: (2025)
par: Zhou, Zhipeng, et autres
Publié: (2025)
GlycanML: A Multi-Task and Multi-Structure Benchmark for Glycan Machine Learning
par: Xu, Minghao, et autres
Publié: (2024)
par: Xu, Minghao, et autres
Publié: (2024)
Documents similaires
-
AutoMixAlign: Adaptive Data Mixing for Multi-Task Preference Optimization in LLMs
par: Corrado, Nicholas E., et autres
Publié: (2025) -
Evolutionary Contrastive Distillation for Language Model Alignment
par: Katz-Samuels, Julian, et autres
Publié: (2024) -
VidLA: Video-Language Alignment at Scale
par: Rizve, Mamshad Nayeem, et autres
Publié: (2024) -
DreamBlend: Advancing Personalized Fine-tuning of Text-to-Image Diffusion Models
par: Ram, Shwetha, et autres
Publié: (2024) -
InfoPO: On Mutual Information Maximization for Large Language Model Alignment
par: Xiao, Teng, et autres
Publié: (2025)