OSDTW: Optimal Shared Depth and Task Weighting for Long-Tailed Recognition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chu, Chang, Zhang, Qingyue, Huang, Shao-Lun, Zheng, Junxiong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unified Optimization of Source Weights and Transfer Quantities in Multi-Source Transfer Learning: An Asymptotic Framework
par: Zhang, Qingyue, et autres
Publié: (2026)
par: Zhang, Qingyue, et autres
Publié: (2026)
LoRA-DA: Data-Aware Initialization for Low-Rank Adaptation via Asymptotic Analysis
par: Zhang, Qingyue, et autres
Publié: (2025)
par: Zhang, Qingyue, et autres
Publié: (2025)
A High-Dimensional Statistical Method for Optimizing Transfer Quantities in Multi-Source Transfer Learning
par: Zhang, Qingyue, et autres
Publié: (2025)
par: Zhang, Qingyue, et autres
Publié: (2025)
Mitigating Long-Tailed Anomaly Score Distributions with Importance-Weighted Loss
par: Lee, Jungi, et autres
Publié: (2026)
par: Lee, Jungi, et autres
Publié: (2026)
POWQMIX: Weighted Value Factorization with Potentially Optimal Joint Actions Recognition for Cooperative Multi-Agent Reinforcement Learning
par: Huang, Chang, et autres
Publié: (2024)
par: Huang, Chang, et autres
Publié: (2024)
Robust Layerwise Scaling Rules by Proper Weight Decay Tuning
par: Fan, Zhiyuan, et autres
Publié: (2025)
par: Fan, Zhiyuan, et autres
Publié: (2025)
Practical Transferability Estimation for Image Classification Tasks
par: Tan, Yang, et autres
Publié: (2021)
par: Tan, Yang, et autres
Publié: (2021)
Towards Improving Long-Tail Entity Predictions in Temporal Knowledge Graphs through Global Similarity and Weighted Sampling
par: Mirtaheri, Mehrnoosh, et autres
Publié: (2025)
par: Mirtaheri, Mehrnoosh, et autres
Publié: (2025)
QMP: Q-switch Mixture of Policies for Multi-Task Behavior Sharing
par: Zhang, Grace, et autres
Publié: (2023)
par: Zhang, Grace, et autres
Publié: (2023)
Shared-unique Features and Task-aware Prioritized Sampling on Multi-task Reinforcement Learning
par: Lin, Po-Shao, et autres
Publié: (2024)
par: Lin, Po-Shao, et autres
Publié: (2024)
Understanding the Impact of Differentially Private Training on Memorization of Long-Tailed Data
par: Zhang, Jiaming, et autres
Publié: (2026)
par: Zhang, Jiaming, et autres
Publié: (2026)
Stochastic Weight Sharing for Bayesian Neural Networks
par: Lin, Moule, et autres
Publié: (2025)
par: Lin, Moule, et autres
Publié: (2025)
Transferability-Guided Cross-Domain Cross-Task Transfer Learning
par: Tan, Yang, et autres
Publié: (2022)
par: Tan, Yang, et autres
Publié: (2022)
Risk-Informed Diffusion Transformer for Long-Tail Trajectory Prediction in the Crash Scenario
par: Chen, Junlan, et autres
Publié: (2025)
par: Chen, Junlan, et autres
Publié: (2025)
Ensemble of Pre-Trained Models for Long-Tailed Trajectory Prediction
par: Thuremella, Divya, et autres
Publié: (2025)
par: Thuremella, Divya, et autres
Publié: (2025)
A Universal Model for Human Mobility Prediction
par: Long, Qingyue, et autres
Publié: (2024)
par: Long, Qingyue, et autres
Publié: (2024)
Near-Optimal Regret for KL-Regularized Multi-Armed Bandits
par: Ji, Kaixuan, et autres
Publié: (2026)
par: Ji, Kaixuan, et autres
Publié: (2026)
Heterogeneous Graph Prompt Learning via Adaptive Weight Pruning
par: Wei, Chu-Yuan, et autres
Publié: (2025)
par: Wei, Chu-Yuan, et autres
Publié: (2025)
Tackling Heavy-Tailed Rewards in Reinforcement Learning with Function Approximation: Minimax Optimal and Instance-Dependent Regret Bounds
par: Huang, Jiayi, et autres
Publié: (2023)
par: Huang, Jiayi, et autres
Publié: (2023)
On the Optimal Sample Complexity of Offline Multi-Armed Bandits with KL Regularization
par: Ji, Kaixuan, et autres
Publié: (2026)
par: Ji, Kaixuan, et autres
Publié: (2026)
Estimating Long-term Heterogeneous Dose-response Curve: Generalization Bound Leveraging Optimal Transport Weights
par: Yang, Zeqin, et autres
Publié: (2024)
par: Yang, Zeqin, et autres
Publié: (2024)
Stochastic KV Routing: Enabling Adaptive Depth-Wise Cache Sharing
par: Filippova, Anastasiia, et autres
Publié: (2026)
par: Filippova, Anastasiia, et autres
Publié: (2026)
TAET: Two-Stage Adversarial Equalization Training on Long-Tailed Distributions
par: YuHang, Wang, et autres
Publié: (2025)
par: YuHang, Wang, et autres
Publié: (2025)
An Optimal Discriminator Weighted Imitation Perspective for Reinforcement Learning
par: Xu, Haoran, et autres
Publié: (2025)
par: Xu, Haoran, et autres
Publié: (2025)
Neural Architecture Search: Two Constant Shared Weights Initialisations
par: Gracheva, Ekaterina
Publié: (2023)
par: Gracheva, Ekaterina
Publié: (2023)
Addressing Long-Tail Noisy Label Learning Problems: a Two-Stage Solution with Label Refurbishment Considering Label Rarity
par: Wu, Ying-Hsuan, et autres
Publié: (2024)
par: Wu, Ying-Hsuan, et autres
Publié: (2024)
Shared Parameter Subspaces and Cross-Task Linearity in Emergently Misaligned Behavior
par: Arturi, Daniel Aarao Reis, et autres
Publié: (2025)
par: Arturi, Daniel Aarao Reis, et autres
Publié: (2025)
Momentum Boosted Episodic Memory for Improving Learning in Long-Tailed RL Environments
par: Fernandes, Dolton, et autres
Publié: (2025)
par: Fernandes, Dolton, et autres
Publié: (2025)
Heterogeneous Learning Rate Scheduling for Neural Architecture Search on Long-Tailed Datasets
par: Tang, Chenxia
Publié: (2024)
par: Tang, Chenxia
Publié: (2024)
Decoupled Federated Learning on Long-Tailed and Non-IID data with Feature Statistics
par: Chen, Zhuoxin, et autres
Publié: (2024)
par: Chen, Zhuoxin, et autres
Publié: (2024)
Celler:A Genomic Language Model for Long-Tailed Single-Cell Annotation
par: Zhao, Huan, et autres
Publié: (2025)
par: Zhao, Huan, et autres
Publié: (2025)
Variational Task Vector Composition
par: Zhang, Boyuan, et autres
Publié: (2025)
par: Zhang, Boyuan, et autres
Publié: (2025)
Space Alignment Matters: The Missing Piece for Inducing Neural Collapse in Long-Tailed Learning
par: Wang, Jinping, et autres
Publié: (2025)
par: Wang, Jinping, et autres
Publié: (2025)
The Optimal Token Baseline: Variance Reduction for Long-Horizon LLM-RL
par: Li, Yingru, et autres
Publié: (2026)
par: Li, Yingru, et autres
Publié: (2026)
Efficient UAV Swarm-Based Multi-Task Federated Learning with Dynamic Task Knowledge Sharing
par: Yang, Yubo, et autres
Publié: (2025)
par: Yang, Yubo, et autres
Publié: (2025)
One Fits All: General Mobility Trajectory Modeling via Masked Conditional Diffusion
par: Long, Qingyue, et autres
Publié: (2025)
par: Long, Qingyue, et autres
Publié: (2025)
Dynamic Population Distribution Aware Human Trajectory Generation with Diffusion Model
par: Long, Qingyue, et autres
Publié: (2025)
par: Long, Qingyue, et autres
Publié: (2025)
From Efficient Multimodal Models to World Models: A Survey
par: Mai, Xinji, et autres
Publié: (2024)
par: Mai, Xinji, et autres
Publié: (2024)
Identifying Sensitive Weights via Post-quantization Integral
par: Hu, Yuezhou, et autres
Publié: (2025)
par: Hu, Yuezhou, et autres
Publié: (2025)
DeltaLLM: Compress LLMs with Low-Rank Deltas between Shared Weights
par: Mikaelyan, Liana, et autres
Publié: (2025)
par: Mikaelyan, Liana, et autres
Publié: (2025)
Documents similaires
-
Unified Optimization of Source Weights and Transfer Quantities in Multi-Source Transfer Learning: An Asymptotic Framework
par: Zhang, Qingyue, et autres
Publié: (2026) -
LoRA-DA: Data-Aware Initialization for Low-Rank Adaptation via Asymptotic Analysis
par: Zhang, Qingyue, et autres
Publié: (2025) -
A High-Dimensional Statistical Method for Optimizing Transfer Quantities in Multi-Source Transfer Learning
par: Zhang, Qingyue, et autres
Publié: (2025) -
Mitigating Long-Tailed Anomaly Score Distributions with Importance-Weighted Loss
par: Lee, Jungi, et autres
Publié: (2026) -
POWQMIX: Weighted Value Factorization with Potentially Optimal Joint Actions Recognition for Cooperative Multi-Agent Reinforcement Learning
par: Huang, Chang, et autres
Publié: (2024)