SGW-based Multi-Task Learning in Vision Tasks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Ruiyuan, Chen, Yuyao, Huo, Yuchi, Liu, Jiaxiang, Xi, Dianbing, Liu, Jie, Wu, Chao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Leveraging Pretrained Diffusion Models for Zero-Shot Part Assembly
par: Zhang, Ruiyuan, et autres
Publié: (2025)
par: Zhang, Ruiyuan, et autres
Publié: (2025)
PFAvatar: Pose-Fusion 3D Personalized Avatar Reconstruction from Real-World Outfit-of-the-Day Photos
par: Xi, Dianbing, et autres
Publié: (2025)
par: Xi, Dianbing, et autres
Publié: (2025)
Anomaly Multi-classification in Industrial Scenarios: Transferring Few-shot Learning to a New Task
par: Liu, Jie, et autres
Publié: (2024)
par: Liu, Jie, et autres
Publié: (2024)
Inverse Rendering using Multi-Bounce Path Tracing and Reservoir Sampling
par: Dai, Yuxin, et autres
Publié: (2024)
par: Dai, Yuxin, et autres
Publié: (2024)
Hierarchical Invariance for Robust and Interpretable Vision Tasks at Larger Scales
par: Qi, Shuren, et autres
Publié: (2024)
par: Qi, Shuren, et autres
Publié: (2024)
Frequency Switching Mechanism for Parameter-E!cient Multi-Task Learning
par: Liu, Shih-Wen, et autres
Publié: (2026)
par: Liu, Shih-Wen, et autres
Publié: (2026)
Sample-Centric Multi-Task Learning for Detection and Segmentation of Industrial Surface Defects
par: Dong, Hang-Cheng, et autres
Publié: (2025)
par: Dong, Hang-Cheng, et autres
Publié: (2025)
AdaMerging: Adaptive Model Merging for Multi-Task Learning
par: Yang, Enneng, et autres
Publié: (2023)
par: Yang, Enneng, et autres
Publié: (2023)
AdaTask: A Task-aware Adaptive Learning Rate Approach to Multi-task Learning
par: Yang, Enneng, et autres
Publié: (2022)
par: Yang, Enneng, et autres
Publié: (2022)
Quantifying Task Priority for Multi-Task Optimization
par: Jeong, Wooseong, et autres
Publié: (2024)
par: Jeong, Wooseong, et autres
Publié: (2024)
VCR: A Task for Pixel-Level Complex Reasoning in Vision Language Models via Restoring Occluded Text
par: Zhang, Tianyu, et autres
Publié: (2024)
par: Zhang, Tianyu, et autres
Publié: (2024)
Prismer: A Vision-Language Model with Multi-Task Experts
par: Liu, Shikun, et autres
Publié: (2023)
par: Liu, Shikun, et autres
Publié: (2023)
Rep-MTL: Unleashing the Power of Representation-level Task Saliency for Multi-Task Learning
par: Wang, Zedong, et autres
Publié: (2025)
par: Wang, Zedong, et autres
Publié: (2025)
OmniVDiff: Omni Controllable Video Diffusion for Generation and Understanding
par: Xi, Dianbing, et autres
Publié: (2025)
par: Xi, Dianbing, et autres
Publié: (2025)
Synthesizer Based Efficient Self-Attention for Vision Tasks
par: Zhu, Guangyang, et autres
Publié: (2022)
par: Zhu, Guangyang, et autres
Publié: (2022)
Task-based Loss Functions in Computer Vision: A Comprehensive Review
par: Elharrouss, Omar, et autres
Publié: (2025)
par: Elharrouss, Omar, et autres
Publié: (2025)
Task-Driven Subspace Decomposition for Knowledge Sharing and Isolation in LoRA-based Continual Learning
par: He, Lingfeng, et autres
Publié: (2026)
par: He, Lingfeng, et autres
Publié: (2026)
A Survey on Deep Multi-Task Learning in Connected Autonomous Vehicles
par: Wang, Jiayuan, et autres
Publié: (2025)
par: Wang, Jiayuan, et autres
Publié: (2025)
AutoMMLab: Automatically Generating Deployable Models from Language Instructions for Computer Vision Tasks
par: Yang, Zekang, et autres
Publié: (2024)
par: Yang, Zekang, et autres
Publié: (2024)
Multi-instance Learning as Downstream Task of Self-Supervised Learning-based Pre-trained Model
par: Matsuishi, Koki, et autres
Publié: (2025)
par: Matsuishi, Koki, et autres
Publié: (2025)
Learning to Rank Pre-trained Vision-Language Models for Downstream Tasks
par: Ding, Yuhe, et autres
Publié: (2024)
par: Ding, Yuhe, et autres
Publié: (2024)
Remote Sensing Image Segmentation Using Vision Mamba and Multi-Scale Multi-Frequency Feature Fusion
par: Cao, Yice, et autres
Publié: (2024)
par: Cao, Yice, et autres
Publié: (2024)
Gradient Similarity Surgery in Multi-Task Deep Learning
par: Borsani, Thomas, et autres
Publié: (2025)
par: Borsani, Thomas, et autres
Publié: (2025)
Understanding Task Transfer in Vision-Language Models
par: Sachdeva, Bhuvan, et autres
Publié: (2025)
par: Sachdeva, Bhuvan, et autres
Publié: (2025)
INTERACT-CMIL: Multi-Task Shared Learning and Inter-Task Consistency for Conjunctival Melanocytic Intraepithelial Lesion Grading
par: Ikinci, Mert, et autres
Publié: (2025)
par: Ikinci, Mert, et autres
Publié: (2025)
DRESS: Disentangled Representation-based Self-Supervised Meta-Learning for Diverse Tasks
par: Cui, Wei, et autres
Publié: (2025)
par: Cui, Wei, et autres
Publié: (2025)
Redefining non-IID Data in Federated Learning for Computer Vision Tasks: Migrating from Labels to Embeddings for Task-Specific Data Distributions
par: Borazjani, Kasra, et autres
Publié: (2025)
par: Borazjani, Kasra, et autres
Publié: (2025)
Joint-Task Regularization for Partially Labeled Multi-Task Learning
par: Nishi, Kento, et autres
Publié: (2024)
par: Nishi, Kento, et autres
Publié: (2024)
Task-Aware Multi-Expert Architecture For Lifelong Deep Learning
par: Wang, Jianyu, et autres
Publié: (2025)
par: Wang, Jianyu, et autres
Publié: (2025)
Multi-Task Learning for Visually Grounded Reasoning in Gastrointestinal VQA
par: Safwan, Itbaan, et autres
Publié: (2025)
par: Safwan, Itbaan, et autres
Publié: (2025)
Benchmarking Vision, Language, & Action Models on Robotic Learning Tasks
par: Guruprasad, Pranav, et autres
Publié: (2024)
par: Guruprasad, Pranav, et autres
Publié: (2024)
Scalable Geometric Fracture Assembly via Co-creation Space among Assemblers
par: Zhang, Ruiyuan, et autres
Publié: (2023)
par: Zhang, Ruiyuan, et autres
Publié: (2023)
Leveraging Vision Language Models for Specialized Agricultural Tasks
par: Arshad, Muhammad Arbab, et autres
Publié: (2024)
par: Arshad, Muhammad Arbab, et autres
Publié: (2024)
GFPL: Generative Federated Prototype Learning for Resource-Constrained and Data-Imbalanced Vision Task
par: Lu, Shiwei, et autres
Publié: (2026)
par: Lu, Shiwei, et autres
Publié: (2026)
GCond: Gradient Conflict Resolution via Accumulation-based Stabilization for Large-Scale Multi-Task Learning
par: Limarenko, Evgeny Alves, et autres
Publié: (2025)
par: Limarenko, Evgeny Alves, et autres
Publié: (2025)
The Unified Balance Theory of Second-Moment Exponential Scaling Optimizers in Visual Tasks
par: Zhang, Gongyue, et autres
Publié: (2024)
par: Zhang, Gongyue, et autres
Publié: (2024)
Advancing Vision-based Human Action Recognition: Exploring Vision-Language CLIP Model for Generalisation in Domain-Independent Tasks
par: Shandilya, Utkarsh, et autres
Publié: (2025)
par: Shandilya, Utkarsh, et autres
Publié: (2025)
Parameter-efficient Multi-Task and Multi-Domain Learning using Factorized Tensor Networks
par: Garg, Yash, et autres
Publié: (2023)
par: Garg, Yash, et autres
Publié: (2023)
When Multi-Task Learning Meets Partial Supervision: A Computer Vision Review
par: Fontana, Maxime, et autres
Publié: (2023)
par: Fontana, Maxime, et autres
Publié: (2023)
Multi-Dataset Multi-Task Learning for COVID-19 Prognosis
par: Ruffini, Filippo, et autres
Publié: (2024)
par: Ruffini, Filippo, et autres
Publié: (2024)
Documents similaires
-
Leveraging Pretrained Diffusion Models for Zero-Shot Part Assembly
par: Zhang, Ruiyuan, et autres
Publié: (2025) -
PFAvatar: Pose-Fusion 3D Personalized Avatar Reconstruction from Real-World Outfit-of-the-Day Photos
par: Xi, Dianbing, et autres
Publié: (2025) -
Anomaly Multi-classification in Industrial Scenarios: Transferring Few-shot Learning to a New Task
par: Liu, Jie, et autres
Publié: (2024) -
Inverse Rendering using Multi-Bounce Path Tracing and Reservoir Sampling
par: Dai, Yuxin, et autres
Publié: (2024) -
Hierarchical Invariance for Robust and Interpretable Vision Tasks at Larger Scales
par: Qi, Shuren, et autres
Publié: (2024)