Efficient Stitchable Task Adaptation
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Haoyu, Pan, Zizheng, Liu, Jing, Cai, Jianfei, Zhuang, Bohan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pruning Self-attentions into Convolutional Layers in Single Path
di: He, Haoyu, et al.
Pubblicazione: (2021)
di: He, Haoyu, et al.
Pubblicazione: (2021)
T-Stitch: Accelerating Sampling in Pre-Trained Diffusion Models with Trajectory Stitching
di: Pan, Zizheng, et al.
Pubblicazione: (2024)
di: Pan, Zizheng, et al.
Pubblicazione: (2024)
FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion
di: Chen, Zhuokun, et al.
Pubblicazione: (2026)
di: Chen, Zhuokun, et al.
Pubblicazione: (2026)
Evaluating and Advancing Multimodal Large Language Models in Perception Ability Lens
di: Chen, Feng, et al.
Pubblicazione: (2024)
di: Chen, Feng, et al.
Pubblicazione: (2024)
Localize-and-Stitch: Efficient Model Merging via Sparse Task Arithmetic
di: He, Yifei, et al.
Pubblicazione: (2024)
di: He, Yifei, et al.
Pubblicazione: (2024)
Efficient Domain Adaptation of Multimodal Embeddings using Constrastive Learning
di: Margaritis, Georgios, et al.
Pubblicazione: (2025)
di: Margaritis, Georgios, et al.
Pubblicazione: (2025)
Task-Specific Directions: Definition, Exploration, and Utilization in Parameter Efficient Fine-Tuning
di: Si, Chongjie, et al.
Pubblicazione: (2024)
di: Si, Chongjie, et al.
Pubblicazione: (2024)
Monkey Jump : MoE-Style PEFT for Efficient Multi-Task Learning
di: Prottasha, Nusrat Jahan, et al.
Pubblicazione: (2026)
di: Prottasha, Nusrat Jahan, et al.
Pubblicazione: (2026)
Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models
di: Xu, Qinwu, et al.
Pubblicazione: (2026)
di: Xu, Qinwu, et al.
Pubblicazione: (2026)
Rethinking Misalignment in Vision-Language Model Adaptation from a Causal Perspective
di: Zhang, Yanan, et al.
Pubblicazione: (2024)
di: Zhang, Yanan, et al.
Pubblicazione: (2024)
ATR-Bench: A Federated Learning Benchmark for Adaptation, Trust, and Reasoning
di: Ashraf, Tajamul, et al.
Pubblicazione: (2025)
di: Ashraf, Tajamul, et al.
Pubblicazione: (2025)
VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks
di: Koh, Jing Yu, et al.
Pubblicazione: (2024)
di: Koh, Jing Yu, et al.
Pubblicazione: (2024)
Dynamic Context-oriented Decomposition for Task-aware Low-rank Adaptation with Less Forgetting and Faster Convergence
di: Yang, Yibo, et al.
Pubblicazione: (2025)
di: Yang, Yibo, et al.
Pubblicazione: (2025)
Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis
di: Chen, Zhuokun, et al.
Pubblicazione: (2025)
di: Chen, Zhuokun, et al.
Pubblicazione: (2025)
HoloLLM: Multisensory Foundation Model for Language-Grounded Human Sensing and Reasoning
di: Zhou, Chuhao, et al.
Pubblicazione: (2025)
di: Zhou, Chuhao, et al.
Pubblicazione: (2025)
Few-shot Adaptation to Distribution Shifts By Mixing Source and Target Embeddings
di: Xue, Yihao, et al.
Pubblicazione: (2023)
di: Xue, Yihao, et al.
Pubblicazione: (2023)
DeLoRA: Decoupling Angles and Strength in Low-rank Adaptation
di: Bini, Massimo, et al.
Pubblicazione: (2025)
di: Bini, Massimo, et al.
Pubblicazione: (2025)
PaRa: Personalizing Text-to-Image Diffusion via Parameter Rank Reduction
di: Chen, Shangyu, et al.
Pubblicazione: (2024)
di: Chen, Shangyu, et al.
Pubblicazione: (2024)
The Vision Wormhole: Latent-Space Communication in Heterogeneous Multi-Agent Systems
di: Liu, Xiaoze, et al.
Pubblicazione: (2026)
di: Liu, Xiaoze, et al.
Pubblicazione: (2026)
MASSV: Multimodal Adaptation and Self-Data Distillation for Speculative Decoding of Vision-Language Models
di: Ganesan, Mugilan, et al.
Pubblicazione: (2025)
di: Ganesan, Mugilan, et al.
Pubblicazione: (2025)
BYOM: Building Your Own Multi-Task Model For Free
di: Jiang, Weisen, et al.
Pubblicazione: (2023)
di: Jiang, Weisen, et al.
Pubblicazione: (2023)
Vision-Language Models Create Cross-Modal Task Representations
di: Luo, Grace, et al.
Pubblicazione: (2024)
di: Luo, Grace, et al.
Pubblicazione: (2024)
Task Matrices: Linear Maps for Cross-Model Finetuning Transfer
di: Brien, Darrin O', et al.
Pubblicazione: (2025)
di: Brien, Darrin O', et al.
Pubblicazione: (2025)
Multi-Task Model Merging via Adaptive Weight Disentanglement
di: Xiong, Feng, et al.
Pubblicazione: (2024)
di: Xiong, Feng, et al.
Pubblicazione: (2024)
Efficient Model Editing with Task-Localized Sparse Fine-tuning
di: Iurada, Leonardo, et al.
Pubblicazione: (2025)
di: Iurada, Leonardo, et al.
Pubblicazione: (2025)
Enhancing Post-Training Quantization via Future Activation Awareness
di: Lv, Zheqi, et al.
Pubblicazione: (2026)
di: Lv, Zheqi, et al.
Pubblicazione: (2026)
MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks
di: Wu, Yiming, et al.
Pubblicazione: (2024)
di: Wu, Yiming, et al.
Pubblicazione: (2024)
MM-GEN: Enhancing Task Performance Through Targeted Multimodal Data Curation
di: Joshi, Siddharth, et al.
Pubblicazione: (2025)
di: Joshi, Siddharth, et al.
Pubblicazione: (2025)
Language-Pretraining-Induced Bias: A Strong Foundation for General Vision Tasks
di: Luo, Yaxin, et al.
Pubblicazione: (2026)
di: Luo, Yaxin, et al.
Pubblicazione: (2026)
Gla-AI4BioMed at RRG24: Visual Instruction-tuned Adaptation for Radiology Report Generation
di: Zhang, Xi, et al.
Pubblicazione: (2024)
di: Zhang, Xi, et al.
Pubblicazione: (2024)
Transformers without Normalization
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
VLM Judges Can Rank but Cannot Score: Task-Dependent Uncertainty in Multimodal Evaluation
di: Kumar, Divake, et al.
Pubblicazione: (2026)
di: Kumar, Divake, et al.
Pubblicazione: (2026)
Compress to Impress: Efficient LLM Adaptation Using a Single Gradient Step on 100 Samples
di: Sreeram, Shiva, et al.
Pubblicazione: (2025)
di: Sreeram, Shiva, et al.
Pubblicazione: (2025)
ElaLoRA: Elastic & Learnable Low-Rank Adaptation for Efficient Model Fine-Tuning
di: Chang, Huandong, et al.
Pubblicazione: (2025)
di: Chang, Huandong, et al.
Pubblicazione: (2025)
RDP LoRA: Geometry-Driven Identification for Parameter-Efficient Adaptation in Large Language Models
di: Çelebi, Yusuf, et al.
Pubblicazione: (2026)
di: Çelebi, Yusuf, et al.
Pubblicazione: (2026)
How Vision-Language Tasks Benefit from Large Pre-trained Models: A Survey
di: Qi, Yayun, et al.
Pubblicazione: (2024)
di: Qi, Yayun, et al.
Pubblicazione: (2024)
The Double Dilemma in Multi-Task Radiology Report Generation: A Gradient Dynamics Analysis and Solution
di: Zhang, Erjian, et al.
Pubblicazione: (2026)
di: Zhang, Erjian, et al.
Pubblicazione: (2026)
Prime Once, then Reprogram Locally: An Efficient Alternative to Black-Box Service Model Adaptation
di: Zhang, Yunbei, et al.
Pubblicazione: (2026)
di: Zhang, Yunbei, et al.
Pubblicazione: (2026)
RIG: Synergizing Reasoning and Imagination in End-to-End Generalist Policy
di: Zhao, Zhonghan, et al.
Pubblicazione: (2025)
di: Zhao, Zhonghan, et al.
Pubblicazione: (2025)
Adapting in the Dark: Efficient and Stable Test-Time Adaptation for Black-Box Models
di: Zhang, Yunbei, et al.
Pubblicazione: (2026)
di: Zhang, Yunbei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Pruning Self-attentions into Convolutional Layers in Single Path
di: He, Haoyu, et al.
Pubblicazione: (2021) -
T-Stitch: Accelerating Sampling in Pre-Trained Diffusion Models with Trajectory Stitching
di: Pan, Zizheng, et al.
Pubblicazione: (2024) -
FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion
di: Chen, Zhuokun, et al.
Pubblicazione: (2026) -
Evaluating and Advancing Multimodal Large Language Models in Perception Ability Lens
di: Chen, Feng, et al.
Pubblicazione: (2024) -
Localize-and-Stitch: Efficient Model Merging via Sparse Task Arithmetic
di: He, Yifei, et al.
Pubblicazione: (2024)