Vision as LoRA
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Han, Ye, Yongjie, Li, Bingru, Nie, Yuxiang, Lu, Jinghui, Tang, Jingqun, Wang, Yanjie, Huang, Can |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Elysium: Exploring Object-level Perception in Videos via MLLM
di: Wang, Han, et al.
Pubblicazione: (2024)
di: Wang, Han, et al.
Pubblicazione: (2024)
In-Context Meta LoRA Generation
di: Shao, Yihua, et al.
Pubblicazione: (2025)
di: Shao, Yihua, et al.
Pubblicazione: (2025)
Evolutionary Negative Module Pruning for Better LoRA Merging
di: Cao, Anda, et al.
Pubblicazione: (2026)
di: Cao, Anda, et al.
Pubblicazione: (2026)
Dynamic-VLM: Simple Dynamic Visual Token Compression for VideoLLM
di: Wang, Han, et al.
Pubblicazione: (2024)
di: Wang, Han, et al.
Pubblicazione: (2024)
Octavius: Mitigating Task Interference in MLLMs via LoRA-MoE
di: Chen, Zeren, et al.
Pubblicazione: (2023)
di: Chen, Zeren, et al.
Pubblicazione: (2023)
Multi-LoRA Composition for Image Generation
di: Zhong, Ming, et al.
Pubblicazione: (2024)
di: Zhong, Ming, et al.
Pubblicazione: (2024)
TC-LoRA: Temporally Modulated Conditional LoRA for Adaptive Diffusion Control
di: Cho, Minkyoung, et al.
Pubblicazione: (2025)
di: Cho, Minkyoung, et al.
Pubblicazione: (2025)
NOLA: Compressing LoRA using Linear Combination of Random Basis
di: Koohpayegani, Soroush Abbasi, et al.
Pubblicazione: (2023)
di: Koohpayegani, Soroush Abbasi, et al.
Pubblicazione: (2023)
Mask the Target: A Plug-and-Play Regularizer Against LoRA Forgetting
di: Xu, Runze, et al.
Pubblicazione: (2026)
di: Xu, Runze, et al.
Pubblicazione: (2026)
LangVision-LoRA-NAS: Neural Architecture Search for Variable LoRA Rank in Vision Language Models
di: Chitty-Venkata, Krishna Teja, et al.
Pubblicazione: (2025)
di: Chitty-Venkata, Krishna Teja, et al.
Pubblicazione: (2025)
NP-LoRA: Null Space Projection for Subject-Style LoRA Fusion
di: Chen, Chuheng, et al.
Pubblicazione: (2025)
di: Chen, Chuheng, et al.
Pubblicazione: (2025)
A Novel Trustworthy Video Summarization Algorithm Through a Mixture of LoRA Experts
di: Du, Wenzhuo, et al.
Pubblicazione: (2025)
di: Du, Wenzhuo, et al.
Pubblicazione: (2025)
FreeLoRA: Enabling Training-Free LoRA Fusion for Autoregressive Multi-Subject Personalization
di: Zheng, Peng, et al.
Pubblicazione: (2025)
di: Zheng, Peng, et al.
Pubblicazione: (2025)
Empower Vision Applications with LoRA LMM
di: Mi, Liang, et al.
Pubblicazione: (2024)
di: Mi, Liang, et al.
Pubblicazione: (2024)
NAS-LoRA: Empowering Parameter-Efficient Fine-Tuning for Visual Foundation Models with Searchable Adaptation
di: Chen, Renqi, et al.
Pubblicazione: (2025)
di: Chen, Renqi, et al.
Pubblicazione: (2025)
TAS-LoRA: Transformer Architecture Search with Mixture-of-LoRA Experts
di: Jeon, Jeimin, et al.
Pubblicazione: (2026)
di: Jeon, Jeimin, et al.
Pubblicazione: (2026)
LoRA-Edit: Controllable First-Frame-Guided Video Editing via Mask-Aware LoRA Fine-Tuning
di: Gao, Chenjian, et al.
Pubblicazione: (2025)
di: Gao, Chenjian, et al.
Pubblicazione: (2025)
Video2LoRA: Unified Semantic-Controlled Video Generation via Per-Reference-Video LoRA
di: Wu, Zexi, et al.
Pubblicazione: (2026)
di: Wu, Zexi, et al.
Pubblicazione: (2026)
Think When Needed: Adaptive Reasoning-Driven Multimodal Embeddings with a Dual-LoRA Architecture
di: Zhang, Longxiang, et al.
Pubblicazione: (2026)
di: Zhang, Longxiang, et al.
Pubblicazione: (2026)
LoRA-FAIR: Federated LoRA Fine-Tuning with Aggregation and Initialization Refinement
di: Bian, Jieming, et al.
Pubblicazione: (2024)
di: Bian, Jieming, et al.
Pubblicazione: (2024)
Multimodal Instruction Tuning with Conditional Mixture of LoRA
di: Shen, Ying, et al.
Pubblicazione: (2024)
di: Shen, Ying, et al.
Pubblicazione: (2024)
In-Context LoRA for Diffusion Transformers
di: Huang, Lianghua, et al.
Pubblicazione: (2024)
di: Huang, Lianghua, et al.
Pubblicazione: (2024)
Meta-LoRA: Meta-Learning LoRA Components for Domain-Aware ID Personalization
di: Topal, Barış Batuhan, et al.
Pubblicazione: (2025)
di: Topal, Barış Batuhan, et al.
Pubblicazione: (2025)
CA-LoRA: Concept-Aware LoRA for Domain-Aligned Segmentation Dataset Generation
di: Park, Minho, et al.
Pubblicazione: (2025)
di: Park, Minho, et al.
Pubblicazione: (2025)
How LoRA Remembers? A Parametric Memory Law for LLM Finetuning
di: Xu, Ziwen, et al.
Pubblicazione: (2026)
di: Xu, Ziwen, et al.
Pubblicazione: (2026)
ChineseVideoBench: Benchmarking Multi-modal Large Models for Chinese Video Question Answering
di: Nie, Yuxiang, et al.
Pubblicazione: (2025)
di: Nie, Yuxiang, et al.
Pubblicazione: (2025)
LoRA in LoRA: Towards Parameter-Efficient Architecture Expansion for Continual Visual Instruction Tuning
di: Che, Chang, et al.
Pubblicazione: (2025)
di: Che, Chang, et al.
Pubblicazione: (2025)
LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models
di: Kojima, Yuto, et al.
Pubblicazione: (2025)
di: Kojima, Yuto, et al.
Pubblicazione: (2025)
K-LoRA: Unlocking Training-Free Fusion of Any Subject and Style LoRAs
di: Ouyang, Ziheng, et al.
Pubblicazione: (2025)
di: Ouyang, Ziheng, et al.
Pubblicazione: (2025)
LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion
di: Zhang, Yisu, et al.
Pubblicazione: (2025)
di: Zhang, Yisu, et al.
Pubblicazione: (2025)
Mixture of Cluster-conditional LoRA Experts for Vision-language Instruction Tuning
di: Gou, Yunhao, et al.
Pubblicazione: (2023)
di: Gou, Yunhao, et al.
Pubblicazione: (2023)
TimeStep Master: Asymmetrical Mixture of Timestep LoRA Experts for Versatile and Efficient Diffusion Models in Vision
di: Zhuang, Shaobin, et al.
Pubblicazione: (2025)
di: Zhuang, Shaobin, et al.
Pubblicazione: (2025)
LoRASculpt: Sculpting LoRA for Harmonizing General and Specialized Knowledge in Multimodal Large Language Models
di: Liang, Jian, et al.
Pubblicazione: (2025)
di: Liang, Jian, et al.
Pubblicazione: (2025)
ChimeraLoRA: Multi-Head LoRA-Guided Synthetic Datasets
di: Kim, Hoyoung, et al.
Pubblicazione: (2026)
di: Kim, Hoyoung, et al.
Pubblicazione: (2026)
StolenLoRA: Exploring LoRA Extraction Attacks via Synthetic Data
di: Wang, Yixu, et al.
Pubblicazione: (2025)
di: Wang, Yixu, et al.
Pubblicazione: (2025)
Deep LoRA-Unfolding Networks for Image Restoration
di: Wang, Xiangming, et al.
Pubblicazione: (2026)
di: Wang, Xiangming, et al.
Pubblicazione: (2026)
Decouple and Orthogonalize: A Data-Free Framework for LoRA Merging
di: Zheng, Shenghe, et al.
Pubblicazione: (2025)
di: Zheng, Shenghe, et al.
Pubblicazione: (2025)
ConsisLoRA: Enhancing Content and Style Consistency for LoRA-based Style Transfer
di: Chen, Bolin, et al.
Pubblicazione: (2025)
di: Chen, Bolin, et al.
Pubblicazione: (2025)
FedEx-LoRA: Exact Aggregation for Federated and Efficient Fine-Tuning of Foundation Models
di: Singhal, Raghav, et al.
Pubblicazione: (2024)
di: Singhal, Raghav, et al.
Pubblicazione: (2024)
ID-LoRA: Identity-Driven Audio-Video Personalization with In-Context LoRA
di: Dahan, Aviad, et al.
Pubblicazione: (2026)
di: Dahan, Aviad, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Elysium: Exploring Object-level Perception in Videos via MLLM
di: Wang, Han, et al.
Pubblicazione: (2024) -
In-Context Meta LoRA Generation
di: Shao, Yihua, et al.
Pubblicazione: (2025) -
Evolutionary Negative Module Pruning for Better LoRA Merging
di: Cao, Anda, et al.
Pubblicazione: (2026) -
Dynamic-VLM: Simple Dynamic Visual Token Compression for VideoLLM
di: Wang, Han, et al.
Pubblicazione: (2024) -
Octavius: Mitigating Task Interference in MLLMs via LoRA-MoE
di: Chen, Zeren, et al.
Pubblicazione: (2023)