Hierarchical Dual-Subspace Decoupling for Continual Learning in Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Qin, Mengxin, Zhang, Xiang, Wei, Kun, Yang, Xu, Deng, Cheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DIMoE-Adapters: Dynamic Expert Evolution for Continual Learning in Vision-Language Models
di: Qin, Mengxin, et al.
Pubblicazione: (2026)
di: Qin, Mengxin, et al.
Pubblicazione: (2026)
iGSP:Implicit Gradient Subspace Projection for Efficient Continual Learning of Vision-Language Models
di: Cui, Xuezhi, et al.
Pubblicazione: (2026)
di: Cui, Xuezhi, et al.
Pubblicazione: (2026)
Libra: Building Decoupled Vision System on Large Language Models
di: Xu, Yifan, et al.
Pubblicazione: (2024)
di: Xu, Yifan, et al.
Pubblicazione: (2024)
SIF: Semantically In-Distribution Fingerprints for Large Vision-Language Models
di: Zhao, Yifei, et al.
Pubblicazione: (2026)
di: Zhao, Yifei, et al.
Pubblicazione: (2026)
Complementary Subspace Low-Rank Adaptation of Vision-Language Models for Few-Shot Classification
di: Wang, Zhongqi, et al.
Pubblicazione: (2025)
di: Wang, Zhongqi, et al.
Pubblicazione: (2025)
Continuous Subspace Optimization for Continual Learning
di: Cheng, Quan, et al.
Pubblicazione: (2025)
di: Cheng, Quan, et al.
Pubblicazione: (2025)
Continual Vision-Language Learning for Remote Sensing: Benchmarking and Analysis
di: Weng, Xingxing, et al.
Pubblicazione: (2026)
di: Weng, Xingxing, et al.
Pubblicazione: (2026)
PathoHR: Hierarchical Reasoning for Vision-Language Models in Pathology
di: Huang, Yating, et al.
Pubblicazione: (2025)
di: Huang, Yating, et al.
Pubblicazione: (2025)
Hierarchical Cross-modal Prompt Learning for Vision-Language Models
di: Zheng, Hao, et al.
Pubblicazione: (2025)
di: Zheng, Hao, et al.
Pubblicazione: (2025)
HiSpatial: Taming Hierarchical 3D Spatial Understanding in Vision-Language Models
di: Liang, Huizhi, et al.
Pubblicazione: (2026)
di: Liang, Huizhi, et al.
Pubblicazione: (2026)
JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation
di: Zeng, Shuang, et al.
Pubblicazione: (2025)
di: Zeng, Shuang, et al.
Pubblicazione: (2025)
Enhanced Continual Learning of Vision-Language Models with Model Fusion
di: Gao, Haoyuan, et al.
Pubblicazione: (2025)
di: Gao, Haoyuan, et al.
Pubblicazione: (2025)
Select and Distill: Selective Dual-Teacher Knowledge Transfer for Continual Learning on Vision-Language Models
di: Yu, Yu-Chu, et al.
Pubblicazione: (2024)
di: Yu, Yu-Chu, et al.
Pubblicazione: (2024)
EvoVLMA: Evolutionary Vision-Language Model Adaptation
di: Ding, Kun, et al.
Pubblicazione: (2025)
di: Ding, Kun, et al.
Pubblicazione: (2025)
Subspace Alignment for Vision-Language Model Test-time Adaptation
di: Zeng, Zhichen, et al.
Pubblicazione: (2026)
di: Zeng, Zhichen, et al.
Pubblicazione: (2026)
Towards Arbitrary Motion Completing via Hierarchical Continuous Representation
di: Xu, Chenghao, et al.
Pubblicazione: (2025)
di: Xu, Chenghao, et al.
Pubblicazione: (2025)
Language-Guided Token Compression with Reinforcement Learning in Large Vision-Language Models
di: Cao, Sihan, et al.
Pubblicazione: (2026)
di: Cao, Sihan, et al.
Pubblicazione: (2026)
Calibrated Cache Model for Few-Shot Vision-Language Model Adaptation
di: Ding, Kun, et al.
Pubblicazione: (2024)
di: Ding, Kun, et al.
Pubblicazione: (2024)
Integrated Structural Prompt Learning for Vision-Language Models
di: Wang, Jiahui, et al.
Pubblicazione: (2025)
di: Wang, Jiahui, et al.
Pubblicazione: (2025)
Do You Guys Want to Dance: Zero-Shot Compositional Human Dance Generation with Multiple Persons
di: Xu, Zhe, et al.
Pubblicazione: (2024)
di: Xu, Zhe, et al.
Pubblicazione: (2024)
Zero-shot Generalizable Incremental Learning for Vision-Language Object Detection
di: Deng, Jieren, et al.
Pubblicazione: (2024)
di: Deng, Jieren, et al.
Pubblicazione: (2024)
A Bridge from Audio to Video: Phoneme-Viseme Alignment Allows Every Face to Speak Multiple Languages
di: Su, Zibo, et al.
Pubblicazione: (2025)
di: Su, Zibo, et al.
Pubblicazione: (2025)
Compositional Kronecker Context Optimization for Vision-Language Models
di: Ding, Kun, et al.
Pubblicazione: (2024)
di: Ding, Kun, et al.
Pubblicazione: (2024)
Decoupling Continual Semantic Segmentation
di: Guo, Yifu, et al.
Pubblicazione: (2025)
di: Guo, Yifu, et al.
Pubblicazione: (2025)
Branch, or Layer? Zeroth-Order Optimization for Continual Learning of Vision-Language Models
di: Liu, Ziwei, et al.
Pubblicazione: (2025)
di: Liu, Ziwei, et al.
Pubblicazione: (2025)
Cascade Prompt Learning for Vision-Language Model Adaptation
di: Wu, Ge, et al.
Pubblicazione: (2024)
di: Wu, Ge, et al.
Pubblicazione: (2024)
Breaking Semantic Hegemony: Decoupling Principal and Residual Subspaces for Generalized OOD Detection
di: Peng, Ningkang, et al.
Pubblicazione: (2026)
di: Peng, Ningkang, et al.
Pubblicazione: (2026)
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
di: Gao, Zhengqing, et al.
Pubblicazione: (2024)
di: Gao, Zhengqing, et al.
Pubblicazione: (2024)
Advancing Cross-domain Discriminability in Continual Learning of Vision-Language Models
di: Xu, Yicheng, et al.
Pubblicazione: (2024)
di: Xu, Yicheng, et al.
Pubblicazione: (2024)
ResTok: Learning Hierarchical Residuals in 1D Visual Tokenizers for Autoregressive Image Generation
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
Hierarchical and Decoupled BEV Perception Learning Framework for Autonomous Driving
di: Dai, Yuqi, et al.
Pubblicazione: (2024)
di: Dai, Yuqi, et al.
Pubblicazione: (2024)
Towards Unified Modeling in Federated Multi-Task Learning via Subspace Decoupling
di: Wei, Yipan, et al.
Pubblicazione: (2025)
di: Wei, Yipan, et al.
Pubblicazione: (2025)
Diagnosing and Repairing Unsafe Channels in Vision-Language Models via Causal Discovery and Dual-Modal Safety Subspace Projection
di: Fu, Jinhu, et al.
Pubblicazione: (2026)
di: Fu, Jinhu, et al.
Pubblicazione: (2026)
U-VLM: Hierarchical Vision Language Modeling for Report Generation
di: Shi, Pengcheng, et al.
Pubblicazione: (2026)
di: Shi, Pengcheng, et al.
Pubblicazione: (2026)
Triage: Hierarchical Visual Budgeting for Efficient Video Reasoning in Vision-Language Models
di: Wang, Anmin, et al.
Pubblicazione: (2026)
di: Wang, Anmin, et al.
Pubblicazione: (2026)
A Chain-of-Thought Subspace Meta-Learning for Few-shot Image Captioning with Large Vision and Language Models
di: Huang, Hao, et al.
Pubblicazione: (2025)
di: Huang, Hao, et al.
Pubblicazione: (2025)
Video-LaVIT: Unified Video-Language Pre-training with Decoupled Visual-Motional Tokenization
di: Jin, Yang, et al.
Pubblicazione: (2024)
di: Jin, Yang, et al.
Pubblicazione: (2024)
Unpaired Deblurring via Decoupled Diffusion Model
di: Cheng, Junhao, et al.
Pubblicazione: (2025)
di: Cheng, Junhao, et al.
Pubblicazione: (2025)
A Survey of Low-shot Vision-Language Model Adaptation via Representer Theorem
di: Ding, Kun, et al.
Pubblicazione: (2024)
di: Ding, Kun, et al.
Pubblicazione: (2024)
Dual-Modeling Decouple Distillation for Unsupervised Anomaly Detection
di: Liu, Xinyue, et al.
Pubblicazione: (2024)
di: Liu, Xinyue, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DIMoE-Adapters: Dynamic Expert Evolution for Continual Learning in Vision-Language Models
di: Qin, Mengxin, et al.
Pubblicazione: (2026) -
iGSP:Implicit Gradient Subspace Projection for Efficient Continual Learning of Vision-Language Models
di: Cui, Xuezhi, et al.
Pubblicazione: (2026) -
Libra: Building Decoupled Vision System on Large Language Models
di: Xu, Yifan, et al.
Pubblicazione: (2024) -
SIF: Semantically In-Distribution Fingerprints for Large Vision-Language Models
di: Zhao, Yifei, et al.
Pubblicazione: (2026) -
Complementary Subspace Low-Rank Adaptation of Vision-Language Models for Few-Shot Classification
di: Wang, Zhongqi, et al.
Pubblicazione: (2025)