Mamba as a Bridge: Where Vision Foundation Models Meet Vision Language Models for Domain-Generalized Semantic Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Xin, Tan, Robby T. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Stronger, Fewer, & Superior: Harnessing Vision Foundation Models for Domain Generalized Semantic Segmentation
par: Wei, Zhixiang, et autres
Publié: (2023)
par: Wei, Zhixiang, et autres
Publié: (2023)
Causal-Tune: Mining Causal Factors from Vision Foundation Models for Domain Generalized Semantic Segmentation
par: Zhang, Yin, et autres
Publié: (2025)
par: Zhang, Yin, et autres
Publié: (2025)
Semantic Segmentation in Multiple Adverse Weather Conditions with Domain Knowledge Retention
par: Yang, Xin, et autres
Publié: (2024)
par: Yang, Xin, et autres
Publié: (2024)
Rein++: Efficient Generalization and Adaptation for Semantic Segmentation with Vision Foundation Models
par: Wei, Zhixiang, et autres
Publié: (2025)
par: Wei, Zhixiang, et autres
Publié: (2025)
CrossEarth: Geospatial Vision Foundation Model for Domain Generalizable Remote Sensing Semantic Segmentation
par: Gong, Ziyang, et autres
Publié: (2024)
par: Gong, Ziyang, et autres
Publié: (2024)
CrossHOI-Bench: A Unified Benchmark for HOI Evaluation across Vision-Language Models and HOI-Specific Methods
par: Lei, Qinqian, et autres
Publié: (2025)
par: Lei, Qinqian, et autres
Publié: (2025)
Annotation Free Semantic Segmentation with Vision Foundation Models
par: Seifi, Soroush, et autres
Publié: (2024)
par: Seifi, Soroush, et autres
Publié: (2024)
White-Balance First, Adjust Later: Cross-Camera Color Constancy via Vision-Language Evaluation
par: Li, Shuwei, et autres
Publié: (2026)
par: Li, Shuwei, et autres
Publié: (2026)
Unbiased Semantic Decoding with Vision Foundation Models for Few-shot Segmentation
par: Wang, Jin, et autres
Publié: (2025)
par: Wang, Jin, et autres
Publié: (2025)
A Survey on Segment Anything Model (SAM): Vision Foundation Model Meets Prompt Engineering
par: Zhang, Chaoning, et autres
Publié: (2023)
par: Zhang, Chaoning, et autres
Publié: (2023)
Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation
par: Yu, Wenjun, et autres
Publié: (2025)
par: Yu, Wenjun, et autres
Publié: (2025)
Selective, Regularized, and Calibrated: Harnessing Vision Foundation Models for Cross-Domain Few-Shot Semantic Segmentation
par: Ma, Junyuan, et autres
Publié: (2026)
par: Ma, Junyuan, et autres
Publié: (2026)
ED-SAM: An Efficient Diffusion Sampling Approach to Domain Generalization in Vision-Language Foundation Models
par: Truong, Thanh-Dat, et autres
Publié: (2024)
par: Truong, Thanh-Dat, et autres
Publié: (2024)
Generalizable Knowledge Distillation from Vision Foundation Models for Semantic Segmentation
par: Lv, Chonghua, et autres
Publié: (2026)
par: Lv, Chonghua, et autres
Publié: (2026)
Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention
par: Zhao, Jianfei, et autres
Publié: (2025)
par: Zhao, Jianfei, et autres
Publié: (2025)
FisherTune: Fisher-Guided Robust Tuning of Vision Foundation Models for Domain Generalized Segmentation
par: Zhao, Dong, et autres
Publié: (2025)
par: Zhao, Dong, et autres
Publié: (2025)
Do Vision Foundation Models Enhance Domain Generalization in Medical Image Segmentation?
par: Cekmeceli, Kerem, et autres
Publié: (2024)
par: Cekmeceli, Kerem, et autres
Publié: (2024)
Vision-Language Semantic Grounding for Multi-Domain Crop-Weed Segmentation
par: Hossain, Nazia, et autres
Publié: (2026)
par: Hossain, Nazia, et autres
Publié: (2026)
PolarVLM: Bridging the Semantic-Physical Gap in Vision-Language Models
par: Li, Yuliang, et autres
Publié: (2026)
par: Li, Yuliang, et autres
Publié: (2026)
InfoCLIP: Bridging Vision-Language Pretraining and Open-Vocabulary Semantic Segmentation via Information-Theoretic Alignment Transfer
par: Yuan, Muyao, et autres
Publié: (2025)
par: Yuan, Muyao, et autres
Publié: (2025)
Minimal Semantic Sufficiency Meets Unsupervised Domain Generalization
par: Pan, Tan, et autres
Publié: (2025)
par: Pan, Tan, et autres
Publié: (2025)
Probabilistic Prototype Calibration of Vision-Language Models for Generalized Few-shot Semantic Segmentation
par: Liu, Jie, et autres
Publié: (2025)
par: Liu, Jie, et autres
Publié: (2025)
Vision Foundation Models as Generalist Tokenizers for Image Generation
par: Zheng, Anlin, et autres
Publié: (2026)
par: Zheng, Anlin, et autres
Publié: (2026)
Are Vision Foundation Models Foundational for Electron Microscopy Image Segmentation?
par: Fuster-Barceló, Caterina, et autres
Publié: (2026)
par: Fuster-Barceló, Caterina, et autres
Publié: (2026)
A Study on Unsupervised Domain Adaptation for Semantic Segmentation in the Era of Vision-Language Models
par: Schwonberg, Manuel, et autres
Publié: (2024)
par: Schwonberg, Manuel, et autres
Publié: (2024)
Set Pivot Learning: Redefining Generalized Segmentation with Vision Foundation Models
par: Li, Xinhui, et autres
Publié: (2025)
par: Li, Xinhui, et autres
Publié: (2025)
Image Re-Identification: Where Self-supervision Meets Vision-Language Learning
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
Toward Semantic-Agnostic and Shape-Aware Vision-Language Segmentation Models
par: Seutin, Corentin, et autres
Publié: (2026)
par: Seutin, Corentin, et autres
Publié: (2026)
Bridging Different Language Models and Generative Vision Models for Text-to-Image Generation
par: Zhao, Shihao, et autres
Publié: (2024)
par: Zhao, Shihao, et autres
Publié: (2024)
Small Language Model Meets with Reinforced Vision Vocabulary
par: Wei, Haoran, et autres
Publié: (2024)
par: Wei, Haoran, et autres
Publié: (2024)
Probing and Bridging Geometry-Interaction Cues for Affordance Reasoning in Vision Foundation Models
par: Zhang, Qing, et autres
Publié: (2026)
par: Zhang, Qing, et autres
Publié: (2026)
TASeg: Text-aware RGB-T Semantic Segmentation based on Fine-tuning Vision Foundation Models
par: Yu, Meng, et autres
Publié: (2025)
par: Yu, Meng, et autres
Publié: (2025)
Vision-Language Enhanced Foundation Model for Semi-supervised Medical Image Segmentation
par: Guo, Jiaqi, et autres
Publié: (2025)
par: Guo, Jiaqi, et autres
Publié: (2025)
Hyperspectral Adapter for Semantic Segmentation with Vision Foundation Models
par: Hurtado, Juana Valeria, et autres
Publié: (2025)
par: Hurtado, Juana Valeria, et autres
Publié: (2025)
How to Benchmark Vision Foundation Models for Semantic Segmentation?
par: Kerssies, Tommie, et autres
Publié: (2024)
par: Kerssies, Tommie, et autres
Publié: (2024)
Revisiting Continual Semantic Segmentation with Pre-trained Vision Models
par: Zhang, Duzhen, et autres
Publié: (2025)
par: Zhang, Duzhen, et autres
Publié: (2025)
Bridging Day and Night: Target-Class Hallucination Suppression in Unpaired Image Translation
par: Li, Shuwei, et autres
Publié: (2026)
par: Li, Shuwei, et autres
Publié: (2026)
Vision Superalignment: Weak-to-Strong Generalization for Vision Foundation Models
par: Guo, Jianyuan, et autres
Publié: (2024)
par: Guo, Jianyuan, et autres
Publié: (2024)
Equipping Vision Foundation Model with Mixture of Experts for Out-of-Distribution Detection
par: Zhao, Shizhen, et autres
Publié: (2025)
par: Zhao, Shizhen, et autres
Publié: (2025)
Test-Time Adaptation of Vision-Language Models for Open-Vocabulary Semantic Segmentation
par: Noori, Mehrdad, et autres
Publié: (2025)
par: Noori, Mehrdad, et autres
Publié: (2025)
Documents similaires
-
Stronger, Fewer, & Superior: Harnessing Vision Foundation Models for Domain Generalized Semantic Segmentation
par: Wei, Zhixiang, et autres
Publié: (2023) -
Causal-Tune: Mining Causal Factors from Vision Foundation Models for Domain Generalized Semantic Segmentation
par: Zhang, Yin, et autres
Publié: (2025) -
Semantic Segmentation in Multiple Adverse Weather Conditions with Domain Knowledge Retention
par: Yang, Xin, et autres
Publié: (2024) -
Rein++: Efficient Generalization and Adaptation for Semantic Segmentation with Vision Foundation Models
par: Wei, Zhixiang, et autres
Publié: (2025) -
CrossEarth: Geospatial Vision Foundation Model for Domain Generalizable Remote Sensing Semantic Segmentation
par: Gong, Ziyang, et autres
Publié: (2024)