Unsupervised Pre-training with Language-Vision Prompts for Low-Data Instance Segmentation
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Dingwen, Li, Hao, He, Diqi, Liu, Nian, Cheng, Lechao, Wang, Jingdong, Han, Junwei |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
GP-NeRF: Generalized Perception NeRF for Context-Aware 3D Scene Understanding
by: Li, Hao, et al.
Published: (2023)
by: Li, Hao, et al.
Published: (2023)
Calibrating Undisciplined Over-Smoothing in Transformer for Weakly Supervised Semantic Segmentation
by: Cheng, Lechao, et al.
Published: (2023)
by: Cheng, Lechao, et al.
Published: (2023)
Pixel Distillation: A New Knowledge Distillation Scheme for Low-Resolution Image Recognition
by: Guo, Guangyu, et al.
Published: (2021)
by: Guo, Guangyu, et al.
Published: (2021)
Revisiting the Power of Prompt for Visual Tuning
by: Wang, Yuzhu, et al.
Published: (2024)
by: Wang, Yuzhu, et al.
Published: (2024)
HyperVision: A Channel-Adaptive Ground-Based Hyperspectral Vision Pre-trained Backbone
by: Fu, Guanyiman, et al.
Published: (2026)
by: Fu, Guanyiman, et al.
Published: (2026)
VSCode: General Visual Salient and Camouflaged Object Detection with 2D Prompt Learning
by: Luo, Ziyang, et al.
Published: (2023)
by: Luo, Ziyang, et al.
Published: (2023)
VDG: Vision-Only Dynamic Gaussian for Driving Simulation
by: Li, Hao, et al.
Published: (2024)
by: Li, Hao, et al.
Published: (2024)
Training-Free Unsupervised Prompt for Vision-Language Models
by: Long, Sifan, et al.
Published: (2024)
by: Long, Sifan, et al.
Published: (2024)
Unsupervised Domain Adaption Harnessing Vision-Language Pre-training
by: Zhou, Wenlve, et al.
Published: (2024)
by: Zhou, Wenlve, et al.
Published: (2024)
Hierarchical Mixing Architecture for Low-light RAW Image Enhancement
by: Chen, Xianmin, et al.
Published: (2025)
by: Chen, Xianmin, et al.
Published: (2025)
VDNeRF: Vision-only Dynamic Neural Radiance Field for Urban Scenes
by: Zou, Zhengyu, et al.
Published: (2025)
by: Zou, Zhengyu, et al.
Published: (2025)
Unsupervised Pre-Training for 3D Leaf Instance Segmentation
by: Roggiolani, Gianmarco, et al.
Published: (2024)
by: Roggiolani, Gianmarco, et al.
Published: (2024)
3D Scene Graph Guided Vision-Language Pre-training
by: Liu, Hao, et al.
Published: (2024)
by: Liu, Hao, et al.
Published: (2024)
LangSurf: Language-Embedded Surface Gaussians for 3D Scene Understanding
by: Li, Hao, et al.
Published: (2024)
by: Li, Hao, et al.
Published: (2024)
ProMerge: Prompt and Merge for Unsupervised Instance Segmentation
by: Li, Dylan, et al.
Published: (2024)
by: Li, Dylan, et al.
Published: (2024)
Mamba Capsule Routing Towards Part-Whole Relational Camouflaged Object Detection
by: Zhang, Dingwen, et al.
Published: (2024)
by: Zhang, Dingwen, et al.
Published: (2024)
Hard-aware Instance Adaptive Self-training for Unsupervised Cross-domain Semantic Segmentation
by: Zhu, Chuang, et al.
Published: (2023)
by: Zhu, Chuang, et al.
Published: (2023)
Saliency-R1: Incentivizing Unified Saliency Reasoning Capability in MLLM with Confidence-Guided Reinforcement Learning
by: Li, Long, et al.
Published: (2025)
by: Li, Long, et al.
Published: (2025)
PolSAM: Polarimetric Scattering Mechanism Informed Segment Anything Model
by: Wang, Yuqing, et al.
Published: (2024)
by: Wang, Yuqing, et al.
Published: (2024)
Dual-Granularity Semantic Prompting for Language Guidance Infrared Small Target Detection
by: Wang, Zixuan, et al.
Published: (2025)
by: Wang, Zixuan, et al.
Published: (2025)
Understanding the Multi-modal Prompts of the Pre-trained Vision-Language Model
by: Ma, Shuailei, et al.
Published: (2023)
by: Ma, Shuailei, et al.
Published: (2023)
Point Cloud Unsupervised Pre-training via 3D Gaussian Splatting
by: Liu, Hao, et al.
Published: (2024)
by: Liu, Hao, et al.
Published: (2024)
ASPS: Augmented Segment Anything Model for Polyp Segmentation
by: Li, Huiqian, et al.
Published: (2024)
by: Li, Huiqian, et al.
Published: (2024)
Semantic-Aligned Learning with Collaborative Refinement for Unsupervised VI-ReID
by: Cheng, De, et al.
Published: (2025)
by: Cheng, De, et al.
Published: (2025)
Incorporating Pre-training Data Matters in Unsupervised Domain Adaptation
by: Xu, Yinsong, et al.
Published: (2023)
by: Xu, Yinsong, et al.
Published: (2023)
PromptKD: Unsupervised Prompt Distillation for Vision-Language Models
by: Li, Zheng, et al.
Published: (2024)
by: Li, Zheng, et al.
Published: (2024)
UVIS: Unsupervised Video Instance Segmentation
by: Huang, Shuaiyi, et al.
Published: (2024)
by: Huang, Shuaiyi, et al.
Published: (2024)
Retaining and Enhancing Pre-trained Knowledge in Vision-Language Models with Prompt Ensembling
by: Kim, Donggeun, et al.
Published: (2024)
by: Kim, Donggeun, et al.
Published: (2024)
Unsupervised Online 3D Instance Segmentation with Synthetic Sequences and Dynamic Loss
by: Zhang, Yifan, et al.
Published: (2025)
by: Zhang, Yifan, et al.
Published: (2025)
Part2Object: Hierarchical Unsupervised 3D Instance Segmentation
by: Shi, Cheng, et al.
Published: (2024)
by: Shi, Cheng, et al.
Published: (2024)
AURORA:Augmented Understanding via Structured Reasoning and Reinforcement Learning for Reference Audio-Visual Segmentation
by: Luo, Ziyang, et al.
Published: (2025)
by: Luo, Ziyang, et al.
Published: (2025)
IAP: Improving Continual Learning of Vision-Language Models via Instance-Aware Prompting
by: Fu, Hao, et al.
Published: (2025)
by: Fu, Hao, et al.
Published: (2025)
Prompt-Induced Score Variance in Zero-Shot Binary Vision-Language Safety Classification
by: Weng, Charles, et al.
Published: (2026)
by: Weng, Charles, et al.
Published: (2026)
PLIP: Language-Image Pre-training for Person Representation Learning
by: Zuo, Jialong, et al.
Published: (2023)
by: Zuo, Jialong, et al.
Published: (2023)
Revisiting Continual Semantic Segmentation with Pre-trained Vision Models
by: Zhang, Duzhen, et al.
Published: (2025)
by: Zhang, Duzhen, et al.
Published: (2025)
FreePoint: Unsupervised Point Cloud Instance Segmentation
by: Zhang, Zhikai, et al.
Published: (2023)
by: Zhang, Zhikai, et al.
Published: (2023)
Unsupervised Instance Segmentation with Superpixels
by: Hoang, Cuong Manh
Published: (2025)
by: Hoang, Cuong Manh
Published: (2025)
Low-hallucination Synthetic Captions for Large-Scale Vision-Language Model Pre-training
by: Zhang, Xinsong, et al.
Published: (2025)
by: Zhang, Xinsong, et al.
Published: (2025)
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
by: He, Jiayi, et al.
Published: (2025)
by: He, Jiayi, et al.
Published: (2025)
Semantic-aware SAM for Point-Prompted Instance Segmentation
by: Wei, Zhaoyang, et al.
Published: (2023)
by: Wei, Zhaoyang, et al.
Published: (2023)
Similar Items
-
GP-NeRF: Generalized Perception NeRF for Context-Aware 3D Scene Understanding
by: Li, Hao, et al.
Published: (2023) -
Calibrating Undisciplined Over-Smoothing in Transformer for Weakly Supervised Semantic Segmentation
by: Cheng, Lechao, et al.
Published: (2023) -
Pixel Distillation: A New Knowledge Distillation Scheme for Low-Resolution Image Recognition
by: Guo, Guangyu, et al.
Published: (2021) -
Revisiting the Power of Prompt for Visual Tuning
by: Wang, Yuzhu, et al.
Published: (2024) -
HyperVision: A Channel-Adaptive Ground-Based Hyperspectral Vision Pre-trained Backbone
by: Fu, Guanyiman, et al.
Published: (2026)