VRP-SAM: SAM with Visual Reference Prompt
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Sun, Yanpeng, Chen, Jiahui, Zhang, Shan, Zhang, Xinyu, Li, Xiaofan, Chen, Qiang, Zhang, Gang, Ding, Errui, Wang, Jingdong, Li, Zechao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SSP-SAM: SAM with Semantic-Spatial Prompt for Referring Expression Segmentation
von: Tang, Wei, et al.
Veröffentlicht: (2026)
von: Tang, Wei, et al.
Veröffentlicht: (2026)
Exploring Effective Factors for Improving Visual In-Context Learning
von: Sun, Yanpeng, et al.
Veröffentlicht: (2023)
von: Sun, Yanpeng, et al.
Veröffentlicht: (2023)
Improving Multi-modal Large Language Model through Boosting Vision Capabilities
von: Sun, Yanpeng, et al.
Veröffentlicht: (2024)
von: Sun, Yanpeng, et al.
Veröffentlicht: (2024)
FedMGP: Personalized Federated Learning with Multi-Group Text-Visual Prompts
von: Bo, Weihao, et al.
Veröffentlicht: (2025)
von: Bo, Weihao, et al.
Veröffentlicht: (2025)
ProSAM: Enhancing the Robustness of SAM-based Visual Reference Segmentation with Probabilistic Prompts
von: Wang, Xiaoqi, et al.
Veröffentlicht: (2025)
von: Wang, Xiaoqi, et al.
Veröffentlicht: (2025)
FullAnno: A Data Engine for Enhancing Image Comprehension of MLLMs
von: Hao, Jing, et al.
Veröffentlicht: (2024)
von: Hao, Jing, et al.
Veröffentlicht: (2024)
EdgeSAM: Prompt-In-the-Loop Distillation for SAM
von: Zhou, Chong, et al.
Veröffentlicht: (2023)
von: Zhou, Chong, et al.
Veröffentlicht: (2023)
Add-SD: Rational Generation without Manual Reference
von: Yang, Lingfeng, et al.
Veröffentlicht: (2024)
von: Yang, Lingfeng, et al.
Veröffentlicht: (2024)
SAM-CP: Marrying SAM with Composable Prompts for Versatile Segmentation
von: Chen, Pengfei, et al.
Veröffentlicht: (2024)
von: Chen, Pengfei, et al.
Veröffentlicht: (2024)
Visual Position Prompt for MLLM based Visual Grounding
von: Tang, Wei, et al.
Veröffentlicht: (2025)
von: Tang, Wei, et al.
Veröffentlicht: (2025)
Artemis: Structured Visual Reasoning for Perception Policy Learning
von: Tang, Wei, et al.
Veröffentlicht: (2025)
von: Tang, Wei, et al.
Veröffentlicht: (2025)
OVLW-DETR: Open-Vocabulary Light-Weighted Detection Transformer
von: Wang, Yu, et al.
Veröffentlicht: (2024)
von: Wang, Yu, et al.
Veröffentlicht: (2024)
Enhancing Descriptive Captions with Visual Attributes for Multimodal Perception
von: Sun, Yanpeng, et al.
Veröffentlicht: (2024)
von: Sun, Yanpeng, et al.
Veröffentlicht: (2024)
Tarot-SAM3: Training-free SAM3 for Any Referring Expression Segmentation
von: Zhang, Weiming, et al.
Veröffentlicht: (2026)
von: Zhang, Weiming, et al.
Veröffentlicht: (2026)
AuralSAM2: Enabling SAM2 Hear Through Pyramid Audio-Visual Feature Prompting
von: Liu, Yuyuan, et al.
Veröffentlicht: (2025)
von: Liu, Yuyuan, et al.
Veröffentlicht: (2025)
LW-DETR: A Transformer Replacement to YOLO for Real-Time Detection
von: Chen, Qiang, et al.
Veröffentlicht: (2024)
von: Chen, Qiang, et al.
Veröffentlicht: (2024)
HFP-SAM: Hierarchical Frequency Prompted SAM for Efficient Marine Animal Segmentation
von: Zhang, Pingping, et al.
Veröffentlicht: (2026)
von: Zhang, Pingping, et al.
Veröffentlicht: (2026)
MedSAM-U: Uncertainty-Guided Auto Multi-Prompt Adaptation for Reliable MedSAM
von: Zhou, Nan, et al.
Veröffentlicht: (2024)
von: Zhou, Nan, et al.
Veröffentlicht: (2024)
OFL-SAM2: Prompt SAM2 with Online Few-shot Learner for Efficient Medical Image Segmentation
von: Lan, Meng, et al.
Veröffentlicht: (2025)
von: Lan, Meng, et al.
Veröffentlicht: (2025)
RS2-SAM2: Customized SAM2 for Referring Remote Sensing Image Segmentation
von: Rong, Fu, et al.
Veröffentlicht: (2025)
von: Rong, Fu, et al.
Veröffentlicht: (2025)
Efficient-SAM2: Accelerating SAM2 with Object-Aware Visual Encoding and Memory Retrieval
von: Zhang, Jing, et al.
Veröffentlicht: (2026)
von: Zhang, Jing, et al.
Veröffentlicht: (2026)
Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks
von: Ren, Tianhe, et al.
Veröffentlicht: (2024)
von: Ren, Tianhe, et al.
Veröffentlicht: (2024)
MPG-SAM 2: Adapting SAM 2 with Mask Priors and Global Context for Referring Video Object Segmentation
von: Rong, Fu, et al.
Veröffentlicht: (2025)
von: Rong, Fu, et al.
Veröffentlicht: (2025)
PA-SAM: Prompt Adapter SAM for High-Quality Image Segmentation
von: Xie, Zhaozhi, et al.
Veröffentlicht: (2024)
von: Xie, Zhaozhi, et al.
Veröffentlicht: (2024)
Ref-SAM3D: Bridging SAM3D with Text for Reference 3D Reconstruction
von: Zhou, Yun, et al.
Veröffentlicht: (2025)
von: Zhou, Yun, et al.
Veröffentlicht: (2025)
BLO-SAM: Bi-level Optimization Based Overfitting-Preventing Finetuning of SAM
von: Zhang, Li, et al.
Veröffentlicht: (2024)
von: Zhang, Li, et al.
Veröffentlicht: (2024)
AutoProSAM: Automated Prompting SAM for 3D Multi-Organ Segmentation
von: Li, Chengyin, et al.
Veröffentlicht: (2023)
von: Li, Chengyin, et al.
Veröffentlicht: (2023)
IP-SAM: Prompt-Space Conditioning for Prompt-Absent Camouflaged Object Detection
von: Zhang, Huiyao, et al.
Veröffentlicht: (2026)
von: Zhang, Huiyao, et al.
Veröffentlicht: (2026)
Vision and Language Reference Prompt into SAM for Few-shot Segmentation
von: Sakurai, Kosuke, et al.
Veröffentlicht: (2025)
von: Sakurai, Kosuke, et al.
Veröffentlicht: (2025)
ET-SAM: Efficient Point Prompt Prediction in SAM for Unified Scene Text Detection and Layout Analysis
von: Zhang, Xike, et al.
Veröffentlicht: (2026)
von: Zhang, Xike, et al.
Veröffentlicht: (2026)
Auto-Prompting SAM for Weakly Supervised Landslide Extraction
von: Wang, Jian, et al.
Veröffentlicht: (2025)
von: Wang, Jian, et al.
Veröffentlicht: (2025)
Correspondence as Video: Test-Time Adaption on SAM2 for Reference Segmentation in the Wild
von: Wang, Haoran, et al.
Veröffentlicht: (2025)
von: Wang, Haoran, et al.
Veröffentlicht: (2025)
Semantic-aware SAM for Point-Prompted Instance Segmentation
von: Wei, Zhaoyang, et al.
Veröffentlicht: (2023)
von: Wei, Zhaoyang, et al.
Veröffentlicht: (2023)
OpenWorldSAM: Extending SAM2 for Universal Image Segmentation with Language Prompts
von: Xiao, Shiting, et al.
Veröffentlicht: (2025)
von: Xiao, Shiting, et al.
Veröffentlicht: (2025)
Memory-SAM: Human-Prompt-Free Tongue Segmentation via Retrieval-to-Prompt
von: Chae, Joongwon, et al.
Veröffentlicht: (2025)
von: Chae, Joongwon, et al.
Veröffentlicht: (2025)
Self-Prompt SAM: Medical Image Segmentation via Automatic Prompt SAM Adaptation
von: Xie, Bin, et al.
Veröffentlicht: (2025)
von: Xie, Bin, et al.
Veröffentlicht: (2025)
Granular Computing-driven SAM: From Coarse-to-Fine Guidance for Prompt-Free Segmentation
von: Yu, Qiyang, et al.
Veröffentlicht: (2025)
von: Yu, Qiyang, et al.
Veröffentlicht: (2025)
ViRefSAM: Visual Reference-Guided Segment Anything Model for Remote Sensing Segmentation
von: Bi, Hanbo, et al.
Veröffentlicht: (2025)
von: Bi, Hanbo, et al.
Veröffentlicht: (2025)
FusionSAM: Visual Multi-Modal Learning with Segment Anything
von: Li, Daixun, et al.
Veröffentlicht: (2024)
von: Li, Daixun, et al.
Veröffentlicht: (2024)
MS-DETR: Efficient DETR Training with Mixed Supervision
von: Zhao, Chuyang, et al.
Veröffentlicht: (2024)
von: Zhao, Chuyang, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
SSP-SAM: SAM with Semantic-Spatial Prompt for Referring Expression Segmentation
von: Tang, Wei, et al.
Veröffentlicht: (2026) -
Exploring Effective Factors for Improving Visual In-Context Learning
von: Sun, Yanpeng, et al.
Veröffentlicht: (2023) -
Improving Multi-modal Large Language Model through Boosting Vision Capabilities
von: Sun, Yanpeng, et al.
Veröffentlicht: (2024) -
FedMGP: Personalized Federated Learning with Multi-Group Text-Visual Prompts
von: Bo, Weihao, et al.
Veröffentlicht: (2025) -
ProSAM: Enhancing the Robustness of SAM-based Visual Reference Segmentation with Probabilistic Prompts
von: Wang, Xiaoqi, et al.
Veröffentlicht: (2025)