Progressive Prompt-Guided Cross-Modal Reasoning for Referring Image Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Jiachen, Wang, Hongyun, Xu, Jinyu, Jiang, Wenbo, Ma, Yanchun, Liu, Yongjian, Xie, Qing, Zheng, Bolong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LGD: Leveraging Generative Descriptions for Zero-Shot Referring Image Segmentation
par: Li, Jiachen, et autres
Publié: (2025)
par: Li, Jiachen, et autres
Publié: (2025)
Stealthy and Robust Backdoor Attack against 3D Point Clouds through Additional Point Features
par: Ning, Xiaoyang, et autres
Publié: (2024)
par: Ning, Xiaoyang, et autres
Publié: (2024)
CM-MaskSD: Cross-Modality Masked Self-Distillation for Referring Image Segmentation
par: Wang, Wenxuan, et autres
Publié: (2023)
par: Wang, Wenxuan, et autres
Publié: (2023)
Channel Attention-Guided Cross-Modal Knowledge Distillation for Referring Image Segmentation
par: Yang, Chen
Publié: (2026)
par: Yang, Chen
Publié: (2026)
Referring Video Object Segmentation with Cross-Modality Proxy Queries
par: Sun, Baoli, et autres
Publié: (2025)
par: Sun, Baoli, et autres
Publié: (2025)
Image-Conditioned Instance Prompt Network for Referring Remote Sensing Image Segmentation
par: Ren, Biaoyu, et autres
Publié: (2026)
par: Ren, Biaoyu, et autres
Publié: (2026)
PC-CrossDiff: Point-Cluster Dual-Level Cross-Modal Differential Attention for Unified 3D Referring and Segmentation
par: Tan, Wenbin, et autres
Publié: (2026)
par: Tan, Wenbin, et autres
Publié: (2026)
Co-Seg: Mutual Prompt-Guided Collaborative Learning for Tissue and Nuclei Segmentation
par: Xu, Qing, et autres
Publié: (2025)
par: Xu, Qing, et autres
Publié: (2025)
Cross-Modal Bidirectional Interaction Model for Referring Remote Sensing Image Segmentation
par: Dong, Zhe, et autres
Publié: (2024)
par: Dong, Zhe, et autres
Publié: (2024)
Visual Textualization for Image Prompted Object Detection
par: Wu, Yongjian, et autres
Publié: (2025)
par: Wu, Yongjian, et autres
Publié: (2025)
Rad-VLSM: A Cross-Modal Framework with Semantics-Assisted Prompting for Medical Segmentation and Diagnosis
par: Zhang, Fengyi, et autres
Publié: (2026)
par: Zhang, Fengyi, et autres
Publié: (2026)
Co-Seg++: Mutual Prompt-Guided Collaborative Learning for Versatile Medical Segmentation
par: Xu, Qing, et autres
Publié: (2025)
par: Xu, Qing, et autres
Publié: (2025)
Curriculum Point Prompting for Weakly-Supervised Referring Image Segmentation
par: Dai, Qiyuan, et autres
Publié: (2024)
par: Dai, Qiyuan, et autres
Publié: (2024)
MSM-Seg: A Modality-and-Slice Memory Framework with Category-Agnostic Prompting for Multi-Modal Brain Tumor Segmentation
par: Luo, Yuxiang, et autres
Publié: (2025)
par: Luo, Yuxiang, et autres
Publié: (2025)
Refer-Agent: A Collaborative Multi-Agent System with Reasoning and Reflection for Referring Video Object Segmentation
par: Jiang, Haichao, et autres
Publié: (2026)
par: Jiang, Haichao, et autres
Publié: (2026)
Collaborative Position Reasoning Network for Referring Image Segmentation
par: Cao, Jianjian, et autres
Publié: (2024)
par: Cao, Jianjian, et autres
Publié: (2024)
ModalPrompt: Towards Efficient Multimodal Continual Instruction Tuning with Dual-Modality Guided Prompt
par: Zeng, Fanhu, et autres
Publié: (2024)
par: Zeng, Fanhu, et autres
Publié: (2024)
Boosting Weakly-Supervised Referring Image Segmentation via Progressive Comprehension
par: Yang, Zaiquan, et autres
Publié: (2024)
par: Yang, Zaiquan, et autres
Publié: (2024)
STMI: Segmentation-Guided Token Modulation with Cross-Modal Hypergraph Interaction for Multi-Modal Object Re-Identification
par: Xu, Xingguo, et autres
Publié: (2026)
par: Xu, Xingguo, et autres
Publié: (2026)
Seeing is Believing: Robust Vision-Guided Cross-Modal Prompt Learning under Label Noise
par: Geng, Zibin, et autres
Publié: (2026)
par: Geng, Zibin, et autres
Publié: (2026)
Semi-MedRef: Semi-Supervised Medical Referring Image Segmentation with Cross-Modal Alignment
par: Li, Yuchen, et autres
Publié: (2026)
par: Li, Yuchen, et autres
Publié: (2026)
VMambaMorph: a Multi-Modality Deformable Image Registration Framework based on Visual State Space Model with Cross-Scan Module
par: Wang, Ziyang, et autres
Publié: (2024)
par: Wang, Ziyang, et autres
Publié: (2024)
Omni-Referring Image Segmentation
par: Zheng, Qiancheng, et autres
Publié: (2025)
par: Zheng, Qiancheng, et autres
Publié: (2025)
PPBoost: Progressive Prompt Boosting for Text-Driven Medical Image Segmentation
par: Li, Xuchen, et autres
Publié: (2025)
par: Li, Xuchen, et autres
Publié: (2025)
Missing No More: Dictionary-Guided Cross-Modal Image Fusion under Missing Infrared
par: Zhang, Yafei, et autres
Publié: (2026)
par: Zhang, Yafei, et autres
Publié: (2026)
Few-Shot Referring Video Single- and Multi-Object Segmentation via Cross-Modal Affinity with Instance Sequence Matching
par: Liu, Heng, et autres
Publié: (2025)
par: Liu, Heng, et autres
Publié: (2025)
Mask Grounding for Referring Image Segmentation
par: Chng, Yong Xien, et autres
Publié: (2023)
par: Chng, Yong Xien, et autres
Publié: (2023)
Enhancing Cross-Modal Medical Image Segmentation through Compositionality
par: Eijpe, Aniek, et autres
Publié: (2024)
par: Eijpe, Aniek, et autres
Publié: (2024)
CADFormer: Fine-Grained Cross-modal Alignment and Decoding Transformer for Referring Remote Sensing Image Segmentation
par: Liu, Maofu, et autres
Publié: (2025)
par: Liu, Maofu, et autres
Publié: (2025)
ProGiDiff: Prompt-Guided Diffusion-Based Medical Image Segmentation
par: Lin, Yuan, et autres
Publié: (2026)
par: Lin, Yuan, et autres
Publié: (2026)
RIS-FUSION: Rethinking Text-Driven Infrared and Visible Image Fusion from the Perspective of Referring Image Segmentation
par: Ma, Siju, et autres
Publié: (2025)
par: Ma, Siju, et autres
Publié: (2025)
Show Me When and Where: Towards Referring Video Object Segmentation in the Wild
par: Gao, Mingqi, et autres
Publié: (2026)
par: Gao, Mingqi, et autres
Publié: (2026)
Early Semantic Grounding in Image Editing Models for Zero-Shot Referring Image Segmentation
par: He, Jingxuan, et autres
Publié: (2026)
par: He, Jingxuan, et autres
Publié: (2026)
RESAnything: Attribute Prompting for Arbitrary Referring Segmentation
par: Wang, Ruiqi, et autres
Publié: (2025)
par: Wang, Ruiqi, et autres
Publié: (2025)
Feature-prompting GBMSeg: One-Shot Reference Guided Training-Free Prompt Engineering for Glomerular Basement Membrane Segmentation
par: Liu, Xueyu, et autres
Publié: (2024)
par: Liu, Xueyu, et autres
Publié: (2024)
Towards Omnimodal Expressions and Reasoning in Referring Audio-Visual Segmentation
par: Ying, Kaining, et autres
Publié: (2025)
par: Ying, Kaining, et autres
Publié: (2025)
MeViS: A Multi-Modal Dataset for Referring Motion Expression Video Segmentation
par: Ding, Henghui, et autres
Publié: (2025)
par: Ding, Henghui, et autres
Publié: (2025)
SAM-Aware Graph Prompt Reasoning Network for Cross-Domain Few-Shot Segmentation
par: Peng, Shi-Feng, et autres
Publié: (2024)
par: Peng, Shi-Feng, et autres
Publié: (2024)
IPDN: Image-enhanced Prompt Decoding Network for 3D Referring Expression Segmentation
par: Chen, Qi, et autres
Publié: (2025)
par: Chen, Qi, et autres
Publié: (2025)
CrossWeaver: Cross-modal Weaving for Arbitrary-Modality Semantic Segmentation
par: Zhang, Zelin, et autres
Publié: (2026)
par: Zhang, Zelin, et autres
Publié: (2026)
Documents similaires
-
LGD: Leveraging Generative Descriptions for Zero-Shot Referring Image Segmentation
par: Li, Jiachen, et autres
Publié: (2025) -
Stealthy and Robust Backdoor Attack against 3D Point Clouds through Additional Point Features
par: Ning, Xiaoyang, et autres
Publié: (2024) -
CM-MaskSD: Cross-Modality Masked Self-Distillation for Referring Image Segmentation
par: Wang, Wenxuan, et autres
Publié: (2023) -
Channel Attention-Guided Cross-Modal Knowledge Distillation for Referring Image Segmentation
par: Yang, Chen
Publié: (2026) -
Referring Video Object Segmentation with Cross-Modality Proxy Queries
par: Sun, Baoli, et autres
Publié: (2025)