Spatial Semantic Recurrent Mining for Referring Image Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Jiaxing, Zhang, Lihe, Sun, Jiayu, Lu, Huchuan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Referring Remote Sensing Image Segmentation with Cross-view Semantics Interaction Network
par: Yang, Jiaxing, et autres
Publié: (2025)
par: Yang, Jiaxing, et autres
Publié: (2025)
Adaptive Multi-source Predictor for Zero-shot Video Object Segmentation
par: Zhao, Xiaoqi, et autres
Publié: (2023)
par: Zhao, Xiaoqi, et autres
Publié: (2023)
High-Performance Few-Shot Segmentation with Foundation Models: An Empirical Study
par: Chang, Shijie, et autres
Publié: (2024)
par: Chang, Shijie, et autres
Publié: (2024)
Multi-view Aggregation Network for Dichotomous Image Segmentation
par: Yu, Qian, et autres
Publié: (2024)
par: Yu, Qian, et autres
Publié: (2024)
Open-Vocabulary Camouflaged Object Segmentation
par: Pang, Youwei, et autres
Publié: (2023)
par: Pang, Youwei, et autres
Publié: (2023)
Beyond Mask: Rethinking Guidance Types in Few-shot Segmentation
par: Chang, Shijie, et autres
Publié: (2024)
par: Chang, Shijie, et autres
Publié: (2024)
Towards Diverse Binary Segmentation via A Simple yet General Gated Network
par: Zhao, Xiaoqi, et autres
Publié: (2023)
par: Zhao, Xiaoqi, et autres
Publié: (2023)
High-Precision Dichotomous Image Segmentation via Probing Diffusion Capacity
par: Yu, Qian, et autres
Publié: (2024)
par: Yu, Qian, et autres
Publié: (2024)
M$^{2}$SNet: Multi-scale in Multi-scale Subtraction Network for Medical Image Segmentation
par: Zhao, Xiaoqi, et autres
Publié: (2023)
par: Zhao, Xiaoqi, et autres
Publié: (2023)
ComPtr: Towards Diverse Bi-source Dense Prediction Tasks via A Simple yet General Complementary Transformer
par: Pang, Youwei, et autres
Publié: (2023)
par: Pang, Youwei, et autres
Publié: (2023)
Learning Spatial-Semantic Features for Robust Video Object Segmentation
par: Li, Xin, et autres
Publié: (2024)
par: Li, Xin, et autres
Publié: (2024)
UniMatch V2: Pushing the Limit of Semi-Supervised Semantic Segmentation
par: Yang, Lihe, et autres
Publié: (2024)
par: Yang, Lihe, et autres
Publié: (2024)
UniSegDiff: Boosting Unified Lesion Segmentation via a Staged Diffusion Model
par: Hu, Yilong, et autres
Publié: (2025)
par: Hu, Yilong, et autres
Publié: (2025)
UniMRSeg: Unified Modality-Relax Segmentation via Hierarchical Self-Supervised Compensation
par: Zhao, Xiaoqi, et autres
Publié: (2025)
par: Zhao, Xiaoqi, et autres
Publié: (2025)
ZoomNeXt: A Unified Collaborative Pyramid Network for Camouflaged Object Detection
par: Pang, Youwei, et autres
Publié: (2023)
par: Pang, Youwei, et autres
Publié: (2023)
SSP-SAM: SAM with Semantic-Spatial Prompt for Referring Expression Segmentation
par: Tang, Wei, et autres
Publié: (2026)
par: Tang, Wei, et autres
Publié: (2026)
Spatial-Frequency Enhanced Mamba for Multi-Modal Image Fusion
par: Sun, Hui, et autres
Publié: (2025)
par: Sun, Hui, et autres
Publié: (2025)
A Lightweight Clustering Framework for Unsupervised Semantic Segmentation
par: Cheung, Yau Shing Jonathan, et autres
Publié: (2023)
par: Cheung, Yau Shing Jonathan, et autres
Publié: (2023)
Spider: A Unified Framework for Context-dependent Concept Segmentation
par: Zhao, Xiaoqi, et autres
Publié: (2024)
par: Zhao, Xiaoqi, et autres
Publié: (2024)
CroBIM-V: Memory-Quality Controlled Remote Sensing Referring Video Object Segmentation
par: Jiang, H., et autres
Publié: (2026)
par: Jiang, H., et autres
Publié: (2026)
Evaluation and Enhancement of Semantic Grounding in Large Vision-Language Models
par: Lu, Jiaying, et autres
Publié: (2023)
par: Lu, Jiaying, et autres
Publié: (2023)
CNN-Transformer Rectified Collaborative Learning for Medical Image Segmentation
par: Wu, Lanhu, et autres
Publié: (2024)
par: Wu, Lanhu, et autres
Publié: (2024)
Mining Contextualized Visual Associations from Images for Creativity Understanding
par: Sahu, Ananya, et autres
Publié: (2025)
par: Sahu, Ananya, et autres
Publié: (2025)
A Dual Semantic-Aware Recurrent Global-Adaptive Network For Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2023)
par: Wang, Liuyi, et autres
Publié: (2023)
Towards Effective Long-Video Event Prediction via Multi-Level Event Semantics Mining
par: Peng, Bo, et autres
Publié: (2026)
par: Peng, Bo, et autres
Publié: (2026)
Spectral Prompt Tuning:Unveiling Unseen Classes for Zero-Shot Semantic Segmentation
par: Xu, Wenhao, et autres
Publié: (2023)
par: Xu, Wenhao, et autres
Publié: (2023)
Reinforcing Video Reasoning Segmentation to Think Before It Segments
par: Gong, Sitong, et autres
Publié: (2025)
par: Gong, Sitong, et autres
Publié: (2025)
Complementary and Contrastive Learning for Audio-Visual Segmentation
par: Gong, Sitong, et autres
Publié: (2025)
par: Gong, Sitong, et autres
Publié: (2025)
Do Vision-Language Models Represent Space and How? Evaluating Spatial Frame of Reference Under Ambiguities
par: Zhang, Zheyuan, et autres
Publié: (2024)
par: Zhang, Zheyuan, et autres
Publié: (2024)
Rethinking Evaluation of Infrared Small Target Detection
par: Pang, Youwei, et autres
Publié: (2025)
par: Pang, Youwei, et autres
Publié: (2025)
SST-EM: Advanced Metrics for Evaluating Semantic, Spatial and Temporal Aspects in Video Editing
par: Biyyala, Varun, et autres
Publié: (2025)
par: Biyyala, Varun, et autres
Publié: (2025)
UniMMAD: Unified Multi-Modal and Multi-Class Anomaly Detection via MoE-Driven Feature Decompression
par: Zhao, Yuan, et autres
Publié: (2025)
par: Zhao, Yuan, et autres
Publié: (2025)
MMSI-Bench: A Benchmark for Multi-Image Spatial Intelligence
par: Yang, Sihan, et autres
Publié: (2025)
par: Yang, Sihan, et autres
Publié: (2025)
Pi-GPS: Enhancing Geometry Problem Solving by Unleashing the Power of Diagrammatic Information
par: Zhao, Junbo, et autres
Publié: (2025)
par: Zhao, Junbo, et autres
Publié: (2025)
Reasoning Paths with Reference Objects Elicit Quantitative Spatial Reasoning in Large Vision-Language Models
par: Liao, Yuan-Hong, et autres
Publié: (2024)
par: Liao, Yuan-Hong, et autres
Publié: (2024)
FoR-SALE: Frame of Reference-guided Spatial Adjustment in LLM-based Diffusion Editing
par: Premsri, Tanawan, et autres
Publié: (2025)
par: Premsri, Tanawan, et autres
Publié: (2025)
Omni-Referring Image Segmentation
par: Zheng, Qiancheng, et autres
Publié: (2025)
par: Zheng, Qiancheng, et autres
Publié: (2025)
Fantastic Animals and Where to Find Them: Segment Any Marine Animal with Dual SAM
par: Zhang, Pingping, et autres
Publié: (2024)
par: Zhang, Pingping, et autres
Publié: (2024)
Learning Motion and Temporal Cues for Unsupervised Video Object Segmentation
par: Zhuge, Yunzhi, et autres
Publié: (2025)
par: Zhuge, Yunzhi, et autres
Publié: (2025)
Open-Vocabulary Object Detection via Language Hierarchy
par: Huang, Jiaxing, et autres
Publié: (2024)
par: Huang, Jiaxing, et autres
Publié: (2024)
Documents similaires
-
Referring Remote Sensing Image Segmentation with Cross-view Semantics Interaction Network
par: Yang, Jiaxing, et autres
Publié: (2025) -
Adaptive Multi-source Predictor for Zero-shot Video Object Segmentation
par: Zhao, Xiaoqi, et autres
Publié: (2023) -
High-Performance Few-Shot Segmentation with Foundation Models: An Empirical Study
par: Chang, Shijie, et autres
Publié: (2024) -
Multi-view Aggregation Network for Dichotomous Image Segmentation
par: Yu, Qian, et autres
Publié: (2024) -
Open-Vocabulary Camouflaged Object Segmentation
par: Pang, Youwei, et autres
Publié: (2023)