Hybrid Global-Local Representation with Augmented Spatial Guidance for Zero-Shot Referring Image Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Ting, Li, Siyuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
SPATIOROUTE: Dynamic Prompt Routing for Zero-Shot Spatial Reasoning
di: Chunhachatrachai, Pawat, et al.
Pubblicazione: (2026)
di: Chunhachatrachai, Pawat, et al.
Pubblicazione: (2026)
Zeus: Zero-shot LLM Instruction for Union Segmentation in Multimodal Medical Imaging
di: Dai, Siyuan, et al.
Pubblicazione: (2025)
di: Dai, Siyuan, et al.
Pubblicazione: (2025)
Semantic Localization Guiding Segment Anything Model For Reference Remote Sensing Image Segmentation
di: Li, Shuyang, et al.
Pubblicazione: (2025)
di: Li, Shuyang, et al.
Pubblicazione: (2025)
Zero-Shot Industrial Anomaly Segmentation with Image-Aware Prompt Generation
di: Park, SoYoung, et al.
Pubblicazione: (2025)
di: Park, SoYoung, et al.
Pubblicazione: (2025)
ReferGPT: Towards Zero-Shot Referring Multi-Object Tracking
di: Chamiti, Tzoulio, et al.
Pubblicazione: (2025)
di: Chamiti, Tzoulio, et al.
Pubblicazione: (2025)
A Text-Image Fusion Method with Data Augmentation Capabilities for Referring Medical Image Segmentation
di: Chai, Shurong, et al.
Pubblicazione: (2025)
di: Chai, Shurong, et al.
Pubblicazione: (2025)
SpatialAnt: Autonomous Zero-Shot Robot Navigation via Active Scene Reconstruction and Visual Anticipation
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
Zero-Shot Referring Expression Comprehension via Vison-Language True/False Verification
di: Liu, Jeffrey, et al.
Pubblicazione: (2025)
di: Liu, Jeffrey, et al.
Pubblicazione: (2025)
Language-Driven Visual Consensus for Zero-Shot Semantic Segmentation
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing
di: Su, Tongtong, et al.
Pubblicazione: (2025)
di: Su, Tongtong, et al.
Pubblicazione: (2025)
Self-Attention Diffusion Models for Zero-Shot Biomedical Image Segmentation: Unlocking New Frontiers in Medical Imaging
di: Hamrani, Abderrachid, et al.
Pubblicazione: (2025)
di: Hamrani, Abderrachid, et al.
Pubblicazione: (2025)
ClipSAM: CLIP and SAM Collaboration for Zero-Shot Anomaly Segmentation
di: Li, Shengze, et al.
Pubblicazione: (2024)
di: Li, Shengze, et al.
Pubblicazione: (2024)
RSVG-ZeroOV: Exploring a Training-Free Framework for Zero-Shot Open-Vocabulary Visual Grounding in Remote Sensing Images
di: Li, Ke, et al.
Pubblicazione: (2025)
di: Li, Ke, et al.
Pubblicazione: (2025)
LesionLocator: Zero-Shot Universal Tumor Segmentation and Tracking in 3D Whole-Body Imaging
di: Rokuss, Maximilian, et al.
Pubblicazione: (2025)
di: Rokuss, Maximilian, et al.
Pubblicazione: (2025)
Hybrid Discriminative Attribute-Object Embedding Network for Compositional Zero-Shot Learning
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
MotionShop: Zero-Shot Motion Transfer in Video Diffusion Models with Mixture of Score Guidance
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
One-Shot Action Recognition via Multi-Scale Spatial-Temporal Skeleton Matching
di: Yang, Siyuan, et al.
Pubblicazione: (2023)
di: Yang, Siyuan, et al.
Pubblicazione: (2023)
Evolving, Not Training: Zero-Shot Reasoning Segmentation via Evolutionary Prompting
di: Ye, Kai, et al.
Pubblicazione: (2025)
di: Ye, Kai, et al.
Pubblicazione: (2025)
Investigating the Semantic Robustness of CLIP-based Zero-Shot Anomaly Segmentation
di: Stangl, Kevin, et al.
Pubblicazione: (2024)
di: Stangl, Kevin, et al.
Pubblicazione: (2024)
Semantic Segmentation Refiner for Ultrasound Applications with Zero-Shot Foundation Models
di: Indelman, Hedda Cohen, et al.
Pubblicazione: (2024)
di: Indelman, Hedda Cohen, et al.
Pubblicazione: (2024)
TIMA: Text-Image Mutual Awareness for Balancing Zero-Shot Adversarial Robustness and Generalization Ability
di: Ma, Fengji, et al.
Pubblicazione: (2024)
di: Ma, Fengji, et al.
Pubblicazione: (2024)
MCIE: Multimodal LLM-Driven Complex Instruction Image Editing with Spatial Guidance
di: Bai, Xuehai, et al.
Pubblicazione: (2026)
di: Bai, Xuehai, et al.
Pubblicazione: (2026)
Virtual Guidance as a Mid-level Representation for Navigation with Augmented Reality
di: Yang, Hsuan-Kung, et al.
Pubblicazione: (2023)
di: Yang, Hsuan-Kung, et al.
Pubblicazione: (2023)
Efficient Zero-Shot AI-Generated Image Detection
di: Sonoda, Ryosuke, et al.
Pubblicazione: (2026)
di: Sonoda, Ryosuke, et al.
Pubblicazione: (2026)
PostEdit: Posterior Sampling for Efficient Zero-Shot Image Editing
di: Tian, Feng, et al.
Pubblicazione: (2024)
di: Tian, Feng, et al.
Pubblicazione: (2024)
GRAZE: Grounded Refinement and Motion-Aware Zero-Shot Event Localization
di: Zaidi, Syed Ahsan Masud, et al.
Pubblicazione: (2026)
di: Zaidi, Syed Ahsan Masud, et al.
Pubblicazione: (2026)
Zero Shot Context-Based Object Segmentation using SLIP (SAM+CLIP)
di: Gundavarapu, Saaketh Koundinya, et al.
Pubblicazione: (2024)
di: Gundavarapu, Saaketh Koundinya, et al.
Pubblicazione: (2024)
Zero-Shot Gaze-based Volumetric Medical Image Segmentation
di: Shmykova, Tatyana, et al.
Pubblicazione: (2025)
di: Shmykova, Tatyana, et al.
Pubblicazione: (2025)
Binary Verification for Zero-Shot Vision
di: Hu, Rongbin, et al.
Pubblicazione: (2025)
di: Hu, Rongbin, et al.
Pubblicazione: (2025)
Blind to Position, Biased in Language: Probing Mid-Layer Representational Bias in Vision-Language Encoders for Zero-Shot Language-Grounded Spatial Understanding
di: An, Na Min, et al.
Pubblicazione: (2025)
di: An, Na Min, et al.
Pubblicazione: (2025)
Zero-Shot Temporal Interaction Localization for Egocentric Videos
di: Zhang, Erhang, et al.
Pubblicazione: (2025)
di: Zhang, Erhang, et al.
Pubblicazione: (2025)
AMLRIS: Alignment-aware Masked Learning for Referring Image Segmentation
di: Chen, Tongfei, et al.
Pubblicazione: (2026)
di: Chen, Tongfei, et al.
Pubblicazione: (2026)
Enhancing Supervised Composed Image Retrieval via Reasoning-Augmented Representation Engineering
di: Li, Jun, et al.
Pubblicazione: (2025)
di: Li, Jun, et al.
Pubblicazione: (2025)
Decoupling Endpoint and Semantic Transition Learning for Zero-Shot Composed Image Retrieval
di: Liu, Mingyu, et al.
Pubblicazione: (2026)
di: Liu, Mingyu, et al.
Pubblicazione: (2026)
Learning Local and Global Temporal Contexts for Video Semantic Segmentation
di: Sun, Guolei, et al.
Pubblicazione: (2022)
di: Sun, Guolei, et al.
Pubblicazione: (2022)
MatchSeg: Towards Better Segmentation via Reference Image Matching
di: Huo, Jiayu, et al.
Pubblicazione: (2024)
di: Huo, Jiayu, et al.
Pubblicazione: (2024)
MAGIC: Few-Shot Mask-Guided Anomaly Inpainting with Prompt Perturbation, Spatially Adaptive Guidance, and Context Awareness
di: Choi, JaeHyuck, et al.
Pubblicazione: (2025)
di: Choi, JaeHyuck, et al.
Pubblicazione: (2025)
BiPVL-Seg: Bidirectional Progressive Vision-Language Fusion with Global-Local Alignment for Medical Image Segmentation
di: Sultan, Rafi Ibn, et al.
Pubblicazione: (2025)
di: Sultan, Rafi Ibn, et al.
Pubblicazione: (2025)
Latent Expression Generation for Referring Image Segmentation and Grounding
di: Yu, Seonghoon, et al.
Pubblicazione: (2025)
di: Yu, Seonghoon, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
di: Zhang, Jiwen, et al.
Pubblicazione: (2026) -
SPATIOROUTE: Dynamic Prompt Routing for Zero-Shot Spatial Reasoning
di: Chunhachatrachai, Pawat, et al.
Pubblicazione: (2026) -
Zeus: Zero-shot LLM Instruction for Union Segmentation in Multimodal Medical Imaging
di: Dai, Siyuan, et al.
Pubblicazione: (2025) -
Semantic Localization Guiding Segment Anything Model For Reference Remote Sensing Image Segmentation
di: Li, Shuyang, et al.
Pubblicazione: (2025) -
Zero-Shot Industrial Anomaly Segmentation with Image-Aware Prompt Generation
di: Park, SoYoung, et al.
Pubblicazione: (2025)