Conversational Image Segmentation: Grounding Abstract Concepts with Scalable Supervision
Fuente:
arXiv
Saved in:
| Main Authors: | Sahoo, Aadarsh, Gkioxari, Georgia |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Aligning Text, Images, and 3D Structure Token-by-Token
by: Sahoo, Aadarsh, et al.
Published: (2025)
by: Sahoo, Aadarsh, et al.
Published: (2025)
No Labels, No Problem: Training Visual Reasoners with Multimodal Verifiers
by: Marsili, Damiano, et al.
Published: (2025)
by: Marsili, Damiano, et al.
Published: (2025)
Reconstructing Hand-Held Objects in 3D from Images and Videos
by: Wu, Jane, et al.
Published: (2024)
by: Wu, Jane, et al.
Published: (2024)
Out of Sight, Out of Mind? Evaluating State Evolution in Video World Models
by: Ma, Ziqi, et al.
Published: (2026)
by: Ma, Ziqi, et al.
Published: (2026)
Find Any Part in 3D
by: Ma, Ziqi, et al.
Published: (2024)
by: Ma, Ziqi, et al.
Published: (2024)
Is This Tracker On? A Benchmark Protocol for Dynamic Tracking
by: Demler, Ilona, et al.
Published: (2025)
by: Demler, Ilona, et al.
Published: (2025)
Feedforward 3D Editing via Text-Steerable Image-to-3D
by: Ma, Ziqi, et al.
Published: (2025)
by: Ma, Ziqi, et al.
Published: (2025)
Linear Mechanisms for Spatiotemporal Reasoning in Vision Language Models
by: Kang, Raphi, et al.
Published: (2026)
by: Kang, Raphi, et al.
Published: (2026)
Visual Agentic AI for Spatial Reasoning with a Dynamic API
by: Marsili, Damiano, et al.
Published: (2025)
by: Marsili, Damiano, et al.
Published: (2025)
Same or Not? Enhancing Visual Perception in Vision-Language Models
by: Marsili, Damiano, et al.
Published: (2025)
by: Marsili, Damiano, et al.
Published: (2025)
Is CLIP ideal? No. Can we fix it? Yes!
by: Kang, Raphi, et al.
Published: (2025)
by: Kang, Raphi, et al.
Published: (2025)
MonoTher-Depth: Enhancing Thermal Depth Estimation via Confidence-Aware Distillation
by: Zuo, Xingxing, et al.
Published: (2025)
by: Zuo, Xingxing, et al.
Published: (2025)
S5: Scalable Semi-Supervised Semantic Segmentation in Remote Sensing
by: Lv, Liang, et al.
Published: (2025)
by: Lv, Liang, et al.
Published: (2025)
Uncertainty-Aware Concept and Motion Segmentation for Semi-Supervised Angiography Videos
by: Luo, Yu, et al.
Published: (2026)
by: Luo, Yu, et al.
Published: (2026)
Mask Grounding for Referring Image Segmentation
by: Chng, Yong Xien, et al.
Published: (2023)
by: Chng, Yong Xien, et al.
Published: (2023)
Beyond the Ground Truth: Enhanced Supervision for Image Restoration
by: Ryou, Donghun, et al.
Published: (2025)
by: Ryou, Donghun, et al.
Published: (2025)
Caltech Aerial RGB-Thermal Dataset in the Wild
by: Lee, Connor, et al.
Published: (2024)
by: Lee, Connor, et al.
Published: (2024)
SNCE: Geometry-Aware Supervision for Scalable Discrete Image Generation
by: Li, Shufan, et al.
Published: (2026)
by: Li, Shufan, et al.
Published: (2026)
From Segments to Concepts: Interpretable Image Classification via Concept-Guided Segmentation
by: Eisenberg, Ran, et al.
Published: (2025)
by: Eisenberg, Ran, et al.
Published: (2025)
Concept-to-Pixel: Prompt-Free Universal Medical Image Segmentation
by: Chen, Haoyun, et al.
Published: (2026)
by: Chen, Haoyun, et al.
Published: (2026)
Image Augmentation Agent for Weakly Supervised Semantic Segmentation
by: Wu, Wangyu, et al.
Published: (2024)
by: Wu, Wangyu, et al.
Published: (2024)
Adaptive Mix for Semi-Supervised Medical Image Segmentation
by: Shen, Zhiqiang, et al.
Published: (2024)
by: Shen, Zhiqiang, et al.
Published: (2024)
Self-Supervised Alignment Learning for Medical Image Segmentation
by: Li, Haofeng, et al.
Published: (2024)
by: Li, Haofeng, et al.
Published: (2024)
Prototype-Based Image Prompting for Weakly Supervised Histopathological Image Segmentation
by: Tang, Qingchen, et al.
Published: (2025)
by: Tang, Qingchen, et al.
Published: (2025)
S2-UniSeg: Fast Universal Agglomerative Pooling for Scalable Segment Anything without Supervision
by: Xu, Huihui, et al.
Published: (2025)
by: Xu, Huihui, et al.
Published: (2025)
Unified and Semantically Grounded Domain Adaptation for Medical Image Segmentation
by: Wang, Xin, et al.
Published: (2025)
by: Wang, Xin, et al.
Published: (2025)
Weakly Supervised Food Image Segmentation using Vision Transformers and Segment Anything Model
by: Sarafis, Ioannis, et al.
Published: (2025)
by: Sarafis, Ioannis, et al.
Published: (2025)
Quality-Guided Semi-Supervised Learning for Medical Image Segmentation
by: Abhishek, Kumar, et al.
Published: (2026)
by: Abhishek, Kumar, et al.
Published: (2026)
Principle-Guided Supervision for Interpretable Uncertainty in Medical Image Segmentation
by: Sui, An, et al.
Published: (2026)
by: Sui, An, et al.
Published: (2026)
Self-Supervised Learning for Image Segmentation: A Comprehensive Survey
by: Akilan, Thangarajah, et al.
Published: (2025)
by: Akilan, Thangarajah, et al.
Published: (2025)
Masked Image Modeling Boosting Semi-Supervised Semantic Segmentation
by: Li, Yangyang, et al.
Published: (2024)
by: Li, Yangyang, et al.
Published: (2024)
Adaptive Bidirectional Displacement for Semi-Supervised Medical Image Segmentation
by: Chi, Hanyang, et al.
Published: (2024)
by: Chi, Hanyang, et al.
Published: (2024)
Semi-Supervised Medical Image Segmentation via Dual Networks
by: Lu, Yunyao, et al.
Published: (2025)
by: Lu, Yunyao, et al.
Published: (2025)
Image-Text Co-Decomposition for Text-Supervised Semantic Segmentation
by: Wu, Ji-Jia, et al.
Published: (2024)
by: Wu, Ji-Jia, et al.
Published: (2024)
Curriculum Point Prompting for Weakly-Supervised Referring Image Segmentation
by: Dai, Qiyuan, et al.
Published: (2024)
by: Dai, Qiyuan, et al.
Published: (2024)
A Unified Framework for Semi-Supervised Image Segmentation and Registration
by: Li, Ruizhe, et al.
Published: (2025)
by: Li, Ruizhe, et al.
Published: (2025)
Image Augmentation with Controlled Diffusion for Weakly-Supervised Semantic Segmentation
by: Wu, Wangyu, et al.
Published: (2023)
by: Wu, Wangyu, et al.
Published: (2023)
Emerging Trends in Pseudo-Label Refinement for Weakly Supervised Semantic Segmentation with Image-Level Supervision
by: Zhang, Zheyuan, et al.
Published: (2025)
by: Zhang, Zheyuan, et al.
Published: (2025)
Delta-Adapter: Scalable Exemplar-Based Image Editing with Single-Pair Supervision
by: Chen, Jiacheng, et al.
Published: (2026)
by: Chen, Jiacheng, et al.
Published: (2026)
WalkGPT: Grounded Vision-Language Conversation with Depth-Aware Segmentation for Pedestrian Navigation
by: Sultan, Rafi Ibn, et al.
Published: (2026)
by: Sultan, Rafi Ibn, et al.
Published: (2026)
Similar Items
-
Aligning Text, Images, and 3D Structure Token-by-Token
by: Sahoo, Aadarsh, et al.
Published: (2025) -
No Labels, No Problem: Training Visual Reasoners with Multimodal Verifiers
by: Marsili, Damiano, et al.
Published: (2025) -
Reconstructing Hand-Held Objects in 3D from Images and Videos
by: Wu, Jane, et al.
Published: (2024) -
Out of Sight, Out of Mind? Evaluating State Evolution in Video World Models
by: Ma, Ziqi, et al.
Published: (2026) -
Find Any Part in 3D
by: Ma, Ziqi, et al.
Published: (2024)