Seg-ReSearch: Segmentation with Interleaved Reasoning and External Search
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liang, Tianming, Du, Qirui, Hu, Jian-Fang, Jiang, Haichao, Lin, Zicheng, Zheng, Wei-Shi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Refer-Agent: A Collaborative Multi-Agent System with Reasoning and Reflection for Referring Video Object Segmentation
von: Jiang, Haichao, et al.
Veröffentlicht: (2026)
von: Jiang, Haichao, et al.
Veröffentlicht: (2026)
ReferDINO-Plus: 2nd Solution for 4th PVUW MeViS Challenge at CVPR 2025
von: Liang, Tianming, et al.
Veröffentlicht: (2025)
von: Liang, Tianming, et al.
Veröffentlicht: (2025)
Long-RVOS: A Comprehensive Benchmark for Long-term Referring Video Object Segmentation
von: Liang, Tianming, et al.
Veröffentlicht: (2025)
von: Liang, Tianming, et al.
Veröffentlicht: (2025)
Don't Guess, Just Ask: Resolving Ambiguity in Referring Segmentation via Multi-turn Clarification
von: Yang, Yuting, et al.
Veröffentlicht: (2026)
von: Yang, Yuting, et al.
Veröffentlicht: (2026)
ReferDINO: Referring Video Object Segmentation with Visual Grounding Foundations
von: Liang, Tianming, et al.
Veröffentlicht: (2025)
von: Liang, Tianming, et al.
Veröffentlicht: (2025)
Weaver: End-to-End Agentic System Training for Video Interleaved Reasoning
von: Shi, Yudi, et al.
Veröffentlicht: (2026)
von: Shi, Yudi, et al.
Veröffentlicht: (2026)
Ranking Distillation for Open-Ended Video Question Answering with Insufficient Labels
von: Liang, Tianming, et al.
Veröffentlicht: (2024)
von: Liang, Tianming, et al.
Veröffentlicht: (2024)
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation
von: Lin, Jiayi, et al.
Veröffentlicht: (2024)
von: Lin, Jiayi, et al.
Veröffentlicht: (2024)
AnchorSeg: Language Grounded Query Banks for Reasoning Segmentation
von: Qian, Rui, et al.
Veröffentlicht: (2026)
von: Qian, Rui, et al.
Veröffentlicht: (2026)
Progressive Pretext Task Learning for Human Trajectory Prediction
von: Lin, Xiaotong, et al.
Veröffentlicht: (2024)
von: Lin, Xiaotong, et al.
Veröffentlicht: (2024)
EOV-Seg: Efficient Open-Vocabulary Panoptic Segmentation
von: Niu, Hongwei, et al.
Veröffentlicht: (2024)
von: Niu, Hongwei, et al.
Veröffentlicht: (2024)
IRG-MotionLLM: Interleaving Motion Generation, Assessment and Refinement for Text-to-Motion Generation
von: Li, Yuan-Ming, et al.
Veröffentlicht: (2025)
von: Li, Yuan-Ming, et al.
Veröffentlicht: (2025)
WeatherReasonSeg: A Benchmark for Weather-Aware Reasoning Segmentation in Visual Language Models
von: Du, Wanjun, et al.
Veröffentlicht: (2026)
von: Du, Wanjun, et al.
Veröffentlicht: (2026)
CoopDiff: Anticipating 3D Human-object Interactions via Contact-consistent Decoupled Diffusion
von: Lin, Xiaotong, et al.
Veröffentlicht: (2025)
von: Lin, Xiaotong, et al.
Veröffentlicht: (2025)
SteerSeg: Attention Steering for Reasoning Video Segmentation
von: Cheraghian, Ali, et al.
Veröffentlicht: (2026)
von: Cheraghian, Ali, et al.
Veröffentlicht: (2026)
InterLV-Search: Benchmarking Interleaved Multimodal Agentic Search
von: Hou, Bohan, et al.
Veröffentlicht: (2026)
von: Hou, Bohan, et al.
Veröffentlicht: (2026)
HyperSeg: Towards Universal Visual Segmentation with Large Language Model
von: Wei, Cong, et al.
Veröffentlicht: (2024)
von: Wei, Cong, et al.
Veröffentlicht: (2024)
DR$^2$Seg: Decomposed Two-Stage Rollouts for Efficient Reasoning Segmentation in Multimodal Large Language Models
von: He, Yulin, et al.
Veröffentlicht: (2026)
von: He, Yulin, et al.
Veröffentlicht: (2026)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
von: Shao, Hao, et al.
Veröffentlicht: (2025)
von: Shao, Hao, et al.
Veröffentlicht: (2025)
RCoT-Seg: Reinforced Chain-of-Thought for Video Reasoning and Segmentation
von: Wen, Junwei, et al.
Veröffentlicht: (2026)
von: Wen, Junwei, et al.
Veröffentlicht: (2026)
Seg-Agent: Test-Time Multimodal Reasoning for Training-Free Language-Guided Segmentation
von: Hao, Chao, et al.
Veröffentlicht: (2026)
von: Hao, Chao, et al.
Veröffentlicht: (2026)
CoReS: Orchestrating the Dance of Reasoning and Segmentation
von: Bao, Xiaoyi, et al.
Veröffentlicht: (2024)
von: Bao, Xiaoyi, et al.
Veröffentlicht: (2024)
SegGraph: Leveraging Graphs of SAM Segments for Few-Shot 3D Part Segmentation
von: Hu, Yueyang, et al.
Veröffentlicht: (2025)
von: Hu, Yueyang, et al.
Veröffentlicht: (2025)
SegLLM: Multi-round Reasoning Segmentation
von: Wang, XuDong, et al.
Veröffentlicht: (2024)
von: Wang, XuDong, et al.
Veröffentlicht: (2024)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
von: Huang, Yu, et al.
Veröffentlicht: (2025)
von: Huang, Yu, et al.
Veröffentlicht: (2025)
CoT-Seg: Rethinking Segmentation with Chain-of-Thought Reasoning and Self-Correction
von: Kao, Shiu-hong, et al.
Veröffentlicht: (2026)
von: Kao, Shiu-hong, et al.
Veröffentlicht: (2026)
One Token to Seg Them All: Language Instructed Reasoning Segmentation in Videos
von: Bai, Zechen, et al.
Veröffentlicht: (2024)
von: Bai, Zechen, et al.
Veröffentlicht: (2024)
SegVol: Universal and Interactive Volumetric Medical Image Segmentation
von: Du, Yuxin, et al.
Veröffentlicht: (2023)
von: Du, Yuxin, et al.
Veröffentlicht: (2023)
SegMo: Segment-aligned Text to 3D Human Motion Generation
von: Dang, Bowen, et al.
Veröffentlicht: (2025)
von: Dang, Bowen, et al.
Veröffentlicht: (2025)
TumorChain: Interleaved Multimodal Chain-of-Thought Reasoning for Traceable Clinical Tumor Analysis
von: Li, Sijing, et al.
Veröffentlicht: (2026)
von: Li, Sijing, et al.
Veröffentlicht: (2026)
SegTrans: Transferable Adversarial Examples for Segmentation Models
von: Song, Yufei, et al.
Veröffentlicht: (2025)
von: Song, Yufei, et al.
Veröffentlicht: (2025)
Pose2Seg: Detection Free Human Instance Segmentation
von: Zhang, Song-Hai, et al.
Veröffentlicht: (2018)
von: Zhang, Song-Hai, et al.
Veröffentlicht: (2018)
SegStitch: Multidimensional Transformer for Robust and Efficient Medical Imaging Segmentation
von: Tan, Shengbo, et al.
Veröffentlicht: (2024)
von: Tan, Shengbo, et al.
Veröffentlicht: (2024)
Seg-VAR: Image Segmentation with Visual Autoregressive Modeling
von: Zheng, Rongkun, et al.
Veröffentlicht: (2025)
von: Zheng, Rongkun, et al.
Veröffentlicht: (2025)
Reason3D: Searching and Reasoning 3D Segmentation via Large Language Model
von: Huang, Kuan-Chih, et al.
Veröffentlicht: (2024)
von: Huang, Kuan-Chih, et al.
Veröffentlicht: (2024)
MINT-CoT: Enabling Interleaved Visual Tokens in Mathematical Chain-of-Thought Reasoning
von: Chen, Xinyan, et al.
Veröffentlicht: (2025)
von: Chen, Xinyan, et al.
Veröffentlicht: (2025)
GeoSeg: Training-Free Reasoning-Driven Segmentation in Remote Sensing Imagery
von: Jiang, Lifan, et al.
Veröffentlicht: (2026)
von: Jiang, Lifan, et al.
Veröffentlicht: (2026)
Beyond Textual CoT: Interleaved Text-Image Chains with Deep Confidence Reasoning for Image Editing
von: Zou, Zhentao, et al.
Veröffentlicht: (2025)
von: Zou, Zhentao, et al.
Veröffentlicht: (2025)
CondSeg: Ellipse Estimation of Pupil and Iris via Conditioned Segmentation
von: Jia, Zhuang, et al.
Veröffentlicht: (2024)
von: Jia, Zhuang, et al.
Veröffentlicht: (2024)
ACS-SegNet: An Attention-Based CNN-SegFormer Segmentation Network for Tissue Segmentation in Histopathology
von: Torbati, Nima, et al.
Veröffentlicht: (2025)
von: Torbati, Nima, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Refer-Agent: A Collaborative Multi-Agent System with Reasoning and Reflection for Referring Video Object Segmentation
von: Jiang, Haichao, et al.
Veröffentlicht: (2026) -
ReferDINO-Plus: 2nd Solution for 4th PVUW MeViS Challenge at CVPR 2025
von: Liang, Tianming, et al.
Veröffentlicht: (2025) -
Long-RVOS: A Comprehensive Benchmark for Long-term Referring Video Object Segmentation
von: Liang, Tianming, et al.
Veröffentlicht: (2025) -
Don't Guess, Just Ask: Resolving Ambiguity in Referring Segmentation via Multi-turn Clarification
von: Yang, Yuting, et al.
Veröffentlicht: (2026) -
ReferDINO: Referring Video Object Segmentation with Visual Grounding Foundations
von: Liang, Tianming, et al.
Veröffentlicht: (2025)