Seg-Agent: Test-Time Multimodal Reasoning for Training-Free Language-Guided Segmentation
Fuente:
arXiv
Guardado en:
| Autores principales: | Hao, Chao, Xu, Jun, Du, Ji, Ye, Shuo, Qiao, Ziyue, Cun, Xiaodong, Wang, Guangcong, Zheng, Xubin, Yu, Zitong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SegTTA: Training-Free Test-Time Augmentation for Zero-Shot Medical Imaging Segmentation
por: Yao, Yihong, et al.
Publicado: (2026)
por: Yao, Yihong, et al.
Publicado: (2026)
Depth-aware Test-Time Training for Zero-shot Video Object Segmentation
por: Liu, Weihuang, et al.
Publicado: (2024)
por: Liu, Weihuang, et al.
Publicado: (2024)
scFusionTTT: Single-cell transcriptomics and proteomics fusion with Test-Time Training layers
por: Meng, Dian, et al.
Publicado: (2024)
por: Meng, Dian, et al.
Publicado: (2024)
GeoSeg: Training-Free Reasoning-Driven Segmentation in Remote Sensing Imagery
por: Jiang, Lifan, et al.
Publicado: (2026)
por: Jiang, Lifan, et al.
Publicado: (2026)
ForgeryTTT: Zero-Shot Image Manipulation Localization with Test-Time Training
por: Liu, Weihuang, et al.
Publicado: (2024)
por: Liu, Weihuang, et al.
Publicado: (2024)
Text-Guided Multimodal Unified Industrial Anomaly Detection
por: Li, Zewen, et al.
Publicado: (2026)
por: Li, Zewen, et al.
Publicado: (2026)
FusionMamba: Dynamic Feature Enhancement for Multimodal Image Fusion with Mamba
por: Xie, Xinyu, et al.
Publicado: (2024)
por: Xie, Xinyu, et al.
Publicado: (2024)
Seg-ReSearch: Segmentation with Interleaved Reasoning and External Search
por: Liang, Tianming, et al.
Publicado: (2026)
por: Liang, Tianming, et al.
Publicado: (2026)
SegRAG: Training-Free Retrieval-Augmented Semantic Segmentation
por: Boudiaf, Abderrahmene, et al.
Publicado: (2026)
por: Boudiaf, Abderrahmene, et al.
Publicado: (2026)
Single-View Graph Contrastive Learning with Soft Neighborhood Awareness
por: Sun, Qingqiang, et al.
Publicado: (2024)
por: Sun, Qingqiang, et al.
Publicado: (2024)
YUV20K: A Complexity-Driven Benchmark and Trajectory-Aware Alignment Model for Video Camouflaged Object Detection
por: Liu, Yiyu, et al.
Publicado: (2026)
por: Liu, Yiyu, et al.
Publicado: (2026)
FreeSeg-Diff: Training-Free Open-Vocabulary Segmentation with Diffusion Models
por: Corradini, Barbara Toniella, et al.
Publicado: (2024)
por: Corradini, Barbara Toniella, et al.
Publicado: (2024)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
por: Shao, Hao, et al.
Publicado: (2025)
por: Shao, Hao, et al.
Publicado: (2025)
Seg the HAB: Language-Guided Geospatial Algae Bloom Reasoning and Segmentation
por: Hsieh, Patterson, et al.
Publicado: (2025)
por: Hsieh, Patterson, et al.
Publicado: (2025)
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation
por: Lin, Jiayi, et al.
Publicado: (2024)
por: Lin, Jiayi, et al.
Publicado: (2024)
R$^{2}$Seg: Training-Free OOD Medical Tumor Segmentation via Anatomical Reasoning and Statistical Rejection
por: Shen, Shuaike, et al.
Publicado: (2025)
por: Shen, Shuaike, et al.
Publicado: (2025)
CellSeg1: Robust Cell Segmentation with One Training Image
por: Zhou, Peilin, et al.
Publicado: (2024)
por: Zhou, Peilin, et al.
Publicado: (2024)
FairyGen: Storied Cartoon Video from a Single Child-Drawn Character
por: Zheng, Jiayi, et al.
Publicado: (2025)
por: Zheng, Jiayi, et al.
Publicado: (2025)
Enhancing Prompt Following with Visual Control Through Training-Free Mask-Guided Diffusion
por: Chen, Hongyu, et al.
Publicado: (2024)
por: Chen, Hongyu, et al.
Publicado: (2024)
SegTest: Metamorphic Testing of Image Segmentation via Guided Instance‐Level Test Data Augmentation
por: Zhonghao Hou, et al.
Publicado: (2024)
por: Zhonghao Hou, et al.
Publicado: (2024)
CustomTTT: Motion and Appearance Customized Video Generation via Test-Time Training
por: Bi, Xiuli, et al.
Publicado: (2024)
por: Bi, Xiuli, et al.
Publicado: (2024)
ARGenSeg: Image Segmentation with Autoregressive Image Generation Model
por: Wang, Xiaolong, et al.
Publicado: (2025)
por: Wang, Xiaolong, et al.
Publicado: (2025)
Causal and Local Correlations Based Network for Multivariate Time Series Classification
por: Du, Mingsen, et al.
Publicado: (2024)
por: Du, Mingsen, et al.
Publicado: (2024)
Efficient Reasoning via Thought-Training and Thought-Free Inference
por: Wu, Canhui, et al.
Publicado: (2025)
por: Wu, Canhui, et al.
Publicado: (2025)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
por: Huang, Yu, et al.
Publicado: (2025)
por: Huang, Yu, et al.
Publicado: (2025)
Pose2Seg: Detection Free Human Instance Segmentation
por: Zhang, Song-Hai, et al.
Publicado: (2018)
por: Zhang, Song-Hai, et al.
Publicado: (2018)
SegLLM: Multi-round Reasoning Segmentation
por: Wang, XuDong, et al.
Publicado: (2024)
por: Wang, XuDong, et al.
Publicado: (2024)
WeatherReasonSeg: A Benchmark for Weather-Aware Reasoning Segmentation in Visual Language Models
por: Du, Wanjun, et al.
Publicado: (2026)
por: Du, Wanjun, et al.
Publicado: (2026)
OpenSeg-R: Improving Open-Vocabulary Segmentation via Step-by-Step Visual Reasoning
por: Han, Zongyan, et al.
Publicado: (2025)
por: Han, Zongyan, et al.
Publicado: (2025)
One Token to Seg Them All: Language Instructed Reasoning Segmentation in Videos
por: Bai, Zechen, et al.
Publicado: (2024)
por: Bai, Zechen, et al.
Publicado: (2024)
VideoMaker: Zero-shot Customized Video Generation with the Inherent Force of Video Diffusion Models
por: Wu, Tao, et al.
Publicado: (2024)
por: Wu, Tao, et al.
Publicado: (2024)
SegEarth-OV: Towards Training-Free Open-Vocabulary Segmentation for Remote Sensing Images
por: Li, Kaiyu, et al.
Publicado: (2024)
por: Li, Kaiyu, et al.
Publicado: (2024)
ModuSeg: Decoupling Object Discovery and Semantic Retrieval for Training-Free Weakly Supervised Segmentation
por: He, Qingze, et al.
Publicado: (2026)
por: He, Qingze, et al.
Publicado: (2026)
iSegMan: Interactive Segment-and-Manipulate 3D Gaussians
por: Zhao, Yian, et al.
Publicado: (2025)
por: Zhao, Yian, et al.
Publicado: (2025)
SegDebias: Test-Time Bias Mitigation for ViT-Based CLIP via Segmentation
por: Wu, Fangyu, et al.
Publicado: (2025)
por: Wu, Fangyu, et al.
Publicado: (2025)
MultiMind: Enhancing Werewolf Agents with Multimodal Reasoning and Theory of Mind
por: Zhang, Zheng, et al.
Publicado: (2025)
por: Zhang, Zheng, et al.
Publicado: (2025)
ZARA: Training-Free Motion Time-Series Reasoning via Evidence-Grounded LLM Agents
por: Li, Zechen, et al.
Publicado: (2025)
por: Li, Zechen, et al.
Publicado: (2025)
R2-T2: Re-Routing in Test-Time for Multimodal Mixture-of-Experts
por: Li, Zhongyang, et al.
Publicado: (2025)
por: Li, Zhongyang, et al.
Publicado: (2025)
SteerSeg: Attention Steering for Reasoning Video Segmentation
por: Cheraghian, Ali, et al.
Publicado: (2026)
por: Cheraghian, Ali, et al.
Publicado: (2026)
BrainSegDMlF: A Dynamic Fusion-enhanced SAM for Brain Lesion Segmentation
por: Wang, Hongming, et al.
Publicado: (2025)
por: Wang, Hongming, et al.
Publicado: (2025)
Ejemplares similares
-
SegTTA: Training-Free Test-Time Augmentation for Zero-Shot Medical Imaging Segmentation
por: Yao, Yihong, et al.
Publicado: (2026) -
Depth-aware Test-Time Training for Zero-shot Video Object Segmentation
por: Liu, Weihuang, et al.
Publicado: (2024) -
scFusionTTT: Single-cell transcriptomics and proteomics fusion with Test-Time Training layers
por: Meng, Dian, et al.
Publicado: (2024) -
GeoSeg: Training-Free Reasoning-Driven Segmentation in Remote Sensing Imagery
por: Jiang, Lifan, et al.
Publicado: (2026) -
ForgeryTTT: Zero-Shot Image Manipulation Localization with Test-Time Training
por: Liu, Weihuang, et al.
Publicado: (2024)