AnchorSeg: Language Grounded Query Banks for Reasoning Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Qian, Rui, Deng, Chuanhang, Huang, Qiang, Xiong, Jian, Li, Mingxuan, Zhou, Yingbo, Zhai, Wei, Chen, Jintao, Dou, Dejing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UGround: Towards Unified Visual Grounding with Unrolled Transformers
di: Qian, Rui, et al.
Pubblicazione: (2025)
di: Qian, Rui, et al.
Pubblicazione: (2025)
AAPO: Enhancing the Reasoning Capabilities of LLMs with Advantage Margin
di: Xiong, Jian, et al.
Pubblicazione: (2025)
di: Xiong, Jian, et al.
Pubblicazione: (2025)
Reasoning to Attend: Try to Understand How <SEG> Token Works
di: Qian, Rui, et al.
Pubblicazione: (2024)
di: Qian, Rui, et al.
Pubblicazione: (2024)
PAMNet: Cycle-aware Phase-Amplitude Modulation Network for Multivariate Time Series Forecasting
di: Zhou, Yingbo, et al.
Pubblicazione: (2026)
di: Zhou, Yingbo, et al.
Pubblicazione: (2026)
PAMod: Modeling Cyclical Shifts via Phase-Amplitude Modulation for Non-stationary Time Series Forecasting
di: Zhou, Yingbo, et al.
Pubblicazione: (2026)
di: Zhou, Yingbo, et al.
Pubblicazione: (2026)
Unrewarded Exploration in Large Language Models Reveals Latent Learning from Psychology
di: Xiong, Jian, et al.
Pubblicazione: (2026)
di: Xiong, Jian, et al.
Pubblicazione: (2026)
Segmenting Visuals With Querying Words: Language Anchors For Semi-Supervised Image Segmentation
di: Nadeem, Numair, et al.
Pubblicazione: (2025)
di: Nadeem, Numair, et al.
Pubblicazione: (2025)
Seg-ReSearch: Segmentation with Interleaved Reasoning and External Search
di: Liang, Tianming, et al.
Pubblicazione: (2026)
di: Liang, Tianming, et al.
Pubblicazione: (2026)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
di: Huang, Yu, et al.
Pubblicazione: (2025)
di: Huang, Yu, et al.
Pubblicazione: (2025)
DR$^2$Seg: Decomposed Two-Stage Rollouts for Efficient Reasoning Segmentation in Multimodal Large Language Models
di: He, Yulin, et al.
Pubblicazione: (2026)
di: He, Yulin, et al.
Pubblicazione: (2026)
DVIS-DAQ: Improving Video Segmentation via Dynamic Anchor Queries
di: Zhou, Yikang, et al.
Pubblicazione: (2024)
di: Zhou, Yikang, et al.
Pubblicazione: (2024)
SegTalker: Segmentation-based Talking Face Generation with Mask-guided Local Editing
di: Xiong, Lingyu, et al.
Pubblicazione: (2024)
di: Xiong, Lingyu, et al.
Pubblicazione: (2024)
ContextSeg: Sketch Semantic Segmentation by Querying the Context with Attention
di: Wang, Jiawei, et al.
Pubblicazione: (2023)
di: Wang, Jiawei, et al.
Pubblicazione: (2023)
Qwen3-VL-Seg: Unlocking Open-World Referring Segmentation with Vision-Language Grounding
di: Yao, Yuan, et al.
Pubblicazione: (2026)
di: Yao, Yuan, et al.
Pubblicazione: (2026)
Fast-SegSim: Real-Time Open-Vocabulary Segmentation for Robotics in Simulation
di: Yu, Xuan, et al.
Pubblicazione: (2026)
di: Yu, Xuan, et al.
Pubblicazione: (2026)
LLM-Seg: Bridging Image Segmentation and Large Language Model Reasoning
di: Wang, Junchi, et al.
Pubblicazione: (2024)
di: Wang, Junchi, et al.
Pubblicazione: (2024)
Seg the HAB: Language-Guided Geospatial Algae Bloom Reasoning and Segmentation
di: Hsieh, Patterson, et al.
Pubblicazione: (2025)
di: Hsieh, Patterson, et al.
Pubblicazione: (2025)
LightMedSeg: Lightweight 3D Medical Image Segmentation with Learned Spatial Anchors
di: Tyagi, Kavyansh, et al.
Pubblicazione: (2026)
di: Tyagi, Kavyansh, et al.
Pubblicazione: (2026)
SegLLM: Multi-round Reasoning Segmentation
di: Wang, XuDong, et al.
Pubblicazione: (2024)
di: Wang, XuDong, et al.
Pubblicazione: (2024)
SegMASt3R: Geometry Grounded Segment Matching
di: Jayanti, Rohit, et al.
Pubblicazione: (2025)
di: Jayanti, Rohit, et al.
Pubblicazione: (2025)
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation
di: Lin, Jiayi, et al.
Pubblicazione: (2024)
di: Lin, Jiayi, et al.
Pubblicazione: (2024)
Reasoning Curriculum: Bootstrapping Broad LLM Reasoning from Math
di: Pang, Bo, et al.
Pubblicazione: (2025)
di: Pang, Bo, et al.
Pubblicazione: (2025)
One Token to Seg Them All: Language Instructed Reasoning Segmentation in Videos
di: Bai, Zechen, et al.
Pubblicazione: (2024)
di: Bai, Zechen, et al.
Pubblicazione: (2024)
WeatherReasonSeg: A Benchmark for Weather-Aware Reasoning Segmentation in Visual Language Models
di: Du, Wanjun, et al.
Pubblicazione: (2026)
di: Du, Wanjun, et al.
Pubblicazione: (2026)
JudgeRank: Leveraging Large Language Models for Reasoning-Intensive Reranking
di: Niu, Tong, et al.
Pubblicazione: (2024)
di: Niu, Tong, et al.
Pubblicazione: (2024)
GeoSeg: Training-Free Reasoning-Driven Segmentation in Remote Sensing Imagery
di: Jiang, Lifan, et al.
Pubblicazione: (2026)
di: Jiang, Lifan, et al.
Pubblicazione: (2026)
CORE-Seg: Reasoning-Driven Segmentation for Complex Lesions via Reinforcement Learning
di: Xie, Yuxin, et al.
Pubblicazione: (2026)
di: Xie, Yuxin, et al.
Pubblicazione: (2026)
CoT-Seg: Rethinking Segmentation with Chain-of-Thought Reasoning and Self-Correction
di: Kao, Shiu-hong, et al.
Pubblicazione: (2026)
di: Kao, Shiu-hong, et al.
Pubblicazione: (2026)
Ground Anchors
di: Rincent, Jean-Jacques Henri
Pubblicazione: (2024)
di: Rincent, Jean-Jacques Henri
Pubblicazione: (2024)
SteerSeg: Attention Steering for Reasoning Video Segmentation
di: Cheraghian, Ali, et al.
Pubblicazione: (2026)
di: Cheraghian, Ali, et al.
Pubblicazione: (2026)
TerraSeg: Self-Supervised Ground Segmentation for Any LiDAR
di: Lentsch, Ted, et al.
Pubblicazione: (2026)
di: Lentsch, Ted, et al.
Pubblicazione: (2026)
SegVG: Transferring Object Bounding Box to Segmentation for Visual Grounding
di: Kang, Weitai, et al.
Pubblicazione: (2024)
di: Kang, Weitai, et al.
Pubblicazione: (2024)
Seg-Agent: Test-Time Multimodal Reasoning for Training-Free Language-Guided Segmentation
di: Hao, Chao, et al.
Pubblicazione: (2026)
di: Hao, Chao, et al.
Pubblicazione: (2026)
AnchorDiff: Training-Free Concept Grounding for MM-DiTs via Anchor-Based Graph Propagation
di: Zhang, Jian, et al.
Pubblicazione: (2026)
di: Zhang, Jian, et al.
Pubblicazione: (2026)
Grounding Language Model with Chunking-Free In-Context Retrieval
di: Qian, Hongjin, et al.
Pubblicazione: (2024)
di: Qian, Hongjin, et al.
Pubblicazione: (2024)
GenSeg-R1: RL-Driven Vision-Language Grounding for Fine-Grained Referring Segmentation
di: Hegde, Sandesh, et al.
Pubblicazione: (2026)
di: Hegde, Sandesh, et al.
Pubblicazione: (2026)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
di: Shao, Hao, et al.
Pubblicazione: (2025)
di: Shao, Hao, et al.
Pubblicazione: (2025)
RCoT-Seg: Reinforced Chain-of-Thought for Video Reasoning and Segmentation
di: Wen, Junwei, et al.
Pubblicazione: (2026)
di: Wen, Junwei, et al.
Pubblicazione: (2026)
Fisher Information-based Efficient Curriculum Federated Learning with Large Language Models
di: Liu, Ji, et al.
Pubblicazione: (2024)
di: Liu, Ji, et al.
Pubblicazione: (2024)
Resilient Random Time-hopping Reply against Distance Attacks in UWB Ranging
di: Gou, Wenlong, et al.
Pubblicazione: (2024)
di: Gou, Wenlong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
UGround: Towards Unified Visual Grounding with Unrolled Transformers
di: Qian, Rui, et al.
Pubblicazione: (2025) -
AAPO: Enhancing the Reasoning Capabilities of LLMs with Advantage Margin
di: Xiong, Jian, et al.
Pubblicazione: (2025) -
Reasoning to Attend: Try to Understand How <SEG> Token Works
di: Qian, Rui, et al.
Pubblicazione: (2024) -
PAMNet: Cycle-aware Phase-Amplitude Modulation Network for Multivariate Time Series Forecasting
di: Zhou, Yingbo, et al.
Pubblicazione: (2026) -
PAMod: Modeling Cyclical Shifts via Phase-Amplitude Modulation for Non-stationary Time Series Forecasting
di: Zhou, Yingbo, et al.
Pubblicazione: (2026)