Salvato in:
| Autori principali: | Hegde, Sandesh, Chacko, Jaison Saji, Banerjee, Debarshi, Mahesh, Uma |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.09701 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scaling Vision-and-Language Navigation With Offline RL
di: Bundele, Valay, et al.
Pubblicazione: (2024)
di: Bundele, Valay, et al.
Pubblicazione: (2024)
Qwen3-VL-Seg: Unlocking Open-World Referring Segmentation with Vision-Language Grounding
di: Yao, Yuan, et al.
Pubblicazione: (2026)
di: Yao, Yuan, et al.
Pubblicazione: (2026)
Med-DisSeg: Dispersion-Driven Representation Learning for Fine-Grained Medical Image Segmentation
di: Chen, Zhiquan, et al.
Pubblicazione: (2026)
di: Chen, Zhiquan, et al.
Pubblicazione: (2026)
SegMASt3R: Geometry Grounded Segment Matching
di: Jayanti, Rohit, et al.
Pubblicazione: (2025)
di: Jayanti, Rohit, et al.
Pubblicazione: (2025)
AnchorSeg: Language Grounded Query Banks for Reasoning Segmentation
di: Qian, Rui, et al.
Pubblicazione: (2026)
di: Qian, Rui, et al.
Pubblicazione: (2026)
DA-SegFormer: Damage-Aware Semantic Segmentation for Fine-Grained Disaster Assessment
di: Zhu, Kevin, et al.
Pubblicazione: (2026)
di: Zhu, Kevin, et al.
Pubblicazione: (2026)
ViGoR: Improving Visual Grounding of Large Vision Language Models with Fine-Grained Reward Modeling
di: Yan, Siming, et al.
Pubblicazione: (2024)
di: Yan, Siming, et al.
Pubblicazione: (2024)
RSRefSeg: Referring Remote Sensing Image Segmentation with Foundation Models
di: Chen, Keyan, et al.
Pubblicazione: (2025)
di: Chen, Keyan, et al.
Pubblicazione: (2025)
SegVG: Transferring Object Bounding Box to Segmentation for Visual Grounding
di: Kang, Weitai, et al.
Pubblicazione: (2024)
di: Kang, Weitai, et al.
Pubblicazione: (2024)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
di: Wang, Chenhao, et al.
Pubblicazione: (2026)
di: Wang, Chenhao, et al.
Pubblicazione: (2026)
RefineSeg: Dual Coarse-to-Fine Learning for Medical Image Segmentation
di: Du, Anghong, et al.
Pubblicazione: (2025)
di: Du, Anghong, et al.
Pubblicazione: (2025)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
di: Huang, Yu, et al.
Pubblicazione: (2025)
di: Huang, Yu, et al.
Pubblicazione: (2025)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
di: Shao, Hao, et al.
Pubblicazione: (2025)
di: Shao, Hao, et al.
Pubblicazione: (2025)
Zooming into Comics: Region-Aware RL Improves Fine-Grained Comic Understanding in Vision-Language Models
di: Chen, Yule, et al.
Pubblicazione: (2025)
di: Chen, Yule, et al.
Pubblicazione: (2025)
SegEarth-R2: Towards Comprehensive Language-guided Segmentation for Remote Sensing Images
di: Xin, Zepeng, et al.
Pubblicazione: (2025)
di: Xin, Zepeng, et al.
Pubblicazione: (2025)
Exploring Fine-Grained Image-Text Alignment for Referring Remote Sensing Image Segmentation
di: Lei, Sen, et al.
Pubblicazione: (2024)
di: Lei, Sen, et al.
Pubblicazione: (2024)
Mask Grounding for Referring Image Segmentation
di: Chng, Yong Xien, et al.
Pubblicazione: (2023)
di: Chng, Yong Xien, et al.
Pubblicazione: (2023)
RSRefSeg 2: Decoupling Referring Remote Sensing Image Segmentation with Foundation Models
di: Chen, Keyan, et al.
Pubblicazione: (2025)
di: Chen, Keyan, et al.
Pubblicazione: (2025)
ViTA-Seg: Vision Transformer for Amodal Segmentation in Robotics
di: Caramia, Donato, et al.
Pubblicazione: (2025)
di: Caramia, Donato, et al.
Pubblicazione: (2025)
MatchSeg: Towards Better Segmentation via Reference Image Matching
di: Huo, Jiayu, et al.
Pubblicazione: (2024)
di: Huo, Jiayu, et al.
Pubblicazione: (2024)
EPIC-Bench: A Perception-Centric Benchmark for Fine-Grained Embodied Visual Grounding in Vision-Language Models
di: Shan, Haozhe, et al.
Pubblicazione: (2026)
di: Shan, Haozhe, et al.
Pubblicazione: (2026)
FugSeg: Fast Uncertainty-aware Ground Segmentation for 3D Point Cloud
di: Li, Yu, et al.
Pubblicazione: (2026)
di: Li, Yu, et al.
Pubblicazione: (2026)
Seg-R1: Segmentation Can Be Surprisingly Simple with Reinforcement Learning
di: You, Zuyao, et al.
Pubblicazione: (2025)
di: You, Zuyao, et al.
Pubblicazione: (2025)
Prompt Tuning Vision Language Models with Margin Regularizer for Few-Shot Learning under Distribution Shifts
di: Brahma, Debarshi, et al.
Pubblicazione: (2025)
di: Brahma, Debarshi, et al.
Pubblicazione: (2025)
Beyond Language: Grounding Referring Expressions with Hand Pointing in Egocentric Vision
di: Li, Ling, et al.
Pubblicazione: (2026)
di: Li, Ling, et al.
Pubblicazione: (2026)
Hierarchical Contextual Grounding LVLM: Enhancing Fine-Grained Visual-Language Understanding with Robust Grounding
di: Guo, Leilei, et al.
Pubblicazione: (2025)
di: Guo, Leilei, et al.
Pubblicazione: (2025)
FPBench: A Comprehensive Benchmark of Multimodal Large Language Models for Fingerprint Analysis
di: Gavas, Ekta, et al.
Pubblicazione: (2025)
di: Gavas, Ekta, et al.
Pubblicazione: (2025)
Vision and Language Reference Prompt into SAM for Few-shot Segmentation
di: Sakurai, Kosuke, et al.
Pubblicazione: (2025)
di: Sakurai, Kosuke, et al.
Pubblicazione: (2025)
EAVL: Explicitly Align Vision and Language for Referring Image Segmentation
di: Yan, Yichen, et al.
Pubblicazione: (2023)
di: Yan, Yichen, et al.
Pubblicazione: (2023)
MetaSegNet: Metadata-collaborative Vision-Language Representation Learning for Semantic Segmentation of Remote Sensing Images
di: Wang, Libo, et al.
Pubblicazione: (2023)
di: Wang, Libo, et al.
Pubblicazione: (2023)
COCONut-PanCap: Joint Panoptic Segmentation and Grounded Captions for Fine-Grained Understanding and Generation
di: Deng, Xueqing, et al.
Pubblicazione: (2025)
di: Deng, Xueqing, et al.
Pubblicazione: (2025)
ReferDINO: Referring Video Object Segmentation with Visual Grounding Foundations
di: Liang, Tianming, et al.
Pubblicazione: (2025)
di: Liang, Tianming, et al.
Pubblicazione: (2025)
FILA: Fine-Grained Vision Language Models
di: Zhu, Shiding, et al.
Pubblicazione: (2024)
di: Zhu, Shiding, et al.
Pubblicazione: (2024)
ACS-SegNet: An Attention-Based CNN-SegFormer Segmentation Network for Tissue Segmentation in Histopathology
di: Torbati, Nima, et al.
Pubblicazione: (2025)
di: Torbati, Nima, et al.
Pubblicazione: (2025)
SliceLens: Fine-Grained and Grounded Error Slice Discovery for Multi-Instance Vision Tasks
di: Zhang, Wei, et al.
Pubblicazione: (2025)
di: Zhang, Wei, et al.
Pubblicazione: (2025)
Towards Fine-grained Renal Vasculature Segmentation: Full-Scale Hierarchical Learning with FH-Seg
di: Long, Yitian, et al.
Pubblicazione: (2025)
di: Long, Yitian, et al.
Pubblicazione: (2025)
CADFormer: Fine-Grained Cross-modal Alignment and Decoding Transformer for Referring Remote Sensing Image Segmentation
di: Liu, Maofu, et al.
Pubblicazione: (2025)
di: Liu, Maofu, et al.
Pubblicazione: (2025)
MitoSeg: Mitochondria Segmentation Tool
di: Taşel, Faris Serdar, et al.
Pubblicazione: (2024)
di: Taşel, Faris Serdar, et al.
Pubblicazione: (2024)
SegSLR: Promptable Video Segmentation for Isolated Sign Language Recognition
di: Schreiber, Sven, et al.
Pubblicazione: (2025)
di: Schreiber, Sven, et al.
Pubblicazione: (2025)
HyperSeg: Towards Universal Visual Segmentation with Large Language Model
di: Wei, Cong, et al.
Pubblicazione: (2024)
di: Wei, Cong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Scaling Vision-and-Language Navigation With Offline RL
di: Bundele, Valay, et al.
Pubblicazione: (2024) -
Qwen3-VL-Seg: Unlocking Open-World Referring Segmentation with Vision-Language Grounding
di: Yao, Yuan, et al.
Pubblicazione: (2026) -
Med-DisSeg: Dispersion-Driven Representation Learning for Fine-Grained Medical Image Segmentation
di: Chen, Zhiquan, et al.
Pubblicazione: (2026) -
SegMASt3R: Geometry Grounded Segment Matching
di: Jayanti, Rohit, et al.
Pubblicazione: (2025) -
AnchorSeg: Language Grounded Query Banks for Reasoning Segmentation
di: Qian, Rui, et al.
Pubblicazione: (2026)