HyperSeg: Towards Universal Visual Segmentation with Large Language Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Wei, Cong, Zhong, Yujie, Tan, Haoxian, Liu, Yong, Zhao, Zheng, Hu, Jie, Yang, Yujiu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
InstructSeg: Unifying Instructed Visual Segmentation with Multi-modal Large Language Models
di: Wei, Cong, et al.
Pubblicazione: (2024)
di: Wei, Cong, et al.
Pubblicazione: (2024)
LaSagnA: Language-based Segmentation Assistant for Complex Queries
di: Wei, Cong, et al.
Pubblicazione: (2024)
di: Wei, Cong, et al.
Pubblicazione: (2024)
Advancing Visual Large Language Model for Multi-granular Versatile Perception
di: Xiang, Wentao, et al.
Pubblicazione: (2025)
di: Xiang, Wentao, et al.
Pubblicazione: (2025)
LinVT: Empower Your Image-level Large Language Model to Understand Videos
di: Gao, Lishuai, et al.
Pubblicazione: (2024)
di: Gao, Lishuai, et al.
Pubblicazione: (2024)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
di: Huang, Yu, et al.
Pubblicazione: (2025)
di: Huang, Yu, et al.
Pubblicazione: (2025)
Seg-VAR: Image Segmentation with Visual Autoregressive Modeling
di: Zheng, Rongkun, et al.
Pubblicazione: (2025)
di: Zheng, Rongkun, et al.
Pubblicazione: (2025)
Universal Segmentation at Arbitrary Granularity with Language Instruction
di: Liu, Yong, et al.
Pubblicazione: (2023)
di: Liu, Yong, et al.
Pubblicazione: (2023)
DR$^2$Seg: Decomposed Two-Stage Rollouts for Efficient Reasoning Segmentation in Multimodal Large Language Models
di: He, Yulin, et al.
Pubblicazione: (2026)
di: He, Yulin, et al.
Pubblicazione: (2026)
A Comprehensive Study of Multimodal Large Language Models for Image Quality Assessment
di: Wu, Tianhe, et al.
Pubblicazione: (2024)
di: Wu, Tianhe, et al.
Pubblicazione: (2024)
SegStitch: Multidimensional Transformer for Robust and Efficient Medical Imaging Segmentation
di: Tan, Shengbo, et al.
Pubblicazione: (2024)
di: Tan, Shengbo, et al.
Pubblicazione: (2024)
SegPoint: Segment Any Point Cloud via Large Language Model
di: He, Shuting, et al.
Pubblicazione: (2024)
di: He, Shuting, et al.
Pubblicazione: (2024)
SegVol: Universal and Interactive Volumetric Medical Image Segmentation
di: Du, Yuxin, et al.
Pubblicazione: (2023)
di: Du, Yuxin, et al.
Pubblicazione: (2023)
iSegMan: Interactive Segment-and-Manipulate 3D Gaussians
di: Zhao, Yian, et al.
Pubblicazione: (2025)
di: Zhao, Yian, et al.
Pubblicazione: (2025)
EOV-Seg: Efficient Open-Vocabulary Panoptic Segmentation
di: Niu, Hongwei, et al.
Pubblicazione: (2024)
di: Niu, Hongwei, et al.
Pubblicazione: (2024)
LLM-Seg: Bridging Image Segmentation and Large Language Model Reasoning
di: Wang, Junchi, et al.
Pubblicazione: (2024)
di: Wang, Junchi, et al.
Pubblicazione: (2024)
Seg-ReSearch: Segmentation with Interleaved Reasoning and External Search
di: Liang, Tianming, et al.
Pubblicazione: (2026)
di: Liang, Tianming, et al.
Pubblicazione: (2026)
DisTime: Distribution-based Time Representation for Video Large Language Models
di: Zeng, Yingsen, et al.
Pubblicazione: (2025)
di: Zeng, Yingsen, et al.
Pubblicazione: (2025)
MatchSeg: Towards Better Segmentation via Reference Image Matching
di: Huo, Jiayu, et al.
Pubblicazione: (2024)
di: Huo, Jiayu, et al.
Pubblicazione: (2024)
TokenSeg: Efficient 3D Medical Image Segmentation via Hierarchical Visual Token Compression
di: Zeng, Sen, et al.
Pubblicazione: (2026)
di: Zeng, Sen, et al.
Pubblicazione: (2026)
SegTrans: Transferable Adversarial Examples for Segmentation Models
di: Song, Yufei, et al.
Pubblicazione: (2025)
di: Song, Yufei, et al.
Pubblicazione: (2025)
Qwen3-VL-Seg: Unlocking Open-World Referring Segmentation with Vision-Language Grounding
di: Yao, Yuan, et al.
Pubblicazione: (2026)
di: Yao, Yuan, et al.
Pubblicazione: (2026)
Text4Seg++: Advancing Image Segmentation via Generative Language Modeling
di: Lan, Mengcheng, et al.
Pubblicazione: (2025)
di: Lan, Mengcheng, et al.
Pubblicazione: (2025)
IDA-VLM: Towards Movie Understanding via ID-Aware Large Vision-Language Model
di: Ji, Yatai, et al.
Pubblicazione: (2024)
di: Ji, Yatai, et al.
Pubblicazione: (2024)
AnchorSeg: Language Grounded Query Banks for Reasoning Segmentation
di: Qian, Rui, et al.
Pubblicazione: (2026)
di: Qian, Rui, et al.
Pubblicazione: (2026)
WeatherReasonSeg: A Benchmark for Weather-Aware Reasoning Segmentation in Visual Language Models
di: Du, Wanjun, et al.
Pubblicazione: (2026)
di: Du, Wanjun, et al.
Pubblicazione: (2026)
SkySeg: Collaborative Onboard Semantic Segmentation with Heterogeneous UAVs in the Wild
di: Lu, Anqi, et al.
Pubblicazione: (2026)
di: Lu, Anqi, et al.
Pubblicazione: (2026)
TP-Seg: Task-Prototype Framework for Unified Medical Lesion Segmentation
di: Xu, Jiawei, et al.
Pubblicazione: (2026)
di: Xu, Jiawei, et al.
Pubblicazione: (2026)
Learning Semantic-Aware Representation in Visual-Language Models for Multi-Label Recognition with Partial Labels
di: Ruan, Haoxian, et al.
Pubblicazione: (2024)
di: Ruan, Haoxian, et al.
Pubblicazione: (2024)
ARGenSeg: Image Segmentation with Autoregressive Image Generation Model
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
MedUniSeg: 2D and 3D Medical Image Segmentation via a Prompt-driven Universal Model
di: Ye, Yiwen, et al.
Pubblicazione: (2024)
di: Ye, Yiwen, et al.
Pubblicazione: (2024)
PlantSeg: A Large-Scale In-the-wild Dataset for Plant Disease Segmentation
di: Wei, Tianqi, et al.
Pubblicazione: (2024)
di: Wei, Tianqi, et al.
Pubblicazione: (2024)
SegEarth-R2: Towards Comprehensive Language-guided Segmentation for Remote Sensing Images
di: Xin, Zepeng, et al.
Pubblicazione: (2025)
di: Xin, Zepeng, et al.
Pubblicazione: (2025)
HyperET: Efficient Training in Hyperbolic Space for Multi-modal Large Language Models
di: Peng, Zelin, et al.
Pubblicazione: (2025)
di: Peng, Zelin, et al.
Pubblicazione: (2025)
CharGen: High Accurate Character-Level Visual Text Generation Model with MultiModal Encoder
di: Ma, Lichen, et al.
Pubblicazione: (2024)
di: Ma, Lichen, et al.
Pubblicazione: (2024)
MAgSeg: Segmentation of Agricultural Landscapes in High-Resolution Satellite Imagery using Multimodal Large Language Models
di: Tiwary, Piyush, et al.
Pubblicazione: (2026)
di: Tiwary, Piyush, et al.
Pubblicazione: (2026)
SegVG: Transferring Object Bounding Box to Segmentation for Visual Grounding
di: Kang, Weitai, et al.
Pubblicazione: (2024)
di: Kang, Weitai, et al.
Pubblicazione: (2024)
MAIRA-Seg: Enhancing Radiology Report Generation with Segmentation-Aware Multimodal Large Language Models
di: Sharma, Harshita, et al.
Pubblicazione: (2024)
di: Sharma, Harshita, et al.
Pubblicazione: (2024)
OMG-Seg: Is One Model Good Enough For All Segmentation?
di: Li, Xiangtai, et al.
Pubblicazione: (2024)
di: Li, Xiangtai, et al.
Pubblicazione: (2024)
SegRGB-X: General RGB-X Semantic Segmentation Model
di: Liu, Jiong, et al.
Pubblicazione: (2026)
di: Liu, Jiong, et al.
Pubblicazione: (2026)
SegMoTE: Token-Level Mixture of Experts for Medical Image Segmentation
di: Lu, Yujie, et al.
Pubblicazione: (2026)
di: Lu, Yujie, et al.
Pubblicazione: (2026)
Documenti analoghi
-
InstructSeg: Unifying Instructed Visual Segmentation with Multi-modal Large Language Models
di: Wei, Cong, et al.
Pubblicazione: (2024) -
LaSagnA: Language-based Segmentation Assistant for Complex Queries
di: Wei, Cong, et al.
Pubblicazione: (2024) -
Advancing Visual Large Language Model for Multi-granular Versatile Perception
di: Xiang, Wentao, et al.
Pubblicazione: (2025) -
LinVT: Empower Your Image-level Large Language Model to Understand Videos
di: Gao, Lishuai, et al.
Pubblicazione: (2024) -
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
di: Huang, Yu, et al.
Pubblicazione: (2025)