FGAseg: Fine-Grained Pixel-Text Alignment for Open-Vocabulary Semantic Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Bingyu, Zhang, Da, Zhao, Zhiyuan, Gao, Junyu, Li, Xuelong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MARIS: Marine Open-Vocabulary Instance Segmentation with Geometric Enhancement and Semantic Alignment
di: Li, Bingyu, et al.
Pubblicazione: (2025)
di: Li, Bingyu, et al.
Pubblicazione: (2025)
Exploring Efficient Open-Vocabulary Segmentation in the Remote Sensing
di: Li, Bingyu, et al.
Pubblicazione: (2025)
di: Li, Bingyu, et al.
Pubblicazione: (2025)
Towards Realistic Open-Vocabulary Remote Sensing Segmentation: Benchmark and Baseline
di: Li, Bingyu, et al.
Pubblicazione: (2026)
di: Li, Bingyu, et al.
Pubblicazione: (2026)
U3M: Unbiased Multiscale Modal Fusion Model for Multimodal Semantic Segmentation
di: Li, Bingyu, et al.
Pubblicazione: (2024)
di: Li, Bingyu, et al.
Pubblicazione: (2024)
StitchFusion: Weaving Any Visual Modalities to Enhance Multimodal Semantic Segmentation
di: Li, Bingyu, et al.
Pubblicazione: (2024)
di: Li, Bingyu, et al.
Pubblicazione: (2024)
An Open-Source Benchmark and Baseline for Multi-temporal Referring Segmentation
di: Li, Bingyu, et al.
Pubblicazione: (2026)
di: Li, Bingyu, et al.
Pubblicazione: (2026)
Exploring the Underwater World Segmentation without Extra Training
di: Li, Bingyu, et al.
Pubblicazione: (2025)
di: Li, Bingyu, et al.
Pubblicazione: (2025)
Prototype-Based Low Altitude UAV Semantic Segmentation
di: Zhang, Da, et al.
Pubblicazione: (2026)
di: Zhang, Da, et al.
Pubblicazione: (2026)
Dynamic Proxy Domain Generalizes the Crowd Localization by Better Binary Segmentation
di: Gao, Junyu, et al.
Pubblicazione: (2024)
di: Gao, Junyu, et al.
Pubblicazione: (2024)
UWBench: A Comprehensive Vision-Language Benchmark for Underwater Understanding
di: Zhang, Da, et al.
Pubblicazione: (2025)
di: Zhang, Da, et al.
Pubblicazione: (2025)
Quantum-inspired Interpretable Deep Learning Architecture for Text Sentiment Analysis
di: Li, Bingyu, et al.
Pubblicazione: (2024)
di: Li, Bingyu, et al.
Pubblicazione: (2024)
Boosting Quantitive and Spatial Awareness for Zero-Shot Object Counting
di: Zhang, Da, et al.
Pubblicazione: (2026)
di: Zhang, Da, et al.
Pubblicazione: (2026)
IntroSVG: Learning from Rendering Feedback for Text-to-SVG Generation via an Introspective Generator-Critic Framework
di: Wang, Feiyu, et al.
Pubblicazione: (2026)
di: Wang, Feiyu, et al.
Pubblicazione: (2026)
NWPU-MOC: A Benchmark for Fine-grained Multi-category Object Counting in Aerial Images
di: Gao, Junyu, et al.
Pubblicazione: (2024)
di: Gao, Junyu, et al.
Pubblicazione: (2024)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
di: Wang, Chenhao, et al.
Pubblicazione: (2026)
di: Wang, Chenhao, et al.
Pubblicazione: (2026)
Semantic Alignment in Hyperbolic Space for Open-Vocabulary Semantic Segmentation
di: Truong, Hoang M., et al.
Pubblicazione: (2026)
di: Truong, Hoang M., et al.
Pubblicazione: (2026)
Fine-Grained Image-Text Correspondence with Cost Aggregation for Open-Vocabulary Part Segmentation
di: Choi, Jiho, et al.
Pubblicazione: (2025)
di: Choi, Jiho, et al.
Pubblicazione: (2025)
Incorporating Feature Pyramid Tokenization and Open Vocabulary Semantic Segmentation
di: Zhang, Jianyu, et al.
Pubblicazione: (2024)
di: Zhang, Jianyu, et al.
Pubblicazione: (2024)
Adapting Vision-Language Model with Fine-grained Semantics for Open-Vocabulary Segmentation
di: Chng, Yong Xien, et al.
Pubblicazione: (2024)
di: Chng, Yong Xien, et al.
Pubblicazione: (2024)
Lost in Translation? Vocabulary Alignment for Source-Free Adaptation in Open-Vocabulary Semantic Segmentation
di: Mazzucco, Silvio, et al.
Pubblicazione: (2025)
di: Mazzucco, Silvio, et al.
Pubblicazione: (2025)
Open-Vocabulary Segmentation with Semantic-Assisted Calibration
di: Liu, Yong, et al.
Pubblicazione: (2023)
di: Liu, Yong, et al.
Pubblicazione: (2023)
Enhancing Open-Vocabulary Object Detection through Multi-Level Fine-Grained Visual-Language Alignment
di: Zhang, Tianyi, et al.
Pubblicazione: (2026)
di: Zhang, Tianyi, et al.
Pubblicazione: (2026)
Unified Embedding Alignment for Open-Vocabulary Video Instance Segmentation
di: Fang, Hao, et al.
Pubblicazione: (2024)
di: Fang, Hao, et al.
Pubblicazione: (2024)
Open-Vocabulary 3D Semantic Segmentation with Text-to-Image Diffusion Models
di: Zhu, Xiaoyu, et al.
Pubblicazione: (2024)
di: Zhu, Xiaoyu, et al.
Pubblicazione: (2024)
Efficient Redundancy Reduction for Open-Vocabulary Semantic Segmentation
di: Chen, Lin, et al.
Pubblicazione: (2025)
di: Chen, Lin, et al.
Pubblicazione: (2025)
From Open-Vocabulary to Vocabulary-Free Semantic Segmentation
di: Reichard, Klara, et al.
Pubblicazione: (2025)
di: Reichard, Klara, et al.
Pubblicazione: (2025)
Fine-Grained Open-Vocabulary Object Recognition via User-Guided Segmentation
di: Ahn, Jinwoo, et al.
Pubblicazione: (2024)
di: Ahn, Jinwoo, et al.
Pubblicazione: (2024)
Open-Vocabulary Semantic Segmentation with Image Embedding Balancing
di: Shan, Xiangheng, et al.
Pubblicazione: (2024)
di: Shan, Xiangheng, et al.
Pubblicazione: (2024)
Dense Multimodal Alignment for Open-Vocabulary 3D Scene Understanding
di: Li, Ruihuang, et al.
Pubblicazione: (2024)
di: Li, Ruihuang, et al.
Pubblicazione: (2024)
Exploring Fine-Grained Image-Text Alignment for Referring Remote Sensing Image Segmentation
di: Lei, Sen, et al.
Pubblicazione: (2024)
di: Lei, Sen, et al.
Pubblicazione: (2024)
InfoCLIP: Bridging Vision-Language Pretraining and Open-Vocabulary Semantic Segmentation via Information-Theoretic Alignment Transfer
di: Yuan, Muyao, et al.
Pubblicazione: (2025)
di: Yuan, Muyao, et al.
Pubblicazione: (2025)
DPSeg: Dual-Prompt Cost Volume Learning for Open-Vocabulary Semantic Segmentation
di: Zhao, Ziyu, et al.
Pubblicazione: (2025)
di: Zhao, Ziyu, et al.
Pubblicazione: (2025)
DCP-CLIP:A Coarse-to-Fine Framework for Open-Vocabulary Semantic Segmentation with Dual Interaction
di: Wang, Jing, et al.
Pubblicazione: (2026)
di: Wang, Jing, et al.
Pubblicazione: (2026)
Direct Segmentation without Logits Optimization for Training-Free Open-Vocabulary Semantic Segmentation
di: Li, Jiahao, et al.
Pubblicazione: (2026)
di: Li, Jiahao, et al.
Pubblicazione: (2026)
Open-Vocabulary Semantic Part Segmentation of 3D Human
di: Suzuki, Keito, et al.
Pubblicazione: (2025)
di: Suzuki, Keito, et al.
Pubblicazione: (2025)
Stepping Out of Similar Semantic Space for Open-Vocabulary Segmentation
di: Liu, Yong, et al.
Pubblicazione: (2025)
di: Liu, Yong, et al.
Pubblicazione: (2025)
Multi-Grained Cross-modal Alignment for Learning Open-vocabulary Semantic Segmentation from Text Supervision
di: Liu, Yajie, et al.
Pubblicazione: (2024)
di: Liu, Yajie, et al.
Pubblicazione: (2024)
SVGen: Interpretable Vector Graphics Generation with Large Language Models
di: Wang, Feiyu, et al.
Pubblicazione: (2025)
di: Wang, Feiyu, et al.
Pubblicazione: (2025)
Open-Vocabulary Octree-Graph for 3D Scene Understanding
di: Wang, Zhigang, et al.
Pubblicazione: (2024)
di: Wang, Zhigang, et al.
Pubblicazione: (2024)
Training-Free Class Purification for Open-Vocabulary Semantic Segmentation
di: Chen, Qi, et al.
Pubblicazione: (2025)
di: Chen, Qi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MARIS: Marine Open-Vocabulary Instance Segmentation with Geometric Enhancement and Semantic Alignment
di: Li, Bingyu, et al.
Pubblicazione: (2025) -
Exploring Efficient Open-Vocabulary Segmentation in the Remote Sensing
di: Li, Bingyu, et al.
Pubblicazione: (2025) -
Towards Realistic Open-Vocabulary Remote Sensing Segmentation: Benchmark and Baseline
di: Li, Bingyu, et al.
Pubblicazione: (2026) -
U3M: Unbiased Multiscale Modal Fusion Model for Multimodal Semantic Segmentation
di: Li, Bingyu, et al.
Pubblicazione: (2024) -
StitchFusion: Weaving Any Visual Modalities to Enhance Multimodal Semantic Segmentation
di: Li, Bingyu, et al.
Pubblicazione: (2024)