SED: A Simple Encoder-Decoder for Open-Vocabulary Semantic Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xie, Bin, Cao, Jiale, Xie, Jin, Khan, Fahad Shahbaz, Pang, Yanwei |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
iSeg: An Iterative Refinement-based Framework for Training-free Segmentation
par: Sun, Lin, et autres
Publié: (2024)
par: Sun, Lin, et autres
Publié: (2024)
CLIPer: Hierarchically Improving Spatial Representation of CLIP for Open-Vocabulary Semantic Segmentation
par: Sun, Lin, et autres
Publié: (2024)
par: Sun, Lin, et autres
Publié: (2024)
CLIP-VIS: Adapting CLIP for Open-Vocabulary Video Instance Segmentation
par: Zhu, Wenqi, et autres
Publié: (2024)
par: Zhu, Wenqi, et autres
Publié: (2024)
SNNSIR: A Simple Spiking Neural Network for Stereo Image Restoration
par: Xu, Ronghua, et autres
Publié: (2025)
par: Xu, Ronghua, et autres
Publié: (2025)
Open-YOLO 3D: Towards Fast and Accurate Open-Vocabulary 3D Instance Segmentation
par: Boudjoghra, Mohamed El Amine, et autres
Publié: (2024)
par: Boudjoghra, Mohamed El Amine, et autres
Publié: (2024)
Open-Vocabulary Temporal Action Localization using Multimodal Guidance
par: Gupta, Akshita, et autres
Publié: (2024)
par: Gupta, Akshita, et autres
Publié: (2024)
Video-GroundingDINO: Towards Open-Vocabulary Spatio-Temporal Video Grounding
par: Wasim, Syed Talal, et autres
Publié: (2023)
par: Wasim, Syed Talal, et autres
Publié: (2023)
Transformer-based stereo-aware 3D object detection from binocular images
par: Sun, Hanqing, et autres
Publié: (2023)
par: Sun, Hanqing, et autres
Publié: (2023)
Exploring Simple Open-Vocabulary Semantic Segmentation
par: Lai, Zihang
Publié: (2024)
par: Lai, Zihang
Publié: (2024)
Implicit and Explicit Language Guidance for Diffusion-based Visual Perception
par: Wang, Hefeng, et autres
Publié: (2024)
par: Wang, Hefeng, et autres
Publié: (2024)
Not All Modalities Are Equal: Instruction-Aware Gating for Multimodal Videos
par: Ding, Bonan, et autres
Publié: (2026)
par: Ding, Bonan, et autres
Publié: (2026)
Training-Free Class Purification for Open-Vocabulary Semantic Segmentation
par: Chen, Qi, et autres
Publié: (2025)
par: Chen, Qi, et autres
Publié: (2025)
Target Refocusing via Attention Redistribution for Open-Vocabulary Semantic Segmentation: An Explainability Perspective
par: Li, Jiahao, et autres
Publié: (2025)
par: Li, Jiahao, et autres
Publié: (2025)
Open3DTrack: Towards Open-Vocabulary 3D Multi-Object Tracking
par: Ishaq, Ayesha, et autres
Publié: (2024)
par: Ishaq, Ayesha, et autres
Publié: (2024)
DB-SAM: Delving into High Quality Universal Medical Image Segmentation
par: Qin, Chao, et autres
Publié: (2024)
par: Qin, Chao, et autres
Publié: (2024)
VFMM3D: Releasing the Potential of Image by Vision Foundation Model for Monocular 3D Object Detection
par: Ding, Bonan, et autres
Publié: (2024)
par: Ding, Bonan, et autres
Publié: (2024)
Direct Segmentation without Logits Optimization for Training-Free Open-Vocabulary Semantic Segmentation
par: Li, Jiahao, et autres
Publié: (2026)
par: Li, Jiahao, et autres
Publié: (2026)
Vocabulary-free Fine-grained Visual Recognition via Enriched Contextually Grounded Vision-Language Model
par: Demidov, Dmitry, et autres
Publié: (2025)
par: Demidov, Dmitry, et autres
Publié: (2025)
Language Guided Domain Generalized Medical Image Segmentation
par: Kunhimon, Shahina, et autres
Publié: (2024)
par: Kunhimon, Shahina, et autres
Publié: (2024)
From Open-Vocabulary to Vocabulary-Free Semantic Segmentation
par: Reichard, Klara, et autres
Publié: (2025)
par: Reichard, Klara, et autres
Publié: (2025)
Novel Category Discovery with X-Agent Attention for Open-Vocabulary Semantic Segmentation
par: Li, Jiahao, et autres
Publié: (2025)
par: Li, Jiahao, et autres
Publié: (2025)
Efficient Redundancy Reduction for Open-Vocabulary Semantic Segmentation
par: Chen, Lin, et autres
Publié: (2025)
par: Chen, Lin, et autres
Publié: (2025)
MedROV: Towards Real-Time Open-Vocabulary Detection Across Diverse Medical Imaging Modalities
par: Sheikh, Tooba Tehreem, et autres
Publié: (2025)
par: Sheikh, Tooba Tehreem, et autres
Publié: (2025)
A Simple Framework for Open-Vocabulary Zero-Shot Segmentation
par: Stegmüller, Thomas, et autres
Publié: (2024)
par: Stegmüller, Thomas, et autres
Publié: (2024)
VideoGLaMM: A Large Multimodal Model for Pixel-Level Visual Grounding in Videos
par: Munasinghe, Shehan, et autres
Publié: (2024)
par: Munasinghe, Shehan, et autres
Publié: (2024)
OpenSeg-R: Improving Open-Vocabulary Segmentation via Step-by-Step Visual Reasoning
par: Han, Zongyan, et autres
Publié: (2025)
par: Han, Zongyan, et autres
Publié: (2025)
EoCD: Encoder only Remote Sensing Change Detection
par: Noman, Mubashir, et autres
Publié: (2026)
par: Noman, Mubashir, et autres
Publié: (2026)
Open-Vocabulary Camouflaged Object Segmentation
par: Pang, Youwei, et autres
Publié: (2023)
par: Pang, Youwei, et autres
Publié: (2023)
Open-Vocabulary Segmentation with Semantic-Assisted Calibration
par: Liu, Yong, et autres
Publié: (2023)
par: Liu, Yong, et autres
Publié: (2023)
Open-Vocabulary Remote Sensing Image Semantic Segmentation
par: Cao, Qinglong, et autres
Publié: (2024)
par: Cao, Qinglong, et autres
Publié: (2024)
CoME-VL: Scaling Complementary Multi-Encoder Vision-Language Learning
par: Deria, Ankan, et autres
Publié: (2026)
par: Deria, Ankan, et autres
Publié: (2026)
Semantic Alignment in Hyperbolic Space for Open-Vocabulary Semantic Segmentation
par: Truong, Hoang M., et autres
Publié: (2026)
par: Truong, Hoang M., et autres
Publié: (2026)
Towards Open-Vocabulary Semantic Segmentation Without Semantic Labels
par: Shin, Heeseong, et autres
Publié: (2024)
par: Shin, Heeseong, et autres
Publié: (2024)
Progressive Semantic-Guided Vision Transformer for Zero-Shot Learning
par: Chen, Shiming, et autres
Publié: (2024)
par: Chen, Shiming, et autres
Publié: (2024)
AURORA:Augmented Understanding via Structured Reasoning and Reinforcement Learning for Reference Audio-Visual Segmentation
par: Luo, Ziyang, et autres
Publié: (2025)
par: Luo, Ziyang, et autres
Publié: (2025)
Open-Vocabulary Semantic Segmentation with Image Embedding Balancing
par: Shan, Xiangheng, et autres
Publié: (2024)
par: Shan, Xiangheng, et autres
Publié: (2024)
TAG: Guidance-free Open-Vocabulary Semantic Segmentation
par: Kawano, Yasufumi, et autres
Publié: (2024)
par: Kawano, Yasufumi, et autres
Publié: (2024)
Effective SAM Combination for Open-Vocabulary Semantic Segmentation
par: Lee, Minhyeok, et autres
Publié: (2024)
par: Lee, Minhyeok, et autres
Publié: (2024)
A Survey on Training-free Open-Vocabulary Semantic Segmentation
par: Kombol, Naomi, et autres
Publié: (2025)
par: Kombol, Naomi, et autres
Publié: (2025)
A Hierarchical Semantic Distillation Framework for Open-Vocabulary Object Detection
par: Fu, Shenghao, et autres
Publié: (2025)
par: Fu, Shenghao, et autres
Publié: (2025)
Documents similaires
-
iSeg: An Iterative Refinement-based Framework for Training-free Segmentation
par: Sun, Lin, et autres
Publié: (2024) -
CLIPer: Hierarchically Improving Spatial Representation of CLIP for Open-Vocabulary Semantic Segmentation
par: Sun, Lin, et autres
Publié: (2024) -
CLIP-VIS: Adapting CLIP for Open-Vocabulary Video Instance Segmentation
par: Zhu, Wenqi, et autres
Publié: (2024) -
SNNSIR: A Simple Spiking Neural Network for Stereo Image Restoration
par: Xu, Ronghua, et autres
Publié: (2025) -
Open-YOLO 3D: Towards Fast and Accurate Open-Vocabulary 3D Instance Segmentation
par: Boudjoghra, Mohamed El Amine, et autres
Publié: (2024)