Representation Separation for Semantic Segmentation with Vision Transformers
Fuente:
arXiv
Guardado en:
| Autores principales: | Hong, Yuanduo, Pan, Huihui, Sun, Weichao, Yu, Xinghu, Gao, Huijun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2022
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Deep Dual-resolution Networks for Real-time and Accurate Semantic Segmentation of Road Scenes
por: Hong, Yuanduo, et al.
Publicado: (2021)
por: Hong, Yuanduo, et al.
Publicado: (2021)
Vision Transformer-Conditioned UNet for Domain-Adaptive Semantic Segmentation
por: Ortega, Joel Valdivia, et al.
Publicado: (2026)
por: Ortega, Joel Valdivia, et al.
Publicado: (2026)
Vision-Language Model Purified Semi-Supervised Semantic Segmentation for Remote Sensing Images
por: Wang, Shanwen, et al.
Publicado: (2026)
por: Wang, Shanwen, et al.
Publicado: (2026)
Fine-grained Background Representation for Weakly Supervised Semantic Segmentation
por: Yin, Xu, et al.
Publicado: (2024)
por: Yin, Xu, et al.
Publicado: (2024)
Are Vision Transformer Representations Semantically Meaningful? A Case Study in Medical Imaging
por: Shams, Montasir, et al.
Publicado: (2025)
por: Shams, Montasir, et al.
Publicado: (2025)
Superpixel Semantics Representation and Pre-training for Vision-Language Task
por: Zhang, Siyu, et al.
Publicado: (2023)
por: Zhang, Siyu, et al.
Publicado: (2023)
I-Segmenter: Integer-Only Vision Transformer for Efficient Semantic Segmentation
por: Sassoon, Jordan, et al.
Publicado: (2025)
por: Sassoon, Jordan, et al.
Publicado: (2025)
Power of Boundary and Reflection: Semantic Transparent Object Segmentation using Pyramid Vision Transformer with Transparent Cues
por: Vu, Tuan-Anh, et al.
Publicado: (2025)
por: Vu, Tuan-Anh, et al.
Publicado: (2025)
Heuristical Comparison of Vision Transformers Against Convolutional Neural Networks for Semantic Segmentation on Remote Sensing Imagery
por: Dahal, Ashim, et al.
Publicado: (2024)
por: Dahal, Ashim, et al.
Publicado: (2024)
DEFormer: DCT-driven Enhancement Transformer for Low-light Image and Dark Vision
por: Yin, Xiangchen, et al.
Publicado: (2023)
por: Yin, Xiangchen, et al.
Publicado: (2023)
Urban Socio-Semantic Segmentation with Vision-Language Reasoning
por: Wang, Yu, et al.
Publicado: (2026)
por: Wang, Yu, et al.
Publicado: (2026)
Separators in Enhancing Autoregressive Pretraining for Vision Mamba
por: Liu, Hanpeng, et al.
Publicado: (2026)
por: Liu, Hanpeng, et al.
Publicado: (2026)
PROSPECT: Unified Streaming Vision-Language Navigation via Semantic--Spatial Fusion and Latent Predictive Representation
por: Fan, Zehua, et al.
Publicado: (2026)
por: Fan, Zehua, et al.
Publicado: (2026)
Harnessing Group-Oriented Consistency Constraints for Semi-Supervised Semantic Segmentation in CdZnTe Semiconductors
por: Li, Peihao, et al.
Publicado: (2025)
por: Li, Peihao, et al.
Publicado: (2025)
CycleBEV: Regularizing View Transformation Networks via View Cycle Consistency for Bird's-Eye-View Semantic Segmentation
por: Hong, Jeongbin, et al.
Publicado: (2026)
por: Hong, Jeongbin, et al.
Publicado: (2026)
How Lightweight Can A Vision Transformer Be
por: Tan, Jen Hong
Publicado: (2024)
por: Tan, Jen Hong
Publicado: (2024)
Adversarially Domain-adaptive Latent Diffusion for Unsupervised Semantic Segmentation
por: Yu, Jongmin, et al.
Publicado: (2024)
por: Yu, Jongmin, et al.
Publicado: (2024)
Leveraging Swin Transformer for Local-to-Global Weakly Supervised Semantic Segmentation
por: Ahmadi, Rozhan, et al.
Publicado: (2024)
por: Ahmadi, Rozhan, et al.
Publicado: (2024)
Cross-aware Early Fusion with Stage-divided Vision and Language Transformer Encoders for Referring Image Segmentation
por: Cho, Yubin, et al.
Publicado: (2024)
por: Cho, Yubin, et al.
Publicado: (2024)
Semantic Segmentation by Semantic Proportions
por: Aysel, Halil Ibrahim, et al.
Publicado: (2023)
por: Aysel, Halil Ibrahim, et al.
Publicado: (2023)
SAC-ViT: Semantic-Aware Clustering Vision Transformer with Early Exit
por: Hu, Youbing, et al.
Publicado: (2025)
por: Hu, Youbing, et al.
Publicado: (2025)
A 2D Semantic-Aware Position Encoding for Vision Transformers
por: Chen, Xi, et al.
Publicado: (2025)
por: Chen, Xi, et al.
Publicado: (2025)
Knowledge-Guided Brain Tumor Segmentation via Synchronized Visual-Semantic-Topological Prior Fusion
por: Zhang, Mingda, et al.
Publicado: (2025)
por: Zhang, Mingda, et al.
Publicado: (2025)
Dissecting Query-Key Interaction in Vision Transformers
por: Pan, Xu, et al.
Publicado: (2024)
por: Pan, Xu, et al.
Publicado: (2024)
Semantic Localization Guiding Segment Anything Model For Reference Remote Sensing Image Segmentation
por: Li, Shuyang, et al.
Publicado: (2025)
por: Li, Shuyang, et al.
Publicado: (2025)
Emergent Open-Vocabulary Semantic Segmentation from Off-the-shelf Vision-Language Models
por: Luo, Jiayun, et al.
Publicado: (2023)
por: Luo, Jiayun, et al.
Publicado: (2023)
A Study on Unsupervised Domain Adaptation for Semantic Segmentation in the Era of Vision-Language Models
por: Schwonberg, Manuel, et al.
Publicado: (2024)
por: Schwonberg, Manuel, et al.
Publicado: (2024)
Solution for CVPR 2024 UG2+ Challenge Track on All Weather Semantic Segmentation
por: Yu, Jun, et al.
Publicado: (2024)
por: Yu, Jun, et al.
Publicado: (2024)
Spiking Vision Transformer with Saccadic Attention
por: Wang, Shuai, et al.
Publicado: (2025)
por: Wang, Shuai, et al.
Publicado: (2025)
REL-SF4PASS: Panoramic Semantic Segmentation with REL Depth Representation and Spherical Fusion
por: Li, Xuewei, et al.
Publicado: (2026)
por: Li, Xuewei, et al.
Publicado: (2026)
Depth-guided Texture Diffusion for Image Semantic Segmentation
por: Sun, Wei, et al.
Publicado: (2024)
por: Sun, Wei, et al.
Publicado: (2024)
Semi-supervised Semantic Segmentation for Remote Sensing Images via Multi-scale Uncertainty Consistency and Cross-Teacher-Student Attention
por: Wang, Shanwen, et al.
Publicado: (2025)
por: Wang, Shanwen, et al.
Publicado: (2025)
Symbolic Rule Extraction from Attention-Guided Sparse Representations in Vision Transformers
por: Padalkar, Parth, et al.
Publicado: (2025)
por: Padalkar, Parth, et al.
Publicado: (2025)
IFViT: Interpretable Fixed-Length Representation for Fingerprint Matching via Vision Transformer
por: Qiu, Yuhang, et al.
Publicado: (2024)
por: Qiu, Yuhang, et al.
Publicado: (2024)
Two-stage Vision Transformers and Hard Masking offer Robust Object Representations
por: Aniraj, Ananthu, et al.
Publicado: (2025)
por: Aniraj, Ananthu, et al.
Publicado: (2025)
Learning to Merge Tokens via Decoupled Embedding for Efficient Vision Transformers
por: Lee, Dong Hoon, et al.
Publicado: (2024)
por: Lee, Dong Hoon, et al.
Publicado: (2024)
MSDNet: Multi-Scale Decoder for Few-Shot Semantic Segmentation via Transformer-Guided Prototyping
por: Fateh, Amirreza, et al.
Publicado: (2024)
por: Fateh, Amirreza, et al.
Publicado: (2024)
SLTNet: Efficient Event-based Semantic Segmentation with Spike-driven Lightweight Transformer-based Networks
por: Long, Xianlei, et al.
Publicado: (2024)
por: Long, Xianlei, et al.
Publicado: (2024)
AllSpark: Reborn Labeled Features from Unlabeled in Transformer for Semi-Supervised Semantic Segmentation
por: Wang, Haonan, et al.
Publicado: (2024)
por: Wang, Haonan, et al.
Publicado: (2024)
Learning Local and Global Temporal Contexts for Video Semantic Segmentation
por: Sun, Guolei, et al.
Publicado: (2022)
por: Sun, Guolei, et al.
Publicado: (2022)
Ejemplares similares
-
Deep Dual-resolution Networks for Real-time and Accurate Semantic Segmentation of Road Scenes
por: Hong, Yuanduo, et al.
Publicado: (2021) -
Vision Transformer-Conditioned UNet for Domain-Adaptive Semantic Segmentation
por: Ortega, Joel Valdivia, et al.
Publicado: (2026) -
Vision-Language Model Purified Semi-Supervised Semantic Segmentation for Remote Sensing Images
por: Wang, Shanwen, et al.
Publicado: (2026) -
Fine-grained Background Representation for Weakly Supervised Semantic Segmentation
por: Yin, Xu, et al.
Publicado: (2024) -
Are Vision Transformer Representations Semantically Meaningful? A Case Study in Medical Imaging
por: Shams, Montasir, et al.
Publicado: (2025)