Revitalizing Dense Material Segmentation: Stabilized Vision Transformers and the Generalization Paradox
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kazakov, Allan, Cakir, Duygu, İrfanoğlu, Hilal Kurt, İrfanoğlu, Yavuz |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Vision Transformers: From Semantic Segmentation to Dense Prediction
par: Zhang, Li, et autres
Publié: (2022)
par: Zhang, Li, et autres
Publié: (2022)
Quantization Robustness to Input Degradations for Object Detection
par: Karimov, Toghrul, et autres
Publié: (2025)
par: Karimov, Toghrul, et autres
Publié: (2025)
Meissonic: Revitalizing Masked Generative Transformers for Efficient High-Resolution Text-to-Image Synthesis
par: Bai, Jinbin, et autres
Publié: (2024)
par: Bai, Jinbin, et autres
Publié: (2024)
Dense Vision Transformer Compression with Few Samples
par: Zhang, Hanxiao, et autres
Publié: (2024)
par: Zhang, Hanxiao, et autres
Publié: (2024)
RD-ViT: Recurrent-Depth Vision Transformer for Semantic Segmentation with Reduced Data Dependence Extending the Recurrent-Depth Transformer Architecture to Dense Prediction
par: He, Renjie
Publié: (2026)
par: He, Renjie
Publié: (2026)
VPNeXt -- Rethinking Dense Decoding for Plain Vision Transformer
par: Tang, Xikai, et autres
Publié: (2025)
par: Tang, Xikai, et autres
Publié: (2025)
CLIPSelf: Vision Transformer Distills Itself for Open-Vocabulary Dense Prediction
par: Wu, Size, et autres
Publié: (2023)
par: Wu, Size, et autres
Publié: (2023)
MaterialSeg3D: Segmenting Dense Materials from 2D Priors for 3D Assets
par: Li, Zeyu, et autres
Publié: (2024)
par: Li, Zeyu, et autres
Publié: (2024)
The Power of Certainty: How Confident Models Lead to Better Segmentation
par: Erol, Tugberk, et autres
Publié: (2025)
par: Erol, Tugberk, et autres
Publié: (2025)
SHED Light on Segmentation for Dense Prediction
par: Lee, Seung Hyun, et autres
Publié: (2026)
par: Lee, Seung Hyun, et autres
Publié: (2026)
Revisiting Audio-Visual Segmentation with Vision-Centric Transformer
par: Huang, Shaofei, et autres
Publié: (2025)
par: Huang, Shaofei, et autres
Publié: (2025)
ViT-CoMer: Vision Transformer with Convolutional Multi-scale Feature Interaction for Dense Predictions
par: Xia, Chunlong, et autres
Publié: (2024)
par: Xia, Chunlong, et autres
Publié: (2024)
DenSe-AdViT: A novel Vision Transformer for Dense SAR Object Detection
par: Zhang, Yang, et autres
Publié: (2025)
par: Zhang, Yang, et autres
Publié: (2025)
Native Segmentation Vision Transformers
par: Brasó, Guillem, et autres
Publié: (2025)
par: Brasó, Guillem, et autres
Publié: (2025)
DSGG: Dense Relation Transformer for an End-to-end Scene Graph Generation
par: Hayder, Zeeshan, et autres
Publié: (2024)
par: Hayder, Zeeshan, et autres
Publié: (2024)
Weakly Supervised Food Image Segmentation using Vision Transformers and Segment Anything Model
par: Sarafis, Ioannis, et autres
Publié: (2025)
par: Sarafis, Ioannis, et autres
Publié: (2025)
Dino-NestedUNet: Unlocking Foundation Vision Encoders for Pathology Tumor Bulk Segmentation via Dense Decoding
par: Wang, Tianyang, et autres
Publié: (2026)
par: Wang, Tianyang, et autres
Publié: (2026)
Token-Space Mask Prediction for Efficient Vision Transformer Segmentation
par: Galagain, Calvin, et autres
Publié: (2026)
par: Galagain, Calvin, et autres
Publié: (2026)
Boundary-Aware Vision Transformer for Angiography Vascular Network Segmentation
par: Hezil, Nabil, et autres
Publié: (2025)
par: Hezil, Nabil, et autres
Publié: (2025)
SAMIDARE: Advanced Tracking-by-Segmentation for Dense Scenarios
par: Hirano, Shozaburo, et autres
Publié: (2026)
par: Hirano, Shozaburo, et autres
Publié: (2026)
Virtual Category Learning: A Semi-Supervised Learning Method for Dense Prediction with Extremely Limited Labels
par: Chen, Changrui, et autres
Publié: (2023)
par: Chen, Changrui, et autres
Publié: (2023)
DisentangleFormer: Spatial-Channel Decoupling for Multi-Channel Vision
par: Liao, Jiashu, et autres
Publié: (2025)
par: Liao, Jiashu, et autres
Publié: (2025)
Diff-Plugin: Revitalizing Details for Diffusion-based Low-level Tasks
par: Liu, Yuhao, et autres
Publié: (2024)
par: Liu, Yuhao, et autres
Publié: (2024)
DiCo: Revitalizing ConvNets for Scalable and Efficient Diffusion Modeling
par: Ai, Yuang, et autres
Publié: (2025)
par: Ai, Yuang, et autres
Publié: (2025)
Unified Review and Benchmark of Deep Segmentation Architectures for Cardiac Ultrasound on CAMUS
par: Ullah, Zahid, et autres
Publié: (2025)
par: Ullah, Zahid, et autres
Publié: (2025)
Neuromorphic Vision-based Motion Segmentation with Graph Transformer Neural Network
par: Alkendi, Yusra, et autres
Publié: (2024)
par: Alkendi, Yusra, et autres
Publié: (2024)
Self-Supervised Vision Transformers Are Efficient Segmentation Learners for Imperfect Labels
par: Lee, Seungho, et autres
Publié: (2024)
par: Lee, Seungho, et autres
Publié: (2024)
AViT: Adapting Vision Transformers for Small Skin Lesion Segmentation Datasets
par: Du, Siyi, et autres
Publié: (2023)
par: Du, Siyi, et autres
Publié: (2023)
Multi-Layer Dense Attention Decoder for Polyp Segmentation
par: Patel, Krushi, et autres
Publié: (2024)
par: Patel, Krushi, et autres
Publié: (2024)
Mitigating Data Redundancy to Revitalize Transformer-based Long-Term Time Series Forecasting System
par: Li, Mingjie, et autres
Publié: (2022)
par: Li, Mingjie, et autres
Publié: (2022)
DenseSeg: Joint Learning for Semantic Segmentation and Landmark Detection Using Dense Image-to-Shape Representation
par: Keuth, Ron, et autres
Publié: (2024)
par: Keuth, Ron, et autres
Publié: (2024)
DBAT: Dynamic Backward Attention Transformer for Material Segmentation with Cross-Resolution Patches
par: Heng, Yuwen, et autres
Publié: (2023)
par: Heng, Yuwen, et autres
Publié: (2023)
Memory Efficient Transformer Adapter for Dense Predictions
par: Zhang, Dong, et autres
Publié: (2025)
par: Zhang, Dong, et autres
Publié: (2025)
MMSFormer: Multimodal Transformer for Material and Semantic Segmentation
par: Reza, Md Kaykobad, et autres
Publié: (2023)
par: Reza, Md Kaykobad, et autres
Publié: (2023)
CroMo-Mixup: Augmenting Cross-Model Representations for Continual Self-Supervised Learning
par: Mushtaq, Erum, et autres
Publié: (2024)
par: Mushtaq, Erum, et autres
Publié: (2024)
PlankFormer: Robust Plankton Instance Segmentation via MAE-Pretrained Vision Transformers and Pseudo Community Image Generation
par: Miyazaki, Masaharu, et autres
Publié: (2026)
par: Miyazaki, Masaharu, et autres
Publié: (2026)
Forest2Seq: Revitalizing Order Prior for Sequential Indoor Scene Synthesis
par: Sun, Qi, et autres
Publié: (2024)
par: Sun, Qi, et autres
Publié: (2024)
Adapting Vision Transformers to Ultra-High Resolution Semantic Segmentation with Relay Tokens
par: Perron, Yohann, et autres
Publié: (2026)
par: Perron, Yohann, et autres
Publié: (2026)
PMT: Plain Mask Transformer for Image and Video Segmentation with Frozen Vision Encoders
par: Cavagnero, Niccolò, et autres
Publié: (2026)
par: Cavagnero, Niccolò, et autres
Publié: (2026)
WeakTr: Exploring Plain Vision Transformer for Weakly-supervised Semantic Segmentation
par: Zhu, Lianghui, et autres
Publié: (2023)
par: Zhu, Lianghui, et autres
Publié: (2023)
Documents similaires
-
Vision Transformers: From Semantic Segmentation to Dense Prediction
par: Zhang, Li, et autres
Publié: (2022) -
Quantization Robustness to Input Degradations for Object Detection
par: Karimov, Toghrul, et autres
Publié: (2025) -
Meissonic: Revitalizing Masked Generative Transformers for Efficient High-Resolution Text-to-Image Synthesis
par: Bai, Jinbin, et autres
Publié: (2024) -
Dense Vision Transformer Compression with Few Samples
par: Zhang, Hanxiao, et autres
Publié: (2024) -
RD-ViT: Recurrent-Depth Vision Transformer for Semantic Segmentation with Reduced Data Dependence Extending the Recurrent-Depth Transformer Architecture to Dense Prediction
par: He, Renjie
Publié: (2026)