Analyzing Local Representations of Self-supervised Vision Transformers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Vanyan, Ani, Barseghyan, Alvard, Tamazyan, Hakob, Huroyan, Vahan, Khachatrian, Hrant, Danelljan, Martin |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Do Satellite Tasks Need Special Pretraining?
par: Vanyan, Ani, et autres
Publié: (2025)
par: Vanyan, Ani, et autres
Publié: (2025)
GeoCrossBench: Cross-Band Generalization for Remote Sensing
par: Tamazyan, Hakob, et autres
Publié: (2025)
par: Tamazyan, Hakob, et autres
Publié: (2025)
Fusion of Pervasive RF Data with Spatial Images via Vision Transformers for Enhanced Mapping in Smart Cities
par: Mkrtchyan, Rafayel, et autres
Publié: (2025)
par: Mkrtchyan, Rafayel, et autres
Publié: (2025)
Vision Transformers for Efficient Indoor Pathloss Radio Map Prediction
par: Mkrtchyan, Rafayel, et autres
Publié: (2024)
par: Mkrtchyan, Rafayel, et autres
Publié: (2024)
LocalViT: Analyzing Locality in Vision Transformers
par: Li, Yawei, et autres
Publié: (2021)
par: Li, Yawei, et autres
Publié: (2021)
Efficient Self-supervised Vision Pretraining with Local Masked Reconstruction
par: Chen, Jun, et autres
Publié: (2022)
par: Chen, Jun, et autres
Publié: (2022)
Self-supervised Representation Learning with Local Aggregation for Image-based Profiling
par: Dai, Siran, et autres
Publié: (2025)
par: Dai, Siran, et autres
Publié: (2025)
Visualizing the loss landscape of Self-supervised Vision Transformer
par: Lee, Youngwan, et autres
Publié: (2024)
par: Lee, Youngwan, et autres
Publié: (2024)
Masked Modeling for Self-supervised Representation Learning on Vision and Beyond
par: Li, Siyuan, et autres
Publié: (2023)
par: Li, Siyuan, et autres
Publié: (2023)
PersonViT: Large-scale Self-supervised Vision Transformer for Person Re-Identification
par: Hu, Bin, et autres
Publié: (2024)
par: Hu, Bin, et autres
Publié: (2024)
Masked Diffusion as Self-supervised Representation Learner
par: Pan, Zixuan, et autres
Publié: (2023)
par: Pan, Zixuan, et autres
Publié: (2023)
Self-supervised Transformation Learning for Equivariant Representations
par: Yu, Jaemyung, et autres
Publié: (2025)
par: Yu, Jaemyung, et autres
Publié: (2025)
Boosting Generative Adversarial Transferability with Self-supervised Vision Transformer Features
par: Wu, Shangbo, et autres
Publié: (2025)
par: Wu, Shangbo, et autres
Publié: (2025)
Gaussian Grouping: Segment and Edit Anything in 3D Scenes
par: Ye, Mingqiao, et autres
Publié: (2023)
par: Ye, Mingqiao, et autres
Publié: (2023)
Constrained Multiview Representation for Self-supervised Contrastive Learning
par: Dai, Siyuan, et autres
Publié: (2024)
par: Dai, Siyuan, et autres
Publié: (2024)
DuoFormer: Leveraging Hierarchical Representations by Local and Global Attention Vision Transformer
par: Tang, Xiaoya, et autres
Publié: (2025)
par: Tang, Xiaoya, et autres
Publié: (2025)
Multi-modal Video Representation Alignment for Robust Self-supervised Driver Distraction Detection
par: Lerch, David J., et autres
Publié: (2026)
par: Lerch, David J., et autres
Publié: (2026)
Decoupling Common and Unique Representations for Multimodal Self-supervised Learning
par: Wang, Yi, et autres
Publié: (2023)
par: Wang, Yi, et autres
Publié: (2023)
Self-supervised Audiovisual Representation Learning for Remote Sensing Data
par: Heidler, Konrad, et autres
Publié: (2021)
par: Heidler, Konrad, et autres
Publié: (2021)
Collaboratively Self-supervised Video Representation Learning for Action Recognition
par: Zhang, Jie, et autres
Publié: (2024)
par: Zhang, Jie, et autres
Publié: (2024)
A Self-supervised Motion Representation for Portrait Video Generation
par: Zhang, Qiyuan, et autres
Publié: (2025)
par: Zhang, Qiyuan, et autres
Publié: (2025)
Exploring Structural Degradation in Dense Representations for Self-supervised Learning
par: Dai, Siran, et autres
Publié: (2025)
par: Dai, Siran, et autres
Publié: (2025)
PIV3CAMS: a multi-camera dataset for multiple computer vision problems and its application to novel view-point synthesis
par: Kim, Sohyeong, et autres
Publié: (2024)
par: Kim, Sohyeong, et autres
Publié: (2024)
Generalization of Self-Supervised Vision Transformers for Protein Localization Across Microscopy Domains
par: Isselmann, Ben, et autres
Publié: (2026)
par: Isselmann, Ben, et autres
Publié: (2026)
Calibrated Self-supervised Vision Transformers Improve Intracranial Arterial Calcification Segmentation from Clinical CT Head Scans
par: Jin, Benjamin, et autres
Publié: (2025)
par: Jin, Benjamin, et autres
Publié: (2025)
Self-supervised Photographic Image Layout Representation Learning
par: Zhao, Zhaoran, et autres
Publié: (2024)
par: Zhao, Zhaoran, et autres
Publié: (2024)
Human-like Object Grouping in Self-supervised Vision Transformers
par: Adeli, Hossein, et autres
Publié: (2026)
par: Adeli, Hossein, et autres
Publié: (2026)
Locality-Attending Vision Transformer
par: Hajimiri, Sina, et autres
Publié: (2026)
par: Hajimiri, Sina, et autres
Publié: (2026)
Return of Unconditional Generation: A Self-supervised Representation Generation Method
par: Li, Tianhong, et autres
Publié: (2023)
par: Li, Tianhong, et autres
Publié: (2023)
Self-supervised Learning of Dense Hierarchical Representations for Medical Image Segmentation
par: Kats, Eytan, et autres
Publié: (2024)
par: Kats, Eytan, et autres
Publié: (2024)
PSMamba: Progressive Self-supervised Vision Mamba for Plant Disease Recognition
par: Mamun, Abdullah Al, et autres
Publié: (2025)
par: Mamun, Abdullah Al, et autres
Publié: (2025)
Bootstrapping Vision-language Models for Self-supervised Remote Physiological Measurement
par: Yue, Zijie, et autres
Publié: (2024)
par: Yue, Zijie, et autres
Publié: (2024)
Revisit Self-supervised Depth Estimation with Local Structure-from-Motion
par: Zhu, Shengjie, et autres
Publié: (2024)
par: Zhu, Shengjie, et autres
Publié: (2024)
Depth-Wise Representation Development Under Blockwise Self-Supervised Learning for Video Vision Transformers
par: Römer, Jonas, et autres
Publié: (2026)
par: Römer, Jonas, et autres
Publié: (2026)
WeakTr: Exploring Plain Vision Transformer for Weakly-supervised Semantic Segmentation
par: Zhu, Lianghui, et autres
Publié: (2023)
par: Zhu, Lianghui, et autres
Publié: (2023)
Looking Locally: Object-Centric Vision Transformers as Foundation Models for Efficient Segmentation
par: Traub, Manuel, et autres
Publié: (2025)
par: Traub, Manuel, et autres
Publié: (2025)
Image Re-Identification: Where Self-supervision Meets Vision-Language Learning
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
TRivia: Self-supervised Fine-tuning of Vision-Language Models for Table Recognition
par: Zhang, Junyuan, et autres
Publié: (2025)
par: Zhang, Junyuan, et autres
Publié: (2025)
Detecting Lip-Syncing Deepfakes: Vision Temporal Transformer for Analyzing Mouth Inconsistencies
par: Datta, Soumyya Kanti, et autres
Publié: (2025)
par: Datta, Soumyya Kanti, et autres
Publié: (2025)
SOHES: Self-supervised Open-world Hierarchical Entity Segmentation
par: Cao, Shengcao, et autres
Publié: (2024)
par: Cao, Shengcao, et autres
Publié: (2024)
Documents similaires
-
Do Satellite Tasks Need Special Pretraining?
par: Vanyan, Ani, et autres
Publié: (2025) -
GeoCrossBench: Cross-Band Generalization for Remote Sensing
par: Tamazyan, Hakob, et autres
Publié: (2025) -
Fusion of Pervasive RF Data with Spatial Images via Vision Transformers for Enhanced Mapping in Smart Cities
par: Mkrtchyan, Rafayel, et autres
Publié: (2025) -
Vision Transformers for Efficient Indoor Pathloss Radio Map Prediction
par: Mkrtchyan, Rafayel, et autres
Publié: (2024) -
LocalViT: Analyzing Locality in Vision Transformers
par: Li, Yawei, et autres
Publié: (2021)