Enhancing Feature Diversity Boosts Channel-Adaptive Vision Transformers
Fuente:
arXiv
Salvato in:
| Autori principali: | Pham, Chau, Plummer, Bryan A. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ChA-MAEViT: Unifying Channel-Aware Masked Autoencoders and Multi-Channel Vision Transformers for Improved Cross-Channel Learning
di: Pham, Chau, et al.
Pubblicazione: (2025)
di: Pham, Chau, et al.
Pubblicazione: (2025)
Walk and Read Less: Improving the Efficiency of Vision-and-Language Navigation via Tuning-Free Multimodal Token Pruning
di: Qin, Wenda, et al.
Pubblicazione: (2025)
di: Qin, Wenda, et al.
Pubblicazione: (2025)
CAViT -- Channel-Aware Vision Transformer for Dynamic Feature Fusion
di: Safdar, Aon, et al.
Pubblicazione: (2026)
di: Safdar, Aon, et al.
Pubblicazione: (2026)
Boosting Medical Vision-Language Pretraining via Momentum Self-Distillation under Limited Computing Resources
di: Pham, Phuc, et al.
Pubblicazione: (2025)
di: Pham, Phuc, et al.
Pubblicazione: (2025)
AFFormer: Adaptive Feature Fusion Transformer for V2X Cooperative Perception under Channel Impairments
di: Zhou, Xi, et al.
Pubblicazione: (2026)
di: Zhou, Xi, et al.
Pubblicazione: (2026)
Proximal Vision Transformer: Enhancing Feature Representation through Two-Stage Manifold Geometry
di: Yun, Haoyu, et al.
Pubblicazione: (2025)
di: Yun, Haoyu, et al.
Pubblicazione: (2025)
Adaptive High-Frequency Transformer for Diverse Wildlife Re-Identification
di: Li, Chenyue, et al.
Pubblicazione: (2024)
di: Li, Chenyue, et al.
Pubblicazione: (2024)
Feature-Optimized Vision for Adaptive 3D Scene Reconstruction
di: Liang, Eric
Pubblicazione: (2026)
di: Liang, Eric
Pubblicazione: (2026)
Adaptive Layer Selection for Efficient Vision Transformer Fine-Tuning
di: Devoto, Alessio, et al.
Pubblicazione: (2024)
di: Devoto, Alessio, et al.
Pubblicazione: (2024)
AT-SNN: Adaptive Tokens for Vision Transformer on Spiking Neural Network
di: Kang, Donghwa, et al.
Pubblicazione: (2024)
di: Kang, Donghwa, et al.
Pubblicazione: (2024)
Towards Robust Vision Transformer via Masked Adaptive Ensemble
di: Lin, Fudong, et al.
Pubblicazione: (2024)
di: Lin, Fudong, et al.
Pubblicazione: (2024)
Vision Transformer-Conditioned UNet for Domain-Adaptive Semantic Segmentation
di: Ortega, Joel Valdivia, et al.
Pubblicazione: (2026)
di: Ortega, Joel Valdivia, et al.
Pubblicazione: (2026)
Nested-TNT: Hierarchical Vision Transformers with Multi-Scale Feature Processing
di: Liu, Yuang, et al.
Pubblicazione: (2024)
di: Liu, Yuang, et al.
Pubblicazione: (2024)
Unleashing Foundation Vision Models: Adaptive Transfer for Diverse Data-Limited Scientific Domains
di: Li, Qiankun, et al.
Pubblicazione: (2025)
di: Li, Qiankun, et al.
Pubblicazione: (2025)
Boosting 3D Neuron Segmentation with 2D Vision Transformer Pre-trained on Natural Images
di: Cheng, Yik San, et al.
Pubblicazione: (2024)
di: Cheng, Yik San, et al.
Pubblicazione: (2024)
Surformer v1: Transformer-Based Surface Classification Using Tactile and Vision Features
di: Kansana, Manish, et al.
Pubblicazione: (2025)
di: Kansana, Manish, et al.
Pubblicazione: (2025)
Accelerating Vision Transformers with Adaptive Patch Sizes
di: Choudhury, Rohan, et al.
Pubblicazione: (2025)
di: Choudhury, Rohan, et al.
Pubblicazione: (2025)
SlimSeiz: Efficient Channel-Adaptive Seizure Prediction Using a Mamba-Enhanced Network
di: Lu, Guorui, et al.
Pubblicazione: (2024)
di: Lu, Guorui, et al.
Pubblicazione: (2024)
Enhancing Breast Cancer Detection with Vision Transformers and Graph Neural Networks
di: Cai, Yeming, et al.
Pubblicazione: (2025)
di: Cai, Yeming, et al.
Pubblicazione: (2025)
Hierarchical Vision Transformer Enhanced by Graph Convolutional Network for Image Classification
di: Jiao, Haibin
Pubblicazione: (2026)
di: Jiao, Haibin
Pubblicazione: (2026)
Mull-Tokens: Modality-Agnostic Latent Thinking
di: Ray, Arijit, et al.
Pubblicazione: (2025)
di: Ray, Arijit, et al.
Pubblicazione: (2025)
GLoG-CSUnet: Enhancing Vision Transformers with Adaptable Radiomic Features for Medical Image Segmentation
di: Eghbali, Niloufar, et al.
Pubblicazione: (2025)
di: Eghbali, Niloufar, et al.
Pubblicazione: (2025)
Edge-Enhanced Vision Transformer Framework for Accurate AI-Generated Image Detection
di: Das, Dabbrata, et al.
Pubblicazione: (2025)
di: Das, Dabbrata, et al.
Pubblicazione: (2025)
LTCF-Net: A Transformer-Enhanced Dual-Channel Fourier Framework for Low-Light Image Restoration
di: Zhang, Gaojing, et al.
Pubblicazione: (2024)
di: Zhang, Gaojing, et al.
Pubblicazione: (2024)
Boosting Camera Motion Control for Video Diffusion Transformers
di: Cheong, Soon Yau, et al.
Pubblicazione: (2024)
di: Cheong, Soon Yau, et al.
Pubblicazione: (2024)
Single-Teacher View Augmentation: Boosting Knowledge Distillation via Angular Diversity
di: Yu, Seonghoon, et al.
Pubblicazione: (2025)
di: Yu, Seonghoon, et al.
Pubblicazione: (2025)
Improving Video Diffusion Transformer Training by Multi-Feature Fusion and Alignment from Self-Supervised Vision Encoders
di: Lee, Dohun, et al.
Pubblicazione: (2025)
di: Lee, Dohun, et al.
Pubblicazione: (2025)
EDIT: Enhancing Vision Transformers by Mitigating Attention Sink through an Encoder-Decoder Architecture
di: Feng, Wenfeng, et al.
Pubblicazione: (2025)
di: Feng, Wenfeng, et al.
Pubblicazione: (2025)
Adaptive Channel Allocation for Robust Differentiable Architecture Search
di: Li, Chao, et al.
Pubblicazione: (2022)
di: Li, Chao, et al.
Pubblicazione: (2022)
DRScaffold: Boosting Dense-Scene Reasoning in Lightweight Vision Language Models
di: Shi, Xinrui, et al.
Pubblicazione: (2026)
di: Shi, Xinrui, et al.
Pubblicazione: (2026)
EfficientFSL: Enhancing Few-Shot Classification via Query-Only Tuning in Vision Transformers
di: Liao, Wenwen, et al.
Pubblicazione: (2026)
di: Liao, Wenwen, et al.
Pubblicazione: (2026)
Benchmarking Unlearning for Vision Transformers
di: Zhao, Kairan, et al.
Pubblicazione: (2026)
di: Zhao, Kairan, et al.
Pubblicazione: (2026)
Vision Bridge Transformer at Scale
di: Tan, Zhenxiong, et al.
Pubblicazione: (2025)
di: Tan, Zhenxiong, et al.
Pubblicazione: (2025)
Causal Interpretation of Sparse Autoencoder Features in Vision
di: Han, Sangyu, et al.
Pubblicazione: (2025)
di: Han, Sangyu, et al.
Pubblicazione: (2025)
Adaptive Camera Sensor for Vision Models
di: Baek, Eunsu, et al.
Pubblicazione: (2025)
di: Baek, Eunsu, et al.
Pubblicazione: (2025)
Feature Learning with Multi-Stage Vision Transformers on Inter-Modality HER2 Status Scoring and Tumor Classification on Whole Slides
di: Oyelade, Olaide N., et al.
Pubblicazione: (2025)
di: Oyelade, Olaide N., et al.
Pubblicazione: (2025)
An Innovative Framework for Breast Cancer Detection Using Pyramid Adaptive Atrous Convolution, Transformer Integration, and Multi-Scale Feature Fusion
di: Pour, Ehsan Sadeghi, et al.
Pubblicazione: (2026)
di: Pour, Ehsan Sadeghi, et al.
Pubblicazione: (2026)
FGM-HD: Boosting Generation Diversity of Fractal Generative Models through Hausdorff Dimension Induction
di: Zhang, Haowei, et al.
Pubblicazione: (2025)
di: Zhang, Haowei, et al.
Pubblicazione: (2025)
Enhancing Few-Shot Vision-Language Classification with Large Multimodal Model Features
di: Mitra, Chancharik, et al.
Pubblicazione: (2024)
di: Mitra, Chancharik, et al.
Pubblicazione: (2024)
Case-Enhanced Vision Transformer: Improving Explanations of Image Similarity with a ViT-based Similarity Metric
di: Zhao, Ziwei, et al.
Pubblicazione: (2024)
di: Zhao, Ziwei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ChA-MAEViT: Unifying Channel-Aware Masked Autoencoders and Multi-Channel Vision Transformers for Improved Cross-Channel Learning
di: Pham, Chau, et al.
Pubblicazione: (2025) -
Walk and Read Less: Improving the Efficiency of Vision-and-Language Navigation via Tuning-Free Multimodal Token Pruning
di: Qin, Wenda, et al.
Pubblicazione: (2025) -
CAViT -- Channel-Aware Vision Transformer for Dynamic Feature Fusion
di: Safdar, Aon, et al.
Pubblicazione: (2026) -
Boosting Medical Vision-Language Pretraining via Momentum Self-Distillation under Limited Computing Resources
di: Pham, Phuc, et al.
Pubblicazione: (2025) -
AFFormer: Adaptive Feature Fusion Transformer for V2X Cooperative Perception under Channel Impairments
di: Zhou, Xi, et al.
Pubblicazione: (2026)