ChA-MAEViT: Unifying Channel-Aware Masked Autoencoders and Multi-Channel Vision Transformers for Improved Cross-Channel Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pham, Chau, Caicedo, Juan C., Plummer, Bryan A. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Feature Diversity Boosts Channel-Adaptive Vision Transformers
par: Pham, Chau, et autres
Publié: (2024)
par: Pham, Chau, et autres
Publié: (2024)
Isolated Channel Vision Transformers: From Single-Channel Pretraining to Multi-Channel Finetuning
par: Lian, Wenyi, et autres
Publié: (2025)
par: Lian, Wenyi, et autres
Publié: (2025)
DisentangleFormer: Spatial-Channel Decoupling for Multi-Channel Vision
par: Liao, Jiashu, et autres
Publié: (2025)
par: Liao, Jiashu, et autres
Publié: (2025)
Channel-Aware Probing for Multi-Channel Imaging
par: Marikkar, Umar, et autres
Publié: (2026)
par: Marikkar, Umar, et autres
Publié: (2026)
CHAMMI: A benchmark for channel-adaptive models in microscopy imaging
par: Chen, Zitong, et autres
Publié: (2023)
par: Chen, Zitong, et autres
Publié: (2023)
CAViT -- Channel-Aware Vision Transformer for Dynamic Feature Fusion
par: Safdar, Aon, et autres
Publié: (2026)
par: Safdar, Aon, et autres
Publié: (2026)
SCHEME: Scalable Channel Mixer for Vision Transformers
par: Sridhar, Deepak, et autres
Publié: (2023)
par: Sridhar, Deepak, et autres
Publié: (2023)
Multi-Channel Cross Modal Detection of Synthetic Face Images
par: Ibsen, M., et autres
Publié: (2023)
par: Ibsen, M., et autres
Publié: (2023)
Improving Masked Autoencoders by Learning Where to Mask
par: Chen, Haijian, et autres
Publié: (2023)
par: Chen, Haijian, et autres
Publié: (2023)
Mask-Guided Multi-Channel SwinUNETR Framework for Robust MRI Classification
par: Joshi, Smriti, et autres
Publié: (2025)
par: Joshi, Smriti, et autres
Publié: (2025)
DC-ViT: Modulating Spatial and Channel Interactions for Multi-Channel Images
par: Marikkar, Umar, et autres
Publié: (2026)
par: Marikkar, Umar, et autres
Publié: (2026)
ChWDTA: Channel-wise Wavelet-Domain Transformer Attention and Entropy Modeling for Learned Image Compression
par: Fu, Haisheng, et autres
Publié: (2026)
par: Fu, Haisheng, et autres
Publié: (2026)
ChAda-ViT : Channel Adaptive Attention for Joint Representation Learning of Heterogeneous Microscopy Images
par: Bourriez, Nicolas, et autres
Publié: (2023)
par: Bourriez, Nicolas, et autres
Publié: (2023)
CS-Mixer: A Cross-Scale Vision MLP Model with Spatial-Channel Mixing
par: Cui, Jonathan, et autres
Publié: (2023)
par: Cui, Jonathan, et autres
Publié: (2023)
Multimodal Transformer Using Cross-Channel attention for Object Detection in Remote Sensing Images
par: Bahaduri, Bissmella, et autres
Publié: (2023)
par: Bahaduri, Bissmella, et autres
Publié: (2023)
OU-CoViT: Copula-Enhanced Bi-Channel Multi-Task Vision Transformers with Dual Adaptation for OU-UWF Images
par: Li, Yang, et autres
Publié: (2024)
par: Li, Yang, et autres
Publié: (2024)
Sparse Mixture-of-Experts for Multi-Channel Imaging: Are All Channel Interactions Required?
par: Yun, Sukwon, et autres
Publié: (2025)
par: Yun, Sukwon, et autres
Publié: (2025)
Decompose, Mix, Adapt: A Unified Framework for Parameter-Efficient Neural Network Recombination and Compression
par: Tasnim, Nazia, et autres
Publié: (2026)
par: Tasnim, Nazia, et autres
Publié: (2026)
SC-Net: Robust Correspondence Learning via Spatial and Cross-Channel Context
par: Lin, Shuyuan, et autres
Publié: (2025)
par: Lin, Shuyuan, et autres
Publié: (2025)
Text-Guided Channel Perturbation and Pretrained Knowledge Integration for Unified Multi-Modality Image Fusion
par: Li, Xilai, et autres
Publié: (2025)
par: Li, Xilai, et autres
Publié: (2025)
IMTS is Worth Time $\times$ Channel Patches: Visual Masked Autoencoders for Irregular Multivariate Time Series Prediction
par: Hu, Zhangyi, et autres
Publié: (2025)
par: Hu, Zhangyi, et autres
Publié: (2025)
Learning Adaptive Lighting via Channel-Aware Guidance
par: Yang, Qirui, et autres
Publié: (2024)
par: Yang, Qirui, et autres
Publié: (2024)
LNL+K: Enhancing Learning with Noisy Labels Through Noise Source Knowledge Integration
par: Wang, Siqi, et autres
Publié: (2023)
par: Wang, Siqi, et autres
Publié: (2023)
Spectral Complex Autoencoder Pruning: A Fidelity-Guided Criterion for Extreme Structured Channel Compression
par: Liu, Wei, et autres
Publié: (2026)
par: Liu, Wei, et autres
Publié: (2026)
Chanel-Orderer: A Channel-Ordering Predictor for Tri-Channel Natural Images
par: Li, Shen, et autres
Publié: (2024)
par: Li, Shen, et autres
Publié: (2024)
Cross-view Masked Diffusion Transformers for Person Image Synthesis
par: Pham, Trung X., et autres
Publié: (2024)
par: Pham, Trung X., et autres
Publié: (2024)
UniGeo: A Unified 3D Indoor Object Detection Framework Integrating Geometry-Aware Learning and Dynamic Channel Gating
par: Yi, Xing, et autres
Publié: (2026)
par: Yi, Xing, et autres
Publié: (2026)
Transformer-based RGB-T Tracking with Channel and Spatial Feature Fusion
par: Li, Yunfeng, et autres
Publié: (2024)
par: Li, Yunfeng, et autres
Publié: (2024)
CT3D++: Improving 3D Object Detection with Keypoint-induced Channel-wise Transformer
par: Sheng, Hualian, et autres
Publié: (2024)
par: Sheng, Hualian, et autres
Publié: (2024)
Contrastive Masked Autoencoders are Stronger Vision Learners
par: Huang, Zhicheng, et autres
Publié: (2022)
par: Huang, Zhicheng, et autres
Publié: (2022)
Learning Channel Importance for High Content Imaging with Interpretable Deep Input Channel Mixing
par: Siegismund, Daniel, et autres
Publié: (2023)
par: Siegismund, Daniel, et autres
Publié: (2023)
Enhancing Virtual Try-On with Synthetic Pairs and Error-Aware Noise Scheduling
par: Li, Nannan, et autres
Publié: (2025)
par: Li, Nannan, et autres
Publié: (2025)
Walk and Read Less: Improving the Efficiency of Vision-and-Language Navigation via Tuning-Free Multimodal Token Pruning
par: Qin, Wenda, et autres
Publié: (2025)
par: Qin, Wenda, et autres
Publié: (2025)
TSRE: Channel-Aware Typical Set Refinement for Out-of-Distribution Detection
par: Gao, Weijun, et autres
Publié: (2025)
par: Gao, Weijun, et autres
Publié: (2025)
CAST: Channel-Aware Spatial Transfer Learning with Pseudo-Image Radar for Sign Language Recognition
par: Shujon, Md. Shakhoyat Rahman, et autres
Publié: (2026)
par: Shujon, Md. Shakhoyat Rahman, et autres
Publié: (2026)
Web Artifact Attacks Disrupt Vision Language Models
par: Qraitem, Maan, et autres
Publié: (2025)
par: Qraitem, Maan, et autres
Publié: (2025)
ParFormer: A Vision Transformer with Parallel Mixer and Sparse Channel Attention Patch Embedding
par: Setyawan, Novendra, et autres
Publié: (2024)
par: Setyawan, Novendra, et autres
Publié: (2024)
Masked Angle-Aware Autoencoder for Remote Sensing Images
par: Li, Zhihao, et autres
Publié: (2024)
par: Li, Zhihao, et autres
Publié: (2024)
VAMAE: Vessel-Aware Masked Autoencoders for OCT Angiography
par: Abolade, Ilerioluwakiiye, et autres
Publié: (2026)
par: Abolade, Ilerioluwakiiye, et autres
Publié: (2026)
HyperVision: A Channel-Adaptive Ground-Based Hyperspectral Vision Pre-trained Backbone
par: Fu, Guanyiman, et autres
Publié: (2026)
par: Fu, Guanyiman, et autres
Publié: (2026)
Documents similaires
-
Enhancing Feature Diversity Boosts Channel-Adaptive Vision Transformers
par: Pham, Chau, et autres
Publié: (2024) -
Isolated Channel Vision Transformers: From Single-Channel Pretraining to Multi-Channel Finetuning
par: Lian, Wenyi, et autres
Publié: (2025) -
DisentangleFormer: Spatial-Channel Decoupling for Multi-Channel Vision
par: Liao, Jiashu, et autres
Publié: (2025) -
Channel-Aware Probing for Multi-Channel Imaging
par: Marikkar, Umar, et autres
Publié: (2026) -
CHAMMI: A benchmark for channel-adaptive models in microscopy imaging
par: Chen, Zitong, et autres
Publié: (2023)