TransNeXt: Robust Foveal Visual Perception for Vision Transformers
Fuente:
arXiv
Guardado en:
| Autor principal: | Shi, Dai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EmoNeXt: an Adapted ConvNeXt for Facial Emotion Recognition
por: Boudouri, Yassine El, et al.
Publicado: (2025)
por: Boudouri, Yassine El, et al.
Publicado: (2025)
CoAtNeXt:An Attention-Enhanced ConvNeXtV2-Transformer Hybrid Model for Gastric Tissue Classification
por: Yurdakul, Mustafa, et al.
Publicado: (2025)
por: Yurdakul, Mustafa, et al.
Publicado: (2025)
InceptionNeXt: When Inception Meets ConvNeXt
por: Yu, Weihao, et al.
Publicado: (2023)
por: Yu, Weihao, et al.
Publicado: (2023)
Ensemble of radiomics and ConvNeXt for breast cancer diagnosis
por: Garza-Abdala, Jorge Alberto, et al.
Publicado: (2026)
por: Garza-Abdala, Jorge Alberto, et al.
Publicado: (2026)
FourCastNeXt: Optimizing FourCastNet Training for Limited Compute
por: Guo, Edison, et al.
Publicado: (2024)
por: Guo, Edison, et al.
Publicado: (2024)
Reviving ConvNeXt for Efficient Convolutional Diffusion Models
por: Kwon, Taesung, et al.
Publicado: (2026)
por: Kwon, Taesung, et al.
Publicado: (2026)
Deep Learning-Based Rock Particulate Classification Using Attention-Enhanced ConvNeXt
por: Amankwah, Anthony, et al.
Publicado: (2025)
por: Amankwah, Anthony, et al.
Publicado: (2025)
Enhancing kelp forest detection in remote sensing images using crowdsourced labels with Mixed Vision Transformers and ConvNeXt segmentation models
por: Nasios, Ioannis
Publicado: (2025)
por: Nasios, Ioannis
Publicado: (2025)
MambaNeXt-YOLO: A Hybrid State Space Model for Real-time Object Detection
por: Lei, Xiaochun, et al.
Publicado: (2025)
por: Lei, Xiaochun, et al.
Publicado: (2025)
Multi-encoder ConvNeXt Network with Smooth Attentional Feature Fusion for Multispectral Semantic Segmentation
por: Ramos, Leo Thomas, et al.
Publicado: (2026)
por: Ramos, Leo Thomas, et al.
Publicado: (2026)
MedNet-PVS: A MedNeXt-Based Deep Learning Model for Automated Segmentation of Perivascular Spaces
por: Low, Zhen Xuen Brandon, et al.
Publicado: (2025)
por: Low, Zhen Xuen Brandon, et al.
Publicado: (2025)
SAFER-AiD: Saccade-Assisted Foveal-peripheral vision Enhanced Reconstruction for Adversarial Defense
por: Liu, Jiayang, et al.
Publicado: (2025)
por: Liu, Jiayang, et al.
Publicado: (2025)
VLANeXt: Recipes for Building Strong VLA Models
por: Wu, Xiao-Ming, et al.
Publicado: (2026)
por: Wu, Xiao-Ming, et al.
Publicado: (2026)
FovealNet: Advancing AI-Driven Gaze Tracking Solutions for Optimized Foveated Rendering System Performance in Virtual Reality
por: Liu, Wenxuan, et al.
Publicado: (2024)
por: Liu, Wenxuan, et al.
Publicado: (2024)
3D Motion Perception of Binocular Vision Target with PID-CNN
por: Shi, Jiazhao, et al.
Publicado: (2025)
por: Shi, Jiazhao, et al.
Publicado: (2025)
EVCC: Enhanced Vision Transformer-ConvNeXt-CoAtNet Fusion for Classification
por: Hasan, Kazi Reyazul, et al.
Publicado: (2025)
por: Hasan, Kazi Reyazul, et al.
Publicado: (2025)
Beyond the Doors of Perception: Vision Transformers Represent Relations Between Objects
por: Lepori, Michael A., et al.
Publicado: (2024)
por: Lepori, Michael A., et al.
Publicado: (2024)
NeRFDeformer: NeRF Transformation from a Single View via 3D Scene Flows
por: Tang, Zhenggang, et al.
Publicado: (2024)
por: Tang, Zhenggang, et al.
Publicado: (2024)
VisionCoach: Reinforcing Grounded Video Reasoning via Visual-Perception Prompting
por: Lee, Daeun, et al.
Publicado: (2026)
por: Lee, Daeun, et al.
Publicado: (2026)
GranViT: A Fine-Grained Vision Model With Autoregressive Perception For MLLMs
por: Zheng, Guanghao, et al.
Publicado: (2025)
por: Zheng, Guanghao, et al.
Publicado: (2025)
MicroCrackAttentionNeXt: Advancing Microcrack Detection in Wave Field Analysis Using Deep Neural Networks through Feature Visualization
por: Moreh, Fatahlla, et al.
Publicado: (2024)
por: Moreh, Fatahlla, et al.
Publicado: (2024)
SPARO: Selective Attention for Robust and Compositional Transformer Encodings for Vision
por: Vani, Ankit, et al.
Publicado: (2024)
por: Vani, Ankit, et al.
Publicado: (2024)
Towards Robust Vision Transformer via Masked Adaptive Ensemble
por: Lin, Fudong, et al.
Publicado: (2024)
por: Lin, Fudong, et al.
Publicado: (2024)
VisionFoundry: Teaching VLMs Visual Perception with Synthetic Images
por: Zhou, Guanyu, et al.
Publicado: (2026)
por: Zhou, Guanyu, et al.
Publicado: (2026)
Integrating ConvNeXt and Vision Transformers for Enhancing Facial Age Estimation
por: Maroun, Gaby, et al.
Publicado: (2025)
por: Maroun, Gaby, et al.
Publicado: (2025)
Perception Before Reasoning: Two-Stage Reinforcement Learning for Visual Reasoning in Vision-Language Models
por: Chen, Yan, et al.
Publicado: (2025)
por: Chen, Yan, et al.
Publicado: (2025)
Understanding Graphical Perception in Data Visualization through Zero-shot Prompting of Vision-Language Models
por: Guo, Grace, et al.
Publicado: (2024)
por: Guo, Grace, et al.
Publicado: (2024)
LiteNeXt: A Novel Lightweight ConvMixer-based Model with Self-embedding Representation Parallel for Medical Image Segmentation
por: Tran, Ngoc-Du, et al.
Publicado: (2024)
por: Tran, Ngoc-Du, et al.
Publicado: (2024)
Linear Differential Vision Transformer: Learning Visual Contrasts via Pairwise Differentials
por: Pu, Yifan, et al.
Publicado: (2025)
por: Pu, Yifan, et al.
Publicado: (2025)
Attention Guided CAM: Visual Explanations of Vision Transformer Guided by Self-Attention
por: Leem, Saebom, et al.
Publicado: (2024)
por: Leem, Saebom, et al.
Publicado: (2024)
Two-stage Vision Transformers and Hard Masking offer Robust Object Representations
por: Aniraj, Ananthu, et al.
Publicado: (2025)
por: Aniraj, Ananthu, et al.
Publicado: (2025)
StrokeNeXt: A Siamese-encoder Approach for Brain Stroke Classification in Computed Tomography Imagery
por: Ramos, Leo Thomas, et al.
Publicado: (2026)
por: Ramos, Leo Thomas, et al.
Publicado: (2026)
UI-Vision: A Desktop-centric GUI Benchmark for Visual Perception and Interaction
por: Nayak, Shravan, et al.
Publicado: (2025)
por: Nayak, Shravan, et al.
Publicado: (2025)
MVP-Bench: Can Large Vision--Language Models Conduct Multi-level Visual Perception Like Humans?
por: Li, Guanzhen, et al.
Publicado: (2024)
por: Li, Guanzhen, et al.
Publicado: (2024)
LangXAI: Integrating Large Vision Models for Generating Textual Explanations to Enhance Explainability in Visual Perception Tasks
por: Nguyen, Truong Thanh Hung, et al.
Publicado: (2024)
por: Nguyen, Truong Thanh Hung, et al.
Publicado: (2024)
DinoTwins: Combining DINO and Barlow Twins for Robust, Label-Efficient Vision Transformers
por: Podsiadly, Michael, et al.
Publicado: (2025)
por: Podsiadly, Michael, et al.
Publicado: (2025)
Reinforced Embodied Active Defense: Exploiting Adaptive Interaction for Robust Visual Perception in Adversarial 3D Environments
por: Yang, Xiao, et al.
Publicado: (2025)
por: Yang, Xiao, et al.
Publicado: (2025)
MedNeXt-v2: Scaling 3D ConvNeXts for Large-Scale Supervised Representation Learning in Medical Image Segmentation
por: Roy, Saikat, et al.
Publicado: (2025)
por: Roy, Saikat, et al.
Publicado: (2025)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
por: Li, Ao, et al.
Publicado: (2025)
por: Li, Ao, et al.
Publicado: (2025)
SenseBench: A Benchmark for Remote Sensing Low-Level Visual Perception and Description in Large Vision-Language Models
por: Zhong, Chen, et al.
Publicado: (2026)
por: Zhong, Chen, et al.
Publicado: (2026)
Ejemplares similares
-
EmoNeXt: an Adapted ConvNeXt for Facial Emotion Recognition
por: Boudouri, Yassine El, et al.
Publicado: (2025) -
CoAtNeXt:An Attention-Enhanced ConvNeXtV2-Transformer Hybrid Model for Gastric Tissue Classification
por: Yurdakul, Mustafa, et al.
Publicado: (2025) -
InceptionNeXt: When Inception Meets ConvNeXt
por: Yu, Weihao, et al.
Publicado: (2023) -
Ensemble of radiomics and ConvNeXt for breast cancer diagnosis
por: Garza-Abdala, Jorge Alberto, et al.
Publicado: (2026) -
FourCastNeXt: Optimizing FourCastNet Training for Limited Compute
por: Guo, Edison, et al.
Publicado: (2024)