NiNformer: A Network in Network Transformer with Token Mixing Generated Gating Function
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Abdullah, Abdullah Nazhat, Aydin, Tarkan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Activator: GLU Activation Function as the Core Component of a Vision Transformer
par: Abdullah, Abdullah Nazhat, et autres
Publié: (2024)
par: Abdullah, Abdullah Nazhat, et autres
Publié: (2024)
VLM-KG: Multimodal Radiology Knowledge Graph Generation
par: Abdullah, Abdullah, et autres
Publié: (2025)
par: Abdullah, Abdullah, et autres
Publié: (2025)
Convolutional Differentiable Logic Gate Networks
par: Petersen, Felix, et autres
Publié: (2024)
par: Petersen, Felix, et autres
Publié: (2024)
Transformer-Based Contrastive Meta-Learning For Low-Resource Generalizable Activity Recognition
par: Wang, Junyao, et autres
Publié: (2024)
par: Wang, Junyao, et autres
Publié: (2024)
A Real-time Face Mask Detection and Social Distancing System for COVID-19 using Attention-InceptionV3 Model
par: Asif, Abdullah Al, et autres
Publié: (2024)
par: Asif, Abdullah Al, et autres
Publié: (2024)
Quantum Machine Learning for Image Classification: A Hybrid Model of Residual Network with Quantum Support Vector Machine
par: Shahriyar, Md. Farhan, et autres
Publié: (2025)
par: Shahriyar, Md. Farhan, et autres
Publié: (2025)
Quanvolutional Neural Networks for Pneumonia Detection: An Efficient Quantum-Assisted Feature Extraction Paradigm
par: Tanbhir, Gazi, et autres
Publié: (2025)
par: Tanbhir, Gazi, et autres
Publié: (2025)
Metric Unreliability in Multimodal Machine Unlearning: A Systematic Analysis and Principled Unified Score
par: Khan, Abdullah Ahmad, et autres
Publié: (2026)
par: Khan, Abdullah Ahmad, et autres
Publié: (2026)
TransformMix: Learning Transformation and Mixing Strategies from Data
par: Cheung, Tsz-Him, et autres
Publié: (2024)
par: Cheung, Tsz-Him, et autres
Publié: (2024)
UKBOB: One Billion MRI Labeled Masks for Generalizable 3D Medical Image Segmentation
par: Bourigault, Emmanuelle, et autres
Publié: (2025)
par: Bourigault, Emmanuelle, et autres
Publié: (2025)
BanglaMM-Disaster: A Multimodal Transformer-Based Deep Learning Framework for Multiclass Disaster Classification in Bangla
par: Islam, Ariful, et autres
Publié: (2025)
par: Islam, Ariful, et autres
Publié: (2025)
Zero-Shot Action Generalization with Limited Observations
par: Alchihabi, Abdullah, et autres
Publié: (2025)
par: Alchihabi, Abdullah, et autres
Publié: (2025)
DualSwinFusionSeg: Multimodal Martian Landslide Segmentation via Dual Swin Transformer with Multi-Scale Fusion and UNet++
par: Kabir, Shahriar, et autres
Publié: (2026)
par: Kabir, Shahriar, et autres
Publié: (2026)
MADFormer: Mixed Autoregressive and Diffusion Transformers for Continuous Image Generation
par: Chen, Junhao, et autres
Publié: (2025)
par: Chen, Junhao, et autres
Publié: (2025)
Token Caching for Diffusion Transformer Acceleration
par: Lou, Jinming, et autres
Publié: (2024)
par: Lou, Jinming, et autres
Publié: (2024)
SFC-GAN: A Generative Adversarial Network for Brain Functional and Structural Connectome Translation
par: Tan, Yee-Fan, et autres
Publié: (2025)
par: Tan, Yee-Fan, et autres
Publié: (2025)
AR-GAN: Generative Adversarial Network-Based Defense Method Against Adversarial Attacks on the Traffic Sign Classification System of Autonomous Vehicles
par: Salek, M Sabbir, et autres
Publié: (2023)
par: Salek, M Sabbir, et autres
Publié: (2023)
Leveraging Transformers for Weakly Supervised Object Localization in Unconstrained Videos
par: Murtaza, Shakeeb, et autres
Publié: (2024)
par: Murtaza, Shakeeb, et autres
Publié: (2024)
SugarcaneShuffleNet: A Very Fast, Lightweight Convolutional Neural Network for Diagnosis of 15 Sugarcane Leaf Diseases
par: Arman, Shifat E., et autres
Publié: (2025)
par: Arman, Shifat E., et autres
Publié: (2025)
Efficient Visual Transformer by Learnable Token Merging
par: Wang, Yancheng, et autres
Publié: (2024)
par: Wang, Yancheng, et autres
Publié: (2024)
SPoT: Subpixel Placement of Tokens in Vision Transformers
par: Hjelkrem-Tan, Martine, et autres
Publié: (2025)
par: Hjelkrem-Tan, Martine, et autres
Publié: (2025)
MosquitoFusion: A Multiclass Dataset for Real-Time Detection of Mosquitoes, Swarms, and Breeding Sites Using Deep Learning
par: Sayeedi, Md. Faiyaz Abdullah, et autres
Publié: (2024)
par: Sayeedi, Md. Faiyaz Abdullah, et autres
Publié: (2024)
ABFR-KAN: Kolmogorov-Arnold Networks for Functional Brain Analysis
par: Ward, Tyler, et autres
Publié: (2026)
par: Ward, Tyler, et autres
Publié: (2026)
Uncertainty-Aware Token Importance Estimation in Spiking Transformers
par: Liu, Wenxuan, et autres
Publié: (2026)
par: Liu, Wenxuan, et autres
Publié: (2026)
AdaPerceiver: Transformers with Adaptive Width, Depth, and Tokens
par: Jajal, Purvish, et autres
Publié: (2025)
par: Jajal, Purvish, et autres
Publié: (2025)
Tokenizing Buildings: A Transformer for Layout Synthesis
par: de Guevara, Manuel Ladron, et autres
Publié: (2025)
par: de Guevara, Manuel Ladron, et autres
Publié: (2025)
Capsule Endoscopy Multi-classification via Gated Attention and Wavelet Transformations
par: Panchananam, Lakshmi Srinivas, et autres
Publié: (2024)
par: Panchananam, Lakshmi Srinivas, et autres
Publié: (2024)
SPAQ-DL-SLAM: Towards Optimizing Deep Learning-based SLAM for Resource-Constrained Embedded Platforms
par: Pudasaini, Niraj, et autres
Publié: (2024)
par: Pudasaini, Niraj, et autres
Publié: (2024)
Fractional Concepts in Neural Networks: Enhancing Activation Functions
par: Alijani, Zahra, et autres
Publié: (2023)
par: Alijani, Zahra, et autres
Publié: (2023)
Calibrating Bayesian UNet++ for Sub-Seasonal Forecasting
par: Asan, Busra, et autres
Publié: (2024)
par: Asan, Busra, et autres
Publié: (2024)
ShrinkBox: Backdoor Attack on Object Detection to Disrupt Collision Avoidance in Machine Learning-based Advanced Driver Assistance Systems
par: Shahzad, Muhammad Zaeem, et autres
Publié: (2025)
par: Shahzad, Muhammad Zaeem, et autres
Publié: (2025)
SATA: Spatial Autocorrelation Token Analysis for Enhancing the Robustness of Vision Transformers
par: Nikzad, Nick, et autres
Publié: (2024)
par: Nikzad, Nick, et autres
Publié: (2024)
Don't Look Twice: Faster Video Transformers with Run-Length Tokenization
par: Choudhury, Rohan, et autres
Publié: (2024)
par: Choudhury, Rohan, et autres
Publié: (2024)
Hybrid Spiking Neural Network -- Transformer Video Classification Model
par: Bateni, Aaron
Publié: (2024)
par: Bateni, Aaron
Publié: (2024)
VibeToken: Scaling 1D Image Tokenizers and Autoregressive Models for Dynamic Resolution Generations
par: Patel, Maitreya, et autres
Publié: (2026)
par: Patel, Maitreya, et autres
Publié: (2026)
Efficient and Effective Methods for Mixed Precision Neural Network Quantization for Faster, Energy-efficient Inference
par: Bablani, Deepika, et autres
Publié: (2023)
par: Bablani, Deepika, et autres
Publié: (2023)
ArcGate: Adaptive Arctangent Gated Activation
par: Bhattacharya, Avik, et autres
Publié: (2026)
par: Bhattacharya, Avik, et autres
Publié: (2026)
Convolutional Neural Networks and Vision Transformers for Fashion MNIST Classification: A Literature Review
par: Bbouzidi, Sonia, et autres
Publié: (2024)
par: Bbouzidi, Sonia, et autres
Publié: (2024)
A Novel Shape Guided Transformer Network for Instance Segmentation in Remote Sensing Images
par: Yu, Dawen, et autres
Publié: (2024)
par: Yu, Dawen, et autres
Publié: (2024)
A General and Efficient Training for Transformer via Token Expansion
par: Huang, Wenxuan, et autres
Publié: (2024)
par: Huang, Wenxuan, et autres
Publié: (2024)
Documents similaires
-
Activator: GLU Activation Function as the Core Component of a Vision Transformer
par: Abdullah, Abdullah Nazhat, et autres
Publié: (2024) -
VLM-KG: Multimodal Radiology Knowledge Graph Generation
par: Abdullah, Abdullah, et autres
Publié: (2025) -
Convolutional Differentiable Logic Gate Networks
par: Petersen, Felix, et autres
Publié: (2024) -
Transformer-Based Contrastive Meta-Learning For Low-Resource Generalizable Activity Recognition
par: Wang, Junyao, et autres
Publié: (2024) -
A Real-time Face Mask Detection and Social Distancing System for COVID-19 using Attention-InceptionV3 Model
par: Asif, Abdullah Al, et autres
Publié: (2024)