Compact and Efficient Neural Networks for Image Recognition Based on Learned 2D Separable Transform
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Vashkevich, Maxim, Krivalcevich, Egor |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ViTNF: Leveraging Neural Fields to Boost Vision Transformers in Generalized Category Discovery
par: Su, Jiayi, et autres
Publié: (2025)
par: Su, Jiayi, et autres
Publié: (2025)
Co-Training with Active Contrastive Learning and Meta-Pseudo-Labeling on 2D Projections for Deep Semi-Supervised Learning
par: Aparco-Cardenas, David, et autres
Publié: (2025)
par: Aparco-Cardenas, David, et autres
Publié: (2025)
Neural Encoding for Image Recall: Human-Like Memory
par: Foussereau, Virgile, et autres
Publié: (2024)
par: Foussereau, Virgile, et autres
Publié: (2024)
The Normalized Difference Layer: A Differentiable Spectral Index Formulation for Deep Learning
par: Lotfi, Ali, et autres
Publié: (2026)
par: Lotfi, Ali, et autres
Publié: (2026)
Understanding Generalization, Robustness, and Interpretability in Low-Capacity Neural Networks
par: Kumar, Yash
Publié: (2025)
par: Kumar, Yash
Publié: (2025)
TGraphX: Tensor-Aware Graph Neural Network for Multi-Dimensional Feature Learning
par: Sajjadi, Arash, et autres
Publié: (2025)
par: Sajjadi, Arash, et autres
Publié: (2025)
Predictive Modeling of Maritime Radar Data Using Transformer Architecture
par: Qesaraku, Bjorna, et autres
Publié: (2025)
par: Qesaraku, Bjorna, et autres
Publié: (2025)
Leveraging large multimodal models for audio-video deepfake detection: a pilot study
par: Cao, Songjun, et autres
Publié: (2026)
par: Cao, Songjun, et autres
Publié: (2026)
Optimized Gradient Clipping for Noisy Label Learning
par: Ye, Xichen, et autres
Publié: (2024)
par: Ye, Xichen, et autres
Publié: (2024)
Archival Faces: Detection of Faces in Digitized Historical Documents
par: Vaško, Marek, et autres
Publié: (2025)
par: Vaško, Marek, et autres
Publié: (2025)
RoNFA: Robust Neural Field-based Approach for Few-Shot Image Classification with Noisy Labels
par: Xiang, Nan, et autres
Publié: (2025)
par: Xiang, Nan, et autres
Publié: (2025)
Machine Unlearning for Class Removal through SISA-based Deep Neural Network Architectures
par: Mahi, Ishrak Hamim, et autres
Publié: (2026)
par: Mahi, Ishrak Hamim, et autres
Publié: (2026)
Scene Detection Policies and Keyframe Extraction Strategies for Large-Scale Video Analysis
par: Korolkov, Vasilii
Publié: (2025)
par: Korolkov, Vasilii
Publié: (2025)
Kolmogorov-Arnold Attention: Is Learnable Attention Better For Vision Transformers?
par: Maity, Subhajit, et autres
Publié: (2025)
par: Maity, Subhajit, et autres
Publié: (2025)
Wafer Map Defect Classification Using Autoencoder-Based Data Augmentation and Convolutional Neural Network
par: Bao, Yin-Yin, et autres
Publié: (2024)
par: Bao, Yin-Yin, et autres
Publié: (2024)
Few-Class Arena: A Benchmark for Efficient Selection of Vision Models and Dataset Difficulty Measurement
par: Cao, Bryan Bo, et autres
Publié: (2024)
par: Cao, Bryan Bo, et autres
Publié: (2024)
Which Transformer to Favor: A Comparative Analysis of Efficiency in Vision Transformers
par: Nauen, Tobias Christian, et autres
Publié: (2023)
par: Nauen, Tobias Christian, et autres
Publié: (2023)
A deep learning approach to track eye movements based on events
par: Seth, Chirag, et autres
Publié: (2025)
par: Seth, Chirag, et autres
Publié: (2025)
Towards understanding how attention mechanism works in deep learning
par: Ruan, Tianyu, et autres
Publié: (2024)
par: Ruan, Tianyu, et autres
Publié: (2024)
StatsMerging: Statistics-Guided Model Merging via Task-Specific Teacher Distillation
par: Merugu, Ranjith, et autres
Publié: (2025)
par: Merugu, Ranjith, et autres
Publié: (2025)
Hierarchical Point-Patch Fusion with Adaptive Patch Codebook for 3D Shape Anomaly Detection
par: Kang, Xueyang, et autres
Publié: (2026)
par: Kang, Xueyang, et autres
Publié: (2026)
Optimizing Inference in Transformer-Based Models: A Multi-Method Benchmark
par: Ho, Siu Hang, et autres
Publié: (2025)
par: Ho, Siu Hang, et autres
Publié: (2025)
Divergence-Based Similarity Function for Multi-View Contrastive Learning
par: Jeon, Jae Hyoung, et autres
Publié: (2025)
par: Jeon, Jae Hyoung, et autres
Publié: (2025)
Cross-Architecture Knowledge Distillation (KD) for Retinal Fundus Image Anomaly Detection on NVIDIA Jetson Nano
par: Yilmaz, Berk, et autres
Publié: (2025)
par: Yilmaz, Berk, et autres
Publié: (2025)
WildfireVLM: AI-powered Analysis for Early Wildfire Detection and Risk Assessment Using Satellite Imagery
par: Ayanzadeh, Aydin, et autres
Publié: (2026)
par: Ayanzadeh, Aydin, et autres
Publié: (2026)
Explicit Dropout: Deterministic Regularization for Transformer Architectures
par: Agrawal, Vidhi, et autres
Publié: (2026)
par: Agrawal, Vidhi, et autres
Publié: (2026)
DeepDRK: Deep Dependency Regularized Knockoff for Feature Selection
par: Shen, Hongyu, et autres
Publié: (2024)
par: Shen, Hongyu, et autres
Publié: (2024)
Supervised deep learning of elastic SRV distances on the shape space of curves
par: Hartman, Emmanuel, et autres
Publié: (2021)
par: Hartman, Emmanuel, et autres
Publié: (2021)
Revisiting Energy-Based Model for Out-of-Distribution Detection
par: Wu, Yifan, et autres
Publié: (2024)
par: Wu, Yifan, et autres
Publié: (2024)
Objaverse++: Curated 3D Object Dataset with Quality Annotations
par: Lin, Chendi, et autres
Publié: (2025)
par: Lin, Chendi, et autres
Publié: (2025)
Rethinking Visual Intelligence: Insights from Video Pretraining
par: Acuaviva, Pablo, et autres
Publié: (2025)
par: Acuaviva, Pablo, et autres
Publié: (2025)
CAFCT-Net: A CNN-Transformer Hybrid Network with Contextual and Attentional Feature Fusion for Liver Tumor Segmentation
par: Kang, Ming, et autres
Publié: (2024)
par: Kang, Ming, et autres
Publié: (2024)
A generalised novel loss function for computational fluid dynamics
par: Cooper-Baldock, Zachary, et autres
Publié: (2024)
par: Cooper-Baldock, Zachary, et autres
Publié: (2024)
Cross-Enhanced Multimodal Fusion of Eye-Tracking and Facial Features for Alzheimer's Disease Diagnosis
par: Nie, Yujie, et autres
Publié: (2025)
par: Nie, Yujie, et autres
Publié: (2025)
Deep Spectral Meshes: Multi-Frequency Facial Mesh Processing with Graph Neural Networks
par: Kosk, Robert, et autres
Publié: (2024)
par: Kosk, Robert, et autres
Publié: (2024)
Massive Redundancy in Gradient Transport Enables Sparse Online Learning
par: Merin, Aur Shalev
Publié: (2026)
par: Merin, Aur Shalev
Publié: (2026)
CVCM Track Circuits Pre-emptive Failure Diagnostics for Predictive Maintenance Using Deep Neural Networks
par: Mukherjee, Debdeep, et autres
Publié: (2025)
par: Mukherjee, Debdeep, et autres
Publié: (2025)
SeMi: When Imbalanced Semi-Supervised Learning Meets Mining Hard Examples
par: Wang, Yin, et autres
Publié: (2025)
par: Wang, Yin, et autres
Publié: (2025)
Automatic Detection of Intro and Credits in Video using CLIP and Multihead Attention
par: Korolkov, Vasilii, et autres
Publié: (2025)
par: Korolkov, Vasilii, et autres
Publié: (2025)
Digital implementations of deep feature extractors are intrinsically informative
par: Getter, Max
Publié: (2025)
par: Getter, Max
Publié: (2025)
Documents similaires
-
ViTNF: Leveraging Neural Fields to Boost Vision Transformers in Generalized Category Discovery
par: Su, Jiayi, et autres
Publié: (2025) -
Co-Training with Active Contrastive Learning and Meta-Pseudo-Labeling on 2D Projections for Deep Semi-Supervised Learning
par: Aparco-Cardenas, David, et autres
Publié: (2025) -
Neural Encoding for Image Recall: Human-Like Memory
par: Foussereau, Virgile, et autres
Publié: (2024) -
The Normalized Difference Layer: A Differentiable Spectral Index Formulation for Deep Learning
par: Lotfi, Ali, et autres
Publié: (2026) -
Understanding Generalization, Robustness, and Interpretability in Low-Capacity Neural Networks
par: Kumar, Yash
Publié: (2025)