Salvato in:
| Autori principali: | Nottebaum, Moritz, Dunnhofer, Matteo, Micheloni, Christian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2409.03460 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond MACs: Hardware Efficient Architecture Design for Vision Backbones
di: Nottebaum, Moritz, et al.
Pubblicazione: (2026)
di: Nottebaum, Moritz, et al.
Pubblicazione: (2026)
CPUBone: Efficient Vision Backbone Design for Devices with Low Parallelization Capabilities
di: Nottebaum, Moritz, et al.
Pubblicazione: (2026)
di: Nottebaum, Moritz, et al.
Pubblicazione: (2026)
Is Tracking really more challenging in First Person Egocentric Vision?
di: Dunnhofer, Matteo, et al.
Pubblicazione: (2025)
di: Dunnhofer, Matteo, et al.
Pubblicazione: (2025)
Better, But Not Sufficient: Testing Video ANNs Against Macaque IT Dynamics
di: Dunnhofer, Matteo, et al.
Pubblicazione: (2026)
di: Dunnhofer, Matteo, et al.
Pubblicazione: (2026)
Online Episodic Memory Visual Query Localization with Egocentric Streaming Object Memory
di: Manigrasso, Zaira, et al.
Pubblicazione: (2024)
di: Manigrasso, Zaira, et al.
Pubblicazione: (2024)
Tracking Skiers from the Top to the Bottom
di: Dunnhofer, Matteo, et al.
Pubblicazione: (2023)
di: Dunnhofer, Matteo, et al.
Pubblicazione: (2023)
SkelMamba: A State Space Model for Efficient Skeleton Action Recognition of Neurological Disorders
di: Martinel, Niki, et al.
Pubblicazione: (2024)
di: Martinel, Niki, et al.
Pubblicazione: (2024)
H3D-MarNet: Wavelet-Guided Dual-Path Learning for Metal Artifact Suppression and CT Modality Transformation for Radiotherapy Workflows
di: Rehman, Mubashara, et al.
Pubblicazione: (2026)
di: Rehman, Mubashara, et al.
Pubblicazione: (2026)
ReMAR-DS: Recalibrated Feature Learning for Metal Artifact Reduction and CT Domain Transformation
di: Rehman, Mubashara, et al.
Pubblicazione: (2025)
di: Rehman, Mubashara, et al.
Pubblicazione: (2025)
ModalFormer: Multimodal Transformer for Low-Light Image Enhancement
di: Brateanu, Alexandru, et al.
Pubblicazione: (2025)
di: Brateanu, Alexandru, et al.
Pubblicazione: (2025)
WidthFormer: Toward Efficient Transformer-based BEV View Transformation
di: Yang, Chenhongyi, et al.
Pubblicazione: (2024)
di: Yang, Chenhongyi, et al.
Pubblicazione: (2024)
Revisiting the Integration of Convolution and Attention for Vision Backbone
di: Zhu, Lei, et al.
Pubblicazione: (2024)
di: Zhu, Lei, et al.
Pubblicazione: (2024)
ScatterFormer: Efficient Voxel Transformer with Scattered Linear Attention
di: He, Chenhang, et al.
Pubblicazione: (2024)
di: He, Chenhang, et al.
Pubblicazione: (2024)
MixFormerV2: Efficient Fully Transformer Tracking
di: Cui, Yutao, et al.
Pubblicazione: (2023)
di: Cui, Yutao, et al.
Pubblicazione: (2023)
FakeFormer: Efficient Vulnerability-Driven Transformers for Generalisable Deepfake Detection
di: Nguyen, Dat, et al.
Pubblicazione: (2024)
di: Nguyen, Dat, et al.
Pubblicazione: (2024)
UniFormer: Unifying Convolution and Self-attention for Visual Recognition
di: Li, Kunchang, et al.
Pubblicazione: (2022)
di: Li, Kunchang, et al.
Pubblicazione: (2022)
JAQ: Joint Efficient Architecture Design and Low-Bit Quantization with Hardware-Software Co-Exploration
di: Wang, Mingzi, et al.
Pubblicazione: (2025)
di: Wang, Mingzi, et al.
Pubblicazione: (2025)
Convolutional Initialization for Data-Efficient Vision Transformers
di: Zheng, Jianqiao, et al.
Pubblicazione: (2024)
di: Zheng, Jianqiao, et al.
Pubblicazione: (2024)
RapidNet: Multi-Level Dilated Convolution Based Mobile Backbone
di: Munir, Mustafa, et al.
Pubblicazione: (2024)
di: Munir, Mustafa, et al.
Pubblicazione: (2024)
MambaVision: A Hybrid Mamba-Transformer Vision Backbone
di: Hatamizadeh, Ali, et al.
Pubblicazione: (2024)
di: Hatamizadeh, Ali, et al.
Pubblicazione: (2024)
Activation-Free Backbones for Image Recognition: Polynomial Alternatives within MetaFormer-Style Vision Models
di: Wang, Jeffrey, et al.
Pubblicazione: (2026)
di: Wang, Jeffrey, et al.
Pubblicazione: (2026)
Efficient Quantum Convolutional Neural Networks for Image Classification: Overcoming Hardware Constraints
di: Röseler, Peter, et al.
Pubblicazione: (2025)
di: Röseler, Peter, et al.
Pubblicazione: (2025)
SegFormer3D: an Efficient Transformer for 3D Medical Image Segmentation
di: Perera, Shehan, et al.
Pubblicazione: (2024)
di: Perera, Shehan, et al.
Pubblicazione: (2024)
AnchorFormer: Differentiable Anchor Attention for Efficient Vision Transformer
di: Shan, Jiquan, et al.
Pubblicazione: (2025)
di: Shan, Jiquan, et al.
Pubblicazione: (2025)
Vision Backbone Efficient Selection for Image Classification in Low-Data Regimes
di: Guerin, Joris, et al.
Pubblicazione: (2024)
di: Guerin, Joris, et al.
Pubblicazione: (2024)
LoFormer: Local Frequency Transformer for Image Deblurring
di: Mao, Xintian, et al.
Pubblicazione: (2024)
di: Mao, Xintian, et al.
Pubblicazione: (2024)
CountFormer: Multi-View Crowd Counting Transformer
di: Mo, Hong, et al.
Pubblicazione: (2024)
di: Mo, Hong, et al.
Pubblicazione: (2024)
GridFormer: Point-Grid Transformer for Surface Reconstruction
di: Li, Shengtao, et al.
Pubblicazione: (2024)
di: Li, Shengtao, et al.
Pubblicazione: (2024)
GeoFormer: A Multi-Polygon Segmentation Transformer
di: Khomiakov, Maxim, et al.
Pubblicazione: (2024)
di: Khomiakov, Maxim, et al.
Pubblicazione: (2024)
MonoFormer: One Transformer for Both Diffusion and Autoregression
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
AesFormer: Transform Everyday Photos into Beautiful Memories
di: Du, Tianxiang, et al.
Pubblicazione: (2026)
di: Du, Tianxiang, et al.
Pubblicazione: (2026)
Low-Bit Integerization of Vision Transformers using Operand Reordering for Efficient Hardware
di: Lin, Ching-Yi, et al.
Pubblicazione: (2025)
di: Lin, Ching-Yi, et al.
Pubblicazione: (2025)
KnapFormer: An Online Load Balancer for Efficient Diffusion Transformers Training
di: Zhang, Kai, et al.
Pubblicazione: (2025)
di: Zhang, Kai, et al.
Pubblicazione: (2025)
SLAM-Former: Putting SLAM into One Transformer
di: Yuan, Yijun, et al.
Pubblicazione: (2025)
di: Yuan, Yijun, et al.
Pubblicazione: (2025)
Low-Cost Self-Ensembles Based on Multi-Branch Transformation and Grouped Convolution
di: Lee, Hojung, et al.
Pubblicazione: (2024)
di: Lee, Hojung, et al.
Pubblicazione: (2024)
Rethinking Backbone Design for Lightweight 3D Object Detection in LiDAR
di: Chandorkar, Adwait, et al.
Pubblicazione: (2025)
di: Chandorkar, Adwait, et al.
Pubblicazione: (2025)
A Comparative Study of Image Restoration Networks for General Backbone Network Design
di: Chen, Xiangyu, et al.
Pubblicazione: (2023)
di: Chen, Xiangyu, et al.
Pubblicazione: (2023)
Depth-Wise Convolutions in Vision Transformers for Efficient Training on Small Datasets
di: Zhang, Tianxiao, et al.
Pubblicazione: (2024)
di: Zhang, Tianxiao, et al.
Pubblicazione: (2024)
CompetitorFormer: Competitor Transformer for 3D Instance Segmentation
di: Wang, Duanchu, et al.
Pubblicazione: (2024)
di: Wang, Duanchu, et al.
Pubblicazione: (2024)
SkateFormer: Skeletal-Temporal Transformer for Human Action Recognition
di: Do, Jeonghyeok, et al.
Pubblicazione: (2024)
di: Do, Jeonghyeok, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Beyond MACs: Hardware Efficient Architecture Design for Vision Backbones
di: Nottebaum, Moritz, et al.
Pubblicazione: (2026) -
CPUBone: Efficient Vision Backbone Design for Devices with Low Parallelization Capabilities
di: Nottebaum, Moritz, et al.
Pubblicazione: (2026) -
Is Tracking really more challenging in First Person Egocentric Vision?
di: Dunnhofer, Matteo, et al.
Pubblicazione: (2025) -
Better, But Not Sufficient: Testing Video ANNs Against Macaque IT Dynamics
di: Dunnhofer, Matteo, et al.
Pubblicazione: (2026) -
Online Episodic Memory Visual Query Localization with Egocentric Streaming Object Memory
di: Manigrasso, Zaira, et al.
Pubblicazione: (2024)