CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge
Fuente:
arXiv
Guardado en:
| Autores principales: | Lagani, Gabriele, Falchi, Fabrizio, Gennaro, Claudio, Amato, Giuseppe |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Semi-Supervised Biomedical Image Segmentation via Diffusion Models and Teacher-Student Co-Training
por: Ciampi, Luca, et al.
Publicado: (2025)
por: Ciampi, Luca, et al.
Publicado: (2025)
Biologically-inspired Semi-supervised Semantic Segmentation for Biomedical Imaging
por: Ciampi, Luca, et al.
Publicado: (2024)
por: Ciampi, Luca, et al.
Publicado: (2024)
Adversarial Magnification to Deceive Deepfake Detection through Super Resolution
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024)
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024)
Exploring Strengths and Weaknesses of Super-Resolution Attack in Deepfake Detection
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024)
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024)
Deepfake Detection without Deepfakes: Generalization via Synthetic Frequency Patterns Injection
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024)
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024)
Neuro-Inspired Visual Pattern Recognition via Biological Reservoir Computing
por: Ciampi, Luca, et al.
Publicado: (2026)
por: Ciampi, Luca, et al.
Publicado: (2026)
From Neural Activity to Computation: Biological Reservoirs for Pattern Recognition in Digit Classification
por: Iannello, Ludovico, et al.
Publicado: (2025)
por: Iannello, Ludovico, et al.
Publicado: (2025)
Comparison of Different Deep Neural Network Models in the Cultural Heritage Domain
por: Boyadzhiev, Teodor, et al.
Publicado: (2025)
por: Boyadzhiev, Teodor, et al.
Publicado: (2025)
LoomNet: Enhancing Multi-View Image Generation via Latent Space Weaving
por: Federico, Giulio, et al.
Publicado: (2025)
por: Federico, Giulio, et al.
Publicado: (2025)
CountingDINO: A Training-free Pipeline for Class-Agnostic Counting using Unsupervised Backbones
por: Pacini, Giacomo, et al.
Publicado: (2025)
por: Pacini, Giacomo, et al.
Publicado: (2025)
One Patch to Caption Them All: A Unified Zero-Shot Captioning Framework
por: Bianchi, Lorenzo, et al.
Publicado: (2025)
por: Bianchi, Lorenzo, et al.
Publicado: (2025)
Mind the Prompt: A Novel Benchmark for Prompt-based Class-Agnostic Counting
por: Ciampi, Luca, et al.
Publicado: (2024)
por: Ciampi, Luca, et al.
Publicado: (2024)
Does it Really Count? Assessing Semantic Grounding in Text-Guided Class-Agnostic Counting
por: Pacini, Giacomo, et al.
Publicado: (2026)
por: Pacini, Giacomo, et al.
Publicado: (2026)
From Neurons to Computation: Biological Reservoir Computing for Pattern Recognition
por: Iannello, Ludovico, et al.
Publicado: (2025)
por: Iannello, Ludovico, et al.
Publicado: (2025)
AttentNet: Fully Convolutional 3D Attention for Lung Nodule Detection
por: Almahasneh, Majedaldein, et al.
Publicado: (2024)
por: Almahasneh, Majedaldein, et al.
Publicado: (2024)
The devil is in the fine-grained details: Evaluating open-vocabulary object detectors for fine-grained understanding
por: Bianchi, Lorenzo, et al.
Publicado: (2023)
por: Bianchi, Lorenzo, et al.
Publicado: (2023)
Efficient 3D Recognition with Event-driven Spike Sparse Convolution
por: Qiu, Xuerui, et al.
Publicado: (2024)
por: Qiu, Xuerui, et al.
Publicado: (2024)
Efficient Dynamic Attention 3D Convolution for Hyperspectral Image Classification
por: Li, Guandong, et al.
Publicado: (2025)
por: Li, Guandong, et al.
Publicado: (2025)
ViSketch-GPT: Collaborative Multi-Scale Feature Extraction for Sketch Recognition and Generation
por: Federico, Giulio, et al.
Publicado: (2025)
por: Federico, Giulio, et al.
Publicado: (2025)
Y-CA-Net: A Convolutional Attention Based Network for Volumetric Medical Image Segmentation
por: Sharif, Muhammad Hamza, et al.
Publicado: (2024)
por: Sharif, Muhammad Hamza, et al.
Publicado: (2024)
MoCA: Mixture-of-Components Attention for Scalable Compositional 3D Generation
por: Li, Zhiqi, et al.
Publicado: (2025)
por: Li, Zhiqi, et al.
Publicado: (2025)
CA^2ST: Cross-Attention in Audio, Space, and Time for Holistic Video Recognition
por: Lee, Jongseo, et al.
Publicado: (2025)
por: Lee, Jongseo, et al.
Publicado: (2025)
PAL-Net: A Point-Wise CNN with Patch-Attention for 3D Facial Landmark Localization
por: Yazdi, Ali Shadman, et al.
Publicado: (2025)
por: Yazdi, Ali Shadman, et al.
Publicado: (2025)
LATUP-Net: A Lightweight 3D Attention U-Net with Parallel Convolutions for Brain Tumor Segmentation
por: Alwadee, Ebtihal J., et al.
Publicado: (2024)
por: Alwadee, Ebtihal J., et al.
Publicado: (2024)
A Survey on Class-Agnostic Counting: Advancements from Reference-Based to Open-World Text-Guided Approaches
por: Ciampi, Luca, et al.
Publicado: (2025)
por: Ciampi, Luca, et al.
Publicado: (2025)
2D-3D Attention and Entropy for Pose Robust 2D Facial Recognition
por: Peace, J. Brennan, et al.
Publicado: (2025)
por: Peace, J. Brennan, et al.
Publicado: (2025)
ESAM++: Efficient Online 3D Perception on the Edge
por: Liu, Qin, et al.
Publicado: (2026)
por: Liu, Qin, et al.
Publicado: (2026)
Is CLIP the main roadblock for fine-grained open-world perception?
por: Bianchi, Lorenzo, et al.
Publicado: (2024)
por: Bianchi, Lorenzo, et al.
Publicado: (2024)
MoCA3D: Monocular 3D Bounding Box Prediction in the Image Plane
por: Jeon, Changwoo, et al.
Publicado: (2026)
por: Jeon, Changwoo, et al.
Publicado: (2026)
GraphFusion3D: Dynamic Graph Attention Convolution with Adaptive Cross-Modal Transformer for 3D Object Detection
por: Mia, Md Sohag, et al.
Publicado: (2025)
por: Mia, Md Sohag, et al.
Publicado: (2025)
An Efficient 3D Convolutional Neural Network with Channel-wise, Spatial-grouped, and Temporal Convolutions
por: Wang, Zhe, et al.
Publicado: (2025)
por: Wang, Zhe, et al.
Publicado: (2025)
DCFormer: Efficient 3D Vision-Language Modeling with Decomposed Convolutions
por: Ates, Gorkem Can, et al.
Publicado: (2025)
por: Ates, Gorkem Can, et al.
Publicado: (2025)
SmokeNet: Efficient Smoke Segmentation Leveraging Multiscale Convolutions and Multiview Attention Mechanisms
por: Liu, Xuesong, et al.
Publicado: (2025)
por: Liu, Xuesong, et al.
Publicado: (2025)
Is 3D Convolution with 5D Tensors Really Necessary for Video Analysis?
por: Hajimolahoseini, Habib, et al.
Publicado: (2024)
por: Hajimolahoseini, Habib, et al.
Publicado: (2024)
Interspatial Attention for Efficient 4D Human Video Generation
por: Shao, Ruizhi, et al.
Publicado: (2025)
por: Shao, Ruizhi, et al.
Publicado: (2025)
Efficient Continuous Group Convolutions for Local SE(3) Equivariance in 3D Point Clouds
por: Weijler, Lisa, et al.
Publicado: (2025)
por: Weijler, Lisa, et al.
Publicado: (2025)
MeshVPR: Citywide Visual Place Recognition Using 3D Meshes
por: Berton, Gabriele, et al.
Publicado: (2024)
por: Berton, Gabriele, et al.
Publicado: (2024)
EPAM-Net: An Efficient Pose-driven Attention-guided Multimodal Network for Video Action Recognition
por: Abdelkawy, Ahmed, et al.
Publicado: (2024)
por: Abdelkawy, Ahmed, et al.
Publicado: (2024)
F4D: Factorized 4D Convolutional Neural Network for Efficient Video-level Representation Learning
por: Al-Saad, Mohammad, et al.
Publicado: (2023)
por: Al-Saad, Mohammad, et al.
Publicado: (2023)
The revenge of BiSeNet: Efficient Multi-Task Image Segmentation
por: Rosi, Gabriele, et al.
Publicado: (2024)
por: Rosi, Gabriele, et al.
Publicado: (2024)
Ejemplares similares
-
Semi-Supervised Biomedical Image Segmentation via Diffusion Models and Teacher-Student Co-Training
por: Ciampi, Luca, et al.
Publicado: (2025) -
Biologically-inspired Semi-supervised Semantic Segmentation for Biomedical Imaging
por: Ciampi, Luca, et al.
Publicado: (2024) -
Adversarial Magnification to Deceive Deepfake Detection through Super Resolution
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024) -
Exploring Strengths and Weaknesses of Super-Resolution Attack in Deepfake Detection
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024) -
Deepfake Detection without Deepfakes: Generalization via Synthetic Frequency Patterns Injection
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024)