Enregistré dans:
| Auteurs principaux: | Ashraf, Yasser, Sharshar, Ahmed, Bojkovic, Velibor, Gu, Bin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2507.16151 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Temporal Misalignment in ANN-SNN Conversion and Its Mitigation via Probabilistic Spiking Neurons
par: Bojković, Velibor, et autres
Publié: (2025)
par: Bojković, Velibor, et autres
Publié: (2025)
FTBC: Forward Temporal Bias Correction for Optimizing ANN-SNN Conversion
par: Wu, Xiaofeng, et autres
Publié: (2024)
par: Wu, Xiaofeng, et autres
Publié: (2024)
PulmoFusion: Advancing Pulmonary Health with Efficient Multi-Modal Fusion
par: Sharshar, Ahmed, et autres
Publié: (2025)
par: Sharshar, Ahmed, et autres
Publié: (2025)
Not Only Grey Matter: OmniBrain for Robust Multimodal Classification of Alzheimer's Disease
par: Sharshar, Ahmed, et autres
Publié: (2025)
par: Sharshar, Ahmed, et autres
Publié: (2025)
Complementary Random Masking for RGB-Thermal Semantic Segmentation
par: Shin, Ukcheol, et autres
Publié: (2023)
par: Shin, Ukcheol, et autres
Publié: (2023)
GeoLLaVA: Efficient Fine-Tuned Vision-Language Models for Temporal Change Detection in Remote Sensing
par: Elgendy, Hosam, et autres
Publié: (2024)
par: Elgendy, Hosam, et autres
Publié: (2024)
Human Activity Recognition using RGB-Event based Sensors: A Multi-modal Heat Conduction Model and A Benchmark Dataset
par: Wang, Shiao, et autres
Publié: (2025)
par: Wang, Shiao, et autres
Publié: (2025)
An End-to-End Two-Stream Network Based on RGB Flow and Representation Flow for Human Action Recognition
par: Lai, Song-Jiang, et autres
Publié: (2024)
par: Lai, Song-Jiang, et autres
Publié: (2024)
RGB-Event based Pedestrian Attribute Recognition: A Benchmark Dataset and An Asymmetric RWKV Fusion Framework
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
Vision-Language Models for Edge Networks: A Comprehensive Survey
par: Sharshar, Ahmed, et autres
Publié: (2025)
par: Sharshar, Ahmed, et autres
Publié: (2025)
SigFormer: Sparse Signal-Guided Transformer for Multi-Modal Human Action Segmentation
par: Liu, Qi, et autres
Publié: (2023)
par: Liu, Qi, et autres
Publié: (2023)
Event Stream based Human Action Recognition: A High-Definition Benchmark Dataset and Algorithms
par: Wang, Xiao, et autres
Publié: (2024)
par: Wang, Xiao, et autres
Publié: (2024)
Fire on Motion: Optimizing Video Pass-bands for Efficient Spiking Action Recognition
par: Ye, Shuhan, et autres
Publié: (2026)
par: Ye, Shuhan, et autres
Publié: (2026)
Temporal-Guided Spiking Neural Networks for Event-Based Human Action Recognition
par: Yang, Siyuan, et autres
Publié: (2025)
par: Yang, Siyuan, et autres
Publié: (2025)
Signal-SGN++: Topology-Enhanced Time-Frequency Spiking Graph Network for Skeleton-Based Action Recognition
par: Zheng, Naichuan, et autres
Publié: (2025)
par: Zheng, Naichuan, et autres
Publié: (2025)
S3T-Former: A Purely Spike-Driven State-Space Topology Transformer for Skeleton Action Recognition
par: Zheng, Naichuan, et autres
Publié: (2026)
par: Zheng, Naichuan, et autres
Publié: (2026)
MMeViT: Multi-Modal ensemble ViT for Post-Stroke Rehabilitation Action Recognition
par: Kim, Ye-eun, et autres
Publié: (2025)
par: Kim, Ye-eun, et autres
Publié: (2025)
Conformal Predictions for Human Action Recognition with Vision-Language Models
par: Tim, Bary, et autres
Publié: (2025)
par: Tim, Bary, et autres
Publié: (2025)
Collaborative Learning for 3D Hand-Object Reconstruction and Compositional Action Recognition from Egocentric RGB Videos Using Superquadrics
par: Tse, Tze Ho Elden, et autres
Publié: (2025)
par: Tse, Tze Ho Elden, et autres
Publié: (2025)
CMD-HAR: Cross-Modal Disentanglement for Wearable Human Activity Recognition
par: Yu, Ying, et autres
Publié: (2025)
par: Yu, Ying, et autres
Publié: (2025)
From Lightweight CNNs to SpikeNets: Benchmarking Accuracy-Energy Tradeoffs with Pruned Spiking SqueezeNet
par: Kabir, Radib Bin, et autres
Publié: (2026)
par: Kabir, Radib Bin, et autres
Publié: (2026)
Pause and Think: A Dataset and Benchmark for Video-Grounded Assistive Action Suggestion
par: Singh, Shivam, et autres
Publié: (2026)
par: Singh, Shivam, et autres
Publié: (2026)
TAG: Thinking with Action Unit Grounding for Facial Expression Recognition
par: Lin, Haobo, et autres
Publié: (2026)
par: Lin, Haobo, et autres
Publié: (2026)
EPAM-Net: An Efficient Pose-driven Attention-guided Multimodal Network for Video Action Recognition
par: Abdelkawy, Ahmed, et autres
Publié: (2024)
par: Abdelkawy, Ahmed, et autres
Publié: (2024)
Grounding Foundational Vision Models with 3D Human Poses for Robust Action Recognition
par: Babey, Nicholas, et autres
Publié: (2025)
par: Babey, Nicholas, et autres
Publié: (2025)
Interpretable Action Recognition on Hard to Classify Actions
par: Anichenko, Anastasia, et autres
Publié: (2024)
par: Anichenko, Anastasia, et autres
Publié: (2024)
Pedestrian Attribute Recognition via Hierarchical Cross-Modality HyperGraph Learning
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
Complex Mathematical Expression Recognition: Benchmark, Large-Scale Dataset and Strong Baseline
par: Bai, Weikang, et autres
Publié: (2025)
par: Bai, Weikang, et autres
Publié: (2025)
Segment Any RGB-Thermal Model with Language-aided Distillation
par: Xing, Dong, et autres
Publié: (2025)
par: Xing, Dong, et autres
Publié: (2025)
Rethinking RGB-D Fusion for Semantic Segmentation in Surgical Datasets
par: Jamal, Muhammad Abdullah, et autres
Publié: (2024)
par: Jamal, Muhammad Abdullah, et autres
Publié: (2024)
HalluciDet: Hallucinating RGB Modality for Person Detection Through Privileged Information
par: Medeiros, Heitor Rapela, et autres
Publié: (2023)
par: Medeiros, Heitor Rapela, et autres
Publié: (2023)
Lens Privacy Sealing: A New Benchmark and Method for Physical Privacy-Preserving Action Recognition
par: Liu, Mengyuan, et autres
Publié: (2026)
par: Liu, Mengyuan, et autres
Publié: (2026)
Unleashing the Power of CNN and Transformer for Balanced RGB-Event Video Recognition
par: Wang, Xiao, et autres
Publié: (2023)
par: Wang, Xiao, et autres
Publié: (2023)
Real-Time Human Action Recognition on Embedded Platforms
par: Wang, Ruiqi, et autres
Publié: (2024)
par: Wang, Ruiqi, et autres
Publié: (2024)
Neurosymbolic Framework for Concept-Driven Logical Reasoning in Skeleton-Based Human Action Recognition
par: Ilyas, Talha, et autres
Publié: (2026)
par: Ilyas, Talha, et autres
Publié: (2026)
Enhanced Sparse Point Cloud Data Processing for Privacy-aware Human Action Recognition
par: Tunau, Maimunatu, et autres
Publié: (2025)
par: Tunau, Maimunatu, et autres
Publié: (2025)
SpikMamba: When SNN meets Mamba in Event-based Human Action Recognition
par: Chen, Jiaqi, et autres
Publié: (2024)
par: Chen, Jiaqi, et autres
Publié: (2024)
Human-AI Divergence in Ego-centric Action Recognition under Spatial and Spatiotemporal Manipulations
par: Rahmaniboldaji, Sadegh, et autres
Publié: (2026)
par: Rahmaniboldaji, Sadegh, et autres
Publié: (2026)
MVIP -- A Dataset and Methods for Application Oriented Multi-View and Multi-Modal Industrial Part Recognition
par: Koch, Paul, et autres
Publié: (2025)
par: Koch, Paul, et autres
Publié: (2025)
Toward Aligning Human and Robot Actions via Multi-Modal Demonstration Learning
par: Zahid, Azizul, et autres
Publié: (2025)
par: Zahid, Azizul, et autres
Publié: (2025)
Documents similaires
-
Temporal Misalignment in ANN-SNN Conversion and Its Mitigation via Probabilistic Spiking Neurons
par: Bojković, Velibor, et autres
Publié: (2025) -
FTBC: Forward Temporal Bias Correction for Optimizing ANN-SNN Conversion
par: Wu, Xiaofeng, et autres
Publié: (2024) -
PulmoFusion: Advancing Pulmonary Health with Efficient Multi-Modal Fusion
par: Sharshar, Ahmed, et autres
Publié: (2025) -
Not Only Grey Matter: OmniBrain for Robust Multimodal Classification of Alzheimer's Disease
par: Sharshar, Ahmed, et autres
Publié: (2025) -
Complementary Random Masking for RGB-Thermal Semantic Segmentation
par: Shin, Ukcheol, et autres
Publié: (2023)