Guardado en:
| Autores principales: | Hashemifard, Kooshan, Climent-Pérez, Pau, Florez-Revuelta, Francisco |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2603.04509 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Action Recognition in Real-World Ambient Assisted Living Environment
por: Zakka, Vincent Gbouna, et al.
Publicado: (2025)
por: Zakka, Vincent Gbouna, et al.
Publicado: (2025)
Enhanced Aiot Multi‐Modal Fusion for Human Activity Recognition in Ambient Assisted Living Environment
por: Ankit D. Patel, et al.
Publicado: (2024)
por: Ankit D. Patel, et al.
Publicado: (2024)
Multi-view Video-Pose Pretraining for Operating Room Surgical Activity Recognition
por: Hamoud, Idris, et al.
Publicado: (2025)
por: Hamoud, Idris, et al.
Publicado: (2025)
PovNet+: A Deep Learning Architecture for Socially Assistive Robots to Learn and Assist with Multiple Activities of Daily Living
por: Robinson, Fraser, et al.
Publicado: (2026)
por: Robinson, Fraser, et al.
Publicado: (2026)
Multi-Modal Gesture Recognition from Video and Surgical Tool Pose Information via Motion Invariants
por: Atoum, Jumanh, et al.
Publicado: (2025)
por: Atoum, Jumanh, et al.
Publicado: (2025)
ForcePose: A Deep Learning Approach for Force Calculation Based on Action Recognition Using MediaPipe Pose Estimation Combined with Object Detection
por: M, Nandakishor, et al.
Publicado: (2025)
por: M, Nandakishor, et al.
Publicado: (2025)
End-to-End Multi-Person Pose Estimation with Pose-Aware Video Transformer
por: Yu, Yonghui, et al.
Publicado: (2025)
por: Yu, Yonghui, et al.
Publicado: (2025)
Paving the Way Towards Kinematic Assessment Using Monocular Video: A Preclinical Benchmark of State-of-the-Art Deep-Learning-Based 3D Human Pose Estimators Against Inertial Sensors in Daily Living Activities
por: Medrano-Paredes, Mario, et al.
Publicado: (2025)
por: Medrano-Paredes, Mario, et al.
Publicado: (2025)
Learning Frequency and Memory-Aware Prompts for Multi-Modal Object Tracking
por: Xu, Boyue, et al.
Publicado: (2025)
por: Xu, Boyue, et al.
Publicado: (2025)
Predicting Penalty Kick Direction Using Multi-Modal Deep Learning with Pose-Guided Attention
por: Ranasinghe, Pasindu, et al.
Publicado: (2025)
por: Ranasinghe, Pasindu, et al.
Publicado: (2025)
Detection, Recognition and Pose Estimation of Tabletop Objects
por: Nirgude, Sanjuksha, et al.
Publicado: (2024)
por: Nirgude, Sanjuksha, et al.
Publicado: (2024)
PoseGAM: Robust Unseen Object Pose Estimation via Geometry-Aware Multi-View Reasoning
por: Chen, Jianqi, et al.
Publicado: (2025)
por: Chen, Jianqi, et al.
Publicado: (2025)
Demo-Pose: Depth-Monocular Modality Fusion For Object Pose Estimation
por: Agarwal, Rachit, et al.
Publicado: (2026)
por: Agarwal, Rachit, et al.
Publicado: (2026)
Deep Learning Pose Estimation for Multi-Label Recognition of Combined Hyperkinetic Movement Disorders
por: Cif, Laura, et al.
Publicado: (2026)
por: Cif, Laura, et al.
Publicado: (2026)
TSM-Pose: Topology-Aware Learning with Semantic Mamba for Category-Level Object Pose Estimation
por: Liu, Jinshuo, et al.
Publicado: (2026)
por: Liu, Jinshuo, et al.
Publicado: (2026)
UnityVideo: Unified Multi-Modal Multi-Task Learning for Enhancing World-Aware Video Generation
por: Huang, Jiehui, et al.
Publicado: (2025)
por: Huang, Jiehui, et al.
Publicado: (2025)
Post-Hurricane Debris Segmentation Using Fine-Tuned Foundational Vision Models
por: Amini, Kooshan, et al.
Publicado: (2025)
por: Amini, Kooshan, et al.
Publicado: (2025)
Deep Adversarial Learning with Activity-Based User Discrimination Task for Human Activity Recognition
por: Calatrava-Nicolás, Francisco M., et al.
Publicado: (2024)
por: Calatrava-Nicolás, Francisco M., et al.
Publicado: (2024)
Continual Multimodal Egocentric Activity Recognition via Modality-Aware Novel Detection
por: Lim, Wonseon, et al.
Publicado: (2026)
por: Lim, Wonseon, et al.
Publicado: (2026)
PoseTraj: Pose-Aware Trajectory Control in Video Diffusion
por: Ji, Longbin, et al.
Publicado: (2025)
por: Ji, Longbin, et al.
Publicado: (2025)
Towards LLM-Powered Ambient Sensor Based Multi-Person Human Activity Recognition
por: Chen, Xi, et al.
Publicado: (2024)
por: Chen, Xi, et al.
Publicado: (2024)
Exploring Modality-Aware Fusion and Decoupled Temporal Propagation for Multi-Modal Object Tracking
por: Wang, Shilei, et al.
Publicado: (2026)
por: Wang, Shilei, et al.
Publicado: (2026)
Reliable Multi-Modal Object Re-Identification via Modality-Aware Graph Reasoning
por: Wan, Xixi, et al.
Publicado: (2025)
por: Wan, Xixi, et al.
Publicado: (2025)
Can Text-to-image Model Assist Multi-modal Learning for Visual Recognition with Visual Modality Missing?
por: Feng, Tiantian, et al.
Publicado: (2024)
por: Feng, Tiantian, et al.
Publicado: (2024)
IDSelect: A RL-Based Cost-Aware Selection Agent for Video-based Multi-Modal Person Recognition
por: Ji, Yuyang, et al.
Publicado: (2026)
por: Ji, Yuyang, et al.
Publicado: (2026)
X Modality Assisting RGBT Object Tracking
por: Ding, Zhaisheng, et al.
Publicado: (2023)
por: Ding, Zhaisheng, et al.
Publicado: (2023)
TransPose: 6D Object Pose Estimation with Geometry-Aware Transformer
por: Lin, Xiao, et al.
Publicado: (2023)
por: Lin, Xiao, et al.
Publicado: (2023)
Deep Learning Approaches for Human Action Recognition in Video Data
por: Xie, Yufei
Publicado: (2024)
por: Xie, Yufei
Publicado: (2024)
A Distributed Multi-Modal Sensing Approach for Human Activity Recognition in Real-Time Human-Robot Collaboration
por: Belcamino, Valerio, et al.
Publicado: (2026)
por: Belcamino, Valerio, et al.
Publicado: (2026)
Deep Learning-Based Object Pose Estimation: A Comprehensive Survey
por: Liu, Jian, et al.
Publicado: (2024)
por: Liu, Jian, et al.
Publicado: (2024)
Group Activity Recognition using Unreliable Tracked Pose
por: Thilakarathne, Haritha, et al.
Publicado: (2024)
por: Thilakarathne, Haritha, et al.
Publicado: (2024)
Language-Assisted Deep Learning for Autistic Behaviors Recognition
por: Deng, Andong, et al.
Publicado: (2022)
por: Deng, Andong, et al.
Publicado: (2022)
Multi-Modal Monocular Endoscopic Depth and Pose Estimation with Edge-Guided Self-Supervision
por: Ju, Xinwei, et al.
Publicado: (2026)
por: Ju, Xinwei, et al.
Publicado: (2026)
BEVPose: Unveiling Scene Semantics through Pose-Guided Multi-Modal BEV Alignment
por: Hosseinzadeh, Mehdi, et al.
Publicado: (2024)
por: Hosseinzadeh, Mehdi, et al.
Publicado: (2024)
Modality-Agnostic Prompt Learning for Multi-Modal Camouflaged Object Detection
por: Wang, Hao, et al.
Publicado: (2026)
por: Wang, Hao, et al.
Publicado: (2026)
Object Pose Estimation through Dexterous Touch
por: Shahidzadeh, Amir-Hossein, et al.
Publicado: (2025)
por: Shahidzadeh, Amir-Hossein, et al.
Publicado: (2025)
UA-Pose: Uncertainty-Aware 6D Object Pose Estimation and Online Object Completion with Partial References
por: Li, Ming-Feng, et al.
Publicado: (2025)
por: Li, Ming-Feng, et al.
Publicado: (2025)
MAPRPose: Mask-Aware Proposal and Amodal Refinement for Multi-Object 6D Pose Estimation
por: Luo, Yang, et al.
Publicado: (2026)
por: Luo, Yang, et al.
Publicado: (2026)
Pixels or Positions? Benchmarking Modalities in Group Activity Recognition
por: Karki, Drishya, et al.
Publicado: (2025)
por: Karki, Drishya, et al.
Publicado: (2025)
Unsupervised Learning of Category-Level 3D Pose from Object-Centric Videos
por: Sommer, Leonhard, et al.
Publicado: (2024)
por: Sommer, Leonhard, et al.
Publicado: (2024)
Ejemplares similares
-
Action Recognition in Real-World Ambient Assisted Living Environment
por: Zakka, Vincent Gbouna, et al.
Publicado: (2025) -
Enhanced Aiot Multi‐Modal Fusion for Human Activity Recognition in Ambient Assisted Living Environment
por: Ankit D. Patel, et al.
Publicado: (2024) -
Multi-view Video-Pose Pretraining for Operating Room Surgical Activity Recognition
por: Hamoud, Idris, et al.
Publicado: (2025) -
PovNet+: A Deep Learning Architecture for Socially Assistive Robots to Learn and Assist with Multiple Activities of Daily Living
por: Robinson, Fraser, et al.
Publicado: (2026) -
Multi-Modal Gesture Recognition from Video and Surgical Tool Pose Information via Motion Invariants
por: Atoum, Jumanh, et al.
Publicado: (2025)