An Evaluation of Large Pre-Trained Models for Gesture Recognition using Synthetic Videos
Fuente:
arXiv
Guardado en:
| Autores principales: | Reddy, Arun, Shah, Ketul, Rivera, Corban, Paul, William, De Melo, Celso M., Chellappa, Rama |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Unsupervised Video Domain Adaptation with Masked Pre-Training and Collaborative Self-Training
por: Reddy, Arun, et al.
Publicado: (2023)
por: Reddy, Arun, et al.
Publicado: (2023)
Synthetic-to-Real Domain Adaptation for Action Recognition: A Dataset and Baseline Performances
por: Reddy, Arun V., et al.
Publicado: (2023)
por: Reddy, Arun V., et al.
Publicado: (2023)
MultLFG: Training-free Multi-LoRA composition using Frequency-domain Guidance
por: Roy, Aniket, et al.
Publicado: (2025)
por: Roy, Aniket, et al.
Publicado: (2025)
MV2MAE: Multi-View Video Masked Autoencoders
por: Shah, Ketul, et al.
Publicado: (2024)
por: Shah, Ketul, et al.
Publicado: (2024)
MimicGait: A Model Agnostic approach for Occluded Gait Recognition using Correlational Knowledge Distillation
por: Gupta, Ayush, et al.
Publicado: (2025)
por: Gupta, Ayush, et al.
Publicado: (2025)
Template-based Multi-Domain Face Recognition
por: Nanduri, Anirudh, et al.
Publicado: (2024)
por: Nanduri, Anirudh, et al.
Publicado: (2024)
Multi-Domain Biometric Recognition using Body Embeddings
por: Nanduri, Anirudh, et al.
Publicado: (2025)
por: Nanduri, Anirudh, et al.
Publicado: (2025)
A Quantitative Evaluation of the Expressivity of BMI, Pose and Gender in Body Embeddings for Recognition and Identification
por: Pal, Basudha, et al.
Publicado: (2025)
por: Pal, Basudha, et al.
Publicado: (2025)
Video-ColBERT: Contextualized Late Interaction for Text-to-Video Retrieval
por: Reddy, Arun, et al.
Publicado: (2025)
por: Reddy, Arun, et al.
Publicado: (2025)
Mind the Gap: Bridging Occlusion in Gait Recognition via Residual Gap Correction
por: Gupta, Ayush, et al.
Publicado: (2025)
por: Gupta, Ayush, et al.
Publicado: (2025)
CLR-Face: Conditional Latent Refinement for Blind Face Restoration Using Score-Based Diffusion Models
por: Suin, Maitreya, et al.
Publicado: (2024)
por: Suin, Maitreya, et al.
Publicado: (2024)
Cross-Spectral Body Recognition with Side Information Embedding: Benchmarks on LLCM and Analyzing Range-Induced Occlusions on IJB-MDF
por: Nanduri, Anirudh, et al.
Publicado: (2025)
por: Nanduri, Anirudh, et al.
Publicado: (2025)
ViT-Linearizer: Distilling Quadratic Knowledge into Linear-Time Vision Models
por: Wei, Guoyizhe, et al.
Publicado: (2025)
por: Wei, Guoyizhe, et al.
Publicado: (2025)
GaitContour: Efficient Gait Recognition based on a Contour-Pose Representation
por: Guo, Yuxiang, et al.
Publicado: (2023)
por: Guo, Yuxiang, et al.
Publicado: (2023)
StimuVAR: Spatiotemporal Stimuli-aware Video Affective Reasoning with Multimodal Large Language Models
por: Guo, Yuxiang, et al.
Publicado: (2024)
por: Guo, Yuxiang, et al.
Publicado: (2024)
DiffInf: Influence-Guided Diffusion for Supervision Alignment in Facial Attribute Learning
por: Pal, Basudha, et al.
Publicado: (2026)
por: Pal, Basudha, et al.
Publicado: (2026)
Uncertainty-quantified Pulse Signal Recovery from Facial Video using Regularized Stochastic Interpolants
por: Shenoy, Vineet R., et al.
Publicado: (2026)
por: Shenoy, Vineet R., et al.
Publicado: (2026)
AttriBE: Quantifying Attribute Expressivity in Body Embeddings for Recognition and Identification
por: Pal, Basudha, et al.
Publicado: (2026)
por: Pal, Basudha, et al.
Publicado: (2026)
Zero-Shot Personalization of Objects via Textual Inversion
por: Roy, Aniket, et al.
Publicado: (2026)
por: Roy, Aniket, et al.
Publicado: (2026)
VILLS -- Video-Image Learning to Learn Semantics for Person Re-Identification
por: Huang, Siyuan, et al.
Publicado: (2023)
por: Huang, Siyuan, et al.
Publicado: (2023)
CAM3R: Camera-Agnostic Model for 3D Reconstruction
por: Guruprasad, Namitha, et al.
Publicado: (2026)
por: Guruprasad, Namitha, et al.
Publicado: (2026)
Zero-Shot Scene Understanding for Automatic Target Recognition Using Large Vision-Language Models
por: Ranasinghe, Yasiru, et al.
Publicado: (2025)
por: Ranasinghe, Yasiru, et al.
Publicado: (2025)
PETALface: Parameter Efficient Transfer Learning for Low-resolution Face Recognition
por: Narayan, Kartik, et al.
Publicado: (2024)
por: Narayan, Kartik, et al.
Publicado: (2024)
Distillation-guided Representation Learning for Unconstrained Gait Recognition
por: Guo, Yuxiang, et al.
Publicado: (2023)
por: Guo, Yuxiang, et al.
Publicado: (2023)
Leveraging Pre-Trained Visual Models for AI-Generated Video Detection
por: Veeramachaneni, Keerthi, et al.
Publicado: (2025)
por: Veeramachaneni, Keerthi, et al.
Publicado: (2025)
RANKVIDEO: Reasoning Reranking for Text-to-Video Retrieval
por: Skow, Tyler, et al.
Publicado: (2026)
por: Skow, Tyler, et al.
Publicado: (2026)
FusionRF: High-Fidelity Satellite Neural Radiance Fields from Multispectral and Panchromatic Acquisitions
por: Sprintson, Michael, et al.
Publicado: (2024)
por: Sprintson, Michael, et al.
Publicado: (2024)
Enrich and Detect: Video Temporal Grounding with Multimodal LLMs
por: Pramanick, Shraman, et al.
Publicado: (2025)
por: Pramanick, Shraman, et al.
Publicado: (2025)
Training-free Video Temporal Grounding using Large-scale Pre-trained Models
por: Zheng, Minghang, et al.
Publicado: (2024)
por: Zheng, Minghang, et al.
Publicado: (2024)
Recovering Pulse Waves from Video Using Deep Unrolling and Deep Equilibrium Models
por: Shenoy, Vineet R, et al.
Publicado: (2025)
por: Shenoy, Vineet R, et al.
Publicado: (2025)
SPIDER: Spatial Image CorresponDence Estimator for Robust Calibration
por: Shao, Zhimin, et al.
Publicado: (2025)
por: Shao, Zhimin, et al.
Publicado: (2025)
SPIQA: A Dataset for Multimodal Question Answering on Scientific Papers
por: Pramanick, Shraman, et al.
Publicado: (2024)
por: Pramanick, Shraman, et al.
Publicado: (2024)
DiffRegCD: Integrated Registration and Change Detection with Diffusion Features
por: Madani, Seyedehanita, et al.
Publicado: (2025)
por: Madani, Seyedehanita, et al.
Publicado: (2025)
PromptGAR: Flexible Promptive Group Activity Recognition
por: Jin, Zhangyu, et al.
Publicado: (2025)
por: Jin, Zhangyu, et al.
Publicado: (2025)
Encoding of Demographic and Anatomical Information in Chest X-Ray-based Severe Left Ventricular Hypertrophy Classifiers
por: Pal, Basudha, et al.
Publicado: (2025)
por: Pal, Basudha, et al.
Publicado: (2025)
Towards Open-World Gesture Recognition
por: Shen, Junxiao, et al.
Publicado: (2024)
por: Shen, Junxiao, et al.
Publicado: (2024)
Boosting Gesture Recognition with an Automatic Gesture Annotation Framework
por: Shen, Junxiao, et al.
Publicado: (2024)
por: Shen, Junxiao, et al.
Publicado: (2024)
FaceXFormer: A Unified Transformer for Facial Analysis
por: Narayan, Kartik, et al.
Publicado: (2024)
por: Narayan, Kartik, et al.
Publicado: (2024)
Zero-shot Prompt-based Video Encoder for Surgical Gesture Recognition
por: Rao, Mingxing, et al.
Publicado: (2024)
por: Rao, Mingxing, et al.
Publicado: (2024)
Mesh-Gait: A Unified Framework for Gait Recognition Through Multi-Modal Representation Learning from 2D Silhouettes
por: Wang, Zhao-Yang, et al.
Publicado: (2025)
por: Wang, Zhao-Yang, et al.
Publicado: (2025)
Ejemplares similares
-
Unsupervised Video Domain Adaptation with Masked Pre-Training and Collaborative Self-Training
por: Reddy, Arun, et al.
Publicado: (2023) -
Synthetic-to-Real Domain Adaptation for Action Recognition: A Dataset and Baseline Performances
por: Reddy, Arun V., et al.
Publicado: (2023) -
MultLFG: Training-free Multi-LoRA composition using Frequency-domain Guidance
por: Roy, Aniket, et al.
Publicado: (2025) -
MV2MAE: Multi-View Video Masked Autoencoders
por: Shah, Ketul, et al.
Publicado: (2024) -
MimicGait: A Model Agnostic approach for Occluded Gait Recognition using Correlational Knowledge Distillation
por: Gupta, Ayush, et al.
Publicado: (2025)