Object Recognition in Human Computer Interaction:- A Comparative Analysis
Fuente:
arXiv
Salvato in:
| Autori principali: | Ranade, Kaushik, Khule, Tanmay, More, Riddhi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond One-Size-Fits-All: A Survey of Personalized Affective Computing in Human-Agent Interaction
di: Li, Jialin, et al.
Pubblicazione: (2023)
di: Li, Jialin, et al.
Pubblicazione: (2023)
VILOD: A Visual Interactive Labeling Tool for Object Detection
di: Holm, Isac
Pubblicazione: (2025)
di: Holm, Isac
Pubblicazione: (2025)
Monocular 3D Object Position Estimation with VLMs for Human-Robot Interaction
di: Wahl, Ari, et al.
Pubblicazione: (2026)
di: Wahl, Ari, et al.
Pubblicazione: (2026)
Learning with Category-Equivariant Representations for Human Activity Recognition
di: Maruyama, Yoshihiro
Pubblicazione: (2025)
di: Maruyama, Yoshihiro
Pubblicazione: (2025)
Learning with Category-Equivariant Architectures for Human Activity Recognition
di: Maruyama, Yoshihiro
Pubblicazione: (2025)
di: Maruyama, Yoshihiro
Pubblicazione: (2025)
ArtWhisperer: A Dataset for Characterizing Human-AI Interactions in Artistic Creations
di: Vodrahalli, Kailas, et al.
Pubblicazione: (2023)
di: Vodrahalli, Kailas, et al.
Pubblicazione: (2023)
Bridging Human Concepts and Computer Vision for Explainable Face Verification
di: Doh, Miriam, et al.
Pubblicazione: (2024)
di: Doh, Miriam, et al.
Pubblicazione: (2024)
On the Interpretability of Part-Prototype Based Classifiers: A Human Centric Analysis
di: Davoodi, Omid, et al.
Pubblicazione: (2023)
di: Davoodi, Omid, et al.
Pubblicazione: (2023)
A Cloud-Based Cross-Modal Transformer for Emotion Recognition and Adaptive Human-Computer Interaction
di: Zhong, Ziwen, et al.
Pubblicazione: (2025)
di: Zhong, Ziwen, et al.
Pubblicazione: (2025)
Efficient Retail Video Annotation: A Robust Key Frame Generation Approach for Product and Customer Interaction Analysis
di: Mannam, Varun, et al.
Pubblicazione: (2025)
di: Mannam, Varun, et al.
Pubblicazione: (2025)
Interaction as Explanation: A User Interaction-based Method for Explaining Image Classification Models
di: Yun, Hyeonggeun
Pubblicazione: (2024)
di: Yun, Hyeonggeun
Pubblicazione: (2024)
Continuous Human Action Recognition for Human-Machine Interaction: A Review
di: Gammulle, Harshala, et al.
Pubblicazione: (2022)
di: Gammulle, Harshala, et al.
Pubblicazione: (2022)
Deep Generative Domain Adaptation with Temporal Attention for Cross-User Activity Recognition
di: Ye, Xiaozhou, et al.
Pubblicazione: (2024)
di: Ye, Xiaozhou, et al.
Pubblicazione: (2024)
How Good is ChatGPT at Audiovisual Deepfake Detection: A Comparative Study of ChatGPT, AI Models and Human Perception
di: Shahzad, Sahibzada Adil, et al.
Pubblicazione: (2024)
di: Shahzad, Sahibzada Adil, et al.
Pubblicazione: (2024)
Generating Synthetic Satellite Imagery for Rare Objects: An Empirical Comparison of Models and Metrics
di: Nguyen, Tuong Vy, et al.
Pubblicazione: (2024)
di: Nguyen, Tuong Vy, et al.
Pubblicazione: (2024)
Deep Generative Domain Adaptation with Temporal Relation Knowledge for Cross-User Activity Recognition
di: Ye, Xiaozhou, et al.
Pubblicazione: (2024)
di: Ye, Xiaozhou, et al.
Pubblicazione: (2024)
Deep Learning Based Approach to Enhanced Recognition of Emotions and Behavioral Patterns of Autistic Children
di: R, Nelaka K. A., et al.
Pubblicazione: (2025)
di: R, Nelaka K. A., et al.
Pubblicazione: (2025)
RadioActive: 3D Radiological Interactive Segmentation Benchmark
di: Ulrich, Constantin, et al.
Pubblicazione: (2024)
di: Ulrich, Constantin, et al.
Pubblicazione: (2024)
Looking for a better fit? An Incremental Learning Multimodal Object Referencing Framework adapting to Individual Drivers
di: Gomaa, Amr, et al.
Pubblicazione: (2024)
di: Gomaa, Amr, et al.
Pubblicazione: (2024)
InterVLS: Interactive Model Understanding and Improvement with Vision-Language Surrogates
di: Huang, Jinbin, et al.
Pubblicazione: (2023)
di: Huang, Jinbin, et al.
Pubblicazione: (2023)
Fusing Forces: Deep-Human-Guided Refinement of Segmentation Masks
di: Sterzinger, Rafael, et al.
Pubblicazione: (2024)
di: Sterzinger, Rafael, et al.
Pubblicazione: (2024)
BdSLW401: Transformer-Based Word-Level Bangla Sign Language Recognition Using Relative Quantization Encoding (RQE)
di: Rubaiyeat, Husne Ara, et al.
Pubblicazione: (2025)
di: Rubaiyeat, Husne Ara, et al.
Pubblicazione: (2025)
Dodgersort: Uncertainty-Aware VLM-Guided Human-in-the-Loop Pairwise Ranking
di: Park, Yujin, et al.
Pubblicazione: (2026)
di: Park, Yujin, et al.
Pubblicazione: (2026)
GazeTrack: High-Precision Eye Tracking Based on Regularization and Spatial Computing
di: Yang, Xiaoyin
Pubblicazione: (2025)
di: Yang, Xiaoyin
Pubblicazione: (2025)
A Foundational Generative Model for Breast Ultrasound Image Analysis
di: Yu, Haojun, et al.
Pubblicazione: (2025)
di: Yu, Haojun, et al.
Pubblicazione: (2025)
HERO: Human-Feedback Efficient Reinforcement Learning for Online Diffusion Model Finetuning
di: Hiranaka, Ayano, et al.
Pubblicazione: (2024)
di: Hiranaka, Ayano, et al.
Pubblicazione: (2024)
SpiderNets: Vision Models Predict Human Fear From Aversive Images
di: Pegler, Dominik, et al.
Pubblicazione: (2025)
di: Pegler, Dominik, et al.
Pubblicazione: (2025)
Facial Analysis Systems and Down Syndrome
di: Rondina, Marco, et al.
Pubblicazione: (2025)
di: Rondina, Marco, et al.
Pubblicazione: (2025)
C3T: Cross-modal Transfer Through Time for Sensor-based Human Activity Recognition
di: Kamboj, Abhi, et al.
Pubblicazione: (2024)
di: Kamboj, Abhi, et al.
Pubblicazione: (2024)
Human-like visual computing advances explainability and few-shot learning in deep neural networks for complex physiological data
di: Alahmadi, Alaa, et al.
Pubblicazione: (2025)
di: Alahmadi, Alaa, et al.
Pubblicazione: (2025)
Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis
di: Chaudhari, Shravan, et al.
Pubblicazione: (2025)
di: Chaudhari, Shravan, et al.
Pubblicazione: (2025)
Predicting and Explaining Mobile UI Tappability with Vision Modeling and Saliency Analysis
di: Schoop, Eldon, et al.
Pubblicazione: (2022)
di: Schoop, Eldon, et al.
Pubblicazione: (2022)
Analysis of the 2024 BraTS Meningioma Radiotherapy Planning Automated Segmentation Challenge
di: LaBella, Dominic, et al.
Pubblicazione: (2024)
di: LaBella, Dominic, et al.
Pubblicazione: (2024)
HAPI: A Model for Learning Robot Facial Expressions from Human Preferences
di: Yang, Dongsheng, et al.
Pubblicazione: (2025)
di: Yang, Dongsheng, et al.
Pubblicazione: (2025)
HOSt3R: Keypoint-free Hand-Object 3D Reconstruction from RGB images
di: Swamy, Anilkumar, et al.
Pubblicazione: (2025)
di: Swamy, Anilkumar, et al.
Pubblicazione: (2025)
BlenderRAG: High-Fidelity 3D Object Generation via Retrieval-Augmented Code Synthesis
di: Rondelli, Massimo, et al.
Pubblicazione: (2026)
di: Rondelli, Massimo, et al.
Pubblicazione: (2026)
Avatar Forcing: Real-Time Interactive Head Avatar Generation for Natural Conversation
di: Ki, Taekyung, et al.
Pubblicazione: (2026)
di: Ki, Taekyung, et al.
Pubblicazione: (2026)
Human-Agent Joint Learning for Efficient Robot Manipulation Skill Acquisition
di: Luo, Shengcheng, et al.
Pubblicazione: (2024)
di: Luo, Shengcheng, et al.
Pubblicazione: (2024)
Exploring Object Status Recognition for Recipe Progress Tracking in Non-Visual Cooking
di: Li, Franklin Mingzhe, et al.
Pubblicazione: (2025)
di: Li, Franklin Mingzhe, et al.
Pubblicazione: (2025)
Sketch2Colab: Sketch-Conditioned Multi-Human Animation via Controllable Flow Distillation
di: Daiya, Divyanshu, et al.
Pubblicazione: (2026)
di: Daiya, Divyanshu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Beyond One-Size-Fits-All: A Survey of Personalized Affective Computing in Human-Agent Interaction
di: Li, Jialin, et al.
Pubblicazione: (2023) -
VILOD: A Visual Interactive Labeling Tool for Object Detection
di: Holm, Isac
Pubblicazione: (2025) -
Monocular 3D Object Position Estimation with VLMs for Human-Robot Interaction
di: Wahl, Ari, et al.
Pubblicazione: (2026) -
Learning with Category-Equivariant Representations for Human Activity Recognition
di: Maruyama, Yoshihiro
Pubblicazione: (2025) -
Learning with Category-Equivariant Architectures for Human Activity Recognition
di: Maruyama, Yoshihiro
Pubblicazione: (2025)