Exploring Object Status Recognition for Recipe Progress Tracking in Non-Visual Cooking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Franklin Mingzhe, Ng, Kaitlyn, Zhu, Bin, Carrington, Patrick |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
OSCAR: Object Status and Contextual Awareness for Recipes to Support Non-Visual Cooking
par: Li, Franklin Mingzhe, et autres
Publié: (2025)
par: Li, Franklin Mingzhe, et autres
Publié: (2025)
A Recipe for Success? Exploring Strategies for Improving Non-Visual Access to Cooking Instructions
par: Li, Franklin Mingzhe, et autres
Publié: (2024)
par: Li, Franklin Mingzhe, et autres
Publié: (2024)
More than One Step at a Time: Designing Procedural Feedback for Non-visual Makeup Routines
par: Li, Franklin Mingzhe, et autres
Publié: (2025)
par: Li, Franklin Mingzhe, et autres
Publié: (2025)
Evaluating Visual Prompts with Eye-Tracking Data for MLLM-Based Human Activity Recognition
par: Choi, Jae Young, et autres
Publié: (2026)
par: Choi, Jae Young, et autres
Publié: (2026)
A Contextual Inquiry of People with Vision Impairments in Cooking
par: Li, Franklin Mingzhe, et autres
Publié: (2024)
par: Li, Franklin Mingzhe, et autres
Publié: (2024)
DeepSORT-Driven Visual Tracking Approach for Gesture Recognition in Interactive Systems
par: Zhang, Tong, et autres
Publié: (2025)
par: Zhang, Tong, et autres
Publié: (2025)
Deep Learning-based Lightweight RGB Object Tracking for Augmented Reality Devices
par: Smith, Alice, et autres
Publié: (2025)
par: Smith, Alice, et autres
Publié: (2025)
Distinguishing Target and Non-Target Fixations with EEG and Eye Tracking in Realistic Visual Scenes
par: Sharma, Mansi, et autres
Publié: (2025)
par: Sharma, Mansi, et autres
Publié: (2025)
EEG-based Multimodal Representation Learning for Emotion Recognition
par: Yin, Kang, et autres
Publié: (2024)
par: Yin, Kang, et autres
Publié: (2024)
Automated Visual Attention Detection using Mobile Eye Tracking in Behavioral Classroom Studies
par: Bozkir, Efe, et autres
Publié: (2025)
par: Bozkir, Efe, et autres
Publié: (2025)
FineCLIPER: Multi-modal Fine-grained CLIP for Dynamic Facial Expression Recognition with AdaptERs
par: Chen, Haodong, et autres
Publié: (2024)
par: Chen, Haodong, et autres
Publié: (2024)
Beyond Object Categories: Multi-Attribute Reference Understanding for Visual Grounding
par: Guo, Hao, et autres
Publié: (2025)
par: Guo, Hao, et autres
Publié: (2025)
From Coarse to Nuanced: Cross-Modal Alignment of Fine-Grained Linguistic Cues and Visual Salient Regions for Dynamic Emotion Recognition
par: Liu, Yu, et autres
Publié: (2025)
par: Liu, Yu, et autres
Publié: (2025)
Unsupervised Domain Adaptation for RF-based Gesture Recognition
par: Zhang, Bin-Bin, et autres
Publié: (2021)
par: Zhang, Bin-Bin, et autres
Publié: (2021)
WheelPoser: Sparse-IMU Based Body Pose Estimation for Wheelchair Users
par: Li, Yunzhi, et autres
Publié: (2024)
par: Li, Yunzhi, et autres
Publié: (2024)
In-Depth Analysis of Emotion Recognition through Knowledge-Based Large Language Models
par: Han, Bin, et autres
Publié: (2024)
par: Han, Bin, et autres
Publié: (2024)
SwipeGANSpace: Swipe-to-Compare Image Generation via Efficient Latent Space Exploration
par: Nakashima, Yuto, et autres
Publié: (2024)
par: Nakashima, Yuto, et autres
Publié: (2024)
A Dataset for Crucial Object Recognition in Blind and Low-Vision Individuals' Navigation
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
Object Recognition in Human Computer Interaction:- A Comparative Analysis
par: Ranade, Kaushik, et autres
Publié: (2024)
par: Ranade, Kaushik, et autres
Publié: (2024)
ViEEG: Hierarchical Visual Neural Representation for EEG Brain Decoding
par: Liu, Minxu, et autres
Publié: (2025)
par: Liu, Minxu, et autres
Publié: (2025)
FocusUI: Efficient UI Grounding via Position-Preserving Visual Token Selection
par: Ouyang, Mingyu, et autres
Publié: (2026)
par: Ouyang, Mingyu, et autres
Publié: (2026)
Towards an End-to-End System for 3D Tracking of Physical Objects in Virtual Immersive Environments
par: Knapiński, Stanisław, et autres
Publié: (2026)
par: Knapiński, Stanisław, et autres
Publié: (2026)
AROMA: Mixed-Initiative AI Assistance for Non-Visual Cooking by Grounding Multi-modal Information Between Reality and Videos
par: Ning, Zheng, et autres
Publié: (2025)
par: Ning, Zheng, et autres
Publié: (2025)
ObjectGS: Object-aware Scene Reconstruction and Scene Understanding via Gaussian Splatting
par: Zhu, Ruijie, et autres
Publié: (2025)
par: Zhu, Ruijie, et autres
Publié: (2025)
Implicit Search Intent Recognition using EEG and Eye Tracking: Novel Dataset and Cross-User Prediction
par: Sharma, Mansi, et autres
Publié: (2025)
par: Sharma, Mansi, et autres
Publié: (2025)
Exploring Thermography Technology: A Comprehensive Facial Dataset for Face Detection, Recognition, and Emotion
par: Abuhussein, Mohamed Fawzi Abdelshafie, et autres
Publié: (2024)
par: Abuhussein, Mohamed Fawzi Abdelshafie, et autres
Publié: (2024)
Creo: From One-Shot Image Generation to Progressive, Co-Creative Ideation
par: De Simone, Zoe, et autres
Publié: (2026)
par: De Simone, Zoe, et autres
Publié: (2026)
Summary of the Unusual Activity Recognition Challenge for Developmental Disability Support
par: Garcia, Christina, et autres
Publié: (2026)
par: Garcia, Christina, et autres
Publié: (2026)
MOTION: ML-Assisted On-Device Low-Latency Motion Recognition
par: Pugazhenthi, Veeramani, et autres
Publié: (2025)
par: Pugazhenthi, Veeramani, et autres
Publié: (2025)
Triple Spectral Fusion for Sensor-based Human Activity Recognition
par: Zhang, Ye, et autres
Publié: (2026)
par: Zhang, Ye, et autres
Publié: (2026)
VILOD: A Visual Interactive Labeling Tool for Object Detection
par: Holm, Isac
Publié: (2025)
par: Holm, Isac
Publié: (2025)
Reading Smiles: Proxy Bias in Foundation Models for Facial Emotion Recognition
par: Tsangko, Iosif, et autres
Publié: (2025)
par: Tsangko, Iosif, et autres
Publié: (2025)
Milmer: a Framework for Multiple Instance Learning based Multimodal Emotion Recognition
par: Wang, Zaitian, et autres
Publié: (2025)
par: Wang, Zaitian, et autres
Publié: (2025)
CG-MER: A Card Game-based Multimodal dataset for Emotion Recognition
par: Farhat, Nessrine, et autres
Publié: (2025)
par: Farhat, Nessrine, et autres
Publié: (2025)
Modelling the Interplay of Eye-Tracking Temporal Dynamics and Personality for Emotion Detection in Face-to-Face Settings
par: Seikavandi, Meisam J., et autres
Publié: (2025)
par: Seikavandi, Meisam J., et autres
Publié: (2025)
OLMD: Orientation-aware Long-term Motion Decoupling for Continuous Sign Language Recognition
par: Yu, Yiheng, et autres
Publié: (2025)
par: Yu, Yiheng, et autres
Publié: (2025)
AuraMask: An Extensible Pipeline for Developing Aesthetic Anti-Facial Recognition Image Filters
par: Lagogiannis, Jacob, et autres
Publié: (2026)
par: Lagogiannis, Jacob, et autres
Publié: (2026)
SASG-DA: Sparse-Aware Semantic-Guided Diffusion Augmentation For Myoelectric Gesture Recognition
par: Liu, Chen, et autres
Publié: (2025)
par: Liu, Chen, et autres
Publié: (2025)
LEyes: A Lightweight Framework for Deep Learning-Based Eye Tracking using Synthetic Eye Images
par: Byrne, Sean Anthony, et autres
Publié: (2023)
par: Byrne, Sean Anthony, et autres
Publié: (2023)
GameWorld: Towards Standardized and Verifiable Evaluation of Multimodal Game Agents
par: Ouyang, Mingyu, et autres
Publié: (2026)
par: Ouyang, Mingyu, et autres
Publié: (2026)
Documents similaires
-
OSCAR: Object Status and Contextual Awareness for Recipes to Support Non-Visual Cooking
par: Li, Franklin Mingzhe, et autres
Publié: (2025) -
A Recipe for Success? Exploring Strategies for Improving Non-Visual Access to Cooking Instructions
par: Li, Franklin Mingzhe, et autres
Publié: (2024) -
More than One Step at a Time: Designing Procedural Feedback for Non-visual Makeup Routines
par: Li, Franklin Mingzhe, et autres
Publié: (2025) -
Evaluating Visual Prompts with Eye-Tracking Data for MLLM-Based Human Activity Recognition
par: Choi, Jae Young, et autres
Publié: (2026) -
A Contextual Inquiry of People with Vision Impairments in Cooking
par: Li, Franklin Mingzhe, et autres
Publié: (2024)