Webcam-based Pupil Diameter Prediction Benefits from Upscaling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shah, Vijul, Moser, Brian B., Watanabe, Ko, Dengel, Andreas |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PupilSense: A Novel Application for Webcam-Based Pupil Diameter Estimation
par: Shah, Vijul, et autres
Publié: (2024)
par: Shah, Vijul, et autres
Publié: (2024)
Zoomed In, Diffused Out: Towards Local Degradation-Aware Multi-Diffusion for Extreme Image Super-Resolution
par: Moser, Brian B., et autres
Publié: (2024)
par: Moser, Brian B., et autres
Publié: (2024)
Diffusion Models, Image Super-Resolution And Everything: A Survey
par: Moser, Brian B., et autres
Publié: (2024)
par: Moser, Brian B., et autres
Publié: (2024)
A Low-Resolution Image is Worth 1x1 Words: Enabling Fine Image Super-Resolution with Transformers and TaylorShift
par: Nagaraju, Sanath Budakegowdanadoddi, et autres
Publié: (2024)
par: Nagaraju, Sanath Budakegowdanadoddi, et autres
Publié: (2024)
Multi-Label Scene Classification in Remote Sensing Benefits from Image Super-Resolution
par: Mudraje, Ashitha, et autres
Publié: (2025)
par: Mudraje, Ashitha, et autres
Publié: (2025)
LLM-based Fusion of Multi-modal Features for Commercial Memorability Prediction
par: Pramov, Aleksandar
Publié: (2025)
par: Pramov, Aleksandar
Publié: (2025)
Detecting Multimodal Situations with Insufficient Context and Abstaining from Baseless Predictions
par: Liu, Junzhang, et autres
Publié: (2024)
par: Liu, Junzhang, et autres
Publié: (2024)
Creatively Upscaling Images with Global-Regional Priors
par: Qian, Yurui, et autres
Publié: (2025)
par: Qian, Yurui, et autres
Publié: (2025)
Rethink Predicting the Optical Flow with the Kinetics Perspective
par: Cheng, Yuhao, et autres
Publié: (2024)
par: Cheng, Yuhao, et autres
Publié: (2024)
Cross-modal Causal Intervention for Alzheimer's Disease Prediction
par: Jin, Yutao, et autres
Publié: (2025)
par: Jin, Yutao, et autres
Publié: (2025)
VidCtx: Context-aware Video Question Answering with Image Models
par: Goulas, Andreas, et autres
Publié: (2024)
par: Goulas, Andreas, et autres
Publié: (2024)
TheoremExplainAgent: Towards Video-based Multimodal Explanations for LLM Theorem Understanding
par: Ku, Max, et autres
Publié: (2025)
par: Ku, Max, et autres
Publié: (2025)
Handling Missing Modalities in Multimodal Survival Prediction for Non-Small Cell Lung Cancer
par: Ruffini, Filippo, et autres
Publié: (2026)
par: Ruffini, Filippo, et autres
Publié: (2026)
A Novel Multimodal System to Predict Agitation in People with Dementia Within Clinical Settings: A Proof of Concept
par: Badawi, Abeer, et autres
Publié: (2024)
par: Badawi, Abeer, et autres
Publié: (2024)
Exploiting LMM-based knowledge for image classification tasks
par: Tzelepi, Maria, et autres
Publié: (2024)
par: Tzelepi, Maria, et autres
Publié: (2024)
LPM 1.0: Video-based Character Performance Model
par: Zeng, Ailing, et autres
Publié: (2026)
par: Zeng, Ailing, et autres
Publié: (2026)
Case-based reasoning approach for diagnostic screening of children with developmental delays
par: Song, Zichen, et autres
Publié: (2024)
par: Song, Zichen, et autres
Publié: (2024)
A multi-purpose automatic editing system based on lecture semantics for remote education
par: Hu, Panwen, et autres
Publié: (2024)
par: Hu, Panwen, et autres
Publié: (2024)
Q-Ponder: A Unified Training Pipeline for Reasoning-based Visual Quality Assessment
par: Cai, Zhuoxuan, et autres
Publié: (2025)
par: Cai, Zhuoxuan, et autres
Publié: (2025)
High-fidelity and Lip-synced Talking Face Synthesis via Landmark-based Diffusion Model
par: Zhong, Weizhi, et autres
Publié: (2024)
par: Zhong, Weizhi, et autres
Publié: (2024)
Can Large Language Models Grasp Event Signals? Exploring Pure Zero-Shot Event-based Recognition
par: Yu, Zongyou, et autres
Publié: (2024)
par: Yu, Zongyou, et autres
Publié: (2024)
PoseTalk: Text-and-Audio-based Pose Control and Motion Refinement for One-Shot Talking Head Generation
par: Ling, Jun, et autres
Publié: (2024)
par: Ling, Jun, et autres
Publié: (2024)
Anti-Inpainting: A Proactive Defense Approach against Malicious Diffusion-based Inpainters under Unknown Conditions
par: Guo, Yimao, et autres
Publié: (2025)
par: Guo, Yimao, et autres
Publié: (2025)
CLASP: Cross-modal Salient Anchor-based Semantic Propagation for Weakly-supervised Dense Audio-Visual Event Localization
par: Zhou, Jinxing, et autres
Publié: (2025)
par: Zhou, Jinxing, et autres
Publié: (2025)
Parents and Children: Distinguishing Multimodal DeepFakes from Natural Images
par: Amoroso, Roberto, et autres
Publié: (2023)
par: Amoroso, Roberto, et autres
Publié: (2023)
Controllable Audio-Visual Viewpoint Generation from 360° Spatial Information
par: Marinoni, Christian, et autres
Publié: (2025)
par: Marinoni, Christian, et autres
Publié: (2025)
Composing Concepts from Images and Videos via Concept-prompt Binding
par: Kong, Xianghao, et autres
Publié: (2025)
par: Kong, Xianghao, et autres
Publié: (2025)
Automatic Recognition of Food Ingestion Environment from the AIM-2 Wearable Sensor
par: Huang, Yuning, et autres
Publié: (2024)
par: Huang, Yuning, et autres
Publié: (2024)
GGAvatar: Reconstructing Garment-Separated 3D Gaussian Splatting Avatars from Monocular Video
par: Chen, Jingxuan
Publié: (2024)
par: Chen, Jingxuan
Publié: (2024)
Lumos-1: On Autoregressive Video Generation with Discrete Diffusion from a Unified Model Perspective
par: Yuan, Hangjie, et autres
Publié: (2025)
par: Yuan, Hangjie, et autres
Publié: (2025)
Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation
par: Yu, Lijun, et autres
Publié: (2023)
par: Yu, Lijun, et autres
Publié: (2023)
KAN Text to Vision? The Exploration of Kolmogorov-Arnold Networks for Multi-Scale Sequence-Based Pose Animation from Sign Language Notation
par: Du, Guanyi, et autres
Publié: (2026)
par: Du, Guanyi, et autres
Publié: (2026)
How Far Are Surgeons from Surgical World Models? A Pilot Study on Zero-shot Surgical Video Generation with Expert Assessment
par: Chen, Zhen, et autres
Publié: (2025)
par: Chen, Zhen, et autres
Publié: (2025)
VideoConviction: A Multimodal Benchmark for Human Conviction and Stock Market Recommendations
par: Galarnyk, Michael, et autres
Publié: (2025)
par: Galarnyk, Michael, et autres
Publié: (2025)
Zero-Shot Visual Deepfake Detection: Can AI Predict and Prevent Fake Content Before It's Created?
par: Sar, Ayan, et autres
Publié: (2025)
par: Sar, Ayan, et autres
Publié: (2025)
TbExplain: A Text-based Explanation Method for Scene Classification Models with the Statistical Prediction Correction
par: Aminimehr, Amirhossein, et autres
Publié: (2023)
par: Aminimehr, Amirhossein, et autres
Publié: (2023)
IRR: Image Review Ranking Framework for Evaluating Vision-Language Models
par: Hayashi, Kazuki, et autres
Publié: (2024)
par: Hayashi, Kazuki, et autres
Publié: (2024)
Question-Answering Dense Video Events
par: Qin, Hangyu, et autres
Publié: (2024)
par: Qin, Hangyu, et autres
Publié: (2024)
Cross-domain Multi-step Thinking: Zero-shot Fine-grained Traffic Sign Recognition in the Wild
par: Gan, Yaozong, et autres
Publié: (2024)
par: Gan, Yaozong, et autres
Publié: (2024)
Multimodal Markup Document Models for Graphic Design Completion
par: Kikuchi, Kotaro, et autres
Publié: (2024)
par: Kikuchi, Kotaro, et autres
Publié: (2024)
Documents similaires
-
PupilSense: A Novel Application for Webcam-Based Pupil Diameter Estimation
par: Shah, Vijul, et autres
Publié: (2024) -
Zoomed In, Diffused Out: Towards Local Degradation-Aware Multi-Diffusion for Extreme Image Super-Resolution
par: Moser, Brian B., et autres
Publié: (2024) -
Diffusion Models, Image Super-Resolution And Everything: A Survey
par: Moser, Brian B., et autres
Publié: (2024) -
A Low-Resolution Image is Worth 1x1 Words: Enabling Fine Image Super-Resolution with Transformers and TaylorShift
par: Nagaraju, Sanath Budakegowdanadoddi, et autres
Publié: (2024) -
Multi-Label Scene Classification in Remote Sensing Benefits from Image Super-Resolution
par: Mudraje, Ashitha, et autres
Publié: (2025)