Webcam-based Pupil Diameter Prediction Benefits from Upscaling
Fuente:
arXiv
Guardado en:
| Autores principales: | Shah, Vijul, Moser, Brian B., Watanabe, Ko, Dengel, Andreas |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PupilSense: A Novel Application for Webcam-Based Pupil Diameter Estimation
por: Shah, Vijul, et al.
Publicado: (2024)
por: Shah, Vijul, et al.
Publicado: (2024)
Zoomed In, Diffused Out: Towards Local Degradation-Aware Multi-Diffusion for Extreme Image Super-Resolution
por: Moser, Brian B., et al.
Publicado: (2024)
por: Moser, Brian B., et al.
Publicado: (2024)
Diffusion Models, Image Super-Resolution And Everything: A Survey
por: Moser, Brian B., et al.
Publicado: (2024)
por: Moser, Brian B., et al.
Publicado: (2024)
A Low-Resolution Image is Worth 1x1 Words: Enabling Fine Image Super-Resolution with Transformers and TaylorShift
por: Nagaraju, Sanath Budakegowdanadoddi, et al.
Publicado: (2024)
por: Nagaraju, Sanath Budakegowdanadoddi, et al.
Publicado: (2024)
Multi-Label Scene Classification in Remote Sensing Benefits from Image Super-Resolution
por: Mudraje, Ashitha, et al.
Publicado: (2025)
por: Mudraje, Ashitha, et al.
Publicado: (2025)
LLM-based Fusion of Multi-modal Features for Commercial Memorability Prediction
por: Pramov, Aleksandar
Publicado: (2025)
por: Pramov, Aleksandar
Publicado: (2025)
Detecting Multimodal Situations with Insufficient Context and Abstaining from Baseless Predictions
por: Liu, Junzhang, et al.
Publicado: (2024)
por: Liu, Junzhang, et al.
Publicado: (2024)
Creatively Upscaling Images with Global-Regional Priors
por: Qian, Yurui, et al.
Publicado: (2025)
por: Qian, Yurui, et al.
Publicado: (2025)
Rethink Predicting the Optical Flow with the Kinetics Perspective
por: Cheng, Yuhao, et al.
Publicado: (2024)
por: Cheng, Yuhao, et al.
Publicado: (2024)
Cross-modal Causal Intervention for Alzheimer's Disease Prediction
por: Jin, Yutao, et al.
Publicado: (2025)
por: Jin, Yutao, et al.
Publicado: (2025)
VidCtx: Context-aware Video Question Answering with Image Models
por: Goulas, Andreas, et al.
Publicado: (2024)
por: Goulas, Andreas, et al.
Publicado: (2024)
TheoremExplainAgent: Towards Video-based Multimodal Explanations for LLM Theorem Understanding
por: Ku, Max, et al.
Publicado: (2025)
por: Ku, Max, et al.
Publicado: (2025)
Handling Missing Modalities in Multimodal Survival Prediction for Non-Small Cell Lung Cancer
por: Ruffini, Filippo, et al.
Publicado: (2026)
por: Ruffini, Filippo, et al.
Publicado: (2026)
A Novel Multimodal System to Predict Agitation in People with Dementia Within Clinical Settings: A Proof of Concept
por: Badawi, Abeer, et al.
Publicado: (2024)
por: Badawi, Abeer, et al.
Publicado: (2024)
Exploiting LMM-based knowledge for image classification tasks
por: Tzelepi, Maria, et al.
Publicado: (2024)
por: Tzelepi, Maria, et al.
Publicado: (2024)
LPM 1.0: Video-based Character Performance Model
por: Zeng, Ailing, et al.
Publicado: (2026)
por: Zeng, Ailing, et al.
Publicado: (2026)
Case-based reasoning approach for diagnostic screening of children with developmental delays
por: Song, Zichen, et al.
Publicado: (2024)
por: Song, Zichen, et al.
Publicado: (2024)
A multi-purpose automatic editing system based on lecture semantics for remote education
por: Hu, Panwen, et al.
Publicado: (2024)
por: Hu, Panwen, et al.
Publicado: (2024)
Q-Ponder: A Unified Training Pipeline for Reasoning-based Visual Quality Assessment
por: Cai, Zhuoxuan, et al.
Publicado: (2025)
por: Cai, Zhuoxuan, et al.
Publicado: (2025)
High-fidelity and Lip-synced Talking Face Synthesis via Landmark-based Diffusion Model
por: Zhong, Weizhi, et al.
Publicado: (2024)
por: Zhong, Weizhi, et al.
Publicado: (2024)
Can Large Language Models Grasp Event Signals? Exploring Pure Zero-Shot Event-based Recognition
por: Yu, Zongyou, et al.
Publicado: (2024)
por: Yu, Zongyou, et al.
Publicado: (2024)
PoseTalk: Text-and-Audio-based Pose Control and Motion Refinement for One-Shot Talking Head Generation
por: Ling, Jun, et al.
Publicado: (2024)
por: Ling, Jun, et al.
Publicado: (2024)
Anti-Inpainting: A Proactive Defense Approach against Malicious Diffusion-based Inpainters under Unknown Conditions
por: Guo, Yimao, et al.
Publicado: (2025)
por: Guo, Yimao, et al.
Publicado: (2025)
CLASP: Cross-modal Salient Anchor-based Semantic Propagation for Weakly-supervised Dense Audio-Visual Event Localization
por: Zhou, Jinxing, et al.
Publicado: (2025)
por: Zhou, Jinxing, et al.
Publicado: (2025)
Parents and Children: Distinguishing Multimodal DeepFakes from Natural Images
por: Amoroso, Roberto, et al.
Publicado: (2023)
por: Amoroso, Roberto, et al.
Publicado: (2023)
Controllable Audio-Visual Viewpoint Generation from 360° Spatial Information
por: Marinoni, Christian, et al.
Publicado: (2025)
por: Marinoni, Christian, et al.
Publicado: (2025)
Composing Concepts from Images and Videos via Concept-prompt Binding
por: Kong, Xianghao, et al.
Publicado: (2025)
por: Kong, Xianghao, et al.
Publicado: (2025)
Automatic Recognition of Food Ingestion Environment from the AIM-2 Wearable Sensor
por: Huang, Yuning, et al.
Publicado: (2024)
por: Huang, Yuning, et al.
Publicado: (2024)
GGAvatar: Reconstructing Garment-Separated 3D Gaussian Splatting Avatars from Monocular Video
por: Chen, Jingxuan
Publicado: (2024)
por: Chen, Jingxuan
Publicado: (2024)
Lumos-1: On Autoregressive Video Generation with Discrete Diffusion from a Unified Model Perspective
por: Yuan, Hangjie, et al.
Publicado: (2025)
por: Yuan, Hangjie, et al.
Publicado: (2025)
Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation
por: Yu, Lijun, et al.
Publicado: (2023)
por: Yu, Lijun, et al.
Publicado: (2023)
KAN Text to Vision? The Exploration of Kolmogorov-Arnold Networks for Multi-Scale Sequence-Based Pose Animation from Sign Language Notation
por: Du, Guanyi, et al.
Publicado: (2026)
por: Du, Guanyi, et al.
Publicado: (2026)
How Far Are Surgeons from Surgical World Models? A Pilot Study on Zero-shot Surgical Video Generation with Expert Assessment
por: Chen, Zhen, et al.
Publicado: (2025)
por: Chen, Zhen, et al.
Publicado: (2025)
VideoConviction: A Multimodal Benchmark for Human Conviction and Stock Market Recommendations
por: Galarnyk, Michael, et al.
Publicado: (2025)
por: Galarnyk, Michael, et al.
Publicado: (2025)
Zero-Shot Visual Deepfake Detection: Can AI Predict and Prevent Fake Content Before It's Created?
por: Sar, Ayan, et al.
Publicado: (2025)
por: Sar, Ayan, et al.
Publicado: (2025)
TbExplain: A Text-based Explanation Method for Scene Classification Models with the Statistical Prediction Correction
por: Aminimehr, Amirhossein, et al.
Publicado: (2023)
por: Aminimehr, Amirhossein, et al.
Publicado: (2023)
IRR: Image Review Ranking Framework for Evaluating Vision-Language Models
por: Hayashi, Kazuki, et al.
Publicado: (2024)
por: Hayashi, Kazuki, et al.
Publicado: (2024)
Question-Answering Dense Video Events
por: Qin, Hangyu, et al.
Publicado: (2024)
por: Qin, Hangyu, et al.
Publicado: (2024)
Cross-domain Multi-step Thinking: Zero-shot Fine-grained Traffic Sign Recognition in the Wild
por: Gan, Yaozong, et al.
Publicado: (2024)
por: Gan, Yaozong, et al.
Publicado: (2024)
Multimodal Markup Document Models for Graphic Design Completion
por: Kikuchi, Kotaro, et al.
Publicado: (2024)
por: Kikuchi, Kotaro, et al.
Publicado: (2024)
Ejemplares similares
-
PupilSense: A Novel Application for Webcam-Based Pupil Diameter Estimation
por: Shah, Vijul, et al.
Publicado: (2024) -
Zoomed In, Diffused Out: Towards Local Degradation-Aware Multi-Diffusion for Extreme Image Super-Resolution
por: Moser, Brian B., et al.
Publicado: (2024) -
Diffusion Models, Image Super-Resolution And Everything: A Survey
por: Moser, Brian B., et al.
Publicado: (2024) -
A Low-Resolution Image is Worth 1x1 Words: Enabling Fine Image Super-Resolution with Transformers and TaylorShift
por: Nagaraju, Sanath Budakegowdanadoddi, et al.
Publicado: (2024) -
Multi-Label Scene Classification in Remote Sensing Benefits from Image Super-Resolution
por: Mudraje, Ashitha, et al.
Publicado: (2025)