GazeXplain: Learning to Predict Natural Language Explanations of Visual Scanpaths
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Xianyu, Jiang, Ming, Zhao, Qi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Average: Individualized Visual Scanpath Prediction
par: Chen, Xianyu, et autres
Publié: (2024)
par: Chen, Xianyu, et autres
Publié: (2024)
OAT: Object-Level Attention Transformer for Gaze Scanpath Prediction
par: Fang, Yini, et autres
Publié: (2024)
par: Fang, Yini, et autres
Publié: (2024)
Modeling Human Gaze Behavior with Diffusion Models for Unified Scanpath Prediction
par: Cartella, Giuseppe, et autres
Publié: (2025)
par: Cartella, Giuseppe, et autres
Publié: (2025)
Beyond Scanpaths: Graph-Based Gaze Simulation in Dynamic Scenes
par: Palmer, Luke, et autres
Publié: (2026)
par: Palmer, Luke, et autres
Publié: (2026)
Leveraging Bottom-Up and Top-Down Attention for Few-Shot Object Detection
par: Chen, Xianyu, et autres
Publié: (2020)
par: Chen, Xianyu, et autres
Publié: (2020)
CT-ScanGaze: A Dataset and Baselines for 3D Volumetric Scanpath Modeling
par: Pham, Trong-Thang, et autres
Publié: (2025)
par: Pham, Trong-Thang, et autres
Publié: (2025)
Few-shot Personalized Scanpath Prediction
par: Xue, Ruoyu, et autres
Publié: (2025)
par: Xue, Ruoyu, et autres
Publié: (2025)
Human Scanpath Prediction in Target-Present Visual Search with Semantic-Foveal Bayesian Attention
par: Luzio, João, et autres
Publié: (2025)
par: Luzio, João, et autres
Publié: (2025)
Object Referring-Guided Scanpath Prediction with Perception-Enhanced Vision-Language Models
par: Quan, Rong, et autres
Publié: (2026)
par: Quan, Rong, et autres
Publié: (2026)
MedXplain-VQA: Multi-Component Explainable Medical Visual Question Answering
par: Nguyen, Hai-Dang, et autres
Publié: (2025)
par: Nguyen, Hai-Dang, et autres
Publié: (2025)
eXplaining to Learn (eX2L): Regularization Using Contrastive Visual Explanation Pairs for Distribution Shifts
par: Medina, Paulo Mario P., et autres
Publié: (2026)
par: Medina, Paulo Mario P., et autres
Publié: (2026)
TextGaze: Gaze-Controllable Face Generation with Natural Language
par: Wang, Hengfei, et autres
Publié: (2024)
par: Wang, Hengfei, et autres
Publié: (2024)
GazeNLQ @ Ego4D Natural Language Queries Challenge 2025
par: Lin, Wei-Cheng, et autres
Publié: (2025)
par: Lin, Wei-Cheng, et autres
Publié: (2025)
Scanpath Prediction in Panoramic Videos via Expected Code Length Minimization
par: Li, Mu, et autres
Publié: (2023)
par: Li, Mu, et autres
Publié: (2023)
LG-Gaze: Learning Geometry-aware Continuous Prompts for Language-Guided Gaze Estimation
par: Yin, Pengwei, et autres
Publié: (2024)
par: Yin, Pengwei, et autres
Publié: (2024)
A Comparative Study of Scanpath Models in Graph-Based Visualization
par: Lopez-Cardona, Angela, et autres
Publié: (2025)
par: Lopez-Cardona, Angela, et autres
Publié: (2025)
EyeFormer: Predicting Personalized Scanpaths with Transformer-Guided Reinforcement Learning
par: Jiang, Yue, et autres
Publié: (2024)
par: Jiang, Yue, et autres
Publié: (2024)
Eye Gaze Tells You Where to Compute: Gaze-Driven Efficient VLMs
par: Chen, Qinyu, et autres
Publié: (2025)
par: Chen, Qinyu, et autres
Publié: (2025)
Eyes on VLM: Benchmarking Gaze Following and Social Gaze Prediction in Vision Language Models
par: Wang, Hengfei, et autres
Publié: (2026)
par: Wang, Hengfei, et autres
Publié: (2026)
Impact of Design Decisions in Scanpath Modeling
par: Emami, Parvin, et autres
Publié: (2024)
par: Emami, Parvin, et autres
Publié: (2024)
Black-box Attacks on Image Activity Prediction and its Natural Language Explanations
par: Baia, Alina Elena, et autres
Publié: (2023)
par: Baia, Alina Elena, et autres
Publié: (2023)
Unifying Top-down and Bottom-up Scanpath Prediction Using Transformers
par: Yang, Zhibo, et autres
Publié: (2023)
par: Yang, Zhibo, et autres
Publié: (2023)
CountXplain: Interpretable Cell Counting with Prototype-Based Density Map Estimation
par: Mohammed, Abdurahman Ali, et autres
Publié: (2025)
par: Mohammed, Abdurahman Ali, et autres
Publié: (2025)
RL-ScanIQA: Reinforcement-Learned Scanpaths for Blind 360°Image Quality Assessment
par: Wang, Yujia, et autres
Publié: (2026)
par: Wang, Yujia, et autres
Publié: (2026)
GazeGaussian: High-Fidelity Gaze Redirection with 3D Gaussian Splatting
par: Wei, Xiaobao, et autres
Publié: (2024)
par: Wei, Xiaobao, et autres
Publié: (2024)
GazeGen: Gaze-Driven User Interaction for Visual Content Generation
par: Hsieh, He-Yen, et autres
Publié: (2024)
par: Hsieh, He-Yen, et autres
Publié: (2024)
DocXplain: A Novel Model-Agnostic Explainability Method for Document Image Classification
par: Saifullah, Saifullah, et autres
Publié: (2024)
par: Saifullah, Saifullah, et autres
Publié: (2024)
Gaze to Insight: A Scalable AI Approach for Detecting Gaze Behaviours in Face-to-Face Collaborative Learning
par: Liang, Junyuan, et autres
Publié: (2026)
par: Liang, Junyuan, et autres
Publié: (2026)
Context-Aware Integration of Language and Visual References for Natural Language Tracking
par: Shao, Yanyan, et autres
Publié: (2024)
par: Shao, Yanyan, et autres
Publié: (2024)
Automatic Classification and Segmentation of Tunnel Cracks Based on Deep Learning and Visual Explanations
par: Feng, Yong, et autres
Publié: (2025)
par: Feng, Yong, et autres
Publié: (2025)
A Robotics-Inspired Scanpath Model Reveals the Importance of Uncertainty and Semantic Object Cues for Gaze Guidance in Dynamic Scenes
par: Mengers, Vito, et autres
Publié: (2024)
par: Mengers, Vito, et autres
Publié: (2024)
CLIP-Gaze: Towards General Gaze Estimation via Visual-Linguistic Model
par: Yin, Pengwei, et autres
Publié: (2024)
par: Yin, Pengwei, et autres
Publié: (2024)
GazeProphet: Software-Only Gaze Prediction for VR Foveated Rendering
par: Ebadulla, Farhaan, et autres
Publié: (2025)
par: Ebadulla, Farhaan, et autres
Publié: (2025)
Collaborative Temporal Consistency Learning for Point-supervised Natural Language Video Localization
par: Tao, Zhuo, et autres
Publié: (2025)
par: Tao, Zhuo, et autres
Publié: (2025)
Learned Scanpaths Aid Blind Panoramic Video Quality Assessment
par: Fan, Kanglong, et autres
Publié: (2024)
par: Fan, Kanglong, et autres
Publié: (2024)
Pathformer3D: A 3D Scanpath Transformer for 360° Images
par: Quan, Rong, et autres
Publié: (2024)
par: Quan, Rong, et autres
Publié: (2024)
Saliency-Bench: A Comprehensive Benchmark for Evaluating Visual Explanations
par: Zhang, Yifei, et autres
Publié: (2023)
par: Zhang, Yifei, et autres
Publié: (2023)
VL4Gaze: Unleashing Vision-Language Models for Gaze Following
par: Wang, Shijing, et autres
Publié: (2025)
par: Wang, Shijing, et autres
Publié: (2025)
Gaze Prediction in Virtual Reality Without Eye Tracking Using Visual and Head Motion Cues
par: Petrou, Christos, et autres
Publié: (2026)
par: Petrou, Christos, et autres
Publié: (2026)
A Novel Framework for Multi-Person Temporal Gaze Following and Social Gaze Prediction
par: Gupta, Anshul, et autres
Publié: (2024)
par: Gupta, Anshul, et autres
Publié: (2024)
Documents similaires
-
Beyond Average: Individualized Visual Scanpath Prediction
par: Chen, Xianyu, et autres
Publié: (2024) -
OAT: Object-Level Attention Transformer for Gaze Scanpath Prediction
par: Fang, Yini, et autres
Publié: (2024) -
Modeling Human Gaze Behavior with Diffusion Models for Unified Scanpath Prediction
par: Cartella, Giuseppe, et autres
Publié: (2025) -
Beyond Scanpaths: Graph-Based Gaze Simulation in Dynamic Scenes
par: Palmer, Luke, et autres
Publié: (2026) -
Leveraging Bottom-Up and Top-Down Attention for Few-Shot Object Detection
par: Chen, Xianyu, et autres
Publié: (2020)