Leveraging Multi-Modal Saliency and Fusion for Gaze Target Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Mathew, Athul M., Khan, Arshad Ali, Khalid, Thariq, AL-Tam, Faroq, Souissi, Riad |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GazeVLM: A Vision-Language Model for Multi-Task Gaze Understanding
por: Mathew, Athul M., et al.
Publicado: (2025)
por: Mathew, Athul M., et al.
Publicado: (2025)
GazeFusion: Saliency-Guided Image Generation
por: Zhang, Yunxiang, et al.
Publicado: (2024)
por: Zhang, Yunxiang, et al.
Publicado: (2024)
GazeHTA: End-to-end Gaze Target Detection with Head-Target Association
por: Lin, Zhi-Yi, et al.
Publicado: (2024)
por: Lin, Zhi-Yi, et al.
Publicado: (2024)
Increasing the Thinking Budget is Not All You Need
por: Iacobacci, Ignacio, et al.
Publicado: (2025)
por: Iacobacci, Ignacio, et al.
Publicado: (2025)
Ocular Authentication: Fusion of Gaze and Periocular Modalities
por: Lohr, Dillon, et al.
Publicado: (2025)
por: Lohr, Dillon, et al.
Publicado: (2025)
Feature Fusion and Knowledge-Distilled Multi-Modal Multi-Target Detection
por: Do, Ngoc Tuyen, et al.
Publicado: (2025)
por: Do, Ngoc Tuyen, et al.
Publicado: (2025)
Multi-view Gaze Target Estimation
por: Miao, Qiaomu, et al.
Publicado: (2025)
por: Miao, Qiaomu, et al.
Publicado: (2025)
Multi-Modal Gaze Following in Conversational Scenarios
por: Hou, Yuqi, et al.
Publicado: (2023)
por: Hou, Yuqi, et al.
Publicado: (2023)
Gazing Into Missteps: Leveraging Eye-Gaze for Unsupervised Mistake Detection in Egocentric Videos of Skilled Human Activities
por: Mazzamuto, Michele, et al.
Publicado: (2024)
por: Mazzamuto, Michele, et al.
Publicado: (2024)
Capturing Gaze Shifts for Guidance: Cross-Modal Fusion Enhancement for VLM Hallucination Mitigation
por: Qi, Zheng, et al.
Publicado: (2025)
por: Qi, Zheng, et al.
Publicado: (2025)
Enhanced Small Target Detection via Multi-Modal Fusion and Attention Mechanisms: A YOLOv5 Approach
por: Ma, Xiaoxiao, et al.
Publicado: (2025)
por: Ma, Xiaoxiao, et al.
Publicado: (2025)
Upper-Body Pose-based Gaze Estimation for Privacy-Preserving 3D Gaze Target Detection
por: Toaiari, Andrea, et al.
Publicado: (2024)
por: Toaiari, Andrea, et al.
Publicado: (2024)
AL-GTD: Deep Active Learning for Gaze Target Detection
por: Tonini, Francesco, et al.
Publicado: (2024)
por: Tonini, Francesco, et al.
Publicado: (2024)
HiddenObject: Modality-Agnostic Fusion for Multimodal Hidden Object Detection
por: Song, Harris, et al.
Publicado: (2025)
por: Song, Harris, et al.
Publicado: (2025)
GazeOnce360: Fisheye-Based 360° Multi-Person Gaze Estimation with Global-Local Feature Fusion
por: Cai, Zhuojiang, et al.
Publicado: (2026)
por: Cai, Zhuojiang, et al.
Publicado: (2026)
Gaze-LLE: Gaze Target Estimation via Large-Scale Learned Encoders
por: Ryan, Fiona, et al.
Publicado: (2024)
por: Ryan, Fiona, et al.
Publicado: (2024)
SalFAU-Net: Saliency Fusion Attention U-Net for Salient Object Detection
por: Mulat, Kassaw Abraham, et al.
Publicado: (2024)
por: Mulat, Kassaw Abraham, et al.
Publicado: (2024)
GazeDETR: Gaze Detection using Disentangled Head and Gaze Representations
por: de Belen, Ryan Anthony Jalova, et al.
Publicado: (2025)
por: de Belen, Ryan Anthony Jalova, et al.
Publicado: (2025)
Progressive Multi-Modal Fusion for Robust 3D Object Detection
por: Mohan, Rohit, et al.
Publicado: (2024)
por: Mohan, Rohit, et al.
Publicado: (2024)
MV2DFusion: Leveraging Modality-Specific Object Semantics for Multi-Modal 3D Detection
por: Wang, Zitian, et al.
Publicado: (2024)
por: Wang, Zitian, et al.
Publicado: (2024)
Do Saliency Models Detect Odd-One-Out Targets? New Datasets and Evaluations
por: Kotseruba, Iuliia, et al.
Publicado: (2020)
por: Kotseruba, Iuliia, et al.
Publicado: (2020)
CSPENet: Contour-Aware and Saliency Priors Embedding Network for Infrared Small Target Detection
por: Deng, Jiakun, et al.
Publicado: (2025)
por: Deng, Jiakun, et al.
Publicado: (2025)
Salience DETR: Enhancing Detection Transformer with Hierarchical Salience Filtering Refinement
por: Hou, Xiuquan, et al.
Publicado: (2024)
por: Hou, Xiuquan, et al.
Publicado: (2024)
SpikeMba: Multi-Modal Spiking Saliency Mamba for Temporal Video Grounding
por: Li, Wenrui, et al.
Publicado: (2024)
por: Li, Wenrui, et al.
Publicado: (2024)
TriFusion-SR: Joint Tri-Modal Medical Image Fusion and SR
por: Dharejo, Fayaz Ali, et al.
Publicado: (2026)
por: Dharejo, Fayaz Ali, et al.
Publicado: (2026)
SSiT: Saliency-guided Self-supervised Image Transformer for Diabetic Retinopathy Grading
por: Huang, Yijin, et al.
Publicado: (2022)
por: Huang, Yijin, et al.
Publicado: (2022)
Equivariant Multi-Modality Image Fusion
por: Zhao, Zixiang, et al.
Publicado: (2023)
por: Zhao, Zixiang, et al.
Publicado: (2023)
Toward Gaze Target Detection of Young Autistic Children
por: Deng, Shijian, et al.
Publicado: (2025)
por: Deng, Shijian, et al.
Publicado: (2025)
Grains of Saliency: Optimizing Saliency-based Training of Biometric Attack Detection Models
por: Crum, Colton R., et al.
Publicado: (2024)
por: Crum, Colton R., et al.
Publicado: (2024)
GateFusion: Hierarchical Gated Cross-Modal Fusion for Active Speaker Detection
por: Wang, Yu, et al.
Publicado: (2025)
por: Wang, Yu, et al.
Publicado: (2025)
GazeMoE: Perception of Gaze Target with Mixture-of-Experts
por: Dai, Zhuangzhuang, et al.
Publicado: (2026)
por: Dai, Zhuangzhuang, et al.
Publicado: (2026)
Relevance-guided Audio Visual Fusion for Video Saliency Prediction
por: Yu, Li, et al.
Publicado: (2024)
por: Yu, Li, et al.
Publicado: (2024)
A Saliency Enhanced Feature Fusion based multiscale RGB-D Salient Object Detection Network
por: Huang, Rui, et al.
Publicado: (2024)
por: Huang, Rui, et al.
Publicado: (2024)
A Generalized Multi-Modal Fusion Detection Framework
por: Cui, Leichao, et al.
Publicado: (2023)
por: Cui, Leichao, et al.
Publicado: (2023)
Exploring Saliency Bias in Manipulation Detection
por: Krinsky, Joshua, et al.
Publicado: (2024)
por: Krinsky, Joshua, et al.
Publicado: (2024)
GazeTarget360: Towards Gaze Target Estimation in 360-Degree for Robot Perception
por: Dai, Zhuangzhuang, et al.
Publicado: (2025)
por: Dai, Zhuangzhuang, et al.
Publicado: (2025)
S4Fusion: Saliency-aware Selective State Space Model for Infrared Visible Image Fusion
por: Ma, Haolong, et al.
Publicado: (2024)
por: Ma, Haolong, et al.
Publicado: (2024)
Long-Tailed 3D Detection via Multi-Modal Fusion
por: Ma, Yechi, et al.
Publicado: (2023)
por: Ma, Yechi, et al.
Publicado: (2023)
DGFusion: Dual-guided Fusion for Robust Multi-Modal 3D Object Detection
por: Jia, Feiyang, et al.
Publicado: (2025)
por: Jia, Feiyang, et al.
Publicado: (2025)
Joint Attention-Guided Feature Fusion Network for Saliency Detection of Surface Defects
por: Jiang, Xiaoheng, et al.
Publicado: (2024)
por: Jiang, Xiaoheng, et al.
Publicado: (2024)
Ejemplares similares
-
GazeVLM: A Vision-Language Model for Multi-Task Gaze Understanding
por: Mathew, Athul M., et al.
Publicado: (2025) -
GazeFusion: Saliency-Guided Image Generation
por: Zhang, Yunxiang, et al.
Publicado: (2024) -
GazeHTA: End-to-end Gaze Target Detection with Head-Target Association
por: Lin, Zhi-Yi, et al.
Publicado: (2024) -
Increasing the Thinking Budget is Not All You Need
por: Iacobacci, Ignacio, et al.
Publicado: (2025) -
Ocular Authentication: Fusion of Gaze and Periocular Modalities
por: Lohr, Dillon, et al.
Publicado: (2025)