Enregistré dans:
| Auteurs principaux: | Peng, Yanming, Wang, Shijing, Huang, Yaping, Tian, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2604.16562 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Suppressing Uncertainty in Gaze Estimation
par: Wang, Shijing, et autres
Publié: (2024)
par: Wang, Shijing, et autres
Publié: (2024)
Cross-Dataset Gaze Estimation by Evidential Inter-intra Fusion
par: Wang, Shijing, et autres
Publié: (2024)
par: Wang, Shijing, et autres
Publié: (2024)
Seeing Through the Noise: Improving Infrared Small Target Detection and Segmentation from Noise Suppression Perspective
par: Yuan, Maoxun, et autres
Publié: (2025)
par: Yuan, Maoxun, et autres
Publié: (2025)
A Generalized Label Shift Perspective for Cross-Domain Gaze Estimation
par: Yang, Hao-Ran, et autres
Publié: (2025)
par: Yang, Hao-Ran, et autres
Publié: (2025)
VL4Gaze: Unleashing Vision-Language Models for Gaze Following
par: Wang, Shijing, et autres
Publié: (2025)
par: Wang, Shijing, et autres
Publié: (2025)
Differential Contrastive Training for Gaze Estimation
par: Zhang, Lin, et autres
Publié: (2025)
par: Zhang, Lin, et autres
Publié: (2025)
Enhancing Gaze Reasoning in Vision Foundation Models for Gaze Following
par: Wang, Shijing, et autres
Publié: (2026)
par: Wang, Shijing, et autres
Publié: (2026)
Seeing is Believing: Robust Vision-Guided Cross-Modal Prompt Learning under Label Noise
par: Geng, Zibin, et autres
Publié: (2026)
par: Geng, Zibin, et autres
Publié: (2026)
Seeing Like Radiologists: Context- and Gaze-Guided Vision-Language Pretraining for Chest X-rays
par: Liu, Kang, et autres
Publié: (2026)
par: Liu, Kang, et autres
Publié: (2026)
GazeFormer-MoE: Context-Aware Gaze Estimation via CLIP and MoE Transformer
par: Zhao, Xinyuan, et autres
Publié: (2026)
par: Zhao, Xinyuan, et autres
Publié: (2026)
Is Geometry Enough? An Evaluation of Landmark-Based Gaze Estimation
par: Agostinelli, Daniele, et autres
Publié: (2026)
par: Agostinelli, Daniele, et autres
Publié: (2026)
DMAGaze: Gaze Estimation Based on Feature Disentanglement and Multi-Scale Attention
par: Chen, Haohan, et autres
Publié: (2025)
par: Chen, Haohan, et autres
Publié: (2025)
IELDG: Suppressing Domain-Specific Noise with Inverse Evolution Layers for Domain Generalized Semantic Segmentation
par: Fan, Qizhe, et autres
Publié: (2025)
par: Fan, Qizhe, et autres
Publié: (2025)
Seeing Through the Mask: Rethinking Adversarial Examples for CAPTCHAs
par: Jabary, Yahya, et autres
Publié: (2024)
par: Jabary, Yahya, et autres
Publié: (2024)
FreeDNA: Endowing Domain Adaptation of Diffusion-Based Dense Prediction with Training-Free Domain Noise Alignment
par: Xu, Hang, et autres
Publié: (2025)
par: Xu, Hang, et autres
Publié: (2025)
SeeThrough3D: Occlusion Aware 3D Control in Text-to-Image Generation
par: Agrawal, Vaibhav, et autres
Publié: (2026)
par: Agrawal, Vaibhav, et autres
Publié: (2026)
GazeMoE: Perception of Gaze Target with Mixture-of-Experts
par: Dai, Zhuangzhuang, et autres
Publié: (2026)
par: Dai, Zhuangzhuang, et autres
Publié: (2026)
Learning Gaze-aware Compositional GAN
par: Aranjuelo, Nerea, et autres
Publié: (2024)
par: Aranjuelo, Nerea, et autres
Publié: (2024)
Seeing Through the Brain: New Insights from Decoding Visual Stimuli with fMRI
par: Huang, Zheng, et autres
Publié: (2025)
par: Huang, Zheng, et autres
Publié: (2025)
GazeQwen: Lightweight Gaze-Conditioned LLM Modulation for Streaming Video Understanding
par: Pham, Trong Thang, et autres
Publié: (2026)
par: Pham, Trong Thang, et autres
Publié: (2026)
Gaze-VLM:Bridging Gaze and VLMs through Attention Regularization for Egocentric Understanding
par: Pani, Anupam, et autres
Publié: (2025)
par: Pani, Anupam, et autres
Publié: (2025)
GazeVLM: A Vision-Language Model for Multi-Task Gaze Understanding
par: Mathew, Athul M., et autres
Publié: (2025)
par: Mathew, Athul M., et autres
Publié: (2025)
Noise Injection: Improving Out-of-Distribution Generalization for Limited Size Datasets
par: Mai, Duong, et autres
Publié: (2025)
par: Mai, Duong, et autres
Publié: (2025)
Toward Gaze Target Detection of Young Autistic Children
par: Deng, Shijian, et autres
Publié: (2025)
par: Deng, Shijian, et autres
Publié: (2025)
GazeFusion: Saliency-Guided Image Generation
par: Zhang, Yunxiang, et autres
Publié: (2024)
par: Zhang, Yunxiang, et autres
Publié: (2024)
Seeing is Improving: Visual Feedback for Iterative Text Layout Refinement
par: Guo, Junrong, et autres
Publié: (2026)
par: Guo, Junrong, et autres
Publié: (2026)
Improving Noise Efficiency in Privacy-preserving Dataset Distillation
par: Zheng, Runkai, et autres
Publié: (2025)
par: Zheng, Runkai, et autres
Publié: (2025)
Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction
par: Tian, Keyu, et autres
Publié: (2024)
par: Tian, Keyu, et autres
Publié: (2024)
TPP-Gaze: Modelling Gaze Dynamics in Space and Time with Neural Temporal Point Processes
par: D'Amelio, Alessandro, et autres
Publié: (2024)
par: D'Amelio, Alessandro, et autres
Publié: (2024)
TriAug: Out-of-Distribution Detection for Imbalanced Breast Lesion in Ultrasound
par: Ye, Yinyu, et autres
Publié: (2024)
par: Ye, Yinyu, et autres
Publié: (2024)
See, Act, Adapt: Active Perception for Unsupervised Cross-Domain Visual Adaptation via Personalized VLM-Guided Agent
par: Tang, Tianci, et autres
Publié: (2026)
par: Tang, Tianci, et autres
Publié: (2026)
Improved Noise Schedule for Diffusion Training
par: Hang, Tiankai, et autres
Publié: (2024)
par: Hang, Tiankai, et autres
Publié: (2024)
Seeing Through Deepfakes: A Human-Inspired Framework for Multi-Face Detection
par: Hu, Juan, et autres
Publié: (2025)
par: Hu, Juan, et autres
Publié: (2025)
Who Can See Through You? Adversarial Shielding Against VLM-Based Attribute Inference Attacks
par: Fan, Yucheng, et autres
Publié: (2025)
par: Fan, Yucheng, et autres
Publié: (2025)
Bad Seeing or Bad Thinking? Rewarding Perception for Vision-Language Reasoning
par: Wang, Haozhe, et autres
Publié: (2026)
par: Wang, Haozhe, et autres
Publié: (2026)
From Noise to Nuance: Advances in Deep Generative Image Models
par: Peng, Benji, et autres
Publié: (2024)
par: Peng, Benji, et autres
Publié: (2024)
PP-DocBee: Improving Multimodal Document Understanding Through a Bag of Tricks
par: Ni, Feng, et autres
Publié: (2025)
par: Ni, Feng, et autres
Publié: (2025)
Revisiting Cross-Attention Mechanisms: Leveraging Beneficial Noise for Domain-Adaptive Learning
par: Zang, Zelin, et autres
Publié: (2026)
par: Zang, Zelin, et autres
Publié: (2026)
Roll Your Eyes: Gaze Redirection via Explicit 3D Eyeball Rotation
par: Choi, YoungChan, et autres
Publié: (2025)
par: Choi, YoungChan, et autres
Publié: (2025)
Domain-Transferred Synthetic Data Generation for Improving Monocular Depth Estimation
par: Lee, Seungyeop, et autres
Publié: (2024)
par: Lee, Seungyeop, et autres
Publié: (2024)
Documents similaires
-
Suppressing Uncertainty in Gaze Estimation
par: Wang, Shijing, et autres
Publié: (2024) -
Cross-Dataset Gaze Estimation by Evidential Inter-intra Fusion
par: Wang, Shijing, et autres
Publié: (2024) -
Seeing Through the Noise: Improving Infrared Small Target Detection and Segmentation from Noise Suppression Perspective
par: Yuan, Maoxun, et autres
Publié: (2025) -
A Generalized Label Shift Perspective for Cross-Domain Gaze Estimation
par: Yang, Hao-Ran, et autres
Publié: (2025) -
VL4Gaze: Unleashing Vision-Language Models for Gaze Following
par: Wang, Shijing, et autres
Publié: (2025)