CSGaze: Context-aware Social Gaze Prediction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Madan, Surbhi, Ghosh, Shreya, Subramanian, Ramanathan, Dhall, Abhinav, Gedeon, Tom |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MIP-GAF: A MLLM-annotated Benchmark for Most Important Person Localization and Group Context Understanding
par: Madan, Surbhi, et autres
Publié: (2024)
par: Madan, Surbhi, et autres
Publié: (2024)
Gems: Group Emotion Profiling Through Multimodal Situational Understanding
par: Kataria, Anubhav, et autres
Publié: (2025)
par: Kataria, Anubhav, et autres
Publié: (2025)
Multiverse Through Deepfakes: The MultiFakeVerse Dataset of Person-Centric Visual and Conceptual Manipulations
par: Gupta, Parul, et autres
Publié: (2025)
par: Gupta, Parul, et autres
Publié: (2025)
MRAC Track 1: 2nd Workshop on Multimodal, Generative and Responsible Affective Computing
par: Ghosh, Shreya, et autres
Publié: (2024)
par: Ghosh, Shreya, et autres
Publié: (2024)
Pavlok-Nudge: A Feedback Mechanism for Atomic Behaviour Modification with Snoring Usecase
par: Hasan, Md Rakibul, et autres
Publié: (2023)
par: Hasan, Md Rakibul, et autres
Publié: (2023)
AV-Deepfake1M: A Large-Scale LLM-Driven Audio-Visual Deepfake Dataset
par: Cai, Zhixi, et autres
Publié: (2023)
par: Cai, Zhixi, et autres
Publié: (2023)
AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations
par: Cai, Zhixi, et autres
Publié: (2025)
par: Cai, Zhixi, et autres
Publié: (2025)
A Closer Look at the Robustness of Contrastive Language-Image Pre-Training (CLIP)
par: Tu, Weijie, et autres
Publié: (2024)
par: Tu, Weijie, et autres
Publié: (2024)
Improving Personalized Image Generation through Social Context Feedback
par: Gupta, Parul, et autres
Publié: (2025)
par: Gupta, Parul, et autres
Publié: (2025)
What Does Softmax Probability Tell Us about Classifiers Ranking Across Diverse Test Conditions?
par: Tu, Weijie, et autres
Publié: (2024)
par: Tu, Weijie, et autres
Publié: (2024)
Taylor Videos for Action Recognition
par: Wang, Lei, et autres
Publié: (2024)
par: Wang, Lei, et autres
Publié: (2024)
TrackNetV4: Enhancing Fast Sports Object Tracking with Motion Attention Maps
par: Raj, Arjun, et autres
Publié: (2024)
par: Raj, Arjun, et autres
Publié: (2024)
A Survey of Deep Learning for Group-level Emotion Recognition
par: Huang, Xiaohua, et autres
Publié: (2024)
par: Huang, Xiaohua, et autres
Publié: (2024)
An Empirical Study Into What Matters for Calibrating Vision-Language Models
par: Tu, Weijie, et autres
Publié: (2024)
par: Tu, Weijie, et autres
Publié: (2024)
When Spatial meets Temporal in Action Recognition
par: Chen, Huilin, et autres
Publié: (2024)
par: Chen, Huilin, et autres
Publié: (2024)
SFANet: Spatial-Frequency Attention Network for Deepfake Detection
par: Ahire, Vrushank, et autres
Publié: (2025)
par: Ahire, Vrushank, et autres
Publié: (2025)
Motion meets Attention: Video Motion Prompts
par: Chen, Qixiang, et autres
Publié: (2024)
par: Chen, Qixiang, et autres
Publié: (2024)
Adaptive Multi-head Contrastive Learning
par: Wang, Lei, et autres
Publié: (2023)
par: Wang, Lei, et autres
Publié: (2023)
Prompting without Panic: Attribute-aware, Zero-shot, Test-Time Calibration
par: Hebbalaguppe, Ramya, et autres
Publié: (2025)
par: Hebbalaguppe, Ramya, et autres
Publié: (2025)
7th ABAW Competition: Multi-Task Learning and Compound Expression Recognition
par: Kollias, Dimitrios, et autres
Publié: (2024)
par: Kollias, Dimitrios, et autres
Publié: (2024)
1M-Deepfakes Detection Challenge
par: Cai, Zhixi, et autres
Publié: (2024)
par: Cai, Zhixi, et autres
Publié: (2024)
Meet JEANIE: a Similarity Measure for 3D Skeleton Sequences via Temporal-Viewpoint Alignment
par: Wang, Lei, et autres
Publié: (2024)
par: Wang, Lei, et autres
Publié: (2024)
Learnable Expansion of Graph Operators for Multi-Modal Feature Fusion
par: Ding, Dexuan, et autres
Publié: (2024)
par: Ding, Dexuan, et autres
Publié: (2024)
An Enhanced Large Language Model For Cross Modal Query Understanding System Using DL-KeyBERT Based CAZSSCL-MPGPT
par: Singh, Shreya
Publié: (2025)
par: Singh, Shreya
Publié: (2025)
Suppressing Uncertainty in Gaze Estimation
par: Wang, Shijing, et autres
Publié: (2024)
par: Wang, Shijing, et autres
Publié: (2024)
How Does the Spatial Distribution of Pre-training Data Affect Geospatial Foundation Models?
par: Purohit, Mirali, et autres
Publié: (2025)
par: Purohit, Mirali, et autres
Publié: (2025)
Global Context-aware Representation Learning for Spatially Resolved Transcriptomics
par: Oh, Yunhak, et autres
Publié: (2025)
par: Oh, Yunhak, et autres
Publié: (2025)
iWatchRoadv2: Pothole Detection, Geospatial Mapping, and Intelligent Road Governance
par: Sahoo, Rishi Raj, et autres
Publié: (2025)
par: Sahoo, Rishi Raj, et autres
Publié: (2025)
iWatchRoad: Scalable Detection and Geospatial Visualization of Potholes for Smart Cities
par: Sahoo, Rishi Raj, et autres
Publié: (2025)
par: Sahoo, Rishi Raj, et autres
Publié: (2025)
Bayesian Multi-Scale Neural Network for Crowd Counting
par: Sagar, Abhinav
Publié: (2020)
par: Sagar, Abhinav
Publié: (2020)
Privacy-Preserving Empathy Detection in Video Interactions
par: Hasan, Md Rakibul, et autres
Publié: (2025)
par: Hasan, Md Rakibul, et autres
Publié: (2025)
Pretrain Where? Investigating How Pretraining Data Diversity Impacts Geospatial Foundation Model Performance
par: Kaur, Amandeep, et autres
Publié: (2026)
par: Kaur, Amandeep, et autres
Publié: (2026)
CascadedGaze: Efficiency in Global Context Extraction for Image Restoration
par: Ghasemabadi, Amirhosein, et autres
Publié: (2024)
par: Ghasemabadi, Amirhosein, et autres
Publié: (2024)
Human Gaze Boosts Object-Centered Representation Learning
par: Schaumlöffel, Timothy, et autres
Publié: (2025)
par: Schaumlöffel, Timothy, et autres
Publié: (2025)
EM-Net: Gaze Estimation with Expectation Maximization Algorithm
par: Cheng, Zhang, et autres
Publié: (2024)
par: Cheng, Zhang, et autres
Publié: (2024)
EEG-based Cognitive Load Estimation of Acoustic Parameters for Data Sonification
par: Sharma, Gulshan, et autres
Publié: (2024)
par: Sharma, Gulshan, et autres
Publié: (2024)
HandsOnVLM: Vision-Language Models for Hand-Object Interaction Prediction
par: Bao, Chen, et autres
Publié: (2024)
par: Bao, Chen, et autres
Publié: (2024)
A Transformer-Based Model for the Prediction of Human Gaze Behavior on Videos
par: Ozdel, Suleyman, et autres
Publié: (2024)
par: Ozdel, Suleyman, et autres
Publié: (2024)
Gaze-Informed Vision Transformers: Predicting Driving Decisions Under Uncertainty
par: Koorathota, Sharath, et autres
Publié: (2023)
par: Koorathota, Sharath, et autres
Publié: (2023)
Cross-Dataset Gaze Estimation by Evidential Inter-intra Fusion
par: Wang, Shijing, et autres
Publié: (2024)
par: Wang, Shijing, et autres
Publié: (2024)
Documents similaires
-
MIP-GAF: A MLLM-annotated Benchmark for Most Important Person Localization and Group Context Understanding
par: Madan, Surbhi, et autres
Publié: (2024) -
Gems: Group Emotion Profiling Through Multimodal Situational Understanding
par: Kataria, Anubhav, et autres
Publié: (2025) -
Multiverse Through Deepfakes: The MultiFakeVerse Dataset of Person-Centric Visual and Conceptual Manipulations
par: Gupta, Parul, et autres
Publié: (2025) -
MRAC Track 1: 2nd Workshop on Multimodal, Generative and Responsible Affective Computing
par: Ghosh, Shreya, et autres
Publié: (2024) -
Pavlok-Nudge: A Feedback Mechanism for Atomic Behaviour Modification with Snoring Usecase
par: Hasan, Md Rakibul, et autres
Publié: (2023)