Spot The Ball: A Benchmark for Visual Social Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Balamurugan, Neha, Wu, Sarah, Chun, Adam, Gaw, Gabe, Eyzaguirre, Cristobal, Gerstenberg, Tobias |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VizDefender: Unmasking Visualization Tampering through Proactive Localization and Intent Inference
par: Song, Sicheng, et autres
Publié: (2025)
par: Song, Sicheng, et autres
Publié: (2025)
Why Someone Asked "Why": Foil Inference in Human and LLM Question Interpretation
par: Besch, Britt, et autres
Publié: (2026)
par: Besch, Britt, et autres
Publié: (2026)
Enhancing Saliency Prediction in Monitoring Tasks: The Role of Visual Highlights
par: Wu, Zekun, et autres
Publié: (2024)
par: Wu, Zekun, et autres
Publié: (2024)
Towards Consumer-Grade Cybersickness Prediction: Multi-Model Alignment for Real-Time Vision-Only Inference
par: Zhu, Yitong, et autres
Publié: (2025)
par: Zhu, Yitong, et autres
Publié: (2025)
SpatialViz-Bench: A Cognitively-Grounded Benchmark for Diagnosing Spatial Visualization in MLLMs
par: Wang, Siting, et autres
Publié: (2025)
par: Wang, Siting, et autres
Publié: (2025)
Visually Grounded Narratives: Reducing Cognitive Burden in Researcher-Participant Interaction
par: Wu, Runtong, et autres
Publié: (2025)
par: Wu, Runtong, et autres
Publié: (2025)
DAVINCI: A Single-Stage Architecture for Constrained CAD Sketch Inference
par: Karadeniz, Ahmet Serdar, et autres
Publié: (2024)
par: Karadeniz, Ahmet Serdar, et autres
Publié: (2024)
Deep Learning for Virtual Reality User Identification: A Benchmark
par: Frizzo, Davide, et autres
Publié: (2026)
par: Frizzo, Davide, et autres
Publié: (2026)
Visual Neural Decoding via Improved Visual-EEG Semantic Consistency
par: Chen, Hongzhou, et autres
Publié: (2024)
par: Chen, Hongzhou, et autres
Publié: (2024)
3D Reconstruction by Looking: Instantaneous Blind Spot Detector for Indoor SLAM through Mixed Reality
par: Chang, Hanbeom, et autres
Publié: (2024)
par: Chang, Hanbeom, et autres
Publié: (2024)
A Comparative Study of Scanpath Models in Graph-Based Visualization
par: Lopez-Cardona, Angela, et autres
Publié: (2025)
par: Lopez-Cardona, Angela, et autres
Publié: (2025)
Tell Me Without Telling Me: Two-Way Prediction of Visualization Literacy and Visual Attention
par: Chang, Minsuk, et autres
Publié: (2025)
par: Chang, Minsuk, et autres
Publié: (2025)
SimVecVis: A Dataset for Enhancing MLLMs in Visualization Understanding
par: Liu, Can, et autres
Publié: (2025)
par: Liu, Can, et autres
Publié: (2025)
VIS-Shepherd: Constructing Critic for LLM-based Data Visualization Generation
par: Pan, Bo, et autres
Publié: (2025)
par: Pan, Bo, et autres
Publié: (2025)
A Deep Learning Framework for Visual Attention Prediction and Analysis of News Interfaces
par: Kenely, Matthew, et autres
Publié: (2025)
par: Kenely, Matthew, et autres
Publié: (2025)
When, Where, and What? A Novel Benchmark for Accident Anticipation and Localization with Large Language Models
par: Liao, Haicheng, et autres
Publié: (2024)
par: Liao, Haicheng, et autres
Publié: (2024)
OMG-Bench: A New Challenging Benchmark for Skeleton-based Online Micro Hand Gesture Recognition
par: Chang, Haochen, et autres
Publié: (2025)
par: Chang, Haochen, et autres
Publié: (2025)
Accelerating Physical Property Reasoning for Augmented Visual Cognition
par: Lan, Hongbo, et autres
Publié: (2025)
par: Lan, Hongbo, et autres
Publié: (2025)
Panda or not Panda? Understanding Adversarial Attacks with Interactive Visualization
par: You, Yuzhe, et autres
Publié: (2023)
par: You, Yuzhe, et autres
Publié: (2023)
PoseAugment: Generative Human Pose Data Augmentation with Physical Plausibility for IMU-based Motion Capture
par: Li, Zhuojun, et autres
Publié: (2024)
par: Li, Zhuojun, et autres
Publié: (2024)
AttributionScanner: A Visual Analytics System for Model Validation with Metadata-Free Slice Finding
par: Xuan, Xiwei, et autres
Publié: (2024)
par: Xuan, Xiwei, et autres
Publié: (2024)
Do MLLMs Understand Pointing? Benchmarking and Enhancing Referential Reasoning in Egocentric Vision
par: Li, Chentao, et autres
Publié: (2026)
par: Li, Chentao, et autres
Publié: (2026)
mEBAL2 Database and Benchmark: Image-based Multispectral Eyeblink Detection
par: Daza, Roberto, et autres
Publié: (2023)
par: Daza, Roberto, et autres
Publié: (2023)
NeuroSwift: A Lightweight Cross-Subject Framework for fMRI Visual Reconstruction of Complex Scenes
par: Zhang, Shiyi, et autres
Publié: (2025)
par: Zhang, Shiyi, et autres
Publié: (2025)
Collection Space Navigator: An Interactive Visualization Interface for Multidimensional Datasets
par: Ohm, Tillmann, et autres
Publié: (2023)
par: Ohm, Tillmann, et autres
Publié: (2023)
AIris: An AI-powered Wearable Assistive Device for the Visually Impaired
par: Brilli, Dionysia Danai, et autres
Publié: (2024)
par: Brilli, Dionysia Danai, et autres
Publié: (2024)
GenColor: Generative Color-Concept Association in Visual Design
par: Hou, Yihan, et autres
Publié: (2025)
par: Hou, Yihan, et autres
Publié: (2025)
GAZEploit: Remote Keystroke Inference Attack by Gaze Estimation from Avatar Views in VR/MR Devices
par: Wang, Hanqiu, et autres
Publié: (2024)
par: Wang, Hanqiu, et autres
Publié: (2024)
The Latency Wall: Benchmarking Off-the-Shelf Emotion Recognition for Real-Time Virtual Avatars
par: Benyamin, Yarin
Publié: (2026)
par: Benyamin, Yarin
Publié: (2026)
Beyond Object Categories: Multi-Attribute Reference Understanding for Visual Grounding
par: Guo, Hao, et autres
Publié: (2025)
par: Guo, Hao, et autres
Publié: (2025)
CoEditor++: Instruction-based Visual Editing via Cognitive Reasoning
par: Ni, Minheng, et autres
Publié: (2026)
par: Ni, Minheng, et autres
Publié: (2026)
iTrace: Click-Based Gaze Visualization on the Apple Vision Pro
par: Mehmedova, Esra, et autres
Publié: (2025)
par: Mehmedova, Esra, et autres
Publié: (2025)
Talk to Parallel LiDARs: A Human-LiDAR Interaction Method Based on 3D Visual Grounding
par: Liu, Yuhang, et autres
Publié: (2024)
par: Liu, Yuhang, et autres
Publié: (2024)
Enhancing Apparent Personality Trait Analysis with Cross-Modal Embeddings
par: Fodor, Ádám, et autres
Publié: (2024)
par: Fodor, Ádám, et autres
Publié: (2024)
Visualization of a multidimensional point cloud as a 3D swarm of avatars
par: Luchowski, Leszek, et autres
Publié: (2025)
par: Luchowski, Leszek, et autres
Publié: (2025)
OSCAR: Object Status and Contextual Awareness for Recipes to Support Non-Visual Cooking
par: Li, Franklin Mingzhe, et autres
Publié: (2025)
par: Li, Franklin Mingzhe, et autres
Publié: (2025)
Visual Affect Analysis: Predicting Emotions of Image Viewers with Vision-Language Models
par: Nowicki, Filip, et autres
Publié: (2026)
par: Nowicki, Filip, et autres
Publié: (2026)
DeepSORT-Driven Visual Tracking Approach for Gesture Recognition in Interactive Systems
par: Zhang, Tong, et autres
Publié: (2025)
par: Zhang, Tong, et autres
Publié: (2025)
Distinguishing Target and Non-Target Fixations with EEG and Eye Tracking in Realistic Visual Scenes
par: Sharma, Mansi, et autres
Publié: (2025)
par: Sharma, Mansi, et autres
Publié: (2025)
VisionGPT: LLM-Assisted Real-Time Anomaly Detection for Safe Visual Navigation
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
Documents similaires
-
VizDefender: Unmasking Visualization Tampering through Proactive Localization and Intent Inference
par: Song, Sicheng, et autres
Publié: (2025) -
Why Someone Asked "Why": Foil Inference in Human and LLM Question Interpretation
par: Besch, Britt, et autres
Publié: (2026) -
Enhancing Saliency Prediction in Monitoring Tasks: The Role of Visual Highlights
par: Wu, Zekun, et autres
Publié: (2024) -
Towards Consumer-Grade Cybersickness Prediction: Multi-Model Alignment for Real-Time Vision-Only Inference
par: Zhu, Yitong, et autres
Publié: (2025) -
SpatialViz-Bench: A Cognitively-Grounded Benchmark for Diagnosing Spatial Visualization in MLLMs
par: Wang, Siting, et autres
Publié: (2025)