Mind the Gesture: Evaluating AI Sensitivity to Culturally Offensive Non-Verbal Gestures
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yerukola, Akhila, Gabriel, Saadia, Peng, Nanyun, Sap, Maarten |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Is the Pope Catholic? Yes, the Pope is Catholic. Generative Evaluation of Non-Literal Intent Resolution in LLMs
par: Yerukola, Akhila, et autres
Publié: (2024)
par: Yerukola, Akhila, et autres
Publié: (2024)
SoMi-ToM: Evaluating Multi-Perspective Theory of Mind in Embodied Social Interactions
par: Fan, Xianzhe, et autres
Publié: (2025)
par: Fan, Xianzhe, et autres
Publié: (2025)
Gesture2Text: A Generalizable Decoder for Word-Gesture Keyboards in XR Through Trajectory Coarse Discretization and Pre-training
par: Shen, Junxiao, et autres
Publié: (2024)
par: Shen, Junxiao, et autres
Publié: (2024)
RingGesture: A Ring-Based Mid-Air Gesture Typing System Powered by a Deep-Learning Word Prediction Framework
par: Shen, Junxiao, et autres
Publié: (2024)
par: Shen, Junxiao, et autres
Publié: (2024)
Allo-AVA: A Large-Scale Multimodal Conversational AI Dataset for Allocentric Avatar Gesture Animation
par: Punjwani, Saif, et autres
Publié: (2024)
par: Punjwani, Saif, et autres
Publié: (2024)
Contextual Gesture: Co-Speech Gesture Video Generation through Context-aware Gesture Representation
par: Liu, Pinxin, et autres
Publié: (2025)
par: Liu, Pinxin, et autres
Publié: (2025)
Gesture Matters: Pedestrian Gesture Recognition for AVs Through Skeleton Pose Evaluation
par: Mahdi, Alif Rizqullah, et autres
Publié: (2026)
par: Mahdi, Alif Rizqullah, et autres
Publié: (2026)
ConTextual: Evaluating Context-Sensitive Text-Rich Visual Reasoning in Large Multimodal Models
par: Wadhawan, Rohan, et autres
Publié: (2024)
par: Wadhawan, Rohan, et autres
Publié: (2024)
Intentional Gesture: Deliver Your Intentions with Gestures for Speech
par: Liu, Pinxin, et autres
Publié: (2025)
par: Liu, Pinxin, et autres
Publié: (2025)
MRAG-Bench: Vision-Centric Evaluation for Retrieval-Augmented Multimodal Models
par: Hu, Wenbo, et autres
Publié: (2024)
par: Hu, Wenbo, et autres
Publié: (2024)
Dyna-Mind: Learning to Simulate from Experience for Better AI Agents
par: Yu, Xiao, et autres
Publié: (2025)
par: Yu, Xiao, et autres
Publié: (2025)
EmotionGesture: Audio-Driven Diverse Emotional Co-Speech 3D Gesture Generation
par: Qi, Xingqun, et autres
Publié: (2023)
par: Qi, Xingqun, et autres
Publié: (2023)
Verbalized Representation Learning for Interpretable Few-Shot Generalization
par: Yang, Cheng-Fu, et autres
Publié: (2024)
par: Yang, Cheng-Fu, et autres
Publié: (2024)
LLAniMAtion: LLAMA Driven Gesture Animation
par: Windle, Jonathan, et autres
Publié: (2024)
par: Windle, Jonathan, et autres
Publié: (2024)
Leveraging Speech for Gesture Detection in Multimodal Communication
par: Ghaleb, Esam, et autres
Publié: (2024)
par: Ghaleb, Esam, et autres
Publié: (2024)
Time Frequency Analysis of EMG Signal for Gesture Recognition using Fine grained Features
par: Aarotale, Parshuram N., et autres
Publié: (2025)
par: Aarotale, Parshuram N., et autres
Publié: (2025)
SynthoGestures: A Novel Framework for Synthetic Dynamic Hand Gesture Generation for Driving Scenarios
par: Gomaa, Amr, et autres
Publié: (2023)
par: Gomaa, Amr, et autres
Publié: (2023)
METAL: A Multi-Agent Framework for Chart Generation with Test-Time Scaling
par: Li, Bingxuan, et autres
Publié: (2025)
par: Li, Bingxuan, et autres
Publié: (2025)
End to End AI System for Surgical Gesture Sequence Recognition and Clinical Outcome Prediction
par: Li, Xi, et autres
Publié: (2025)
par: Li, Xi, et autres
Publié: (2025)
3DLLM-Mem: Long-Term Spatial-Temporal Memory for Embodied 3D Large Language Model
par: Hu, Wenbo, et autres
Publié: (2025)
par: Hu, Wenbo, et autres
Publié: (2025)
Survey on Hand Gesture Recognition from Visual Input
par: Linardakis, Manousos, et autres
Publié: (2025)
par: Linardakis, Manousos, et autres
Publié: (2025)
Unlearning Sensitive Information in Multimodal LLMs: Benchmark and Attack-Defense Evaluation
par: Patil, Vaidehi, et autres
Publié: (2025)
par: Patil, Vaidehi, et autres
Publié: (2025)
Saliency-guided Emotion Modeling: Predicting Viewer Reactions from Video Stimuli
par: Yaragoppa, Akhila, et autres
Publié: (2025)
par: Yaragoppa, Akhila, et autres
Publié: (2025)
MMToM-QA: Multimodal Theory of Mind Question Answering
par: Jin, Chuanyang, et autres
Publié: (2024)
par: Jin, Chuanyang, et autres
Publié: (2024)
Democratizing High-Fidelity Co-Speech Gesture Video Generation
par: Yang, Xu, et autres
Publié: (2025)
par: Yang, Xu, et autres
Publié: (2025)
Fast Real-Time Pipeline for Robust Arm Gesture Recognition
par: Bagladi, Milán Zsolt, et autres
Publié: (2025)
par: Bagladi, Milán Zsolt, et autres
Publié: (2025)
UAC: Uncertainty-Aware Calibration of Neural Networks for Gesture Detection
par: Haddad, Farida Al, et autres
Publié: (2025)
par: Haddad, Farida Al, et autres
Publié: (2025)
A Technique for Classifying Static Gestures Using UWB Radar
par: Sebastian, Abhishek, et autres
Publié: (2023)
par: Sebastian, Abhishek, et autres
Publié: (2023)
OpenVLThinkerV2: A Generalist Multimodal Reasoning Model for Multi-domain Visual Tasks
par: Hu, Wenbo, et autres
Publié: (2026)
par: Hu, Wenbo, et autres
Publié: (2026)
Faithful Attention Explainer: Verbalizing Decisions Based on Discriminative Features
par: Rong, Yao, et autres
Publié: (2024)
par: Rong, Yao, et autres
Publié: (2024)
Elastic Spiking Transformers for Efficient Gesture Understanding
par: Ancilotto, Alberto, et autres
Publié: (2026)
par: Ancilotto, Alberto, et autres
Publié: (2026)
Mind the (Language) Gap: Towards Probing Numerical and Cross-Lingual Limits of LVLMs
par: Gautam, Somraj, et autres
Publié: (2025)
par: Gautam, Somraj, et autres
Publié: (2025)
MuMA-ToM: Multi-modal Multi-Agent Theory of Mind
par: Shi, Haojun, et autres
Publié: (2024)
par: Shi, Haojun, et autres
Publié: (2024)
VISCO: Benchmarking Fine-Grained Critique and Correction Towards Self-Improvement in Visual Reasoning
par: Wu, Xueqing, et autres
Publié: (2024)
par: Wu, Xueqing, et autres
Publié: (2024)
GPT Sonograpy: Hand Gesture Decoding from Forearm Ultrasound Images via VLM
par: Bimbraw, Keshav, et autres
Publié: (2024)
par: Bimbraw, Keshav, et autres
Publié: (2024)
CaKE: Circuit-aware Editing Enables Generalizable Knowledge Learners
par: Yao, Yunzhi, et autres
Publié: (2025)
par: Yao, Yunzhi, et autres
Publié: (2025)
Continual Gesture Learning without Data via Synthetic Feature Sampling
par: Lu, Zhenyu, et autres
Publié: (2024)
par: Lu, Zhenyu, et autres
Publié: (2024)
Contrastive Visual Data Augmentation
par: Zhou, Yu, et autres
Publié: (2025)
par: Zhou, Yu, et autres
Publié: (2025)
This&That: Language-Gesture Controlled Video Generation for Robot Planning
par: Wang, Boyang, et autres
Publié: (2024)
par: Wang, Boyang, et autres
Publié: (2024)
VELMA: Verbalization Embodiment of LLM Agents for Vision and Language Navigation in Street View
par: Schumann, Raphael, et autres
Publié: (2023)
par: Schumann, Raphael, et autres
Publié: (2023)
Documents similaires
-
Is the Pope Catholic? Yes, the Pope is Catholic. Generative Evaluation of Non-Literal Intent Resolution in LLMs
par: Yerukola, Akhila, et autres
Publié: (2024) -
SoMi-ToM: Evaluating Multi-Perspective Theory of Mind in Embodied Social Interactions
par: Fan, Xianzhe, et autres
Publié: (2025) -
Gesture2Text: A Generalizable Decoder for Word-Gesture Keyboards in XR Through Trajectory Coarse Discretization and Pre-training
par: Shen, Junxiao, et autres
Publié: (2024) -
RingGesture: A Ring-Based Mid-Air Gesture Typing System Powered by a Deep-Learning Word Prediction Framework
par: Shen, Junxiao, et autres
Publié: (2024) -
Allo-AVA: A Large-Scale Multimodal Conversational AI Dataset for Allocentric Avatar Gesture Animation
par: Punjwani, Saif, et autres
Publié: (2024)