Prompt-to-Gesture: Measuring the Capabilities of Image-to-Video Deictic Gesture Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ali, Hassan, Jirak, Doreen, Müller, Luca, Wermter, Stefan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Snapture -- A Novel Neural Architecture for Combined Static and Dynamic Hand Gesture Recognition
par: Ali, Hassan, et autres
Publié: (2022)
par: Ali, Hassan, et autres
Publié: (2022)
Contextual Gesture: Co-Speech Gesture Video Generation through Context-aware Gesture Representation
par: Liu, Pinxin, et autres
Publié: (2025)
par: Liu, Pinxin, et autres
Publié: (2025)
Conveying Meaning through Gestures: An Investigation into Semantic Co-Speech Gesture Generation
par: Voss, Hendric, et autres
Publié: (2025)
par: Voss, Hendric, et autres
Publié: (2025)
LiveGesture Streamable Co-Speech Gesture Generation Model
par: Saleem, Muhammad Usama, et autres
Publié: (2026)
par: Saleem, Muhammad Usama, et autres
Publié: (2026)
Zero-shot Prompt-based Video Encoder for Surgical Gesture Recognition
par: Rao, Mingxing, et autres
Publié: (2024)
par: Rao, Mingxing, et autres
Publié: (2024)
SocialGesture: Delving into Multi-person Gesture Understanding
par: Cao, Xu, et autres
Publié: (2025)
par: Cao, Xu, et autres
Publié: (2025)
Boosting Gesture Recognition with an Automatic Gesture Annotation Framework
par: Shen, Junxiao, et autres
Publié: (2024)
par: Shen, Junxiao, et autres
Publié: (2024)
CoordSpeaker: Exploiting Gesture Captioning for Coordinated Caption-Empowered Co-Speech Gesture Generation
par: Fang, Fengyi, et autres
Publié: (2025)
par: Fang, Fengyi, et autres
Publié: (2025)
CoCoGesture: Toward Coherent Co-speech 3D Gesture Generation in the Wild
par: Qi, Xingqun, et autres
Publié: (2024)
par: Qi, Xingqun, et autres
Publié: (2024)
DeiSAM: Segment Anything with Deictic Prompting
par: Shindo, Hikaru, et autres
Publié: (2024)
par: Shindo, Hikaru, et autres
Publié: (2024)
InteracTalker: Prompt-Based Human-Object Interaction with Co-Speech Gesture Generation
par: Rajan, Sreehari, et autres
Publié: (2025)
par: Rajan, Sreehari, et autres
Publié: (2025)
Co-speech Gesture Video Generation via Motion-Based Graph Retrieval
par: Song, Yafei, et autres
Publié: (2025)
par: Song, Yafei, et autres
Publié: (2025)
PersonaGesture: Single-Reference Co-Speech Gesture Personalization for Unseen Speakers
par: Zhang, Xiangyue, et autres
Publié: (2026)
par: Zhang, Xiangyue, et autres
Publié: (2026)
MM-Gesture: Towards Precise Micro-Gesture Recognition through Multimodal Fusion
par: Gu, Jihao, et autres
Publié: (2025)
par: Gu, Jihao, et autres
Publié: (2025)
EMAGE: Towards Unified Holistic Co-Speech Gesture Generation via Expressive Masked Audio Gesture Modeling
par: Liu, Haiyang, et autres
Publié: (2023)
par: Liu, Haiyang, et autres
Publié: (2023)
Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion
par: Qi, Xingqun, et autres
Publié: (2025)
par: Qi, Xingqun, et autres
Publié: (2025)
DuoGesture: Neuro-Inspired and Biomechanically Informed Dual-Stream Co-Speech Gesture Generation
par: Paar, Ferdinand, et autres
Publié: (2026)
par: Paar, Ferdinand, et autres
Publié: (2026)
GestureLSM: Latent Shortcut based Co-Speech Gesture Generation with Spatial-Temporal Modeling
par: Liu, Pinxin, et autres
Publié: (2025)
par: Liu, Pinxin, et autres
Publié: (2025)
This&That: Language-Gesture Controlled Video Generation for Robot Planning
par: Wang, Boyang, et autres
Publié: (2024)
par: Wang, Boyang, et autres
Publié: (2024)
Democratizing High-Fidelity Co-Speech Gesture Video Generation
par: Yang, Xu, et autres
Publié: (2025)
par: Yang, Xu, et autres
Publié: (2025)
Gesture Classification in Artworks Using Contextual Image Features
par: Hussian, Azhar, et autres
Publié: (2024)
par: Hussian, Azhar, et autres
Publié: (2024)
HaGRID - HAnd Gesture Recognition Image Dataset
par: Kapitanov, Alexander, et autres
Publié: (2022)
par: Kapitanov, Alexander, et autres
Publié: (2022)
Self-Supervised Learning of Deviation in Latent Representation for Co-speech Gesture Video Generation
par: Yang, Huan, et autres
Publié: (2024)
par: Yang, Huan, et autres
Publié: (2024)
ImaGGen: Zero-Shot Generation of Co-Speech Semantic Gestures Grounded in Language and Image Input
par: Voss, Hendric, et autres
Publié: (2025)
par: Voss, Hendric, et autres
Publié: (2025)
Intentional Gesture: Deliver Your Intentions with Gestures for Speech
par: Liu, Pinxin, et autres
Publié: (2025)
par: Liu, Pinxin, et autres
Publié: (2025)
MMGT: Motion Mask Guided Two-Stage Network for Co-Speech Gesture Video Generation
par: Wang, Siyuan, et autres
Publié: (2025)
par: Wang, Siyuan, et autres
Publié: (2025)
Think Step by Step: Chain-of-Gesture Prompting for Error Detection in Robotic Surgical Videos
par: Shao, Zhimin, et autres
Publié: (2024)
par: Shao, Zhimin, et autres
Publié: (2024)
Bridge to Non-Barrier Communication: Gloss-Prompted Fine-grained Cued Speech Gesture Generation with Diffusion Model
par: Lei, Wentao, et autres
Publié: (2024)
par: Lei, Wentao, et autres
Publié: (2024)
Recognizing Co-Speech Gestures in-the-Wild
par: Hegde, Sindhu B, et autres
Publié: (2026)
par: Hegde, Sindhu B, et autres
Publié: (2026)
Interpretable Underwater Diver Gesture Recognition
par: Mangalvedhekar, Sudeep, et autres
Publié: (2023)
par: Mangalvedhekar, Sudeep, et autres
Publié: (2023)
Zero-Shot Underwater Gesture Recognition
par: Sarma, Sandipan, et autres
Publié: (2024)
par: Sarma, Sandipan, et autres
Publié: (2024)
Understanding Co-speech Gestures in-the-wild
par: Hegde, Sindhu B, et autres
Publié: (2025)
par: Hegde, Sindhu B, et autres
Publié: (2025)
Towards Open-World Gesture Recognition
par: Shen, Junxiao, et autres
Publié: (2024)
par: Shen, Junxiao, et autres
Publié: (2024)
An Evaluation of Large Pre-Trained Models for Gesture Recognition using Synthetic Videos
par: Reddy, Arun, et autres
Publié: (2024)
par: Reddy, Arun, et autres
Publié: (2024)
EmotionGesture: Audio-Driven Diverse Emotional Co-Speech 3D Gesture Generation
par: Qi, Xingqun, et autres
Publié: (2023)
par: Qi, Xingqun, et autres
Publié: (2023)
EasyGenNet: An Efficient Framework for Audio-Driven Gesture Video Generation Based on Diffusion Model
par: Li, Renda, et autres
Publié: (2025)
par: Li, Renda, et autres
Publié: (2025)
SynthoGestures: A Novel Framework for Synthetic Dynamic Hand Gesture Generation for Driving Scenarios
par: Gomaa, Amr, et autres
Publié: (2023)
par: Gomaa, Amr, et autres
Publié: (2023)
Co-Speech Gesture Video Generation via Motion-Decoupled Diffusion Model
par: He, Xu, et autres
Publié: (2024)
par: He, Xu, et autres
Publié: (2024)
Emphasizing Semantic Consistency of Salient Posture for Speech-Driven Gesture Generation
par: Liu, Fengqi, et autres
Publié: (2024)
par: Liu, Fengqi, et autres
Publié: (2024)
Audio-driven Gesture Generation via Deviation Feature in the Latent Space
par: Chen, Jiahui, et autres
Publié: (2025)
par: Chen, Jiahui, et autres
Publié: (2025)
Documents similaires
-
Snapture -- A Novel Neural Architecture for Combined Static and Dynamic Hand Gesture Recognition
par: Ali, Hassan, et autres
Publié: (2022) -
Contextual Gesture: Co-Speech Gesture Video Generation through Context-aware Gesture Representation
par: Liu, Pinxin, et autres
Publié: (2025) -
Conveying Meaning through Gestures: An Investigation into Semantic Co-Speech Gesture Generation
par: Voss, Hendric, et autres
Publié: (2025) -
LiveGesture Streamable Co-Speech Gesture Generation Model
par: Saleem, Muhammad Usama, et autres
Publié: (2026) -
Zero-shot Prompt-based Video Encoder for Surgical Gesture Recognition
par: Rao, Mingxing, et autres
Publié: (2024)