HolisticSemGes: Semantic Grounding of Holistic Co-Speech Gesture Generation with Contrastive Flow-Matching
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Lanmiao, Ghaleb, Esam, Özyürek, Aslı, Yumak, Zerrin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning
di: Liu, Lanmiao, et al.
Pubblicazione: (2025)
di: Liu, Lanmiao, et al.
Pubblicazione: (2025)
DuoGesture: Neuro-Inspired and Biomechanically Informed Dual-Stream Co-Speech Gesture Generation
di: Paar, Ferdinand, et al.
Pubblicazione: (2026)
di: Paar, Ferdinand, et al.
Pubblicazione: (2026)
I see what you mean: Co-Speech Gestures for Reference Resolution in Multimodal Dialogue
di: Ghaleb, Esam, et al.
Pubblicazione: (2025)
di: Ghaleb, Esam, et al.
Pubblicazione: (2025)
Learning Co-Speech Gesture Representations in Dialogue through Contrastive Learning: An Intrinsic Evaluation
di: Ghaleb, Esam, et al.
Pubblicazione: (2024)
di: Ghaleb, Esam, et al.
Pubblicazione: (2024)
Co-Speech Gesture Detection through Multi-Phase Sequence Labeling
di: Ghaleb, Esam, et al.
Pubblicazione: (2023)
di: Ghaleb, Esam, et al.
Pubblicazione: (2023)
Leveraging Speech for Gesture Detection in Multimodal Communication
di: Ghaleb, Esam, et al.
Pubblicazione: (2024)
di: Ghaleb, Esam, et al.
Pubblicazione: (2024)
The Visual Iconicity Challenge: Evaluating Vision-Language Models on Sign Language Form-Meaning Mapping
di: Keleş, Onur, et al.
Pubblicazione: (2025)
di: Keleş, Onur, et al.
Pubblicazione: (2025)
EMAGE: Towards Unified Holistic Co-Speech Gesture Generation via Expressive Masked Audio Gesture Modeling
di: Liu, Haiyang, et al.
Pubblicazione: (2023)
di: Liu, Haiyang, et al.
Pubblicazione: (2023)
SemTalk: Holistic Co-speech Motion Generation with Frame-level Semantic Emphasis
di: Zhang, Xiangyue, et al.
Pubblicazione: (2024)
di: Zhang, Xiangyue, et al.
Pubblicazione: (2024)
ProbTalk3D: Non-Deterministic Emotion Controllable Speech-Driven 3D Facial Animation Synthesis Using VQ-VAE
di: Wu, Sichun, et al.
Pubblicazione: (2024)
di: Wu, Sichun, et al.
Pubblicazione: (2024)
VarGes: Improving Variation in Co-Speech 3D Gesture Generation via StyleCLIPS
di: Meng, Ming, et al.
Pubblicazione: (2025)
di: Meng, Ming, et al.
Pubblicazione: (2025)
Towards Variable and Coordinated Holistic Co-Speech Motion Generation
di: Liu, Yifei, et al.
Pubblicazione: (2024)
di: Liu, Yifei, et al.
Pubblicazione: (2024)
HoloGest: Decoupled Diffusion and Motion Priors for Generating Holisticly Expressive Co-speech Gestures
di: Cheng, Yongkang, et al.
Pubblicazione: (2025)
di: Cheng, Yongkang, et al.
Pubblicazione: (2025)
GesGPT: Speech Gesture Synthesis With Text Parsing from ChatGPT
di: Gao, Nan, et al.
Pubblicazione: (2023)
di: Gao, Nan, et al.
Pubblicazione: (2023)
E.M.Ground: A Temporal Grounding Vid-LLM with Holistic Event Perception and Matching
di: Nie, Jiahao, et al.
Pubblicazione: (2026)
di: Nie, Jiahao, et al.
Pubblicazione: (2026)
Holistic Semantic Representation for Navigational Trajectory Generation
di: Cao, Ji, et al.
Pubblicazione: (2025)
di: Cao, Ji, et al.
Pubblicazione: (2025)
GesVLA: Gesture-Aware Vision-Language-Action Model Embedded Representations
di: Guo, Wenxuan, et al.
Pubblicazione: (2026)
di: Guo, Wenxuan, et al.
Pubblicazione: (2026)
Conveying Meaning through Gestures: An Investigation into Semantic Co-Speech Gesture Generation
di: Voss, Hendric, et al.
Pubblicazione: (2025)
di: Voss, Hendric, et al.
Pubblicazione: (2025)
EchoMask: Speech-Queried Attention-based Mask Modeling for Holistic Co-Speech Motion Generation
di: Zhang, Xiangyue, et al.
Pubblicazione: (2025)
di: Zhang, Xiangyue, et al.
Pubblicazione: (2025)
LiveGesture Streamable Co-Speech Gesture Generation Model
di: Saleem, Muhammad Usama, et al.
Pubblicazione: (2026)
di: Saleem, Muhammad Usama, et al.
Pubblicazione: (2026)
DIDiffGes: Decoupled Semi-Implicit Diffusion Models for Real-time Gesture Generation from Speech
di: Cheng, Yongkang, et al.
Pubblicazione: (2025)
di: Cheng, Yongkang, et al.
Pubblicazione: (2025)
ImaGGen: Zero-Shot Generation of Co-Speech Semantic Gestures Grounded in Language and Image Input
di: Voss, Hendric, et al.
Pubblicazione: (2025)
di: Voss, Hendric, et al.
Pubblicazione: (2025)
Language and Geometry Grounded Sparse Voxel Representations for Holistic Scene Understanding
di: Wu, Guile, et al.
Pubblicazione: (2026)
di: Wu, Guile, et al.
Pubblicazione: (2026)
MambaTalk: Efficient Holistic Gesture Synthesis with Selective State Space Models
di: Xu, Zunnan, et al.
Pubblicazione: (2024)
di: Xu, Zunnan, et al.
Pubblicazione: (2024)
ExGes: Expressive Human Motion Retrieval and Modulation for Audio-Driven Gesture Synthesis
di: Zhou, Xukun, et al.
Pubblicazione: (2025)
di: Zhou, Xukun, et al.
Pubblicazione: (2025)
3DGesPolicy: Phoneme-Aware Holistic Co-Speech Gesture Generation Based on Action Control
di: Sha, Xuanmeng, et al.
Pubblicazione: (2026)
di: Sha, Xuanmeng, et al.
Pubblicazione: (2026)
GestureLSM: Latent Shortcut based Co-Speech Gesture Generation with Spatial-Temporal Modeling
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
Emphasizing Semantic Consistency of Salient Posture for Speech-Driven Gesture Generation
di: Liu, Fengqi, et al.
Pubblicazione: (2024)
di: Liu, Fengqi, et al.
Pubblicazione: (2024)
Contextual Gesture: Co-Speech Gesture Video Generation through Context-aware Gesture Representation
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
Ges3ViG: Incorporating Pointing Gestures into Language-Based 3D Visual Grounding for Embodied Reference Understanding
di: Mane, Atharv Mahesh, et al.
Pubblicazione: (2025)
di: Mane, Atharv Mahesh, et al.
Pubblicazione: (2025)
GROUNDHOG: Grounding Large Language Models to Holistic Segmentation
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
Recognizing Co-Speech Gestures in-the-Wild
di: Hegde, Sindhu B, et al.
Pubblicazione: (2026)
di: Hegde, Sindhu B, et al.
Pubblicazione: (2026)
CoordSpeaker: Exploiting Gesture Captioning for Coordinated Caption-Empowered Co-Speech Gesture Generation
di: Fang, Fengyi, et al.
Pubblicazione: (2025)
di: Fang, Fengyi, et al.
Pubblicazione: (2025)
PersonaGesture: Single-Reference Co-Speech Gesture Personalization for Unseen Speakers
di: Zhang, Xiangyue, et al.
Pubblicazione: (2026)
di: Zhang, Xiangyue, et al.
Pubblicazione: (2026)
On the Holistic Approach for Detecting Human Image Forgery
di: Guo, Xiao, et al.
Pubblicazione: (2026)
di: Guo, Xiao, et al.
Pubblicazione: (2026)
Semantic Gesticulator: Semantics-Aware Co-Speech Gesture Synthesis
di: Zhang, Zeyi, et al.
Pubblicazione: (2024)
di: Zhang, Zeyi, et al.
Pubblicazione: (2024)
Let Me Finish My Sentence: Video Temporal Grounding with Holistic Text Understanding
di: Woo, Jongbhin, et al.
Pubblicazione: (2024)
di: Woo, Jongbhin, et al.
Pubblicazione: (2024)
DiffSHEG: A Diffusion-Based Approach for Real-Time Speech-driven Holistic 3D Expression and Gesture Generation
di: Chen, Junming, et al.
Pubblicazione: (2024)
di: Chen, Junming, et al.
Pubblicazione: (2024)
Towards Holistic Surgical Scene Graph
di: Shin, Jongmin, et al.
Pubblicazione: (2025)
di: Shin, Jongmin, et al.
Pubblicazione: (2025)
Omni-ID: Holistic Identity Representation Designed for Generative Tasks
di: Qian, Guocheng, et al.
Pubblicazione: (2024)
di: Qian, Guocheng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning
di: Liu, Lanmiao, et al.
Pubblicazione: (2025) -
DuoGesture: Neuro-Inspired and Biomechanically Informed Dual-Stream Co-Speech Gesture Generation
di: Paar, Ferdinand, et al.
Pubblicazione: (2026) -
I see what you mean: Co-Speech Gestures for Reference Resolution in Multimodal Dialogue
di: Ghaleb, Esam, et al.
Pubblicazione: (2025) -
Learning Co-Speech Gesture Representations in Dialogue through Contrastive Learning: An Intrinsic Evaluation
di: Ghaleb, Esam, et al.
Pubblicazione: (2024) -
Co-Speech Gesture Detection through Multi-Phase Sequence Labeling
di: Ghaleb, Esam, et al.
Pubblicazione: (2023)