Bridge to Non-Barrier Communication: Gloss-Prompted Fine-grained Cued Speech Gesture Generation with Diffusion Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Lei, Wentao, Liu, Li, Wang, Jun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LiveGesture Streamable Co-Speech Gesture Generation Model
di: Saleem, Muhammad Usama, et al.
Pubblicazione: (2026)
di: Saleem, Muhammad Usama, et al.
Pubblicazione: (2026)
EFDiT: Efficient Fine-grained Image Generation Using Diffusion Transformer Models
di: Wang, Kun, et al.
Pubblicazione: (2025)
di: Wang, Kun, et al.
Pubblicazione: (2025)
Bridging Sign and Spoken Languages: Pseudo Gloss Generation for Sign Language Translation
di: Guo, Jianyuan, et al.
Pubblicazione: (2025)
di: Guo, Jianyuan, et al.
Pubblicazione: (2025)
FineDiffusion: Scaling up Diffusion Models for Fine-grained Image Generation with 10,000 Classes
di: Pan, Ziying, et al.
Pubblicazione: (2024)
di: Pan, Ziying, et al.
Pubblicazione: (2024)
MDT-A2G: Exploring Masked Diffusion Transformers for Co-Speech Gesture Generation
di: Mao, Xiaofeng, et al.
Pubblicazione: (2024)
di: Mao, Xiaofeng, et al.
Pubblicazione: (2024)
GestureLSM: Latent Shortcut based Co-Speech Gesture Generation with Spatial-Temporal Modeling
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
InteracTalker: Prompt-Based Human-Object Interaction with Co-Speech Gesture Generation
di: Rajan, Sreehari, et al.
Pubblicazione: (2025)
di: Rajan, Sreehari, et al.
Pubblicazione: (2025)
Style-Aware Gloss Control for Generative Non-Photorealistic Rendering
di: Jimenez-Navarro, Santiago, et al.
Pubblicazione: (2026)
di: Jimenez-Navarro, Santiago, et al.
Pubblicazione: (2026)
Prompt-to-Gesture: Measuring the Capabilities of Image-to-Video Deictic Gesture Generation
di: Ali, Hassan, et al.
Pubblicazione: (2026)
di: Ali, Hassan, et al.
Pubblicazione: (2026)
EMAGE: Towards Unified Holistic Co-Speech Gesture Generation via Expressive Masked Audio Gesture Modeling
di: Liu, Haiyang, et al.
Pubblicazione: (2023)
di: Liu, Haiyang, et al.
Pubblicazione: (2023)
Co-Speech Gesture Video Generation via Motion-Decoupled Diffusion Model
di: He, Xu, et al.
Pubblicazione: (2024)
di: He, Xu, et al.
Pubblicazione: (2024)
PersonaGesture: Single-Reference Co-Speech Gesture Personalization for Unseen Speakers
di: Zhang, Xiangyue, et al.
Pubblicazione: (2026)
di: Zhang, Xiangyue, et al.
Pubblicazione: (2026)
Joint Co-Speech Gesture and Expressive Talking Face Generation using Diffusion with Adapters
di: Hogue, Steven, et al.
Pubblicazione: (2024)
di: Hogue, Steven, et al.
Pubblicazione: (2024)
FiVE: A Fine-grained Video Editing Benchmark for Evaluating Emerging Diffusion and Rectified Flow Models
di: Li, Minghan, et al.
Pubblicazione: (2025)
di: Li, Minghan, et al.
Pubblicazione: (2025)
FocusDiT: Masking Queries in Diffusion Transformers for Fine-grained Image Generation
di: Fang, Xueji, et al.
Pubblicazione: (2026)
di: Fang, Xueji, et al.
Pubblicazione: (2026)
Contextual Gesture: Co-Speech Gesture Video Generation through Context-aware Gesture Representation
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
Emphasizing Semantic Consistency of Salient Posture for Speech-Driven Gesture Generation
di: Liu, Fengqi, et al.
Pubblicazione: (2024)
di: Liu, Fengqi, et al.
Pubblicazione: (2024)
TANGO: Co-Speech Gesture Video Reenactment with Hierarchical Audio Motion Embedding and Diffusion Interpolation
di: Liu, Haiyang, et al.
Pubblicazione: (2024)
di: Liu, Haiyang, et al.
Pubblicazione: (2024)
DuoGesture: Neuro-Inspired and Biomechanically Informed Dual-Stream Co-Speech Gesture Generation
di: Paar, Ferdinand, et al.
Pubblicazione: (2026)
di: Paar, Ferdinand, et al.
Pubblicazione: (2026)
Cosh-DiT: Co-Speech Gesture Video Synthesis via Hybrid Audio-Visual Diffusion Transformers
di: Sun, Yasheng, et al.
Pubblicazione: (2025)
di: Sun, Yasheng, et al.
Pubblicazione: (2025)
CoordSpeaker: Exploiting Gesture Captioning for Coordinated Caption-Empowered Co-Speech Gesture Generation
di: Fang, Fengyi, et al.
Pubblicazione: (2025)
di: Fang, Fengyi, et al.
Pubblicazione: (2025)
Leveraging Speech for Gesture Detection in Multimodal Communication
di: Ghaleb, Esam, et al.
Pubblicazione: (2024)
di: Ghaleb, Esam, et al.
Pubblicazione: (2024)
Beyond Gloss: A Hand-Centric Framework for Gloss-Free Sign Language Translation
di: Asasi, Sobhan, et al.
Pubblicazione: (2025)
di: Asasi, Sobhan, et al.
Pubblicazione: (2025)
MARS: Mixture of Auto-Regressive Models for Fine-grained Text-to-image Synthesis
di: He, Wanggui, et al.
Pubblicazione: (2024)
di: He, Wanggui, et al.
Pubblicazione: (2024)
EasyGenNet: An Efficient Framework for Audio-Driven Gesture Video Generation Based on Diffusion Model
di: Li, Renda, et al.
Pubblicazione: (2025)
di: Li, Renda, et al.
Pubblicazione: (2025)
Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion
di: Qi, Xingqun, et al.
Pubblicazione: (2025)
di: Qi, Xingqun, et al.
Pubblicazione: (2025)
MMGT: Motion Mask Guided Two-Stage Network for Co-Speech Gesture Video Generation
di: Wang, Siyuan, et al.
Pubblicazione: (2025)
di: Wang, Siyuan, et al.
Pubblicazione: (2025)
Towards Generative Class Prompt Learning for Fine-grained Visual Recognition
di: Chattopadhyay, Soumitri, et al.
Pubblicazione: (2024)
di: Chattopadhyay, Soumitri, et al.
Pubblicazione: (2024)
Beyond Binary Preference: Aligning Diffusion Models to Fine-grained Criteria by Decoupling Attributes
di: Meng, Chenye, et al.
Pubblicazione: (2026)
di: Meng, Chenye, et al.
Pubblicazione: (2026)
ConvoFusion: Multi-Modal Conversational Diffusion for Co-Speech Gesture Synthesis
di: Mughal, Muhammad Hamza, et al.
Pubblicazione: (2024)
di: Mughal, Muhammad Hamza, et al.
Pubblicazione: (2024)
Adversarial Reconstruction Feedback for Robust Fine-grained Generalization
di: Wang, Shijie, et al.
Pubblicazione: (2025)
di: Wang, Shijie, et al.
Pubblicazione: (2025)
Is this Generated Person Existed in Real-world? Fine-grained Detecting and Calibrating Abnormal Human-body
di: Wang, Zeqing, et al.
Pubblicazione: (2024)
di: Wang, Zeqing, et al.
Pubblicazione: (2024)
FiVA: Fine-grained Visual Attribute Dataset for Text-to-Image Diffusion Models
di: Wu, Tong, et al.
Pubblicazione: (2024)
di: Wu, Tong, et al.
Pubblicazione: (2024)
Conveying Meaning through Gestures: An Investigation into Semantic Co-Speech Gesture Generation
di: Voss, Hendric, et al.
Pubblicazione: (2025)
di: Voss, Hendric, et al.
Pubblicazione: (2025)
Mesh-RFT: Enhancing Mesh Generation via Fine-grained Reinforcement Fine-Tuning
di: Liu, Jian, et al.
Pubblicazione: (2025)
di: Liu, Jian, et al.
Pubblicazione: (2025)
EmotionGesture: Audio-Driven Diverse Emotional Co-Speech 3D Gesture Generation
di: Qi, Xingqun, et al.
Pubblicazione: (2023)
di: Qi, Xingqun, et al.
Pubblicazione: (2023)
Recognizing Co-Speech Gestures in-the-Wild
di: Hegde, Sindhu B, et al.
Pubblicazione: (2026)
di: Hegde, Sindhu B, et al.
Pubblicazione: (2026)
Prompting Video-Language Foundation Models with Domain-specific Fine-grained Heuristics for Video Question Answering
di: Yu, Ting, et al.
Pubblicazione: (2024)
di: Yu, Ting, et al.
Pubblicazione: (2024)
Intentional Gesture: Deliver Your Intentions with Gestures for Speech
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
Spec-Gloss Surfels and Normal-Diffuse Priors for Relightable Glossy Objects
di: Kouros, Georgios, et al.
Pubblicazione: (2025)
di: Kouros, Georgios, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LiveGesture Streamable Co-Speech Gesture Generation Model
di: Saleem, Muhammad Usama, et al.
Pubblicazione: (2026) -
EFDiT: Efficient Fine-grained Image Generation Using Diffusion Transformer Models
di: Wang, Kun, et al.
Pubblicazione: (2025) -
Bridging Sign and Spoken Languages: Pseudo Gloss Generation for Sign Language Translation
di: Guo, Jianyuan, et al.
Pubblicazione: (2025) -
FineDiffusion: Scaling up Diffusion Models for Fine-grained Image Generation with 10,000 Classes
di: Pan, Ziying, et al.
Pubblicazione: (2024) -
MDT-A2G: Exploring Masked Diffusion Transformers for Co-Speech Gesture Generation
di: Mao, Xiaofeng, et al.
Pubblicazione: (2024)