DiM-Gesture: Co-Speech Gesture Generation with Adaptive Layer Normalization Mamba-2 framework
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Fan, Ji, Naye, Gao, Fuxing, Zhao, Bozuo, Wu, Jingmei, Jiang, Yanbing, Du, Hui, Ye, Zhenqing, Zhu, Jiayang, Zhong, WeiFan, Yan, Leyao, Ma, Xiaomeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DiM-Gestor: Co-Speech Gesture Generation with Adaptive Layer Normalization Mamba-2
di: Zhang, Fan, et al.
Pubblicazione: (2024)
di: Zhang, Fan, et al.
Pubblicazione: (2024)
Speech-driven Personalized Gesture Synthetics: Harnessing Automatic Fuzzy Feature Inference
di: Zhang, Fan, et al.
Pubblicazione: (2024)
di: Zhang, Fan, et al.
Pubblicazione: (2024)
Audio is all in one: speech-driven gesture synthetics using WavLM pre-trained model
di: Zhang, Fan, et al.
Pubblicazione: (2023)
di: Zhang, Fan, et al.
Pubblicazione: (2023)
MAG: Multi-Modal Aligned Autoregressive Co-Speech Gesture Generation without Vector Quantization
di: Liu, Binjie, et al.
Pubblicazione: (2025)
di: Liu, Binjie, et al.
Pubblicazione: (2025)
Semantic Gesticulator: Semantics-Aware Co-Speech Gesture Synthesis
di: Zhang, Zeyi, et al.
Pubblicazione: (2024)
di: Zhang, Zeyi, et al.
Pubblicazione: (2024)
Towards Unified Co-Speech Gesture Generation via Hierarchical Implicit Periodicity Learning
di: Guo, Xin, et al.
Pubblicazione: (2025)
di: Guo, Xin, et al.
Pubblicazione: (2025)
LLM Gesticulator: Leveraging Large Language Models for Scalable and Controllable Co-Speech Gesture Synthesis
di: Pang, Haozhou, et al.
Pubblicazione: (2024)
di: Pang, Haozhou, et al.
Pubblicazione: (2024)
DIDiffGes: Decoupled Semi-Implicit Diffusion Models for Real-time Gesture Generation from Speech
di: Cheng, Yongkang, et al.
Pubblicazione: (2025)
di: Cheng, Yongkang, et al.
Pubblicazione: (2025)
DiffSHEG: A Diffusion-Based Approach for Real-Time Speech-driven Holistic 3D Expression and Gesture Generation
di: Chen, Junming, et al.
Pubblicazione: (2024)
di: Chen, Junming, et al.
Pubblicazione: (2024)
GestureLSM: Latent Shortcut based Co-Speech Gesture Generation with Spatial-Temporal Modeling
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
MATHDance: Mamba-Transformer Architecture with Uniform Tokenization for High-Quality 3D Dance Generation
di: Yang, Kaixing, et al.
Pubblicazione: (2025)
di: Yang, Kaixing, et al.
Pubblicazione: (2025)
Intentional Gesture: Deliver Your Intentions with Gestures for Speech
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
di: Liu, Pinxin, et al.
Pubblicazione: (2025)
EchoMask: Speech-Queried Attention-based Mask Modeling for Holistic Co-Speech Motion Generation
di: Zhang, Xiangyue, et al.
Pubblicazione: (2025)
di: Zhang, Xiangyue, et al.
Pubblicazione: (2025)
Conditional GAN for Enhancing Diffusion Models in Efficient and Authentic Global Gesture Generation from Audios
di: Cheng, Yongkang, et al.
Pubblicazione: (2024)
di: Cheng, Yongkang, et al.
Pubblicazione: (2024)
UMo: Unified Sparse Motion Modeling for Real-Time Co-Speech Avatars
di: Zhan, Xiaoyu, et al.
Pubblicazione: (2026)
di: Zhan, Xiaoyu, et al.
Pubblicazione: (2026)
Integrating Representational Gestures into Automatically Generated Embodied Explanations and its Effects on Understanding and Interaction Quality
di: Robrecht, Amelie Sophie, et al.
Pubblicazione: (2024)
di: Robrecht, Amelie Sophie, et al.
Pubblicazione: (2024)
DuoGesture: Neuro-Inspired and Biomechanically Informed Dual-Stream Co-Speech Gesture Generation
di: Paar, Ferdinand, et al.
Pubblicazione: (2026)
di: Paar, Ferdinand, et al.
Pubblicazione: (2026)
EmoDiffGes: Emotion‐Aware Co‐Speech Holistic Gesture Generation with Progressive Synergistic Diffusion
di: Xinru Li, et al.
Pubblicazione: (2025)
di: Xinru Li, et al.
Pubblicazione: (2025)
M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis
di: Yin, Zhizhuo, et al.
Pubblicazione: (2025)
di: Yin, Zhizhuo, et al.
Pubblicazione: (2025)
PersonaGest: Personalized Co-Speech Gesture Generation with Semantic-Guided Hierarchical Motion Representation
di: Zhao, Junchuan, et al.
Pubblicazione: (2026)
di: Zhao, Junchuan, et al.
Pubblicazione: (2026)
Not Like Transformers: Drop the Beat Representation for Dance Generation with Mamba-Based Diffusion Model
di: Park, Sangjune, et al.
Pubblicazione: (2026)
di: Park, Sangjune, et al.
Pubblicazione: (2026)
Llanimation: Llama Driven Gesture Animation
di: J. Windle, et al.
Pubblicazione: (2024)
di: J. Windle, et al.
Pubblicazione: (2024)
Conversational Gesture Model (CGM): Extending Speaker‐Centric Audio‐Driven Motion Generation to Full Conversation Gestures
di: T. Koren, et al.
Pubblicazione: (2026)
di: T. Koren, et al.
Pubblicazione: (2026)
Unison: Harmonizing Motion, Speech, and Sound for Human-Centric Audio-Video Generation
di: Cheng, Shihao, et al.
Pubblicazione: (2026)
di: Cheng, Shihao, et al.
Pubblicazione: (2026)
Text2Gestures: A Transformer-Based Network for Generating Emotive Body Gestures for Virtual Agents
di: Bhattacharya, Uttaran, et al.
Pubblicazione: (2021)
di: Bhattacharya, Uttaran, et al.
Pubblicazione: (2021)
SonicRadiation: A Hybrid Numerical Solution for Sound Radiation without Ghost Cells
di: Jin, Xutong, et al.
Pubblicazione: (2025)
di: Jin, Xutong, et al.
Pubblicazione: (2025)
TalkingMachines: Real-Time Audio-Driven FaceTime-Style Video via Autoregressive Diffusion Models
di: Low, Chetwin, et al.
Pubblicazione: (2025)
di: Low, Chetwin, et al.
Pubblicazione: (2025)
SounDiT: Geo-Contextual Soundscape-to-Landscape Generation
di: Wang, Junbo, et al.
Pubblicazione: (2025)
di: Wang, Junbo, et al.
Pubblicazione: (2025)
Meta-Learning Empowered Meta-Face: Personalized Speaking Style Adaptation for Audio-Driven 3D Talking Face Animation
di: Zhou, Xukun, et al.
Pubblicazione: (2024)
di: Zhou, Xukun, et al.
Pubblicazione: (2024)
It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model
di: Shi, Mingyi, et al.
Pubblicazione: (2024)
di: Shi, Mingyi, et al.
Pubblicazione: (2024)
Text-Driven Voice Conversion via Latent State-Space Modeling
di: Li, Wen, et al.
Pubblicazione: (2025)
di: Li, Wen, et al.
Pubblicazione: (2025)
Listen and Move: Improving GANs Coherency in Agnostic Sound-to-Video Generation
di: Redondo, Rafael
Pubblicazione: (2024)
di: Redondo, Rafael
Pubblicazione: (2024)
DGFM: Full Body Dance Generation Driven by Music Foundation Models
di: Liu, Xinran, et al.
Pubblicazione: (2025)
di: Liu, Xinran, et al.
Pubblicazione: (2025)
Content and Style Aware Audio-Driven Facial Animation
di: Liu, Qingju, et al.
Pubblicazione: (2024)
di: Liu, Qingju, et al.
Pubblicazione: (2024)
NAT: Neural Acoustic Transfer for Interactive Scenes in Real Time
di: Jin, Xutong, et al.
Pubblicazione: (2025)
di: Jin, Xutong, et al.
Pubblicazione: (2025)
EnchantDance: Unveiling the Potential of Music-Driven Dance Movement
di: Han, Bo, et al.
Pubblicazione: (2023)
di: Han, Bo, et al.
Pubblicazione: (2023)
ELGAR: Expressive Cello Performance Motion Generation for Audio Rendition
di: Qiu, Zhiping, et al.
Pubblicazione: (2025)
di: Qiu, Zhiping, et al.
Pubblicazione: (2025)
SyncViolinist: Music-Oriented Violin Motion Generation Based on Bowing and Fingering
di: Nishizawa, Hiroki, et al.
Pubblicazione: (2024)
di: Nishizawa, Hiroki, et al.
Pubblicazione: (2024)
Beat-It: Beat-Synchronized Multi-Condition 3D Dance Generation
di: Huang, Zikai, et al.
Pubblicazione: (2024)
di: Huang, Zikai, et al.
Pubblicazione: (2024)
Robust Photo-Realistic Hand Gesture Generation: from Single View to Multiple View
di: Fu, Qifan, et al.
Pubblicazione: (2025)
di: Fu, Qifan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DiM-Gestor: Co-Speech Gesture Generation with Adaptive Layer Normalization Mamba-2
di: Zhang, Fan, et al.
Pubblicazione: (2024) -
Speech-driven Personalized Gesture Synthetics: Harnessing Automatic Fuzzy Feature Inference
di: Zhang, Fan, et al.
Pubblicazione: (2024) -
Audio is all in one: speech-driven gesture synthetics using WavLM pre-trained model
di: Zhang, Fan, et al.
Pubblicazione: (2023) -
MAG: Multi-Modal Aligned Autoregressive Co-Speech Gesture Generation without Vector Quantization
di: Liu, Binjie, et al.
Pubblicazione: (2025) -
Semantic Gesticulator: Semantics-Aware Co-Speech Gesture Synthesis
di: Zhang, Zeyi, et al.
Pubblicazione: (2024)