Motion is the Choreographer: Learning Latent Pose Dynamics for Seamless Sign Language Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | He, Jiayi, Wang, Xu, Tang, Shengeng, Wang, Yaxiong, Cheng, Lechao, Guo, Dan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Text-Driven Diffusion Model for Sign Language Production
por: He, Jiayi, et al.
Publicado: (2025)
por: He, Jiayi, et al.
Publicado: (2025)
Discrete to Continuous: Generating Smooth Transition Poses from Sign Language Observation
por: Tang, Shengeng, et al.
Publicado: (2024)
por: Tang, Shengeng, et al.
Publicado: (2024)
SignAligner: Harmonizing Complementary Pose Modalities for Coherent Sign Language Generation
por: Wang, Xu, et al.
Publicado: (2025)
por: Wang, Xu, et al.
Publicado: (2025)
CanonSLR: Canonical-View Guided Multi-View Continuous Sign Language Recognition
por: Wang, Xu, et al.
Publicado: (2026)
por: Wang, Xu, et al.
Publicado: (2026)
StgcDiff: Spatial-Temporal Graph Condition Diffusion for Sign Language Transition Generation
por: He, Jiashu, et al.
Publicado: (2025)
por: He, Jiashu, et al.
Publicado: (2025)
Towards Fine-Grained Emotion Understanding via Skeleton-Based Micro-Gesture Recognition
por: Xu, Hao, et al.
Publicado: (2025)
por: Xu, Hao, et al.
Publicado: (2025)
Knowledge Swapping via Learning and Unlearning
por: Xing, Mingyu, et al.
Publicado: (2025)
por: Xing, Mingyu, et al.
Publicado: (2025)
Sign-IDD: Iconicity Disentangled Diffusion for Sign Language Production
por: Tang, Shengeng, et al.
Publicado: (2024)
por: Tang, Shengeng, et al.
Publicado: (2024)
Shaping a Stabilized Video by Mitigating Unintended Changes for Concept-Augmented Video Editing
por: Guo, Mingce, et al.
Publicado: (2024)
por: Guo, Mingce, et al.
Publicado: (2024)
Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline
por: Li, Haiyang, et al.
Publicado: (2025)
por: Li, Haiyang, et al.
Publicado: (2025)
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
por: He, Jiayi, et al.
Publicado: (2025)
por: He, Jiayi, et al.
Publicado: (2025)
Modality Alignment Meets Federated Broadcasting
por: Ma, Yuting, et al.
Publicado: (2024)
por: Ma, Yuting, et al.
Publicado: (2024)
Linguistics-Vision Monotonic Consistent Network for Sign Language Production
por: Wang, Xu, et al.
Publicado: (2024)
por: Wang, Xu, et al.
Publicado: (2024)
Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering
por: Wang, Xu, et al.
Publicado: (2025)
por: Wang, Xu, et al.
Publicado: (2025)
OmniVL-Guard: Towards Unified Vision-Language Forgery Detection and Grounding via Balanced RL
por: Shen, Jinjie, et al.
Publicado: (2026)
por: Shen, Jinjie, et al.
Publicado: (2026)
Open-World 3D Scene Graph Generation for Retrieval-Augmented Reasoning
por: Yu, Fei, et al.
Publicado: (2025)
por: Yu, Fei, et al.
Publicado: (2025)
SplitGaussian: Reconstructing Dynamic Scenes via Visual Geometry Decomposition
por: Li, Jiahui, et al.
Publicado: (2025)
por: Li, Jiahui, et al.
Publicado: (2025)
SSAM: Self-Supervised Association Modeling for Test-Time Adaption
por: Wang, Yaxiong, et al.
Publicado: (2025)
por: Wang, Yaxiong, et al.
Publicado: (2025)
TDEdit: A Unified Diffusion Framework for Text-Drag Guided Image Manipulation
por: Wang, Qihang, et al.
Publicado: (2025)
por: Wang, Qihang, et al.
Publicado: (2025)
Navigating Semantic Drift in Task-Agnostic Class-Incremental Learning
por: Wu, Fangwen, et al.
Publicado: (2025)
por: Wu, Fangwen, et al.
Publicado: (2025)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
por: Zhang, Zhenxing, et al.
Publicado: (2024)
por: Zhang, Zhenxing, et al.
Publicado: (2024)
OmniVL-Guard Pro: A Tool-Augmented Agent for Omnibus Vision-Language Forensics
por: Shen, Jinjie, et al.
Publicado: (2026)
por: Shen, Jinjie, et al.
Publicado: (2026)
Towards Micro-Action Recognition with Limited Annotations: An Asynchronous Pseudo Labeling and Training Approach
por: Zhang, Yan, et al.
Publicado: (2025)
por: Zhang, Yan, et al.
Publicado: (2025)
EntityCLIP: Entity-Centric Image-Text Matching via Multimodal Attentive Contrastive Learning
por: Wang, Yaxiong, et al.
Publicado: (2024)
por: Wang, Yaxiong, et al.
Publicado: (2024)
Dataset Distillers Are Good Label Denoisers In the Wild
por: Cheng, Lechao, et al.
Publicado: (2024)
por: Cheng, Lechao, et al.
Publicado: (2024)
FedHPL: Efficient Heterogeneous Federated Learning with Prompt Tuning and Logit Distillation
por: Ma, Yuting, et al.
Publicado: (2024)
por: Ma, Yuting, et al.
Publicado: (2024)
FlashSign: Pose-Free Guidance for Efficient Sign Language Video Generation
por: Zhang, Liuzhou, et al.
Publicado: (2026)
por: Zhang, Liuzhou, et al.
Publicado: (2026)
Spoofing-aware Prompt Learning for Unified Physical-Digital Facial Attack Detection
por: Guo, Jiabao, et al.
Publicado: (2025)
por: Guo, Jiabao, et al.
Publicado: (2025)
SignAvatar: Sign Language 3D Motion Reconstruction and Generation
por: Dong, Lu, et al.
Publicado: (2024)
por: Dong, Lu, et al.
Publicado: (2024)
SLRTP2025 Sign Language Production Challenge: Methodology, Results, and Future Work
por: Walsh, Harry, et al.
Publicado: (2025)
por: Walsh, Harry, et al.
Publicado: (2025)
Beyond Artificial Misalignment: Detecting and Grounding Semantic-Coordinated Multimodal Manipulations
por: Shen, Jinjie, et al.
Publicado: (2025)
por: Shen, Jinjie, et al.
Publicado: (2025)
Towards Pixel-Level Prediction for Gaze Following: Benchmark and Approach
por: Liu, Feiyang, et al.
Publicado: (2024)
por: Liu, Feiyang, et al.
Publicado: (2024)
LoopGaussian: Creating 3D Cinemagraph with Multi-view Images via Eulerian Motion Field
por: Li, Jiyang, et al.
Publicado: (2024)
por: Li, Jiyang, et al.
Publicado: (2024)
NaTex: Seamless Texture Generation as Latent Color Diffusion
por: Lai, Zeqiang, et al.
Publicado: (2025)
por: Lai, Zeqiang, et al.
Publicado: (2025)
Decoupled Training with Local Reinforcement Fine-Tuning in Federated Learning
por: Ma, Yuting, et al.
Publicado: (2026)
por: Ma, Yuting, et al.
Publicado: (2026)
SignX: Continuous Sign Recognition in Compact Pose-Rich Latent Space
por: Fang, Sen, et al.
Publicado: (2025)
por: Fang, Sen, et al.
Publicado: (2025)
Pose-Guided Fine-Grained Sign Language Video Generation
por: Shi, Tongkai, et al.
Publicado: (2024)
por: Shi, Tongkai, et al.
Publicado: (2024)
MotionGPT-2: A General-Purpose Motion-Language Model for Motion Generation and Understanding
por: Wang, Yuan, et al.
Publicado: (2024)
por: Wang, Yuan, et al.
Publicado: (2024)
Choreographing a World of Dynamic Objects
por: Lyu, Yanzhe, et al.
Publicado: (2026)
por: Lyu, Yanzhe, et al.
Publicado: (2026)
Generative Human Motion Stylization in Latent Space
por: Guo, Chuan, et al.
Publicado: (2024)
por: Guo, Chuan, et al.
Publicado: (2024)
Ejemplares similares
-
Text-Driven Diffusion Model for Sign Language Production
por: He, Jiayi, et al.
Publicado: (2025) -
Discrete to Continuous: Generating Smooth Transition Poses from Sign Language Observation
por: Tang, Shengeng, et al.
Publicado: (2024) -
SignAligner: Harmonizing Complementary Pose Modalities for Coherent Sign Language Generation
por: Wang, Xu, et al.
Publicado: (2025) -
CanonSLR: Canonical-View Guided Multi-View Continuous Sign Language Recognition
por: Wang, Xu, et al.
Publicado: (2026) -
StgcDiff: Spatial-Temporal Graph Condition Diffusion for Sign Language Transition Generation
por: He, Jiashu, et al.
Publicado: (2025)