Pose-Guided Fine-Grained Sign Language Video Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Shi, Tongkai, Hu, Lianyu, Shang, Fanhua, Feng, Jichao, Liu, Peidong, Feng, Wei |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Deep Correlated Prompting for Visual Recognition with Missing Modalities
by: Hu, Lianyu, et al.
Published: (2024)
by: Hu, Lianyu, et al.
Published: (2024)
Improving Continuous Sign Language Recognition with Adapted Image Models
by: Hu, Lianyu, et al.
Published: (2024)
by: Hu, Lianyu, et al.
Published: (2024)
LightVLM: Acceleraing Large Multimodal Models with Pyramid Token Merging and KV Cache Compression
by: Hu, Lianyu, et al.
Published: (2025)
by: Hu, Lianyu, et al.
Published: (2025)
iLLaVA: An Image is Worth Fewer Than 1/3 Input Tokens in Large Multimodal Models
by: Hu, Lianyu, et al.
Published: (2024)
by: Hu, Lianyu, et al.
Published: (2024)
Dynamic Spatial-Temporal Aggregation for Skeleton-Aware Sign Language Recognition
by: Hu, Lianyu, et al.
Published: (2024)
by: Hu, Lianyu, et al.
Published: (2024)
CorrNet+: Sign Language Recognition and Translation via Spatial-Temporal Correlation
by: Hu, Lianyu, et al.
Published: (2024)
by: Hu, Lianyu, et al.
Published: (2024)
SignAligner: Harmonizing Complementary Pose Modalities for Coherent Sign Language Generation
by: Wang, Xu, et al.
Published: (2025)
by: Wang, Xu, et al.
Published: (2025)
SSL-SSAW: Self-Supervised Learning with Sigmoid Self-Attention Weighting for Question-Based Sign Language Translation
by: Liu, Zekang, et al.
Published: (2025)
by: Liu, Zekang, et al.
Published: (2025)
FlashSign: Pose-Free Guidance for Efficient Sign Language Video Generation
by: Zhang, Liuzhou, et al.
Published: (2026)
by: Zhang, Liuzhou, et al.
Published: (2026)
FashionPose: Text to Pose to Relight Image Generation for Personalized Fashion Visualization
by: Shi, Chuancheng, et al.
Published: (2025)
by: Shi, Chuancheng, et al.
Published: (2025)
HOLO: Homography-Guided Pose Estimator Network for Fine-Grained Visual Localization on SD Maps
by: Zhong, Xuchang, et al.
Published: (2026)
by: Zhong, Xuchang, et al.
Published: (2026)
Beyond Background Shift: Rethinking Instance Replay in Continual Semantic Segmentation
by: Yin, Hongmei, et al.
Published: (2025)
by: Yin, Hongmei, et al.
Published: (2025)
COMMA: Co-Articulated Multi-Modal Learning
by: Hu, Lianyu, et al.
Published: (2023)
by: Hu, Lianyu, et al.
Published: (2023)
CFCML: A Coarse-to-Fine Crossmodal Learning Framework For Disease Diagnosis Using Multimodal Images and Tabular Data
by: Liu, Tianling, et al.
Published: (2026)
by: Liu, Tianling, et al.
Published: (2026)
Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos
by: Ma, Yue, et al.
Published: (2023)
by: Ma, Yue, et al.
Published: (2023)
High-Fidelity 3D Facial Avatar Synthesis with Controllable Fine-Grained Expressions
by: He, Yikang, et al.
Published: (2026)
by: He, Yikang, et al.
Published: (2026)
VistaGEN: Consistent Driving Video Generation with Fine-Grained Control Using Multiview Visual-Language Reasoning
by: Chen, Li-Heng, et al.
Published: (2026)
by: Chen, Li-Heng, et al.
Published: (2026)
SignX: Continuous Sign Recognition in Compact Pose-Rich Latent Space
by: Fang, Sen, et al.
Published: (2025)
by: Fang, Sen, et al.
Published: (2025)
MoBind: Motion Binding for Fine-Grained IMU-Video Pose Alignment
by: Nguyen, Duc Duy, et al.
Published: (2026)
by: Nguyen, Duc Duy, et al.
Published: (2026)
UFVideo: Towards Unified Fine-Grained Video Cooperative Understanding with Large Language Models
by: Pan, Hewen, et al.
Published: (2025)
by: Pan, Hewen, et al.
Published: (2025)
DreamMesh4D: Video-to-4D Generation with Sparse-Controlled Gaussian-Mesh Hybrid Representation
by: Li, Zhiqi, et al.
Published: (2024)
by: Li, Zhiqi, et al.
Published: (2024)
MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation
by: Tong, Haibo, et al.
Published: (2025)
by: Tong, Haibo, et al.
Published: (2025)
Discrete to Continuous: Generating Smooth Transition Poses from Sign Language Observation
by: Tang, Shengeng, et al.
Published: (2024)
by: Tang, Shengeng, et al.
Published: (2024)
Motion is the Choreographer: Learning Latent Pose Dynamics for Seamless Sign Language Generation
by: He, Jiayi, et al.
Published: (2025)
by: He, Jiayi, et al.
Published: (2025)
Joint-Motion Mutual Learning for Pose Estimation in Videos
by: Wu, Sifan, et al.
Published: (2024)
by: Wu, Sifan, et al.
Published: (2024)
VideoPerceiver: Enhancing Fine-Grained Temporal Perception in Video Multimodal Large Language Models
by: Zhao, Fufangchen, et al.
Published: (2025)
by: Zhao, Fufangchen, et al.
Published: (2025)
IncEventGS: Pose-Free Gaussian Splatting from a Single Event Camera
by: Huang, Jian, et al.
Published: (2024)
by: Huang, Jian, et al.
Published: (2024)
Ham2Pose: Animating Sign Language Notation into Pose Sequences
by: Shalev-Arkushin, Rotem, et al.
Published: (2022)
by: Shalev-Arkushin, Rotem, et al.
Published: (2022)
Pose-Based Sign Language Appearance Transfer
by: Moryossef, Amit, et al.
Published: (2024)
by: Moryossef, Amit, et al.
Published: (2024)
PDD: Manifold-Prior Diverse Distillation for Medical Anomaly Detection
by: Lu, Xijun, et al.
Published: (2026)
by: Lu, Xijun, et al.
Published: (2026)
Sign-IDD: Iconicity Disentangled Diffusion for Sign Language Production
by: Tang, Shengeng, et al.
Published: (2024)
by: Tang, Shengeng, et al.
Published: (2024)
DiffSign: AI-Assisted Generation of Customizable Sign Language Videos With Enhanced Realism
by: Krishnamurthy, Sudha, et al.
Published: (2024)
by: Krishnamurthy, Sudha, et al.
Published: (2024)
Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models
by: Hai, Jia-Wei, et al.
Published: (2026)
by: Hai, Jia-Wei, et al.
Published: (2026)
Navigation-Guided Sparse Scene Representation for End-to-End Autonomous Driving
by: Li, Peidong, et al.
Published: (2024)
by: Li, Peidong, et al.
Published: (2024)
NAVERO: Unlocking Fine-Grained Semantics for Video-Language Compositionality
by: Tao, Chaofan, et al.
Published: (2024)
by: Tao, Chaofan, et al.
Published: (2024)
VERIFIED: A Video Corpus Moment Retrieval Benchmark for Fine-Grained Video Understanding
by: Chen, Houlun, et al.
Published: (2024)
by: Chen, Houlun, et al.
Published: (2024)
OmniSparse: Training-Aware Fine-Grained Sparse Attention for Long-Video MLLMs
by: Chen, Feng, et al.
Published: (2025)
by: Chen, Feng, et al.
Published: (2025)
Multi-Grained Feature Pruning for Video-Based Human Pose Estimation
by: Wang, Zhigang, et al.
Published: (2025)
by: Wang, Zhigang, et al.
Published: (2025)
EASL: Multi-Emotion Guided Semantic Disentanglement for Expressive Sign Language Generation
by: Zhao, Yanchao, et al.
Published: (2025)
by: Zhao, Yanchao, et al.
Published: (2025)
Tomato Multi-Angle Multi-Pose Dataset for Fine-Grained Phenotyping
by: Zhang, Yujie, et al.
Published: (2025)
by: Zhang, Yujie, et al.
Published: (2025)
Similar Items
-
Deep Correlated Prompting for Visual Recognition with Missing Modalities
by: Hu, Lianyu, et al.
Published: (2024) -
Improving Continuous Sign Language Recognition with Adapted Image Models
by: Hu, Lianyu, et al.
Published: (2024) -
LightVLM: Acceleraing Large Multimodal Models with Pyramid Token Merging and KV Cache Compression
by: Hu, Lianyu, et al.
Published: (2025) -
iLLaVA: An Image is Worth Fewer Than 1/3 Input Tokens in Large Multimodal Models
by: Hu, Lianyu, et al.
Published: (2024) -
Dynamic Spatial-Temporal Aggregation for Skeleton-Aware Sign Language Recognition
by: Hu, Lianyu, et al.
Published: (2024)