SATO: Stable Text-to-Motion Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Wenshuo, Xiao, Hongru, Zhang, Erhang, Hu, Lijie, Wang, Lei, Liu, Mengyuan, Chen, Chen |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Free-T2M: Robust Text-to-Motion Generation for Humanoid Robots via Frequency-Domain
par: Chen, Wenshuo, et autres
Publié: (2025)
par: Chen, Wenshuo, et autres
Publié: (2025)
ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model
par: Chen, Wenshuo, et autres
Publié: (2025)
par: Chen, Wenshuo, et autres
Publié: (2025)
UniMotion: A Unified Framework for Motion-Text-Vision Understanding and Generation
par: Wang, Ziyi, et autres
Publié: (2026)
par: Wang, Ziyi, et autres
Publié: (2026)
Towards Multi-dimensional Explanation Alignment for Medical Classification
par: Hu, Lijie, et autres
Publié: (2024)
par: Hu, Lijie, et autres
Publié: (2024)
LUMA: Low-Dimension Unified Motion Alignment with Dual-Path Anchoring for Text-to-Motion Diffusion Model
par: Jia, Haozhe, et autres
Publié: (2025)
par: Jia, Haozhe, et autres
Publié: (2025)
T3M: Text Guided 3D Human Motion Synthesis from Speech
par: Peng, Wenshuo, et autres
Publié: (2024)
par: Peng, Wenshuo, et autres
Publié: (2024)
Uni-Hand: Universal Hand Motion Forecasting in Egocentric Views
par: Ma, Junyi, et autres
Publié: (2025)
par: Ma, Junyi, et autres
Publié: (2025)
RadioFlow: Efficient Radio Map Construction Framework with Flow Matching
par: Jia, Haozhe, et autres
Publié: (2025)
par: Jia, Haozhe, et autres
Publié: (2025)
T2M Mamba: Motion Periodicity-Saliency Coupling Approach for Stable Text-Driven Motion Generation
par: Zhan, Xingzu, et autres
Publié: (2026)
par: Zhan, Xingzu, et autres
Publié: (2026)
Eye Motion Matters for 3D Face Reconstruction
par: Wang, Xuan, et autres
Publié: (2024)
par: Wang, Xuan, et autres
Publié: (2024)
MLP: Motion Label Prior for Temporal Sentence Localization in Untrimmed 3D Human Motions
par: Yan, Sheng, et autres
Publié: (2024)
par: Yan, Sheng, et autres
Publié: (2024)
Physics-Informed Representation Alignment for Sparse Radio-Map Reconstruction
par: Jia, Haozhe, et autres
Publié: (2025)
par: Jia, Haozhe, et autres
Publié: (2025)
Cross-Modal Retrieval for Motion and Text via DropTriple Loss
par: Yan, Sheng, et autres
Publié: (2023)
par: Yan, Sheng, et autres
Publié: (2023)
Text-driven Human Motion Generation with Motion Masked Diffusion Model
par: Chen, Xingyu
Publié: (2024)
par: Chen, Xingyu
Publié: (2024)
Multi-Modality Co-Learning for Efficient Skeleton-based Action Recognition
par: Liu, Jinfu, et autres
Publié: (2024)
par: Liu, Jinfu, et autres
Publié: (2024)
ECHO: Edge-Cloud Humanoid Orchestration for Language-to-Motion Control
par: Jia, Haozhe, et autres
Publié: (2026)
par: Jia, Haozhe, et autres
Publié: (2026)
Topology-Agnostic Animal Motion Generation from Text Prompt
par: Chen, Keyi, et autres
Publié: (2025)
par: Chen, Keyi, et autres
Publié: (2025)
Motion2Motion: Cross-topology Motion Transfer with Sparse Correspondence
par: Chen, Ling-Hao, et autres
Publié: (2025)
par: Chen, Ling-Hao, et autres
Publié: (2025)
Think Before You Move: Latent Motion Reasoning for Text-to-Motion Generation
par: Qian, Yijie, et autres
Publié: (2025)
par: Qian, Yijie, et autres
Publié: (2025)
FreeMotion: A Unified Framework for Number-free Text-to-Motion Synthesis
par: Fan, Ke, et autres
Publié: (2024)
par: Fan, Ke, et autres
Publié: (2024)
ClickDiff: Click to Induce Semantic Contact Map for Controllable Grasp Generation with Diffusion Models
par: Li, Peiming, et autres
Publié: (2024)
par: Li, Peiming, et autres
Publié: (2024)
FlashVideo: A Framework for Swift Inference in Text-to-Video Generation
par: Lei, Bin, et autres
Publié: (2023)
par: Lei, Bin, et autres
Publié: (2023)
GPT4Motion: Scripting Physical Motions in Text-to-Video Generation via Blender-Oriented GPT Planning
par: Lv, Jiaxi, et autres
Publié: (2023)
par: Lv, Jiaxi, et autres
Publié: (2023)
DRIVE: Dependable Robust Interpretable Visionary Ensemble Framework in Autonomous Driving
par: Lai, Songning, et autres
Publié: (2024)
par: Lai, Songning, et autres
Publié: (2024)
Expressive Forecasting of 3D Whole-body Human Motions
par: Ding, Pengxiang, et autres
Publié: (2023)
par: Ding, Pengxiang, et autres
Publié: (2023)
MotionBooth: Motion-Aware Customized Text-to-Video Generation
par: Wu, Jianzong, et autres
Publié: (2024)
par: Wu, Jianzong, et autres
Publié: (2024)
TriC-Motion: Tri-Domain Causal Modeling Grounded Text-to-Motion Generation
par: Cao, Yiyang, et autres
Publié: (2026)
par: Cao, Yiyang, et autres
Publié: (2026)
$Z^2$-Sampling: Zero-Cost Zigzag Trajectories for Semantic Alignment in Diffusion Models
par: Li, Haosen, et autres
Publié: (2026)
par: Li, Haosen, et autres
Publié: (2026)
Oracle Noise: Faster Semantic Spherical Alignment for Interpretable Latent Optimization
par: Li, Haosen, et autres
Publié: (2026)
par: Li, Haosen, et autres
Publié: (2026)
Guided Path Sampling: Steering Diffusion Models Back on Track with Principled Path Guidance
par: Li, Haosen, et autres
Publié: (2025)
par: Li, Haosen, et autres
Publié: (2025)
MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation
par: Liu, Yanchen, et autres
Publié: (2025)
par: Liu, Yanchen, et autres
Publié: (2025)
Gaussian Swaying: Surface-Based Framework for Aerodynamic Simulation with 3D Gaussians
par: Yan, Hongru, et autres
Publié: (2025)
par: Yan, Hongru, et autres
Publié: (2025)
CoMo: Compositional Motion Customization for Text-to-Video Generation
par: Xu, Youcan, et autres
Publié: (2025)
par: Xu, Youcan, et autres
Publié: (2025)
ParCo: Part-Coordinating Text-to-Motion Synthesis
par: Zou, Qiran, et autres
Publié: (2024)
par: Zou, Qiran, et autres
Publié: (2024)
Motion Forcing: A Decoupled Framework for Robust Video Generation in Motion Dynamics
par: Xu, Tianshuo, et autres
Publié: (2026)
par: Xu, Tianshuo, et autres
Publié: (2026)
FlowMotion: Training-Free Flow Guidance for Video Motion Transfer
par: Wang, Zhen, et autres
Publié: (2026)
par: Wang, Zhen, et autres
Publié: (2026)
UV-M3TL: A Unified and Versatile Multimodal Multi-Task Learning Framework for Assistive Driving Perception
par: Liu, Wenzhuo, et autres
Publié: (2026)
par: Liu, Wenzhuo, et autres
Publié: (2026)
Language-Guided Transformer Tokenizer for Human Motion Generation
par: Yan, Sheng, et autres
Publié: (2026)
par: Yan, Sheng, et autres
Publié: (2026)
Local Action-Guided Motion Diffusion Model for Text-to-Motion Generation
par: Jin, Peng, et autres
Publié: (2024)
par: Jin, Peng, et autres
Publié: (2024)
EfficientMT: Efficient Temporal Adaptation for Motion Transfer in Text-to-Video Diffusion Models
par: Cai, Yufei, et autres
Publié: (2025)
par: Cai, Yufei, et autres
Publié: (2025)
Documents similaires
-
Free-T2M: Robust Text-to-Motion Generation for Humanoid Robots via Frequency-Domain
par: Chen, Wenshuo, et autres
Publié: (2025) -
ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model
par: Chen, Wenshuo, et autres
Publié: (2025) -
UniMotion: A Unified Framework for Motion-Text-Vision Understanding and Generation
par: Wang, Ziyi, et autres
Publié: (2026) -
Towards Multi-dimensional Explanation Alignment for Medical Classification
par: Hu, Lijie, et autres
Publié: (2024) -
LUMA: Low-Dimension Unified Motion Alignment with Dual-Path Anchoring for Text-to-Motion Diffusion Model
par: Jia, Haozhe, et autres
Publié: (2025)