GPT4Motion: Scripting Physical Motions in Text-to-Video Generation via Blender-Oriented GPT Planning
Fuente:
arXiv
Salvato in:
| Autori principali: | Lv, Jiaxi, Huang, Yi, Yan, Mingfu, Huang, Jiancheng, Liu, Jianzhuang, Liu, Yifan, Wen, Yafei, Chen, Xiaoxin, Chen, Shifeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WaveDM: Wavelet-Based Diffusion Models for Image Restoration
di: Huang, Yi, et al.
Pubblicazione: (2023)
di: Huang, Yi, et al.
Pubblicazione: (2023)
Diffusion Model-Based Image Editing: A Survey
di: Huang, Yi, et al.
Pubblicazione: (2024)
di: Huang, Yi, et al.
Pubblicazione: (2024)
Component Adaptive Clustering for Generalized Category Discovery
di: Yan, Mingfu, et al.
Pubblicazione: (2025)
di: Yan, Mingfu, et al.
Pubblicazione: (2025)
MagicFight: Personalized Martial Arts Combat Video Generation
di: Huang, Jiancheng, et al.
Pubblicazione: (2026)
di: Huang, Jiancheng, et al.
Pubblicazione: (2026)
Seal2Real: Prompt Prior Learning on Diffusion Model for Unsupervised Document Seal Data Generation and Realisation
di: Yan, Mingfu, et al.
Pubblicazione: (2023)
di: Yan, Mingfu, et al.
Pubblicazione: (2023)
Leveraging Contrast Information for Efficient Document Shadow Removal
di: Liu, Yifan, et al.
Pubblicazione: (2025)
di: Liu, Yifan, et al.
Pubblicazione: (2025)
Contrast-Prior Enhanced Duality for Mask-Free Shadow Removal
di: Wu, Jiyu, et al.
Pubblicazione: (2025)
di: Wu, Jiyu, et al.
Pubblicazione: (2025)
DIVE: Taming DINO for Subject-Driven Video Editing
di: Huang, Yi, et al.
Pubblicazione: (2024)
di: Huang, Yi, et al.
Pubblicazione: (2024)
Dual-Schedule Inversion: Training- and Tuning-Free Inversion for Real Image Editing
di: Huang, Jiancheng, et al.
Pubblicazione: (2024)
di: Huang, Jiancheng, et al.
Pubblicazione: (2024)
TARA: Token-Aware LoRA for Composable Personalization in Diffusion Models
di: Peng, Yuqi, et al.
Pubblicazione: (2025)
di: Peng, Yuqi, et al.
Pubblicazione: (2025)
PlanMoGPT: Flow-Enhanced Progressive Planning for Text to Motion Synthesis
di: Jin, Chuhao, et al.
Pubblicazione: (2025)
di: Jin, Chuhao, et al.
Pubblicazione: (2025)
MotionGPT: Finetuned LLMs Are General-Purpose Motion Generators
di: Zhang, Yaqi, et al.
Pubblicazione: (2023)
di: Zhang, Yaqi, et al.
Pubblicazione: (2023)
MotionGPT3: Human Motion as a Second Modality
di: Zhu, Bingfan, et al.
Pubblicazione: (2025)
di: Zhu, Bingfan, et al.
Pubblicazione: (2025)
MotionGPT-2: A General-Purpose Motion-Language Model for Motion Generation and Understanding
di: Wang, Yuan, et al.
Pubblicazione: (2024)
di: Wang, Yuan, et al.
Pubblicazione: (2024)
Motion Blender Gaussian Splatting for Dynamic Scene Reconstruction
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
ControlLight: Towards Controllable, Consistent, and Generalizable Low-Light Enhancement
di: Yang, Yufeng, et al.
Pubblicazione: (2026)
di: Yang, Yufeng, et al.
Pubblicazione: (2026)
VideoChat-M1: Collaborative Policy Planning for Video Understanding via Multi-Agent Reinforcement Learning
di: Chen, Boyu, et al.
Pubblicazione: (2025)
di: Chen, Boyu, et al.
Pubblicazione: (2025)
GeoMotionGPT: Geometry-Aligned Motion Understanding with Large Language Models
di: Ye, Zhankai, et al.
Pubblicazione: (2026)
di: Ye, Zhankai, et al.
Pubblicazione: (2026)
GPT-NAS: Evolutionary Neural Architecture Search with the Generative Pre-Trained Model
di: Yu, Caiyang, et al.
Pubblicazione: (2023)
di: Yu, Caiyang, et al.
Pubblicazione: (2023)
Hierarchical Search-Based Cooperative Motion Planning
di: Wu, Yuchen, et al.
Pubblicazione: (2024)
di: Wu, Yuchen, et al.
Pubblicazione: (2024)
GLAD: Generalizable Tuning for Vision-Language Models
di: Peng, Yuqi, et al.
Pubblicazione: (2025)
di: Peng, Yuqi, et al.
Pubblicazione: (2025)
AToM: Aligning Text-to-Motion Model at Event-Level with GPT-4Vision Reward
di: Han, Haonan, et al.
Pubblicazione: (2024)
di: Han, Haonan, et al.
Pubblicazione: (2024)
DeID-GPT: Zero-shot Medical Text De-Identification by GPT-4
di: Liu, Zhengliang, et al.
Pubblicazione: (2023)
di: Liu, Zhengliang, et al.
Pubblicazione: (2023)
From Diffusion to Flow: Efficient Motion Generation in MotionGPT3
di: Ban, Jaymin, et al.
Pubblicazione: (2026)
di: Ban, Jaymin, et al.
Pubblicazione: (2026)
Video Motion Graphs
di: Liu, Haiyang, et al.
Pubblicazione: (2025)
di: Liu, Haiyang, et al.
Pubblicazione: (2025)
ChartBlender: An Interactive System for Authoring and Synchronizing Visualization Charts in Video
di: He, Yi, et al.
Pubblicazione: (2025)
di: He, Yi, et al.
Pubblicazione: (2025)
SMooGPT: Stylized Motion Generation using Large Language Models
di: Zhong, Lei, et al.
Pubblicazione: (2025)
di: Zhong, Lei, et al.
Pubblicazione: (2025)
Motion Dreamer: Boundary Conditional Motion Reasoning for Physically Coherent Video Generation
di: Xu, Tianshuo, et al.
Pubblicazione: (2024)
di: Xu, Tianshuo, et al.
Pubblicazione: (2024)
MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation
di: Liu, Yanchen, et al.
Pubblicazione: (2025)
di: Liu, Yanchen, et al.
Pubblicazione: (2025)
Topology-Agnostic Animal Motion Generation from Text Prompt
di: Chen, Keyi, et al.
Pubblicazione: (2025)
di: Chen, Keyi, et al.
Pubblicazione: (2025)
MotionMatcher: Motion Customization of Text-to-Video Diffusion Models via Motion Feature Matching
di: Wu, Yen-Siang, et al.
Pubblicazione: (2025)
di: Wu, Yen-Siang, et al.
Pubblicazione: (2025)
MotionBooth: Motion-Aware Customized Text-to-Video Generation
di: Wu, Jianzong, et al.
Pubblicazione: (2024)
di: Wu, Jianzong, et al.
Pubblicazione: (2024)
MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance
di: Zhang, Yuang, et al.
Pubblicazione: (2024)
di: Zhang, Yuang, et al.
Pubblicazione: (2024)
MotionScript: Natural Language Descriptions for Expressive 3D Human Motions
di: Yazdian, Payam Jome, et al.
Pubblicazione: (2023)
di: Yazdian, Payam Jome, et al.
Pubblicazione: (2023)
GPT-Connect: Interaction between Text-Driven Human Motion Generator and 3D Scenes in a Training-free Manner
di: Qu, Haoxuan, et al.
Pubblicazione: (2024)
di: Qu, Haoxuan, et al.
Pubblicazione: (2024)
SwarmGPT: Combining Large Language Models with Safe Motion Planning for Drone Swarm Choreography
di: Schuck, Martin, et al.
Pubblicazione: (2024)
di: Schuck, Martin, et al.
Pubblicazione: (2024)
M$^3$GPT: An Advanced Multimodal, Multitask Framework for Motion Comprehension and Generation
di: Luo, Mingshuang, et al.
Pubblicazione: (2024)
di: Luo, Mingshuang, et al.
Pubblicazione: (2024)
Off-the-shelf ChatGPT is a Good Few-shot Human Motion Predictor
di: Qu, Haoxuan, et al.
Pubblicazione: (2024)
di: Qu, Haoxuan, et al.
Pubblicazione: (2024)
SATO: Stable Text-to-Motion Framework
di: Chen, Wenshuo, et al.
Pubblicazione: (2024)
di: Chen, Wenshuo, et al.
Pubblicazione: (2024)
ElicitationGPT: Text Elicitation Mechanisms via Language Models
di: Wu, Yifan, et al.
Pubblicazione: (2024)
di: Wu, Yifan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
WaveDM: Wavelet-Based Diffusion Models for Image Restoration
di: Huang, Yi, et al.
Pubblicazione: (2023) -
Diffusion Model-Based Image Editing: A Survey
di: Huang, Yi, et al.
Pubblicazione: (2024) -
Component Adaptive Clustering for Generalized Category Discovery
di: Yan, Mingfu, et al.
Pubblicazione: (2025) -
MagicFight: Personalized Martial Arts Combat Video Generation
di: Huang, Jiancheng, et al.
Pubblicazione: (2026) -
Seal2Real: Prompt Prior Learning on Diffusion Model for Unsupervised Document Seal Data Generation and Realisation
di: Yan, Mingfu, et al.
Pubblicazione: (2023)