TV-3DG: Mastering Text-to-3D Customized Generation with Visual Prompt
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Jiahui, Di, Donglin, Ma, Baorui, Yang, Xun, Ma, Yongjia, Sun, Wenzhang, Chen, Wei, Cui, Jianxun, Xue, Zhou, Wang, Meng, Liu, Yebin |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
UniCP: A Unified Caching and Pruning Framework for Efficient Video Generation
by: Sun, Wenzhang, et al.
Published: (2025)
by: Sun, Wenzhang, et al.
Published: (2025)
TrAME: Trajectory-Anchored Multi-View Editing for Text-Guided 3D Gaussian Splatting Manipulation
by: Luo, Chaofan, et al.
Published: (2024)
by: Luo, Chaofan, et al.
Published: (2024)
Hyper-3DG: Text-to-3D Gaussian Generation via Hypergraph
by: Di, Donglin, et al.
Published: (2024)
by: Di, Donglin, et al.
Published: (2024)
QR-LoRA: Efficient and Disentangled Fine-tuning via QR Decomposition for Customized Generation
by: Yang, Jiahui, et al.
Published: (2025)
by: Yang, Jiahui, et al.
Published: (2025)
MoCA: Identity-Preserving Text-to-Video Generation via Mixture of Cross Attention
by: Xie, Qi, et al.
Published: (2025)
by: Xie, Qi, et al.
Published: (2025)
MetricAnything: Scaling Metric Depth Pretraining with Noisy Heterogeneous Sources
by: Ma, Baorui, et al.
Published: (2026)
by: Ma, Baorui, et al.
Published: (2026)
DH-FaceVid-1K: A Large-Scale High-Quality Dataset for Face Video Generation
by: Di, Donglin, et al.
Published: (2024)
by: Di, Donglin, et al.
Published: (2024)
MoEE: Mixture of Emotion Experts for Audio-Driven Portrait Animation
by: Liu, Huaize, et al.
Published: (2025)
by: Liu, Huaize, et al.
Published: (2025)
UniAvatar: Taming Lifelike Audio-Driven Talking Head Generation with Comprehensive Motion and Lighting Control
by: Sun, Wenzhang, et al.
Published: (2024)
by: Sun, Wenzhang, et al.
Published: (2024)
DrivingScene: A Multi-Task Online Feed-Forward 3D Gaussian Splatting Method for Dynamic Driving Scenes
by: Hou, Qirui, et al.
Published: (2025)
by: Hou, Qirui, et al.
Published: (2025)
TIGaussian: Disentangle Gaussians for Spatial-Awared Text-Image-3D Alignment
by: Liu, Jiarun, et al.
Published: (2026)
by: Liu, Jiarun, et al.
Published: (2026)
3D Printing of Customized Carbon Microneedle Arrays
by: Ya Ren, et al.
Published: (2025)
by: Ya Ren, et al.
Published: (2025)
One-Shot Pose-Driving Face Animation Platform
by: Feng, He, et al.
Published: (2024)
by: Feng, He, et al.
Published: (2024)
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
by: Feng, He, et al.
Published: (2026)
by: Feng, He, et al.
Published: (2026)
VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation
by: Chen, Yang, et al.
Published: (2024)
by: Chen, Yang, et al.
Published: (2024)
EverybodyDance: Bipartite Graph-Based Identity Correspondence for Multi-Character Animation
by: Ling, Haotian, et al.
Published: (2025)
by: Ling, Haotian, et al.
Published: (2025)
Tuning-Free Long Video Generation via Global-Local Collaborative Diffusion
by: Ma, Yongjia, et al.
Published: (2025)
by: Ma, Yongjia, et al.
Published: (2025)
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
by: Feng, He, et al.
Published: (2025)
by: Feng, He, et al.
Published: (2025)
Real Face Video Animation Platform
by: Chen, Xiaokai, et al.
Published: (2024)
by: Chen, Xiaokai, et al.
Published: (2024)
SpaceDG: Benchmarking Spatial Intelligence under Visual Degradation
by: Zhou, Xiaolong, et al.
Published: (2026)
by: Zhou, Xiaolong, et al.
Published: (2026)
PAGS: Priority-Adaptive Gaussian Splatting for Dynamic Driving Scenes
by: A, Ying, et al.
Published: (2025)
by: A, Ying, et al.
Published: (2025)
GeoDiff4D: Geometry-Aware Diffusion for 4D Head Avatar Reconstruction
by: Xu, Chao, et al.
Published: (2026)
by: Xu, Chao, et al.
Published: (2026)
Visual Prompt-Agnostic Evolution
by: Wang, Junze, et al.
Published: (2026)
by: Wang, Junze, et al.
Published: (2026)
MPE-TTS: Customized Emotion Zero-Shot Text-To-Speech Using Multi-Modal Prompt
by: Wu, Zhichao, et al.
Published: (2025)
by: Wu, Zhichao, et al.
Published: (2025)
Adams Bashforth Moulton Solver for Inversion and Editing in Rectified Flow
by: Ma, Yongjia, et al.
Published: (2025)
by: Ma, Yongjia, et al.
Published: (2025)
Chain of World: World Model Thinking in Latent Motion
by: Yang, Fuxiang, et al.
Published: (2026)
by: Yang, Fuxiang, et al.
Published: (2026)
Chat-Edit-3D: Interactive 3D Scene Editing via Text Prompts
by: Fang, Shuangkang, et al.
Published: (2024)
by: Fang, Shuangkang, et al.
Published: (2024)
HeadStudio: Text to Animatable Head Avatars with 3D Gaussian Splatting
by: Zhou, Zhenglin, et al.
Published: (2024)
by: Zhou, Zhenglin, et al.
Published: (2024)
Mix3R: Mixing Feed-forward Reconstruction and Generative 3D Priors for Joint Multi-view Aligned 3D Reconstruction and Pose Estimation
by: Lin, Siyou, et al.
Published: (2026)
by: Lin, Siyou, et al.
Published: (2026)
Learning Segmented 3D Gaussians via Efficient Feature Unprojection for Zero-shot Neural Scene Segmentation
by: Dou, Bin, et al.
Published: (2024)
by: Dou, Bin, et al.
Published: (2024)
Customizing Visual Emotion Evaluation for MLLMs: An Open-vocabulary, Multifaceted, and Scalable Approach
by: Wu, Daiqing, et al.
Published: (2025)
by: Wu, Daiqing, et al.
Published: (2025)
ITS3D: Inference-Time Scaling for Text-Guided 3D Diffusion Models
by: Zhou, Zhenglin, et al.
Published: (2025)
by: Zhou, Zhenglin, et al.
Published: (2025)
A Self-supervised Motion Representation for Portrait Video Generation
by: Zhang, Qiyuan, et al.
Published: (2025)
by: Zhang, Qiyuan, et al.
Published: (2025)
Coin3D: Controllable and Interactive 3D Assets Generation with Proxy-Guided Conditioning
by: Dong, Wenqi, et al.
Published: (2024)
by: Dong, Wenqi, et al.
Published: (2024)
IPDN: Image-enhanced Prompt Decoding Network for 3D Referring Expression Segmentation
by: Chen, Qi, et al.
Published: (2025)
by: Chen, Qi, et al.
Published: (2025)
Prompt Customization for Continual Learning
by: Dai, Yong, et al.
Published: (2024)
by: Dai, Yong, et al.
Published: (2024)
InterEdit: Navigating Text-Guided Multi-Human 3D Motion Editing
by: Yang, Yebin, et al.
Published: (2026)
by: Yang, Yebin, et al.
Published: (2026)
CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation
by: Wang, Qinghe, et al.
Published: (2025)
by: Wang, Qinghe, et al.
Published: (2025)
L3DG: Latent 3D Gaussian Diffusion
by: Roessle, Barbara, et al.
Published: (2024)
by: Roessle, Barbara, et al.
Published: (2024)
DG-MVP: 3D Domain Generalization via Multiple Views of Point Clouds for Classification
by: Ren, Huantao, et al.
Published: (2025)
by: Ren, Huantao, et al.
Published: (2025)
Similar Items
-
UniCP: A Unified Caching and Pruning Framework for Efficient Video Generation
by: Sun, Wenzhang, et al.
Published: (2025) -
TrAME: Trajectory-Anchored Multi-View Editing for Text-Guided 3D Gaussian Splatting Manipulation
by: Luo, Chaofan, et al.
Published: (2024) -
Hyper-3DG: Text-to-3D Gaussian Generation via Hypergraph
by: Di, Donglin, et al.
Published: (2024) -
QR-LoRA: Efficient and Disentangled Fine-tuning via QR Decomposition for Customized Generation
by: Yang, Jiahui, et al.
Published: (2025) -
MoCA: Identity-Preserving Text-to-Video Generation via Mixture of Cross Attention
by: Xie, Qi, et al.
Published: (2025)