Flash Sculptor: Modular 3D Worlds from Objects
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Yujia, Liu, Songhua, Yang, Xingyi, Wang, Xinchao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Image Editing As Programs with Diffusion Models
par: Hu, Yujia, et autres
Publié: (2025)
par: Hu, Yujia, et autres
Publié: (2025)
FlashSplat: 2D to 3D Gaussian Splatting Segmentation Solved Optimally
par: Shen, Qiuhong, et autres
Publié: (2024)
par: Shen, Qiuhong, et autres
Publié: (2024)
Hash3D: Training-free Acceleration for 3D Generation
par: Yang, Xingyi, et autres
Publié: (2024)
par: Yang, Xingyi, et autres
Publié: (2024)
Video-Infinity: Distributed Long Video Generation
par: Tan, Zhenxiong, et autres
Publié: (2024)
par: Tan, Zhenxiong, et autres
Publié: (2024)
Gated Condition Injection without Multimodal Attention: Towards Controllable Linear-Attention Transformers
par: Liu, Yuhe, et autres
Publié: (2026)
par: Liu, Yuhe, et autres
Publié: (2026)
Control and Realism: Best of Both Worlds in Layout-to-Image without Training
par: Li, Bonan, et autres
Publié: (2025)
par: Li, Bonan, et autres
Publié: (2025)
Vision Bridge Transformer at Scale
par: Tan, Zhenxiong, et autres
Publié: (2025)
par: Tan, Zhenxiong, et autres
Publié: (2025)
OminiControl2: Efficient Conditioning for Diffusion Transformers
par: Tan, Zhenxiong, et autres
Publié: (2025)
par: Tan, Zhenxiong, et autres
Publié: (2025)
StyDeSty: Min-Max Stylization and Destylization for Single Domain Generalization
par: Liu, Songhua, et autres
Publié: (2024)
par: Liu, Songhua, et autres
Publié: (2024)
WorldWarp: Propagating 3D Geometry with Asynchronous Video Diffusion
par: Kong, Hanyang, et autres
Publié: (2025)
par: Kong, Hanyang, et autres
Publié: (2025)
Language Model as Visual Explainer
par: Yang, Xingyi, et autres
Publié: (2024)
par: Yang, Xingyi, et autres
Publié: (2024)
Compositional Video Generation as Flow Equalization
par: Yang, Xingyi, et autres
Publié: (2024)
par: Yang, Xingyi, et autres
Publié: (2024)
OminiControl: Minimal and Universal Control for Diffusion Transformer
par: Tan, Zhenxiong, et autres
Publié: (2024)
par: Tan, Zhenxiong, et autres
Publié: (2024)
CoDA: From Text-to-Image Diffusion Models to Training-Free Dataset Distillation
par: Zhou, Letian, et autres
Publié: (2025)
par: Zhou, Letian, et autres
Publié: (2025)
CLEAR: Conv-Like Linearization Revs Pre-Trained Diffusion Transformers Up
par: Liu, Songhua, et autres
Publié: (2024)
par: Liu, Songhua, et autres
Publié: (2024)
C4D: 4D Made from 3D through Dual Correspondences
par: Wang, Shizun, et autres
Publié: (2025)
par: Wang, Shizun, et autres
Publié: (2025)
GFlow: Recovering 4D World from Monocular Video
par: Wang, Shizun, et autres
Publié: (2024)
par: Wang, Shizun, et autres
Publié: (2024)
Focus on Neighbors and Know the Whole: Towards Consistent Dense Multiview Text-to-Image Generator for 3D Creation
par: Li, Bonan, et autres
Publié: (2024)
par: Li, Bonan, et autres
Publié: (2024)
Test3R: Learning to Reconstruct 3D at Test Time
par: Yuan, Yuheng, et autres
Publié: (2025)
par: Yuan, Yuheng, et autres
Publié: (2025)
Efficient Gaussian Splatting for Monocular Dynamic Scene Rendering via Sparse Time-Variant Attribute Modeling
par: Kong, Hanyang, et autres
Publié: (2025)
par: Kong, Hanyang, et autres
Publié: (2025)
Unsegment Anything by Simulating Deformation
par: Lu, Jiahao, et autres
Publié: (2024)
par: Lu, Jiahao, et autres
Publié: (2024)
Relation Rectification in Diffusion Model
par: Wu, Yinwei, et autres
Publié: (2024)
par: Wu, Yinwei, et autres
Publié: (2024)
1000+ FPS 4D Gaussian Splatting for Dynamic Scene Rendering
par: Yuan, Yuheng, et autres
Publié: (2025)
par: Yuan, Yuheng, et autres
Publié: (2025)
Understanding Dataset Distillation via Spectral Filtering
par: Bo, Deyu, et autres
Publié: (2025)
par: Bo, Deyu, et autres
Publié: (2025)
One-shot Federated Learning via Synthetic Distiller-Distillate Communication
par: Zhang, Junyuan, et autres
Publié: (2024)
par: Zhang, Junyuan, et autres
Publié: (2024)
Ultra-Resolution Adaptation with Ease
par: Yu, Ruonan, et autres
Publié: (2025)
par: Yu, Ruonan, et autres
Publié: (2025)
Teddy: Efficient Large-Scale Dataset Distillation via Taylor-Approximated Matching
par: Yu, Ruonan, et autres
Publié: (2024)
par: Yu, Ruonan, et autres
Publié: (2024)
Neural Metamorphosis
par: Yang, Xingyi, et autres
Publié: (2024)
par: Yang, Xingyi, et autres
Publié: (2024)
Rethinking Large-scale Dataset Compression: Shifting Focus From Labels to Images
par: Xiao, Lingao, et autres
Publié: (2025)
par: Xiao, Lingao, et autres
Publié: (2025)
Kolmogorov-Arnold Transformer
par: Yang, Xingyi, et autres
Publié: (2024)
par: Yang, Xingyi, et autres
Publié: (2024)
MindBridge: A Cross-Subject Brain Decoding Framework
par: Wang, Shizun, et autres
Publié: (2024)
par: Wang, Shizun, et autres
Publié: (2024)
Distilled Datamodel with Reverse Gradient Matching
par: Ye, Jingwen, et autres
Publié: (2024)
par: Ye, Jingwen, et autres
Publié: (2024)
LinFusion: 1 GPU, 1 Minute, 16K Image
par: Liu, Songhua, et autres
Publié: (2024)
par: Liu, Songhua, et autres
Publié: (2024)
Top-Down Compression: Revisit Efficient Vision Token Projection for Visual Instruction Tuning
par: li, Bonan, et autres
Publié: (2025)
par: li, Bonan, et autres
Publié: (2025)
Heavy Labels Out! Dataset Distillation with Label Space Lightening
par: Yu, Ruonan, et autres
Publié: (2024)
par: Yu, Ruonan, et autres
Publié: (2024)
ViFeEdit: A Video-Free Tuner of Your Video Diffusion Transformer
par: Yu, Ruonan, et autres
Publié: (2026)
par: Yu, Ruonan, et autres
Publié: (2026)
Vista3D: Unravel the 3D Darkside of a Single Image
par: Shen, Qiuhong, et autres
Publié: (2024)
par: Shen, Qiuhong, et autres
Publié: (2024)
DragGaussian: Enabling Drag-style Manipulation on 3D Gaussian Representation
par: Shen, Sitian, et autres
Publié: (2024)
par: Shen, Sitian, et autres
Publié: (2024)
PE3R: Perception-Efficient 3D Reconstruction
par: Hu, Jie, et autres
Publié: (2025)
par: Hu, Jie, et autres
Publié: (2025)
Q-ARVD: Quantizing Autoregressive Video Diffusion Models
par: Tang, Siao, et autres
Publié: (2026)
par: Tang, Siao, et autres
Publié: (2026)
Documents similaires
-
Image Editing As Programs with Diffusion Models
par: Hu, Yujia, et autres
Publié: (2025) -
FlashSplat: 2D to 3D Gaussian Splatting Segmentation Solved Optimally
par: Shen, Qiuhong, et autres
Publié: (2024) -
Hash3D: Training-free Acceleration for 3D Generation
par: Yang, Xingyi, et autres
Publié: (2024) -
Video-Infinity: Distributed Long Video Generation
par: Tan, Zhenxiong, et autres
Publié: (2024) -
Gated Condition Injection without Multimodal Attention: Towards Controllable Linear-Attention Transformers
par: Liu, Yuhe, et autres
Publié: (2026)