Bootstrap3D: Improving Multi-view Diffusion Model with Synthetic Data
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Zeyi, Wu, Tong, Zhang, Pan, Zang, Yuhang, Dong, Xiaoyi, Xiong, Yuanjun, Lin, Dahua, Wang, Jiaqi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
X-Prompt: Towards Universal In-Context Image Generation in Auto-Regressive Vision Language Foundation Models
par: Sun, Zeyi, et autres
Publié: (2024)
par: Sun, Zeyi, et autres
Publié: (2024)
SemanticGarment: Semantic-Controlled Generation and Editing of 3D Gaussian Garments
par: Wang, Ruiyan, et autres
Publié: (2025)
par: Wang, Ruiyan, et autres
Publié: (2025)
Generating Digital Models Using Text-to-3D and Image-to-3D Prompts: Critical Case Study
par: Ziatdinov, Rushan, et autres
Publié: (2025)
par: Ziatdinov, Rushan, et autres
Publié: (2025)
SEAgent: Self-Evolving Computer Use Agent with Autonomous Learning from Experience
par: Sun, Zeyi, et autres
Publié: (2025)
par: Sun, Zeyi, et autres
Publié: (2025)
DASC: Depth-of-Field Aware Scene Complexity Metric for 3D Visualization on Light Field Display
par: Akbar, Kamran, et autres
Publié: (2025)
par: Akbar, Kamran, et autres
Publié: (2025)
GTLR-GS: Geometry-Texture Aware LiDAR-Regularized 3D Gaussian Splatting for Realistic Scene Reconstruction
par: Fang, Yan, et autres
Publié: (2026)
par: Fang, Yan, et autres
Publié: (2026)
Kiss3DGen: Repurposing Image Diffusion Models for 3D Asset Generation
par: Lin, Jiantao, et autres
Publié: (2025)
par: Lin, Jiantao, et autres
Publié: (2025)
Coordinated 2D-3D Visualization of Volumetric Medical Data in XR with Multimodal Interactions
par: Liu, Qixuan, et autres
Publié: (2025)
par: Liu, Qixuan, et autres
Publié: (2025)
altiro3D: Scene representation from single image and novel view synthesis
par: Canessa, E., et autres
Publié: (2023)
par: Canessa, E., et autres
Publié: (2023)
L3GS: Layered 3D Gaussian Splats for Efficient 3D Scene Delivery
par: Tsai, Yi-Zhen, et autres
Publié: (2025)
par: Tsai, Yi-Zhen, et autres
Publié: (2025)
A Collaborative Extended Reality Prototype for 3D Surgical Planning and Visualization
par: Qiu, Shi, et autres
Publié: (2026)
par: Qiu, Shi, et autres
Publié: (2026)
DreamCinema: Cinematic Transfer with Free Camera and 3D Character
par: Chen, Weiliang, et autres
Publié: (2024)
par: Chen, Weiliang, et autres
Publié: (2024)
On Copyright Risks of Text-to-Image Diffusion Models
par: Zhang, Yang, et autres
Publié: (2023)
par: Zhang, Yang, et autres
Publié: (2023)
MesonGS++: Post-training Compression of 3D Gaussian Splatting with Hyperparameter Searching
par: Xie, Shuzhao, et autres
Publié: (2026)
par: Xie, Shuzhao, et autres
Publié: (2026)
Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation
par: Huang, Zikai, et autres
Publié: (2025)
par: Huang, Zikai, et autres
Publié: (2025)
SIG-Chat: Spatial Intent-Guided Conversational Gesture Generation Involving How, When and Where
par: Huang, Yiheng, et autres
Publié: (2025)
par: Huang, Yiheng, et autres
Publié: (2025)
CvhSlicer 2.0: Immersive and Interactive Visualization of Chinese Visible Human Data in XR Environments
par: Qiu, Yue, et autres
Publié: (2025)
par: Qiu, Yue, et autres
Publié: (2025)
Splatography: Sparse multi-view dynamic Gaussian Splatting for filmmaking challenges
par: Azzarelli, Adrian, et autres
Publié: (2025)
par: Azzarelli, Adrian, et autres
Publié: (2025)
Streaming Real-Time Rendered Scenes as 3D Gaussians
par: Siekkinen, Matti, et autres
Publié: (2026)
par: Siekkinen, Matti, et autres
Publié: (2026)
HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation
par: Dong, Wenqi, et autres
Publié: (2025)
par: Dong, Wenqi, et autres
Publié: (2025)
Kubrick: Multimodal Agent Collaborations for Synthetic Video Generation
par: He, Liu, et autres
Publié: (2024)
par: He, Liu, et autres
Publié: (2024)
Real-Time Interactive Hybrid Ocean: Spectrum-Consistent Wave Particle-FFT Coupling
par: Xue, Shengze, et autres
Publié: (2025)
par: Xue, Shengze, et autres
Publié: (2025)
VerbDiff: Text-Only Diffusion Models with Enhanced Interaction Awareness
par: Cha, SeungJu, et autres
Publié: (2025)
par: Cha, SeungJu, et autres
Publié: (2025)
Real-time 3D Light-field Viewing with Eye-tracking on Conventional Displays
par: Pham, Trung Hieu, et autres
Publié: (2025)
par: Pham, Trung Hieu, et autres
Publié: (2025)
Automatic Camera Trajectory Control with Enhanced Immersion for Virtual Cinematography
par: Wu, Xinyi, et autres
Publié: (2023)
par: Wu, Xinyi, et autres
Publié: (2023)
InteractDiffusion: Interaction Control in Text-to-Image Diffusion Models
par: Hoe, Jiun Tian, et autres
Publié: (2023)
par: Hoe, Jiun Tian, et autres
Publié: (2023)
Rip Current Detection in Nearshore Areas through UAV Video Analysis with Almost Local-Isometric Embedding Techniques on Sphere
par: Sun, Anchen, et autres
Publié: (2023)
par: Sun, Anchen, et autres
Publié: (2023)
AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
par: Guan, Jiazhi, et autres
Publié: (2025)
par: Guan, Jiazhi, et autres
Publié: (2025)
Break-for-Make: Modular Low-Rank Adaptations for Composable Content-Style Customization
par: Xu, Yu, et autres
Publié: (2024)
par: Xu, Yu, et autres
Publié: (2024)
Laplacian Analysis Meets Dynamics Modelling: Gaussian Splatting for 4D Reconstruction
par: Zhou, Yifan, et autres
Publié: (2025)
par: Zhou, Yifan, et autres
Publié: (2025)
Neural Network-Based Tracking and 3D Reconstruction of Baseball Pitch Trajectories from Single-View 2D Video
par: Hsieh, Jhen
Publié: (2024)
par: Hsieh, Jhen
Publié: (2024)
Contrastive Multi-Modal Hypergraph Reasoning for 3D Crowd Mesh Recovery
par: Sun, Minghao, et autres
Publié: (2026)
par: Sun, Minghao, et autres
Publié: (2026)
Perceive-Sample-Compress: Towards Real-Time 3D Gaussian Splatting
par: Wang, Zijian, et autres
Publié: (2025)
par: Wang, Zijian, et autres
Publié: (2025)
Casual3DHDR: Deblurring High Dynamic Range 3D Gaussian Splatting from Casually Captured Videos
par: Gong, Shucheng, et autres
Publié: (2025)
par: Gong, Shucheng, et autres
Publié: (2025)
Instant3D: Instant Text-to-3D Generation
par: Li, Ming, et autres
Publié: (2023)
par: Li, Ming, et autres
Publié: (2023)
Exploring Palette based Color Guidance in Diffusion Models
par: Qiu, Qianru, et autres
Publié: (2025)
par: Qiu, Qianru, et autres
Publié: (2025)
MATHDance: Mamba-Transformer Architecture with Uniform Tokenization for High-Quality 3D Dance Generation
par: Yang, Kaixing, et autres
Publié: (2025)
par: Yang, Kaixing, et autres
Publié: (2025)
DanceAnyWay: Synthesizing Beat-Guided 3D Dances with Randomized Temporal Contrastive Learning
par: Bhattacharya, Aneesh, et autres
Publié: (2023)
par: Bhattacharya, Aneesh, et autres
Publié: (2023)
From Code to Canvas
par: Werner, Bernhard O.
Publié: (2025)
par: Werner, Bernhard O.
Publié: (2025)
"You'll Be Alice Adventuring in Wonderland!" Processes, Challenges, and Opportunities of Creating Animated Virtual Reality Stories
par: Yuan, Lin-Ping, et autres
Publié: (2025)
par: Yuan, Lin-Ping, et autres
Publié: (2025)
Documents similaires
-
X-Prompt: Towards Universal In-Context Image Generation in Auto-Regressive Vision Language Foundation Models
par: Sun, Zeyi, et autres
Publié: (2024) -
SemanticGarment: Semantic-Controlled Generation and Editing of 3D Gaussian Garments
par: Wang, Ruiyan, et autres
Publié: (2025) -
Generating Digital Models Using Text-to-3D and Image-to-3D Prompts: Critical Case Study
par: Ziatdinov, Rushan, et autres
Publié: (2025) -
SEAgent: Self-Evolving Computer Use Agent with Autonomous Learning from Experience
par: Sun, Zeyi, et autres
Publié: (2025) -
DASC: Depth-of-Field Aware Scene Complexity Metric for 3D Visualization on Light Field Display
par: Akbar, Kamran, et autres
Publié: (2025)