Guardado en:
| Autores principales: | Qi, Zhangyang, Yang, Yunhan, Zhang, Mengchen, Xing, Long, Wu, Xiaoyang, Wu, Tong, Lin, Dahua, Liu, Xihui, Wang, Jiaqi, Zhao, Hengshuang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2407.06191 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GPT4Point: A Unified Framework for Point-Language Understanding and Generation
por: Qi, Zhangyang, et al.
Publicado: (2023)
por: Qi, Zhangyang, et al.
Publicado: (2023)
DreamComposer: Controllable 3D Object Generation via Multi-View Conditions
por: Yang, Yunhan, et al.
Publicado: (2023)
por: Yang, Yunhan, et al.
Publicado: (2023)
DreamComposer++: Empowering Diffusion Models with Multi-View Conditions for 3D Content Generation
por: Yang, Yunhan, et al.
Publicado: (2025)
por: Yang, Yunhan, et al.
Publicado: (2025)
SS4D: Native 4D Generative Model via Structured Spacetime Latents
por: Li, Zhibing, et al.
Publicado: (2025)
por: Li, Zhibing, et al.
Publicado: (2025)
GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models
por: Qi, Zhangyang, et al.
Publicado: (2025)
por: Qi, Zhangyang, et al.
Publicado: (2025)
3DGen-Bench: Comprehensive Benchmark Suite for 3D Generative Models
por: Zhang, Yuhan, et al.
Publicado: (2025)
por: Zhang, Yuhan, et al.
Publicado: (2025)
Omni6D: Large-Vocabulary 3D Object Dataset for Category-Level 6D Object Pose Estimation
por: Zhang, Mengchen, et al.
Publicado: (2024)
por: Zhang, Mengchen, et al.
Publicado: (2024)
LayerPano3D: Layered 3D Panorama for Hyper-Immersive Scene Generation
por: Yang, Shuai, et al.
Publicado: (2024)
por: Yang, Shuai, et al.
Publicado: (2024)
Towards Large-scale 3D Representation Learning with Multi-dataset Point Prompt Training
por: Wu, Xiaoyang, et al.
Publicado: (2023)
por: Wu, Xiaoyang, et al.
Publicado: (2023)
ViSAudio: End-to-End Video-Driven Binaural Spatial Audio Generation
por: Zhang, Mengchen, et al.
Publicado: (2025)
por: Zhang, Mengchen, et al.
Publicado: (2025)
SAMPart3D: Segment Any Part in 3D Objects
por: Yang, Yunhan, et al.
Publicado: (2024)
por: Yang, Yunhan, et al.
Publicado: (2024)
OpenIns3D: Snap and Lookup for 3D Open-vocabulary Instance Segmentation
por: Huang, Zhening, et al.
Publicado: (2023)
por: Huang, Zhening, et al.
Publicado: (2023)
IDArb: Intrinsic Decomposition for Arbitrary Number of Input Views and Illuminations
por: Li, Zhibing, et al.
Publicado: (2024)
por: Li, Zhibing, et al.
Publicado: (2024)
PhysForge: Generating Physics-Grounded 3D Assets for Interactive Virtual World
por: Yang, Yunhan, et al.
Publicado: (2026)
por: Yang, Yunhan, et al.
Publicado: (2026)
LiteReality: Graphics-Ready 3D Scene Reconstruction from RGB-D Scans
por: Huang, Zhening, et al.
Publicado: (2025)
por: Huang, Zhening, et al.
Publicado: (2025)
VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning
por: Qi, Zhangyang, et al.
Publicado: (2025)
por: Qi, Zhangyang, et al.
Publicado: (2025)
Point Transformer V3: Simpler, Faster, Stronger
por: Wu, Xiaoyang, et al.
Publicado: (2023)
por: Wu, Xiaoyang, et al.
Publicado: (2023)
GenDoP: Auto-regressive Camera Trajectory Generation as a Director of Photography
por: Zhang, Mengchen, et al.
Publicado: (2025)
por: Zhang, Mengchen, et al.
Publicado: (2025)
Concerto: Joint 2D-3D Self-Supervised Learning Emerges Spatial Representations
por: Zhang, Yujia, et al.
Publicado: (2025)
por: Zhang, Yujia, et al.
Publicado: (2025)
HY3D-Bench: Generation of 3D Assets
por: Hunyuan3D, Team, et al.
Publicado: (2026)
por: Hunyuan3D, Team, et al.
Publicado: (2026)
3DTopia-XL: Scaling High-quality 3D Asset Generation via Primitive Diffusion
por: Chen, Zhaoxi, et al.
Publicado: (2024)
por: Chen, Zhaoxi, et al.
Publicado: (2024)
Hi3DEval: Advancing 3D Generation Evaluation with Hierarchical Validity
por: Zhang, Yuhan, et al.
Publicado: (2025)
por: Zhang, Yuhan, et al.
Publicado: (2025)
Velocity-Space 3D Asset Editing
por: Liu, Hao, et al.
Publicado: (2026)
por: Liu, Hao, et al.
Publicado: (2026)
FiVA: Fine-grained Visual Attribute Dataset for Text-to-Image Diffusion Models
por: Wu, Tong, et al.
Publicado: (2024)
por: Wu, Tong, et al.
Publicado: (2024)
OA-CNNs: Omni-Adaptive Sparse CNNs for 3D Semantic Segmentation
por: Peng, Bohao, et al.
Publicado: (2024)
por: Peng, Bohao, et al.
Publicado: (2024)
GroupContrast: Semantic-aware Self-supervised Representation Learning for 3D Understanding
por: Wang, Chengyao, et al.
Publicado: (2024)
por: Wang, Chengyao, et al.
Publicado: (2024)
Make-it-Real: Unleashing Large Multimodal Model for Painting 3D Objects with Realistic Materials
por: Fang, Ye, et al.
Publicado: (2024)
por: Fang, Ye, et al.
Publicado: (2024)
Articraft: An Agentic System for Scalable Articulated 3D Asset Generation
por: Zhou, Matt, et al.
Publicado: (2026)
por: Zhou, Matt, et al.
Publicado: (2026)
HumanGaussian: Text-Driven 3D Human Generation with Gaussian Splatting
por: Liu, Xian, et al.
Publicado: (2023)
por: Liu, Xian, et al.
Publicado: (2023)
Bootstrap3D: Improving Multi-view Diffusion Model with Synthetic Data
por: Sun, Zeyi, et al.
Publicado: (2024)
por: Sun, Zeyi, et al.
Publicado: (2024)
SimC3D: A Simple Contrastive 3D Pretraining Framework Using RGB Images
por: Dong, Jiahua, et al.
Publicado: (2024)
por: Dong, Jiahua, et al.
Publicado: (2024)
Kiss3DGen: Repurposing Image Diffusion Models for 3D Asset Generation
por: Lin, Jiantao, et al.
Publicado: (2025)
por: Lin, Jiantao, et al.
Publicado: (2025)
MIDI: Multi-Instance Diffusion for Single Image to 3D Scene Generation
por: Huang, Zehuan, et al.
Publicado: (2024)
por: Huang, Zehuan, et al.
Publicado: (2024)
Generating Human-AI Collaborative Design Sequence for 3D Assets via Differentiable Operation Graph
por: Huang, Xiaoyang, et al.
Publicado: (2025)
por: Huang, Xiaoyang, et al.
Publicado: (2025)
HoloPart: Generative 3D Part Amodal Segmentation
por: Yang, Yunhan, et al.
Publicado: (2025)
por: Yang, Yunhan, et al.
Publicado: (2025)
RefAny3D: 3D Asset-Referenced Diffusion Models for Image Generation
por: Huang, Hanzhuo, et al.
Publicado: (2026)
por: Huang, Hanzhuo, et al.
Publicado: (2026)
PonderV2: Pave the Way for 3D Foundation Model with A Universal Pre-training Paradigm
por: Zhu, Haoyi, et al.
Publicado: (2023)
por: Zhu, Haoyi, et al.
Publicado: (2023)
Pixel-GS: Density Control with Pixel-aware Gradient for 3D Gaussian Splatting
por: Zhang, Zheng, et al.
Publicado: (2024)
por: Zhang, Zheng, et al.
Publicado: (2024)
Utonia: Toward One Encoder for All Point Clouds
por: Zhang, Yujia, et al.
Publicado: (2026)
por: Zhang, Yujia, et al.
Publicado: (2026)
GPT-4V(ision) is a Human-Aligned Evaluator for Text-to-3D Generation
por: Wu, Tong, et al.
Publicado: (2024)
por: Wu, Tong, et al.
Publicado: (2024)
Ejemplares similares
-
GPT4Point: A Unified Framework for Point-Language Understanding and Generation
por: Qi, Zhangyang, et al.
Publicado: (2023) -
DreamComposer: Controllable 3D Object Generation via Multi-View Conditions
por: Yang, Yunhan, et al.
Publicado: (2023) -
DreamComposer++: Empowering Diffusion Models with Multi-View Conditions for 3D Content Generation
por: Yang, Yunhan, et al.
Publicado: (2025) -
SS4D: Native 4D Generative Model via Structured Spacetime Latents
por: Li, Zhibing, et al.
Publicado: (2025) -
GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models
por: Qi, Zhangyang, et al.
Publicado: (2025)