DreamView: Injecting View-specific Text Guidance into Text-to-3D Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yan, Junkai, Gao, Yipeng, Yang, Qize, Wei, Xihan, Xie, Xuansong, Wu, Ancong, Zheng, Wei-Shi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Frozen-DETR: Enhancing DETR with Image Understanding from Frozen Foundation Models
par: Fu, Shenghao, et autres
Publié: (2024)
par: Fu, Shenghao, et autres
Publié: (2024)
A Hierarchical Semantic Distillation Framework for Open-Vocabulary Object Detection
par: Fu, Shenghao, et autres
Publié: (2025)
par: Fu, Shenghao, et autres
Publié: (2025)
Bridge Past and Future: Overcoming Information Asymmetry in Incremental Object Detection
par: Mo, Qijie, et autres
Publié: (2024)
par: Mo, Qijie, et autres
Publié: (2024)
LLMDet: Learning Strong Open-Vocabulary Object Detectors under the Supervision of Large Language Models
par: Fu, Shenghao, et autres
Publié: (2025)
par: Fu, Shenghao, et autres
Publié: (2025)
Progressive Human Motion Generation Based on Text and Few Motion Frames
par: Zeng, Ling-An, et autres
Publié: (2025)
par: Zeng, Ling-An, et autres
Publié: (2025)
DreamPBR: Text-driven Generation of High-resolution SVBRDF with Multi-modal Guidance
par: Xin, Linxuan, et autres
Publié: (2024)
par: Xin, Linxuan, et autres
Publié: (2024)
IRG-MotionLLM: Interleaving Motion Generation, Assessment and Refinement for Text-to-Motion Generation
par: Li, Yuan-Ming, et autres
Publié: (2025)
par: Li, Yuan-Ming, et autres
Publié: (2025)
Structural Energy Guidance for View-Consistent Text-to-3D Generation
par: Zhang, Qing, et autres
Publié: (2026)
par: Zhang, Qing, et autres
Publié: (2026)
CorrespondentDream: Enhancing 3D Fidelity of Text-to-3D using Cross-View Correspondences
par: Kim, Seungwook, et autres
Publié: (2024)
par: Kim, Seungwook, et autres
Publié: (2024)
AnyText: Multilingual Visual Text Generation And Editing
par: Tuo, Yuxiang, et autres
Publié: (2023)
par: Tuo, Yuxiang, et autres
Publié: (2023)
LOVE-R1: Advancing Long Video Understanding with an Adaptive Zoom-in Mechanism via Multi-Step Reasoning
par: Fu, Shenghao, et autres
Publié: (2025)
par: Fu, Shenghao, et autres
Publié: (2025)
DiffusionGAN3D: Boosting Text-guided 3D Generation and Domain Adaptation by Combining 3D GANs and Diffusion Priors
par: Lei, Biwen, et autres
Publié: (2023)
par: Lei, Biwen, et autres
Publié: (2023)
BoostDream: Efficient Refining for High-Quality Text-to-3D Generation from Multi-View Diffusion
par: Yu, Yonghao, et autres
Publié: (2024)
par: Yu, Yonghao, et autres
Publié: (2024)
Pano3DComposer: Feed-Forward Compositional 3D Scene Generation from Single Panoramic Image
par: Qiu, Zidian, et autres
Publié: (2026)
par: Qiu, Zidian, et autres
Publié: (2026)
DreamDrone: Text-to-Image Diffusion Models are Zero-shot Perpetual View Generators
par: Kong, Hanyang, et autres
Publié: (2023)
par: Kong, Hanyang, et autres
Publié: (2023)
DreamJourney: Perpetual View Generation with Video Diffusion Models
par: Pan, Bo, et autres
Publié: (2025)
par: Pan, Bo, et autres
Publié: (2025)
Injecting Image Guidance into Text-Conditioned Diffusion Models at Inference
par: Żywot, Agata, et autres
Publié: (2026)
par: Żywot, Agata, et autres
Publié: (2026)
Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis
par: Yang, Qize, et autres
Publié: (2025)
par: Yang, Qize, et autres
Publié: (2025)
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
par: Zhang, Yabo, et autres
Publié: (2024)
par: Zhang, Yabo, et autres
Publié: (2024)
Plasticine3D: 3D Non-Rigid Editing with Text Guidance by Multi-View Embedding Optimization
par: Chen, Yige, et autres
Publié: (2023)
par: Chen, Yige, et autres
Publié: (2023)
DreamForge: Motion-Aware Autoregressive Video Generation for Multi-View Driving Scenes
par: Mei, Jianbiao, et autres
Publié: (2024)
par: Mei, Jianbiao, et autres
Publié: (2024)
Sculpt3D: Multi-View Consistent Text-to-3D Generation with Sparse 3D Prior
par: Chen, Cheng, et autres
Publié: (2024)
par: Chen, Cheng, et autres
Publié: (2024)
Single-View Scene Point Cloud Human Grasp Generation
par: Wang, Yan-Kang, et autres
Publié: (2024)
par: Wang, Yan-Kang, et autres
Publié: (2024)
MVLight: Relightable Text-to-3D Generation via Light-conditioned Multi-View Diffusion
par: Shim, Dongseok, et autres
Publié: (2024)
par: Shim, Dongseok, et autres
Publié: (2024)
DreamComposer++: Empowering Diffusion Models with Multi-View Conditions for 3D Content Generation
par: Yang, Yunhan, et autres
Publié: (2025)
par: Yang, Yunhan, et autres
Publié: (2025)
DreamComposer: Controllable 3D Object Generation via Multi-View Conditions
par: Yang, Yunhan, et autres
Publié: (2023)
par: Yang, Yunhan, et autres
Publié: (2023)
Sculpting Holistic 3D Representation in Contrastive Language-Image-3D Pre-training
par: Gao, Yipeng, et autres
Publié: (2023)
par: Gao, Yipeng, et autres
Publié: (2023)
ViewDiff: 3D-Consistent Image Generation with Text-to-Image Models
par: Höllein, Lukas, et autres
Publié: (2024)
par: Höllein, Lukas, et autres
Publié: (2024)
DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation
par: Yang, Haibo, et autres
Publié: (2024)
par: Yang, Haibo, et autres
Publié: (2024)
DreamLCM: Towards High-Quality Text-to-3D Generation via Latent Consistency Model
par: Zhong, Yiming, et autres
Publié: (2024)
par: Zhong, Yiming, et autres
Publié: (2024)
Cross-View Meets Diffusion: Aerial Image Synthesis with Geometry and Text Guidance
par: Arrabi, Ahmad, et autres
Publié: (2024)
par: Arrabi, Ahmad, et autres
Publié: (2024)
DreamSat: Towards a General 3D Model for Novel View Synthesis of Space Objects
par: Mathihalli, Nidhi, et autres
Publié: (2024)
par: Mathihalli, Nidhi, et autres
Publié: (2024)
UniDream: Unifying Diffusion Priors for Relightable Text-to-3D Generation
par: Liu, Zexiang, et autres
Publié: (2023)
par: Liu, Zexiang, et autres
Publié: (2023)
DreamDissector: Learning Disentangled Text-to-3D Generation from 2D Diffusion Priors
par: Yan, Zizheng, et autres
Publié: (2024)
par: Yan, Zizheng, et autres
Publié: (2024)
Text2Street: Controllable Text-to-image Generation for Street Views
par: Su, Jinming, et autres
Publié: (2024)
par: Su, Jinming, et autres
Publié: (2024)
CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion
par: Zheng, Wendi, et autres
Publié: (2024)
par: Zheng, Wendi, et autres
Publié: (2024)
DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance
par: Wang, Cong, et autres
Publié: (2023)
par: Wang, Cong, et autres
Publié: (2023)
VAGeo: View-specific Attention for Cross-View Object Geo-Localization
par: Li, Zhongyang, et autres
Publié: (2025)
par: Li, Zhongyang, et autres
Publié: (2025)
DreamScene: 3D Gaussian-based Text-to-3D Scene Generation via Formation Pattern Sampling
par: Li, Haoran, et autres
Publié: (2024)
par: Li, Haoran, et autres
Publié: (2024)
TrAME: Trajectory-Anchored Multi-View Editing for Text-Guided 3D Gaussian Splatting Manipulation
par: Luo, Chaofan, et autres
Publié: (2024)
par: Luo, Chaofan, et autres
Publié: (2024)
Documents similaires
-
Frozen-DETR: Enhancing DETR with Image Understanding from Frozen Foundation Models
par: Fu, Shenghao, et autres
Publié: (2024) -
A Hierarchical Semantic Distillation Framework for Open-Vocabulary Object Detection
par: Fu, Shenghao, et autres
Publié: (2025) -
Bridge Past and Future: Overcoming Information Asymmetry in Incremental Object Detection
par: Mo, Qijie, et autres
Publié: (2024) -
LLMDet: Learning Strong Open-Vocabulary Object Detectors under the Supervision of Large Language Models
par: Fu, Shenghao, et autres
Publié: (2025) -
Progressive Human Motion Generation Based on Text and Few Motion Frames
par: Zeng, Ling-An, et autres
Publié: (2025)