Taming Stable Diffusion for Text to 360° Panorama Image Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Cheng, Wu, Qianyi, Gambardella, Camilo Cruz, Huang, Xiaoshui, Phung, Dinh, Ouyang, Wanli, Cai, Jianfei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PanSplat: 4K Panorama Synthesis with Feed-Forward Gaussian Splatting
par: Zhang, Cheng, et autres
Publié: (2024)
par: Zhang, Cheng, et autres
Publié: (2024)
PaRa: Personalizing Text-to-Image Diffusion via Parameter Rank Reduction
par: Chen, Shangyu, et autres
Publié: (2024)
par: Chen, Shangyu, et autres
Publié: (2024)
Unified Camera Positional Encoding for Controlled Video Generation
par: Zhang, Cheng, et autres
Publié: (2025)
par: Zhang, Cheng, et autres
Publié: (2025)
PanFlow: Decoupled Motion Control for Panoramic Video Generation
par: Zhang, Cheng, et autres
Publié: (2025)
par: Zhang, Cheng, et autres
Publié: (2025)
What Makes for Text to 360-degree Panorama Generation with Stable Diffusion?
par: Ni, Jinhong, et autres
Publié: (2025)
par: Ni, Jinhong, et autres
Publié: (2025)
DiffPano: Scalable and Consistent Text to Panorama Generation with Spherical Epipolar-Aware Diffusion
par: Ye, Weicai, et autres
Publié: (2024)
par: Ye, Weicai, et autres
Publié: (2024)
360DVD: Controllable Panorama Video Generation with 360-Degree Video Diffusion Model
par: Wang, Qian, et autres
Publié: (2024)
par: Wang, Qian, et autres
Publié: (2024)
UniDream: Unifying Diffusion Priors for Relightable Text-to-3D Generation
par: Liu, Zexiang, et autres
Publié: (2023)
par: Liu, Zexiang, et autres
Publié: (2023)
GVGEN: Text-to-3D Generation with Volumetric Representation
par: He, Xianglong, et autres
Publié: (2024)
par: He, Xianglong, et autres
Publié: (2024)
Pantheon360: Taming Digital Twin Generation via 3D-Aware 360° Video Diffusion
par: Chen, Ting-Hsuan, et autres
Publié: (2026)
par: Chen, Ting-Hsuan, et autres
Publié: (2026)
Large-Scale Data-Free Knowledge Distillation for ImageNet via Multi-Resolution Data Generation
par: Tran, Minh-Tuan, et autres
Publié: (2024)
par: Tran, Minh-Tuan, et autres
Publié: (2024)
PanoDiffusion: 360-degree Panorama Outpainting via Diffusion
par: Wu, Tianhao, et autres
Publié: (2023)
par: Wu, Tianhao, et autres
Publié: (2023)
360PanT: Training-Free Text-Driven 360-Degree Panorama-to-Panorama Translation
par: Wang, Hai, et autres
Publié: (2024)
par: Wang, Hai, et autres
Publié: (2024)
NeRF-Det++: Incorporating Semantic Cues and Perspective-aware Depth Supervision for Indoor Multi-View 3D Detection
par: Huang, Chenxi, et autres
Publié: (2024)
par: Huang, Chenxi, et autres
Publié: (2024)
A Self-Conditioned Representation Guided Diffusion Model for Realistic Text-to-LiDAR Scene Generation
par: Qu, Wentao, et autres
Publié: (2025)
par: Qu, Wentao, et autres
Publié: (2025)
A Survey on Text-Driven 360-Degree Panorama Generation
par: Wang, Hai, et autres
Publié: (2025)
par: Wang, Hai, et autres
Publié: (2025)
How Far Can We Compress Instant-NGP-Based NeRF?
par: Chen, Yihang, et autres
Publié: (2024)
par: Chen, Yihang, et autres
Publié: (2024)
MeshCraft: Exploring Efficient and Controllable Mesh Generation with Flow-based DiTs
par: He, Xianglong, et autres
Publié: (2025)
par: He, Xianglong, et autres
Publié: (2025)
StableDub: Taming Diffusion Prior for Generalized and Efficient Visual Dubbing
par: Chen, Liyang, et autres
Publié: (2025)
par: Chen, Liyang, et autres
Publié: (2025)
THOR: Text to Human-Object Interaction Diffusion via Relation Intervention
par: Wu, Qianyang, et autres
Publié: (2024)
par: Wu, Qianyang, et autres
Publié: (2024)
Semi-supervised 3D Object Detection with PatchTeacher and PillarMix
par: Wu, Xiaopei, et autres
Publié: (2024)
par: Wu, Xiaopei, et autres
Publié: (2024)
Hiding and Recovering Knowledge in Text-to-Image Diffusion Models via Learnable Prompts
par: Bui, Anh, et autres
Publié: (2024)
par: Bui, Anh, et autres
Publié: (2024)
COMOGen: A Controllable Text-to-3D Multi-object Generation Framework
par: Sun, Shaorong, et autres
Publié: (2024)
par: Sun, Shaorong, et autres
Publié: (2024)
Ranni: Taming Text-to-Image Diffusion for Accurate Instruction Following
par: Feng, Yutong, et autres
Publié: (2023)
par: Feng, Yutong, et autres
Publié: (2023)
Causal-Adapter: Taming Text-to-Image Diffusion for Faithful Counterfactual Generation
par: Tong, Lei, et autres
Publié: (2025)
par: Tong, Lei, et autres
Publié: (2025)
HAC++: Towards 100X Compression of 3D Gaussian Splatting
par: Chen, Yihang, et autres
Publié: (2025)
par: Chen, Yihang, et autres
Publié: (2025)
HAC: Hash-grid Assisted Context for 3D Gaussian Splatting Compression
par: Chen, Yihang, et autres
Publié: (2024)
par: Chen, Yihang, et autres
Publié: (2024)
Normal-GS: 3D Gaussian Splatting with Normal-Involved Rendering
par: Wei, Meng, et autres
Publié: (2024)
par: Wei, Meng, et autres
Publié: (2024)
MVSplat360: Feed-Forward 360 Scene Synthesis from Sparse Views
par: Chen, Yuedong, et autres
Publié: (2024)
par: Chen, Yuedong, et autres
Publié: (2024)
TASeg: Temporal Aggregation Network for LiDAR Semantic Segmentation
par: Wu, Xiaopei, et autres
Publié: (2024)
par: Wu, Xiaopei, et autres
Publié: (2024)
TanDiT: Tangent-Plane Diffusion Transformer for High-Quality 360° Panorama Generation
par: Çapuk, Hakan, et autres
Publié: (2025)
par: Çapuk, Hakan, et autres
Publié: (2025)
Diffusion Models Need Visual Priors for Image Generation
par: Yue, Xiaoyu, et autres
Publié: (2024)
par: Yue, Xiaoyu, et autres
Publié: (2024)
Delta-SVD: Efficient Compression for Personalized Text-to-Image Models
par: Zhang, Tangyuan, et autres
Publié: (2025)
par: Zhang, Tangyuan, et autres
Publié: (2025)
SE360: Semantic Edit in 360$^\circ$ Panoramas via Hierarchical Data Construction
par: Zhong, Haoyi, et autres
Publié: (2025)
par: Zhong, Haoyi, et autres
Publié: (2025)
Fast Feedforward 3D Gaussian Splatting Compression
par: Chen, Yihang, et autres
Publié: (2024)
par: Chen, Yihang, et autres
Publié: (2024)
PCGS: Progressive Compression of 3D Gaussian Splatting
par: Chen, Yihang, et autres
Publié: (2025)
par: Chen, Yihang, et autres
Publié: (2025)
Dense360: Dense Understanding from Omnidirectional Panoramas
par: Zhou, Yikang, et autres
Publié: (2025)
par: Zhou, Yikang, et autres
Publié: (2025)
Dual-Projection Fusion for Accurate Upright Panorama Generation in Robotic Vision
par: Shan, Yuhao, et autres
Publié: (2025)
par: Shan, Yuhao, et autres
Publié: (2025)
MasterWeaver: Taming Editability and Face Identity for Personalized Text-to-Image Generation
par: Wei, Yuxiang, et autres
Publié: (2024)
par: Wei, Yuxiang, et autres
Publié: (2024)
Uni3D-LLM: Unifying Point Cloud Perception, Generation and Editing with Large Language Models
par: Liu, Dingning, et autres
Publié: (2024)
par: Liu, Dingning, et autres
Publié: (2024)
Documents similaires
-
PanSplat: 4K Panorama Synthesis with Feed-Forward Gaussian Splatting
par: Zhang, Cheng, et autres
Publié: (2024) -
PaRa: Personalizing Text-to-Image Diffusion via Parameter Rank Reduction
par: Chen, Shangyu, et autres
Publié: (2024) -
Unified Camera Positional Encoding for Controlled Video Generation
par: Zhang, Cheng, et autres
Publié: (2025) -
PanFlow: Decoupled Motion Control for Panoramic Video Generation
par: Zhang, Cheng, et autres
Publié: (2025) -
What Makes for Text to 360-degree Panorama Generation with Stable Diffusion?
par: Ni, Jinhong, et autres
Publié: (2025)