DreamJourney: Perpetual View Generation with Video Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Bo, Chen, Yang, Pan, Yingwei, Yao, Ting, Chen, Wei, Mei, Tao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models
par: Yang, Haibo, et autres
Publié: (2024)
par: Yang, Haibo, et autres
Publié: (2024)
DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation
par: Jiang, Xin, et autres
Publié: (2026)
par: Jiang, Xin, et autres
Publié: (2026)
Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On
par: Wan, Siqi, et autres
Publié: (2025)
par: Wan, Siqi, et autres
Publié: (2025)
DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation
par: Yang, Haibo, et autres
Publié: (2024)
par: Yang, Haibo, et autres
Publié: (2024)
VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation
par: Chen, Yang, et autres
Publié: (2024)
par: Chen, Yang, et autres
Publié: (2024)
DreamDrone: Text-to-Image Diffusion Models are Zero-shot Perpetual View Generators
par: Kong, Hanyang, et autres
Publié: (2023)
par: Kong, Hanyang, et autres
Publié: (2023)
TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models
par: Zhang, Zhongwei, et autres
Publié: (2024)
par: Zhang, Zhongwei, et autres
Publié: (2024)
Improving Virtual Try-On with Garment-focused Diffusion Models
par: Wan, Siqi, et autres
Publié: (2024)
par: Wan, Siqi, et autres
Publié: (2024)
HIRI-ViT: Scaling Vision Transformer with High Resolution Inputs
par: Yao, Ting, et autres
Publié: (2024)
par: Yao, Ting, et autres
Publié: (2024)
HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer
par: Cai, Qi, et autres
Publié: (2025)
par: Cai, Qi, et autres
Publié: (2025)
MotionPro: A Precise Motion Controller for Image-to-Video Generation
par: Zhang, Zhongwei, et autres
Publié: (2025)
par: Zhang, Zhongwei, et autres
Publié: (2025)
Boosting Diffusion Models with Moving Average Sampling in Frequency Domain
par: Qian, Yurui, et autres
Publié: (2024)
par: Qian, Yurui, et autres
Publié: (2024)
FreeInpaint: Tuning-free Prompt Alignment and Visual Rationality Enhancement in Image Inpainting
par: Gong, Chao, et autres
Publié: (2025)
par: Gong, Chao, et autres
Publié: (2025)
SD-DiT: Unleashing the Power of Self-supervised Discrimination in Diffusion Transformer
par: Zhu, Rui, et autres
Publié: (2024)
par: Zhu, Rui, et autres
Publié: (2024)
Creatively Upscaling Images with Global-Regional Priors
par: Qian, Yurui, et autres
Publié: (2025)
par: Qian, Yurui, et autres
Publié: (2025)
DreamForge: Motion-Aware Autoregressive Video Generation for Multi-View Driving Scenes
par: Mei, Jianbiao, et autres
Publié: (2024)
par: Mei, Jianbiao, et autres
Publié: (2024)
Improving Text-guided Object Inpainting with Semantic Pre-inpainting
par: Chen, Yifu, et autres
Publié: (2024)
par: Chen, Yifu, et autres
Publié: (2024)
Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction
par: Li, Dong, et autres
Publié: (2025)
par: Li, Dong, et autres
Publié: (2025)
Ouroboros-Diffusion: Exploring Consistent Content Generation in Tuning-free Long Video Diffusion
par: Chen, Jingyuan, et autres
Publié: (2025)
par: Chen, Jingyuan, et autres
Publié: (2025)
Prompt Refinement with Image Pivot for Text-to-Image Generation
par: Zhan, Jingtao, et autres
Publié: (2024)
par: Zhan, Jingtao, et autres
Publié: (2024)
DreamLite: A Lightweight On-Device Unified Model for Image Generation and Editing
par: Feng, Kailai, et autres
Publié: (2026)
par: Feng, Kailai, et autres
Publié: (2026)
Hierarchical Masked Autoregressive Models with Low-Resolution Token Pivots
par: Zheng, Guangting, et autres
Publié: (2025)
par: Zheng, Guangting, et autres
Publié: (2025)
DreamComposer++: Empowering Diffusion Models with Multi-View Conditions for 3D Content Generation
par: Yang, Yunhan, et autres
Publié: (2025)
par: Yang, Yunhan, et autres
Publié: (2025)
Visual Autoregressive Modeling for Instruction-Guided Image Editing
par: Mao, Qingyang, et autres
Publié: (2025)
par: Mao, Qingyang, et autres
Publié: (2025)
VideoStudio: Generating Consistent-Content and Multi-Scene Videos
par: Long, Fuchen, et autres
Publié: (2024)
par: Long, Fuchen, et autres
Publié: (2024)
HiDream-O1-Image: A Natively Unified Image Generative Foundation Model with Pixel-level Unified Transformer
par: Cai, Qi, et autres
Publié: (2026)
par: Cai, Qi, et autres
Publié: (2026)
DreamDA: Generative Data Augmentation with Diffusion Models
par: Fu, Yunxiang, et autres
Publié: (2024)
par: Fu, Yunxiang, et autres
Publié: (2024)
Learning Spatial Adaptation and Temporal Coherence in Diffusion Models for Video Super-Resolution
par: Chen, Zhikai, et autres
Publié: (2024)
par: Chen, Zhikai, et autres
Publié: (2024)
DreamView: Injecting View-specific Text Guidance into Text-to-3D Generation
par: Yan, Junkai, et autres
Publié: (2024)
par: Yan, Junkai, et autres
Publié: (2024)
Landscape-Awareness for Geometric View Diffusion Model
par: Chen, Yan-Ting, et autres
Publié: (2026)
par: Chen, Yan-Ting, et autres
Publié: (2026)
ViewPoint: Panoramic Video Generation with Pretrained Diffusion Models
par: Fang, Zixun, et autres
Publié: (2025)
par: Fang, Zixun, et autres
Publié: (2025)
EgoTwin: Dreaming Body and View in First Person
par: Xiu, Jingqiao, et autres
Publié: (2025)
par: Xiu, Jingqiao, et autres
Publié: (2025)
Unleashing Text-to-Image Diffusion Prior for Zero-Shot Image Captioning
par: Luo, Jianjie, et autres
Publié: (2024)
par: Luo, Jianjie, et autres
Publié: (2024)
DreamWorld: Unified World Modeling in Video Generation
par: Tan, Boming, et autres
Publié: (2026)
par: Tan, Boming, et autres
Publié: (2026)
Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models
par: Yang, Zeyu, et autres
Publié: (2024)
par: Yang, Zeyu, et autres
Publié: (2024)
DreamingComics: A Story Visualization Pipeline via Subject and Layout Customized Generation using Video Models
par: Kwon, Patrick, et autres
Publié: (2025)
par: Kwon, Patrick, et autres
Publié: (2025)
Voyaging into Perpetual Dynamic Scenes from a Single View
par: Tian, Fengrui, et autres
Publié: (2025)
par: Tian, Fengrui, et autres
Publié: (2025)
DreamInsert: Zero-Shot Image-to-Video Object Insertion from A Single Image
par: Zhao, Qi, et autres
Publié: (2025)
par: Zhao, Qi, et autres
Publié: (2025)
VividDream: Generating 3D Scene with Ambient Dynamics
par: Lee, Yao-Chih, et autres
Publié: (2024)
par: Lee, Yao-Chih, et autres
Publié: (2024)
DreamShot: Personalized Storyboard Synthesis with Video Diffusion Prior
par: Huang, Junjia, et autres
Publié: (2026)
par: Huang, Junjia, et autres
Publié: (2026)
Documents similaires
-
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models
par: Yang, Haibo, et autres
Publié: (2024) -
DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation
par: Jiang, Xin, et autres
Publié: (2026) -
Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On
par: Wan, Siqi, et autres
Publié: (2025) -
DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation
par: Yang, Haibo, et autres
Publié: (2024) -
VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation
par: Chen, Yang, et autres
Publié: (2024)