Hierarchical Masked 3D Diffusion Model for Video Outpainting
Fuente:
arXiv
Saved in:
| Main Authors: | Fan, Fanda, Guo, Chaoxu, Gong, Litong, Wang, Biao, Ge, Tiezheng, Jiang, Yuning, Luo, Chunjie, Zhan, Jianfeng |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Tuning-Free Noise Rectification for High Fidelity Image-to-Video Generation
by: Li, Weijie, et al.
Published: (2024)
by: Li, Weijie, et al.
Published: (2024)
AIGCBench: Comprehensive Evaluation of Image-to-Video Content Generated by AI
by: Fan, Fanda, et al.
Published: (2024)
by: Fan, Fanda, et al.
Published: (2024)
AtomoVideo: High Fidelity Image-to-Video Generation
by: Gong, Litong, et al.
Published: (2024)
by: Gong, Litong, et al.
Published: (2024)
RISE-T2V: Rephrasing and Injecting Semantics with LLM for Expansive Text-to-Video Generation
by: Zhang, Xiangjun, et al.
Published: (2025)
by: Zhang, Xiangjun, et al.
Published: (2025)
OutDreamer: Video Outpainting with a Diffusion Transformer
by: Zhong, Linhao, et al.
Published: (2025)
by: Zhong, Linhao, et al.
Published: (2025)
Beyond Point-Wise Matching: Structural Representation Alignment for Accelerating Diffusion Transformers
by: Xu, Shaodong, et al.
Published: (2026)
by: Xu, Shaodong, et al.
Published: (2026)
AdvDMD: Adversarial Reward Meets DMD For High-Quality Few-Step Generation
by: Wang, Xu, et al.
Published: (2026)
by: Wang, Xu, et al.
Published: (2026)
Be-Your-Outpainter: Mastering Video Outpainting through Input-Specific Adaptation
by: Wang, Fu-Yun, et al.
Published: (2024)
by: Wang, Fu-Yun, et al.
Published: (2024)
IN2OUT: Fine-Tuning Video Inpainting Model for Video Outpainting Using Hierarchical Discriminator
by: Youn, Sangwoo, et al.
Published: (2025)
by: Youn, Sangwoo, et al.
Published: (2025)
GlobalPaint: Spatiotemporal Coherent Video Outpainting with Global Feature Guidance
by: Pan, Yueming, et al.
Published: (2026)
by: Pan, Yueming, et al.
Published: (2026)
POWDR: Pathology-preserving Outpainting with Wavelet Diffusion for 3D MRI
by: Tan, Fei, et al.
Published: (2026)
by: Tan, Fei, et al.
Published: (2026)
Edit-GRPO: A Locality-Preserving Policy Optimization Framework for Image Editing
by: Xu, Shaodong, et al.
Published: (2026)
by: Xu, Shaodong, et al.
Published: (2026)
CF-Font: Content Fusion for Few-shot Font Generation
by: Wang, Chi, et al.
Published: (2023)
by: Wang, Chi, et al.
Published: (2023)
PanoDiffusion: 360-degree Panorama Outpainting via Diffusion
by: Wu, Tianhao, et al.
Published: (2023)
by: Wu, Tianhao, et al.
Published: (2023)
Edit As You Wish: Video Caption Editing with Multi-grained User Control
by: Yao, Linli, et al.
Published: (2023)
by: Yao, Linli, et al.
Published: (2023)
Generative Outpainting To Enhance the Memorability of Short-Form Videos
by: Byju, Alan, et al.
Published: (2024)
by: Byju, Alan, et al.
Published: (2024)
Continuous-Multiple Image Outpainting in One-Step via Positional Query and A Diffusion-based Approach
by: Zhang, Shaofeng, et al.
Published: (2024)
by: Zhang, Shaofeng, et al.
Published: (2024)
Enhancing Prompt Following with Visual Control Through Training-Free Mask-Guided Diffusion
by: Chen, Hongyu, et al.
Published: (2024)
by: Chen, Hongyu, et al.
Published: (2024)
GaMO: Geometry-aware Multi-view Diffusion Outpainting for Sparse-View 3D Reconstruction
by: Huang, Yi-Chuan, et al.
Published: (2025)
by: Huang, Yi-Chuan, et al.
Published: (2025)
LightsOut: Diffusion-based Outpainting for Enhanced Lens Flare Removal
by: Tsai, Shr-Ruei, et al.
Published: (2025)
by: Tsai, Shr-Ruei, et al.
Published: (2025)
Follow-Your-Canvas: Higher-Resolution Video Outpainting with Extensive Content Generation
by: Chen, Qihua, et al.
Published: (2024)
by: Chen, Qihua, et al.
Published: (2024)
Animate3D: Animating Any 3D Model with Multi-view Video Diffusion
by: Jiang, Yanqin, et al.
Published: (2024)
by: Jiang, Yanqin, et al.
Published: (2024)
Unified Long Video Inpainting and Outpainting via Overlapping High-Order Co-Denoising
by: Lyu, Shuangquan, et al.
Published: (2025)
by: Lyu, Shuangquan, et al.
Published: (2025)
Seen-to-Scene: Keep the Seen, Generate the Unseen for Video Outpainting
by: Jeon, Inseok, et al.
Published: (2026)
by: Jeon, Inseok, et al.
Published: (2026)
VC4VG: Optimizing Video Captions for Text-to-Video Generation
by: Du, Yang, et al.
Published: (2025)
by: Du, Yang, et al.
Published: (2025)
Fine-Grained Controllable Apparel Showcase Image Generation via Garment-Centric Outpainting
by: Zhang, Rong, et al.
Published: (2025)
by: Zhang, Rong, et al.
Published: (2025)
Identity-Preserving Image-to-Video Generation via Reward-Guided Optimization
by: Shen, Liao, et al.
Published: (2025)
by: Shen, Liao, et al.
Published: (2025)
VIP: Versatile Image Outpainting Empowered by Multimodal Large Language Model
by: Yang, Jinze, et al.
Published: (2024)
by: Yang, Jinze, et al.
Published: (2024)
MaskGaussian: Adaptive 3D Gaussian Representation from Probabilistic Masks
by: Liu, Yifei, et al.
Published: (2024)
by: Liu, Yifei, et al.
Published: (2024)
AnyRecon: Arbitrary-View 3D Reconstruction with Video Diffusion Model
by: Chen, Yutian, et al.
Published: (2026)
by: Chen, Yutian, et al.
Published: (2026)
TBStar-Edit: From Image Editing Pattern Shifting to Consistency Enhancement
by: Fang, Hao, et al.
Published: (2025)
by: Fang, Hao, et al.
Published: (2025)
Mimir: Improving Video Diffusion Models for Precise Text Understanding
by: Tan, Shuai, et al.
Published: (2024)
by: Tan, Shuai, et al.
Published: (2024)
Physics-Aligned Spectral Mamba: Decoupling Semantics and Dynamics for Few-Shot Hyperspectral Target Detection
by: Gong, Luqi, et al.
Published: (2026)
by: Gong, Luqi, et al.
Published: (2026)
Learning Subject-Aware Cropping by Outpainting Professional Photos
by: Hong, James, et al.
Published: (2023)
by: Hong, James, et al.
Published: (2023)
DiCoDe: Diffusion-Compressed Deep Tokens for Autoregressive Video Generation with Language Models
by: Li, Yizhuo, et al.
Published: (2024)
by: Li, Yizhuo, et al.
Published: (2024)
LaGeM: A Large Geometry Model for 3D Representation Learning and Diffusion
by: Zhang, Biao, et al.
Published: (2024)
by: Zhang, Biao, et al.
Published: (2024)
MDiff4STR: Mask Diffusion Model for Scene Text Recognition
by: Du, Yongkun, et al.
Published: (2025)
by: Du, Yongkun, et al.
Published: (2025)
InterMask: 3D Human Interaction Generation via Collaborative Masked Modeling
by: Javed, Muhammad Gohar, et al.
Published: (2024)
by: Javed, Muhammad Gohar, et al.
Published: (2024)
VideoLifter: Lifting Videos to 3D with Fast Hierarchical Stereo Alignment
by: Cong, Wenyan, et al.
Published: (2025)
by: Cong, Wenyan, et al.
Published: (2025)
Diffusion Models are Geometry Critics: Single Image 3D Editing Using Pre-Trained Diffusion Priors
by: Wang, Ruicheng, et al.
Published: (2024)
by: Wang, Ruicheng, et al.
Published: (2024)
Similar Items
-
Tuning-Free Noise Rectification for High Fidelity Image-to-Video Generation
by: Li, Weijie, et al.
Published: (2024) -
AIGCBench: Comprehensive Evaluation of Image-to-Video Content Generated by AI
by: Fan, Fanda, et al.
Published: (2024) -
AtomoVideo: High Fidelity Image-to-Video Generation
by: Gong, Litong, et al.
Published: (2024) -
RISE-T2V: Rephrasing and Injecting Semantics with LLM for Expansive Text-to-Video Generation
by: Zhang, Xiangjun, et al.
Published: (2025) -
OutDreamer: Video Outpainting with a Diffusion Transformer
by: Zhong, Linhao, et al.
Published: (2025)