Make a Cheap Scaling: A Self-Cascade Diffusion Model for Higher-Resolution Adaptation
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Lanqing, He, Yingqing, Chen, Haoxin, Xia, Menghan, Cun, Xiaodong, Wang, Yufei, Huang, Siyu, Zhang, Yong, Wang, Xintao, Chen, Qifeng, Shan, Ying, Wen, Bihan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models
di: Chen, Haoxin, et al.
Pubblicazione: (2024)
di: Chen, Haoxin, et al.
Pubblicazione: (2024)
Noise Calibration: Plug-and-play Content-Preserving Video Enhancement using Pre-trained Video Diffusion Models
di: Yang, Qinyu, et al.
Pubblicazione: (2024)
di: Yang, Qinyu, et al.
Pubblicazione: (2024)
Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos
di: Ma, Yue, et al.
Pubblicazione: (2023)
di: Ma, Yue, et al.
Pubblicazione: (2023)
FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling
di: Qiu, Haonan, et al.
Pubblicazione: (2023)
di: Qiu, Haonan, et al.
Pubblicazione: (2023)
Seeing and Hearing: Open-domain Visual-Audio Generation with Diffusion Latent Aligners
di: Xing, Yazhou, et al.
Pubblicazione: (2024)
di: Xing, Yazhou, et al.
Pubblicazione: (2024)
MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model
di: Niu, Muyao, et al.
Pubblicazione: (2024)
di: Niu, Muyao, et al.
Pubblicazione: (2024)
StyleCrafter: Enhancing Stylized Text-to-Video Generation with Style Adapter
di: Liu, Gongye, et al.
Pubblicazione: (2023)
di: Liu, Gongye, et al.
Pubblicazione: (2023)
ZeroSmooth: Training-free Diffuser Adaptation for High Frame Rate Video Generation
di: Yang, Shaoshu, et al.
Pubblicazione: (2024)
di: Yang, Shaoshu, et al.
Pubblicazione: (2024)
EvalCrafter: Benchmarking and Evaluating Large Video Generation Models
di: Liu, Yaofang, et al.
Pubblicazione: (2023)
di: Liu, Yaofang, et al.
Pubblicazione: (2023)
UniMMVSR: A Unified Multi-Modal Framework for Cascaded Video Super-Resolution
di: Du, Shian, et al.
Pubblicazione: (2025)
di: Du, Shian, et al.
Pubblicazione: (2025)
HiPrompt: Tuning-free Higher-Resolution Generation with Hierarchical MLLM Prompts
di: Liu, Xinyu, et al.
Pubblicazione: (2024)
di: Liu, Xinyu, et al.
Pubblicazione: (2024)
FreeTraj: Tuning-Free Trajectory Control in Video Diffusion Models
di: Qiu, Haonan, et al.
Pubblicazione: (2024)
di: Qiu, Haonan, et al.
Pubblicazione: (2024)
SimpleGVR: A Simple Baseline for Latent-Cascaded Video Super-Resolution
di: Xie, Liangbin, et al.
Pubblicazione: (2025)
di: Xie, Liangbin, et al.
Pubblicazione: (2025)
PatchVSR: Breaking Video Diffusion Resolution Limits with Patch-wise Video Super-Resolution
di: Du, Shian, et al.
Pubblicazione: (2025)
di: Du, Shian, et al.
Pubblicazione: (2025)
SoftShadow: Leveraging Soft Masks for Penumbra-Aware Shadow Removal
di: Wang, Xinrui, et al.
Pubblicazione: (2024)
di: Wang, Xinrui, et al.
Pubblicazione: (2024)
MagicStick: Controllable Video Editing via Control Handle Transformations
di: Ma, Yue, et al.
Pubblicazione: (2023)
di: Ma, Yue, et al.
Pubblicazione: (2023)
MotionCtrl: A Unified and Flexible Motion Controller for Video Generation
di: Wang, Zhouxia, et al.
Pubblicazione: (2023)
di: Wang, Zhouxia, et al.
Pubblicazione: (2023)
DUO-VSR: Dual-Stream Distillation for One-Step Video Super-Resolution
di: Lv, Zhengyao, et al.
Pubblicazione: (2026)
di: Lv, Zhengyao, et al.
Pubblicazione: (2026)
Sketch Video Synthesis
di: Yudian Zheng, et al.
Pubblicazione: (2024)
di: Yudian Zheng, et al.
Pubblicazione: (2024)
ToonCrafter: Generative Cartoon Interpolation
di: Xing, Jinbo, et al.
Pubblicazione: (2024)
di: Xing, Jinbo, et al.
Pubblicazione: (2024)
Fake it till You Make it: Reward Modeling as Discriminative Prediction
di: Liu, Runtao, et al.
Pubblicazione: (2025)
di: Liu, Runtao, et al.
Pubblicazione: (2025)
Progressive Divide-and-Conquer via Subsampling Decomposition for Accelerated MRI
di: Wang, Chong, et al.
Pubblicazione: (2024)
di: Wang, Chong, et al.
Pubblicazione: (2024)
Temporal As a Plugin: Unsupervised Video Denoising with Pre-Trained Image Denoisers
di: Fu, Zixuan, et al.
Pubblicazione: (2024)
di: Fu, Zixuan, et al.
Pubblicazione: (2024)
Scale Where It Matters: Training-Free Localized Scaling for Diffusion Models
di: Ren, Qin, et al.
Pubblicazione: (2025)
di: Ren, Qin, et al.
Pubblicazione: (2025)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
di: Wang, Yufei, et al.
Pubblicazione: (2025)
di: Wang, Yufei, et al.
Pubblicazione: (2025)
ContextGS: Compact 3D Gaussian Splatting with Anchor Level Context Model
di: Wang, Yufei, et al.
Pubblicazione: (2024)
di: Wang, Yufei, et al.
Pubblicazione: (2024)
Benchmarking Adversarial Robustness of Image Shadow Removal with Shadow-adaptive Attacks
di: Wang, Chong, et al.
Pubblicazione: (2024)
di: Wang, Chong, et al.
Pubblicazione: (2024)
High-Resolution Document Shadow Removal via A Large-Scale Real-World Dataset and A Frequency-Aware Shadow Erasing Net
di: Li, Zinuo, et al.
Pubblicazione: (2023)
di: Li, Zinuo, et al.
Pubblicazione: (2023)
Controlling Your Image via Simplified Vector Graphics
di: Guo, Lanqing, et al.
Pubblicazione: (2026)
di: Guo, Lanqing, et al.
Pubblicazione: (2026)
EasyOmnimatte: Taming Pretrained Inpainting Diffusion Models for End-to-End Video Layered Decomposition
di: Hu, Yihan, et al.
Pubblicazione: (2025)
di: Hu, Yihan, et al.
Pubblicazione: (2025)
GenCompositor: Generative Video Compositing with Diffusion Transformer
di: Yang, Shuzhou, et al.
Pubblicazione: (2025)
di: Yang, Shuzhou, et al.
Pubblicazione: (2025)
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)
di: Liu, Runtao, et al.
Pubblicazione: (2024)
Sparc3D: Sparse Representation and Construction for High-Resolution 3D Shapes Modeling
di: Li, Zhihao, et al.
Pubblicazione: (2025)
di: Li, Zhihao, et al.
Pubblicazione: (2025)
SpA2V: Harnessing Spatial Auditory Cues for Audio-driven Spatially-aware Video Generation
di: Pham, Kien T., et al.
Pubblicazione: (2025)
di: Pham, Kien T., et al.
Pubblicazione: (2025)
4DVD: Cascaded Dense-view Video Diffusion Model for High-quality 4D Content Generation
di: Yang, Shuzhou, et al.
Pubblicazione: (2025)
di: Yang, Shuzhou, et al.
Pubblicazione: (2025)
Make-Your-Anchor: A Diffusion-based 2D Avatar Generation Framework
di: Huang, Ziyao, et al.
Pubblicazione: (2024)
di: Huang, Ziyao, et al.
Pubblicazione: (2024)
DiffEditor: Boosting Accuracy and Flexibility on Diffusion-based Image Editing
di: Mou, Chong, et al.
Pubblicazione: (2024)
di: Mou, Chong, et al.
Pubblicazione: (2024)
DiTCtrl: Exploring Attention Control in Multi-Modal Diffusion Transformer for Tuning-Free Multi-Prompt Longer Video Generation
di: Cai, Minghong, et al.
Pubblicazione: (2024)
di: Cai, Minghong, et al.
Pubblicazione: (2024)
EfficientMT: Efficient Temporal Adaptation for Motion Transfer in Text-to-Video Diffusion Models
di: Cai, Yufei, et al.
Pubblicazione: (2025)
di: Cai, Yufei, et al.
Pubblicazione: (2025)
Follow-Your-Canvas: Higher-Resolution Video Outpainting with Extensive Content Generation
di: Chen, Qihua, et al.
Pubblicazione: (2024)
di: Chen, Qihua, et al.
Pubblicazione: (2024)
Documenti analoghi
-
VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models
di: Chen, Haoxin, et al.
Pubblicazione: (2024) -
Noise Calibration: Plug-and-play Content-Preserving Video Enhancement using Pre-trained Video Diffusion Models
di: Yang, Qinyu, et al.
Pubblicazione: (2024) -
Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos
di: Ma, Yue, et al.
Pubblicazione: (2023) -
FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling
di: Qiu, Haonan, et al.
Pubblicazione: (2023) -
Seeing and Hearing: Open-domain Visual-Audio Generation with Diffusion Latent Aligners
di: Xing, Yazhou, et al.
Pubblicazione: (2024)