AtomoVideo: High Fidelity Image-to-Video Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gong, Litong, Zhu, Yiran, Li, Weijie, Kang, Xiaoyang, Wang, Biao, Ge, Tiezheng, Zheng, Bo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Tuning-Free Noise Rectification for High Fidelity Image-to-Video Generation
par: Li, Weijie, et autres
Publié: (2024)
par: Li, Weijie, et autres
Publié: (2024)
Identity-Preserving Image-to-Video Generation via Reward-Guided Optimization
par: Shen, Liao, et autres
Publié: (2025)
par: Shen, Liao, et autres
Publié: (2025)
RISE-T2V: Rephrasing and Injecting Semantics with LLM for Expansive Text-to-Video Generation
par: Zhang, Xiangjun, et autres
Publié: (2025)
par: Zhang, Xiangjun, et autres
Publié: (2025)
Hierarchical Masked 3D Diffusion Model for Video Outpainting
par: Fan, Fanda, et autres
Publié: (2023)
par: Fan, Fanda, et autres
Publié: (2023)
AdvDMD: Adversarial Reward Meets DMD For High-Quality Few-Step Generation
par: Wang, Xu, et autres
Publié: (2026)
par: Wang, Xu, et autres
Publié: (2026)
Edit-GRPO: A Locality-Preserving Policy Optimization Framework for Image Editing
par: Xu, Shaodong, et autres
Publié: (2026)
par: Xu, Shaodong, et autres
Publié: (2026)
VC4VG: Optimizing Video Captions for Text-to-Video Generation
par: Du, Yang, et autres
Publié: (2025)
par: Du, Yang, et autres
Publié: (2025)
Beyond Point-Wise Matching: Structural Representation Alignment for Accelerating Diffusion Transformers
par: Xu, Shaodong, et autres
Publié: (2026)
par: Xu, Shaodong, et autres
Publié: (2026)
DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance
par: Wang, Cong, et autres
Publié: (2023)
par: Wang, Cong, et autres
Publié: (2023)
HiFiVFS: High Fidelity Video Face Swapping
par: Chen, Xu, et autres
Publié: (2024)
par: Chen, Xu, et autres
Publié: (2024)
FlowDCN: Exploring DCN-like Architectures for Fast Image Generation with Arbitrary Resolution
par: Wang, Shuai, et autres
Publié: (2024)
par: Wang, Shuai, et autres
Publié: (2024)
Accelerating Image Generation with Sub-path Linear Approximation Model
par: Xu, Chen, et autres
Publié: (2024)
par: Xu, Chen, et autres
Publié: (2024)
DMM: Building a Versatile Image Generation Model via Distillation-Based Model Merging
par: Song, Tianhui, et autres
Publié: (2025)
par: Song, Tianhui, et autres
Publié: (2025)
FlashVideo: Flowing Fidelity to Detail for Efficient High-Resolution Video Generation
par: Zhang, Shilong, et autres
Publié: (2025)
par: Zhang, Shilong, et autres
Publié: (2025)
RepNet-VSR: Reparameterizable Architecture for High-Fidelity Video Super-Resolution
par: Wu, Biao, et autres
Publié: (2025)
par: Wu, Biao, et autres
Publié: (2025)
Lynx: Towards High-Fidelity Personalized Video Generation
par: Sang, Shen, et autres
Publié: (2025)
par: Sang, Shen, et autres
Publié: (2025)
Dimension-Reduction Attack! Video Generative Models are Experts on Controllable Image Synthesis
par: Cao, Hengyuan, et autres
Publié: (2025)
par: Cao, Hengyuan, et autres
Publié: (2025)
MotionStone: Decoupled Motion Intensity Modulation with Diffusion Transformer for Image-to-Video Generation
par: Shi, Shuwei, et autres
Publié: (2024)
par: Shi, Shuwei, et autres
Publié: (2024)
AlignVid: Training-Free Attention Scaling for Semantic Fidelity in Text-Guided Image-to-Video Generation
par: Liu, Yexin, et autres
Publié: (2025)
par: Liu, Yexin, et autres
Publié: (2025)
RHanDS: Refining Malformed Hands for Generated Images with Decoupled Structure and Style Guidance
par: Wang, Chengrui, et autres
Publié: (2024)
par: Wang, Chengrui, et autres
Publié: (2024)
PosterMaker: Towards High-Quality Product Poster Generation with Accurate Text Rendering
par: Gao, Yifan, et autres
Publié: (2025)
par: Gao, Yifan, et autres
Publié: (2025)
DualDiff+: Dual-Branch Diffusion for High-Fidelity Video Generation with Reward Guidance
par: Yang, Zhao, et autres
Publié: (2025)
par: Yang, Zhao, et autres
Publié: (2025)
PersonalVideo: High ID-Fidelity Video Customization without Dynamic and Semantic Degradation
par: Li, Hengjia, et autres
Publié: (2024)
par: Li, Hengjia, et autres
Publié: (2024)
PixelWizard: Towards Efficient High-Fidelity Video Generation at Ultra-Large Spatial Resolution
par: Li, Wenxue, et autres
Publié: (2026)
par: Li, Wenxue, et autres
Publié: (2026)
LumiSculpt: Enabling Consistent Portrait Lighting in Video Generation
par: Zhang, Yuxin, et autres
Publié: (2024)
par: Zhang, Yuxin, et autres
Publié: (2024)
Vidu4D: Single Generated Video to High-Fidelity 4D Reconstruction with Dynamic Gaussian Surfels
par: Wang, Yikai, et autres
Publié: (2024)
par: Wang, Yikai, et autres
Publié: (2024)
Vivid-ZOO: Multi-View Video Generation with Diffusion Model
par: Li, Bing, et autres
Publié: (2024)
par: Li, Bing, et autres
Publié: (2024)
FideDiff: Efficient Diffusion Model for High-Fidelity Image Motion Deblurring
par: Liu, Xiaoyang, et autres
Publié: (2025)
par: Liu, Xiaoyang, et autres
Publié: (2025)
PhysRVG: Physics-Aware Unified Reinforcement Learning for Video Generative Models
par: Zhang, Qiyuan, et autres
Publié: (2026)
par: Zhang, Qiyuan, et autres
Publié: (2026)
Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality
par: Luo, Zekai, et autres
Publié: (2025)
par: Luo, Zekai, et autres
Publié: (2025)
SynMotion: Semantic-Visual Adaptation for Motion Customized Video Generation
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
VideoSSM: Autoregressive Long Video Generation with Hybrid State-Space Memory
par: Yu, Yifei, et autres
Publié: (2025)
par: Yu, Yifei, et autres
Publié: (2025)
PKU-DyMVHumans: A Multi-View Video Benchmark for High-Fidelity Dynamic Human Modeling
par: Zheng, Xiaoyun, et autres
Publié: (2024)
par: Zheng, Xiaoyun, et autres
Publié: (2024)
Rethinking Scribble-Guided Image Editing: Generalization, Instruction Adherence, and Multi-Tasking
par: Xu, Mingyi, et autres
Publié: (2026)
par: Xu, Mingyi, et autres
Publié: (2026)
Ctrl-V: Higher Fidelity Video Generation with Bounding-Box Controlled Object Motion
par: Luo, Ge Ya, et autres
Publié: (2024)
par: Luo, Ge Ya, et autres
Publié: (2024)
Consistent Video Editing as Flow-Driven Image-to-Video Generation
par: Wang, Ge, et autres
Publié: (2025)
par: Wang, Ge, et autres
Publié: (2025)
ResMaster: Mastering High-Resolution Image Generation via Structural and Fine-Grained Guidance
par: Shi, Shuwei, et autres
Publié: (2024)
par: Shi, Shuwei, et autres
Publié: (2024)
LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation
par: Huang, Yushi, et autres
Publié: (2025)
par: Huang, Yushi, et autres
Publié: (2025)
PreciseCache: Precise Feature Caching for Efficient and High-fidelity Video Generation
par: Wang, Jiangshan, et autres
Publié: (2026)
par: Wang, Jiangshan, et autres
Publié: (2026)
MPF-Net: Exposing High-Fidelity AI-Generated Video Forgeries via Hierarchical Manifold Deviation and Micro-Temporal Fluctuations
par: He, Xinan, et autres
Publié: (2026)
par: He, Xinan, et autres
Publié: (2026)
Documents similaires
-
Tuning-Free Noise Rectification for High Fidelity Image-to-Video Generation
par: Li, Weijie, et autres
Publié: (2024) -
Identity-Preserving Image-to-Video Generation via Reward-Guided Optimization
par: Shen, Liao, et autres
Publié: (2025) -
RISE-T2V: Rephrasing and Injecting Semantics with LLM for Expansive Text-to-Video Generation
par: Zhang, Xiangjun, et autres
Publié: (2025) -
Hierarchical Masked 3D Diffusion Model for Video Outpainting
par: Fan, Fanda, et autres
Publié: (2023) -
AdvDMD: Adversarial Reward Meets DMD For High-Quality Few-Step Generation
par: Wang, Xu, et autres
Publié: (2026)