A Video is Worth 256 Bases: Spatial-Temporal Expectation-Maximization Inversion for Zero-Shot Video Editing
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Maomao, Li, Yu, Yang, Tianyu, Liu, Yunfei, Yue, Dongxu, Lin, Zhihui, Xu, Dong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FREE-Edit: Using Editing-aware Injection in Rectified Flow Models for Zero-shot Image-Driven Video Editing
di: Li, Maomao, et al.
Pubblicazione: (2026)
di: Li, Maomao, et al.
Pubblicazione: (2026)
Exploring Iterative Manifold Constraint for Zero-shot Image Editing
di: Li, Maomao, et al.
Pubblicazione: (2025)
di: Li, Maomao, et al.
Pubblicazione: (2025)
Qffusion: Controllable Portrait Video Editing via Quadrant-Grid Attention Learning
di: Li, Maomao, et al.
Pubblicazione: (2025)
di: Li, Maomao, et al.
Pubblicazione: (2025)
Zero-Shot Video Translation and Editing with Frame Spatial-Temporal Correspondence
di: Yang, Shuai, et al.
Pubblicazione: (2025)
di: Yang, Shuai, et al.
Pubblicazione: (2025)
FRESCO: Spatial-Temporal Correspondence for Zero-Shot Video Translation
di: Yang, Shuai, et al.
Pubblicazione: (2024)
di: Yang, Shuai, et al.
Pubblicazione: (2024)
Video In-context Learning: Autoregressive Transformers are Zero-Shot Video Imitators
di: Zhang, Wentao, et al.
Pubblicazione: (2024)
di: Zhang, Wentao, et al.
Pubblicazione: (2024)
VidEdit: Zero-Shot and Spatially Aware Text-Driven Video Editing
di: Couairon, Paul, et al.
Pubblicazione: (2023)
di: Couairon, Paul, et al.
Pubblicazione: (2023)
VideoCoF: Unified Video Editing with Temporal Reasoner
di: Yang, Xiangpeng, et al.
Pubblicazione: (2025)
di: Yang, Xiangpeng, et al.
Pubblicazione: (2025)
Enhancing Low-Cost Video Editing with Lightweight Adaptors and Temporal-Aware Inversion
di: He, Yangfan, et al.
Pubblicazione: (2025)
di: He, Yangfan, et al.
Pubblicazione: (2025)
Zero-Shot Temporal Interaction Localization for Egocentric Videos
di: Zhang, Erhang, et al.
Pubblicazione: (2025)
di: Zhang, Erhang, et al.
Pubblicazione: (2025)
Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing
di: Su, Tongtong, et al.
Pubblicazione: (2025)
di: Su, Tongtong, et al.
Pubblicazione: (2025)
E4S: Fine-grained Face Swapping via Editing With Regional GAN Inversion
di: Li, Maomao, et al.
Pubblicazione: (2023)
di: Li, Maomao, et al.
Pubblicazione: (2023)
Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models
di: Wang, Wen, et al.
Pubblicazione: (2023)
di: Wang, Wen, et al.
Pubblicazione: (2023)
FlowAnchor: Stabilizing the Editing Signal for Inversion-Free Video Editing
di: Chen, Ze, et al.
Pubblicazione: (2026)
di: Chen, Ze, et al.
Pubblicazione: (2026)
Zero-Shot Video Restoration and Enhancement with Assistance of Video Diffusion Models
di: Cao, Cong, et al.
Pubblicazione: (2026)
di: Cao, Cong, et al.
Pubblicazione: (2026)
Slicedit: Zero-Shot Video Editing With Text-to-Image Diffusion Models Using Spatio-Temporal Slices
di: Cohen, Nathaniel, et al.
Pubblicazione: (2024)
di: Cohen, Nathaniel, et al.
Pubblicazione: (2024)
EZSR: Event-based Zero-Shot Recognition
di: Yang, Yan, et al.
Pubblicazione: (2024)
di: Yang, Yan, et al.
Pubblicazione: (2024)
Two-Pass Zero-Shot Temporal-Spatial Grounding of Rare Traffic Events in Surveillance Video
di: Huang, Jiantang
Pubblicazione: (2026)
di: Huang, Jiantang
Pubblicazione: (2026)
Zero-TIG: Temporal Consistency-Aware Zero-Shot Illumination-Guided Low-light Video Enhancement
di: Li, Yini, et al.
Pubblicazione: (2025)
di: Li, Yini, et al.
Pubblicazione: (2025)
Zero-Shot Video Deraining with Video Diffusion Models
di: Varanka, Tuomas, et al.
Pubblicazione: (2025)
di: Varanka, Tuomas, et al.
Pubblicazione: (2025)
Motion-Zero: Zero-Shot Moving Object Control Framework for Diffusion-Based Video Generation
di: Chen, Changgu, et al.
Pubblicazione: (2024)
di: Chen, Changgu, et al.
Pubblicazione: (2024)
Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
di: Xi, Haocheng, et al.
Pubblicazione: (2025)
di: Xi, Haocheng, et al.
Pubblicazione: (2025)
Zero-Shot Video Translation via Token Warping
di: Zhu, Haiming, et al.
Pubblicazione: (2024)
di: Zhu, Haiming, et al.
Pubblicazione: (2024)
From Shots to Stories: LLM-Assisted Video Editing with Unified Language Representations
di: Li, Yuzhi, et al.
Pubblicazione: (2025)
di: Li, Yuzhi, et al.
Pubblicazione: (2025)
Unleashing the Potential of Multimodal LLMs for Zero-Shot Spatio-Temporal Video Grounding
di: Yang, Zaiquan, et al.
Pubblicazione: (2025)
di: Yang, Zaiquan, et al.
Pubblicazione: (2025)
SAMJAM: Zero-Shot Video Scene Graph Generation for Egocentric Kitchen Videos
di: Li, Joshua, et al.
Pubblicazione: (2025)
di: Li, Joshua, et al.
Pubblicazione: (2025)
ZeroHSI: Zero-Shot 4D Human-Scene Interaction by Video Generation
di: Li, Hongjie, et al.
Pubblicazione: (2024)
di: Li, Hongjie, et al.
Pubblicazione: (2024)
Context-Aware Pseudo-Label Scoring for Zero-Shot Video Summarization
di: Wu, Yuanli, et al.
Pubblicazione: (2025)
di: Wu, Yuanli, et al.
Pubblicazione: (2025)
FreeMask: Rethinking the Importance of Attention Masks for Zero-Shot Video Editing
di: Cai, Lingling, et al.
Pubblicazione: (2024)
di: Cai, Lingling, et al.
Pubblicazione: (2024)
VTG-GPT: Tuning-Free Zero-Shot Video Temporal Grounding with GPT
di: Xu, Yifang, et al.
Pubblicazione: (2024)
di: Xu, Yifang, et al.
Pubblicazione: (2024)
SST-EM: Advanced Metrics for Evaluating Semantic, Spatial and Temporal Aspects in Video Editing
di: Biyyala, Varun, et al.
Pubblicazione: (2025)
di: Biyyala, Varun, et al.
Pubblicazione: (2025)
Moonshot: Towards Controllable Video Generation and Editing with Multimodal Conditions
di: Zhang, David Junhao, et al.
Pubblicazione: (2024)
di: Zhang, David Junhao, et al.
Pubblicazione: (2024)
Are Video Models Emerging as Zero-Shot Learners and Reasoners in Medical Imaging?
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
ZONE: Zero-Shot Instruction-Guided Local Editing
di: Li, Shanglin, et al.
Pubblicazione: (2023)
di: Li, Shanglin, et al.
Pubblicazione: (2023)
RealCraft: Attention Control as A Tool for Zero-Shot Consistent Video Editing
di: Jin, Shutong, et al.
Pubblicazione: (2023)
di: Jin, Shutong, et al.
Pubblicazione: (2023)
ReplicateAnyScene: Zero-Shot Video-to-3D Composition via Textual-Visual-Spatial Alignment
di: Dong, Mingyu, et al.
Pubblicazione: (2026)
di: Dong, Mingyu, et al.
Pubblicazione: (2026)
Zero-Shot Long-Form Video Understanding through Screenplay
di: Wu, Yongliang, et al.
Pubblicazione: (2024)
di: Wu, Yongliang, et al.
Pubblicazione: (2024)
ESA: Energy-Based Shot Assembly Optimization for Automatic Video Editing
di: Chen, Yaosen, et al.
Pubblicazione: (2025)
di: Chen, Yaosen, et al.
Pubblicazione: (2025)
Expectation-Maximization as the Engine of Scalable Medical Intelligence
di: Li, Wenxuan, et al.
Pubblicazione: (2025)
di: Li, Wenxuan, et al.
Pubblicazione: (2025)
StreamSTGS: Streaming Spatial and Temporal Gaussian Grids for Real-Time Free-Viewpoint Video
di: Ke, Zhihui, et al.
Pubblicazione: (2025)
di: Ke, Zhihui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
FREE-Edit: Using Editing-aware Injection in Rectified Flow Models for Zero-shot Image-Driven Video Editing
di: Li, Maomao, et al.
Pubblicazione: (2026) -
Exploring Iterative Manifold Constraint for Zero-shot Image Editing
di: Li, Maomao, et al.
Pubblicazione: (2025) -
Qffusion: Controllable Portrait Video Editing via Quadrant-Grid Attention Learning
di: Li, Maomao, et al.
Pubblicazione: (2025) -
Zero-Shot Video Translation and Editing with Frame Spatial-Temporal Correspondence
di: Yang, Shuai, et al.
Pubblicazione: (2025) -
FRESCO: Spatial-Temporal Correspondence for Zero-Shot Video Translation
di: Yang, Shuai, et al.
Pubblicazione: (2024)