FRESCO: Spatial-Temporal Correspondence for Zero-Shot Video Translation
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Shuai, Zhou, Yifan, Liu, Ziwei, Loy, Chen Change |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Zero-Shot Video Translation and Editing with Frame Spatial-Temporal Correspondence
di: Yang, Shuai, et al.
Pubblicazione: (2025)
di: Yang, Shuai, et al.
Pubblicazione: (2025)
Generalizable Implicit Motion Modeling for Video Frame Interpolation
di: Guo, Zujin, et al.
Pubblicazione: (2024)
di: Guo, Zujin, et al.
Pubblicazione: (2024)
Kalman-Inspired Feature Propagation for Video Face Super-Resolution
di: Feng, Ruicheng, et al.
Pubblicazione: (2024)
di: Feng, Ruicheng, et al.
Pubblicazione: (2024)
MatAnyone: Stable Video Matting with Consistent Memory Propagation
di: Yang, Peiqing, et al.
Pubblicazione: (2025)
di: Yang, Peiqing, et al.
Pubblicazione: (2025)
GroupDiff: Diffusion-based Group Portrait Editing
di: Jiang, Yuming, et al.
Pubblicazione: (2024)
di: Jiang, Yuming, et al.
Pubblicazione: (2024)
MVIP-NeRF: Multi-view 3D Inpainting on NeRF Scenes via Diffusion Prior
di: Chen, Honghua, et al.
Pubblicazione: (2024)
di: Chen, Honghua, et al.
Pubblicazione: (2024)
Eliminating Feature Ambiguity for Few-Shot Segmentation
di: Xu, Qianxiong, et al.
Pubblicazione: (2024)
di: Xu, Qianxiong, et al.
Pubblicazione: (2024)
AITTI: Learning Adaptive Inclusive Token for Text-to-Image Generation
di: Hou, Xinyu, et al.
Pubblicazione: (2024)
di: Hou, Xinyu, et al.
Pubblicazione: (2024)
Enhanced Generative Structure Prior for Chinese Text Image Super-resolution
di: Li, Xiaoming, et al.
Pubblicazione: (2025)
di: Li, Xiaoming, et al.
Pubblicazione: (2025)
DifFace: Blind Face Restoration with Diffused Error Contraction
di: Yue, Zongsheng, et al.
Pubblicazione: (2022)
di: Yue, Zongsheng, et al.
Pubblicazione: (2022)
A Video is Worth 256 Bases: Spatial-Temporal Expectation-Maximization Inversion for Zero-Shot Video Editing
di: Li, Maomao, et al.
Pubblicazione: (2023)
di: Li, Maomao, et al.
Pubblicazione: (2023)
ObjCtrl-2.5D: Training-free Object Control with Camera Poses
di: Wang, Zhouxia, et al.
Pubblicazione: (2024)
di: Wang, Zhouxia, et al.
Pubblicazione: (2024)
Trans-Adapter: A Plug-and-Play Framework for Transparent Image Inpainting
di: Dai, Yuekun, et al.
Pubblicazione: (2025)
di: Dai, Yuekun, et al.
Pubblicazione: (2025)
EdgeSAM: Prompt-In-the-Loop Distillation for SAM
di: Zhou, Chong, et al.
Pubblicazione: (2023)
di: Zhou, Chong, et al.
Pubblicazione: (2023)
Towards Language-Driven Video Inpainting via Multimodal Large Language Models
di: Wu, Jianzong, et al.
Pubblicazione: (2024)
di: Wu, Jianzong, et al.
Pubblicazione: (2024)
ANYPORTAL: Zero-Shot Consistent Video Background Replacement
di: Gao, Wenshuo, et al.
Pubblicazione: (2025)
di: Gao, Wenshuo, et al.
Pubblicazione: (2025)
Learning 3D Garment Animation from Trajectories of A Piece of Cloth
di: Shao, Yidi, et al.
Pubblicazione: (2025)
di: Shao, Yidi, et al.
Pubblicazione: (2025)
FileGram: Grounding Agent Personalization in File-System Behavioral Traces
di: Liu, Shuai, et al.
Pubblicazione: (2026)
di: Liu, Shuai, et al.
Pubblicazione: (2026)
Zero-Shot Video Translation via Token Warping
di: Zhu, Haiming, et al.
Pubblicazione: (2024)
di: Zhu, Haiming, et al.
Pubblicazione: (2024)
Denoising as Adaptation: Noise-Space Domain Adaptation for Image Restoration
di: Liao, Kang, et al.
Pubblicazione: (2024)
di: Liao, Kang, et al.
Pubblicazione: (2024)
Omegance: A Single Parameter for Various Granularities in Diffusion-Based Synthesis
di: Hou, Xinyu, et al.
Pubblicazione: (2024)
di: Hou, Xinyu, et al.
Pubblicazione: (2024)
MOWA: Multiple-in-One Image Warping Model
di: Liao, Kang, et al.
Pubblicazione: (2024)
di: Liao, Kang, et al.
Pubblicazione: (2024)
Control Color: Multimodal Diffusion-based Interactive Image Colorization
di: Liang, Zhexin, et al.
Pubblicazione: (2024)
di: Liang, Zhexin, et al.
Pubblicazione: (2024)
Learning Inclusion Matching for Animation Paint Bucket Colorization
di: Dai, Yuekun, et al.
Pubblicazione: (2024)
di: Dai, Yuekun, et al.
Pubblicazione: (2024)
3DEnhancer: Consistent Multi-View Diffusion for 3D Enhancement
di: Luo, Yihang, et al.
Pubblicazione: (2024)
di: Luo, Yihang, et al.
Pubblicazione: (2024)
4RC: 4D Reconstruction via Conditional Querying Anytime and Anywhere
di: Luo, Yihang, et al.
Pubblicazione: (2026)
di: Luo, Yihang, et al.
Pubblicazione: (2026)
Two-Pass Zero-Shot Temporal-Spatial Grounding of Rare Traffic Events in Surveillance Video
di: Huang, Jiantang
Pubblicazione: (2026)
di: Huang, Jiantang
Pubblicazione: (2026)
Generate Your Talking Avatar from Video Reference
di: Guo, Zujin, et al.
Pubblicazione: (2026)
di: Guo, Zujin, et al.
Pubblicazione: (2026)
Unleashing the Potential of Multimodal LLMs for Zero-Shot Spatio-Temporal Video Grounding
di: Yang, Zaiquan, et al.
Pubblicazione: (2025)
di: Yang, Zaiquan, et al.
Pubblicazione: (2025)
SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration
di: Wang, Jianyi, et al.
Pubblicazione: (2025)
di: Wang, Jianyi, et al.
Pubblicazione: (2025)
Efficient Diffusion Model for Image Restoration by Residual Shifting
di: Yue, Zongsheng, et al.
Pubblicazione: (2024)
di: Yue, Zongsheng, et al.
Pubblicazione: (2024)
MEAT: Multiview Diffusion Model for Human Generation on Megapixels with Mesh Attention
di: Wang, Yuhan, et al.
Pubblicazione: (2025)
di: Wang, Yuhan, et al.
Pubblicazione: (2025)
MeViS: A Multi-Modal Dataset for Referring Motion Expression Video Segmentation
di: Ding, Henghui, et al.
Pubblicazione: (2025)
di: Ding, Henghui, et al.
Pubblicazione: (2025)
GausSim: Foreseeing Reality by Gaussian Simulator for Elastic Objects
di: Shao, Yidi, et al.
Pubblicazione: (2024)
di: Shao, Yidi, et al.
Pubblicazione: (2024)
SA-LUT: Spatial Adaptive 4D Look-Up Table for Photorealistic Style Transfer
di: Gong, Zerui, et al.
Pubblicazione: (2025)
di: Gong, Zerui, et al.
Pubblicazione: (2025)
Open-Vocabulary SAM: Segment and Recognize Twenty-thousand Classes Interactively
di: Yuan, Haobo, et al.
Pubblicazione: (2024)
di: Yuan, Haobo, et al.
Pubblicazione: (2024)
Video World Models with Long-term Spatial Memory
di: Wu, Tong, et al.
Pubblicazione: (2025)
di: Wu, Tong, et al.
Pubblicazione: (2025)
Arbitrary-steps Image Super-resolution via Diffusion Inversion
di: Yue, Zongsheng, et al.
Pubblicazione: (2024)
di: Yue, Zongsheng, et al.
Pubblicazione: (2024)
Transformer-Based Visual Segmentation: A Survey
di: Li, Xiangtai, et al.
Pubblicazione: (2023)
di: Li, Xiangtai, et al.
Pubblicazione: (2023)
Paint Bucket Colorization Using Anime Character Color Design Sheets
di: Dai, Yuekun, et al.
Pubblicazione: (2024)
di: Dai, Yuekun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Zero-Shot Video Translation and Editing with Frame Spatial-Temporal Correspondence
di: Yang, Shuai, et al.
Pubblicazione: (2025) -
Generalizable Implicit Motion Modeling for Video Frame Interpolation
di: Guo, Zujin, et al.
Pubblicazione: (2024) -
Kalman-Inspired Feature Propagation for Video Face Super-Resolution
di: Feng, Ruicheng, et al.
Pubblicazione: (2024) -
MatAnyone: Stable Video Matting with Consistent Memory Propagation
di: Yang, Peiqing, et al.
Pubblicazione: (2025) -
GroupDiff: Diffusion-based Group Portrait Editing
di: Jiang, Yuming, et al.
Pubblicazione: (2024)