EffiVED:Efficient Video Editing via Text-instruction Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Zhenghao, Dai, Zuozhuo, Qin, Long, Wang, Weizhi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Tora: Trajectory-oriented Diffusion Transformer for Video Generation
di: Zhang, Zhenghao, et al.
Pubblicazione: (2024)
di: Zhang, Zhenghao, et al.
Pubblicazione: (2024)
UVOSAM: A Mask-free Paradigm for Unsupervised Video Object Segmentation via Segment Anything Model
di: Zhang, Zhenghao, et al.
Pubblicazione: (2023)
di: Zhang, Zhenghao, et al.
Pubblicazione: (2023)
Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation
di: Zhang, Zhenghao, et al.
Pubblicazione: (2025)
di: Zhang, Zhenghao, et al.
Pubblicazione: (2025)
Identity-GRPO: Optimizing Multi-Human Identity-preserving Video Generation via Reinforcement Learning
di: Meng, Xiangyu, et al.
Pubblicazione: (2025)
di: Meng, Xiangyu, et al.
Pubblicazione: (2025)
LaTo: Landmark-tokenized Diffusion Transformer for Fine-grained Human Face Editing
di: Zhang, Zhenghao, et al.
Pubblicazione: (2025)
di: Zhang, Zhenghao, et al.
Pubblicazione: (2025)
VideoDirector: Precise Video Editing via Text-to-Video Models
di: Wang, Yukun, et al.
Pubblicazione: (2024)
di: Wang, Yukun, et al.
Pubblicazione: (2024)
EffiPerception: an Efficient Framework for Various Perception Tasks
di: Xiang, Xinhao, et al.
Pubblicazione: (2024)
di: Xiang, Xinhao, et al.
Pubblicazione: (2024)
FastVideoEdit: Leveraging Consistency Models for Efficient Text-to-Video Editing
di: Zhang, Youyuan, et al.
Pubblicazione: (2024)
di: Zhang, Youyuan, et al.
Pubblicazione: (2024)
Tora3: Trajectory-Guided Audio-Video Generation with Physical Coherence
di: Liao, Junchao, et al.
Pubblicazione: (2026)
di: Liao, Junchao, et al.
Pubblicazione: (2026)
Text-based Talking Video Editing with Cascaded Conditional Diffusion
di: Han, Bo, et al.
Pubblicazione: (2024)
di: Han, Bo, et al.
Pubblicazione: (2024)
Re-HOLD: Video Hand Object Interaction Reenactment via adaptive Layout-instructed Diffusion Model
di: Fan, Yingying, et al.
Pubblicazione: (2025)
di: Fan, Yingying, et al.
Pubblicazione: (2025)
CCEdit: Creative and Controllable Video Editing via Diffusion Models
di: Feng, Ruoyu, et al.
Pubblicazione: (2023)
di: Feng, Ruoyu, et al.
Pubblicazione: (2023)
DAPE: Dual-Stage Parameter-Efficient Fine-Tuning for Consistent Video Editing with Diffusion Models
di: Xia, Junhao, et al.
Pubblicazione: (2025)
di: Xia, Junhao, et al.
Pubblicazione: (2025)
Streaming Video Diffusion: Online Video Editing with Diffusion Models
di: Chen, Feng, et al.
Pubblicazione: (2024)
di: Chen, Feng, et al.
Pubblicazione: (2024)
RFDM: Residual Flow Diffusion Model for Efficient Causal Video Editing
di: Salehi, Mohammadreza, et al.
Pubblicazione: (2026)
di: Salehi, Mohammadreza, et al.
Pubblicazione: (2026)
Instructing Text-to-Image Diffusion Models via Classifier-Guided Semantic Optimization
di: Chang, Yuanyuan, et al.
Pubblicazione: (2025)
di: Chang, Yuanyuan, et al.
Pubblicazione: (2025)
Video Editing via Factorized Diffusion Distillation
di: Singer, Uriel, et al.
Pubblicazione: (2024)
di: Singer, Uriel, et al.
Pubblicazione: (2024)
MobileViCLIP: An Efficient Video-Text Model for Mobile Devices
di: Yang, Min, et al.
Pubblicazione: (2025)
di: Yang, Min, et al.
Pubblicazione: (2025)
InsEdit: Towards Instruction-based Visual Editing via Data-Efficient Video Diffusion Models Adaptation
di: Rao, Zhefan, et al.
Pubblicazione: (2026)
di: Rao, Zhefan, et al.
Pubblicazione: (2026)
Slicedit: Zero-Shot Video Editing With Text-to-Image Diffusion Models Using Spatio-Temporal Slices
di: Cohen, Nathaniel, et al.
Pubblicazione: (2024)
di: Cohen, Nathaniel, et al.
Pubblicazione: (2024)
TRCE: Towards Reliable Malicious Concept Erasure in Text-to-Image Diffusion Models
di: Chen, Ruidong, et al.
Pubblicazione: (2025)
di: Chen, Ruidong, et al.
Pubblicazione: (2025)
Object-Centric Diffusion for Efficient Video Editing
di: Kahatapitiya, Kumara, et al.
Pubblicazione: (2024)
di: Kahatapitiya, Kumara, et al.
Pubblicazione: (2024)
MM-Diff: High-Fidelity Image Personalization via Multi-Modal Condition Integration
di: Wei, Zhichao, et al.
Pubblicazione: (2024)
di: Wei, Zhichao, et al.
Pubblicazione: (2024)
I2VEdit: First-Frame-Guided Video Editing via Image-to-Video Diffusion Models
di: Ouyang, Wenqi, et al.
Pubblicazione: (2024)
di: Ouyang, Wenqi, et al.
Pubblicazione: (2024)
EffiComm: Bandwidth Efficient Multi Agent Communication
di: Yazgan, Melih, et al.
Pubblicazione: (2025)
di: Yazgan, Melih, et al.
Pubblicazione: (2025)
EfficientMT: Efficient Temporal Adaptation for Motion Transfer in Text-to-Video Diffusion Models
di: Cai, Yufei, et al.
Pubblicazione: (2025)
di: Cai, Yufei, et al.
Pubblicazione: (2025)
Dual-Stream Diffusion Net for Text-to-Video Generation
di: Liu, Binhui, et al.
Pubblicazione: (2023)
di: Liu, Binhui, et al.
Pubblicazione: (2023)
Edit as You See: Image-guided Video Editing via Masked Motion Modeling
di: Huang, Zhi-Lin, et al.
Pubblicazione: (2025)
di: Huang, Zhi-Lin, et al.
Pubblicazione: (2025)
CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer
di: Yang, Zhuoyi, et al.
Pubblicazione: (2024)
di: Yang, Zhuoyi, et al.
Pubblicazione: (2024)
Towards Training-Free Scene Text Editing
di: Li, Yubo, et al.
Pubblicazione: (2026)
di: Li, Yubo, et al.
Pubblicazione: (2026)
DECap: Towards Generalized Explicit Caption Editing via Diffusion Mechanism
di: Wang, Zhen, et al.
Pubblicazione: (2023)
di: Wang, Zhen, et al.
Pubblicazione: (2023)
Omni-Video 2: Scaling MLLM-Conditioned Diffusion for Unified Video Generation and Editing
di: Yang, Hao, et al.
Pubblicazione: (2026)
di: Yang, Hao, et al.
Pubblicazione: (2026)
Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models
di: Wang, Wen, et al.
Pubblicazione: (2023)
di: Wang, Wen, et al.
Pubblicazione: (2023)
Efficient Temporal Consistency in Diffusion-Based Video Editing with Adaptor Modules: A Theoretical Framework
di: Song, Xinyuan, et al.
Pubblicazione: (2025)
di: Song, Xinyuan, et al.
Pubblicazione: (2025)
Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing
di: Gao, Kaifeng, et al.
Pubblicazione: (2024)
di: Gao, Kaifeng, et al.
Pubblicazione: (2024)
SketchAnimator: Animate Sketch via Motion Customization of Text-to-Video Diffusion Models
di: Yang, Ruolin, et al.
Pubblicazione: (2025)
di: Yang, Ruolin, et al.
Pubblicazione: (2025)
Lightning-Fast Image Inversion and Editing for Text-to-Image Diffusion Models
di: Samuel, Dvir, et al.
Pubblicazione: (2023)
di: Samuel, Dvir, et al.
Pubblicazione: (2023)
D$^4$M: Dataset Distillation via Disentangled Diffusion Model
di: Su, Duo, et al.
Pubblicazione: (2024)
di: Su, Duo, et al.
Pubblicazione: (2024)
Accelerating Text-to-Image Editing via Cache-Enabled Sparse Diffusion Inference
di: Yu, Zihao, et al.
Pubblicazione: (2023)
di: Yu, Zihao, et al.
Pubblicazione: (2023)
MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models
di: Zhu, Hongyang, et al.
Pubblicazione: (2025)
di: Zhu, Hongyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Tora: Trajectory-oriented Diffusion Transformer for Video Generation
di: Zhang, Zhenghao, et al.
Pubblicazione: (2024) -
UVOSAM: A Mask-free Paradigm for Unsupervised Video Object Segmentation via Segment Anything Model
di: Zhang, Zhenghao, et al.
Pubblicazione: (2023) -
Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation
di: Zhang, Zhenghao, et al.
Pubblicazione: (2025) -
Identity-GRPO: Optimizing Multi-Human Identity-preserving Video Generation via Reinforcement Learning
di: Meng, Xiangyu, et al.
Pubblicazione: (2025) -
LaTo: Landmark-tokenized Diffusion Transformer for Fine-grained Human Face Editing
di: Zhang, Zhenghao, et al.
Pubblicazione: (2025)