Blended Latent Diffusion under Attention Control for Real-World Video Editing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Deyin, Wu, Lin Yuanbo, Xie, Xianghua |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Novel Approach to Industrial Defect Generation through Blended Latent Diffusion Model with Online Adaptation
par: Li, Hanxi, et autres
Publié: (2024)
par: Li, Hanxi, et autres
Publié: (2024)
Re-Attentional Controllable Video Diffusion Editing
par: Wang, Yuanzhi, et autres
Publié: (2024)
par: Wang, Yuanzhi, et autres
Publié: (2024)
Towards Efficient Pixel Labeling for Industrial Anomaly Detection and Localization
par: Li, Hanxi, et autres
Publié: (2024)
par: Li, Hanxi, et autres
Publié: (2024)
Self-Navigated Residual Mamba for Universal Industrial Anomaly Detection
par: Li, Hanxi, et autres
Publié: (2025)
par: Li, Hanxi, et autres
Publié: (2025)
Towards Efficient Pixel Labeling for Industrial Anomaly Detection and Localization
par: Wu, Jingqi, et autres
Publié: (2025)
par: Wu, Jingqi, et autres
Publié: (2025)
Qffusion: Controllable Portrait Video Editing via Quadrant-Grid Attention Learning
par: Li, Maomao, et autres
Publié: (2025)
par: Li, Maomao, et autres
Publié: (2025)
Unleashing Hierarchical Reasoning: An LLM-Driven Framework for Training-Free Referring Video Object Segmentation
par: Zhao, Bingrui, et autres
Publié: (2025)
par: Zhao, Bingrui, et autres
Publié: (2025)
RealCraft: Attention Control as A Tool for Zero-Shot Consistent Video Editing
par: Jin, Shutong, et autres
Publié: (2023)
par: Jin, Shutong, et autres
Publié: (2023)
Fuse Your Latents: Video Editing with Multi-source Latent Diffusion Models
par: Lu, Tianyi, et autres
Publié: (2023)
par: Lu, Tianyi, et autres
Publié: (2023)
AttentNet: Fully Convolutional 3D Attention for Lung Nodule Detection
par: Almahasneh, Majedaldein, et autres
Publié: (2024)
par: Almahasneh, Majedaldein, et autres
Publié: (2024)
Streaming Video Diffusion: Online Video Editing with Diffusion Models
par: Chen, Feng, et autres
Publié: (2024)
par: Chen, Feng, et autres
Publié: (2024)
AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
par: Yang, Biao, et autres
Publié: (2025)
par: Yang, Biao, et autres
Publié: (2025)
VEBench:Benchmarking Large Multimodal Models for Real-World Video Editing
par: Deng, Andong, et autres
Publié: (2026)
par: Deng, Andong, et autres
Publié: (2026)
RealViformer: Investigating Attention for Real-World Video Super-Resolution
par: Zhang, Yuehan, et autres
Publié: (2024)
par: Zhang, Yuehan, et autres
Publié: (2024)
Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing
par: Li, Yan, et autres
Publié: (2026)
par: Li, Yan, et autres
Publié: (2026)
A Deep Semantic Segmentation Network with Semantic and Contextual Refinements
par: Wang, Zhiyan, et autres
Publié: (2024)
par: Wang, Zhiyan, et autres
Publié: (2024)
Denoise to Track: Harnessing Video Diffusion Priors for Robust Correspondence
par: Yuan, Tianyu, et autres
Publié: (2025)
par: Yuan, Tianyu, et autres
Publié: (2025)
FAME: Fairness-aware Attention-modulated Video Editing
par: Wu, Zhangkai, et autres
Publié: (2025)
par: Wu, Zhangkai, et autres
Publié: (2025)
SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer
par: Zhao, Yuyang, et autres
Publié: (2026)
par: Zhao, Yuyang, et autres
Publié: (2026)
CCEdit: Creative and Controllable Video Editing via Diffusion Models
par: Feng, Ruoyu, et autres
Publié: (2023)
par: Feng, Ruoyu, et autres
Publié: (2023)
HairDiffusion: Vivid Multi-Colored Hair Editing via Latent Diffusion
par: Zeng, Yu, et autres
Publié: (2024)
par: Zeng, Yu, et autres
Publié: (2024)
DeCo: Decoupled Human-Centered Diffusion Video Editing with Motion Consistency
par: Zhong, Xiaojing, et autres
Publié: (2024)
par: Zhong, Xiaojing, et autres
Publié: (2024)
RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera Control
par: Li, Teng, et autres
Publié: (2025)
par: Li, Teng, et autres
Publié: (2025)
ACD: Direct Conditional Control for Video Diffusion Models via Attention Supervision
par: Li, Weiqi, et autres
Publié: (2025)
par: Li, Weiqi, et autres
Publié: (2025)
Dynamic Motion Blending for Versatile Motion Editing
par: Jiang, Nan, et autres
Publié: (2025)
par: Jiang, Nan, et autres
Publié: (2025)
EditCtrl: Disentangled Local and Global Control for Real-Time Generative Video Editing
par: Litman, Yehonathan, et autres
Publié: (2026)
par: Litman, Yehonathan, et autres
Publié: (2026)
Ingredients: Blending Custom Photos with Video Diffusion Transformers
par: Fei, Zhengcong, et autres
Publié: (2025)
par: Fei, Zhengcong, et autres
Publié: (2025)
Blended Point Cloud Diffusion for Localized Text-guided Shape Editing
par: Sella, Etai, et autres
Publié: (2025)
par: Sella, Etai, et autres
Publié: (2025)
OptiWorld: Optimal Control for Video World Generation under Physical Constraints
par: Yuan, Yu, et autres
Publié: (2026)
par: Yuan, Yu, et autres
Publié: (2026)
Analysis of Attention in Video Diffusion Transformers
par: Wen, Yuxin, et autres
Publié: (2025)
par: Wen, Yuxin, et autres
Publié: (2025)
Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models
par: Wang, Wen, et autres
Publié: (2023)
par: Wang, Wen, et autres
Publié: (2023)
TDM: Temporally-Consistent Diffusion Model for All-in-One Real-World Video Restoration
par: Li, Yizhou, et autres
Publié: (2025)
par: Li, Yizhou, et autres
Publié: (2025)
PixPerfect: Seamless Latent Diffusion Local Editing with Discriminative Pixel-Space Refinement
par: Zheng, Haitian, et autres
Publié: (2025)
par: Zheng, Haitian, et autres
Publié: (2025)
LTX-Video: Realtime Video Latent Diffusion
par: HaCohen, Yoav, et autres
Publié: (2024)
par: HaCohen, Yoav, et autres
Publié: (2024)
VSA: Faster Video Diffusion with Trainable Sparse Attention
par: Zhang, Peiyuan, et autres
Publié: (2025)
par: Zhang, Peiyuan, et autres
Publié: (2025)
LSGQuant: Layer-Sensitivity Guided Quantization for One-Step Diffusion Real-World Video Super-Resolution
par: Wu, Tianxing, et autres
Publié: (2026)
par: Wu, Tianxing, et autres
Publié: (2026)
Muon-Accelerated Attention Distillation for Real-Time Edge Synthesis via Optimized Latent Diffusion
par: Chen, Weiye, et autres
Publié: (2025)
par: Chen, Weiye, et autres
Publié: (2025)
Latent Space Disentanglement in Diffusion Transformers Enables Precise Zero-shot Semantic Editing
par: Shuai, Zitao, et autres
Publié: (2024)
par: Shuai, Zitao, et autres
Publié: (2024)
FiVE: A Fine-grained Video Editing Benchmark for Evaluating Emerging Diffusion and Rectified Flow Models
par: Li, Minghan, et autres
Publié: (2025)
par: Li, Minghan, et autres
Publié: (2025)
Multimodal-Conditioned Latent Diffusion Models for Fashion Image Editing
par: Baldrati, Alberto, et autres
Publié: (2024)
par: Baldrati, Alberto, et autres
Publié: (2024)
Documents similaires
-
A Novel Approach to Industrial Defect Generation through Blended Latent Diffusion Model with Online Adaptation
par: Li, Hanxi, et autres
Publié: (2024) -
Re-Attentional Controllable Video Diffusion Editing
par: Wang, Yuanzhi, et autres
Publié: (2024) -
Towards Efficient Pixel Labeling for Industrial Anomaly Detection and Localization
par: Li, Hanxi, et autres
Publié: (2024) -
Self-Navigated Residual Mamba for Universal Industrial Anomaly Detection
par: Li, Hanxi, et autres
Publié: (2025) -
Towards Efficient Pixel Labeling for Industrial Anomaly Detection and Localization
par: Wu, Jingqi, et autres
Publié: (2025)