ConsistEdit: Highly Consistent and Precise Training-free Visual Editing
Fuente:
arXiv
Guardado en:
| Autores principales: | Yin, Zixin, Chen, Ling-Hao, Ni, Lionel, Dai, Xili |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
por: Yin, Zixin, et al.
Publicado: (2025)
por: Yin, Zixin, et al.
Publicado: (2025)
LazyDrag: Enabling Stable Drag-Based Editing on Multi-Modal Diffusion Transformers via Explicit Correspondence
por: Yin, Zixin, et al.
Publicado: (2025)
por: Yin, Zixin, et al.
Publicado: (2025)
MLV-Edit: Towards Consistent and Highly Efficient Editing for Minute-Level Videos
por: Cao, Yangyi, et al.
Publicado: (2026)
por: Cao, Yangyi, et al.
Publicado: (2026)
TweezeEdit: Consistent and Efficient Image Editing with Path Regularization
por: Mao, Jianda, et al.
Publicado: (2025)
por: Mao, Jianda, et al.
Publicado: (2025)
TBStar-Edit: From Image Editing Pattern Shifting to Consistency Enhancement
por: Fang, Hao, et al.
Publicado: (2025)
por: Fang, Hao, et al.
Publicado: (2025)
Inverse-and-Edit: Effective and Fast Image Editing by Cycle Consistency Models
por: Beletskii, Ilia, et al.
Publicado: (2025)
por: Beletskii, Ilia, et al.
Publicado: (2025)
OmniEdit: A Training-free framework for Lip Synchronization and Audio-Visual Editing
por: Lin, Lixiang, et al.
Publicado: (2026)
por: Lin, Lixiang, et al.
Publicado: (2026)
LatentEdit: Adaptive Latent Control for Consistent Semantic Editing
por: Liu, Siyi, et al.
Publicado: (2025)
por: Liu, Siyi, et al.
Publicado: (2025)
VeloEdit: Training-Free Consistent and Continuous Instruction-Based Image Editing via Velocity Field Decomposition
por: Li, Zongqing, et al.
Publicado: (2026)
por: Li, Zongqing, et al.
Publicado: (2026)
FastVideoEdit: Leveraging Consistency Models for Efficient Text-to-Video Editing
por: Zhang, Youyuan, et al.
Publicado: (2024)
por: Zhang, Youyuan, et al.
Publicado: (2024)
UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
por: Wei, Hongyang, et al.
Publicado: (2026)
por: Wei, Hongyang, et al.
Publicado: (2026)
CoCoEdit: Content-Consistent Image Editing via Region Regularized Reinforcement Learning
por: Wu, Yuhui, et al.
Publicado: (2026)
por: Wu, Yuhui, et al.
Publicado: (2026)
KV-Edit: Training-Free Image Editing for Precise Background Preservation
por: Zhu, Tianrui, et al.
Publicado: (2025)
por: Zhu, Tianrui, et al.
Publicado: (2025)
Edit Temporal-Consistent Videos with Image Diffusion Model
por: Wang, Yuanzhi, et al.
Publicado: (2023)
por: Wang, Yuanzhi, et al.
Publicado: (2023)
UniEdit-I: Training-free Image Editing for Unified VLM via Iterative Understanding, Editing and Verifying
por: Bai, Chengyu, et al.
Publicado: (2025)
por: Bai, Chengyu, et al.
Publicado: (2025)
Edicho: Consistent Image Editing in the Wild
por: Bai, Qingyan, et al.
Publicado: (2024)
por: Bai, Qingyan, et al.
Publicado: (2024)
Shape-for-Motion: Precise and Consistent Video Editing with 3D Proxy
por: Liu, Yuhao, et al.
Publicado: (2025)
por: Liu, Yuhao, et al.
Publicado: (2025)
S$^2$Edit: Text-Guided Image Editing with Precise Semantic and Spatial Control
por: Liu, Xudong, et al.
Publicado: (2025)
por: Liu, Xudong, et al.
Publicado: (2025)
PhysEdit: Physically-Consistent Region-Aware Image Editing via Adaptive Spatio-Temporal Reasoning
por: Li, Guandong, et al.
Publicado: (2026)
por: Li, Guandong, et al.
Publicado: (2026)
ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
por: Yin, Fukun, et al.
Publicado: (2025)
por: Yin, Fukun, et al.
Publicado: (2025)
Storybooth: Training-free Multi-Subject Consistency for Improved Visual Storytelling
por: Singh, Jaskirat, et al.
Publicado: (2025)
por: Singh, Jaskirat, et al.
Publicado: (2025)
HulluEdit: Single-Pass Evidence-Consistent Subspace Editing for Mitigating Hallucinations in Large Vision-Language Models
por: Lin, Yangguang, et al.
Publicado: (2026)
por: Lin, Yangguang, et al.
Publicado: (2026)
Ctrl123: Consistent Novel View Synthesis via Closed-Loop Transcription
por: Zhao, Hongxiang, et al.
Publicado: (2024)
por: Zhao, Hongxiang, et al.
Publicado: (2024)
Pay Attention and Move Better: Harnessing Attention for Interactive Motion Generation and Training-free Editing
por: Chen, Ling-Hao, et al.
Publicado: (2024)
por: Chen, Ling-Hao, et al.
Publicado: (2024)
MotionLCM: Real-time Controllable Motion Generation via Latent Consistency Model
por: Dai, Wenxun, et al.
Publicado: (2024)
por: Dai, Wenxun, et al.
Publicado: (2024)
Vectorized Video Representation with Easy Editing via Hierarchical Spatio-Temporally Consistent Proxy Embedding
por: Chen, Ye, et al.
Publicado: (2025)
por: Chen, Ye, et al.
Publicado: (2025)
Multi-turn Consistent Image Editing
por: Zhou, Zijun, et al.
Publicado: (2025)
por: Zhou, Zijun, et al.
Publicado: (2025)
UniVerse-1: Unified Audio-Video Generation via Stitching of Experts
por: Wang, Duomin, et al.
Publicado: (2025)
por: Wang, Duomin, et al.
Publicado: (2025)
DGE: Direct Gaussian 3D Editing by Consistent Multi-view Editing
por: Chen, Minghao, et al.
Publicado: (2024)
por: Chen, Minghao, et al.
Publicado: (2024)
DiffMagicFace: Identity Consistent Facial Editing of Real Videos
por: Yin, Huanghao, et al.
Publicado: (2026)
por: Yin, Huanghao, et al.
Publicado: (2026)
FlashEdit: Decoupling Speed, Structure, and Semantics for Precise Image Editing
por: Wu, Junyi, et al.
Publicado: (2025)
por: Wu, Junyi, et al.
Publicado: (2025)
EditCrafter: Tuning-free High-Resolution Image Editing via Pretrained Diffusion Model
por: Kim, Kunho, et al.
Publicado: (2026)
por: Kim, Kunho, et al.
Publicado: (2026)
Consistent Image Layout Editing with Diffusion Models
por: Xia, Tao, et al.
Publicado: (2025)
por: Xia, Tao, et al.
Publicado: (2025)
Towards Scalable and Consistent 3D Editing
por: Xia, Ruihao, et al.
Publicado: (2025)
por: Xia, Ruihao, et al.
Publicado: (2025)
ETC: training-free diffusion models acceleration with Error-aware Trend Consistency
por: Xie, Jiajian, et al.
Publicado: (2025)
por: Xie, Jiajian, et al.
Publicado: (2025)
Reasoning to Edit: Hypothetical Instruction-Based Image Editing with Visual Reasoning
por: He, Qingdong, et al.
Publicado: (2025)
por: He, Qingdong, et al.
Publicado: (2025)
MotionPCM: Real-Time Motion Synthesis with Phased Consistency Model
por: Jiang, Lei, et al.
Publicado: (2025)
por: Jiang, Lei, et al.
Publicado: (2025)
SpeakerVid-5M: A Large-Scale High-Quality Dataset for Audio-Visual Dyadic Interactive Human Generation
por: Zhang, Youliang, et al.
Publicado: (2025)
por: Zhang, Youliang, et al.
Publicado: (2025)
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation
por: Ren, Weiming, et al.
Publicado: (2024)
por: Ren, Weiming, et al.
Publicado: (2024)
SpotActor: Training-Free Layout-Controlled Consistent Image Generation
por: Wang, Jiahao, et al.
Publicado: (2024)
por: Wang, Jiahao, et al.
Publicado: (2024)
Ejemplares similares
-
Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
por: Yin, Zixin, et al.
Publicado: (2025) -
LazyDrag: Enabling Stable Drag-Based Editing on Multi-Modal Diffusion Transformers via Explicit Correspondence
por: Yin, Zixin, et al.
Publicado: (2025) -
MLV-Edit: Towards Consistent and Highly Efficient Editing for Minute-Level Videos
por: Cao, Yangyi, et al.
Publicado: (2026) -
TweezeEdit: Consistent and Efficient Image Editing with Path Regularization
por: Mao, Jianda, et al.
Publicado: (2025) -
TBStar-Edit: From Image Editing Pattern Shifting to Consistency Enhancement
por: Fang, Hao, et al.
Publicado: (2025)