OmniEdit: Building Image Editing Generalist Models Through Specialist Supervision
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wei, Cong, Xiong, Zheyang, Ren, Weiming, Du, Xinrun, Zhang, Ge, Chen, Wenhu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
OmniEdit: A Training-free framework for Lip Synchronization and Audio-Visual Editing
von: Lin, Lixiang, et al.
Veröffentlicht: (2026)
von: Lin, Lixiang, et al.
Veröffentlicht: (2026)
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation
von: Ren, Weiming, et al.
Veröffentlicht: (2024)
von: Ren, Weiming, et al.
Veröffentlicht: (2024)
AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks
von: Ku, Max, et al.
Veröffentlicht: (2024)
von: Ku, Max, et al.
Veröffentlicht: (2024)
Vamba: Understanding Hour-Long Videos with Hybrid Mamba-Transformers
von: Ren, Weiming, et al.
Veröffentlicht: (2025)
von: Ren, Weiming, et al.
Veröffentlicht: (2025)
SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing
von: Xiao, Yicheng, et al.
Veröffentlicht: (2026)
von: Xiao, Yicheng, et al.
Veröffentlicht: (2026)
VISTA: Enhancing Long-Duration and High-Resolution Video Understanding by Video Spatiotemporal Augmentation
von: Ren, Weiming, et al.
Veröffentlicht: (2024)
von: Ren, Weiming, et al.
Veröffentlicht: (2024)
Balancing Multi-Target Semi-Supervised Medical Image Segmentation with Collaborative Generalist and Specialists
von: Wang, You, et al.
Veröffentlicht: (2025)
von: Wang, You, et al.
Veröffentlicht: (2025)
EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing
von: Wu, Keming, et al.
Veröffentlicht: (2025)
von: Wu, Keming, et al.
Veröffentlicht: (2025)
SEED-Data-Edit Technical Report: A Hybrid Dataset for Instructional Image Editing
von: Ge, Yuying, et al.
Veröffentlicht: (2024)
von: Ge, Yuying, et al.
Veröffentlicht: (2024)
Omni$^2$: Unifying Omnidirectional Image Generation and Editing in an Omni Model
von: Yang, Liu, et al.
Veröffentlicht: (2025)
von: Yang, Liu, et al.
Veröffentlicht: (2025)
ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
von: Yin, Fukun, et al.
Veröffentlicht: (2025)
von: Yin, Fukun, et al.
Veröffentlicht: (2025)
OmniText: A Training-Free Generalist for Controllable Text-Image Manipulation
von: Gunawan, Agus, et al.
Veröffentlicht: (2025)
von: Gunawan, Agus, et al.
Veröffentlicht: (2025)
Med-LEGO: Editing and Adapting toward Generalist Medical Image Diagnosis
von: Zhu, Yitao, et al.
Veröffentlicht: (2025)
von: Zhu, Yitao, et al.
Veröffentlicht: (2025)
EditInfinity: Image Editing with Binary-Quantized Generative Models
von: Wang, Jiahuan, et al.
Veröffentlicht: (2025)
von: Wang, Jiahuan, et al.
Veröffentlicht: (2025)
UniVG: A Generalist Diffusion Model for Unified Image Generation and Editing
von: Fu, Tsu-Jui, et al.
Veröffentlicht: (2025)
von: Fu, Tsu-Jui, et al.
Veröffentlicht: (2025)
SuperEdit: Rectifying and Facilitating Supervision for Instruction-Based Image Editing
von: Li, Ming, et al.
Veröffentlicht: (2025)
von: Li, Ming, et al.
Veröffentlicht: (2025)
LatentEdit: Adaptive Latent Control for Consistent Semantic Editing
von: Liu, Siyi, et al.
Veröffentlicht: (2025)
von: Liu, Siyi, et al.
Veröffentlicht: (2025)
TBStar-Edit: From Image Editing Pattern Shifting to Consistency Enhancement
von: Fang, Hao, et al.
Veröffentlicht: (2025)
von: Fang, Hao, et al.
Veröffentlicht: (2025)
DiT4Edit: Diffusion Transformer for Image Editing
von: Feng, Kunyu, et al.
Veröffentlicht: (2024)
von: Feng, Kunyu, et al.
Veröffentlicht: (2024)
Edit-Compass & EditReward-Compass: A Unified Benchmark for Image Editing and Reward Modeling
von: Bai, Xuehai, et al.
Veröffentlicht: (2026)
von: Bai, Xuehai, et al.
Veröffentlicht: (2026)
BRIGHT: A Collaborative Generalist-Specialist Foundation Model for Breast Pathology
von: Guo, Xiaojing, et al.
Veröffentlicht: (2026)
von: Guo, Xiaojing, et al.
Veröffentlicht: (2026)
DreamOmni: Unified Image Generation and Editing
von: Xia, Bin, et al.
Veröffentlicht: (2024)
von: Xia, Bin, et al.
Veröffentlicht: (2024)
ByteEdit: Boost, Comply and Accelerate Generative Image Editing
von: Ren, Yuxi, et al.
Veröffentlicht: (2024)
von: Ren, Yuxi, et al.
Veröffentlicht: (2024)
EditCLIP: Representation Learning for Image Editing
von: Wang, Qian, et al.
Veröffentlicht: (2025)
von: Wang, Qian, et al.
Veröffentlicht: (2025)
Group Editing: Edit Multiple Images in One Go
von: Ma, Yue, et al.
Veröffentlicht: (2026)
von: Ma, Yue, et al.
Veröffentlicht: (2026)
Edit-GRPO: A Locality-Preserving Policy Optimization Framework for Image Editing
von: Xu, Shaodong, et al.
Veröffentlicht: (2026)
von: Xu, Shaodong, et al.
Veröffentlicht: (2026)
OmniOCR: Generalist OCR for Ethnic Minority Languages
von: Liu, Bonan, et al.
Veröffentlicht: (2026)
von: Liu, Bonan, et al.
Veröffentlicht: (2026)
TweezeEdit: Consistent and Efficient Image Editing with Path Regularization
von: Mao, Jianda, et al.
Veröffentlicht: (2025)
von: Mao, Jianda, et al.
Veröffentlicht: (2025)
VideoEval-Pro: Robust and Realistic Long Video Understanding Evaluation
von: Ma, Wentao, et al.
Veröffentlicht: (2025)
von: Ma, Wentao, et al.
Veröffentlicht: (2025)
UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
von: Wei, Hongyang, et al.
Veröffentlicht: (2026)
von: Wei, Hongyang, et al.
Veröffentlicht: (2026)
EditRefiner: A Human-Aligned Agentic Framework for Image Editing Refinement
von: Xu, Zitong, et al.
Veröffentlicht: (2026)
von: Xu, Zitong, et al.
Veröffentlicht: (2026)
MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models
von: Zhu, Hongyang, et al.
Veröffentlicht: (2025)
von: Zhu, Hongyang, et al.
Veröffentlicht: (2025)
ReEdit: Multimodal Exemplar-Based Image Editing with Diffusion Models
von: Srivastava, Ashutosh, et al.
Veröffentlicht: (2024)
von: Srivastava, Ashutosh, et al.
Veröffentlicht: (2024)
Inverse-and-Edit: Effective and Fast Image Editing by Cycle Consistency Models
von: Beletskii, Ilia, et al.
Veröffentlicht: (2025)
von: Beletskii, Ilia, et al.
Veröffentlicht: (2025)
UniVideo: Unified Understanding, Generation, and Editing for Videos
von: Wei, Cong, et al.
Veröffentlicht: (2025)
von: Wei, Cong, et al.
Veröffentlicht: (2025)
SeedEdit: Align Image Re-Generation to Image Editing
von: Shi, Yichun, et al.
Veröffentlicht: (2024)
von: Shi, Yichun, et al.
Veröffentlicht: (2024)
FlexEdit: Marrying Free-Shape Masks to VLLM for Flexible Image Editing
von: Yuan, Tianshuo, et al.
Veröffentlicht: (2024)
von: Yuan, Tianshuo, et al.
Veröffentlicht: (2024)
WiseEdit: Benchmarking Cognition- and Creativity-Informed Image Editing
von: Pan, Kaihang, et al.
Veröffentlicht: (2025)
von: Pan, Kaihang, et al.
Veröffentlicht: (2025)
ChronoEdit: Towards Temporal Reasoning for Image Editing and World Simulation
von: Wu, Jay Zhangjie, et al.
Veröffentlicht: (2025)
von: Wu, Jay Zhangjie, et al.
Veröffentlicht: (2025)
PostEdit: Posterior Sampling for Efficient Zero-Shot Image Editing
von: Tian, Feng, et al.
Veröffentlicht: (2024)
von: Tian, Feng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
OmniEdit: A Training-free framework for Lip Synchronization and Audio-Visual Editing
von: Lin, Lixiang, et al.
Veröffentlicht: (2026) -
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation
von: Ren, Weiming, et al.
Veröffentlicht: (2024) -
AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks
von: Ku, Max, et al.
Veröffentlicht: (2024) -
Vamba: Understanding Hour-Long Videos with Hybrid Mamba-Transformers
von: Ren, Weiming, et al.
Veröffentlicht: (2025) -
SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing
von: Xiao, Yicheng, et al.
Veröffentlicht: (2026)