FineEdit: Fine-Grained Image Edit with Bounding Box Guidance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Haohang, Liu, Lin, Zhang, Zhibo, Cong, Rong, Zhang, Xiaopeng, Tian, Qi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CogniEdit: Dense Gradient Flow Optimization for Fine-Grained Image Editing
par: Li, Yan, et autres
Publié: (2025)
par: Li, Yan, et autres
Publié: (2025)
SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing
par: Xiao, Yicheng, et autres
Publié: (2026)
par: Xiao, Yicheng, et autres
Publié: (2026)
FineViT: Progressively Unlocking Fine-Grained Perception with Dense Recaptions
par: Zhao, Peisen, et autres
Publié: (2026)
par: Zhao, Peisen, et autres
Publié: (2026)
Occlusion-Aware Physics-Semantic Keyframe Selection for Robust Video Editing
par: Liu, Lin, et autres
Publié: (2026)
par: Liu, Lin, et autres
Publié: (2026)
UltraEdit: Instruction-based Fine-Grained Image Editing at Scale
par: Zhao, Haozhe, et autres
Publié: (2024)
par: Zhao, Haozhe, et autres
Publié: (2024)
SliderEdit: Continuous Image Editing with Fine-Grained Instruction Control
par: Zarei, Arman, et autres
Publié: (2025)
par: Zarei, Arman, et autres
Publié: (2025)
PartEdit: Fine-Grained Image Editing using Pre-Trained Diffusion Models
par: Cvejic, Aleksandar, et autres
Publié: (2025)
par: Cvejic, Aleksandar, et autres
Publié: (2025)
Hallucination at a Glance: Controlled Visual Edits and Fine-Grained Multimodal Learning
par: Bai, Tianyi, et autres
Publié: (2025)
par: Bai, Tianyi, et autres
Publié: (2025)
Let's Split Up: Zero-Shot Classifier Edits for Fine-Grained Video Understanding
par: Liu, Kaiting, et autres
Publié: (2026)
par: Liu, Kaiting, et autres
Publié: (2026)
O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing
par: Chen, Yuqing, et autres
Publié: (2025)
par: Chen, Yuqing, et autres
Publié: (2025)
FireEdit: Fine-grained Instruction-based Image Editing via Region-aware Vision Language Model
par: Zhou, Jun, et autres
Publié: (2025)
par: Zhou, Jun, et autres
Publié: (2025)
GranViT: A Fine-Grained Vision Model With Autoregressive Perception For MLLMs
par: Zheng, Guanghao, et autres
Publié: (2025)
par: Zheng, Guanghao, et autres
Publié: (2025)
Edit-Compass & EditReward-Compass: A Unified Benchmark for Image Editing and Reward Modeling
par: Bai, Xuehai, et autres
Publié: (2026)
par: Bai, Xuehai, et autres
Publié: (2026)
ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
par: Yin, Fukun, et autres
Publié: (2025)
par: Yin, Fukun, et autres
Publié: (2025)
Edit360: 2D Image Edits to 3D Assets from Any Angle
par: Huang, Junchao, et autres
Publié: (2025)
par: Huang, Junchao, et autres
Publié: (2025)
InsightEdit: Towards Better Instruction Following for Image Editing
par: Xu, Yingjing, et autres
Publié: (2024)
par: Xu, Yingjing, et autres
Publié: (2024)
EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning
par: Ju, Xuan, et autres
Publié: (2025)
par: Ju, Xuan, et autres
Publié: (2025)
EditSleuth: A Dataset of Grounded Reasoning Chains for Image-Edit Forensics
par: Nguyen, Van-Loc, et autres
Publié: (2026)
par: Nguyen, Van-Loc, et autres
Publié: (2026)
FastEdit: Fast Text-Guided Single-Image Editing via Semantic-Aware Diffusion Fine-Tuning
par: Chen, Zhi, et autres
Publié: (2024)
par: Chen, Zhi, et autres
Publié: (2024)
Edit Temporal-Consistent Videos with Image Diffusion Model
par: Wang, Yuanzhi, et autres
Publié: (2023)
par: Wang, Yuanzhi, et autres
Publié: (2023)
JIGMARK: A Black-Box Approach for Enhancing Image Watermarks against Diffusion Model Edits
par: Pan, Minzhou, et autres
Publié: (2024)
par: Pan, Minzhou, et autres
Publié: (2024)
X-Edit: Detecting and Localizing Edits in Images Altered by Text-Guided Diffusion Models
par: Bazyleva, Valentina, et autres
Publié: (2025)
par: Bazyleva, Valentina, et autres
Publié: (2025)
CannyEdit: Selective Canny Control and Dual-Prompt Guidance for Training-Free Image Editing
par: Xie, Weiyan, et autres
Publié: (2025)
par: Xie, Weiyan, et autres
Publié: (2025)
AutoEdit: Automatic Hyperparameter Tuning for Image Editing
par: Pham, Chau, et autres
Publié: (2025)
par: Pham, Chau, et autres
Publié: (2025)
SpotEdit: Evaluating Visually-Guided Image Editing Methods
par: Ghazanfari, Sara, et autres
Publié: (2025)
par: Ghazanfari, Sara, et autres
Publié: (2025)
DiT4Edit: Diffusion Transformer for Image Editing
par: Feng, Kunyu, et autres
Publié: (2024)
par: Feng, Kunyu, et autres
Publié: (2024)
ResMaster: Mastering High-Resolution Image Generation via Structural and Fine-Grained Guidance
par: Shi, Shuwei, et autres
Publié: (2024)
par: Shi, Shuwei, et autres
Publié: (2024)
QwenStyle: Content-Preserving Style Transfer with Qwen-Image-Edit
par: Zhang, Shiwen, et autres
Publié: (2026)
par: Zhang, Shiwen, et autres
Publié: (2026)
ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing
par: Ma, Yaohui, et autres
Publié: (2024)
par: Ma, Yaohui, et autres
Publié: (2024)
Kiwi-Edit: Versatile Video Editing via Instruction and Reference Guidance
par: Lin, Yiqi, et autres
Publié: (2026)
par: Lin, Yiqi, et autres
Publié: (2026)
EditThinker: Unlocking Iterative Reasoning for Any Image Editor
par: Li, Hongyu, et autres
Publié: (2025)
par: Li, Hongyu, et autres
Publié: (2025)
Edit One for All: Interactive Batch Image Editing
par: Nguyen, Thao, et autres
Publié: (2024)
par: Nguyen, Thao, et autres
Publié: (2024)
OmniEdit: Building Image Editing Generalist Models Through Specialist Supervision
par: Wei, Cong, et autres
Publié: (2024)
par: Wei, Cong, et autres
Publié: (2024)
ReasonEdit: Towards Interpretable Image Editing Evaluation via Reinforcement Learning
par: Chen, Honghua, et autres
Publié: (2026)
par: Chen, Honghua, et autres
Publié: (2026)
Edit Transfer: Learning Image Editing via Vision In-Context Relations
par: Chen, Lan, et autres
Publié: (2025)
par: Chen, Lan, et autres
Publié: (2025)
FlexEdit: Marrying Free-Shape Masks to VLLM for Flexible Image Editing
par: Yuan, Tianshuo, et autres
Publié: (2024)
par: Yuan, Tianshuo, et autres
Publié: (2024)
EditCLIP: Representation Learning for Image Editing
par: Wang, Qian, et autres
Publié: (2025)
par: Wang, Qian, et autres
Publié: (2025)
ScribbleEdit: Synthetic Data for Image Editing with Scribbles and Text
par: Ji, Anya, et autres
Publié: (2026)
par: Ji, Anya, et autres
Publié: (2026)
BrushEdit: All-In-One Image Inpainting and Editing
par: Li, Yaowei, et autres
Publié: (2024)
par: Li, Yaowei, et autres
Publié: (2024)
KV-Edit: Training-Free Image Editing for Precise Background Preservation
par: Zhu, Tianrui, et autres
Publié: (2025)
par: Zhu, Tianrui, et autres
Publié: (2025)
Documents similaires
-
CogniEdit: Dense Gradient Flow Optimization for Fine-Grained Image Editing
par: Li, Yan, et autres
Publié: (2025) -
SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing
par: Xiao, Yicheng, et autres
Publié: (2026) -
FineViT: Progressively Unlocking Fine-Grained Perception with Dense Recaptions
par: Zhao, Peisen, et autres
Publié: (2026) -
Occlusion-Aware Physics-Semantic Keyframe Selection for Robust Video Editing
par: Liu, Lin, et autres
Publié: (2026) -
UltraEdit: Instruction-based Fine-Grained Image Editing at Scale
par: Zhao, Haozhe, et autres
Publié: (2024)