InstructGIE: Towards Generalizable Image Editing
Fuente:
arXiv
Guardado en:
| Autores principales: | Meng, Zichong, Yang, Changdi, Liu, Jun, Tang, Hao, Zhao, Pu, Wang, Yanzhi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DiffClass: Diffusion-Based Class Incremental Learning
por: Meng, Zichong, et al.
Publicado: (2024)
por: Meng, Zichong, et al.
Publicado: (2024)
GIE-Bench: Towards Grounded Evaluation for Text-Guided Image Editing
por: Qian, Yusu, et al.
Publicado: (2025)
por: Qian, Yusu, et al.
Publicado: (2025)
Fast and Memory-Efficient Video Diffusion Using Streamlined Inference
por: Zhan, Zheng, et al.
Publicado: (2024)
por: Zhan, Zheng, et al.
Publicado: (2024)
InstructPix2NeRF: Instructed 3D Portrait Editing from a Single Image
por: Li, Jianhui, et al.
Publicado: (2023)
por: Li, Jianhui, et al.
Publicado: (2023)
InstructX: Towards Unified Visual Editing with MLLM Guidance
por: Mou, Chong, et al.
Publicado: (2025)
por: Mou, Chong, et al.
Publicado: (2025)
Uncertainty-Instructed Structure Injection for Generalizable HD Map Construction
por: Liu, Xiaolu, et al.
Publicado: (2025)
por: Liu, Xiaolu, et al.
Publicado: (2025)
InstructRL4Pix: Training Diffusion for Image Editing by Reinforcement Learning
por: Li, Tiancheng, et al.
Publicado: (2024)
por: Li, Tiancheng, et al.
Publicado: (2024)
RealRestorer: Towards Generalizable Real-World Image Restoration with Large-Scale Image Editing Models
por: Yang, Yufeng, et al.
Publicado: (2026)
por: Yang, Yufeng, et al.
Publicado: (2026)
InstructBrush: Learning Attention-based Instruction Optimization for Image Editing
por: Zhao, Ruoyu, et al.
Publicado: (2024)
por: Zhao, Ruoyu, et al.
Publicado: (2024)
ALTER: All-in-One Layer Pruning and Temporal Expert Routing for Efficient Diffusion Generation
por: Yang, Xiaomeng, et al.
Publicado: (2025)
por: Yang, Xiaomeng, et al.
Publicado: (2025)
QuartDepth: Post-Training Quantization for Real-Time Depth Estimation on the Edge
por: Shen, Xuan, et al.
Publicado: (2025)
por: Shen, Xuan, et al.
Publicado: (2025)
StyleBlend: Enhancing Style-Specific Content Creation in Text-to-Image Diffusion Models
por: Chen, Zichong, et al.
Publicado: (2025)
por: Chen, Zichong, et al.
Publicado: (2025)
InstructUDrag: Joint Text Instructions and Object Dragging for Interactive Image Editing
por: Yu, Haoran, et al.
Publicado: (2025)
por: Yu, Haoran, et al.
Publicado: (2025)
TSLA: A Task-Specific Learning Adaptation for Semantic Segmentation on Autonomous Vehicles Platform
por: Liu, Jun, et al.
Publicado: (2025)
por: Liu, Jun, et al.
Publicado: (2025)
InstructAV2AV: Instruction-Guided Audio-Video Joint Editing
por: Zheng, Haojie, et al.
Publicado: (2026)
por: Zheng, Haojie, et al.
Publicado: (2026)
TIGER: Text-Instructed 3D Gaussian Retrieval and Coherent Editing
por: Xu, Teng, et al.
Publicado: (2024)
por: Xu, Teng, et al.
Publicado: (2024)
OmniMem: Scalable and Adaptive Memory Retrieval for Long Video Generation
por: Zhao, Lin, et al.
Publicado: (2026)
por: Zhao, Lin, et al.
Publicado: (2026)
InstructHumans: Editing Animated 3D Human Textures with Instructions
por: Zhu, Jiayin, et al.
Publicado: (2024)
por: Zhu, Jiayin, et al.
Publicado: (2024)
InstructVEdit: A Holistic Approach for Instructional Video Editing
por: Zhang, Chi, et al.
Publicado: (2025)
por: Zhang, Chi, et al.
Publicado: (2025)
MRT: Masked Region Transformer for Layered Image Generation and Editing at Scale
por: Tang, Zhicong, et al.
Publicado: (2026)
por: Tang, Zhicong, et al.
Publicado: (2026)
InstructSeg: Unifying Instructed Visual Segmentation with Multi-modal Large Language Models
por: Wei, Cong, et al.
Publicado: (2024)
por: Wei, Cong, et al.
Publicado: (2024)
Instruct-CLIP: Improving Instruction-Guided Image Editing with Automated Data Refinement Using Contrastive Learning
por: Chen, Sherry X., et al.
Publicado: (2025)
por: Chen, Sherry X., et al.
Publicado: (2025)
Towards Understanding Cross and Self-Attention in Stable Diffusion for Text-Guided Image Editing
por: Liu, Bingyan, et al.
Publicado: (2024)
por: Liu, Bingyan, et al.
Publicado: (2024)
InstructEngine: Instruction-driven Text-to-Image Alignment
por: Lu, Xingyu, et al.
Publicado: (2025)
por: Lu, Xingyu, et al.
Publicado: (2025)
Dragging with Geometry: From Pixels to Geometry-Guided Image Editing
por: Pu, Xinyu, et al.
Publicado: (2025)
por: Pu, Xinyu, et al.
Publicado: (2025)
IPAdapter-Instruct: Resolving Ambiguity in Image-based Conditioning using Instruct Prompts
por: Rowles, Ciara, et al.
Publicado: (2024)
por: Rowles, Ciara, et al.
Publicado: (2024)
Towards Scalable and Consistent 3D Editing
por: Xia, Ruihao, et al.
Publicado: (2025)
por: Xia, Ruihao, et al.
Publicado: (2025)
Towards Generalizable Multi-Object Tracking
por: Qin, Zheng, et al.
Publicado: (2024)
por: Qin, Zheng, et al.
Publicado: (2024)
UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
por: Wei, Hongyang, et al.
Publicado: (2026)
por: Wei, Hongyang, et al.
Publicado: (2026)
Group Editing: Edit Multiple Images in One Go
por: Ma, Yue, et al.
Publicado: (2026)
por: Ma, Yue, et al.
Publicado: (2026)
Towards Generalized Multi-Image Editing for Unified Multimodal Models
por: Xu, Pengcheng, et al.
Publicado: (2026)
por: Xu, Pengcheng, et al.
Publicado: (2026)
Towards Generalizable AI-Generated Image Detection via Image-Adaptive Prompt Learning
por: Li, Yiheng, et al.
Publicado: (2025)
por: Li, Yiheng, et al.
Publicado: (2025)
OrderChain: Towards General Instruct-Tuning for Stimulating the Ordinal Understanding Ability of MLLM
por: Wang, Jinhong, et al.
Publicado: (2025)
por: Wang, Jinhong, et al.
Publicado: (2025)
FFP-300K: Scaling First-Frame Propagation for Generalizable Video Editing
por: Huang, Xijie, et al.
Publicado: (2026)
por: Huang, Xijie, et al.
Publicado: (2026)
Towards Consistent and Controllable Image Synthesis for Face Editing
por: Wei, Mengting, et al.
Publicado: (2025)
por: Wei, Mengting, et al.
Publicado: (2025)
InsightEdit: Towards Better Instruction Following for Image Editing
por: Xu, Yingjing, et al.
Publicado: (2024)
por: Xu, Yingjing, et al.
Publicado: (2024)
3D-Layout-R1: Structured Reasoning for Language-Instructed Spatial Editing
por: Zhen, Haoyu, et al.
Publicado: (2026)
por: Zhen, Haoyu, et al.
Publicado: (2026)
Neural-Driven Image Editing
por: Zhou, Pengfei, et al.
Publicado: (2025)
por: Zhou, Pengfei, et al.
Publicado: (2025)
Toward Generalizable Deblurring: Leveraging Massive Blur Priors with Linear Attention for Real-World Scenarios
por: Gao, Yuanting, et al.
Publicado: (2026)
por: Gao, Yuanting, et al.
Publicado: (2026)
Towards Transparent AI: A Survey on Explainable Large Language Models
por: Palikhe, Avash, et al.
Publicado: (2025)
por: Palikhe, Avash, et al.
Publicado: (2025)
Ejemplares similares
-
DiffClass: Diffusion-Based Class Incremental Learning
por: Meng, Zichong, et al.
Publicado: (2024) -
GIE-Bench: Towards Grounded Evaluation for Text-Guided Image Editing
por: Qian, Yusu, et al.
Publicado: (2025) -
Fast and Memory-Efficient Video Diffusion Using Streamlined Inference
por: Zhan, Zheng, et al.
Publicado: (2024) -
InstructPix2NeRF: Instructed 3D Portrait Editing from a Single Image
por: Li, Jianhui, et al.
Publicado: (2023) -
InstructX: Towards Unified Visual Editing with MLLM Guidance
por: Mou, Chong, et al.
Publicado: (2025)