Geometric Image Editing via Effects-Sensitive In-Context Inpainting with Diffusion Transformers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Shuo, Wu, Wenzhuo, Zhang, Huayu, Cheng, Jiarong, Zang, Xianghao, Ban, Chao, Sun, Hao, He, Zhongjiang, Cao, Tianwei, Liang, Kongming, Ma, Zhanyu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FairHuman: Boosting Hand and Face Quality in Human Image Generation with Minimum Potential Delay Fairness in Diffusion Models
par: Wang, Yuxuan, et autres
Publié: (2025)
par: Wang, Yuxuan, et autres
Publié: (2025)
DataEvolver: Let Your Data Build and Improve Itself via Goal-Driven Loop Agents
par: Zhang, Qisong, et autres
Publié: (2026)
par: Zhang, Qisong, et autres
Publié: (2026)
Curriculum Group Policy Optimization: Adaptive Sampling for Unleashing the Potential of Text-to-Image Generation
par: Li, Baoteng, et autres
Publié: (2026)
par: Li, Baoteng, et autres
Publié: (2026)
OmniEraser: Remove Objects and Their Effects in Images with Paired Video-Frame Data
par: Wei, Runpu, et autres
Publié: (2025)
par: Wei, Runpu, et autres
Publié: (2025)
Benchmarking Semantic Segmentation Models via Appearance and Geometry Attribute Editing
par: Yin, Zijin, et autres
Publié: (2026)
par: Yin, Zijin, et autres
Publié: (2026)
Detailed Object Description with Controllable Dimensions
par: Wang, Xinran, et autres
Publié: (2024)
par: Wang, Xinran, et autres
Publié: (2024)
ProTA: Probabilistic Token Aggregation for Text-Video Retrieval
par: Fang, Han, et autres
Publié: (2024)
par: Fang, Han, et autres
Publié: (2024)
Benchmarking Segmentation Models with Mask-Preserved Attribute Editing
par: Yin, Zijin, et autres
Publié: (2024)
par: Yin, Zijin, et autres
Publié: (2024)
Generative Visual Chain-of-Thought for Image Editing
par: Yin, Zijin, et autres
Publié: (2026)
par: Yin, Zijin, et autres
Publié: (2026)
Disentangle and denoise: Tackling context misalignment for video moment retrieval
par: Ma, Kaijing, et autres
Publié: (2024)
par: Ma, Kaijing, et autres
Publié: (2024)
From Simple to Professional: A Combinatorial Controllable Image Captioning Agent
par: Wang, Xinran, et autres
Publié: (2024)
par: Wang, Xinran, et autres
Publié: (2024)
Adaptive Evidential Learning for Temporal-Semantic Robustness in Moment Retrieval
par: Huang, Haojian, et autres
Publié: (2025)
par: Huang, Haojian, et autres
Publié: (2025)
PGP-SAM: Prototype-Guided Prompt Learning for Efficient Few-Shot Medical Image Segmentation
par: Yan, Zhonghao, et autres
Publié: (2025)
par: Yan, Zhonghao, et autres
Publié: (2025)
VideoPainter: Any-length Video Inpainting and Editing with Plug-and-Play Context Control
par: Bian, Yuxuan, et autres
Publié: (2025)
par: Bian, Yuxuan, et autres
Publié: (2025)
InpDiffusion: Image Inpainting Localization via Conditional Diffusion Models
par: Wang, Kai, et autres
Publié: (2025)
par: Wang, Kai, et autres
Publié: (2025)
In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
par: Zhang, Zechuan, et autres
Publié: (2025)
par: Zhang, Zechuan, et autres
Publié: (2025)
Polyp-E: Benchmarking the Robustness of Deep Segmentation Models via Polyp Editing
par: Wei, Runpu, et autres
Publié: (2024)
par: Wei, Runpu, et autres
Publié: (2024)
Harnessing Caption Detailness for Data-Efficient Text-to-Image Generation
par: Wang, Xinran, et autres
Publié: (2025)
par: Wang, Xinran, et autres
Publié: (2025)
BrushEdit: All-In-One Image Inpainting and Editing
par: Li, Yaowei, et autres
Publié: (2024)
par: Li, Yaowei, et autres
Publié: (2024)
DeContext as Defense: Safe Image Editing in Diffusion Transformers
par: Shen, Linghui, et autres
Publié: (2025)
par: Shen, Linghui, et autres
Publié: (2025)
Training-free Geometric Image Editing on Diffusion Models
par: Zhu, Hanshen, et autres
Publié: (2025)
par: Zhu, Hanshen, et autres
Publié: (2025)
Image Inpainting Models are Effective Tools for Instruction-guided Image Editing
par: Ju, Xuan, et autres
Publié: (2024)
par: Ju, Xuan, et autres
Publié: (2024)
NeRF Inpainting with Geometric Diffusion Prior and Balanced Score Distillation
par: Zhang, Menglin, et autres
Publié: (2024)
par: Zhang, Menglin, et autres
Publié: (2024)
Active Tabular Augmentation via Policy-Guided Diffusion Inpainting
par: Zhang, Zheyu, et autres
Publié: (2026)
par: Zhang, Zheyu, et autres
Publié: (2026)
Evaluating Attribute Comprehension in Large Vision-Language Models
par: Zhang, Haiwen, et autres
Publié: (2024)
par: Zhang, Haiwen, et autres
Publié: (2024)
Aggregated Contextual Transformations for High-Resolution Image Inpainting
par: Zeng, Yanhong, et autres
Publié: (2021)
par: Zeng, Yanhong, et autres
Publié: (2021)
Editing Massive Concepts in Text-to-Image Diffusion Models
par: Xiong, Tianwei, et autres
Publié: (2024)
par: Xiong, Tianwei, et autres
Publié: (2024)
DetailVerifyBench: A Benchmark for Dense Hallucination Localization in Long Image Captions
par: Wang, Xinran, et autres
Publié: (2026)
par: Wang, Xinran, et autres
Publié: (2026)
MxT: Mamba x Transformer for Image Inpainting
par: Chen, Shuang, et autres
Publié: (2024)
par: Chen, Shuang, et autres
Publié: (2024)
Hepato-LLaVA: An Expert MLLM with Sparse Topo-Pack Attention for Hepatocellular Pathology Analysis on Whole Slide Images
par: Yang, Yuxuan, et autres
Publié: (2026)
par: Yang, Yuxuan, et autres
Publié: (2026)
Lazy Diffusion Transformer for Interactive Image Editing
par: Nitzan, Yotam, et autres
Publié: (2024)
par: Nitzan, Yotam, et autres
Publié: (2024)
AsyncDSB: Schedule-Asynchronous Diffusion Schrödinger Bridge for Image Inpainting
par: Han, Zihao, et autres
Publié: (2024)
par: Han, Zihao, et autres
Publié: (2024)
Moodifier: MLLM-Enhanced Emotion-Driven Image Editing
par: Ye, Jiarong, et autres
Publié: (2025)
par: Ye, Jiarong, et autres
Publié: (2025)
Equivariant Imaging for Self-supervised Hyperspectral Image Inpainting
par: Li, Shuo, et autres
Publié: (2024)
par: Li, Shuo, et autres
Publié: (2024)
Robust-Wide: Robust Watermarking against Instruction-driven Image Editing
par: Hu, Runyi, et autres
Publié: (2024)
par: Hu, Runyi, et autres
Publié: (2024)
Assessing Image Inpainting via Re-Inpainting Self-Consistency Evaluation
par: Chen, Tianyi, et autres
Publié: (2024)
par: Chen, Tianyi, et autres
Publié: (2024)
Inpaint4Drag: Repurposing Inpainting Models for Drag-Based Image Editing via Bidirectional Warping
par: Lu, Jingyi, et autres
Publié: (2025)
par: Lu, Jingyi, et autres
Publié: (2025)
Efficient Face Super-Resolution via Wavelet-based Feature Enhancement Network
par: Li, Wenjie, et autres
Publié: (2024)
par: Li, Wenjie, et autres
Publié: (2024)
InpaintHuman: Reconstructing Occluded Humans with Multi-Scale UV Mapping and Identity-Preserving Diffusion Inpainting
par: Fan, Jinlong, et autres
Publié: (2026)
par: Fan, Jinlong, et autres
Publié: (2026)
Cross-Lingual Knowledge Editing in Large Language Models
par: Wang, Jiaan, et autres
Publié: (2023)
par: Wang, Jiaan, et autres
Publié: (2023)
Documents similaires
-
FairHuman: Boosting Hand and Face Quality in Human Image Generation with Minimum Potential Delay Fairness in Diffusion Models
par: Wang, Yuxuan, et autres
Publié: (2025) -
DataEvolver: Let Your Data Build and Improve Itself via Goal-Driven Loop Agents
par: Zhang, Qisong, et autres
Publié: (2026) -
Curriculum Group Policy Optimization: Adaptive Sampling for Unleashing the Potential of Text-to-Image Generation
par: Li, Baoteng, et autres
Publié: (2026) -
OmniEraser: Remove Objects and Their Effects in Images with Paired Video-Frame Data
par: Wei, Runpu, et autres
Publié: (2025) -
Benchmarking Semantic Segmentation Models via Appearance and Geometry Attribute Editing
par: Yin, Zijin, et autres
Publié: (2026)