Enregistré dans:
| Auteurs principaux: | Zhu, Hanshen, Zhu, Zhen, Zhang, Kaile, Gong, Yiming, Liu, Yuliang, Bai, Xiang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2507.23300 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
InstantEdit: Text-Guided Few-Step Image Editing with Piecewise Rectified Flow
par: Gong, Yiming, et autres
Publié: (2025)
par: Gong, Yiming, et autres
Publié: (2025)
SemiETS: Integrating Spatial and Content Consistencies for Semi-Supervised End-to-end Text Spotting
par: Luo, Dongliang, et autres
Publié: (2025)
par: Luo, Dongliang, et autres
Publié: (2025)
UniEdit-I: Training-free Image Editing for Unified VLM via Iterative Understanding, Editing and Verifying
par: Bai, Chengyu, et autres
Publié: (2025)
par: Bai, Chengyu, et autres
Publié: (2025)
TextPecker: Rewarding Structural Anomaly Quantification for Enhancing Visual Text Rendering
par: Zhu, Hanshen, et autres
Publié: (2026)
par: Zhu, Hanshen, et autres
Publié: (2026)
Puzzle Pieces Picker: Deciphering Ancient Chinese Characters with Radical Reconstruction
par: Wang, Pengjie, et autres
Publié: (2024)
par: Wang, Pengjie, et autres
Publié: (2024)
MSTAR: Box-free Multi-query Scene Text Retrieval with Attention Recycling
par: Yin, Liang, et autres
Publié: (2025)
par: Yin, Liang, et autres
Publié: (2025)
MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models
par: Zhu, Hongyang, et autres
Publié: (2025)
par: Zhu, Hongyang, et autres
Publié: (2025)
Theorem-Validated Reverse Chain-of-Thought Problem Generation for Geometric Reasoning
par: Deng, Linger, et autres
Publié: (2024)
par: Deng, Linger, et autres
Publié: (2024)
GIDE: Unlocking Diffusion LLMs for Precise Training-Free Image Editing
par: Zhu, Zifeng, et autres
Publié: (2026)
par: Zhu, Zifeng, et autres
Publié: (2026)
Diffusion Models are Geometry Critics: Single Image 3D Editing Using Pre-Trained Diffusion Priors
par: Wang, Ruicheng, et autres
Publié: (2024)
par: Wang, Ruicheng, et autres
Publié: (2024)
Consistent Image Layout Editing with Diffusion Models
par: Xia, Tao, et autres
Publié: (2025)
par: Xia, Tao, et autres
Publié: (2025)
SuperMark: Robust and Training-free Image Watermarking via Diffusion-based Super-Resolution
par: Hu, Runyi, et autres
Publié: (2024)
par: Hu, Runyi, et autres
Publié: (2024)
KV-Edit: Training-Free Image Editing for Precise Background Preservation
par: Zhu, Tianrui, et autres
Publié: (2025)
par: Zhu, Tianrui, et autres
Publié: (2025)
Anytime Continual Learning for Open Vocabulary Classification
par: Zhu, Zhen, et autres
Publié: (2024)
par: Zhu, Zhen, et autres
Publié: (2024)
DocThinker: Explainable Multimodal Large Language Models with Rule-based Reinforcement Learning for Document Understanding
par: Yu, Wenwen, et autres
Publié: (2025)
par: Yu, Wenwen, et autres
Publié: (2025)
An open dataset for oracle bone script recognition and decipherment
par: Wang, Pengjie, et autres
Publié: (2024)
par: Wang, Pengjie, et autres
Publié: (2024)
Geometric Image Editing via Effects-Sensitive In-Context Inpainting with Diffusion Transformers
par: Zhang, Shuo, et autres
Publié: (2026)
par: Zhang, Shuo, et autres
Publié: (2026)
Mini-Monkey: Alleviating the Semantic Sawtooth Effect for Lightweight MLLMs via Complementary Image Pyramid
par: Huang, Mingxin, et autres
Publié: (2024)
par: Huang, Mingxin, et autres
Publié: (2024)
GEWDiff: Geometric Enhanced Wavelet-based Diffusion Model for Hyperspectral Image Super-resolution
par: Wang, Sirui, et autres
Publié: (2025)
par: Wang, Sirui, et autres
Publié: (2025)
Image Editing As Programs with Diffusion Models
par: Hu, Yujia, et autres
Publié: (2025)
par: Hu, Yujia, et autres
Publié: (2025)
Deciphering Oracle Bone Language with Diffusion Models
par: Guan, Haisu, et autres
Publié: (2024)
par: Guan, Haisu, et autres
Publié: (2024)
Towards Anatomically Plausible Human Image Generation via Synthetic Localized Preferences
par: Li, Bao, et autres
Publié: (2026)
par: Li, Bao, et autres
Publié: (2026)
InstructRL4Pix: Training Diffusion for Image Editing by Reinforcement Learning
par: Li, Tiancheng, et autres
Publié: (2024)
par: Li, Tiancheng, et autres
Publié: (2024)
Diffusion Model-Based Image Editing: A Survey
par: Huang, Yi, et autres
Publié: (2024)
par: Huang, Yi, et autres
Publié: (2024)
FreeTuner: Any Subject in Any Style with Training-free Diffusion
par: Xu, Youcan, et autres
Publié: (2024)
par: Xu, Youcan, et autres
Publié: (2024)
AGLLDiff: Guiding Diffusion Models Towards Unsupervised Training-free Real-world Low-light Image Enhancement
par: Lin, Yunlong, et autres
Publié: (2024)
par: Lin, Yunlong, et autres
Publié: (2024)
Streaming Video Diffusion: Online Video Editing with Diffusion Models
par: Chen, Feng, et autres
Publié: (2024)
par: Chen, Feng, et autres
Publié: (2024)
ChatGarment: Garment Estimation, Generation and Editing via Large Language Models
par: Bian, Siyuan, et autres
Publié: (2024)
par: Bian, Siyuan, et autres
Publié: (2024)
Edit-Compass & EditReward-Compass: A Unified Benchmark for Image Editing and Reward Modeling
par: Bai, Xuehai, et autres
Publié: (2026)
par: Bai, Xuehai, et autres
Publié: (2026)
EditCrafter: Tuning-free High-Resolution Image Editing via Pretrained Diffusion Model
par: Kim, Kunho, et autres
Publié: (2026)
par: Kim, Kunho, et autres
Publié: (2026)
LASPA: Latent Spatial Alignment for Fast Training-free Single Image Editing
par: Alharbi, Yazeed, et autres
Publié: (2024)
par: Alharbi, Yazeed, et autres
Publié: (2024)
PartEdit: Fine-Grained Image Editing using Pre-Trained Diffusion Models
par: Cvejic, Aleksandar, et autres
Publié: (2025)
par: Cvejic, Aleksandar, et autres
Publié: (2025)
SEED: A Benchmark Dataset for Sequential Facial Attribute Editing with Diffusion Models
par: Zhu, Yule, et autres
Publié: (2025)
par: Zhu, Yule, et autres
Publié: (2025)
Reversible Inversion for Training-Free Exemplar-guided Image Editing
par: Li, Yuke, et autres
Publié: (2025)
par: Li, Yuke, et autres
Publié: (2025)
MoE Jetpack: From Dense Checkpoints to Adaptive Mixture of Experts for Vision Tasks
par: Zhu, Xingkui, et autres
Publié: (2024)
par: Zhu, Xingkui, et autres
Publié: (2024)
SpecEdit: Training-Free Acceleration for Diffusion based Image Editing via Semantic Locking
par: Yan, Zhengan, et autres
Publié: (2026)
par: Yan, Zhengan, et autres
Publié: (2026)
How to Teach Large Multimodal Models New Skills
par: Zhu, Zhen, et autres
Publié: (2025)
par: Zhu, Zhen, et autres
Publié: (2025)
DragDiffusion: Harnessing Diffusion Models for Interactive Point-based Image Editing
par: Shi, Yujun, et autres
Publié: (2023)
par: Shi, Yujun, et autres
Publié: (2023)
MAUP: Training-free Multi-center Adaptive Uncertainty-aware Prompting for Cross-domain Few-shot Medical Image Segmentation
par: Zhu, Yazhou, et autres
Publié: (2025)
par: Zhu, Yazhou, et autres
Publié: (2025)
Image Motion Blur Removal in the Temporal Dimension with Video Diffusion Models
par: Pang, Wang, et autres
Publié: (2025)
par: Pang, Wang, et autres
Publié: (2025)
Documents similaires
-
InstantEdit: Text-Guided Few-Step Image Editing with Piecewise Rectified Flow
par: Gong, Yiming, et autres
Publié: (2025) -
SemiETS: Integrating Spatial and Content Consistencies for Semi-Supervised End-to-end Text Spotting
par: Luo, Dongliang, et autres
Publié: (2025) -
UniEdit-I: Training-free Image Editing for Unified VLM via Iterative Understanding, Editing and Verifying
par: Bai, Chengyu, et autres
Publié: (2025) -
TextPecker: Rewarding Structural Anomaly Quantification for Enhancing Visual Text Rendering
par: Zhu, Hanshen, et autres
Publié: (2026) -
Puzzle Pieces Picker: Deciphering Ancient Chinese Characters with Radical Reconstruction
par: Wang, Pengjie, et autres
Publié: (2024)