PixelHacker: Image Inpainting with Structural and Semantic Consistency
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Ziyang, Duan, Kangsheng, Shen, Xiaolei, Ding, Zhifeng, Liu, Wenyu, Ruan, Xiaohu, Chen, Xiaoxin, Wang, Xinggang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GaraMoSt: Parallel Multi-Granularity Motion and Structural Modeling for Efficient Multi-Frame Interpolation in DSA Images
par: Xu, Ziyang, et autres
Publié: (2024)
par: Xu, Ziyang, et autres
Publié: (2024)
MoSt-DSA: Modeling Motion and Structural Interactions for Direct Multi-Frame Interpolation in DSA Images
par: Xu, Ziyang, et autres
Publié: (2024)
par: Xu, Ziyang, et autres
Publié: (2024)
GroundingSuite: Measuring Complex Multi-Granular Pixel Grounding
par: Hu, Rui, et autres
Publié: (2025)
par: Hu, Rui, et autres
Publié: (2025)
ControlAR: Controllable Image Generation with Autoregressive Models
par: Li, Zongming, et autres
Publié: (2024)
par: Li, Zongming, et autres
Publié: (2024)
Cross-Layer Attentive Feature Upsampling for Low-latency Semantic Segmentation
par: Cheng, Tianheng, et autres
Publié: (2026)
par: Cheng, Tianheng, et autres
Publié: (2026)
XS-VID: An Extremely Small Video Object Detection Dataset
par: Guo, Jiahao, et autres
Publié: (2024)
par: Guo, Jiahao, et autres
Publié: (2024)
Privacy-Shielded Image Compression: Defending Against Exploitation from Vision-Language Pretrained Models
par: Shen, Xuelin, et autres
Publié: (2025)
par: Shen, Xuelin, et autres
Publié: (2025)
STP4D: Spatio-Temporal-Prompt Consistent Modeling for Text-to-4D Gaussian Splatting
par: Deng, Yunze, et autres
Publié: (2025)
par: Deng, Yunze, et autres
Publié: (2025)
Matte Anything: Interactive Natural Image Matting with Segment Anything Models
par: Yao, Jingfeng, et autres
Publié: (2023)
par: Yao, Jingfeng, et autres
Publié: (2023)
Assessing Image Inpainting via Re-Inpainting Self-Consistency Evaluation
par: Chen, Tianyi, et autres
Publié: (2024)
par: Chen, Tianyi, et autres
Publié: (2024)
MolSight: Optical Chemical Structure Recognition with SMILES Pretraining, Multi-Granularity Learning and Reinforcement Learning
par: Zhang, Wenrui, et autres
Publié: (2025)
par: Zhang, Wenrui, et autres
Publié: (2025)
Genesis: Multimodal Driving Scene Generation with Spatio-Temporal and Cross-Modal Consistency
par: Guo, Xiangyu, et autres
Publié: (2025)
par: Guo, Xiangyu, et autres
Publié: (2025)
Image-Free Timestep Distillation via Continuous-Time Consistency with Trajectory-Sampled Pairs
par: Tang, Bao, et autres
Publié: (2025)
par: Tang, Bao, et autres
Publié: (2025)
Structure Matters: Tackling the Semantic Discrepancy in Diffusion Models for Image Inpainting
par: Liu, Haipeng, et autres
Publié: (2024)
par: Liu, Haipeng, et autres
Publié: (2024)
PersonViT: Large-scale Self-supervised Vision Transformer for Person Re-Identification
par: Hu, Bin, et autres
Publié: (2024)
par: Hu, Bin, et autres
Publié: (2024)
Semantically Consistent Video Inpainting with Conditional Diffusion Models
par: Green, Dylan, et autres
Publié: (2024)
par: Green, Dylan, et autres
Publié: (2024)
Skim then Focus: Integrating Contextual and Fine-grained Views for Repetitive Action Counting
par: Zhao, Zhengqi, et autres
Publié: (2024)
par: Zhao, Zhengqi, et autres
Publié: (2024)
DeltaMIL: Gated Memory Integration for Efficient and Discriminative Whole Slide Image Analysis
par: Zhu, Yueting, et autres
Publié: (2025)
par: Zhu, Yueting, et autres
Publié: (2025)
Ultra High-Resolution Image Inpainting with Patch-Based Content Consistency Adapter
par: Zhang, Jianhui, et autres
Publié: (2025)
par: Zhang, Jianhui, et autres
Publié: (2025)
TransLight: Image-Guided Customized Lighting Control with Generative Decoupling
par: Li, Zongming, et autres
Publié: (2025)
par: Li, Zongming, et autres
Publié: (2025)
MaTVLM: Hybrid Mamba-Transformer for Efficient Vision-Language Modeling
par: Li, Yingyue, et autres
Publié: (2025)
par: Li, Yingyue, et autres
Publié: (2025)
Causality-inspired Discriminative Feature Learning in Triple Domains for Gait Recognition
par: Xiong, Haijun, et autres
Publié: (2024)
par: Xiong, Haijun, et autres
Publié: (2024)
FasterDiT: Towards Faster Diffusion Transformers Training without Architecture Modification
par: Yao, Jingfeng, et autres
Publié: (2024)
par: Yao, Jingfeng, et autres
Publié: (2024)
JoDiffusion: Jointly Diffusing Image with Pixel-Level Annotations for Semantic Segmentation Promotion
par: Wang, Haoyu, et autres
Publié: (2025)
par: Wang, Haoyu, et autres
Publié: (2025)
3D-Consistent Image Inpainting with Diffusion Models
par: Antsfeld, Leonid, et autres
Publié: (2024)
par: Antsfeld, Leonid, et autres
Publié: (2024)
WeakTr: Exploring Plain Vision Transformer for Weakly-supervised Semantic Segmentation
par: Zhu, Lianghui, et autres
Publié: (2023)
par: Zhu, Lianghui, et autres
Publié: (2023)
SAGI: Semantically Aligned and Uncertainty Guided AI Image Inpainting
par: Giakoumoglou, Paschalis, et autres
Publié: (2025)
par: Giakoumoglou, Paschalis, et autres
Publié: (2025)
Perspective-aware 3D Gaussian Inpainting with Multi-view Consistency
par: Cheng, Yuxin, et autres
Publié: (2025)
par: Cheng, Yuxin, et autres
Publié: (2025)
EVF-SAM: Early Vision-Language Fusion for Text-Prompted Segment Anything Model
par: Zhang, Yuxuan, et autres
Publié: (2024)
par: Zhang, Yuxuan, et autres
Publié: (2024)
2D Gaussian Splatting with Semantic Alignment for Image Inpainting
par: Li, Hongyu, et autres
Publié: (2025)
par: Li, Hongyu, et autres
Publié: (2025)
Text Image Inpainting via Global Structure-Guided Diffusion Models
par: Zhu, Shipeng, et autres
Publié: (2024)
par: Zhu, Shipeng, et autres
Publié: (2024)
Structure-aware Semantic Discrepancy and Consistency for 3D Medical Image Self-supervised Learning
par: Pan, Tan, et autres
Publié: (2025)
par: Pan, Tan, et autres
Publié: (2025)
SONIC: Spectral Optimization of Noise for Inpainting with Consistency
par: Baek, Seungyeon, et autres
Publié: (2025)
par: Baek, Seungyeon, et autres
Publié: (2025)
Hierarchical Semantic Compression for Consistent Image Semantic Restoration
par: Li, Shengxi, et autres
Publié: (2025)
par: Li, Shengxi, et autres
Publié: (2025)
Fast Omni-Directional Image Super-Resolution: Adapting the Implicit Image Function with Pixel and Semantic-Wise Spherical Geometric Priors
par: Shen, Xuelin, et autres
Publié: (2025)
par: Shen, Xuelin, et autres
Publié: (2025)
Towards Enhanced Image Inpainting: Mitigating Unwanted Object Insertion and Preserving Color Consistency
par: Wang, Yikai, et autres
Publié: (2023)
par: Wang, Yikai, et autres
Publié: (2023)
From Inpainting to Layer Decomposition: Repurposing Generative Inpainting Models for Image Layer Decomposition
par: Chen, Jingxi, et autres
Publié: (2025)
par: Chen, Jingxi, et autres
Publié: (2025)
TD-Paint: Faster Diffusion Inpainting Through Time Aware Pixel Conditioning
par: Mayet, Tsiry, et autres
Publié: (2024)
par: Mayet, Tsiry, et autres
Publié: (2024)
AlphaDrive: Unleashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning
par: Jiang, Bo, et autres
Publié: (2025)
par: Jiang, Bo, et autres
Publié: (2025)
Bridging Pixels and Words: Mask-Aware Local Semantic Fusion for Multimodal Media Verification
par: Chen, Zizhao, et autres
Publié: (2026)
par: Chen, Zizhao, et autres
Publié: (2026)
Documents similaires
-
GaraMoSt: Parallel Multi-Granularity Motion and Structural Modeling for Efficient Multi-Frame Interpolation in DSA Images
par: Xu, Ziyang, et autres
Publié: (2024) -
MoSt-DSA: Modeling Motion and Structural Interactions for Direct Multi-Frame Interpolation in DSA Images
par: Xu, Ziyang, et autres
Publié: (2024) -
GroundingSuite: Measuring Complex Multi-Granular Pixel Grounding
par: Hu, Rui, et autres
Publié: (2025) -
ControlAR: Controllable Image Generation with Autoregressive Models
par: Li, Zongming, et autres
Publié: (2024) -
Cross-Layer Attentive Feature Upsampling for Low-latency Semantic Segmentation
par: Cheng, Tianheng, et autres
Publié: (2026)