CareCom: Generative Image Composition with Calibrated Reference Features
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Jiaxuan, Zhang, Bo, He, Qingdong, Peng, Jinlong, Niu, Li |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MureObjectStitch: Multi-reference Image Composition
by: Chen, Jiaxuan, et al.
Published: (2024)
by: Chen, Jiaxuan, et al.
Published: (2024)
DreamCom: Finetuning Text-guided Inpainting Model for Image Composition
by: Lu, Lingxiao, et al.
Published: (2023)
by: Lu, Lingxiao, et al.
Published: (2023)
Reflection Generation for Composite Image Using Diffusion Model
by: Zhao, Haonan, et al.
Published: (2026)
by: Zhao, Haonan, et al.
Published: (2026)
PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
by: He, Qingdong, et al.
Published: (2024)
by: He, Qingdong, et al.
Published: (2024)
SCL: Towards Domain Generalization via Single-Temporal Multimodal Contrastive Learning for Remote Sensing Change Detection
by: Du, Qiangang, et al.
Published: (2024)
by: Du, Qiangang, et al.
Published: (2024)
Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation
by: Chen, Yuheng, et al.
Published: (2026)
by: Chen, Yuheng, et al.
Published: (2026)
TokenAR: Multiple Subject Generation via Autoregressive Token-level enhancement
by: Sun, Haiyue, et al.
Published: (2025)
by: Sun, Haiyue, et al.
Published: (2025)
PointRWKV: Efficient RWKV-Like Model for Hierarchical Point Cloud Learning
by: He, Qingdong, et al.
Published: (2024)
by: He, Qingdong, et al.
Published: (2024)
PixelPonder: Dynamic Patch Adaptation for Enhanced Multi-Conditional Text-to-Image Generation
by: Pan, Yanjie, et al.
Published: (2025)
by: Pan, Yanjie, et al.
Published: (2025)
DynamicControl: Adaptive Condition Selection for Improved Text-to-Image Generation
by: He, Qingdong, et al.
Published: (2024)
by: He, Qingdong, et al.
Published: (2024)
MM-Tracker: Motion Mamba with Margin Loss for UAV-platform Multiple Object Tracking
by: Yao, Mufeng, et al.
Published: (2024)
by: Yao, Mufeng, et al.
Published: (2024)
Dual-Interrelated Diffusion Model for Few-Shot Anomaly Image Generation
by: Jin, Ying, et al.
Published: (2024)
by: Jin, Ying, et al.
Published: (2024)
A Single Simple Patch is All You Need for AI-generated Image Detection
by: Chen, Jiaxuan, et al.
Published: (2024)
by: Chen, Jiaxuan, et al.
Published: (2024)
Mamba-YOLO-World: Marrying YOLO-World with Mamba for Open-Vocabulary Detection
by: Wang, Haoxuan, et al.
Published: (2024)
by: Wang, Haoxuan, et al.
Published: (2024)
UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation
by: He, Qingdong, et al.
Published: (2024)
by: He, Qingdong, et al.
Published: (2024)
Shadow Generation for Composite Image Using Diffusion model
by: Liu, Qingyang, et al.
Published: (2024)
by: Liu, Qingyang, et al.
Published: (2024)
Calibration & Reconstruction: Deep Integrated Language for Referring Image Segmentation
by: Yan, Yichen, et al.
Published: (2024)
by: Yan, Yichen, et al.
Published: (2024)
AdapNet: Adaptive Noise-Based Network for Low-Quality Image Retrieval
by: Zhang, Sihe, et al.
Published: (2024)
by: Zhang, Sihe, et al.
Published: (2024)
Once Is Enough: Lightweight DiT-Based Video Virtual Try-On via One-Time Garment Appearance Injection
by: Pan, Yanjie, et al.
Published: (2025)
by: Pan, Yanjie, et al.
Published: (2025)
Towards Generalized Multi-Image Editing for Unified Multimodal Models
by: Xu, Pengcheng, et al.
Published: (2026)
by: Xu, Pengcheng, et al.
Published: (2026)
RefDrop: Controllable Consistency in Image or Video Generation via Reference Feature Guidance
by: Fan, Jiaojiao, et al.
Published: (2024)
by: Fan, Jiaojiao, et al.
Published: (2024)
ComCLIP: Training-Free Compositional Image and Text Matching
by: Jiang, Kenan, et al.
Published: (2022)
by: Jiang, Kenan, et al.
Published: (2022)
Fuse & Calibrate: A bi-directional Vision-Language Guided Framework for Referring Image Segmentation
by: Yan, Yichen, et al.
Published: (2024)
by: Yan, Yichen, et al.
Published: (2024)
Griffin: Generative Reference and Layout Guided Image Composition
by: Mikaeili, Aryan, et al.
Published: (2025)
by: Mikaeili, Aryan, et al.
Published: (2025)
Making Images Real Again: A Comprehensive Survey on Deep Image Composition
by: Niu, Li, et al.
Published: (2021)
by: Niu, Li, et al.
Published: (2021)
Leveraging Fine-Grained Information and Noise Decoupling for Remote Sensing Change Detection
by: Du, Qiangang, et al.
Published: (2024)
by: Du, Qiangang, et al.
Published: (2024)
Bridge Feature Matching and Cross-Modal Alignment with Mutual-filtering for Zero-shot Anomaly Detection
by: Bai, Yuhu, et al.
Published: (2025)
by: Bai, Yuhu, et al.
Published: (2025)
CausalCLIP: Causally-Informed Feature Disentanglement and Filtering for Generalizable Detection of Generated Images
by: Liu, Bo, et al.
Published: (2025)
by: Liu, Bo, et al.
Published: (2025)
ComFusion: Personalized Subject Generation in Multiple Specific Scenes From Single Image
by: Hong, Yan, et al.
Published: (2024)
by: Hong, Yan, et al.
Published: (2024)
Combating Pattern and Content Bias: Adversarial Feature Learning for Generalized AI-Generated Image Detection
by: Zhang, Haifeng, et al.
Published: (2026)
by: Zhang, Haifeng, et al.
Published: (2026)
FitDiT: Advancing the Authentic Garment Details for High-fidelity Virtual Try-on
by: Jiang, Boyuan, et al.
Published: (2024)
by: Jiang, Boyuan, et al.
Published: (2024)
OSInsert: Towards High-authenticity and High-fidelity Image Composition
by: Wang, Jingyuan, et al.
Published: (2026)
by: Wang, Jingyuan, et al.
Published: (2026)
Feature Point Extraction for Extra-Affine Image
by: Wang, Tao, et al.
Published: (2025)
by: Wang, Tao, et al.
Published: (2025)
ComSim: Building Scalable Real-World Robot Data Generation via Compositional Simulation
by: Qin, Yiran, et al.
Published: (2026)
by: Qin, Yiran, et al.
Published: (2026)
Compositional Feature Augmentation for Unbiased Scene Graph Generation
by: Li, Lin, et al.
Published: (2023)
by: Li, Lin, et al.
Published: (2023)
CLEAR: Context-Aware Learning with End-to-End Mask-Free Inference for Adaptive Video Subtitle Removal
by: He, Qingdong, et al.
Published: (2026)
by: He, Qingdong, et al.
Published: (2026)
DiffCalib: Reformulating Monocular Camera Calibration as Diffusion-Based Dense Incident Map Generation
by: He, Xiankang, et al.
Published: (2024)
by: He, Xiankang, et al.
Published: (2024)
AIComposer: Any Style and Content Image Composition via Feature Integration
by: Li, Haowen, et al.
Published: (2025)
by: Li, Haowen, et al.
Published: (2025)
Identity-aware Feature Decoupling Learning for Clothing-change Person Re-identification
by: Xu, Haoxuan, et al.
Published: (2025)
by: Xu, Haoxuan, et al.
Published: (2025)
Detecting AI-Generated Images via Distributional Deviations from Real Images
by: Niu, Yakun, et al.
Published: (2026)
by: Niu, Yakun, et al.
Published: (2026)
Similar Items
-
MureObjectStitch: Multi-reference Image Composition
by: Chen, Jiaxuan, et al.
Published: (2024) -
DreamCom: Finetuning Text-guided Inpainting Model for Image Composition
by: Lu, Lingxiao, et al.
Published: (2023) -
Reflection Generation for Composite Image Using Diffusion Model
by: Zhao, Haonan, et al.
Published: (2026) -
PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
by: He, Qingdong, et al.
Published: (2024) -
SCL: Towards Domain Generalization via Single-Temporal Multimodal Contrastive Learning for Remote Sensing Change Detection
by: Du, Qiangang, et al.
Published: (2024)