Automatic Controllable Colorization via Imagination
Fuente:
arXiv
Saved in:
| Main Authors: | Cong, Xiaoyan, Wu, Yue, Chen, Qifeng, Lei, Chenyang |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MagicStick: Controllable Video Editing via Control Handle Transformations
by: Ma, Yue, et al.
Published: (2023)
by: Ma, Yue, et al.
Published: (2023)
Follow-Your-Color: Multi-Instance Sketch Colorization
by: Zhang, Yinhan, et al.
Published: (2025)
by: Zhang, Yinhan, et al.
Published: (2025)
Robust Depth Enhancement via Polarization Prompt Fusion Tuning
by: Ikemura, Kei, et al.
Published: (2024)
by: Ikemura, Kei, et al.
Published: (2024)
ControlCol: Controllability in Automatic Speaker Video Colorization
by: Ward, Rory, et al.
Published: (2024)
by: Ward, Rory, et al.
Published: (2024)
SimCMF: A Simple Cross-modal Fine-tuning Strategy from Vision Foundation Models to Any Imaging Modality
by: Lei, Chenyang, et al.
Published: (2024)
by: Lei, Chenyang, et al.
Published: (2024)
Adaptive Domain Learning for Cross-domain Image Denoising
by: Qian, Zian, et al.
Published: (2024)
by: Qian, Zian, et al.
Published: (2024)
DiT4Edit: Diffusion Transformer for Image Editing
by: Feng, Kunyu, et al.
Published: (2024)
by: Feng, Kunyu, et al.
Published: (2024)
InstanceAnimator: Multi-Instance Sketch Video Colorization
by: Zhang, Yinhan, et al.
Published: (2026)
by: Zhang, Yinhan, et al.
Published: (2026)
SimMAT: Exploring Transferability from Vision Foundation Models to Any Image Modality
by: Lei, Chenyang, et al.
Published: (2024)
by: Lei, Chenyang, et al.
Published: (2024)
Art3D: Training-Free 3D Generation from Flat-Colored Illustration
by: Cong, Xiaoyan, et al.
Published: (2025)
by: Cong, Xiaoyan, et al.
Published: (2025)
SpatialImaginer: Towards Adaptive Visual Imagination for Spatial Reasoning
by: Li, Yian, et al.
Published: (2026)
by: Li, Yian, et al.
Published: (2026)
Follow-Your-Motion: Video Motion Transfer via Efficient Spatial-Temporal Decoupled Finetuning
by: Ma, Yue, et al.
Published: (2025)
by: Ma, Yue, et al.
Published: (2025)
Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control
by: Long, Zeqian, et al.
Published: (2025)
by: Long, Zeqian, et al.
Published: (2025)
Instruction-based Image Editing with Planning, Reasoning, and Generation
by: Ji, Liya, et al.
Published: (2026)
by: Ji, Liya, et al.
Published: (2026)
Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts
by: Ma, Yue, et al.
Published: (2024)
by: Ma, Yue, et al.
Published: (2024)
MineDreamer: Learning to Follow Instructions via Chain-of-Imagination for Simulated-World Control
by: Zhou, Enshen, et al.
Published: (2024)
by: Zhou, Enshen, et al.
Published: (2024)
SPIRE: Semantic Prompt-Driven Image Restoration
by: Qi, Chenyang, et al.
Published: (2023)
by: Qi, Chenyang, et al.
Published: (2023)
TALE: Training-free Cross-domain Image Composition via Adaptive Latent Manipulation and Energy-guided Optimization
by: Pham, Kien T., et al.
Published: (2024)
by: Pham, Kien T., et al.
Published: (2024)
Color3D: Controllable and Consistent 3D Colorization with Personalized Colorizer
by: Wan, Yecong, et al.
Published: (2025)
by: Wan, Yecong, et al.
Published: (2025)
What if Agents Could Imagine? Reinforcing Open-Vocabulary HOI Comprehension through Generation
by: Yuan, Zhenlong, et al.
Published: (2026)
by: Yuan, Zhenlong, et al.
Published: (2026)
InstantSwap: Fast Customized Concept Swapping across Sharp Shape Differences
by: Zhu, Chenyang, et al.
Published: (2024)
by: Zhu, Chenyang, et al.
Published: (2024)
GenHSI: Controllable Generation of Human-Scene Interaction Videos
by: Li, Zekun, et al.
Published: (2025)
by: Li, Zekun, et al.
Published: (2025)
ReImagine: Rethinking Controllable High-Quality Human Video Generation via Image-First Synthesis
by: Sun, Zhengwentai, et al.
Published: (2026)
by: Sun, Zhengwentai, et al.
Published: (2026)
Controllable-Continuous Color Editing in Diffusion Model via Color Mapping
by: Yang, Yuqi, et al.
Published: (2025)
by: Yang, Yuqi, et al.
Published: (2025)
Imagine and Seek: Improving Composed Image Retrieval with an Imagined Proxy
by: Li, You, et al.
Published: (2024)
by: Li, You, et al.
Published: (2024)
Point Cloud Color Constancy
by: Xing, Xiaoyan, et al.
Published: (2021)
by: Xing, Xiaoyan, et al.
Published: (2021)
Multimodal Semantic-Aware Automatic Colorization with Diffusion Prior
by: Wang, Han, et al.
Published: (2024)
by: Wang, Han, et al.
Published: (2024)
Underwater Organism Color Enhancement via Color Code Decomposition, Adaptation and Interpolation
by: Cong, Xiaofeng, et al.
Published: (2024)
by: Cong, Xiaofeng, et al.
Published: (2024)
MangaNinja: Line Art Colorization with Precise Reference Following
by: Liu, Zhiheng, et al.
Published: (2025)
by: Liu, Zhiheng, et al.
Published: (2025)
EEdit: Rethinking the Spatial and Temporal Redundancy for Efficient Image Editing
by: Yan, Zexuan, et al.
Published: (2025)
by: Yan, Zexuan, et al.
Published: (2025)
Learning Object Permanence from Videos via Latent Imaginations
by: Traub, Manuel, et al.
Published: (2023)
by: Traub, Manuel, et al.
Published: (2023)
Control Color: Multimodal Diffusion-based Interactive Image Colorization
by: Liang, Zhexin, et al.
Published: (2024)
by: Liang, Zhexin, et al.
Published: (2024)
UniPaint: Unified Space-time Video Inpainting via Mixture-of-Experts
by: Wan, Zhen, et al.
Published: (2024)
by: Wan, Zhen, et al.
Published: (2024)
SpiralDiff: Spiral Diffusion with LoRA for RGB-to-RAW Conversion Across Cameras
by: Yue, Huanjing, et al.
Published: (2026)
by: Yue, Huanjing, et al.
Published: (2026)
Imagine the Unseen: Occluded Pedestrian Detection via Adversarial Feature Completion
by: Zhang, Shanshan, et al.
Published: (2024)
by: Zhang, Shanshan, et al.
Published: (2024)
A High-Performance Thermal Infrared Object Detection Framework with Centralized Regulation
by: Li, Jinke, et al.
Published: (2025)
by: Li, Jinke, et al.
Published: (2025)
A Cross-Font Image Retrieval Network for Recognizing Undeciphered Oracle Bone Inscriptions
by: Wu, Zhicong, et al.
Published: (2024)
by: Wu, Zhicong, et al.
Published: (2024)
Bridging Your Imagination with Audio-Video Generation via a Unified Director
by: Zhang, Jiaxu, et al.
Published: (2025)
by: Zhang, Jiaxu, et al.
Published: (2025)
TimeColor: Flexible Reference Colorization via Temporal Concatenation
by: Sadihin, Bryan Constantine, et al.
Published: (2026)
by: Sadihin, Bryan Constantine, et al.
Published: (2026)
AnimationBench: Are Video Models Good at Character-Centric Animation?
by: Wu, Leyi, et al.
Published: (2026)
by: Wu, Leyi, et al.
Published: (2026)
Similar Items
-
MagicStick: Controllable Video Editing via Control Handle Transformations
by: Ma, Yue, et al.
Published: (2023) -
Follow-Your-Color: Multi-Instance Sketch Colorization
by: Zhang, Yinhan, et al.
Published: (2025) -
Robust Depth Enhancement via Polarization Prompt Fusion Tuning
by: Ikemura, Kei, et al.
Published: (2024) -
ControlCol: Controllability in Automatic Speaker Video Colorization
by: Ward, Rory, et al.
Published: (2024) -
SimCMF: A Simple Cross-modal Fine-tuning Strategy from Vision Foundation Models to Any Imaging Modality
by: Lei, Chenyang, et al.
Published: (2024)