Control Color: Multimodal Diffusion-based Interactive Image Colorization
Fuente:
arXiv
Guardado en:
| Autores principales: | Liang, Zhexin, Li, Zhaochen, Zhou, Shangchen, Li, Chongyi, Loy, Chen Change |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Learning Inclusion Matching for Animation Paint Bucket Colorization
por: Dai, Yuekun, et al.
Publicado: (2024)
por: Dai, Yuekun, et al.
Publicado: (2024)
Paint Bucket Colorization Using Anime Character Color Design Sheets
por: Dai, Yuekun, et al.
Publicado: (2024)
por: Dai, Yuekun, et al.
Publicado: (2024)
Trans-Adapter: A Plug-and-Play Framework for Transparent Image Inpainting
por: Dai, Yuekun, et al.
Publicado: (2025)
por: Dai, Yuekun, et al.
Publicado: (2025)
ObjCtrl-2.5D: Training-free Object Control with Camera Poses
por: Wang, Zhouxia, et al.
Publicado: (2024)
por: Wang, Zhouxia, et al.
Publicado: (2024)
Kalman-Inspired Feature Propagation for Video Face Super-Resolution
por: Feng, Ruicheng, et al.
Publicado: (2024)
por: Feng, Ruicheng, et al.
Publicado: (2024)
Exploiting Diffusion Prior for Real-World Image Super-Resolution
por: Wang, Jianyi, et al.
Publicado: (2023)
por: Wang, Jianyi, et al.
Publicado: (2023)
3DEnhancer: Consistent Multi-View Diffusion for 3D Enhancement
por: Luo, Yihang, et al.
Publicado: (2024)
por: Luo, Yihang, et al.
Publicado: (2024)
4RC: 4D Reconstruction via Conditional Querying Anytime and Anywhere
por: Luo, Yihang, et al.
Publicado: (2026)
por: Luo, Yihang, et al.
Publicado: (2026)
MatAnyone: Stable Video Matting with Consistent Memory Propagation
por: Yang, Peiqing, et al.
Publicado: (2025)
por: Yang, Peiqing, et al.
Publicado: (2025)
AITTI: Learning Adaptive Inclusive Token for Text-to-Image Generation
por: Hou, Xinyu, et al.
Publicado: (2024)
por: Hou, Xinyu, et al.
Publicado: (2024)
Enhanced Generative Structure Prior for Chinese Text Image Super-resolution
por: Li, Xiaoming, et al.
Publicado: (2025)
por: Li, Xiaoming, et al.
Publicado: (2025)
Efficient Diffusion Model for Image Restoration by Residual Shifting
por: Yue, Zongsheng, et al.
Publicado: (2024)
por: Yue, Zongsheng, et al.
Publicado: (2024)
Towards Language-Driven Video Inpainting via Multimodal Large Language Models
por: Wu, Jianzong, et al.
Publicado: (2024)
por: Wu, Jianzong, et al.
Publicado: (2024)
MVIP-NeRF: Multi-view 3D Inpainting on NeRF Scenes via Diffusion Prior
por: Chen, Honghua, et al.
Publicado: (2024)
por: Chen, Honghua, et al.
Publicado: (2024)
Omegance: A Single Parameter for Various Granularities in Diffusion-Based Synthesis
por: Hou, Xinyu, et al.
Publicado: (2024)
por: Hou, Xinyu, et al.
Publicado: (2024)
DifFace: Blind Face Restoration with Diffused Error Contraction
por: Yue, Zongsheng, et al.
Publicado: (2022)
por: Yue, Zongsheng, et al.
Publicado: (2022)
Open-Vocabulary SAM: Segment and Recognize Twenty-thousand Classes Interactively
por: Yuan, Haobo, et al.
Publicado: (2024)
por: Yuan, Haobo, et al.
Publicado: (2024)
Arbitrary-steps Image Super-resolution via Diffusion Inversion
por: Yue, Zongsheng, et al.
Publicado: (2024)
por: Yue, Zongsheng, et al.
Publicado: (2024)
Generalizable Implicit Motion Modeling for Video Frame Interpolation
por: Guo, Zujin, et al.
Publicado: (2024)
por: Guo, Zujin, et al.
Publicado: (2024)
LN3DIFF++: Scalable Latent Neural Fields Diffusion for Speedy 3D Generation
por: Lan, Yushi, et al.
Publicado: (2024)
por: Lan, Yushi, et al.
Publicado: (2024)
EdgeSAM: Prompt-In-the-Loop Distillation for SAM
por: Zhou, Chong, et al.
Publicado: (2023)
por: Zhou, Chong, et al.
Publicado: (2023)
Contextual Object Detection with Multimodal Large Language Models
por: Zang, Yuhang, et al.
Publicado: (2023)
por: Zang, Yuhang, et al.
Publicado: (2023)
GaussianAnything: Interactive Point Cloud Flow Matching For 3D Object Generation
por: Lan, Yushi, et al.
Publicado: (2024)
por: Lan, Yushi, et al.
Publicado: (2024)
Controllable Human-centric Keyframe Interpolation with Generative Prior
por: Guo, Zujin, et al.
Publicado: (2025)
por: Guo, Zujin, et al.
Publicado: (2025)
MOWA: Multiple-in-One Image Warping Model
por: Liao, Kang, et al.
Publicado: (2024)
por: Liao, Kang, et al.
Publicado: (2024)
Bokeh Diffusion: Defocus Blur Control in Text-to-Image Diffusion Models
por: Fortes, Armando, et al.
Publicado: (2025)
por: Fortes, Armando, et al.
Publicado: (2025)
Denoising as Adaptation: Noise-Space Domain Adaptation for Image Restoration
por: Liao, Kang, et al.
Publicado: (2024)
por: Liao, Kang, et al.
Publicado: (2024)
Half-Physics: Enabling Kinematic 3D Human Model with Physical Interactions
por: Siyao, Li, et al.
Publicado: (2025)
por: Siyao, Li, et al.
Publicado: (2025)
FRESCO: Spatial-Temporal Correspondence for Zero-Shot Video Translation
por: Yang, Shuai, et al.
Publicado: (2024)
por: Yang, Shuai, et al.
Publicado: (2024)
ColorizeDiffusion: Adjustable Sketch Colorization with Reference Image and Text
por: Yan, Dingkun, et al.
Publicado: (2024)
por: Yan, Dingkun, et al.
Publicado: (2024)
F-LMM: Grounding Frozen Large Multimodal Models
por: Wu, Size, et al.
Publicado: (2024)
por: Wu, Size, et al.
Publicado: (2024)
Learning 3D Garment Animation from Trajectories of A Piece of Cloth
por: Shao, Yidi, et al.
Publicado: (2025)
por: Shao, Yidi, et al.
Publicado: (2025)
STream3R: Scalable Sequential 3D Reconstruction with Causal Transformer
por: Lan, Yushi, et al.
Publicado: (2025)
por: Lan, Yushi, et al.
Publicado: (2025)
GroupDiff: Diffusion-based Group Portrait Editing
por: Jiang, Yuming, et al.
Publicado: (2024)
por: Jiang, Yuming, et al.
Publicado: (2024)
SeedVR2: One-Step Video Restoration via Diffusion Adversarial Post-Training
por: Wang, Jianyi, et al.
Publicado: (2025)
por: Wang, Jianyi, et al.
Publicado: (2025)
DoF-Gaussian: Controllable Depth-of-Field for 3D Gaussian Splatting
por: Shen, Liao, et al.
Publicado: (2025)
por: Shen, Liao, et al.
Publicado: (2025)
OpenUni: A Simple Baseline for Unified Multimodal Understanding and Generation
por: Wu, Size, et al.
Publicado: (2025)
por: Wu, Size, et al.
Publicado: (2025)
AnimeColor: Reference-based Animation Colorization with Diffusion Transformers
por: Zhang, Yuhong, et al.
Publicado: (2025)
por: Zhang, Yuhong, et al.
Publicado: (2025)
LA-Sign: Looped Transformers with Geometry-aware Alignment for Skeleton-based Sign Language Recognition
por: Pu, Muxin, et al.
Publicado: (2026)
por: Pu, Muxin, et al.
Publicado: (2026)
Multimodal Semantic-Aware Automatic Colorization with Diffusion Prior
por: Wang, Han, et al.
Publicado: (2024)
por: Wang, Han, et al.
Publicado: (2024)
Ejemplares similares
-
Learning Inclusion Matching for Animation Paint Bucket Colorization
por: Dai, Yuekun, et al.
Publicado: (2024) -
Paint Bucket Colorization Using Anime Character Color Design Sheets
por: Dai, Yuekun, et al.
Publicado: (2024) -
Trans-Adapter: A Plug-and-Play Framework for Transparent Image Inpainting
por: Dai, Yuekun, et al.
Publicado: (2025) -
ObjCtrl-2.5D: Training-free Object Control with Camera Poses
por: Wang, Zhouxia, et al.
Publicado: (2024) -
Kalman-Inspired Feature Propagation for Video Face Super-Resolution
por: Feng, Ruicheng, et al.
Publicado: (2024)