Cobra: Efficient Line Art COlorization with BRoAder References
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhuang, Junhao, Li, Lingen, Ju, Xuan, Zhang, Zhaoyang, Yuan, Chun, Shan, Ying |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ColorFlow: Retrieval-Augmented Image Sequence Colorization
di: Zhuang, Junhao, et al.
Pubblicazione: (2024)
di: Zhuang, Junhao, et al.
Pubblicazione: (2024)
Image Inpainting Models are Effective Tools for Instruction-guided Image Editing
di: Ju, Xuan, et al.
Pubblicazione: (2024)
di: Ju, Xuan, et al.
Pubblicazione: (2024)
BrushEdit: All-In-One Image Inpainting and Editing
di: Li, Yaowei, et al.
Pubblicazione: (2024)
di: Li, Yaowei, et al.
Pubblicazione: (2024)
FlexiAct: Towards Flexible Action Control in Heterogeneous Scenarios
di: Zhang, Shiyi, et al.
Pubblicazione: (2025)
di: Zhang, Shiyi, et al.
Pubblicazione: (2025)
TextureDiffusion: Target Prompt Disentangled Editing for Various Texture Transfer
di: Su, Zihan, et al.
Pubblicazione: (2024)
di: Su, Zihan, et al.
Pubblicazione: (2024)
Cobra: Extending Mamba to Multi-Modal Large Language Model for Efficient Inference
di: Zhao, Han, et al.
Pubblicazione: (2024)
di: Zhao, Han, et al.
Pubblicazione: (2024)
BRo-JEPA: Learning Modular Arithmetic in Latent Space
di: Jha, Divyansh, et al.
Pubblicazione: (2026)
di: Jha, Divyansh, et al.
Pubblicazione: (2026)
CubeComposer: Spatio-Temporal Autoregressive 4K 360° Video Generation from Perspective Video
di: Li, Lingen, et al.
Pubblicazione: (2026)
di: Li, Lingen, et al.
Pubblicazione: (2026)
MangaNinja: Line Art Colorization with Precise Reference Following
di: Liu, Zhiheng, et al.
Pubblicazione: (2025)
di: Liu, Zhiheng, et al.
Pubblicazione: (2025)
NVComposer: Boosting Generative Novel View Synthesis with Multiple Sparse and Unposed Images
di: Li, Lingen, et al.
Pubblicazione: (2024)
di: Li, Lingen, et al.
Pubblicazione: (2024)
MiraData: A Large-Scale Video Dataset with Long Durations and Structured Captions
di: Ju, Xuan, et al.
Pubblicazione: (2024)
di: Ju, Xuan, et al.
Pubblicazione: (2024)
ToonComposer: Streamlining Cartoon Production with Generative Post-Keyframing
di: Li, Lingen, et al.
Pubblicazione: (2025)
di: Li, Lingen, et al.
Pubblicazione: (2025)
GenCompositor: Generative Video Compositing with Diffusion Transformer
di: Yang, Shuzhou, et al.
Pubblicazione: (2025)
di: Yang, Shuzhou, et al.
Pubblicazione: (2025)
BlobCtrl: Taming Controllable Blob for Element-level Image Editing
di: Li, Yaowei, et al.
Pubblicazione: (2025)
di: Li, Yaowei, et al.
Pubblicazione: (2025)
A Task is Worth One Word: Learning with Task Prompts for High-Quality Versatile Image Inpainting
di: Zhuang, Junhao, et al.
Pubblicazione: (2023)
di: Zhuang, Junhao, et al.
Pubblicazione: (2023)
MangaDiT: Reference-Guided Line Art Colorization with Hierarchical Attention in Diffusion Transformers
di: Qiu, Qianru, et al.
Pubblicazione: (2025)
di: Qiu, Qianru, et al.
Pubblicazione: (2025)
VideoPainter: Any-length Video Inpainting and Editing with Plug-and-Play Context Control
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
IC-Custom: Diverse Image Customization via In-Context Learning
di: Li, Yaowei, et al.
Pubblicazione: (2025)
di: Li, Yaowei, et al.
Pubblicazione: (2025)
FlashVSR: Towards Real-Time Diffusion-Based Streaming Video Super-Resolution
di: Zhuang, Junhao, et al.
Pubblicazione: (2025)
di: Zhuang, Junhao, et al.
Pubblicazione: (2025)
FastVideoEdit: Leveraging Consistency Models for Efficient Text-to-Video Editing
di: Zhang, Youyuan, et al.
Pubblicazione: (2024)
di: Zhang, Youyuan, et al.
Pubblicazione: (2024)
Consistent Human Image and Video Generation with Spatially Conditioned Diffusion
di: Cao, Mingdeng, et al.
Pubblicazione: (2024)
di: Cao, Mingdeng, et al.
Pubblicazione: (2024)
BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion
di: Ju, Xuan, et al.
Pubblicazione: (2024)
di: Ju, Xuan, et al.
Pubblicazione: (2024)
ReVideo: Remake a Video with Motion and Content Control
di: Mou, Chong, et al.
Pubblicazione: (2024)
di: Mou, Chong, et al.
Pubblicazione: (2024)
Region-Wise Correspondence Prediction between Manga Line Art Images
di: Li, Yingxuan, et al.
Pubblicazione: (2025)
di: Li, Yingxuan, et al.
Pubblicazione: (2025)
MotionCraft: Crafting Whole-Body Motion with Plug-and-Play Multimodal Controls
di: Bian, Yuxuan, et al.
Pubblicazione: (2024)
di: Bian, Yuxuan, et al.
Pubblicazione: (2024)
Bidirectional Regression for Monocular 6DoF Head Pose Estimation and Reference System Alignment
di: Chun, Sungho, et al.
Pubblicazione: (2024)
di: Chun, Sungho, et al.
Pubblicazione: (2024)
Referring to Any Person
di: Jiang, Qing, et al.
Pubblicazione: (2025)
di: Jiang, Qing, et al.
Pubblicazione: (2025)
Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning
di: Jiang, Qing, et al.
Pubblicazione: (2025)
di: Jiang, Qing, et al.
Pubblicazione: (2025)
AnimeGamer: Infinite Anime Life Simulation with Next Game State Prediction
di: Cheng, Junhao, et al.
Pubblicazione: (2025)
di: Cheng, Junhao, et al.
Pubblicazione: (2025)
AnimeShooter: A Multi-Shot Animation Dataset for Reference-Guided Video Generation
di: Qiu, Lu, et al.
Pubblicazione: (2025)
di: Qiu, Lu, et al.
Pubblicazione: (2025)
Safe-Sora: Safe Text-to-Video Generation via Graphical Watermarking
di: Su, Zihan, et al.
Pubblicazione: (2025)
di: Su, Zihan, et al.
Pubblicazione: (2025)
Densely Connected Parameter-Efficient Tuning for Referring Image Segmentation
di: Huang, Jiaqi, et al.
Pubblicazione: (2025)
di: Huang, Jiaqi, et al.
Pubblicazione: (2025)
Goal Conditioned Reinforcement Learning for Photo Finishing Tuning
di: Wu, Jiarui, et al.
Pubblicazione: (2025)
di: Wu, Jiarui, et al.
Pubblicazione: (2025)
Video-Holmes: Can MLLM Think Like Holmes for Complex Video Reasoning?
di: Cheng, Junhao, et al.
Pubblicazione: (2025)
di: Cheng, Junhao, et al.
Pubblicazione: (2025)
VRP-SAM: SAM with Visual Reference Prompt
di: Sun, Yanpeng, et al.
Pubblicazione: (2024)
di: Sun, Yanpeng, et al.
Pubblicazione: (2024)
FullLoRA: Efficiently Boosting the Robustness of Pretrained Vision Transformers
di: Yuan, Zheng, et al.
Pubblicazione: (2024)
di: Yuan, Zheng, et al.
Pubblicazione: (2024)
Localization and Expansion: A Decoupled Framework for Point Cloud Few-shot Semantic Segmentation
di: Li, Zhaoyang, et al.
Pubblicazione: (2024)
di: Li, Zhaoyang, et al.
Pubblicazione: (2024)
PixelRefer: A Unified Framework for Spatio-Temporal Object Referring with Arbitrary Granularity
di: Yuan, Yuqian, et al.
Pubblicazione: (2025)
di: Yuan, Yuqian, et al.
Pubblicazione: (2025)
LineArt: A Knowledge-guided Training-free High-quality Appearance Transfer for Design Drawing with Diffusion Model
di: Wang, Xi, et al.
Pubblicazione: (2024)
di: Wang, Xi, et al.
Pubblicazione: (2024)
Referring Remote Sensing Image Segmentation via Bidirectional Alignment Guided Joint Prediction
di: Zhang, Tianxiang, et al.
Pubblicazione: (2025)
di: Zhang, Tianxiang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ColorFlow: Retrieval-Augmented Image Sequence Colorization
di: Zhuang, Junhao, et al.
Pubblicazione: (2024) -
Image Inpainting Models are Effective Tools for Instruction-guided Image Editing
di: Ju, Xuan, et al.
Pubblicazione: (2024) -
BrushEdit: All-In-One Image Inpainting and Editing
di: Li, Yaowei, et al.
Pubblicazione: (2024) -
FlexiAct: Towards Flexible Action Control in Heterogeneous Scenarios
di: Zhang, Shiyi, et al.
Pubblicazione: (2025) -
TextureDiffusion: Target Prompt Disentangled Editing for Various Texture Transfer
di: Su, Zihan, et al.
Pubblicazione: (2024)