MC$^2$: Multi-concept Guidance for Customized Multi-concept Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Jiaxiu, Zhang, Yabo, Feng, Kailai, Wu, Xiaohe, Li, Wenbo, Pei, Renjing, Li, Fan, Zuo, Wangmeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LoViC: Efficient Long Video Generation with Context Compression
por: Jiang, Jiaxiu, et al.
Publicado: (2025)
por: Jiang, Jiaxiu, et al.
Publicado: (2025)
MultiDreamer3D: Multi-concept 3D Customization with Concept-Aware Diffusion Guidance
por: Song, Wooseok, et al.
Publicado: (2025)
por: Song, Wooseok, et al.
Publicado: (2025)
UniRestorer: Universal Image Restoration via Adaptively Estimating Image Degradation at Proper Granularity
por: Lin, Jingbo, et al.
Publicado: (2024)
por: Lin, Jingbo, et al.
Publicado: (2024)
VitaGlyph: Vitalizing Artistic Typography with Flexible Dual-branch Diffusion Models
por: Feng, Kailai, et al.
Publicado: (2024)
por: Feng, Kailai, et al.
Publicado: (2024)
ACE: Anti-Editing Concept Erasure in Text-to-Image Models
por: Wang, Zihao, et al.
Publicado: (2025)
por: Wang, Zihao, et al.
Publicado: (2025)
Image Demoiréing Using Dual Camera Fusion on Mobile Phones
por: Mei, Yanting, et al.
Publicado: (2025)
por: Mei, Yanting, et al.
Publicado: (2025)
SelfHVD: Self-Supervised Handheld Video Deblurring
por: Xu, Honglei, et al.
Publicado: (2025)
por: Xu, Honglei, et al.
Publicado: (2025)
LatexBlend: Scaling Multi-concept Customized Generation with Latent Textual Blending
por: Jin, Jian, et al.
Publicado: (2025)
por: Jin, Jian, et al.
Publicado: (2025)
Generative Inbetweening through Frame-wise Conditions-Driven Video Generation
por: Zhu, Tianyi, et al.
Publicado: (2024)
por: Zhu, Tianyi, et al.
Publicado: (2024)
Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention
por: Lu, Hannan, et al.
Publicado: (2024)
por: Lu, Hannan, et al.
Publicado: (2024)
Bridging Geometry-Coherent Text-to-3D Generation with Multi-View Diffusion Priors and Gaussian Splatting
por: Yang, Feng, et al.
Publicado: (2025)
por: Yang, Feng, et al.
Publicado: (2025)
ScrollScape: Unlocking 32K Image Generation With Video Diffusion Priors
por: Yu, Haodong, et al.
Publicado: (2026)
por: Yu, Haodong, et al.
Publicado: (2026)
S2AM3D: Scale-controllable Part Segmentation of 3D Point Clouds
por: Su, Han, et al.
Publicado: (2025)
por: Su, Han, et al.
Publicado: (2025)
Visual-O1: Understanding Ambiguous Instructions via Multi-modal Multi-turn Chain-of-thoughts Reasoning
por: Ni, Minheng, et al.
Publicado: (2024)
por: Ni, Minheng, et al.
Publicado: (2024)
HP-Edit: A Human-Preference Post-Training Framework for Image Editing
por: Li, Fan, et al.
Publicado: (2026)
por: Li, Fan, et al.
Publicado: (2026)
Reblurring-Guided Single Image Defocus Deblurring: A Learning Framework with Misaligned Training Pairs
por: Ren, Dongwei, et al.
Publicado: (2024)
por: Ren, Dongwei, et al.
Publicado: (2024)
SPDiffusion: Semantic Protection Diffusion Models for Multi-concept Text-to-image Generation
por: Zhang, Yang, et al.
Publicado: (2024)
por: Zhang, Yang, et al.
Publicado: (2024)
CREval: An Automated Interpretable Evaluation for Creative Image Manipulation under Complex Instructions
por: Wang, Chonghuinan, et al.
Publicado: (2026)
por: Wang, Chonghuinan, et al.
Publicado: (2026)
OMG: Occlusion-friendly Personalized Multi-concept Generation in Diffusion Models
por: Kong, Zhe, et al.
Publicado: (2024)
por: Kong, Zhe, et al.
Publicado: (2024)
FramePainter: Endowing Interactive Image Editing with Video Diffusion Priors
por: Zhang, Yabo, et al.
Publicado: (2025)
por: Zhang, Yabo, et al.
Publicado: (2025)
Personalized Image Generation with Deep Generative Models: A Decade Survey
por: Wei, Yuxiang, et al.
Publicado: (2025)
por: Wei, Yuxiang, et al.
Publicado: (2025)
Pseudo-Label Guided Real-World Image De-weathering: A Learning Framework with Imperfect Supervision
por: Xu, Heming, et al.
Publicado: (2025)
por: Xu, Heming, et al.
Publicado: (2025)
Unprejudiced Training Auxiliary Tasks Makes Primary Better: A Multi-Task Learning Perspective
por: Li, Yuanze, et al.
Publicado: (2024)
por: Li, Yuanze, et al.
Publicado: (2024)
RefSTAR: Blind Facial Image Restoration with Reference Selection, Transfer, and Reconstruction
por: Yin, Zhicun, et al.
Publicado: (2025)
por: Yin, Zhicun, et al.
Publicado: (2025)
Multi-Timescale Motion-Decoupled Spiking Transformer for Audio-Visual Zero-Shot Learning
por: Li, Wenrui, et al.
Publicado: (2025)
por: Li, Wenrui, et al.
Publicado: (2025)
Tool-R1: Sample-Efficient Reinforcement Learning for Agentic Tool Use
por: Zhang, Yabo, et al.
Publicado: (2025)
por: Zhang, Yabo, et al.
Publicado: (2025)
PMQ-VE: Progressive Multi-Frame Quantization for Video Enhancement
por: Feng, ZhanFeng, et al.
Publicado: (2025)
por: Feng, ZhanFeng, et al.
Publicado: (2025)
FusionTrack: End-to-End Multi-Object Tracking in Arbitrary Multi-View Environment
por: Li, Xiaohe, et al.
Publicado: (2025)
por: Li, Xiaohe, et al.
Publicado: (2025)
Multi-Modality Driven LoRA for Adverse Condition Depth Estimation
por: Yang, Guanglei, et al.
Publicado: (2024)
por: Yang, Guanglei, et al.
Publicado: (2024)
MV-VTON: Multi-View Virtual Try-On with Diffusion Models
por: Wang, Haoyu, et al.
Publicado: (2024)
por: Wang, Haoyu, et al.
Publicado: (2024)
Enhanced Generative Structure Prior for Chinese Text Image Super-resolution
por: Li, Xiaoming, et al.
Publicado: (2025)
por: Li, Xiaoming, et al.
Publicado: (2025)
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
por: Zhang, Yabo, et al.
Publicado: (2024)
por: Zhang, Yabo, et al.
Publicado: (2024)
Mod-Adapter: Tuning-Free and Versatile Multi-concept Personalization via Modulation Adapter
por: Zhong, Weizhi, et al.
Publicado: (2025)
por: Zhong, Weizhi, et al.
Publicado: (2025)
Tuning-Free Image Customization with Image and Text Guidance
por: Li, Pengzhi, et al.
Publicado: (2024)
por: Li, Pengzhi, et al.
Publicado: (2024)
SplatWeaver: Learning to Allocate Gaussian Primitives for Generalizable Novel View Synthesis
por: Wan, Yecong, et al.
Publicado: (2026)
por: Wan, Yecong, et al.
Publicado: (2026)
Multi-concept Model Immunization through Differentiable Model Merging
por: Zheng, Amber Yijia, et al.
Publicado: (2024)
por: Zheng, Amber Yijia, et al.
Publicado: (2024)
Textual Localization: Decomposing Multi-concept Images for Subject-Driven Text-to-Image Generation
por: Shentu, Junjie, et al.
Publicado: (2024)
por: Shentu, Junjie, et al.
Publicado: (2024)
AnimateAnywhere: Rouse the Background in Human Image Animation
por: Liu, Xiaoyu, et al.
Publicado: (2025)
por: Liu, Xiaoyu, et al.
Publicado: (2025)
QR-LoRA: Efficient and Disentangled Fine-tuning via QR Decomposition for Customized Generation
por: Yang, Jiahui, et al.
Publicado: (2025)
por: Yang, Jiahui, et al.
Publicado: (2025)
Lie Flow: Video Dynamic Fields Modeling and Predicting with Lie Algebra as Geometric Physics Principle
por: Qiao, Weidong, et al.
Publicado: (2026)
por: Qiao, Weidong, et al.
Publicado: (2026)
Ejemplares similares
-
LoViC: Efficient Long Video Generation with Context Compression
por: Jiang, Jiaxiu, et al.
Publicado: (2025) -
MultiDreamer3D: Multi-concept 3D Customization with Concept-Aware Diffusion Guidance
por: Song, Wooseok, et al.
Publicado: (2025) -
UniRestorer: Universal Image Restoration via Adaptively Estimating Image Degradation at Proper Granularity
por: Lin, Jingbo, et al.
Publicado: (2024) -
VitaGlyph: Vitalizing Artistic Typography with Flexible Dual-branch Diffusion Models
por: Feng, Kailai, et al.
Publicado: (2024) -
ACE: Anti-Editing Concept Erasure in Text-to-Image Models
por: Wang, Zihao, et al.
Publicado: (2025)