Diffutoon: High-Resolution Editable Toon Shading via Diffusion Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Duan, Zhongjie, Wang, Chengyu, Chen, Cen, Qian, Weining, Huang, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ExVideo: Extending Video Diffusion Models via Parameter-Efficient Post-Tuning
por: Duan, Zhongjie, et al.
Publicado: (2024)
por: Duan, Zhongjie, et al.
Publicado: (2024)
DeferredGS: Decoupled and Editable Gaussian Splatting with Deferred Shading
por: Wu, Tong, et al.
Publicado: (2024)
por: Wu, Tong, et al.
Publicado: (2024)
VIRAL: Visual In-Context Reasoning via Analogy in Diffusion Transformers
por: Li, Zhiwen, et al.
Publicado: (2026)
por: Li, Zhiwen, et al.
Publicado: (2026)
AttriCtrl: Fine-Grained Control of Aesthetic Attribute Intensity in Diffusion Models
por: Chen, Die, et al.
Publicado: (2025)
por: Chen, Die, et al.
Publicado: (2025)
ToonCrafter: Generative Cartoon Interpolation
por: Xing, Jinbo, et al.
Publicado: (2024)
por: Xing, Jinbo, et al.
Publicado: (2024)
Tuning-Free Image Editing with Fidelity and Editability via Unified Latent Diffusion Model
por: Mao, Qi, et al.
Publicado: (2025)
por: Mao, Qi, et al.
Publicado: (2025)
Watermarking in Diffusion Model: Gaussian Shading with Exact Diffusion Inversion via Coupled Transformations (EDICT)
por: Panthi, Krishna
Publicado: (2025)
por: Panthi, Krishna
Publicado: (2025)
AutoLoRA: Automatic LoRA Retrieval and Fine-Grained Gated Fusion for Text-to-Image Generation
por: Li, Zhiwen, et al.
Publicado: (2025)
por: Li, Zhiwen, et al.
Publicado: (2025)
Toon3D: Seeing Cartoons from New Perspectives
por: Weber, Ethan, et al.
Publicado: (2024)
por: Weber, Ethan, et al.
Publicado: (2024)
EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model
por: Zhang, Bingyuan, et al.
Publicado: (2024)
por: Zhang, Bingyuan, et al.
Publicado: (2024)
Source Prompt Disentangled Inversion for Boosting Image Editability with Diffusion Models
por: Li, Ruibin, et al.
Publicado: (2024)
por: Li, Ruibin, et al.
Publicado: (2024)
Face2Diffusion for Fast and Editable Face Personalization
por: Shiohara, Kaede, et al.
Publicado: (2024)
por: Shiohara, Kaede, et al.
Publicado: (2024)
Encapsulated Composition of Text-to-Image and Text-to-Video Models for High-Quality Video Synthesis
por: Su, Tongtong, et al.
Publicado: (2025)
por: Su, Tongtong, et al.
Publicado: (2025)
Understanding Attention Mechanism in Video Diffusion Models
por: Liu, Bingyan, et al.
Publicado: (2025)
por: Liu, Bingyan, et al.
Publicado: (2025)
ToonComposer: Streamlining Cartoon Production with Generative Post-Keyframing
por: Li, Lingen, et al.
Publicado: (2025)
por: Li, Lingen, et al.
Publicado: (2025)
DreamSalon: A Staged Diffusion Framework for Preserving Identity-Context in Editable Face Generation
por: Lin, Haonan, et al.
Publicado: (2024)
por: Lin, Haonan, et al.
Publicado: (2024)
Editable Scene Simulation for Autonomous Driving via Collaborative LLM-Agents
por: Wei, Yuxi, et al.
Publicado: (2024)
por: Wei, Yuxi, et al.
Publicado: (2024)
Diffusion-4K: Ultra-High-Resolution Image Synthesis with Latent Diffusion Models
por: Zhang, Jinjin, et al.
Publicado: (2025)
por: Zhang, Jinjin, et al.
Publicado: (2025)
TextToon: Real-Time Text Toonify Head Avatar from Single Video
por: Song, Luchuan, et al.
Publicado: (2024)
por: Song, Luchuan, et al.
Publicado: (2024)
Diffusion Templates: A Unified Plugin Framework for Controllable Diffusion
por: Duan, Zhongjie, et al.
Publicado: (2026)
por: Duan, Zhongjie, et al.
Publicado: (2026)
On the Trustworthiness Landscape of State-of-the-art Generative Models: A Survey and Outlook
por: Fan, Mingyuan, et al.
Publicado: (2023)
por: Fan, Mingyuan, et al.
Publicado: (2023)
Towards Understanding Cross and Self-Attention in Stable Diffusion for Text-Guided Image Editing
por: Liu, Bingyan, et al.
Publicado: (2024)
por: Liu, Bingyan, et al.
Publicado: (2024)
ToonOut: Fine-tuned Background-Removal for Anime Characters
por: Muratori, Matteo, et al.
Publicado: (2025)
por: Muratori, Matteo, et al.
Publicado: (2025)
Gaussian Shading: Provable Performance-Lossless Image Watermarking for Diffusion Models
por: Yang, Zijin, et al.
Publicado: (2024)
por: Yang, Zijin, et al.
Publicado: (2024)
ArtAug: Enhancing Text-to-Image Generation through Synthesis-Understanding Interaction
por: Duan, Zhongjie, et al.
Publicado: (2024)
por: Duan, Zhongjie, et al.
Publicado: (2024)
Spectral Evolution Search: Efficient Inference-Time Scaling for Reward-Aligned Image Generation
por: Ye, Jinyan, et al.
Publicado: (2026)
por: Ye, Jinyan, et al.
Publicado: (2026)
Multistable Shape from Shading Emerges from Patch Diffusion
por: Han, Xinran Nicole, et al.
Publicado: (2024)
por: Han, Xinran Nicole, et al.
Publicado: (2024)
Cross-Resolution Distribution Matching for Diffusion Distillation
por: Chen, Feiyang, et al.
Publicado: (2026)
por: Chen, Feiyang, et al.
Publicado: (2026)
Point Resampling and Ray Transformation Aid to Editable NeRF Models
por: Li, Zhenyang, et al.
Publicado: (2024)
por: Li, Zhenyang, et al.
Publicado: (2024)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
Cross-Resolution Diffusion Models via Network Pruning
por: Ren, Jiaxuan, et al.
Publicado: (2026)
por: Ren, Jiaxuan, et al.
Publicado: (2026)
Qwen-Image-Layered: Towards Inherent Editability via Layer Decomposition
por: Yin, Shengming, et al.
Publicado: (2025)
por: Yin, Shengming, et al.
Publicado: (2025)
COMUNI: Decomposing Common and Unique Video Signals for Diffusion-based Video Generation
por: Sun, Mingzhen, et al.
Publicado: (2024)
por: Sun, Mingzhen, et al.
Publicado: (2024)
DreamSR: Towards Ultra-High-Resolution Image Super-Resolution via a Receptive-Field Enhanced Diffusion Transformer
por: Dong, Qingji, et al.
Publicado: (2026)
por: Dong, Qingji, et al.
Publicado: (2026)
Editable Image Elements for Controllable Synthesis
por: Mu, Jiteng, et al.
Publicado: (2024)
por: Mu, Jiteng, et al.
Publicado: (2024)
OpenECAD: An Efficient Visual Language Model for Editable 3D-CAD Design
por: Yuan, Zhe, et al.
Publicado: (2024)
por: Yuan, Zhe, et al.
Publicado: (2024)
Human-Guided Shade Artifact Suppression in CBCT-to-MDCT Translation via Schrödinger Bridge with Conditional Diffusion
por: Kang, Sung Ho, et al.
Publicado: (2025)
por: Kang, Sung Ho, et al.
Publicado: (2025)
Generating Editable Head Avatars with 3D Gaussian GANs
por: Li, Guohao, et al.
Publicado: (2024)
por: Li, Guohao, et al.
Publicado: (2024)
EliGen: Entity-Level Controlled Image Generation with Regional Attention
por: Zhang, Hong, et al.
Publicado: (2025)
por: Zhang, Hong, et al.
Publicado: (2025)
Fin3R: Fine-tuning Feed-forward 3D Reconstruction Models via Monocular Knowledge Distillation
por: Ren, Weining, et al.
Publicado: (2025)
por: Ren, Weining, et al.
Publicado: (2025)
Ejemplares similares
-
ExVideo: Extending Video Diffusion Models via Parameter-Efficient Post-Tuning
por: Duan, Zhongjie, et al.
Publicado: (2024) -
DeferredGS: Decoupled and Editable Gaussian Splatting with Deferred Shading
por: Wu, Tong, et al.
Publicado: (2024) -
VIRAL: Visual In-Context Reasoning via Analogy in Diffusion Transformers
por: Li, Zhiwen, et al.
Publicado: (2026) -
AttriCtrl: Fine-Grained Control of Aesthetic Attribute Intensity in Diffusion Models
por: Chen, Die, et al.
Publicado: (2025) -
ToonCrafter: Generative Cartoon Interpolation
por: Xing, Jinbo, et al.
Publicado: (2024)