CreatiParser: Generative Image Parsing of Raster Graphic Designs into Editable Layers
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Weidong, Hong, Dexiang, Mao, Zhendong, Cheng, Yutao, Liu, Xinyan, Zhang, Lei, Zhang, Yongdong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CreatiPoster: Towards Editable and Controllable Multi-Layer Graphic Design Generation
di: Zhang, Zhao, et al.
Pubblicazione: (2025)
di: Zhang, Zhao, et al.
Pubblicazione: (2025)
CreatiDesign: A Unified Multi-Conditional Diffusion Transformer for Creative Graphic Design
di: Zhang, Hui, et al.
Pubblicazione: (2025)
di: Zhang, Hui, et al.
Pubblicazione: (2025)
CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation
di: Zhang, Hui, et al.
Pubblicazione: (2024)
di: Zhang, Hui, et al.
Pubblicazione: (2024)
FACE-net: Factual Calibration and Emotion Augmentation for Retrieval-enhanced Emotional Video Captioning
di: Chen, Weidong, et al.
Pubblicazione: (2026)
di: Chen, Weidong, et al.
Pubblicazione: (2026)
LayerD: Decomposing Raster Graphic Designs into Layers
di: Suzuki, Tomoyuki, et al.
Pubblicazione: (2025)
di: Suzuki, Tomoyuki, et al.
Pubblicazione: (2025)
COLE: A Hierarchical Generation Framework for Multi-Layered and Editable Graphic Design
di: Jia, Peidong, et al.
Pubblicazione: (2023)
di: Jia, Peidong, et al.
Pubblicazione: (2023)
IGD: Instructional Graphic Design with Multimodal Layer Generation
di: Qu, Yadong, et al.
Pubblicazione: (2025)
di: Qu, Yadong, et al.
Pubblicazione: (2025)
DSE-GAN: Dynamic Semantic Evolution Generative Adversarial Network for Text-to-Image Generation
di: Huang, Mengqi, et al.
Pubblicazione: (2022)
di: Huang, Mengqi, et al.
Pubblicazione: (2022)
Dual-path Collaborative Generation Network for Emotional Video Captioning
di: Ye, Cheng, et al.
Pubblicazione: (2024)
di: Ye, Cheng, et al.
Pubblicazione: (2024)
SceneParser: Hierarchical Scene Parsing for Visual Semantics Understanding
di: Xu, Pengxin, et al.
Pubblicazione: (2026)
di: Xu, Pengxin, et al.
Pubblicazione: (2026)
Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models
di: Zhang, Huatian, et al.
Pubblicazione: (2026)
di: Zhang, Huatian, et al.
Pubblicazione: (2026)
UniParser: Multi-Human Parsing with Unified Correlation Representation Learning
di: Chu, Jiaming, et al.
Pubblicazione: (2023)
di: Chu, Jiaming, et al.
Pubblicazione: (2023)
RealCustom: Narrowing Real Text Word for Real-Time Open-Domain Text-to-Image Customization
di: Huang, Mengqi, et al.
Pubblicazione: (2024)
di: Huang, Mengqi, et al.
Pubblicazione: (2024)
EmoVerse: A MLLMs-Driven Emotion Representation Dataset for Interpretable Visual Emotion Analysis
di: Guo, Yijie, et al.
Pubblicazione: (2025)
di: Guo, Yijie, et al.
Pubblicazione: (2025)
LayerEdit: Disentangled Multi-Object Editing via Conflict-Aware Multi-Layer Learning
di: Fu, Fengyi, et al.
Pubblicazione: (2025)
di: Fu, Fengyi, et al.
Pubblicazione: (2025)
RealCustom++: Representing Images as Real Textual Word for Real-Time Customization
di: Mao, Zhendong, et al.
Pubblicazione: (2024)
di: Mao, Zhendong, et al.
Pubblicazione: (2024)
Parser-Oriented Structural Refinement for a Stable Layout Interface in Document Parsing
di: Liu, Fuyuan, et al.
Pubblicazione: (2026)
di: Liu, Fuyuan, et al.
Pubblicazione: (2026)
DesignAsCode: Bridging Structural Editability and Visual Fidelity in Graphic Design Generation
di: Liu, Ziyuan, et al.
Pubblicazione: (2026)
di: Liu, Ziyuan, et al.
Pubblicazione: (2026)
DreamPoster: A Unified Framework for Image-Conditioned Generative Poster Design
di: Hu, Xiwei, et al.
Pubblicazione: (2025)
di: Hu, Xiwei, et al.
Pubblicazione: (2025)
Qwen-Image-Layered: Towards Inherent Editability via Layer Decomposition
di: Yin, Shengming, et al.
Pubblicazione: (2025)
di: Yin, Shengming, et al.
Pubblicazione: (2025)
MasterWeaver: Taming Editability and Face Identity for Personalized Text-to-Image Generation
di: Wei, Yuxiang, et al.
Pubblicazione: (2024)
di: Wei, Yuxiang, et al.
Pubblicazione: (2024)
Improving Editability in Image Generation with Layer-wise Memory
di: Kim, Daneul, et al.
Pubblicazione: (2025)
di: Kim, Daneul, et al.
Pubblicazione: (2025)
D$^2$iT: Dynamic Diffusion Transformer for Accurate Image Generation
di: Jia, Weinan, et al.
Pubblicazione: (2025)
di: Jia, Weinan, et al.
Pubblicazione: (2025)
Stream-R1: Reliability-Perplexity Aware Reward Distillation for Streaming Video Generation
di: Wu, Bin, et al.
Pubblicazione: (2026)
di: Wu, Bin, et al.
Pubblicazione: (2026)
Source Prompt Disentangled Inversion for Boosting Image Editability with Diffusion Models
di: Li, Ruibin, et al.
Pubblicazione: (2024)
di: Li, Ruibin, et al.
Pubblicazione: (2024)
Rethinking Layered Graphic Design Generation with a Top-Down Approach
di: Chen, Jingye, et al.
Pubblicazione: (2025)
di: Chen, Jingye, et al.
Pubblicazione: (2025)
Text-Conditioned Background Generation for Editable Multi-Layer Documents
di: Kang, Taewon, et al.
Pubblicazione: (2025)
di: Kang, Taewon, et al.
Pubblicazione: (2025)
Editable Image Elements for Controllable Synthesis
di: Mu, Jiteng, et al.
Pubblicazione: (2024)
di: Mu, Jiteng, et al.
Pubblicazione: (2024)
Graphic Design with Large Multimodal Model
di: Cheng, Yutao, et al.
Pubblicazione: (2024)
di: Cheng, Yutao, et al.
Pubblicazione: (2024)
A Multi-Agent Framework with Structured Reasoning and Reflective Refinement for Multimodal Empathetic Response Generation
di: Wang, Liping, et al.
Pubblicazione: (2026)
di: Wang, Liping, et al.
Pubblicazione: (2026)
OmniParser V2: Structured-Points-of-Thought for Unified Visual Text Parsing and Its Generality to Multimodal Large Language Models
di: Yu, Wenwen, et al.
Pubblicazione: (2025)
di: Yu, Wenwen, et al.
Pubblicazione: (2025)
Video-LevelGauge: Investigating Contextual Positional Bias in Large Video Language Models
di: Xia, Hou, et al.
Pubblicazione: (2025)
di: Xia, Hou, et al.
Pubblicazione: (2025)
SparkUI-Parser: Enhancing GUI Perception with Robust Grounding and Parsing
di: Jing, Hongyi, et al.
Pubblicazione: (2025)
di: Jing, Hongyi, et al.
Pubblicazione: (2025)
LICA: Layered Image Composition Annotations for Graphic Design Research
di: Hirsch, Elad, et al.
Pubblicazione: (2026)
di: Hirsch, Elad, et al.
Pubblicazione: (2026)
Uni-Parser Technical Report
di: Fang, Xi, et al.
Pubblicazione: (2025)
di: Fang, Xi, et al.
Pubblicazione: (2025)
NativeTok: Native Visual Tokenization for Improved Image Generation
di: Wu, Bin, et al.
Pubblicazione: (2026)
di: Wu, Bin, et al.
Pubblicazione: (2026)
ChemScraper: Leveraging PDF Graphics Instructions for Molecular Diagram Parsing
di: Shah, Ayush Kumar, et al.
Pubblicazione: (2023)
di: Shah, Ayush Kumar, et al.
Pubblicazione: (2023)
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
di: Wang, Baode, et al.
Pubblicazione: (2025)
di: Wang, Baode, et al.
Pubblicazione: (2025)
3D Space as a Scratchpad for Editable Text-to-Image Generation
di: Saha, Oindrila, et al.
Pubblicazione: (2026)
di: Saha, Oindrila, et al.
Pubblicazione: (2026)
$E^{3}$Gen: Efficient, Expressive and Editable Avatars Generation
di: Zhang, Weitian, et al.
Pubblicazione: (2024)
di: Zhang, Weitian, et al.
Pubblicazione: (2024)
Documenti analoghi
-
CreatiPoster: Towards Editable and Controllable Multi-Layer Graphic Design Generation
di: Zhang, Zhao, et al.
Pubblicazione: (2025) -
CreatiDesign: A Unified Multi-Conditional Diffusion Transformer for Creative Graphic Design
di: Zhang, Hui, et al.
Pubblicazione: (2025) -
CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation
di: Zhang, Hui, et al.
Pubblicazione: (2024) -
FACE-net: Factual Calibration and Emotion Augmentation for Retrieval-enhanced Emotional Video Captioning
di: Chen, Weidong, et al.
Pubblicazione: (2026) -
LayerD: Decomposing Raster Graphic Designs into Layers
di: Suzuki, Tomoyuki, et al.
Pubblicazione: (2025)