PosterCopilot: Toward Layout Reasoning and Controllable Editing for Professional Graphic Design
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wei, Jiazhe, Li, Ken, Lao, Tianyu, Wang, Haofan, Wang, Liang, Shan, Caifeng, Si, Chenyang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CreatiPoster: Towards Editable and Controllable Multi-Layer Graphic Design Generation
par: Zhang, Zhao, et autres
Publié: (2025)
par: Zhang, Zhao, et autres
Publié: (2025)
NOVA: Sparse Control, Dense Synthesis for Pair-Free Video Editing
par: Pan, Tianlin, et autres
Publié: (2026)
par: Pan, Tianlin, et autres
Publié: (2026)
One-to-More: High-Fidelity Training-Free Anomaly Generation with Attention Control
par: Rao, Haoxiang, et autres
Publié: (2026)
par: Rao, Haoxiang, et autres
Publié: (2026)
SciPostLayout: A Dataset for Layout Analysis and Layout Generation of Scientific Posters
par: Tanaka, Shohei, et autres
Publié: (2024)
par: Tanaka, Shohei, et autres
Publié: (2024)
Relation-Aware Diffusion Model for Controllable Poster Layout Generation
par: Li, Fengheng, et autres
Publié: (2023)
par: Li, Fengheng, et autres
Publié: (2023)
LayoutDiT: Exploring Content-Graphic Balance in Layout Generation with Diffusion Transformer
par: Li, Yu, et autres
Publié: (2024)
par: Li, Yu, et autres
Publié: (2024)
Optimize-at-Capture: Highly-adaptive Exposure Controlling for In-Vehicle Non-contact Heart-rate Monitoring
par: Wang, Jieying, et autres
Publié: (2026)
par: Wang, Jieying, et autres
Publié: (2026)
SkyReels-Text: Fine-Grained Font-Controllable Text Editing for Poster Design
par: Yu, Yunjie, et autres
Publié: (2025)
par: Yu, Yunjie, et autres
Publié: (2025)
PosterLLaVa: Constructing a Unified Multi-modal Layout Generator with LLM
par: Yang, Tao, et autres
Publié: (2024)
par: Yang, Tao, et autres
Publié: (2024)
ReLayout: Versatile and Structure-Preserving Design Layout Editing via Relation-Aware Design Reconstruction
par: Lin, Jiawei, et autres
Publié: (2026)
par: Lin, Jiawei, et autres
Publié: (2026)
PosterLlama: Bridging Design Ability of Langauge Model to Contents-Aware Layout Generation
par: Seol, Jaejung, et autres
Publié: (2024)
par: Seol, Jaejung, et autres
Publié: (2024)
StableWorld: Towards Stable and Consistent Long Interactive Video Generation
par: Yang, Ying, et autres
Publié: (2026)
par: Yang, Ying, et autres
Publié: (2026)
PPTBench: Towards Holistic Evaluation of Large Language Models for PowerPoint Layout and Design Understanding
par: Huang, Zheng, et autres
Publié: (2025)
par: Huang, Zheng, et autres
Publié: (2025)
ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
par: Yin, Fukun, et autres
Publié: (2025)
par: Yin, Fukun, et autres
Publié: (2025)
ReLayout: Integrating Relation Reasoning for Content-aware Layout Generation with Multi-modal Large Language Models
par: Tian, Jiaxu, et autres
Publié: (2025)
par: Tian, Jiaxu, et autres
Publié: (2025)
LayoutDiffusion: Controllable Diffusion Model for Layout-to-image Generation
par: Zheng, Guangcong, et autres
Publié: (2023)
par: Zheng, Guangcong, et autres
Publié: (2023)
IMAGHarmony: Controllable Image Editing with Consistent Object Quantity and Layout
par: Shen, Fei, et autres
Publié: (2025)
par: Shen, Fei, et autres
Publié: (2025)
Scan-and-Print: Patch-level Data Summarization and Augmentation for Content-aware Layout Generation in Poster Design
par: Hsu, HsiaoYuan, et autres
Publié: (2025)
par: Hsu, HsiaoYuan, et autres
Publié: (2025)
An Effective End-to-End Solution for Multimodal Action Recognition
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
Exploring Adversarial Transferability between Kolmogorov-arnold Networks
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
InstaFace: Identity-Preserving Facial Editing with Single Image Inference
par: Khan, MD Wahiduzzaman, et autres
Publié: (2025)
par: Khan, MD Wahiduzzaman, et autres
Publié: (2025)
Towards Top-Down Reasoning: An Explainable Multi-Agent Approach for Visual Question Answering
par: Wang, Zeqing, et autres
Publié: (2023)
par: Wang, Zeqing, et autres
Publié: (2023)
LAD-Reasoner: Tiny Multimodal Models are Good Reasoners for Logical Anomaly Detection
par: Li, Weijia, et autres
Publié: (2025)
par: Li, Weijia, et autres
Publié: (2025)
DiverseAR: Boosting Diversity in Bitwise Autoregressive Image Generation
par: Yang, Ying, et autres
Publié: (2025)
par: Yang, Ying, et autres
Publié: (2025)
SciPostLayoutTree: A Dataset for Structural Analysis of Scientific Posters
par: Tanaka, Shohei, et autres
Publié: (2025)
par: Tanaka, Shohei, et autres
Publié: (2025)
GLDesigner: Leveraging Multi-Modal LLMs as Designer for Enhanced Aesthetic Text Glyph Layouts
par: He, Junwen, et autres
Publié: (2024)
par: He, Junwen, et autres
Publié: (2024)
GOOD: Training-Free Guided Diffusion Sampling for Out-of-Distribution Detection
par: Gao, Xin, et autres
Publié: (2025)
par: Gao, Xin, et autres
Publié: (2025)
Vision-as-Inverse-Graphics Agent via Interleaved Multimodal Reasoning
par: Yin, Shaofeng, et autres
Publié: (2026)
par: Yin, Shaofeng, et autres
Publié: (2026)
Consistent Image Layout Editing with Diffusion Models
par: Xia, Tao, et autres
Publié: (2025)
par: Xia, Tao, et autres
Publié: (2025)
Spot the Error: Non-autoregressive Graphic Layout Generation with Wireframe Locator
par: Lin, Jieru, et autres
Publié: (2024)
par: Lin, Jieru, et autres
Publié: (2024)
DesignSense: A Human Preference Dataset and Reward Modeling Framework for Graphic Layout Generation
par: Gopal, Varun, et autres
Publié: (2026)
par: Gopal, Varun, et autres
Publié: (2026)
MagicStick: Controllable Video Editing via Control Handle Transformations
par: Ma, Yue, et autres
Publié: (2023)
par: Ma, Yue, et autres
Publié: (2023)
Toward Scene Graph and Layout Guided Complex 3D Scene Generation
par: Huang, Yu-Hsiang, et autres
Publié: (2024)
par: Huang, Yu-Hsiang, et autres
Publié: (2024)
UTDesign: A Unified Framework for Stylized Text Editing and Generation in Graphic Design Images
par: Zhao, Yiming, et autres
Publié: (2025)
par: Zhao, Yiming, et autres
Publié: (2025)
ReLayout: Towards Real-World Document Understanding via Layout-enhanced Pre-training
par: Jiang, Zhouqiang, et autres
Publié: (2024)
par: Jiang, Zhouqiang, et autres
Publié: (2024)
3D-Layout-R1: Structured Reasoning for Language-Instructed Spatial Editing
par: Zhen, Haoyu, et autres
Publié: (2026)
par: Zhen, Haoyu, et autres
Publié: (2026)
Fast Adversarial Training with Weak-to-Strong Spatial-Temporal Consistency in the Frequency Domain on Videos
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer
par: Zhang, Yuxuan, et autres
Publié: (2025)
par: Zhang, Yuxuan, et autres
Publié: (2025)
SciPostGen: Bridging the Gap between Scientific Papers and Poster Layouts
par: Inadumi, Shun, et autres
Publié: (2025)
par: Inadumi, Shun, et autres
Publié: (2025)
TactileEval: A Step Towards Automated Fine-Grained Evaluation and Editing of Tactile Graphics
par: Khan, Adnan, et autres
Publié: (2026)
par: Khan, Adnan, et autres
Publié: (2026)
Documents similaires
-
CreatiPoster: Towards Editable and Controllable Multi-Layer Graphic Design Generation
par: Zhang, Zhao, et autres
Publié: (2025) -
NOVA: Sparse Control, Dense Synthesis for Pair-Free Video Editing
par: Pan, Tianlin, et autres
Publié: (2026) -
One-to-More: High-Fidelity Training-Free Anomaly Generation with Attention Control
par: Rao, Haoxiang, et autres
Publié: (2026) -
SciPostLayout: A Dataset for Layout Analysis and Layout Generation of Scientific Posters
par: Tanaka, Shohei, et autres
Publié: (2024) -
Relation-Aware Diffusion Model for Controllable Poster Layout Generation
par: Li, Fengheng, et autres
Publié: (2023)