LayerCraft: Enhancing Text-to-Image Generation with CoT Reasoning and Layered Object Integration
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Yuyao, Li, Jinghao, Tai, Yu-Wing |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
HyperAgent: Leveraging Hypergraphs for Topology Optimization in Multi-Agent Communication
by: Zhang, Heng, et al.
Published: (2025)
by: Zhang, Heng, et al.
Published: (2025)
Agent-based visualization of streaming text
by: Benson, Jordan Riley, et al.
Published: (2025)
by: Benson, Jordan Riley, et al.
Published: (2025)
FilmAgent: A Multi-Agent Framework for End-to-End Film Automation in Virtual 3D Spaces
by: Xu, Zhenran, et al.
Published: (2025)
by: Xu, Zhenran, et al.
Published: (2025)
Training and Agentic Inference Strategies for LLM-based Manim Animation Generation
by: Silva, Ravidu Suien Rammuni, et al.
Published: (2026)
by: Silva, Ravidu Suien Rammuni, et al.
Published: (2026)
Emergent Crowd Grouping via Heuristic Self-Organization
by: Liao, Xiao-Cheng, et al.
Published: (2024)
by: Liao, Xiao-Cheng, et al.
Published: (2024)
Neural Cellular Automata: From Cells to Pixels
by: Pajouheshgar, Ehsan, et al.
Published: (2025)
by: Pajouheshgar, Ehsan, et al.
Published: (2025)
A Cross-Layered Multi-Drone Coordination for Medical Supply Delivery during Disaster Response Management
by: Calyam, Aneesh, et al.
Published: (2026)
by: Calyam, Aneesh, et al.
Published: (2026)
CartoAgent: a multimodal large language model-powered multi-agent cartographic framework for map style transfer and evaluation
by: Wang, Chenglong, et al.
Published: (2025)
by: Wang, Chenglong, et al.
Published: (2025)
Communications-Incentivized Collaborative Reasoning in NetGPT through Agentic Reinforcement Learning
by: Yu, Xiaoxue, et al.
Published: (2026)
by: Yu, Xiaoxue, et al.
Published: (2026)
TeamHOI: Learning a Unified Policy for Cooperative Human-Object Interactions with Any Team Size
by: Lionar, Stefan, et al.
Published: (2026)
by: Lionar, Stefan, et al.
Published: (2026)
T2VTree: User-Centered Visual Analytics for Agent-Assisted Thought-to-Video Authoring
by: Zheng, Zhuoyun, et al.
Published: (2026)
by: Zheng, Zhuoyun, et al.
Published: (2026)
NLI4VolVis: Natural Language Interaction for Volume Visualization via LLM Multi-Agents and Editable 3D Gaussian Splatting
by: Ai, Kuangshi, et al.
Published: (2025)
by: Ai, Kuangshi, et al.
Published: (2025)
Direct Preference Optimization-Enhanced Multi-Guided Diffusion Model for Traffic Scenario Generation
by: Yu, Seungjun, et al.
Published: (2025)
by: Yu, Seungjun, et al.
Published: (2025)
From Idea to Co-Creation: A Planner-Actor-Critic Framework for Agent Augmented 3D Modeling
by: Gao, Jin, et al.
Published: (2026)
by: Gao, Jin, et al.
Published: (2026)
Hybrid Training for Enhanced Multi-task Generalization in Multi-agent Reinforcement Learning
by: Zhang, Mingliang, et al.
Published: (2024)
by: Zhang, Mingliang, et al.
Published: (2024)
Decentralized Diffusion Policy Learning for Enhanced Exploration in Cooperative Multi-agent Reinforcement Learning
by: Zhang, Yuyang, et al.
Published: (2026)
by: Zhang, Yuyang, et al.
Published: (2026)
ARMove: Learning to Predict Human Mobility through Agentic Reasoning
by: Wang, Chuyue, et al.
Published: (2026)
by: Wang, Chuyue, et al.
Published: (2026)
IMAGAgent: Orchestrating Multi-Turn Image Editing via Constraint-Aware Planning and Reflection
by: Shen, Fei, et al.
Published: (2026)
by: Shen, Fei, et al.
Published: (2026)
LLM Economist: Large Population Models and Mechanism Design in Multi-Agent Generative Simulacra
by: Karten, Seth, et al.
Published: (2025)
by: Karten, Seth, et al.
Published: (2025)
OFA-MAS: One-for-All Multi-Agent System Topology Design based on Mixture-of-Experts Graph Generative Models
by: Li, Shiyuan, et al.
Published: (2026)
by: Li, Shiyuan, et al.
Published: (2026)
T2MAC: Targeted and Trusted Multi-Agent Communication through Selective Engagement and Evidence-Driven Integration
by: Sun, Chuxiong, et al.
Published: (2024)
by: Sun, Chuxiong, et al.
Published: (2024)
GLOW: Graph-Language Co-Reasoning for Agentic Workflow Performance Prediction
by: Guan, Wei, et al.
Published: (2025)
by: Guan, Wei, et al.
Published: (2025)
Probing Dec-POMDP Reasoning in Cooperative MARL
by: Tessera, Kale-ab, et al.
Published: (2026)
by: Tessera, Kale-ab, et al.
Published: (2026)
SocialDriveGen: Generating Diverse Traffic Scenarios with Controllable Social Interactions
by: Tian, Jiaguo, et al.
Published: (2025)
by: Tian, Jiaguo, et al.
Published: (2025)
MARBLE: Multi-Agent Reasoning for Bioinformatics Learning and Evolution
by: Kim, Sunghyun, et al.
Published: (2026)
by: Kim, Sunghyun, et al.
Published: (2026)
Real-time Adapting Routing (RAR): Improving Efficiency Through Continuous Learning in Software Powered by Layered Foundation Models
by: Vasilevski, Kirill, et al.
Published: (2024)
by: Vasilevski, Kirill, et al.
Published: (2024)
AgentsNet: Coordination and Collaborative Reasoning in Multi-Agent LLMs
by: Grötschla, Florian, et al.
Published: (2025)
by: Grötschla, Florian, et al.
Published: (2025)
BRIDGE: Bootstrapping Text to Control Time-Series Generation via Multi-Agent Iterative Optimization and Diffusion Modeling
by: Li, Hao, et al.
Published: (2025)
by: Li, Hao, et al.
Published: (2025)
Can We Enhance the Quality of Mobile Crowdsensing Data Without Ground Truth?
by: Li, Jiajie, et al.
Published: (2024)
by: Li, Jiajie, et al.
Published: (2024)
CoTDeceptor:Adversarial Code Obfuscation Against CoT-Enhanced LLM Code Agents
by: Li, Haoyang, et al.
Published: (2025)
by: Li, Haoyang, et al.
Published: (2025)
Cluster-Based Multi-Agent Task Scheduling for Space-Air-Ground Integrated Networks
by: Wang, Zhiying, et al.
Published: (2024)
by: Wang, Zhiying, et al.
Published: (2024)
PhysicsAgentABM: Physics-Guided Generative Agent-Based Modeling
by: Venkatesh, Kavana, et al.
Published: (2026)
by: Venkatesh, Kavana, et al.
Published: (2026)
Robust Multi-agent Communication via Multi-view Message Certification
by: Yuan, Lei, et al.
Published: (2023)
by: Yuan, Lei, et al.
Published: (2023)
LumiGen: An LVLM-Enhanced Iterative Framework for Fine-Grained Text-to-Image Generation
by: Dong, Xiaoqi, et al.
Published: (2025)
by: Dong, Xiaoqi, et al.
Published: (2025)
CoDe: Communication Delay-Tolerant Multi-Agent Collaboration via Dual Alignment of Intent and Timeliness
by: Song, Shoucheng, et al.
Published: (2025)
by: Song, Shoucheng, et al.
Published: (2025)
Integrated Noise and Safety Management in UAM via A Unified Reinforcement Learning Framework
by: Murthy, Surya, et al.
Published: (2025)
by: Murthy, Surya, et al.
Published: (2025)
Tackling Uncertainties in Multi-Agent Reinforcement Learning through Integration of Agent Termination Dynamics
by: Hazra, Somnath, et al.
Published: (2025)
by: Hazra, Somnath, et al.
Published: (2025)
CoCoL: A Communication Efficient Decentralized Collaborative Method for Multi-Robot Systems
by: Huang, Jiaxi, et al.
Published: (2025)
by: Huang, Jiaxi, et al.
Published: (2025)
Context-aware Communication for Multi-agent Reinforcement Learning
by: Li, Xinran, et al.
Published: (2023)
by: Li, Xinran, et al.
Published: (2023)
Multi-agent In-context Coordination via Decentralized Memory Retrieval
by: Jiang, Tao, et al.
Published: (2025)
by: Jiang, Tao, et al.
Published: (2025)
Similar Items
-
HyperAgent: Leveraging Hypergraphs for Topology Optimization in Multi-Agent Communication
by: Zhang, Heng, et al.
Published: (2025) -
Agent-based visualization of streaming text
by: Benson, Jordan Riley, et al.
Published: (2025) -
FilmAgent: A Multi-Agent Framework for End-to-End Film Automation in Virtual 3D Spaces
by: Xu, Zhenran, et al.
Published: (2025) -
Training and Agentic Inference Strategies for LLM-based Manim Animation Generation
by: Silva, Ravidu Suien Rammuni, et al.
Published: (2026) -
Emergent Crowd Grouping via Heuristic Self-Organization
by: Liao, Xiao-Cheng, et al.
Published: (2024)