GardenDesigner: Encoding Aesthetic Principles into Jiangnan Garden Construction via a Chain of Agents
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Mengtian, Yang, Fan, Xiong, Ruixue, Fan, Yiyan, Xie, Zhifeng, Wang, Zeyu |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FilmSceneDesigner: Chaining Set Design for Procedural Film Scene Generation
by: Xie, Zhifeng, et al.
Published: (2025)
by: Xie, Zhifeng, et al.
Published: (2025)
GaussianBody: Clothed Human Reconstruction via 3d Gaussian Splatting
by: Li, Mengtian, et al.
Published: (2024)
by: Li, Mengtian, et al.
Published: (2024)
FoleyDesigner: Immersive Stereo Foley Generation with Precise Spatio-Temporal Alignment for Film Clips
by: Li, Mengtian, et al.
Published: (2026)
by: Li, Mengtian, et al.
Published: (2026)
HieraFashDiff: Hierarchical Fashion Design with Multi-stage Diffusion Models
by: Xie, Zhifeng, et al.
Published: (2024)
by: Xie, Zhifeng, et al.
Published: (2024)
Infinite Motion: Extended Motion Generation via Long Text Instructions
by: Li, Mengtian, et al.
Published: (2024)
by: Li, Mengtian, et al.
Published: (2024)
SemMorph3D: Unsupervised Semantic-Aware 3D Morphing via Mesh-Guided Gaussians
by: Li, Mengtian, et al.
Published: (2025)
by: Li, Mengtian, et al.
Published: (2025)
VERTIGO: Visual Preference Optimization for Cinematic Camera Trajectory Generation
by: Li, Mengtian, et al.
Published: (2026)
by: Li, Mengtian, et al.
Published: (2026)
AniGaussian: Animatable Gaussian Avatar with Pose-guided Deformation
by: Li, Mengtian, et al.
Published: (2025)
by: Li, Mengtian, et al.
Published: (2025)
Text-Aware Real-World Image Super-Resolution via Diffusion Model with Joint Segmentation Decoders
by: Hu, Qiming, et al.
Published: (2025)
by: Hu, Qiming, et al.
Published: (2025)
FilmComposer: LLM-Driven Music Production for Silent Film Clips
by: Xie, Zhifeng, et al.
Published: (2025)
by: Xie, Zhifeng, et al.
Published: (2025)
Grid4D: 4D Decomposed Hash Encoding for High-Fidelity Dynamic Gaussian Splatting
by: Xu, Jiawei, et al.
Published: (2024)
by: Xu, Jiawei, et al.
Published: (2024)
Image Aesthetics Assessment via Learnable Queries
by: Xiong, Zhiwei, et al.
Published: (2023)
by: Xiong, Zhiwei, et al.
Published: (2023)
Mind-of-Director: Multi-modal Agent-Driven Film Previsualization via Collaborative Decision-Making
by: Nan, Shufeng, et al.
Published: (2026)
by: Nan, Shufeng, et al.
Published: (2026)
A Partial Replication of MaskFormer in TensorFlow on TPUs for the TensorFlow Model Garden
by: Purohit, Vishal, et al.
Published: (2024)
by: Purohit, Vishal, et al.
Published: (2024)
VSearcher: Long-Horizon Multimodal Search Agent via Reinforcement Learning
by: Zhang, Ruiyang, et al.
Published: (2026)
by: Zhang, Ruiyang, et al.
Published: (2026)
When Visualizing is the First Step to Reasoning: MIRA, a Benchmark for Visual Chain-of-Thought
by: Zhou, Yiyang, et al.
Published: (2025)
by: Zhou, Yiyang, et al.
Published: (2025)
Characterizing and Optimizing the Spatial Kernel of Multi Resolution Hash Encodings
by: Dai, Tianxiang, et al.
Published: (2026)
by: Dai, Tianxiang, et al.
Published: (2026)
Restore Text First, Enhance Image Later: Two-Stage Scene Text Image Super-Resolution with Glyph Structure Guidance
by: Luo, Minxing, et al.
Published: (2025)
by: Luo, Minxing, et al.
Published: (2025)
Neural Field Classifiers via Target Encoding and Classification Loss
by: Yang, Xindi, et al.
Published: (2024)
by: Yang, Xindi, et al.
Published: (2024)
Fine-grained Image Aesthetic Assessment: Learning Discriminative Scores from Relative Ranks
by: Yang, Zhichao, et al.
Published: (2026)
by: Yang, Zhichao, et al.
Published: (2026)
PhotoAgent: Agentic Photo Editing with Exploratory Visual Aesthetic Planning
by: Yao, Mingde, et al.
Published: (2026)
by: Yao, Mingde, et al.
Published: (2026)
HLG: Comprehensive 3D Room Construction via Hierarchical Layout Generation
by: Wang, Xiping, et al.
Published: (2025)
by: Wang, Xiping, et al.
Published: (2025)
GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction
by: Li, Tianhao, et al.
Published: (2025)
by: Li, Tianhao, et al.
Published: (2025)
Multimodal Data Integration for Sustainable Indoor Gardening: Tracking Anyplant with Time Series Foundation Model
by: Nabaei, Seyed Hamidreza, et al.
Published: (2025)
by: Nabaei, Seyed Hamidreza, et al.
Published: (2025)
MatPhys: Learning Material-Aware Physics Parameters for Deformable Object Simulation from Videos
by: Yang, Yang, et al.
Published: (2026)
by: Yang, Yang, et al.
Published: (2026)
Aesthetic Camera Viewpoint Suggestion with 3D Aesthetic Field
by: Tang, Sheyang, et al.
Published: (2026)
by: Tang, Sheyang, et al.
Published: (2026)
Multi-modal Learnable Queries for Image Aesthetics Assessment
by: Xiong, Zhiwei, et al.
Published: (2024)
by: Xiong, Zhiwei, et al.
Published: (2024)
Glyph-ByT5-v2: A Strong Aesthetic Baseline for Accurate Multilingual Visual Text Rendering
by: Liu, Zeyu, et al.
Published: (2024)
by: Liu, Zeyu, et al.
Published: (2024)
GLDesigner: Leveraging Multi-Modal LLMs as Designer for Enhanced Aesthetic Text Glyph Layouts
by: He, Junwen, et al.
Published: (2024)
by: He, Junwen, et al.
Published: (2024)
Class-Imbalanced Semi-Supervised Learning for Large-Scale Point Cloud Semantic Segmentation via Decoupling Optimization
by: Li, Mengtian, et al.
Published: (2024)
by: Li, Mengtian, et al.
Published: (2024)
What Do Vision-Language Models Encode for Personalized Image Aesthetics Assessment?
by: Ryu, Koki, et al.
Published: (2026)
by: Ryu, Koki, et al.
Published: (2026)
MotionChain: Conversational Motion Controllers via Multimodal Prompts
by: Jiang, Biao, et al.
Published: (2024)
by: Jiang, Biao, et al.
Published: (2024)
An Order-Complexity Aesthetic Assessment Model for Aesthetic-aware Music Recommendation
by: Jin, Xin, et al.
Published: (2024)
by: Jin, Xin, et al.
Published: (2024)
The Photographer Eye: Teaching Multimodal Large Language Models to Understand Image Aesthetics like Photographers
by: Qi, Daiqing, et al.
Published: (2025)
by: Qi, Daiqing, et al.
Published: (2025)
Compose Your Aesthetics: Empowering Text-to-Image Models with the Principles of Art
by: Jin, Zhe, et al.
Published: (2025)
by: Jin, Zhe, et al.
Published: (2025)
Scaling Video Understanding via Compact Latent Multi-Agent Collaboration
by: Chen, Kerui, et al.
Published: (2026)
by: Chen, Kerui, et al.
Published: (2026)
Debunking Grad-ECLIP: A Comprehensive Study on Its Incorrectness and Fundamental Principles for Model Interpretation
by: Cui, Yongjin, et al.
Published: (2026)
by: Cui, Yongjin, et al.
Published: (2026)
Diffusion-based Aesthetic QR Code Generation via Scanning-Robust Perceptual Guidance
by: Liao, Jia-Wei, et al.
Published: (2024)
by: Liao, Jia-Wei, et al.
Published: (2024)
StageDesigner: Artistic Stage Generation for Scenography via Theater Scripts
by: Gan, Zhaoxing, et al.
Published: (2025)
by: Gan, Zhaoxing, et al.
Published: (2025)
UniGarmentManip: A Unified Framework for Category-Level Garment Manipulation via Dense Visual Correspondence
by: Wu, Ruihai, et al.
Published: (2024)
by: Wu, Ruihai, et al.
Published: (2024)
Similar Items
-
FilmSceneDesigner: Chaining Set Design for Procedural Film Scene Generation
by: Xie, Zhifeng, et al.
Published: (2025) -
GaussianBody: Clothed Human Reconstruction via 3d Gaussian Splatting
by: Li, Mengtian, et al.
Published: (2024) -
FoleyDesigner: Immersive Stereo Foley Generation with Precise Spatio-Temporal Alignment for Film Clips
by: Li, Mengtian, et al.
Published: (2026) -
HieraFashDiff: Hierarchical Fashion Design with Multi-stage Diffusion Models
by: Xie, Zhifeng, et al.
Published: (2024) -
Infinite Motion: Extended Motion Generation via Long Text Instructions
by: Li, Mengtian, et al.
Published: (2024)