MajutsuCity: Language-driven Aesthetic-adaptive City Generation with Controllable 3D Assets and Layouts
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Huang, Zilong, He, Jun, Huang, Xiaobin, Xiong, Ziyi, Luo, Yang, Ye, Junyan, Li, Weijia, Chen, Yiping, Han, Ting |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Scene4U: Hierarchical Layered 3D Scene Reconstruction from Single Panoramic Image for Your Immerse Exploration
von: Huang, Zilong, et al.
Veröffentlicht: (2025)
von: Huang, Zilong, et al.
Veröffentlicht: (2025)
UrbanFeel: A Comprehensive Benchmark for Temporal and Perceptual Understanding of City Scenes through Human Perspective
von: He, Jun, et al.
Veröffentlicht: (2025)
von: He, Jun, et al.
Veröffentlicht: (2025)
CityGen: Infinite and Controllable City Layout Generation
von: Deng, Jie, et al.
Veröffentlicht: (2023)
von: Deng, Jie, et al.
Veröffentlicht: (2023)
GenClaw: Code-Driven Agentic Image Generation
von: Ye, Junyan, et al.
Veröffentlicht: (2026)
von: Ye, Junyan, et al.
Veröffentlicht: (2026)
CrossViewDiff: A Cross-View Diffusion Model for Satellite-to-Street View Synthesis
von: Li, Weijia, et al.
Veröffentlicht: (2024)
von: Li, Weijia, et al.
Veröffentlicht: (2024)
SatSAM2: Motion-Constrained Video Object Tracking in Satellite Imagery using Promptable SAM2 and Kalman Priors
von: Fan, Ruijie, et al.
Veröffentlicht: (2025)
von: Fan, Ruijie, et al.
Veröffentlicht: (2025)
BLINK-Twice: You see, but do you observe? A Reasoning Benchmark on Visual Perception
von: Ye, Junyan, et al.
Veröffentlicht: (2025)
von: Ye, Junyan, et al.
Veröffentlicht: (2025)
Mind-Brush: Integrating Agentic Cognitive Search and Reasoning into Image Generation
von: He, Jun, et al.
Veröffentlicht: (2026)
von: He, Jun, et al.
Veröffentlicht: (2026)
GPT-ImgEval: A Comprehensive Benchmark for Diagnosing GPT4o in Image Generation
von: Yan, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Yan, Zhiyuan, et al.
Veröffentlicht: (2025)
Controllable Generation of Large-Scale 3D Urban Layouts with Semantic and Structural Guidance
von: Niu, Mengyuan, et al.
Veröffentlicht: (2025)
von: Niu, Mengyuan, et al.
Veröffentlicht: (2025)
COHO: Context-Sensitive City-Scale Hierarchical Urban Layout Generation
von: He, Liu, et al.
Veröffentlicht: (2024)
von: He, Liu, et al.
Veröffentlicht: (2024)
Empirical Asset Pricing with Large Language Model Agents
von: Cheng, Junyan, et al.
Veröffentlicht: (2024)
von: Cheng, Junyan, et al.
Veröffentlicht: (2024)
CityX: Controllable Procedural Content Generation for Unbounded 3D Cities
von: Zhang, Shougao, et al.
Veröffentlicht: (2024)
von: Zhang, Shougao, et al.
Veröffentlicht: (2024)
3DCity-LLM: Empowering Multi-modality Large Language Models for 3D City-scale Perception and Understanding
von: Chen, Yiping, et al.
Veröffentlicht: (2026)
von: Chen, Yiping, et al.
Veröffentlicht: (2026)
Meta-Transfer Learning Powered Temporal Graph Networks for Cross-City Real Estate Appraisal
von: Zhang, Weijia, et al.
Veröffentlicht: (2024)
von: Zhang, Weijia, et al.
Veröffentlicht: (2024)
GLDesigner: Leveraging Multi-Modal LLMs as Designer for Enhanced Aesthetic Text Glyph Layouts
von: He, Junwen, et al.
Veröffentlicht: (2024)
von: He, Junwen, et al.
Veröffentlicht: (2024)
CityCraft: A Real Crafter for 3D City Generation
von: Deng, Jie, et al.
Veröffentlicht: (2024)
von: Deng, Jie, et al.
Veröffentlicht: (2024)
LOKI: A Comprehensive Synthetic Data Detection Benchmark using Large Multimodal Models
von: Ye, Junyan, et al.
Veröffentlicht: (2024)
von: Ye, Junyan, et al.
Veröffentlicht: (2024)
City Street Layout Generation via Conditional Adversarial Learning
von: Yang, Lehao, et al.
Veröffentlicht: (2023)
von: Yang, Lehao, et al.
Veröffentlicht: (2023)
REPARO: Compositional 3D Assets Generation with Differentiable 3D Layout Alignment
von: Han, Haonan, et al.
Veröffentlicht: (2024)
von: Han, Haonan, et al.
Veröffentlicht: (2024)
RealGen: Photorealistic Text-to-Image Generation via Detector-Guided Rewards
von: Ye, Junyan, et al.
Veröffentlicht: (2025)
von: Ye, Junyan, et al.
Veröffentlicht: (2025)
Echo-4o: Harnessing the Power of GPT-4o Synthetic Images for Improved Image Generation
von: Ye, Junyan, et al.
Veröffentlicht: (2025)
von: Ye, Junyan, et al.
Veröffentlicht: (2025)
Laytrol: Preserving Pretrained Knowledge in Layout Control for Multimodal Diffusion Transformers
von: Huang, Sida, et al.
Veröffentlicht: (2025)
von: Huang, Sida, et al.
Veröffentlicht: (2025)
Reference-Steering via Data-Driven Predictive Control for Hyper-Accurate Robotic Flying-Hopping Locomotion
von: Zeng, Yicheng, et al.
Veröffentlicht: (2024)
von: Zeng, Yicheng, et al.
Veröffentlicht: (2024)
AeSlides: Incentivizing Aesthetic Layout in LLM-Based Slide Generation via Verifiable Rewards
von: Pan, Yiming, et al.
Veröffentlicht: (2026)
von: Pan, Yiming, et al.
Veröffentlicht: (2026)
CV-Cities: Advancing Cross-View Geo-Localization in Global Cities
von: Huang, Gaoshuang, et al.
Veröffentlicht: (2024)
von: Huang, Gaoshuang, et al.
Veröffentlicht: (2024)
Piano di Ricerca, Sperimentazione, Testing e Validazione, Assets SmartCity
von: Salis, Antonio
Veröffentlicht: (2025)
von: Salis, Antonio
Veröffentlicht: (2025)
Imagine a City: CityGenAgent for Procedural 3D City Generation
von: Liu, Zishan, et al.
Veröffentlicht: (2026)
von: Liu, Zishan, et al.
Veröffentlicht: (2026)
SG-BEV: Satellite-Guided BEV Fusion for Cross-View Semantic Segmentation
von: Ye, Junyan, et al.
Veröffentlicht: (2024)
von: Ye, Junyan, et al.
Veröffentlicht: (2024)
Conversational Disease Diagnosis via External Planner-Controlled Large Language Models
von: Sun, Zhoujian, et al.
Veröffentlicht: (2024)
von: Sun, Zhoujian, et al.
Veröffentlicht: (2024)
Towards Invariant Time Series Forecasting in Smart Cities
von: Zhang, Ziyi, et al.
Veröffentlicht: (2024)
von: Zhang, Ziyi, et al.
Veröffentlicht: (2024)
LayoutCoT: Unleashing the Deep Reasoning Potential of Large Language Models for Layout Generation
von: Shi, Hengyu, et al.
Veröffentlicht: (2025)
von: Shi, Hengyu, et al.
Veröffentlicht: (2025)
OmniDocLayout: Towards Diverse Document Layout Generation via Coarse-to-Fine LLM Learning
von: Kang, Hengrui, et al.
Veröffentlicht: (2025)
von: Kang, Hengrui, et al.
Veröffentlicht: (2025)
Leveraging BEV Paradigm for Ground-to-Aerial Image Synthesis
von: Ye, Junyan, et al.
Veröffentlicht: (2024)
von: Ye, Junyan, et al.
Veröffentlicht: (2024)
FakeVLM-R1: Internalizing Physical Laws via CoT for Synthetic Image Detection
von: Zhu, Leqi, et al.
Veröffentlicht: (2026)
von: Zhu, Leqi, et al.
Veröffentlicht: (2026)
Textual Aesthetics in Large Language Models
von: Jiang, Lingjie, et al.
Veröffentlicht: (2024)
von: Jiang, Lingjie, et al.
Veröffentlicht: (2024)
Optimal dynamic climate adaptation pathways: a case study of New York City
von: Truong, Chi, et al.
Veröffentlicht: (2024)
von: Truong, Chi, et al.
Veröffentlicht: (2024)
Thermal Analysis of 3D GPU-Memory Architectures with Boron Nitride Interposer
von: Wang, Eric Han, et al.
Veröffentlicht: (2025)
von: Wang, Eric Han, et al.
Veröffentlicht: (2025)
Where am I? Cross-View Geo-localization with Natural Language Descriptions
von: Ye, Junyan, et al.
Veröffentlicht: (2024)
von: Ye, Junyan, et al.
Veröffentlicht: (2024)
CityDreamer: Compositional Generative Model of Unbounded 3D Cities
von: Xie, Haozhe, et al.
Veröffentlicht: (2023)
von: Xie, Haozhe, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Scene4U: Hierarchical Layered 3D Scene Reconstruction from Single Panoramic Image for Your Immerse Exploration
von: Huang, Zilong, et al.
Veröffentlicht: (2025) -
UrbanFeel: A Comprehensive Benchmark for Temporal and Perceptual Understanding of City Scenes through Human Perspective
von: He, Jun, et al.
Veröffentlicht: (2025) -
CityGen: Infinite and Controllable City Layout Generation
von: Deng, Jie, et al.
Veröffentlicht: (2023) -
GenClaw: Code-Driven Agentic Image Generation
von: Ye, Junyan, et al.
Veröffentlicht: (2026) -
CrossViewDiff: A Cross-View Diffusion Model for Satellite-to-Street View Synthesis
von: Li, Weijia, et al.
Veröffentlicht: (2024)