CityGen: Infinite and Controllable City Layout Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Deng, Jie, Chai, Wenhao, Guo, Jianshu, Huang, Qixuan, Huang, Junsheng, Hu, Wenhao, Hao, Shengyu, Hwang, Jenq-Neng, Wang, Gaoang |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CityCraft: A Real Crafter for 3D City Generation
par: Deng, Jie, et autres
Publié: (2024)
par: Deng, Jie, et autres
Publié: (2024)
Pointmap Association and Piecewise-Plane Constraint for Consistent and Compact 3D Gaussian Segmentation Field
par: Hu, Wenhao, et autres
Publié: (2025)
par: Hu, Wenhao, et autres
Publié: (2025)
VersaT2I: Improving Text-to-Image Models with Versatile Reward
par: Guo, Jianshu, et autres
Publié: (2024)
par: Guo, Jianshu, et autres
Publié: (2024)
MovieChat+: Question-aware Sparse Memory for Long Video Question Answering
par: Song, Enxin, et autres
Publié: (2024)
par: Song, Enxin, et autres
Publié: (2024)
MPM: A Unified 2D-3D Human Pose Representation via Masked Pose Modeling
par: Zhang, Zhenyu, et autres
Publié: (2023)
par: Zhang, Zhenyu, et autres
Publié: (2023)
Recent Advances in Embedding Methods for Multi-Object Tracking: A Survey
par: Wang, Gaoang, et autres
Publié: (2022)
par: Wang, Gaoang, et autres
Publié: (2022)
SAMURAI: Adapting Segment Anything Model for Zero-Shot Visual Tracking with Motion-Aware Memory
par: Yang, Cheng-Yen, et autres
Publié: (2024)
par: Yang, Cheng-Yen, et autres
Publié: (2024)
MambaMOT: State-Space Model as Motion Predictor for Multi-Object Tracking
par: Huang, Hsiang-Wei, et autres
Publié: (2024)
par: Huang, Hsiang-Wei, et autres
Publié: (2024)
ToSA: Token Merging with Spatial Awareness
par: Huang, Hsiang-Wei, et autres
Publié: (2025)
par: Huang, Hsiang-Wei, et autres
Publié: (2025)
Understanding Dynamic Scenes in Ego Centric 4D Point Clouds
par: Huang, Junsheng, et autres
Publié: (2025)
par: Huang, Junsheng, et autres
Publié: (2025)
PackDiT: Joint Human Motion and Text Generation via Mutual Prompting
par: Jiang, Zhongyu, et autres
Publié: (2025)
par: Jiang, Zhongyu, et autres
Publié: (2025)
UniHPR: Unified Human Pose Representation via Singular Value Contrastive Learning
par: Jiang, Zhongyu, et autres
Publié: (2025)
par: Jiang, Zhongyu, et autres
Publié: (2025)
Reasoning Matters for 3D Visual Grounding
par: Huang, Hsiang-Wei, et autres
Publié: (2026)
par: Huang, Hsiang-Wei, et autres
Publié: (2026)
Blind Inpainting with Object-aware Discrimination for Artificial Marker Removal
par: Guo, Xuechen, et autres
Publié: (2023)
par: Guo, Xuechen, et autres
Publié: (2023)
MajutsuCity: Language-driven Aesthetic-adaptive City Generation with Controllable 3D Assets and Layouts
par: Huang, Zilong, et autres
Publié: (2025)
par: Huang, Zilong, et autres
Publié: (2025)
LLaVA-Ultra: Large Chinese Language and Vision Assistant for Ultrasound
par: Guo, Xuechen, et autres
Publié: (2024)
par: Guo, Xuechen, et autres
Publié: (2024)
MovieChat: From Dense Token to Sparse Memory for Long Video Understanding
par: Song, Enxin, et autres
Publié: (2023)
par: Song, Enxin, et autres
Publié: (2023)
RT-Pose: A 4D Radar Tensor-based 3D Human Pose Estimation and Localization Benchmark
par: Ho, Yuan-Hao, et autres
Publié: (2024)
par: Ho, Yuan-Hao, et autres
Publié: (2024)
User-Aware Prefix-Tuning is a Good Learner for Personalized Image Captioning
par: Wang, Xuan, et autres
Publié: (2023)
par: Wang, Xuan, et autres
Publié: (2023)
Boosting Online 3D Multi-Object Tracking through Camera-Radar Cross Check
par: Kuan, Sheng-Yao, et autres
Publié: (2024)
par: Kuan, Sheng-Yao, et autres
Publié: (2024)
Imagine a City: CityGenAgent for Procedural 3D City Generation
par: Liu, Zishan, et autres
Publié: (2026)
par: Liu, Zishan, et autres
Publié: (2026)
DSG-World: Learning a 3D Gaussian World Model from Dual State Videos
par: Hu, Wenhao, et autres
Publié: (2025)
par: Hu, Wenhao, et autres
Publié: (2025)
Hand3R: Online 4D Hand-Scene Reconstruction in the Wild
par: Hu, Wendi, et autres
Publié: (2026)
par: Hu, Wendi, et autres
Publié: (2026)
ProTPS: Prototype-Guided Text Prompt Selection for Continual Learning
par: Mei, Jie, et autres
Publié: (2026)
par: Mei, Jie, et autres
Publié: (2026)
AuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark
par: Chai, Wenhao, et autres
Publié: (2024)
par: Chai, Wenhao, et autres
Publié: (2024)
AuroraLong: Bringing RNNs Back to Efficient Open-Ended Video Understanding
par: Xu, Weili, et autres
Publié: (2025)
par: Xu, Weili, et autres
Publié: (2025)
Hierarchical Auto-Organizing System for Open-Ended Multi-Agent Navigation
par: Zhao, Zhonghan, et autres
Publié: (2024)
par: Zhao, Zhonghan, et autres
Publié: (2024)
Ego3DT: Tracking Every 3D Object in Ego-centric Videos
par: Hao, Shengyu, et autres
Publié: (2024)
par: Hao, Shengyu, et autres
Publié: (2024)
DAug: Diffusion-based Channel Augmentation for Radiology Image Retrieval and Classification
par: Jin, Ying, et autres
Publié: (2024)
par: Jin, Ying, et autres
Publié: (2024)
Technical Report for ReID-SAM on SkiTB Visual Tracking Challenge 2025
par: Li, Kunjun, et autres
Publié: (2025)
par: Li, Kunjun, et autres
Publié: (2025)
MonoTAKD: Teaching Assistant Knowledge Distillation for Monocular 3D Object Detection
par: Liu, Hou-I, et autres
Publié: (2024)
par: Liu, Hou-I, et autres
Publié: (2024)
A Density-Guided Temporal Attention Transformer for Indiscernible Object Counting in Underwater Video
par: Yang, Cheng-Yen, et autres
Publié: (2024)
par: Yang, Cheng-Yen, et autres
Publié: (2024)
Video-MMLU: A Massive Multi-Discipline Lecture Understanding Benchmark
par: Song, Enxin, et autres
Publié: (2025)
par: Song, Enxin, et autres
Publié: (2025)
GTA: Global Tracklet Association for Multi-Object Tracking in Sports
par: Sun, Jiacheng, et autres
Publié: (2024)
par: Sun, Jiacheng, et autres
Publié: (2024)
Self-supervised Photographic Image Layout Representation Learning
par: Zhao, Zhaoran, et autres
Publié: (2024)
par: Zhao, Zhaoran, et autres
Publié: (2024)
COHO: Context-Sensitive City-Scale Hierarchical Urban Layout Generation
par: He, Liu, et autres
Publié: (2024)
par: He, Liu, et autres
Publié: (2024)
X-MoGen: Unified Motion Generation across Humans and Animals
par: Wang, Xuan, et autres
Publié: (2025)
par: Wang, Xuan, et autres
Publié: (2025)
Exploring Probabilistic Modeling Beyond Domain Generalization for Semantic Segmentation
par: Chen, I-Hsiang, et autres
Publié: (2025)
par: Chen, I-Hsiang, et autres
Publié: (2025)
ScalingGaussian: Enhancing 3D Content Creation with Generative Gaussian Splatting
par: Chen, Shen, et autres
Publié: (2024)
par: Chen, Shen, et autres
Publié: (2024)
CaMo: Camera Motion Grounded Evaluation and Training for Vision-Language Models
par: Huang, Hsiang-Wei, et autres
Publié: (2026)
par: Huang, Hsiang-Wei, et autres
Publié: (2026)
Documents similaires
-
CityCraft: A Real Crafter for 3D City Generation
par: Deng, Jie, et autres
Publié: (2024) -
Pointmap Association and Piecewise-Plane Constraint for Consistent and Compact 3D Gaussian Segmentation Field
par: Hu, Wenhao, et autres
Publié: (2025) -
VersaT2I: Improving Text-to-Image Models with Versatile Reward
par: Guo, Jianshu, et autres
Publié: (2024) -
MovieChat+: Question-aware Sparse Memory for Long Video Question Answering
par: Song, Enxin, et autres
Publié: (2024) -
MPM: A Unified 2D-3D Human Pose Representation via Masked Pose Modeling
par: Zhang, Zhenyu, et autres
Publié: (2023)