RoBus: A Multimodal Dataset for Controllable Road Networks and Building Layouts Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Tao, Li, Ruihang, Zheng, Huangnan, Ye, Shanding, Li, Shijian, Pan, Zhijie |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sketch-to-Layout: Sketch-Guided Multimodal Layout Generation
par: Brioschi, Riccardo, et autres
Publié: (2025)
par: Brioschi, Riccardo, et autres
Publié: (2025)
ProductWebGen: Benchmarking Multimodal Product Webpage Generation
par: Liu, Zhihong, et autres
Publié: (2026)
par: Liu, Zhihong, et autres
Publié: (2026)
LayoutDiffusion: Controllable Diffusion Model for Layout-to-image Generation
par: Zheng, Guangcong, et autres
Publié: (2023)
par: Zheng, Guangcong, et autres
Publié: (2023)
LayoutDiT: Exploring Content-Graphic Balance in Layout Generation with Diffusion Transformer
par: Li, Yu, et autres
Publié: (2024)
par: Li, Yu, et autres
Publié: (2024)
ComposeAnyone: Controllable Layout-to-Human Generation with Decoupled Multimodal Conditions
par: Zhang, Shiyue, et autres
Publié: (2025)
par: Zhang, Shiyue, et autres
Publié: (2025)
M3DLayout: A Multi-Source Dataset of 3D Indoor Layouts and Structured Descriptions for 3D Generation
par: Zhang, Yiheng, et autres
Publié: (2025)
par: Zhang, Yiheng, et autres
Publié: (2025)
Layout-Conditioned Autoregressive Text-to-Image Generation via Structured Masking
par: Zheng, Zirui, et autres
Publié: (2025)
par: Zheng, Zirui, et autres
Publié: (2025)
A Framework For Image Synthesis Using Supervised Contrastive Learning
par: Liu, Yibin, et autres
Publié: (2024)
par: Liu, Yibin, et autres
Publié: (2024)
ContextGen: Contextual Layout Anchoring for Identity-Consistent Multi-Instance Generation
par: Xu, Ruihang, et autres
Publié: (2025)
par: Xu, Ruihang, et autres
Publié: (2025)
From Pixels to Progress: Generating Road Network from Satellite Imagery for Socioeconomic Insights in Impoverished Areas
par: Xi, Yanxin, et autres
Publié: (2024)
par: Xi, Yanxin, et autres
Publié: (2024)
UniCMs: A Unified Consistency Model For Efficient Multimodal Generation and Understanding
par: Xu, Chenkai, et autres
Publié: (2025)
par: Xu, Chenkai, et autres
Publié: (2025)
Training-free Composite Scene Generation for Layout-to-Image Synthesis
par: Liu, Jiaqi, et autres
Publié: (2024)
par: Liu, Jiaqi, et autres
Publié: (2024)
RoDLA: Benchmarking the Robustness of Document Layout Analysis Models
par: Chen, Yufan, et autres
Publié: (2024)
par: Chen, Yufan, et autres
Publié: (2024)
GIF: A Conditional Multimodal Generative Framework for IR Drop Imaging in Chip Layouts
par: Thorat, Kiran, et autres
Publié: (2026)
par: Thorat, Kiran, et autres
Publié: (2026)
Prim2Room: Layout-Controllable Room Mesh Generation from Primitives
par: Feng, Chengzeng, et autres
Publié: (2024)
par: Feng, Chengzeng, et autres
Publié: (2024)
RanLayNet: A Dataset for Document Layout Detection used for Domain Adaptation and Generalization
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
DesignSense: A Human Preference Dataset and Reward Modeling Framework for Graphic Layout Generation
par: Gopal, Varun, et autres
Publié: (2026)
par: Gopal, Varun, et autres
Publié: (2026)
Multi-level Matching Network for Multimodal Entity Linking
par: Hu, Zhiwei, et autres
Publié: (2024)
par: Hu, Zhiwei, et autres
Publié: (2024)
Relation-Aware Diffusion Model for Controllable Poster Layout Generation
par: Li, Fengheng, et autres
Publié: (2023)
par: Li, Fengheng, et autres
Publié: (2023)
ConsistCompose: Unified Multimodal Layout Control for Image Composition
par: Shi, Xuanke, et autres
Publié: (2025)
par: Shi, Xuanke, et autres
Publié: (2025)
MCN-CL: Multimodal Cross-Attention Network and Contrastive Learning for Multimodal Emotion Recognition
par: Li, Feng, et autres
Publié: (2025)
par: Li, Feng, et autres
Publié: (2025)
LayoutVLM: Differentiable Optimization of 3D Layout via Vision-Language Models
par: Sun, Fan-Yun, et autres
Publié: (2024)
par: Sun, Fan-Yun, et autres
Publié: (2024)
LAYOUTDREAMER: Physics-guided Layout for Text-to-3D Compositional Scene Generation
par: Zhou, Yang, et autres
Publié: (2025)
par: Zhou, Yang, et autres
Publié: (2025)
Direct Numerical Layout Generation for 3D Indoor Scene Synthesis via Spatial Reasoning
par: Ran, Xingjian, et autres
Publié: (2025)
par: Ran, Xingjian, et autres
Publié: (2025)
Versatile Multimodal Controls for Expressive Talking Human Animation
par: Qin, Zheng, et autres
Publié: (2025)
par: Qin, Zheng, et autres
Publié: (2025)
Generative Universal Verifier as Multimodal Meta-Reasoner
par: Zhang, Xinchen, et autres
Publié: (2025)
par: Zhang, Xinchen, et autres
Publié: (2025)
SciPostLayout: A Dataset for Layout Analysis and Layout Generation of Scientific Posters
par: Tanaka, Shohei, et autres
Publié: (2024)
par: Tanaka, Shohei, et autres
Publié: (2024)
Layout-Aware Representation Learning for Open-Set ID Fraud Discovery
par: Li, Jinxing, et autres
Publié: (2026)
par: Li, Jinxing, et autres
Publié: (2026)
ReRoPE: Repurposing RoPE for Relative Camera Control
par: Li, Chunyang, et autres
Publié: (2026)
par: Li, Chunyang, et autres
Publié: (2026)
Official-NV: An LLM-Generated News Video Dataset for Multimodal Fake News Detection
par: Wang, Yihao, et autres
Publié: (2024)
par: Wang, Yihao, et autres
Publié: (2024)
OmniCam: Unified Multimodal Video Generation via Camera Control
par: Yang, Xiaoda, et autres
Publié: (2025)
par: Yang, Xiaoda, et autres
Publié: (2025)
Brain-CLIPLM: Decoding Compressed Semantic Representations in EEG for Language Reconstruction
par: Yang, Xiaoli, et autres
Publié: (2026)
par: Yang, Xiaoli, et autres
Publié: (2026)
V-RoAst: Visual Road Assessment. Can VLM be a Road Safety Assessor Using the iRAP Standard?
par: Jongwiriyanurak, Natchapon, et autres
Publié: (2024)
par: Jongwiriyanurak, Natchapon, et autres
Publié: (2024)
SlideCoder: Layout-aware RAG-enhanced Hierarchical Slide Generation from Design
par: Tang, Wenxin, et autres
Publié: (2025)
par: Tang, Wenxin, et autres
Publié: (2025)
DeepGen 1.0: A Lightweight Unified Multimodal Model for Advancing Image Generation and Editing
par: Wang, Dianyi, et autres
Publié: (2026)
par: Wang, Dianyi, et autres
Publié: (2026)
Genixer: Empowering Multimodal Large Language Models as a Powerful Data Generator
par: Zhao, Henry Hengyuan, et autres
Publié: (2023)
par: Zhao, Henry Hengyuan, et autres
Publié: (2023)
DogLayout: Denoising Diffusion GAN for Discrete and Continuous Layout Generation
par: Gan, Zhaoxing, et autres
Publié: (2024)
par: Gan, Zhaoxing, et autres
Publié: (2024)
AdvDMD: Adversarial Reward Meets DMD For High-Quality Few-Step Generation
par: Wang, Xu, et autres
Publié: (2026)
par: Wang, Xu, et autres
Publié: (2026)
Region Prompt Tuning: Fine-grained Scene Text Detection Utilizing Region Text Prompt
par: Lin, Xingtao, et autres
Publié: (2024)
par: Lin, Xingtao, et autres
Publié: (2024)
UniSVG: A Unified Dataset for Vector Graphic Understanding and Generation with Multimodal Large Language Models
par: Li, Jinke, et autres
Publié: (2025)
par: Li, Jinke, et autres
Publié: (2025)
Documents similaires
-
Sketch-to-Layout: Sketch-Guided Multimodal Layout Generation
par: Brioschi, Riccardo, et autres
Publié: (2025) -
ProductWebGen: Benchmarking Multimodal Product Webpage Generation
par: Liu, Zhihong, et autres
Publié: (2026) -
LayoutDiffusion: Controllable Diffusion Model for Layout-to-image Generation
par: Zheng, Guangcong, et autres
Publié: (2023) -
LayoutDiT: Exploring Content-Graphic Balance in Layout Generation with Diffusion Transformer
par: Li, Yu, et autres
Publié: (2024) -
ComposeAnyone: Controllable Layout-to-Human Generation with Decoupled Multimodal Conditions
par: Zhang, Shiyue, et autres
Publié: (2025)