Generate Any Scene: Scene Graph Driven Data Synthesis for Visual Generation Training
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gao, Ziqi, Huang, Weikai, Zhang, Jieyu, Kembhavi, Aniruddha, Krishna, Ranjay |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Task Me Anything
von: Zhang, Jieyu, et al.
Veröffentlicht: (2024)
von: Zhang, Jieyu, et al.
Veröffentlicht: (2024)
Iterated Learning Improves Compositionality in Large Vision-Language Models
von: Zheng, Chenhao, et al.
Veröffentlicht: (2024)
von: Zheng, Chenhao, et al.
Veröffentlicht: (2024)
Synthetic Object Compositions for Scalable and Accurate Learning in Detection, Segmentation, and Grounding
von: Huang, Weikai, et al.
Veröffentlicht: (2025)
von: Huang, Weikai, et al.
Veröffentlicht: (2025)
Selective Visual Representations Improve Convergence and Generalization for Embodied AI
von: Eftekhar, Ainaz, et al.
Veröffentlicht: (2023)
von: Eftekhar, Ainaz, et al.
Veröffentlicht: (2023)
One Diffusion to Generate Them All
von: Le, Duong H., et al.
Veröffentlicht: (2024)
von: Le, Duong H., et al.
Veröffentlicht: (2024)
Davidsonian Scene Graph: Improving Reliability in Fine-grained Evaluation for Text-to-Image Generation
von: Cho, Jaemin, et al.
Veröffentlicht: (2023)
von: Cho, Jaemin, et al.
Veröffentlicht: (2023)
EchoScene: Indoor Scene Generation via Information Echo over Scene Graph Diffusion
von: Zhai, Guangyao, et al.
Veröffentlicht: (2024)
von: Zhai, Guangyao, et al.
Veröffentlicht: (2024)
One Trajectory, One Token: Grounded Video Tokenization via Panoptic Sub-object Trajectory
von: Zheng, Chenhao, et al.
Veröffentlicht: (2025)
von: Zheng, Chenhao, et al.
Veröffentlicht: (2025)
Training-free Composite Scene Generation for Layout-to-Image Synthesis
von: Liu, Jiaqi, et al.
Veröffentlicht: (2024)
von: Liu, Jiaqi, et al.
Veröffentlicht: (2024)
MIMIC: Masked Image Modeling with Image Correspondences
von: Marathe, Kalyani, et al.
Veröffentlicht: (2023)
von: Marathe, Kalyani, et al.
Veröffentlicht: (2023)
ESCA: Contextualizing Embodied Agents via Scene-Graph Generation
von: Huang, Jiani, et al.
Veröffentlicht: (2025)
von: Huang, Jiani, et al.
Veröffentlicht: (2025)
Synthetic Visual Genome 2: Extracting Large-scale Spatio-Temporal Scene Graphs from Videos
von: Gao, Ziqi, et al.
Veröffentlicht: (2026)
von: Gao, Ziqi, et al.
Veröffentlicht: (2026)
Enhancing Scene Graph Generation with Hierarchical Relationships and Commonsense Knowledge
von: Jiang, Bowen, et al.
Veröffentlicht: (2023)
von: Jiang, Bowen, et al.
Veröffentlicht: (2023)
SceneLLM: Implicit Language Reasoning in LLM for Dynamic Scene Graph Generation
von: Zhang, Hang, et al.
Veröffentlicht: (2024)
von: Zhang, Hang, et al.
Veröffentlicht: (2024)
GenXD: Generating Any 3D and 4D Scenes
von: Zhao, Yuyang, et al.
Veröffentlicht: (2024)
von: Zhao, Yuyang, et al.
Veröffentlicht: (2024)
Neuro-Symbolic Scene Graph Conditioning for Synthetic Image Dataset Generation
von: Savazzi, Giacomo, et al.
Veröffentlicht: (2025)
von: Savazzi, Giacomo, et al.
Veröffentlicht: (2025)
3D-SceneDreamer: Text-Driven 3D-Consistent Scene Generation
von: Zhang, Frank, et al.
Veröffentlicht: (2024)
von: Zhang, Frank, et al.
Veröffentlicht: (2024)
ALF: Adaptive Label Finetuning for Scene Graph Generation
von: Chen, Qishen, et al.
Veröffentlicht: (2023)
von: Chen, Qishen, et al.
Veröffentlicht: (2023)
You Only Judge Once: Multi-response Reward Modeling in a Single Forward Pass
von: Yang, Yinuo, et al.
Veröffentlicht: (2026)
von: Yang, Yinuo, et al.
Veröffentlicht: (2026)
PhyScene: Physically Interactable 3D Scene Synthesis for Embodied AI
von: Yang, Yandan, et al.
Veröffentlicht: (2024)
von: Yang, Yandan, et al.
Veröffentlicht: (2024)
MMGDreamer: Mixed-Modality Graph for Geometry-Controllable 3D Indoor Scene Generation
von: Yang, Zhifei, et al.
Veröffentlicht: (2025)
von: Yang, Zhifei, et al.
Veröffentlicht: (2025)
MagicDrive3D: Controllable 3D Generation for Any-View Rendering in Street Scenes
von: Gao, Ruiyuan, et al.
Veröffentlicht: (2024)
von: Gao, Ruiyuan, et al.
Veröffentlicht: (2024)
BetterScene: 3D Scene Synthesis with Representation-Aligned Generative Model
von: Han, Yuci, et al.
Veröffentlicht: (2026)
von: Han, Yuci, et al.
Veröffentlicht: (2026)
SGTR+: End-to-end Scene Graph Generation with Transformer
von: Li, Rongjie, et al.
Veröffentlicht: (2024)
von: Li, Rongjie, et al.
Veröffentlicht: (2024)
HetScene: Heterogeneity-Aware Diffusion for Dense Indoor Scene Generation
von: Chen, Zini, et al.
Veröffentlicht: (2026)
von: Chen, Zini, et al.
Veröffentlicht: (2026)
LLM4SGG: Large Language Models for Weakly Supervised Scene Graph Generation
von: Kim, Kibum, et al.
Veröffentlicht: (2023)
von: Kim, Kibum, et al.
Veröffentlicht: (2023)
OptiScene: LLM-driven Indoor Scene Layout Generation via Scaled Human-aligned Data Synthesis and Multi-Stage Preference Optimization
von: Yang, Yixuan, et al.
Veröffentlicht: (2025)
von: Yang, Yixuan, et al.
Veröffentlicht: (2025)
Attention over Scene Graphs: Indoor Scene Representations Toward CSAI Classification
von: Barros, Artur, et al.
Veröffentlicht: (2025)
von: Barros, Artur, et al.
Veröffentlicht: (2025)
BloomScene: Lightweight Structured 3D Gaussian Splatting for Crossmodal Scene Generation
von: Hou, Xiaolu, et al.
Veröffentlicht: (2025)
von: Hou, Xiaolu, et al.
Veröffentlicht: (2025)
4D Panoptic Scene Graph Generation
von: Yang, Jingkang, et al.
Veröffentlicht: (2024)
von: Yang, Jingkang, et al.
Veröffentlicht: (2024)
When Rubrics Fail: Error Enumeration as Reward in Reference-Free RL Post-Training for Virtual Try-On
von: Ikezogwo, Wisdom, et al.
Veröffentlicht: (2026)
von: Ikezogwo, Wisdom, et al.
Veröffentlicht: (2026)
EfficientTrain++: Generalized Curriculum Learning for Efficient Visual Backbone Training
von: Wang, Yulin, et al.
Veröffentlicht: (2024)
von: Wang, Yulin, et al.
Veröffentlicht: (2024)
SceneX: Procedural Controllable Large-scale Scene Generation
von: Zhou, Mengqi, et al.
Veröffentlicht: (2024)
von: Zhou, Mengqi, et al.
Veröffentlicht: (2024)
ArtiScene: Language-Driven Artistic 3D Scene Generation Through Image Intermediary
von: Gu, Zeqi, et al.
Veröffentlicht: (2025)
von: Gu, Zeqi, et al.
Veröffentlicht: (2025)
Feature Splatting: Language-Driven Physics-Based Scene Synthesis and Editing
von: Qiu, Ri-Zhao, et al.
Veröffentlicht: (2024)
von: Qiu, Ri-Zhao, et al.
Veröffentlicht: (2024)
Videoshop: Localized Semantic Video Editing with Noise-Extrapolated Diffusion Inversion
von: Fan, Xiang, et al.
Veröffentlicht: (2024)
von: Fan, Xiang, et al.
Veröffentlicht: (2024)
Exposing and Addressing Cross-Task Inconsistency in Unified Vision-Language Models
von: Maharana, Adyasha, et al.
Veröffentlicht: (2023)
von: Maharana, Adyasha, et al.
Veröffentlicht: (2023)
RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion
von: Shriram, Jaidev, et al.
Veröffentlicht: (2024)
von: Shriram, Jaidev, et al.
Veröffentlicht: (2024)
Harmonic Mobile Manipulation
von: Yang, Ruihan, et al.
Veröffentlicht: (2023)
von: Yang, Ruihan, et al.
Veröffentlicht: (2023)
Seen-to-Scene: Keep the Seen, Generate the Unseen for Video Outpainting
von: Jeon, Inseok, et al.
Veröffentlicht: (2026)
von: Jeon, Inseok, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Task Me Anything
von: Zhang, Jieyu, et al.
Veröffentlicht: (2024) -
Iterated Learning Improves Compositionality in Large Vision-Language Models
von: Zheng, Chenhao, et al.
Veröffentlicht: (2024) -
Synthetic Object Compositions for Scalable and Accurate Learning in Detection, Segmentation, and Grounding
von: Huang, Weikai, et al.
Veröffentlicht: (2025) -
Selective Visual Representations Improve Convergence and Generalization for Embodied AI
von: Eftekhar, Ainaz, et al.
Veröffentlicht: (2023) -
One Diffusion to Generate Them All
von: Le, Duong H., et al.
Veröffentlicht: (2024)