GPT4SGG: Synthesizing Scene Graphs from Holistic and Region-specific Narratives
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Zuyao, Wu, Jinlin, Lei, Zhen, Zhang, Zhaoxiang, Chen, Changwen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Expanding Scene Graph Boundaries: Fully Open-vocabulary Scene Graph Generation via Visual-Concept Alignment and Retention
di: Chen, Zuyao, et al.
Pubblicazione: (2023)
di: Chen, Zuyao, et al.
Pubblicazione: (2023)
What Makes a Scene ? Scene Graph-based Evaluation and Feedback for Controllable Generation
di: Chen, Zuyao, et al.
Pubblicazione: (2024)
di: Chen, Zuyao, et al.
Pubblicazione: (2024)
From Data to Modeling: Fully Open-vocabulary Scene Graph Generation
di: Chen, Zuyao, et al.
Pubblicazione: (2025)
di: Chen, Zuyao, et al.
Pubblicazione: (2025)
Compile Scene Graphs with Reinforcement Learning
di: Chen, Zuyao, et al.
Pubblicazione: (2025)
di: Chen, Zuyao, et al.
Pubblicazione: (2025)
CAGE-SGG: Counterfactual Active Graph Evidence for Open-Vocabulary Scene Graph Generation
di: Guang, Suiyang, et al.
Pubblicazione: (2026)
di: Guang, Suiyang, et al.
Pubblicazione: (2026)
Hydra-SGG: Hybrid Relation Assignment for One-stage Scene Graph Generation
di: Chen, Minghan, et al.
Pubblicazione: (2024)
di: Chen, Minghan, et al.
Pubblicazione: (2024)
VOST-SGG: VLM-Aided One-Stage Spatio-Temporal Scene Graph Generation
di: Sugandhika, Chinthani, et al.
Pubblicazione: (2025)
di: Sugandhika, Chinthani, et al.
Pubblicazione: (2025)
HiKER-SGG: Hierarchical Knowledge Enhanced Robust Scene Graph Generation
di: Zhang, Ce, et al.
Pubblicazione: (2024)
di: Zhang, Ce, et al.
Pubblicazione: (2024)
Salience-SGG: Enhancing Unbiased Scene Graph Generation with Iterative Salience Estimation
di: Qu, Runfeng, et al.
Pubblicazione: (2026)
di: Qu, Runfeng, et al.
Pubblicazione: (2026)
ReLIC-SGG: Relation Lattice Completion for Open-Vocabulary Scene Graph Generation
di: Hosseini, Amir, et al.
Pubblicazione: (2026)
di: Hosseini, Amir, et al.
Pubblicazione: (2026)
RA-SGG: Retrieval-Augmented Scene Graph Generation Framework via Multi-Prototype Learning
di: Yoon, Kanghoon, et al.
Pubblicazione: (2024)
di: Yoon, Kanghoon, et al.
Pubblicazione: (2024)
LLaVA-SpaceSGG: Visual Instruct Tuning for Open-vocabulary Scene Graph Generation with Enhanced Spatial Relations
di: Xu, Mingjie, et al.
Pubblicazione: (2024)
di: Xu, Mingjie, et al.
Pubblicazione: (2024)
LLM4SGG: Large Language Models for Weakly Supervised Scene Graph Generation
di: Kim, Kibum, et al.
Pubblicazione: (2023)
di: Kim, Kibum, et al.
Pubblicazione: (2023)
Generating on Generated: An Approach Towards Self-Evolving Diffusion Models
di: Zhang, Xulu, et al.
Pubblicazione: (2025)
di: Zhang, Xulu, et al.
Pubblicazione: (2025)
SGG-R$^{\rm 3}$: From Next-Token Prediction to End-to-End Unbiased Scene Graph Generation
di: Feng, Jiaye, et al.
Pubblicazione: (2026)
di: Feng, Jiaye, et al.
Pubblicazione: (2026)
SA-Person: Text-Based Person Retrieval with Scene-aware Re-ranking
di: Xu, Yingjia, et al.
Pubblicazione: (2025)
di: Xu, Yingjia, et al.
Pubblicazione: (2025)
Towards Holistic Surgical Scene Graph
di: Shin, Jongmin, et al.
Pubblicazione: (2025)
di: Shin, Jongmin, et al.
Pubblicazione: (2025)
Compositional Inversion for Stable Diffusion Models
di: Zhang, Xulu, et al.
Pubblicazione: (2023)
di: Zhang, Xulu, et al.
Pubblicazione: (2023)
Generative Active Learning for Image Synthesis Personalization
di: Zhang, Xulu, et al.
Pubblicazione: (2024)
di: Zhang, Xulu, et al.
Pubblicazione: (2024)
Open Vocabulary 3D Scene Understanding via Geometry Guided Self-Distillation
di: Wang, Pengfei, et al.
Pubblicazione: (2024)
di: Wang, Pengfei, et al.
Pubblicazione: (2024)
Synthesize, Diagnose, and Optimize: Towards Fine-Grained Vision-Language Understanding
di: Peng, Wujian, et al.
Pubblicazione: (2023)
di: Peng, Wujian, et al.
Pubblicazione: (2023)
Robo-SGG: Exploiting Layout-Oriented Normalization and Restitution Can Improve Robust Scene Graph Generation
di: Lv, Changsheng, et al.
Pubblicazione: (2025)
di: Lv, Changsheng, et al.
Pubblicazione: (2025)
DrivingGPT: Unifying Driving World Modeling and Planning with Multi-modal Autoregressive Transformers
di: Chen, Yuntao, et al.
Pubblicazione: (2024)
di: Chen, Yuntao, et al.
Pubblicazione: (2024)
Endo-4DGX: Robust Endoscopic Scene Reconstruction and Illumination Correction with Gaussian Splatting
di: Huang, Yiming, et al.
Pubblicazione: (2025)
di: Huang, Yiming, et al.
Pubblicazione: (2025)
Anatomy-R1: Enhancing Anatomy Reasoning in Multimodal Large Language Models via Anatomical Similarity Curriculum and Group Diversity Augmentation
di: Song, Ziyang, et al.
Pubblicazione: (2025)
di: Song, Ziyang, et al.
Pubblicazione: (2025)
A Survey on Personalized Content Synthesis with Diffusion Models
di: Zhang, Xulu, et al.
Pubblicazione: (2024)
di: Zhang, Xulu, et al.
Pubblicazione: (2024)
Advancing Complex Wide-Area Scene Understanding with Hierarchical Coresets Selection
di: Wang, Jingyao, et al.
Pubblicazione: (2025)
di: Wang, Jingyao, et al.
Pubblicazione: (2025)
Monocular Occupancy Prediction for Scalable Indoor Scenes
di: Yu, Hongxiao, et al.
Pubblicazione: (2024)
di: Yu, Hongxiao, et al.
Pubblicazione: (2024)
Seg-R1: Segmentation Can Be Surprisingly Simple with Reinforcement Learning
di: You, Zuyao, et al.
Pubblicazione: (2025)
di: You, Zuyao, et al.
Pubblicazione: (2025)
General Geometry-aware Weakly Supervised 3D Object Detection
di: Zhang, Guowen, et al.
Pubblicazione: (2024)
di: Zhang, Guowen, et al.
Pubblicazione: (2024)
SurgVisAgent: Multimodal Agentic Model for Versatile Surgical Visual Enhancement
di: Lei, Zeyu, et al.
Pubblicazione: (2025)
di: Lei, Zeyu, et al.
Pubblicazione: (2025)
SimCMF: A Simple Cross-modal Fine-tuning Strategy from Vision Foundation Models to Any Imaging Modality
di: Lei, Chenyang, et al.
Pubblicazione: (2024)
di: Lei, Chenyang, et al.
Pubblicazione: (2024)
Holistic Large-Scale Scene Reconstruction via Mixed Gaussian Splatting
di: Liu, Chuandong, et al.
Pubblicazione: (2025)
di: Liu, Chuandong, et al.
Pubblicazione: (2025)
Learning Accurate Segmentation Purely from Self-Supervision
di: You, Zuyao, et al.
Pubblicazione: (2026)
di: You, Zuyao, et al.
Pubblicazione: (2026)
Top-Down Guidance for Learning Object-Centric Representations
di: Zou, Junhong, et al.
Pubblicazione: (2024)
di: Zou, Junhong, et al.
Pubblicazione: (2024)
Hierarchical and Holistic Open-Vocabulary Functional 3D Scene Graphs for Indoor Spaces
di: Hu, Xinggang, et al.
Pubblicazione: (2026)
di: Hu, Xinggang, et al.
Pubblicazione: (2026)
GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models
di: Qi, Zhangyang, et al.
Pubblicazione: (2025)
di: Qi, Zhangyang, et al.
Pubblicazione: (2025)
SimMAT: Exploring Transferability from Vision Foundation Models to Any Image Modality
di: Lei, Chenyang, et al.
Pubblicazione: (2024)
di: Lei, Chenyang, et al.
Pubblicazione: (2024)
DiffArtist: Towards Structure and Appearance Controllable Image Stylization
di: Jiang, Ruixiang, et al.
Pubblicazione: (2024)
di: Jiang, Ruixiang, et al.
Pubblicazione: (2024)
Language and Geometry Grounded Sparse Voxel Representations for Holistic Scene Understanding
di: Wu, Guile, et al.
Pubblicazione: (2026)
di: Wu, Guile, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Expanding Scene Graph Boundaries: Fully Open-vocabulary Scene Graph Generation via Visual-Concept Alignment and Retention
di: Chen, Zuyao, et al.
Pubblicazione: (2023) -
What Makes a Scene ? Scene Graph-based Evaluation and Feedback for Controllable Generation
di: Chen, Zuyao, et al.
Pubblicazione: (2024) -
From Data to Modeling: Fully Open-vocabulary Scene Graph Generation
di: Chen, Zuyao, et al.
Pubblicazione: (2025) -
Compile Scene Graphs with Reinforcement Learning
di: Chen, Zuyao, et al.
Pubblicazione: (2025) -
CAGE-SGG: Counterfactual Active Graph Evidence for Open-Vocabulary Scene Graph Generation
di: Guang, Suiyang, et al.
Pubblicazione: (2026)