From Data to Modeling: Fully Open-vocabulary Scene Graph Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Zuyao, Wu, Jinlin, Lei, Zhen, Chen, Chang Wen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Expanding Scene Graph Boundaries: Fully Open-vocabulary Scene Graph Generation via Visual-Concept Alignment and Retention
par: Chen, Zuyao, et autres
Publié: (2023)
par: Chen, Zuyao, et autres
Publié: (2023)
What Makes a Scene ? Scene Graph-based Evaluation and Feedback for Controllable Generation
par: Chen, Zuyao, et autres
Publié: (2024)
par: Chen, Zuyao, et autres
Publié: (2024)
Compile Scene Graphs with Reinforcement Learning
par: Chen, Zuyao, et autres
Publié: (2025)
par: Chen, Zuyao, et autres
Publié: (2025)
GPT4SGG: Synthesizing Scene Graphs from Holistic and Region-specific Narratives
par: Chen, Zuyao, et autres
Publié: (2023)
par: Chen, Zuyao, et autres
Publié: (2023)
From Semantics, Scene to Instance-awareness: Distilling Foundation Model for Grounded Open-vocabulary Situation Recognition
par: Cai, Chen, et autres
Publié: (2025)
par: Cai, Chen, et autres
Publié: (2025)
Relation-aware Hierarchical Prompt for Open-vocabulary Scene Graph Generation
par: Liu, Tao, et autres
Publié: (2024)
par: Liu, Tao, et autres
Publié: (2024)
LLaVA-SpaceSGG: Visual Instruct Tuning for Open-vocabulary Scene Graph Generation with Enhanced Spatial Relations
par: Xu, Mingjie, et autres
Publié: (2024)
par: Xu, Mingjie, et autres
Publié: (2024)
From Pixels to Graphs: Open-Vocabulary Scene Graph Generation with Vision-Language Models
par: Li, Rongjie, et autres
Publié: (2024)
par: Li, Rongjie, et autres
Publié: (2024)
OpenIns3D: Snap and Lookup for 3D Open-vocabulary Instance Segmentation
par: Huang, Zhening, et autres
Publié: (2023)
par: Huang, Zhening, et autres
Publié: (2023)
SA-Person: Text-Based Person Retrieval with Scene-aware Re-ranking
par: Xu, Yingjia, et autres
Publié: (2025)
par: Xu, Yingjia, et autres
Publié: (2025)
SPADE: Spatial-Aware Denoising Network for Open-vocabulary Panoptic Scene Graph Generation with Long- and Local-range Context Reasoning
par: Hu, Xin, et autres
Publié: (2025)
par: Hu, Xin, et autres
Publié: (2025)
Anatomy-R1: Enhancing Anatomy Reasoning in Multimodal Large Language Models via Anatomical Similarity Curriculum and Group Diversity Augmentation
par: Song, Ziyang, et autres
Publié: (2025)
par: Song, Ziyang, et autres
Publié: (2025)
DreamMask: Boosting Open-vocabulary Panoptic Segmentation with Synthetic Data
par: Tu, Yuanpeng, et autres
Publié: (2025)
par: Tu, Yuanpeng, et autres
Publié: (2025)
OpenVIS: Open-vocabulary Video Instance Segmentation
par: Guo, Pinxue, et autres
Publié: (2023)
par: Guo, Pinxue, et autres
Publié: (2023)
Continual Learning in Open-vocabulary Classification with Complementary Memory Systems
par: Zhu, Zhen, et autres
Publié: (2023)
par: Zhu, Zhen, et autres
Publié: (2023)
SurgVisAgent: Multimodal Agentic Model for Versatile Surgical Visual Enhancement
par: Lei, Zeyu, et autres
Publié: (2025)
par: Lei, Zeyu, et autres
Publié: (2025)
OMG: Towards Open-vocabulary Motion Generation via Mixture of Controllers
par: Liang, Han, et autres
Publié: (2023)
par: Liang, Han, et autres
Publié: (2023)
Instance Brownian Bridge as Texts for Open-vocabulary Video Instance Segmentation
par: Cheng, Zesen, et autres
Publié: (2024)
par: Cheng, Zesen, et autres
Publié: (2024)
Seg-R1: Segmentation Can Be Surprisingly Simple with Reinforcement Learning
par: You, Zuyao, et autres
Publié: (2025)
par: You, Zuyao, et autres
Publié: (2025)
Generating on Generated: An Approach Towards Self-Evolving Diffusion Models
par: Zhang, Xulu, et autres
Publié: (2025)
par: Zhang, Xulu, et autres
Publié: (2025)
CAGE-SGG: Counterfactual Active Graph Evidence for Open-Vocabulary Scene Graph Generation
par: Guang, Suiyang, et autres
Publié: (2026)
par: Guang, Suiyang, et autres
Publié: (2026)
Interaction-Centric Knowledge Infusion and Transfer for Open-Vocabulary Scene Graph Generation
par: Li, Lin, et autres
Publié: (2025)
par: Li, Lin, et autres
Publié: (2025)
IGLOSS: Image Generation for Lidar Open-vocabulary Semantic Segmentation
par: Samet, Nermin, et autres
Publié: (2026)
par: Samet, Nermin, et autres
Publié: (2026)
A Fully Open and Generalizable Foundation Model for Ultrasound Clinical Applications
par: Zhang, Hongyuan, et autres
Publié: (2025)
par: Zhang, Hongyuan, et autres
Publié: (2025)
Endo-4DGX: Robust Endoscopic Scene Reconstruction and Illumination Correction with Gaussian Splatting
par: Huang, Yiming, et autres
Publié: (2025)
par: Huang, Yiming, et autres
Publié: (2025)
OpenPSG: Open-set Panoptic Scene Graph Generation via Large Multimodal Models
par: Zhou, Zijian, et autres
Publié: (2024)
par: Zhou, Zijian, et autres
Publié: (2024)
Taking A Closer Look at Interacting Objects: Interaction-Aware Open Vocabulary Scene Graph Generation
par: Li, Lin, et autres
Publié: (2025)
par: Li, Lin, et autres
Publié: (2025)
OpenInsGaussian: Open-vocabulary Instance Gaussian Segmentation with Context-aware Cross-view Fusion
par: Huang, Tianyu, et autres
Publié: (2025)
par: Huang, Tianyu, et autres
Publié: (2025)
DetCLIPv3: Towards Versatile Generative Open-vocabulary Object Detection
par: Yao, Lewei, et autres
Publié: (2024)
par: Yao, Lewei, et autres
Publié: (2024)
GaussianGrasper: 3D Language Gaussian Splatting for Open-vocabulary Robotic Grasping
par: Zheng, Yuhang, et autres
Publié: (2024)
par: Zheng, Yuhang, et autres
Publié: (2024)
GaussianGraph: 3D Gaussian-based Scene Graph Generation for Open-world Scene Understanding
par: Wang, Xihan, et autres
Publié: (2025)
par: Wang, Xihan, et autres
Publié: (2025)
Fully Exploiting Vision Foundation Model's Profound Prior Knowledge for Generalizable RGB-Depth Driving Scene Parsing
par: Guo, Sicen, et autres
Publié: (2025)
par: Guo, Sicen, et autres
Publié: (2025)
Open World Scene Graph Generation using Vision Language Models
par: Dutta, Amartya, et autres
Publié: (2025)
par: Dutta, Amartya, et autres
Publié: (2025)
Details Matter for Indoor Open-vocabulary 3D Instance Segmentation
par: Jung, Sanghun, et autres
Publié: (2025)
par: Jung, Sanghun, et autres
Publié: (2025)
Weakly Supervised 3D Open-vocabulary Segmentation
par: Liu, Kunhao, et autres
Publié: (2023)
par: Liu, Kunhao, et autres
Publié: (2023)
Open-vocabulary object 6D pose estimation
par: Corsetti, Jaime, et autres
Publié: (2023)
par: Corsetti, Jaime, et autres
Publié: (2023)
PosSAM: Panoptic Open-vocabulary Segment Anything
par: VS, Vibashan, et autres
Publié: (2024)
par: VS, Vibashan, et autres
Publié: (2024)
Omni-Attribute: Open-vocabulary Attribute Encoder for Visual Concept Personalization
par: Chen, Tsai-Shien, et autres
Publié: (2025)
par: Chen, Tsai-Shien, et autres
Publié: (2025)
Customizing Visual Emotion Evaluation for MLLMs: An Open-vocabulary, Multifaceted, and Scalable Approach
par: Wu, Daiqing, et autres
Publié: (2025)
par: Wu, Daiqing, et autres
Publié: (2025)
Universal Scene Graph Generation
par: Wu, Shengqiong, et autres
Publié: (2025)
par: Wu, Shengqiong, et autres
Publié: (2025)
Documents similaires
-
Expanding Scene Graph Boundaries: Fully Open-vocabulary Scene Graph Generation via Visual-Concept Alignment and Retention
par: Chen, Zuyao, et autres
Publié: (2023) -
What Makes a Scene ? Scene Graph-based Evaluation and Feedback for Controllable Generation
par: Chen, Zuyao, et autres
Publié: (2024) -
Compile Scene Graphs with Reinforcement Learning
par: Chen, Zuyao, et autres
Publié: (2025) -
GPT4SGG: Synthesizing Scene Graphs from Holistic and Region-specific Narratives
par: Chen, Zuyao, et autres
Publié: (2023) -
From Semantics, Scene to Instance-awareness: Distilling Foundation Model for Grounded Open-vocabulary Situation Recognition
par: Cai, Chen, et autres
Publié: (2025)