PRISM-0: A Predicate-Rich Scene Graph Generation Framework for Zero-Shot Open-Vocabulary Tasks
Fuente:
arXiv
Guardado en:
| Autores principales: | Elskhawy, Abdelrahman, Li, Mengze, Navab, Nassir, Busam, Benjamin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EchoScene: Indoor Scene Generation via Information Echo over Scene Graph Diffusion
por: Zhai, Guangyao, et al.
Publicado: (2024)
por: Zhai, Guangyao, et al.
Publicado: (2024)
Foundation Visual Encoders Are Secretly Few-Shot Anomaly Detectors
por: Zhai, Guangyao, et al.
Publicado: (2025)
por: Zhai, Guangyao, et al.
Publicado: (2025)
Location-Free Scene Graph Generation
por: Özsoy, Ege, et al.
Publicado: (2023)
por: Özsoy, Ege, et al.
Publicado: (2023)
Segmenting Known Objects and Unseen Unknowns without Prior Knowledge
por: Gasperini, Stefano, et al.
Publicado: (2022)
por: Gasperini, Stefano, et al.
Publicado: (2022)
CommonScenes: Generating Commonsense 3D Indoor Scenes with Scene Graph Diffusion
por: Zhai, Guangyao, et al.
Publicado: (2023)
por: Zhai, Guangyao, et al.
Publicado: (2023)
PromptVFX: Text-Driven Fields for Open-World 3D Gaussian Animation
por: Kiray, Mert, et al.
Publicado: (2025)
por: Kiray, Mert, et al.
Publicado: (2025)
FLex: Joint Pose and Dynamic Radiance Fields Optimization for Stereo Endoscopic Videos
por: Stilz, Florian Philipp, et al.
Publicado: (2024)
por: Stilz, Florian Philipp, et al.
Publicado: (2024)
CAT-SG: A Large Dynamic Scene Graph Dataset for Fine-Grained Understanding of Cataract Surgery
por: Holm, Felix, et al.
Publicado: (2025)
por: Holm, Felix, et al.
Publicado: (2025)
MS-CLR: Multi-Skeleton Contrastive Learning for Human Action Recognition
por: Kiray, Mert, et al.
Publicado: (2025)
por: Kiray, Mert, et al.
Publicado: (2025)
Semantic Scene Graph for Ultrasound Image Explanation and Scanning Guidance
por: Li, Xuesong, et al.
Publicado: (2025)
por: Li, Xuesong, et al.
Publicado: (2025)
SG-Bot: Object Rearrangement via Coarse-to-Fine Robotic Imagination on Scene Graphs
por: Zhai, Guangyao, et al.
Publicado: (2023)
por: Zhai, Guangyao, et al.
Publicado: (2023)
Millimeter-wave Imaging for Anthropometric Body Measurement
por: Senne, Miriam, et al.
Publicado: (2026)
por: Senne, Miriam, et al.
Publicado: (2026)
Continuous-Time SO(3) Forecasting with Savitzky--Golay Neural Controlled Differential Equations
por: Bastian, Lennart, et al.
Publicado: (2025)
por: Bastian, Lennart, et al.
Publicado: (2025)
RaDialog: A Large Vision-Language Model for Radiology Report Generation and Conversational Assistance
por: Pellegrini, Chantal, et al.
Publicado: (2023)
por: Pellegrini, Chantal, et al.
Publicado: (2023)
Object Pose Transformer: Unifying Unseen Object Pose Estimation
por: Li, Weihang, et al.
Publicado: (2026)
por: Li, Weihang, et al.
Publicado: (2026)
Re-Nerfing: Improving Novel View Synthesis through Novel View Synthesis
por: Tristram, Felix, et al.
Publicado: (2023)
por: Tristram, Felix, et al.
Publicado: (2023)
From Open-Vocabulary to Vocabulary-Free Semantic Segmentation
por: Reichard, Klara, et al.
Publicado: (2025)
por: Reichard, Klara, et al.
Publicado: (2025)
Scene-Graph ViT: End-to-End Open-Vocabulary Visual Relationship Detection
por: Salzmann, Tim, et al.
Publicado: (2024)
por: Salzmann, Tim, et al.
Publicado: (2024)
US-X Complete: A Multi-Modal Approach to Anatomical 3D Shape Recovery
por: Gafencu, Miruna-Alexandra, et al.
Publicado: (2025)
por: Gafencu, Miruna-Alexandra, et al.
Publicado: (2025)
OpenGaFF: Open-Vocabulary Gaussian Feature Field with Codebook Attention
por: Li, Kunyi, et al.
Publicado: (2026)
por: Li, Kunyi, et al.
Publicado: (2026)
VISAGE: Video Synthesis using Action Graphs for Surgery
por: Yeganeh, Yousef, et al.
Publicado: (2024)
por: Yeganeh, Yousef, et al.
Publicado: (2024)
Predicate Hierarchies Improve Few-Shot State Classification
por: Jin, Emily, et al.
Publicado: (2025)
por: Jin, Emily, et al.
Publicado: (2025)
Adversarial Wear and Tear: Exploiting Natural Damage for Generating Physical-World Adversarial Examples
por: Irshad, Samra, et al.
Publicado: (2025)
por: Irshad, Samra, et al.
Publicado: (2025)
Robust Monocular Depth Estimation under Challenging Conditions
por: Gasperini, Stefano, et al.
Publicado: (2023)
por: Gasperini, Stefano, et al.
Publicado: (2023)
DitHub: A Modular Framework for Incremental Open-Vocabulary Object Detection
por: Cappellino, Chiara, et al.
Publicado: (2025)
por: Cappellino, Chiara, et al.
Publicado: (2025)
A Simple Framework for Open-Vocabulary Zero-Shot Segmentation
por: Stegmüller, Thomas, et al.
Publicado: (2024)
por: Stegmüller, Thomas, et al.
Publicado: (2024)
Attention Based Simple Primitives for Open World Compositional Zero-Shot Learning
por: Munir, Ans, et al.
Publicado: (2024)
por: Munir, Ans, et al.
Publicado: (2024)
A Survey on Generative Modeling with Limited Data, Few Shots, and Zero Shot
por: Abdollahzadeh, Milad, et al.
Publicado: (2023)
por: Abdollahzadeh, Milad, et al.
Publicado: (2023)
LiteTracker: Leveraging Temporal Causality for Accurate Low-latency Tissue Tracking
por: Karaoglu, Mert Asim, et al.
Publicado: (2025)
por: Karaoglu, Mert Asim, et al.
Publicado: (2025)
MatchU: Matching Unseen Objects for 6D Pose Estimation from RGB-D Images
por: Huang, Junwen, et al.
Publicado: (2024)
por: Huang, Junwen, et al.
Publicado: (2024)
Prototype-Based Knowledge Guidance for Fine-Grained Structured Radiology Reporting
por: Pellegrini, Chantal, et al.
Publicado: (2026)
por: Pellegrini, Chantal, et al.
Publicado: (2026)
Multimodal Analysis of White Blood Cell Differentiation in Acute Myeloid Leukemia Patients using a β-Variational Autoencoder
por: Mert, Gizem, et al.
Publicado: (2024)
por: Mert, Gizem, et al.
Publicado: (2024)
Hierarchical Open-Vocabulary 3D Scene Graphs for Language-Grounded Robot Navigation
por: Werby, Abdelrhman, et al.
Publicado: (2024)
por: Werby, Abdelrhman, et al.
Publicado: (2024)
OpenSUN3D: 1st Workshop Challenge on Open-Vocabulary 3D Scene Understanding
por: Engelmann, Francis, et al.
Publicado: (2024)
por: Engelmann, Francis, et al.
Publicado: (2024)
Exploring Simple Open-Vocabulary Semantic Segmentation
por: Lai, Zihang
Publicado: (2024)
por: Lai, Zihang
Publicado: (2024)
Anytime Continual Learning for Open Vocabulary Classification
por: Zhu, Zhen, et al.
Publicado: (2024)
por: Zhu, Zhen, et al.
Publicado: (2024)
Query3D: LLM-Powered Open-Vocabulary Scene Segmentation with Language Embedded 3D Gaussian
por: Chahe, Amirhosein, et al.
Publicado: (2024)
por: Chahe, Amirhosein, et al.
Publicado: (2024)
EGTR: Extracting Graph from Transformer for Scene Graph Generation
por: Im, Jinbae, et al.
Publicado: (2024)
por: Im, Jinbae, et al.
Publicado: (2024)
EPIC: Efficient Predicate-Guided Inference-Time Control for Compositional Text-to-Image Generation
por: Mun, Sunung, et al.
Publicado: (2026)
por: Mun, Sunung, et al.
Publicado: (2026)
RayPose: Ray Bundling Diffusion for Template Views in Unseen 6D Object Pose Estimation
por: Huang, Junwen, et al.
Publicado: (2025)
por: Huang, Junwen, et al.
Publicado: (2025)
Ejemplares similares
-
EchoScene: Indoor Scene Generation via Information Echo over Scene Graph Diffusion
por: Zhai, Guangyao, et al.
Publicado: (2024) -
Foundation Visual Encoders Are Secretly Few-Shot Anomaly Detectors
por: Zhai, Guangyao, et al.
Publicado: (2025) -
Location-Free Scene Graph Generation
por: Özsoy, Ege, et al.
Publicado: (2023) -
Segmenting Known Objects and Unseen Unknowns without Prior Knowledge
por: Gasperini, Stefano, et al.
Publicado: (2022) -
CommonScenes: Generating Commonsense 3D Indoor Scenes with Scene Graph Diffusion
por: Zhai, Guangyao, et al.
Publicado: (2023)