Neuro-Symbolic Spatial Reasoning in Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Jiayi, Huang, Jiabo, Gong, Shaogang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation
par: Lin, Jiayi, et autres
Publié: (2024)
par: Lin, Jiayi, et autres
Publié: (2024)
Hybrid-Learning Video Moment Retrieval across Multi-Domain Labels
par: Cai, Weitong, et autres
Publié: (2024)
par: Cai, Weitong, et autres
Publié: (2024)
Leveraging Hallucinations to Reduce Manual Prompt Dependency in Promptable Segmentation
par: Hu, Jian, et autres
Publié: (2024)
par: Hu, Jian, et autres
Publié: (2024)
MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval
par: Cai, Weitong, et autres
Publié: (2024)
par: Cai, Weitong, et autres
Publié: (2024)
Generative Video Diffusion for Unseen Novel Semantic Video Moment Retrieval
par: Luo, Dezhao, et autres
Publié: (2024)
par: Luo, Dezhao, et autres
Publié: (2024)
Grounding Video Reasoning in Physical Signals
par: Osmanli, Alibay, et autres
Publié: (2026)
par: Osmanli, Alibay, et autres
Publié: (2026)
INT: Instance-Specific Negative Mining for Task-Generic Promptable Segmentation
par: Hu, Jian, et autres
Publié: (2025)
par: Hu, Jian, et autres
Publié: (2025)
NeuroHash: A Hyperdimensional Neuro-Symbolic Framework for Spatially-Aware Image Hashing and Retrieval
par: Yun, Sanggeon, et autres
Publié: (2024)
par: Yun, Sanggeon, et autres
Publié: (2024)
Few-Shot Image Generation by Conditional Relaxing Diffusion Inversion
par: Cao, Yu, et autres
Publié: (2024)
par: Cao, Yu, et autres
Publié: (2024)
Neuro Symbolic Knowledge Reasoning for Procedural Video Question Answering
par: Fernando, Basura, et autres
Publié: (2025)
par: Fernando, Basura, et autres
Publié: (2025)
A Multi-Modal Neuro-Symbolic Approach for Spatial Reasoning-Based Visual Grounding in Robotics
par: Jahangard, Simindokht, et autres
Publié: (2025)
par: Jahangard, Simindokht, et autres
Publié: (2025)
Training-free Zero-shot Composed Image Retrieval with Local Concept Reranking
par: Sun, Shitong, et autres
Publié: (2023)
par: Sun, Shitong, et autres
Publié: (2023)
NAVER: A Neuro-Symbolic Compositional Automaton for Visual Grounding with Explicit Logic Reasoning
par: Cai, Zhixi, et autres
Publié: (2025)
par: Cai, Zhixi, et autres
Publié: (2025)
A Neuro-Symbolic Framework Combining Inductive and Deductive Reasoning for Autonomous Driving Planning
par: Wei, Hongyan, et autres
Publié: (2026)
par: Wei, Hongyan, et autres
Publié: (2026)
CRAFT: A Neuro-Symbolic Framework for Visual Functional Affordance Grounding
par: Chen, Zhou, et autres
Publié: (2025)
par: Chen, Zhou, et autres
Publié: (2025)
V-STaR: Benchmarking Video-LLMs on Video Spatio-Temporal Reasoning
par: Cheng, Zixu, et autres
Publié: (2025)
par: Cheng, Zixu, et autres
Publié: (2025)
NeuS-QA: Grounding Long-Form Video Understanding in Temporal Logic and Neuro-Symbolic Reasoning
par: Shah, Sahil, et autres
Publié: (2025)
par: Shah, Sahil, et autres
Publié: (2025)
VL-Nav: A Neuro-Symbolic Approach for Reasoning-based Vision-Language Navigation
par: Du, Yi, et autres
Publié: (2025)
par: Du, Yi, et autres
Publié: (2025)
GraphThinker: Reinforcing Temporally Grounded Video Reasoning with Event Graph Thinking
par: Cheng, Zixu, et autres
Publié: (2026)
par: Cheng, Zixu, et autres
Publié: (2026)
VIRO: Robust and Efficient Neuro-Symbolic Reasoning with Verification for Referring Expression Comprehension
par: Park, Hyejin, et autres
Publié: (2026)
par: Park, Hyejin, et autres
Publié: (2026)
Temporal Score Analysis for Understanding and Correcting Diffusion Artifacts
par: Cao, Yu, et autres
Publié: (2025)
par: Cao, Yu, et autres
Publié: (2025)
Enhancing Zero-Shot Facial Expression Recognition by LLM Knowledge Transfer
par: Zhao, Zengqun, et autres
Publié: (2024)
par: Zhao, Zengqun, et autres
Publié: (2024)
LASER: A Neuro-Symbolic Framework for Learning Spatial-Temporal Scene Graphs with Weak Supervision
par: Huang, Jiani, et autres
Publié: (2023)
par: Huang, Jiani, et autres
Publié: (2023)
Can VLMs Reason Robustly? A Neuro-Symbolic Investigation
par: Chen, Weixin, et autres
Publié: (2026)
par: Chen, Weixin, et autres
Publié: (2026)
Towards Neuro-Symbolic Video Understanding
par: Choi, Minkyu, et autres
Publié: (2024)
par: Choi, Minkyu, et autres
Publié: (2024)
HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation
par: Lin, Weihuang, et autres
Publié: (2025)
par: Lin, Weihuang, et autres
Publié: (2025)
ViSMaP: Unsupervised Hour-long Video Summarisation by Meta-Prompting
par: Hu, Jian, et autres
Publié: (2025)
par: Hu, Jian, et autres
Publié: (2025)
JARVIS: A Neuro-Symbolic Commonsense Reasoning Framework for Conversational Embodied Agents
par: Zheng, Kaizhi, et autres
Publié: (2022)
par: Zheng, Kaizhi, et autres
Publié: (2022)
CoS: Chain-of-Shot Prompting for Long Video Understanding
par: Hu, Jian, et autres
Publié: (2025)
par: Hu, Jian, et autres
Publié: (2025)
XFMamba: Cross-Fusion Mamba for Multi-View Medical Image Classification
par: Zheng, Xiaoyu, et autres
Publié: (2025)
par: Zheng, Xiaoyu, et autres
Publié: (2025)
SHINE: Saliency-aware HIerarchical NEgative Ranking for Compositional Temporal Grounding
par: Cheng, Zixu, et autres
Publié: (2024)
par: Cheng, Zixu, et autres
Publié: (2024)
Neuro-Symbolic Manipulation Understanding with Enriched Semantic Event Chains
par: Ziaeetabar, Fatemeh
Publié: (2026)
par: Ziaeetabar, Fatemeh
Publié: (2026)
Reinforcing Video Reasoning Segmentation to Think Before It Segments
par: Gong, Sitong, et autres
Publié: (2025)
par: Gong, Sitong, et autres
Publié: (2025)
Neuro-Symbolic Concepts
par: Mao, Jiayuan, et autres
Publié: (2025)
par: Mao, Jiayuan, et autres
Publié: (2025)
Keep it SymPL: Symbolic Projective Layout for Allocentric Spatial Reasoning in Vision-Language Models
par: Jang, Jaeyun, et autres
Publié: (2026)
par: Jang, Jaeyun, et autres
Publié: (2026)
Seeing Further on the Shoulders of Giants: Knowledge Inheritance for Vision Foundation Models
par: Huang, Jiabo, et autres
Publié: (2025)
par: Huang, Jiabo, et autres
Publié: (2025)
Enhancing Spatial Reasoning in Multimodal Large Language Models through Reasoning-based Segmentation
par: Ning, Zhenhua, et autres
Publié: (2025)
par: Ning, Zhenhua, et autres
Publié: (2025)
MuSLR: Multimodal Symbolic Logical Reasoning
par: Xu, Jundong, et autres
Publié: (2025)
par: Xu, Jundong, et autres
Publié: (2025)
Grounding vs. Compositionality: On the Non-Complementarity of Reasoning in Neuro-Symbolic Systems
par: Shahid, Mahnoor, et autres
Publié: (2026)
par: Shahid, Mahnoor, et autres
Publié: (2026)
LE-NeuS: Latency-Efficient Neuro-Symbolic Video Understanding via Adaptive Temporal Verification
par: Liang, Shawn, et autres
Publié: (2026)
par: Liang, Shawn, et autres
Publié: (2026)
Documents similaires
-
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation
par: Lin, Jiayi, et autres
Publié: (2024) -
Hybrid-Learning Video Moment Retrieval across Multi-Domain Labels
par: Cai, Weitong, et autres
Publié: (2024) -
Leveraging Hallucinations to Reduce Manual Prompt Dependency in Promptable Segmentation
par: Hu, Jian, et autres
Publié: (2024) -
MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval
par: Cai, Weitong, et autres
Publié: (2024) -
Generative Video Diffusion for Unseen Novel Semantic Video Moment Retrieval
par: Luo, Dezhao, et autres
Publié: (2024)