Concept-RuleNet: Grounded Multi-Agent Neurosymbolic Reasoning in Vision Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Sinha, Sanchit, Xiong, Guangzhi, He, Zhenghao, Zhang, Aidong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
COCO-Tree: Compositional Hierarchical Concept Trees for Enhanced Reasoning in Vision Language Models
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
GCAV: A Global Concept Activation Vector Framework for Cross-Layer Consistency in Interpretability
di: He, Zhenghao, et al.
Pubblicazione: (2025)
di: He, Zhenghao, et al.
Pubblicazione: (2025)
Retrieving Counterfactuals Improves Visual In-Context Learning
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
Attention-guided Fine-tuning of Multimodal Large Language Models Improves Chain-of-Thought Reasoning
di: Sinha, Sanchit, et al.
Pubblicazione: (2026)
di: Sinha, Sanchit, et al.
Pubblicazione: (2026)
ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
CASL: Concept-Aligned Sparse Latents for Interpreting Diffusion Models
di: He, Zhenghao, et al.
Pubblicazione: (2026)
di: He, Zhenghao, et al.
Pubblicazione: (2026)
Rethinking Visual Attribution for Chest X-ray Reasoning in Large Vision Language Models
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
ORCA: An Agentic Reasoning Framework for Hallucination and Adversarial Robustness in Vision-Language Models
di: Yu, Chung-En Johnny, et al.
Pubblicazione: (2025)
di: Yu, Chung-En Johnny, et al.
Pubblicazione: (2025)
MAG-3D: Multi-Agent Grounded Reasoning for 3D Understanding
di: Zheng, Henry, et al.
Pubblicazione: (2026)
di: Zheng, Henry, et al.
Pubblicazione: (2026)
Hydra: An Agentic Reasoning Approach for Enhancing Adversarial Robustness and Mitigating Hallucinations in Vision-Language Models
di: Chung-En, et al.
Pubblicazione: (2025)
di: Chung-En, et al.
Pubblicazione: (2025)
Visual Reasoning Agent: Robust Vision Systems in Remote Sensing via Inference-Time Scaling
di: Yu, Chung-En Johnny, et al.
Pubblicazione: (2025)
di: Yu, Chung-En Johnny, et al.
Pubblicazione: (2025)
StarCraftImage: A Dataset For Prototyping Spatial Reasoning Methods For Multi-Agent Environments
di: Kulinski, Sean, et al.
Pubblicazione: (2024)
di: Kulinski, Sean, et al.
Pubblicazione: (2024)
COMBO: Compositional World Models for Embodied Multi-Agent Cooperation
di: Zhang, Hongxin, et al.
Pubblicazione: (2024)
di: Zhang, Hongxin, et al.
Pubblicazione: (2024)
LongVideoAgent: Multi-Agent Reasoning with Long Videos
di: Liu, Runtao, et al.
Pubblicazione: (2025)
di: Liu, Runtao, et al.
Pubblicazione: (2025)
MARIC: Multi-Agent Reasoning for Image Classification
di: Seo, Wonduk, et al.
Pubblicazione: (2025)
di: Seo, Wonduk, et al.
Pubblicazione: (2025)
V-Agent: An Interactive Video Search System Using Vision-Language Models
di: Park, SunYoung, et al.
Pubblicazione: (2025)
di: Park, SunYoung, et al.
Pubblicazione: (2025)
StoryAgent: Customized Storytelling Video Generation via Multi-Agent Collaboration
di: Hu, Panwen, et al.
Pubblicazione: (2024)
di: Hu, Panwen, et al.
Pubblicazione: (2024)
AgentCVR: Active Multi-Agent Cross-Video Reasoning via Script-Simulated Reinforcement Learning
di: Qiu, Yilun, et al.
Pubblicazione: (2026)
di: Qiu, Yilun, et al.
Pubblicazione: (2026)
Learning Collective Dynamics of Multi-Agent Systems using Event-based Vision
di: Lee, Minah, et al.
Pubblicazione: (2024)
di: Lee, Minah, et al.
Pubblicazione: (2024)
A Multi-Agent Perception-Action Alliance for Efficient Long Video Reasoning
di: Xu, Yichang, et al.
Pubblicazione: (2026)
di: Xu, Yichang, et al.
Pubblicazione: (2026)
MAViS: A Multi-Agent Framework for Long-Sequence Video Storytelling
di: Wang, Qian, et al.
Pubblicazione: (2025)
di: Wang, Qian, et al.
Pubblicazione: (2025)
MedChat: A Multi-Agent Framework for Multimodal Diagnosis with Large Language Models
di: Liu, Philip R., et al.
Pubblicazione: (2025)
di: Liu, Philip R., et al.
Pubblicazione: (2025)
CaPo: Cooperative Plan Optimization for Efficient Embodied Multi-Agent Cooperation
di: Liu, Jie, et al.
Pubblicazione: (2024)
di: Liu, Jie, et al.
Pubblicazione: (2024)
A Multi-Agent System Enables Versatile Information Extraction from the Chemical Literature
di: Chen, Yufan, et al.
Pubblicazione: (2025)
di: Chen, Yufan, et al.
Pubblicazione: (2025)
Chain-of-Anomaly Thoughts with Large Vision-Language Models
di: Domingos, Pedro, et al.
Pubblicazione: (2025)
di: Domingos, Pedro, et al.
Pubblicazione: (2025)
Multi-Agent Dynamic Relational Reasoning for Social Robot Navigation
di: Li, Jiachen, et al.
Pubblicazione: (2024)
di: Li, Jiachen, et al.
Pubblicazione: (2024)
VideoMultiAgents: A Multi-Agent Framework for Video Question Answering
di: Kugo, Noriyuki, et al.
Pubblicazione: (2025)
di: Kugo, Noriyuki, et al.
Pubblicazione: (2025)
FEAT: A Multi-Agent Forensic AI System with Domain-Adapted Large Language Model for Automated Cause-of-Death Analysis
di: Shen, Chen, et al.
Pubblicazione: (2025)
di: Shen, Chen, et al.
Pubblicazione: (2025)
Enhancing Agentic Autonomous Scientific Discovery with Vision-Language Model Capabilities
di: Gandhi, Kahaan, et al.
Pubblicazione: (2025)
di: Gandhi, Kahaan, et al.
Pubblicazione: (2025)
Autonomous Computer Vision Development with Agentic AI
di: Kim, Jin, et al.
Pubblicazione: (2025)
di: Kim, Jin, et al.
Pubblicazione: (2025)
AIDE: Agentically Improve Visual Language Model with Domain Experts
di: Chiu, Ming-Chang, et al.
Pubblicazione: (2025)
di: Chiu, Ming-Chang, et al.
Pubblicazione: (2025)
EmboTeam: Grounding LLM Reasoning into Reactive Behavior Trees via PDDL for Embodied Multi-Robot Collaboration
di: Zeng, Haishan, et al.
Pubblicazione: (2026)
di: Zeng, Haishan, et al.
Pubblicazione: (2026)
Local Prompt Adaptation for Style-Consistent Multi-Object Generation in Diffusion Models
di: Sanjyal, Ankit
Pubblicazione: (2025)
di: Sanjyal, Ankit
Pubblicazione: (2025)
GenCellAgent: Generalizable, Training-Free Cellular Image Segmentation via Large Language Model Agents
di: Yu, Xi, et al.
Pubblicazione: (2025)
di: Yu, Xi, et al.
Pubblicazione: (2025)
Visual Multi-Agent System: Mitigating Hallucination Snowballing via Visual Flow
di: Yu, Xinlei, et al.
Pubblicazione: (2025)
di: Yu, Xinlei, et al.
Pubblicazione: (2025)
Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning
di: Vlachos, Angelos, et al.
Pubblicazione: (2025)
di: Vlachos, Angelos, et al.
Pubblicazione: (2025)
Agentic-J: An AI Agent for Biological Microscopy Image Analysis
di: Johanns, Lukas, et al.
Pubblicazione: (2026)
di: Johanns, Lukas, et al.
Pubblicazione: (2026)
FetalAgents: A Multi-Agent System for Fetal Ultrasound Image and Video Analysis
di: Hu, Xiaotian, et al.
Pubblicazione: (2026)
di: Hu, Xiaotian, et al.
Pubblicazione: (2026)
How Modality Shapes Perception and Reasoning: A Study of Error Propagation in ARC-AGI
di: Wen, Bo, et al.
Pubblicazione: (2025)
di: Wen, Bo, et al.
Pubblicazione: (2025)
AQuaUI: Visual Token Reduction for GUI Agents with Adaptive Quadtrees
di: Li, Yuankai, et al.
Pubblicazione: (2026)
di: Li, Yuankai, et al.
Pubblicazione: (2026)
Documenti analoghi
-
COCO-Tree: Compositional Hierarchical Concept Trees for Enhanced Reasoning in Vision Language Models
di: Sinha, Sanchit, et al.
Pubblicazione: (2025) -
GCAV: A Global Concept Activation Vector Framework for Cross-Layer Consistency in Interpretability
di: He, Zhenghao, et al.
Pubblicazione: (2025) -
Retrieving Counterfactuals Improves Visual In-Context Learning
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026) -
Attention-guided Fine-tuning of Multimodal Large Language Models Improves Chain-of-Thought Reasoning
di: Sinha, Sanchit, et al.
Pubblicazione: (2026) -
ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)