Visual Graph Question Answering with ASP and LLMs for Language Parsing
Fuente:
arXiv
Salvato in:
| Autori principali: | Bauer, Jakob Johannes, Eiter, Thomas, Ruiz, Nelson Higuera, Oetsch, Johannes |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Declarative Knowledge Distillation from Large Language Models for Visual Question Answering Datasets
di: Eiter, Thomas, et al.
Pubblicazione: (2024)
di: Eiter, Thomas, et al.
Pubblicazione: (2024)
Answer-Set-Programming-based Abstractions for Reinforcement Learning
di: Bankosegger, Rafael, et al.
Pubblicazione: (2026)
di: Bankosegger, Rafael, et al.
Pubblicazione: (2026)
Look, Listen, and Answer: Overcoming Biases for Audio-Visual Question Answering
di: Ma, Jie, et al.
Pubblicazione: (2024)
di: Ma, Jie, et al.
Pubblicazione: (2024)
Beyond Segmentation: Structurally Informed Facade Parsing from Imperfect Images
di: Janicki, Maciej, et al.
Pubblicazione: (2026)
di: Janicki, Maciej, et al.
Pubblicazione: (2026)
ASP-driven User-interaction with Clinguin
di: Beiser, Alexander, et al.
Pubblicazione: (2025)
di: Beiser, Alexander, et al.
Pubblicazione: (2025)
Multi-scale attention-based instance segmentation for measuring crystals with large size variation
di: Neubauer, Theresa, et al.
Pubblicazione: (2024)
di: Neubauer, Theresa, et al.
Pubblicazione: (2024)
An Evaluation of a Visual Question Answering Strategy for Zero-shot Facial Expression Recognition in Still Images
di: Castrillón-Santana, Modesto, et al.
Pubblicazione: (2025)
di: Castrillón-Santana, Modesto, et al.
Pubblicazione: (2025)
Physics-R1: An Audited Olympiad Corpus and Recipe for Visual Physics Reasoning
di: Yang, Shan
Pubblicazione: (2026)
di: Yang, Shan
Pubblicazione: (2026)
Robust Visual Question Answering: Datasets, Methods, and Future Challenges
di: Ma, Jie, et al.
Pubblicazione: (2023)
di: Ma, Jie, et al.
Pubblicazione: (2023)
Trapped in texture bias? A large scale comparison of deep instance segmentation
di: Theodoridis, Johannes, et al.
Pubblicazione: (2024)
di: Theodoridis, Johannes, et al.
Pubblicazione: (2024)
Deterministic Event-Graph Substrates as World Models for Counterfactual Reasoning
di: Rovai, Fabio
Pubblicazione: (2026)
di: Rovai, Fabio
Pubblicazione: (2026)
A Random Matrix Theory Perspective on the Consistency of Diffusion Models
di: Wang, Binxu, et al.
Pubblicazione: (2026)
di: Wang, Binxu, et al.
Pubblicazione: (2026)
Cinéaste: A Fine-grained Contextual Movie Question Answering Benchmark
di: Shah, Nisarg A., et al.
Pubblicazione: (2025)
di: Shah, Nisarg A., et al.
Pubblicazione: (2025)
KARMA-MV: A Benchmark for Causal Question Answering on Music Videos
di: Ghosh, Archishman, et al.
Pubblicazione: (2026)
di: Ghosh, Archishman, et al.
Pubblicazione: (2026)
Decoupling Vision and Language: Codebook Anchored Visual Adaptation
di: Wu, Jason, et al.
Pubblicazione: (2026)
di: Wu, Jason, et al.
Pubblicazione: (2026)
Learning the meanings of function words from grounded language using a visual question answering model
di: Portelance, Eva, et al.
Pubblicazione: (2023)
di: Portelance, Eva, et al.
Pubblicazione: (2023)
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
di: Raoufi, Behnam, et al.
Pubblicazione: (2025)
di: Raoufi, Behnam, et al.
Pubblicazione: (2025)
EvoPrune: Early-Stage Visual Token Pruning for Efficient MLLMs
di: Chen, Yuhao, et al.
Pubblicazione: (2026)
di: Chen, Yuhao, et al.
Pubblicazione: (2026)
Mitigating Catastrophic Forgetting in the Incremental Learning of Medical Images
di: Yavari, Sara, et al.
Pubblicazione: (2025)
di: Yavari, Sara, et al.
Pubblicazione: (2025)
ReLKD: Inter-Class Relation Learning with Knowledge Distillation for Generalized Category Discovery
di: Zhou, Fang, et al.
Pubblicazione: (2025)
di: Zhou, Fang, et al.
Pubblicazione: (2025)
GTPBD: A Fine-Grained Global Terraced Parcel and Boundary Dataset
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
Efficient Image Pre-Training with Siamese Cropped Masked Autoencoders
di: Eymaël, Alexandre, et al.
Pubblicazione: (2024)
di: Eymaël, Alexandre, et al.
Pubblicazione: (2024)
Sim2Real in endoscopy segmentation with a novel structure aware image translation
di: Tomasini, Clara, et al.
Pubblicazione: (2025)
di: Tomasini, Clara, et al.
Pubblicazione: (2025)
Uncertainty estimation in Deep Learning for Panoptic segmentation
di: Smith, Michael, et al.
Pubblicazione: (2023)
di: Smith, Michael, et al.
Pubblicazione: (2023)
Evaluation of Attention Mechanisms in U-Net Architectures for Semantic Segmentation of Brazilian Rock Art Petroglyphs
di: Melo, Leonardi, et al.
Pubblicazione: (2025)
di: Melo, Leonardi, et al.
Pubblicazione: (2025)
Data Organization Matters in Multimodal Instruction Tuning: A Controlled Study of Capability Trade-offs
di: Tang, Guowei
Pubblicazione: (2026)
di: Tang, Guowei
Pubblicazione: (2026)
RDPO: Real Data Preference Optimization for Physics Consistency Video Generation
di: Qian, Wenxu, et al.
Pubblicazione: (2025)
di: Qian, Wenxu, et al.
Pubblicazione: (2025)
Preserving instance continuity and length in segmentation through connectivity-aware loss computation
di: Szustakowski, Karol, et al.
Pubblicazione: (2025)
di: Szustakowski, Karol, et al.
Pubblicazione: (2025)
WoundNet-Ensemble: A Novel IoMT System Integrating Self-Supervised Deep Learning and Multi-Model Fusion for Automated, High-Accuracy Wound Classification and Healing Progression Monitoring
di: Kiprono, Moses
Pubblicazione: (2025)
di: Kiprono, Moses
Pubblicazione: (2025)
Adaptive Self-Training for Object Detection
di: Vandeghen, Renaud, et al.
Pubblicazione: (2022)
di: Vandeghen, Renaud, et al.
Pubblicazione: (2022)
Pointing-Based Object Recognition
di: Hajdúch, Lukáš, et al.
Pubblicazione: (2026)
di: Hajdúch, Lukáš, et al.
Pubblicazione: (2026)
Semantic Prioritization in Visual Counterfactual Explanations with Weighted Segmentation and Auto-Adaptive Region Selection
di: Zhang, Lintong, et al.
Pubblicazione: (2025)
di: Zhang, Lintong, et al.
Pubblicazione: (2025)
Patterns of Patterns II
di: Corneli, Joseph, et al.
Pubblicazione: (2023)
di: Corneli, Joseph, et al.
Pubblicazione: (2023)
Design Patterns for Multilevel Modeling and Simulation
di: Serena, Luca, et al.
Pubblicazione: (2024)
di: Serena, Luca, et al.
Pubblicazione: (2024)
Incorporating Spatial Awareness in Data-Driven Gesture Generation for Virtual Agents
di: Deichler, Anna, et al.
Pubblicazione: (2024)
di: Deichler, Anna, et al.
Pubblicazione: (2024)
Differentiable Hierarchical Visual Tokenization
di: Aasan, Marius, et al.
Pubblicazione: (2025)
di: Aasan, Marius, et al.
Pubblicazione: (2025)
Mixture of Rationale: Multi-Modal Reasoning Mixture for Visual Question Answering
di: Li, Tao, et al.
Pubblicazione: (2024)
di: Li, Tao, et al.
Pubblicazione: (2024)
Step-CoT: Stepwise Visual Chain-of-Thought for Medical Visual Question Answering
di: Fan, Lin, et al.
Pubblicazione: (2026)
di: Fan, Lin, et al.
Pubblicazione: (2026)
Conscious Gaze: Adaptive Attention Mechanisms for Hallucination Mitigation in Vision-Language Models
di: Bu, Weijue, et al.
Pubblicazione: (2025)
di: Bu, Weijue, et al.
Pubblicazione: (2025)
CoT4AD: A Vision-Language-Action Model with Explicit Chain-of-Thought Reasoning for Autonomous Driving
di: Wang, Zhaohui, et al.
Pubblicazione: (2025)
di: Wang, Zhaohui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Declarative Knowledge Distillation from Large Language Models for Visual Question Answering Datasets
di: Eiter, Thomas, et al.
Pubblicazione: (2024) -
Answer-Set-Programming-based Abstractions for Reinforcement Learning
di: Bankosegger, Rafael, et al.
Pubblicazione: (2026) -
Look, Listen, and Answer: Overcoming Biases for Audio-Visual Question Answering
di: Ma, Jie, et al.
Pubblicazione: (2024) -
Beyond Segmentation: Structurally Informed Facade Parsing from Imperfect Images
di: Janicki, Maciej, et al.
Pubblicazione: (2026) -
ASP-driven User-interaction with Clinguin
di: Beiser, Alexander, et al.
Pubblicazione: (2025)