Diagnosing Causal Reasoning in Vision-Language Models via Structured Relevance Graphs
Fuente:
arXiv
Guardado en:
| Autores principales: | Pratama, Dhita Putri, Han, Soyeon Caren, Ding, Yihao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MMCOMET: A Large-Scale Multimodal Commonsense Knowledge Graph for Contextual Reasoning
por: Wang, Eileen, et al.
Publicado: (2026)
por: Wang, Eileen, et al.
Publicado: (2026)
ToolTree: Efficient LLM Agent Tool Planning via Dual-Feedback Monte Carlo Tree Search and Bidirectional Pruning
por: Yang, Shuo, et al.
Publicado: (2026)
por: Yang, Shuo, et al.
Publicado: (2026)
VRD-IU: Lessons from Visually Rich Document Intelligence and Understanding
por: Ding, Yihao, et al.
Publicado: (2025)
por: Ding, Yihao, et al.
Publicado: (2025)
MUSEKG: A Knowledge Graph Over Museum Collections
por: Li, Jinhao, et al.
Publicado: (2025)
por: Li, Jinhao, et al.
Publicado: (2025)
UniCast: A Unified Framework for Instance-Conditioned Multimodal Time-Series Forecasting
por: Park, Sehyuk, et al.
Publicado: (2025)
por: Park, Sehyuk, et al.
Publicado: (2025)
Multimodal Commonsense Knowledge Distillation for Visual Question Answering
por: Yang, Shuo, et al.
Publicado: (2024)
por: Yang, Shuo, et al.
Publicado: (2024)
SPANER: Shared Prompt Aligner for Multimodal Semantic Representation
por: Ng, Thye Shan, et al.
Publicado: (2025)
por: Ng, Thye Shan, et al.
Publicado: (2025)
SCO-VIST: Social Interaction Commonsense Knowledge-based Visual Storytelling
por: Wang, Eileen, et al.
Publicado: (2024)
por: Wang, Eileen, et al.
Publicado: (2024)
Graph Neural Networks for Text Classification: A Survey
por: Wang, Kunze, et al.
Publicado: (2023)
por: Wang, Kunze, et al.
Publicado: (2023)
BRIDGE: Benchmark for multi-hop Reasoning In long multimodal Documents with Grounded Evidence
por: Xiang, Biao, et al.
Publicado: (2026)
por: Xiang, Biao, et al.
Publicado: (2026)
Inclusion-of-Thoughts: Mitigating Preference Instability via Purifying the Decision Space
por: Madani, Mohammad Reza Ghasemi, et al.
Publicado: (2026)
por: Madani, Mohammad Reza Ghasemi, et al.
Publicado: (2026)
A Training-Free Length Extrapolation Approach for LLMs: Greedy Attention Logit Interpolation (GALI)
por: Li, Yan, et al.
Publicado: (2025)
por: Li, Yan, et al.
Publicado: (2025)
Utilizing Sequential Information of General Lab-test Results and Diagnoses History for Differential Diagnosis of Dementia
por: Xing, Yizong, et al.
Publicado: (2025)
por: Xing, Yizong, et al.
Publicado: (2025)
See or Say Graphs: Agent-Driven Scalable Graph Structure Understanding with Vision-Language Models
por: Han, Shuo, et al.
Publicado: (2025)
por: Han, Shuo, et al.
Publicado: (2025)
EvoTool: Self-Evolving Tool-Use Policy Optimization in LLM Agents via Blame-Aware Mutation and Diversity-Aware Selection
por: Yang, Shuo, et al.
Publicado: (2026)
por: Yang, Shuo, et al.
Publicado: (2026)
HierCon: Hierarchical Contrastive Attention for Audio Deepfake Detection
por: Liang, Zhili Nicholas, et al.
Publicado: (2026)
por: Liang, Zhili Nicholas, et al.
Publicado: (2026)
Historically Relevant Event Structuring for Temporal Knowledge Graph Reasoning
por: Zhang, Jinchuan, et al.
Publicado: (2024)
por: Zhang, Jinchuan, et al.
Publicado: (2024)
Graph-to-Vision: Multi-graph Understanding and Reasoning using Vision-Language Models
por: Ai, Qihang, et al.
Publicado: (2025)
por: Ai, Qihang, et al.
Publicado: (2025)
Diagnosing and Repairing Unsafe Channels in Vision-Language Models via Causal Discovery and Dual-Modal Safety Subspace Projection
por: Fu, Jinhu, et al.
Publicado: (2026)
por: Fu, Jinhu, et al.
Publicado: (2026)
VLA-Trace: Diagnosing Vision-Language-Action Models through Representation and Behavior Tracing
por: Shi, Haoyuan, et al.
Publicado: (2026)
por: Shi, Haoyuan, et al.
Publicado: (2026)
CausalVLBench: Benchmarking Visual Causal Reasoning in Large Vision-Language Models
por: Komanduri, Aneesh, et al.
Publicado: (2025)
por: Komanduri, Aneesh, et al.
Publicado: (2025)
Hospitality-VQA: Decision-Oriented Informativeness Evaluation for Vision-Language Models
por: Lee, Jeongwoo, et al.
Publicado: (2026)
por: Lee, Jeongwoo, et al.
Publicado: (2026)
ReCo: Reliable Causal Chain Reasoning via Structural Causal Recurrent Neural Networks
por: Xiong, Kai, et al.
Publicado: (2022)
por: Xiong, Kai, et al.
Publicado: (2022)
Reasoning Model is Stubborn: Diagnosing Instruction Overriding in Reasoning Models
por: Jang, Doohyuk, et al.
Publicado: (2025)
por: Jang, Doohyuk, et al.
Publicado: (2025)
When Models Learn to Ask Why: Adaptive Causal Reasoning for Trustworthy Medical Vision-Language Models
por: Lin, Jianxin, et al.
Publicado: (2026)
por: Lin, Jianxin, et al.
Publicado: (2026)
An Enhanced Prompt-Based LLM Reasoning Scheme via Knowledge Graph-Integrated Collaboration
por: Li, Yihao, et al.
Publicado: (2024)
por: Li, Yihao, et al.
Publicado: (2024)
Experiences from Benchmarking Vision-Language-Action Models for Robotic Manipulation
por: Zhang, Yihao, et al.
Publicado: (2025)
por: Zhang, Yihao, et al.
Publicado: (2025)
Causal Abstraction in Model Interpretability: A Compact Survey
por: Zhang, Yihao
Publicado: (2024)
por: Zhang, Yihao
Publicado: (2024)
Diagnosing Pathological Chain-of-Thought in Reasoning Models
por: Liu, Manqing, et al.
Publicado: (2026)
por: Liu, Manqing, et al.
Publicado: (2026)
Structured Relevance Assessment for Robust Retrieval-Augmented Language Models
por: Raj, Aryan, et al.
Publicado: (2025)
por: Raj, Aryan, et al.
Publicado: (2025)
CRANE: Causal Relevance Analysis of Language-Specific Neurons in Multilingual Large Language Models
por: Le, Yifan, et al.
Publicado: (2026)
por: Le, Yifan, et al.
Publicado: (2026)
Eliciting Causal Abilities in Large Language Models for Reasoning Tasks
por: Wang, Yajing, et al.
Publicado: (2024)
por: Wang, Yajing, et al.
Publicado: (2024)
Pseudocode-Guided Structured Reasoning for Automating Reliable Inference in Vision-Language Models
por: Ni, Weicong, et al.
Publicado: (2026)
por: Ni, Weicong, et al.
Publicado: (2026)
Physics-based phenomenological characterization of cross-modal bias in multimodal models
por: Kim, Hyeongmo, et al.
Publicado: (2026)
por: Kim, Hyeongmo, et al.
Publicado: (2026)
SuperRL: Reinforcement Learning with Supervision to Boost Language Model Reasoning
por: Liu, Yihao, et al.
Publicado: (2025)
por: Liu, Yihao, et al.
Publicado: (2025)
Grounding Multi-Hop Reasoning in Structural Causal Models via Group Relative Policy Optimization
por: Bu, Yunhan, et al.
Publicado: (2026)
por: Bu, Yunhan, et al.
Publicado: (2026)
CausalEval: Towards Better Causal Reasoning in Language Models
por: Yu, Longxuan, et al.
Publicado: (2024)
por: Yu, Longxuan, et al.
Publicado: (2024)
Discovering and Reasoning of Causality in the Hidden World with Large Language Models
por: Liu, Chenxi, et al.
Publicado: (2024)
por: Liu, Chenxi, et al.
Publicado: (2024)
Multimodal Causal Reasoning Benchmark: Challenging Vision Large Language Models to Discern Causal Links Across Modalities
por: Li, Zhiyuan, et al.
Publicado: (2024)
por: Li, Zhiyuan, et al.
Publicado: (2024)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
por: Li, Yuangang, et al.
Publicado: (2025)
por: Li, Yuangang, et al.
Publicado: (2025)
Ejemplares similares
-
MMCOMET: A Large-Scale Multimodal Commonsense Knowledge Graph for Contextual Reasoning
por: Wang, Eileen, et al.
Publicado: (2026) -
ToolTree: Efficient LLM Agent Tool Planning via Dual-Feedback Monte Carlo Tree Search and Bidirectional Pruning
por: Yang, Shuo, et al.
Publicado: (2026) -
VRD-IU: Lessons from Visually Rich Document Intelligence and Understanding
por: Ding, Yihao, et al.
Publicado: (2025) -
MUSEKG: A Knowledge Graph Over Museum Collections
por: Li, Jinhao, et al.
Publicado: (2025) -
UniCast: A Unified Framework for Instance-Conditioned Multimodal Time-Series Forecasting
por: Park, Sehyuk, et al.
Publicado: (2025)