\textit{FocaLogic}: Logic-Based Interpretation of Visual Model Decisions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Chenchen, Chen, Muxi, Xu, Qiang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HiBug2: Efficient and Interpretable Error Slice Discovery for Comprehensive Model Debugging
par: Chen, Muxi, et autres
Publié: (2025)
par: Chen, Muxi, et autres
Publié: (2025)
Interpret Your Decision: Logical Reasoning Regularization for Generalization in Visual Classification
par: Tan, Zhaorui, et autres
Publié: (2024)
par: Tan, Zhaorui, et autres
Publié: (2024)
FBCIR: Balancing Cross-Modal Focuses in Composed Image Retrieval
par: Zhao, Chenchen, et autres
Publié: (2026)
par: Zhao, Chenchen, et autres
Publié: (2026)
LogicQA: Logical Anomaly Detection with Vision Language Model Generated Questions
par: Kwon, Yejin, et autres
Publié: (2025)
par: Kwon, Yejin, et autres
Publié: (2025)
On Explaining Visual Captioning with Hybrid Markov Logic Networks
par: Shah, Monika, et autres
Publié: (2025)
par: Shah, Monika, et autres
Publié: (2025)
TopoLogic: An Interpretable Pipeline for Lane Topology Reasoning on Driving Scenes
par: Fu, Yanping, et autres
Publié: (2024)
par: Fu, Yanping, et autres
Publié: (2024)
MetaLogic: Robustness Evaluation of Text-to-Image Models via Logically Equivalent Prompts
par: Shen, Yifan, et autres
Publié: (2025)
par: Shen, Yifan, et autres
Publié: (2025)
Evaluating Text-to-Image Generative Models: An Empirical Study on Human Image Synthesis
par: Chen, Muxi, et autres
Publié: (2024)
par: Chen, Muxi, et autres
Publié: (2024)
LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts
par: Xiao, Yijia, et autres
Publié: (2024)
par: Xiao, Yijia, et autres
Publié: (2024)
LogicGaze: Benchmarking Causal Consistency in Visual Narratives via Counterfactual Verification
par: Driscoll, Rory, et autres
Publié: (2026)
par: Driscoll, Rory, et autres
Publié: (2026)
Generating by Understanding: Neural Visual Generation with Logical Symbol Groundings
par: Peng, Yifei, et autres
Publié: (2023)
par: Peng, Yifei, et autres
Publié: (2023)
Local-to-Global Logical Explanations for Deep Vision Models
par: Vasu, Bhavan, et autres
Publié: (2026)
par: Vasu, Bhavan, et autres
Publié: (2026)
Logic-in-Frames: Dynamic Keyframe Search via Visual Semantic-Logical Verification for Long Video Understanding
par: Guo, Weiyu, et autres
Publié: (2025)
par: Guo, Weiyu, et autres
Publié: (2025)
Disentangling Fine-Tuning from Pre-Training in Visual Captioning with Hybrid Markov Logic
par: Shah, Monika, et autres
Publié: (2025)
par: Shah, Monika, et autres
Publié: (2025)
Learning Differentiable Logic Programs for Abstract Visual Reasoning
par: Shindo, Hikaru, et autres
Publié: (2023)
par: Shindo, Hikaru, et autres
Publié: (2023)
VisualSphinx: Large-Scale Synthetic Vision Logic Puzzles for RL
par: Feng, Yichen, et autres
Publié: (2025)
par: Feng, Yichen, et autres
Publié: (2025)
Self-Evolving Spatial Reasoning in Vision Language Models via Geometric Logic Consistency
par: Liu, Junming, et autres
Publié: (2026)
par: Liu, Junming, et autres
Publié: (2026)
SALAD -- Semantics-Aware Logical Anomaly Detection
par: Fučka, Matic, et autres
Publié: (2025)
par: Fučka, Matic, et autres
Publié: (2025)
VALUED -- Vision and Logical Understanding Evaluation Dataset
par: Saha, Soumadeep, et autres
Publié: (2023)
par: Saha, Soumadeep, et autres
Publié: (2023)
MME-Reasoning: A Comprehensive Benchmark for Logical Reasoning in MLLMs
par: Yuan, Jiakang, et autres
Publié: (2025)
par: Yuan, Jiakang, et autres
Publié: (2025)
Neurosymbolic Framework for Concept-Driven Logical Reasoning in Skeleton-Based Human Action Recognition
par: Ilyas, Talha, et autres
Publié: (2026)
par: Ilyas, Talha, et autres
Publié: (2026)
V-LoL: A Diagnostic Dataset for Visual Logical Learning
par: Helff, Lukas, et autres
Publié: (2023)
par: Helff, Lukas, et autres
Publié: (2023)
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
par: Gong, Haozhen, et autres
Publié: (2025)
par: Gong, Haozhen, et autres
Publié: (2025)
InEdit-Bench: Benchmarking Intermediate Logical Pathways for Intelligent Image Editing Models
par: Sheng, Zhiqiang, et autres
Publié: (2026)
par: Sheng, Zhiqiang, et autres
Publié: (2026)
TMUAD: Enhancing Logical Capabilities in Unified Anomaly Detection Models with a Text Memory Bank
par: Liu, Jiawei, et autres
Publié: (2025)
par: Liu, Jiawei, et autres
Publié: (2025)
Logical Closed Loop: Uncovering Object Hallucinations in Large Vision-Language Models
par: Wu, Junfei, et autres
Publié: (2024)
par: Wu, Junfei, et autres
Publié: (2024)
Evolving Interpretable Visual Classifiers with Large Language Models
par: Chiquier, Mia, et autres
Publié: (2024)
par: Chiquier, Mia, et autres
Publié: (2024)
Training-Free Tunnel Defect Inspection and Engineering Interpretation via Visual Recalibration and Entity Reconstruction
par: Liu, Shipeng, et autres
Publié: (2026)
par: Liu, Shipeng, et autres
Publié: (2026)
Two Online Map Matching Algorithms Based on Analytic Hierarchy Process and Fuzzy Logic
par: Lin, Jeremy J., et autres
Publié: (2024)
par: Lin, Jeremy J., et autres
Publié: (2024)
Logi-PAR: Logic-Infused Patient Activity Recognition via Differentiable Rule
par: Zarar, Muhammad, et autres
Publié: (2026)
par: Zarar, Muhammad, et autres
Publié: (2026)
Fuzzy-Logic and Deep Learning for Environmental Condition-Aware Road Surface Classification
par: Demetgul, Mustafa, et autres
Publié: (2025)
par: Demetgul, Mustafa, et autres
Publié: (2025)
Selective Aggregation of Attention Maps Improves Diffusion-Based Visual Interpretation
par: Park, Jungwon, et autres
Publié: (2026)
par: Park, Jungwon, et autres
Publié: (2026)
RO-Bench: Large-scale robustness evaluation of MLLMs with text-driven counterfactual videos
par: Yang, Zixi, et autres
Publié: (2025)
par: Yang, Zixi, et autres
Publié: (2025)
PerturboLLaVA: Reducing Multimodal Hallucinations with Perturbative Visual Training
par: Chen, Cong, et autres
Publié: (2025)
par: Chen, Cong, et autres
Publié: (2025)
Learning to Reason: Targeted Knowledge Discovery and Fuzzy Logic Update for Robust Image Recognition
par: Srinivas, Gurucharan, et autres
Publié: (2026)
par: Srinivas, Gurucharan, et autres
Publié: (2026)
Understanding Temporal Logic Consistency in Video-Language Models through Cross-Modal Attention Discriminability
par: Li, Chengzhi, et autres
Publié: (2025)
par: Li, Chengzhi, et autres
Publié: (2025)
$\textit{S}^3$Gaussian: Self-Supervised Street Gaussians for Autonomous Driving
par: Huang, Nan, et autres
Publié: (2024)
par: Huang, Nan, et autres
Publié: (2024)
Counting Circuits: Mechanistic Interpretability of Visual Reasoning in Large Vision-Language Models
par: Che, Liwei, et autres
Publié: (2026)
par: Che, Liwei, et autres
Publié: (2026)
From Simple to Professional: A Combinatorial Controllable Image Captioning Agent
par: Wang, Xinran, et autres
Publié: (2024)
par: Wang, Xinran, et autres
Publié: (2024)
RoboSafe: Safeguarding Embodied Agents via Executable Safety Logic
par: Wang, Le, et autres
Publié: (2025)
par: Wang, Le, et autres
Publié: (2025)
Documents similaires
-
HiBug2: Efficient and Interpretable Error Slice Discovery for Comprehensive Model Debugging
par: Chen, Muxi, et autres
Publié: (2025) -
Interpret Your Decision: Logical Reasoning Regularization for Generalization in Visual Classification
par: Tan, Zhaorui, et autres
Publié: (2024) -
FBCIR: Balancing Cross-Modal Focuses in Composed Image Retrieval
par: Zhao, Chenchen, et autres
Publié: (2026) -
LogicQA: Logical Anomaly Detection with Vision Language Model Generated Questions
par: Kwon, Yejin, et autres
Publié: (2025) -
On Explaining Visual Captioning with Hybrid Markov Logic Networks
par: Shah, Monika, et autres
Publié: (2025)