LAD-Reasoner: Tiny Multimodal Models are Good Reasoners for Logical Anomaly Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Weijia, Chu, Guanglei, Chen, Jiong, Xie, Guo-Sen, Shan, Caifeng, Zhao, Fang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection
par: Peng, Yun, et autres
Publié: (2024)
par: Peng, Yun, et autres
Publié: (2024)
Kernel-Aware Graph Prompt Learning for Few-Shot Anomaly Detection
par: Tao, Fenfang, et autres
Publié: (2024)
par: Tao, Fenfang, et autres
Publié: (2024)
OmniAD: Detect and Understand Industrial Anomaly via Multimodal Reasoning
par: Zhao, Shifang, et autres
Publié: (2025)
par: Zhao, Shifang, et autres
Publié: (2025)
ABounD: Adversarial Boundary-Driven Few-Shot Learning for Multi-Class Anomaly Detection
par: Deng, Runzhi, et autres
Publié: (2025)
par: Deng, Runzhi, et autres
Publié: (2025)
LR-IAD:Mask-Free Industrial Anomaly Detection with Logical Reasoning
par: Zeng, Peijian, et autres
Publié: (2025)
par: Zeng, Peijian, et autres
Publié: (2025)
LogTinyLLM: Tiny Large Language Models Based Contextual Log Anomaly Detection
par: Ocansey, Isaiah Thompson, et autres
Publié: (2025)
par: Ocansey, Isaiah Thompson, et autres
Publié: (2025)
One-to-More: High-Fidelity Training-Free Anomaly Generation with Attention Control
par: Rao, Haoxiang, et autres
Publié: (2026)
par: Rao, Haoxiang, et autres
Publié: (2026)
Center-Aware Detection with Swin-based Co-DETR Framework for Cervical Cytology
par: Kong, Yan, et autres
Publié: (2026)
par: Kong, Yan, et autres
Publié: (2026)
MuSLR: Multimodal Symbolic Logical Reasoning
par: Xu, Jundong, et autres
Publié: (2025)
par: Xu, Jundong, et autres
Publié: (2025)
Weakly Supervised Video Anomaly Detection with Anomaly-Connected Components and Intention Reasoning
par: Wang, Yu, et autres
Publié: (2026)
par: Wang, Yu, et autres
Publié: (2026)
VideoDetective: Clue Hunting via both Extrinsic Query and Intrinsic Relevance for Long Video Understanding
par: Yang, Ruoliu, et autres
Publié: (2026)
par: Yang, Ruoliu, et autres
Publié: (2026)
PosterCopilot: Toward Layout Reasoning and Controllable Editing for Professional Graphic Design
par: Wei, Jiazhe, et autres
Publié: (2025)
par: Wei, Jiazhe, et autres
Publié: (2025)
DSCA: A Digital Subtraction Angiography Sequence Dataset and Spatio-Temporal Model for Cerebral Artery Segmentation
par: Zhang, Jiong, et autres
Publié: (2024)
par: Zhang, Jiong, et autres
Publié: (2024)
An Effective End-to-End Solution for Multimodal Action Recognition
par: Wang, Songping, et autres
Publié: (2025)
par: Wang, Songping, et autres
Publié: (2025)
Towards Zero-Shot Anomaly Detection and Reasoning with Multimodal Large Language Models
par: Xu, Jiacong, et autres
Publié: (2025)
par: Xu, Jiacong, et autres
Publié: (2025)
Semantic Visual Anomaly Detection and Reasoning in AI-Generated Images
par: Tan, Chuangchuang, et autres
Publié: (2025)
par: Tan, Chuangchuang, et autres
Publié: (2025)
AD-FM: Multimodal LLMs for Anomaly Detection via Multi-Stage Reasoning and Fine-Grained Reward Optimization
par: Liao, Jingyi, et autres
Publié: (2025)
par: Liao, Jingyi, et autres
Publié: (2025)
MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM
par: Dong, Bowen, et autres
Publié: (2025)
par: Dong, Bowen, et autres
Publié: (2025)
Reasoning-OCR: Can Large Multimodal Models Solve Complex Logical Reasoning Problems from OCR Cues?
par: He, Haibin, et autres
Publié: (2025)
par: He, Haibin, et autres
Publié: (2025)
Myriad: Large Multimodal Model by Applying Vision Experts for Industrial Anomaly Detection
par: Li, Yuanze, et autres
Publié: (2023)
par: Li, Yuanze, et autres
Publié: (2023)
Mario: Multimodal Graph Reasoning with Large Language Models
par: Sun, Yuanfu, et autres
Publié: (2026)
par: Sun, Yuanfu, et autres
Publié: (2026)
Follow the Rules: Reasoning for Video Anomaly Detection with Large Language Models
par: Yang, Yuchen, et autres
Publié: (2024)
par: Yang, Yuchen, et autres
Publié: (2024)
BSDM: Background Suppression Diffusion Model for Hyperspectral Anomaly Detection
par: Ma, Jitao, et autres
Publié: (2023)
par: Ma, Jitao, et autres
Publié: (2023)
Plug-and-Play Grounding of Reasoning in Multimodal Large Language Models
par: Chen, Jiaxing, et autres
Publié: (2024)
par: Chen, Jiaxing, et autres
Publié: (2024)
Language-Instructed Reasoning for Group Activity Detection via Multimodal Large Language Model
par: Peng, Jihua, et autres
Publié: (2025)
par: Peng, Jihua, et autres
Publié: (2025)
Similarity Distance-Based Label Assignment for Tiny Object Detection
par: Shi, Shuohao, et autres
Publié: (2024)
par: Shi, Shuohao, et autres
Publié: (2024)
CVP: Central-Peripheral Vision-Inspired Multimodal Model for Spatial Reasoning
par: Chen, Zeyuan, et autres
Publié: (2025)
par: Chen, Zeyuan, et autres
Publié: (2025)
TinyGLASS: Real-Time Self-Supervised In-Sensor Anomaly Detection
par: Bonazzi, Pietro, et autres
Publié: (2026)
par: Bonazzi, Pietro, et autres
Publié: (2026)
Text-Guided Multimodal Unified Industrial Anomaly Detection
par: Li, Zewen, et autres
Publié: (2026)
par: Li, Zewen, et autres
Publié: (2026)
Towards Explainable Industrial Anomaly Detection via Knowledge-Guided Latent Reasoning
par: Chen, Peng, et autres
Publié: (2026)
par: Chen, Peng, et autres
Publié: (2026)
An Empirical Analysis on Spatial Reasoning Capabilities of Large Multimodal Models
par: Shiri, Fatemeh, et autres
Publié: (2024)
par: Shiri, Fatemeh, et autres
Publié: (2024)
Component-aware Unsupervised Logical Anomaly Generation for Industrial Anomaly Detection
par: Tong, Xuan, et autres
Publié: (2025)
par: Tong, Xuan, et autres
Publié: (2025)
MMhops-R1: Multimodal Multi-hop Reasoning
par: Zhang, Tao, et autres
Publié: (2025)
par: Zhang, Tao, et autres
Publié: (2025)
IADGPT: Unified LVLM for Few-Shot Industrial Anomaly Detection, Localization, and Reasoning via In-Context Learning
par: Zhao, Mengyang, et autres
Publié: (2025)
par: Zhao, Mengyang, et autres
Publié: (2025)
Reasoning-Driven Anomaly Detection and Localization with Image-Level Supervision
par: Jin, Yizhou, et autres
Publié: (2026)
par: Jin, Yizhou, et autres
Publié: (2026)
DPNet: Dynamic Pooling Network for Tiny Object Detection
par: Gong, Luqi, et autres
Publié: (2025)
par: Gong, Luqi, et autres
Publié: (2025)
Cultivating Forensic Reasoning for Generalizable Multimodal Manipulation Detection
par: Zhang, Yuchen, et autres
Publié: (2026)
par: Zhang, Yuchen, et autres
Publié: (2026)
SpatiaLQA: A Benchmark for Evaluating Spatial Logical Reasoning in Vision-Language Models
par: Xie, Yuechen, et autres
Publié: (2026)
par: Xie, Yuechen, et autres
Publié: (2026)
LogicOCR: Do Your Large Multimodal Models Excel at Logical Reasoning on Text-Rich Images?
par: Ye, Maoyuan, et autres
Publié: (2025)
par: Ye, Maoyuan, et autres
Publié: (2025)
TinyEmo: Scaling down Emotional Reasoning via Metric Projection
par: Gutierrez, Cristian
Publié: (2024)
par: Gutierrez, Cristian
Publié: (2024)
Documents similaires
-
SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection
par: Peng, Yun, et autres
Publié: (2024) -
Kernel-Aware Graph Prompt Learning for Few-Shot Anomaly Detection
par: Tao, Fenfang, et autres
Publié: (2024) -
OmniAD: Detect and Understand Industrial Anomaly via Multimodal Reasoning
par: Zhao, Shifang, et autres
Publié: (2025) -
ABounD: Adversarial Boundary-Driven Few-Shot Learning for Multi-Class Anomaly Detection
par: Deng, Runzhi, et autres
Publié: (2025) -
LR-IAD:Mask-Free Industrial Anomaly Detection with Logical Reasoning
par: Zeng, Peijian, et autres
Publié: (2025)