EntroAD: Structural Entropy-Guided Prompt Adaptation for Zero-Shot Anomaly Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Xinyu, Sun, Qingyun, Luo, Jiayi, Li, Jianxin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Automatic Prompt Generation and Grounding Object Detection for Zero-Shot Image Anomaly Detection
par: Cheung, Tsun-Hin, et autres
Publié: (2024)
par: Cheung, Tsun-Hin, et autres
Publié: (2024)
Test-Time Adaptation with CLIP Reward for Zero-Shot Generalization in Vision-Language Models
par: Zhao, Shuai, et autres
Publié: (2023)
par: Zhao, Shuai, et autres
Publié: (2023)
Scaling Prompt Instructed Zero Shot Composed Image Retrieval with Image-Only Data
par: Duan, Yiqun, et autres
Publié: (2025)
par: Duan, Yiqun, et autres
Publié: (2025)
Do LLMs Understand Visual Anomalies? Uncovering LLM's Capabilities in Zero-shot Anomaly Detection
par: Zhu, Jiaqi, et autres
Publié: (2024)
par: Zhu, Jiaqi, et autres
Publié: (2024)
Segmentation-Based Attention Entropy: Detecting and Mitigating Object Hallucinations in Large Vision-Language Models
par: Song, Jiale, et autres
Publié: (2026)
par: Song, Jiale, et autres
Publié: (2026)
FreeMask: Rethinking the Importance of Attention Masks for Zero-Shot Video Editing
par: Cai, Lingling, et autres
Publié: (2024)
par: Cai, Lingling, et autres
Publié: (2024)
UniCVR: From Alignment to Reranking for Unified Zero-Shot Composed Visual Retrieval
par: Wen, Haokun, et autres
Publié: (2026)
par: Wen, Haokun, et autres
Publié: (2026)
MMBench-Video: A Long-Form Multi-Shot Benchmark for Holistic Video Understanding
par: Fang, Xinyu, et autres
Publié: (2024)
par: Fang, Xinyu, et autres
Publié: (2024)
Zero-Shot Visual Grounding in 3D Gaussians via View Retrieval
par: Liao, Liwei, et autres
Publié: (2025)
par: Liao, Liwei, et autres
Publié: (2025)
Zero-Shot Character Identification and Speaker Prediction in Comics via Iterative Multimodal Fusion
par: Li, Yingxuan, et autres
Publié: (2024)
par: Li, Yingxuan, et autres
Publié: (2024)
Context Guided Transformer Entropy Modeling for Video Compression
par: Tong, Junlong, et autres
Publié: (2025)
par: Tong, Junlong, et autres
Publié: (2025)
Fine-grained Textual Inversion Network for Zero-Shot Composed Image Retrieval
par: Lin, Haoqiang, et autres
Publié: (2025)
par: Lin, Haoqiang, et autres
Publié: (2025)
Generalized Video Anomaly Event Detection: Systematic Taxonomy and Comparison of Deep Models
par: Liu, Yang, et autres
Publié: (2023)
par: Liu, Yang, et autres
Publié: (2023)
Prompt-Guided Generation of Structured Chest X-Ray Report Using a Pre-trained LLM
par: Li, Hongzhao, et autres
Publié: (2024)
par: Li, Hongzhao, et autres
Publié: (2024)
Modality-Aware Shot Relating and Comparing for Video Scene Detection
par: Tan, Jiawei, et autres
Publié: (2024)
par: Tan, Jiawei, et autres
Publié: (2024)
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
par: He, Jiayi, et autres
Publié: (2025)
par: He, Jiayi, et autres
Publié: (2025)
SAM as the Guide: Mastering Pseudo-Label Refinement in Semi-Supervised Referring Expression Segmentation
par: Yang, Danni, et autres
Publié: (2024)
par: Yang, Danni, et autres
Publié: (2024)
MSVBench: Towards Human-Level Evaluation of Multi-Shot Video Generation
par: Shi, Haoyuan, et autres
Publié: (2026)
par: Shi, Haoyuan, et autres
Publié: (2026)
Training-and-Prompt-Free General Painterly Harmonization via Zero-Shot Disentenglement on Style and Content References
par: Hsiao, Teng-Fang, et autres
Publié: (2024)
par: Hsiao, Teng-Fang, et autres
Publié: (2024)
Robust Modality-incomplete Anomaly Detection: A Modality-instructive Framework with Benchmark
par: Miao, Bingchen, et autres
Publié: (2024)
par: Miao, Bingchen, et autres
Publié: (2024)
Identity-Preserving Text-to-Video Generation via Training-Free Prompt, Image, and Guidance Enhancement
par: Gao, Jiayi, et autres
Publié: (2025)
par: Gao, Jiayi, et autres
Publié: (2025)
LAPIG: Language Guided Projector Image Generation with Surface Adaptation and Stylization
par: Deng, Yuchen, et autres
Publié: (2025)
par: Deng, Yuchen, et autres
Publié: (2025)
DanceCamAnimator: Keyframe-Based Controllable 3D Dance Camera Synthesis
par: Wang, Zixuan, et autres
Publié: (2024)
par: Wang, Zixuan, et autres
Publié: (2024)
Bridging the Pose-Semantic Gap: A Cascade Framework for Text-Based Person Anomaly Search
par: Xie, Zequn, et autres
Publié: (2026)
par: Xie, Zequn, et autres
Publié: (2026)
OT-DETECTOR: Delving into Optimal Transport for Zero-shot Out-of-Distribution Detection
par: Liu, Yu, et autres
Publié: (2025)
par: Liu, Yu, et autres
Publié: (2025)
ProFD: Prompt-Guided Feature Disentangling for Occluded Person Re-Identification
par: Cui, Can, et autres
Publié: (2024)
par: Cui, Can, et autres
Publié: (2024)
InteractEdit: Zero-Shot Editing of Human-Object Interactions in Images
par: Hoe, Jiun Tian, et autres
Publié: (2025)
par: Hoe, Jiun Tian, et autres
Publié: (2025)
Decompose and Transfer: CoT-Prompting Enhanced Alignment for Open-Vocabulary Temporal Action Detection
par: Zhu, Sa, et autres
Publié: (2026)
par: Zhu, Sa, et autres
Publié: (2026)
VAAS: Vision-Attention Anomaly Scoring for Image Manipulation Detection in Digital Forensics
par: Bamigbade, Opeyemi, et autres
Publié: (2025)
par: Bamigbade, Opeyemi, et autres
Publié: (2025)
GMFVAD: Using Grained Multi-modal Feature to Improve Video Anomaly Detection
par: Dai, Guangyu, et autres
Publié: (2025)
par: Dai, Guangyu, et autres
Publié: (2025)
Beyond Patches: Global-aware Autoregressive Model for Multimodal Few-Shot Font Generation
par: Cai, Haonan, et autres
Publié: (2026)
par: Cai, Haonan, et autres
Publié: (2026)
Multi-modal Speech Emotion Recognition via Feature Distribution Adaptation Network
par: Li, Shaokai, et autres
Publié: (2024)
par: Li, Shaokai, et autres
Publié: (2024)
Visual Grounding with Multi-modal Conditional Adaptation
par: Yao, Ruilin, et autres
Publié: (2024)
par: Yao, Ruilin, et autres
Publié: (2024)
Unleashing Text-to-Image Diffusion Prior for Zero-Shot Image Captioning
par: Luo, Jianjie, et autres
Publié: (2024)
par: Luo, Jianjie, et autres
Publié: (2024)
Towards Generalizable Deepfake Detection via Forgery-aware Audio-Visual Adaptation: A Variational Bayesian Approach
par: Nie, Fan, et autres
Publié: (2025)
par: Nie, Fan, et autres
Publié: (2025)
Interpretable Concept-based Deep Learning Framework for Multimodal Human Behavior Modeling
par: Li, Xinyu, et autres
Publié: (2025)
par: Li, Xinyu, et autres
Publié: (2025)
Zero-shot Video Moment Retrieval via Off-the-shelf Multimodal Large Language Models
par: Xu, Yifang, et autres
Publié: (2025)
par: Xu, Yifang, et autres
Publié: (2025)
An Effective Image Copy-Move Forgery Detection Using Entropy Information
par: Jiang, Li, et autres
Publié: (2023)
par: Jiang, Li, et autres
Publié: (2023)
GAIA: Zero-shot Talking Avatar Generation
par: He, Tianyu, et autres
Publié: (2023)
par: He, Tianyu, et autres
Publié: (2023)
KAN-SAM: Kolmogorov-Arnold Network Guided Segment Anything Model for RGB-T Salient Object Detection
par: Li, Xingyuan, et autres
Publié: (2025)
par: Li, Xingyuan, et autres
Publié: (2025)
Documents similaires
-
Automatic Prompt Generation and Grounding Object Detection for Zero-Shot Image Anomaly Detection
par: Cheung, Tsun-Hin, et autres
Publié: (2024) -
Test-Time Adaptation with CLIP Reward for Zero-Shot Generalization in Vision-Language Models
par: Zhao, Shuai, et autres
Publié: (2023) -
Scaling Prompt Instructed Zero Shot Composed Image Retrieval with Image-Only Data
par: Duan, Yiqun, et autres
Publié: (2025) -
Do LLMs Understand Visual Anomalies? Uncovering LLM's Capabilities in Zero-shot Anomaly Detection
par: Zhu, Jiaqi, et autres
Publié: (2024) -
Segmentation-Based Attention Entropy: Detecting and Mitigating Object Hallucinations in Large Vision-Language Models
par: Song, Jiale, et autres
Publié: (2026)