Chain of Visual Perception: Harnessing Multimodal Large Language Models for Zero-shot Camouflaged Object Detection
Fuente:
arXiv
Saved in:
| Main Authors: | Tang, Lv, Jiang, Peng-Tao, Shen, Zhihao, Zhang, Hao, Chen, Jinwei, Li, Bo |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Evaluating SAM2's Role in Camouflaged Object Detection: From SAM to SAM2
by: Tang, Lv, et al.
Published: (2024)
by: Tang, Lv, et al.
Published: (2024)
Scalable Visual State Space Model with Fractal Scanning
by: Tang, Lv, et al.
Published: (2024)
by: Tang, Lv, et al.
Published: (2024)
Synthetic-to-Real Camouflaged Object Detection
by: Luo, Zhihao, et al.
Published: (2025)
by: Luo, Zhihao, et al.
Published: (2025)
Zero-Shot Aerial Object Detection with Visual Description Regularization
by: Zang, Zhengqing, et al.
Published: (2024)
by: Zang, Zhengqing, et al.
Published: (2024)
Frequency Perception Network for Camouflaged Object Detection
by: Cong, Runmin, et al.
Published: (2023)
by: Cong, Runmin, et al.
Published: (2023)
Discover, Segment, and Select: A Progressive Mechanism for Zero-shot Camouflaged Object Segmentation
by: Yang, Yilong, et al.
Published: (2026)
by: Yang, Yilong, et al.
Published: (2026)
Empowering Segmentation Ability to Multi-modal Large Language Models
by: Yang, Yuqi, et al.
Published: (2024)
by: Yang, Yuqi, et al.
Published: (2024)
Exploring Deeper! Segment Anything Model with Depth Perception for Camouflaged Object Detection
by: Yu, Zhenni, et al.
Published: (2024)
by: Yu, Zhenni, et al.
Published: (2024)
Zero-Shot Co-salient Object Detection Framework
by: Xiao, Haoke, et al.
Published: (2023)
by: Xiao, Haoke, et al.
Published: (2023)
Conditional Polarization Guidance for Camouflaged Object Detection
by: Zhang, QIfan, et al.
Published: (2026)
by: Zhang, QIfan, et al.
Published: (2026)
GLCONet: Learning Multi-source Perception Representation for Camouflaged Object Detection
by: Sun, Yanguang, et al.
Published: (2024)
by: Sun, Yanguang, et al.
Published: (2024)
A Survey of Camouflaged Object Detection and Beyond
by: Xiao, Fengyang, et al.
Published: (2024)
by: Xiao, Fengyang, et al.
Published: (2024)
Towards Real Zero-Shot Camouflaged Object Segmentation without Camouflaged Annotations
by: Lei, Cheng, et al.
Published: (2024)
by: Lei, Cheng, et al.
Published: (2024)
FCL-COD: Weakly Supervised Camouflaged Object Detection with Frequency-aware and Contrastive Learning
by: Ni, Jingchen, et al.
Published: (2026)
by: Ni, Jingchen, et al.
Published: (2026)
Dr. Seg: Revisiting GRPO Training for Visual Large Language Models through Perception-Oriented Design
by: Sun, Haoxiang, et al.
Published: (2026)
by: Sun, Haoxiang, et al.
Published: (2026)
Referring Camouflaged Object Detection
by: Zhang, Xuying, et al.
Published: (2023)
by: Zhang, Xuying, et al.
Published: (2023)
Zero-shot Generalizable Incremental Learning for Vision-Language Object Detection
by: Deng, Jieren, et al.
Published: (2024)
by: Deng, Jieren, et al.
Published: (2024)
Mamba-based Spatio-Frequency Motion Perception for Video Camouflaged Object Detection
by: Li, Xin, et al.
Published: (2025)
by: Li, Xin, et al.
Published: (2025)
Harnessing Chain-of-Thought Reasoning in Multimodal Large Language Models for Face Anti-Spoofing
by: Zhang, Honglu, et al.
Published: (2025)
by: Zhang, Honglu, et al.
Published: (2025)
Modality-Agnostic Prompt Learning for Multi-Modal Camouflaged Object Detection
by: Wang, Hao, et al.
Published: (2026)
by: Wang, Hao, et al.
Published: (2026)
VMAD: Visual-enhanced Multimodal Large Language Model for Zero-Shot Anomaly Detection
by: Deng, Huilin, et al.
Published: (2024)
by: Deng, Huilin, et al.
Published: (2024)
Towards Accurate Camouflaged Object Detection with Mixture Convolution and Interactive Fusion
by: Chen, Geng, et al.
Published: (2021)
by: Chen, Geng, et al.
Published: (2021)
LLaVA-RadZ: Can Multimodal Large Language Models Effectively Tackle Zero-shot Radiology Recognition?
by: Li, Bangyan, et al.
Published: (2025)
by: Li, Bangyan, et al.
Published: (2025)
Benchmarking Vision-Language and Multimodal Large Language Models in Zero-shot and Few-shot Scenarios: A study on Christian Iconography
by: Spinaci, Gianmarco, et al.
Published: (2025)
by: Spinaci, Gianmarco, et al.
Published: (2025)
SFGNet: Semantic and Frequency Guided Network for Camouflaged Object Detection
by: Wang, Dezhen, et al.
Published: (2025)
by: Wang, Dezhen, et al.
Published: (2025)
Rethinking Detecting Salient and Camouflaged Objects in Unconstrained Scenes
by: Zhou, Zhangjun, et al.
Published: (2024)
by: Zhou, Zhangjun, et al.
Published: (2024)
CAMotion: A High-Quality Benchmark for Camouflaged Moving Object Detection in the Wild
by: Yao, Siyuan, et al.
Published: (2026)
by: Yao, Siyuan, et al.
Published: (2026)
VoroNav: Voronoi-based Zero-shot Object Navigation with Large Language Model
by: Wu, Pengying, et al.
Published: (2024)
by: Wu, Pengying, et al.
Published: (2024)
Visual Programming for Zero-shot Open-Vocabulary 3D Visual Grounding
by: Yuan, Zhihao, et al.
Published: (2023)
by: Yuan, Zhihao, et al.
Published: (2023)
Understanding Graphical Perception in Data Visualization through Zero-shot Prompting of Vision-Language Models
by: Guo, Grace, et al.
Published: (2024)
by: Guo, Grace, et al.
Published: (2024)
Towards Training-free Open-world Segmentation via Image Prompt Foundation Models
by: Tang, Lv, et al.
Published: (2023)
by: Tang, Lv, et al.
Published: (2023)
Green Video Camouflaged Object Detection
by: Wang, Xinyu, et al.
Published: (2025)
by: Wang, Xinyu, et al.
Published: (2025)
Retrospective Memory for Camouflaged Object Detection
by: Zhang, Chenxi, et al.
Published: (2025)
by: Zhang, Chenxi, et al.
Published: (2025)
Boundary-Guided Camouflaged Object Detection
by: Sun, Yujia, et al.
Published: (2022)
by: Sun, Yujia, et al.
Published: (2022)
MagicTryOn: Harnessing Diffusion Transformer for Garment-Preserving Video Virtual Try-on
by: Li, Guangyuan, et al.
Published: (2025)
by: Li, Guangyuan, et al.
Published: (2025)
Seamless Detection: Unifying Salient Object Detection and Camouflaged Object Detection
by: Liu, Yi, et al.
Published: (2024)
by: Liu, Yi, et al.
Published: (2024)
VisTa: Visual-contextual and Text-augmented Zero-shot Object-level OOD Detection
by: Zhang, Bin, et al.
Published: (2025)
by: Zhang, Bin, et al.
Published: (2025)
ZS-VCOS: Zero-Shot Video Camouflaged Object Segmentation By Optical Flow and Open Vocabulary Object Detection
by: Guo, Wenqi, et al.
Published: (2025)
by: Guo, Wenqi, et al.
Published: (2025)
Uncertainty-Masked Bernoulli Diffusion for Camouflaged Object Detection Refinement
by: Shen, Yuqi, et al.
Published: (2025)
by: Shen, Yuqi, et al.
Published: (2025)
Combining Knowledge Graph and LLMs for Enhanced Zero-shot Visual Question Answering
by: Tao, Qian, et al.
Published: (2025)
by: Tao, Qian, et al.
Published: (2025)
Similar Items
-
Evaluating SAM2's Role in Camouflaged Object Detection: From SAM to SAM2
by: Tang, Lv, et al.
Published: (2024) -
Scalable Visual State Space Model with Fractal Scanning
by: Tang, Lv, et al.
Published: (2024) -
Synthetic-to-Real Camouflaged Object Detection
by: Luo, Zhihao, et al.
Published: (2025) -
Zero-Shot Aerial Object Detection with Visual Description Regularization
by: Zang, Zhengqing, et al.
Published: (2024) -
Frequency Perception Network for Camouflaged Object Detection
by: Cong, Runmin, et al.
Published: (2023)