LLM-Guided Agentic Object Detection for Open-World Understanding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mumcu, Furkan, Jones, Michael J., Cherian, Anoop, Yilmaz, Yasin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Leveraging Multimodal LLM Descriptions of Activity for Explainable Semi-Supervised Video Anomaly Detection
par: Mumcu, Furkan, et autres
Publié: (2025)
par: Mumcu, Furkan, et autres
Publié: (2025)
Is Video Anomaly Detection Misframed? Evidence from LLM-Based and Multi-Scene Models
par: Mumcu, Furkan, et autres
Publié: (2026)
par: Mumcu, Furkan, et autres
Publié: (2026)
ComplexVAD: Detecting Interaction Anomalies in Video
par: Mumcu, Furkan, et autres
Publié: (2025)
par: Mumcu, Furkan, et autres
Publié: (2025)
Universal and Efficient Detection of Adversarial Data through Nonuniform Impact on Network Layers
par: Mumcu, Furkan, et autres
Publié: (2025)
par: Mumcu, Furkan, et autres
Publié: (2025)
Multimodal Attack Detection for Action Recognition Models
par: Mumcu, Furkan, et autres
Publié: (2024)
par: Mumcu, Furkan, et autres
Publié: (2024)
Improving Open-World Object Localization by Discovering Background
par: Singh, Ashish, et autres
Publié: (2025)
par: Singh, Ashish, et autres
Publié: (2025)
Agentic AI-Empowered Dynamic Survey Framework
par: Mumcu, Furkan, et autres
Publié: (2026)
par: Mumcu, Furkan, et autres
Publié: (2026)
MMHOI: Modeling Complex 3D Multi-Human Multi-Object Interactions
par: Kogashi, Kaen, et autres
Publié: (2025)
par: Kogashi, Kaen, et autres
Publié: (2025)
QVAD: A Question-Centric Agentic Framework for Efficient and Training-Free Video Anomaly Detection
par: Bekit, Lokman, et autres
Publié: (2026)
par: Bekit, Lokman, et autres
Publié: (2026)
Socially-Weighted Alignment: A Game-Theoretic Framework for Multi-Agent LLM Systems
par: Mumcu, Furkan, et autres
Publié: (2026)
par: Mumcu, Furkan, et autres
Publié: (2026)
Robustness of Agentic AI Systems via Adversarially-Aligned Jacobian Regularization
par: Mumcu, Furkan, et autres
Publié: (2026)
par: Mumcu, Furkan, et autres
Publié: (2026)
DINO-X: A Unified Vision Model for Open-World Object Detection and Understanding
par: Ren, Tianhe, et autres
Publié: (2024)
par: Ren, Tianhe, et autres
Publié: (2024)
Semi-supervised Open-World Object Detection
par: Mullappilly, Sahal Shaji, et autres
Publié: (2024)
par: Mullappilly, Sahal Shaji, et autres
Publié: (2024)
Open World Object Detection: A Survey
par: Li, Yiming, et autres
Publié: (2024)
par: Li, Yiming, et autres
Publié: (2024)
VL-SAM-v3: Memory-Guided Visual Priors for Open-World Object Detection
par: Liu, Chih-Chung, et autres
Publié: (2026)
par: Liu, Chih-Chung, et autres
Publié: (2026)
Detecting Adversarial Examples
par: Mumcu, Furkan, et autres
Publié: (2024)
par: Mumcu, Furkan, et autres
Publié: (2024)
Detecting Unknown Objects via Energy-based Separation for Open World Object Detection
par: Heo, Jun-Woo, et autres
Publié: (2026)
par: Heo, Jun-Woo, et autres
Publié: (2026)
Towards Open-Vocabulary Multimodal 3D Object Detection with Attributes
par: Xiang, Xinhao, et autres
Publié: (2025)
par: Xiang, Xinhao, et autres
Publié: (2025)
Detecting Adversarial Data via Provable Adversarial Noise Amplification
par: Mumcu, Furkan, et autres
Publié: (2026)
par: Mumcu, Furkan, et autres
Publié: (2026)
Manual-PA: Learning 3D Part Assembly from Instruction Diagrams
par: Zhang, Jiahao, et autres
Publié: (2024)
par: Zhang, Jiahao, et autres
Publié: (2024)
Beyond Flat Unknown Labels in Open-World Object Detection
par: Zhang, Yuchen, et autres
Publié: (2025)
par: Zhang, Yuchen, et autres
Publié: (2025)
MR-GDINO: Efficient Open-World Continual Object Detection
par: Dong, Bowen, et autres
Publié: (2024)
par: Dong, Bowen, et autres
Publié: (2024)
YOLO-World: Real-Time Open-Vocabulary Object Detection
par: Cheng, Tianheng, et autres
Publié: (2024)
par: Cheng, Tianheng, et autres
Publié: (2024)
A Hierarchical Benchmark of Foundation Models for Dermatology
par: Yuceyalcin, Furkan, et autres
Publié: (2026)
par: Yuceyalcin, Furkan, et autres
Publié: (2026)
OpenAD: Open-World Autonomous Driving Benchmark for 3D Object Detection
par: Xia, Zhongyu, et autres
Publié: (2024)
par: Xia, Zhongyu, et autres
Publié: (2024)
AssemblyBench: Physics-Aware Assembly of Complex Industrial Objects
par: Li, Danrui, et autres
Publié: (2026)
par: Li, Danrui, et autres
Publié: (2026)
Beyond Literal Descriptions: Understanding and Locating Open-World Objects Aligned with Human Intentions
par: Wang, Wenxuan, et autres
Publié: (2024)
par: Wang, Wenxuan, et autres
Publié: (2024)
YOLO-UniOW: Efficient Universal Open-World Object Detection
par: Liu, Lihao, et autres
Publié: (2024)
par: Liu, Lihao, et autres
Publié: (2024)
Looking Beyond the Known: Towards a Data Discovery Guided Open-World Object Detection
par: Majee, Anay, et autres
Publié: (2025)
par: Majee, Anay, et autres
Publié: (2025)
Decoupled PROB: Decoupled Query Initialization Tasks and Objectness-Class Learning for Open World Object Detection
par: Inoue, Riku, et autres
Publié: (2025)
par: Inoue, Riku, et autres
Publié: (2025)
Open-World Human-Object Interaction Detection via Multi-modal Prompts
par: Yang, Jie, et autres
Publié: (2024)
par: Yang, Jie, et autres
Publié: (2024)
Towards Agentic AI for Multimodal-Guided Video Object Segmentation
par: Tran, Tuyen, et autres
Publié: (2025)
par: Tran, Tuyen, et autres
Publié: (2025)
Generalized Open-World Semi-Supervised Object Detection
par: Allabadi, Garvita, et autres
Publié: (2023)
par: Allabadi, Garvita, et autres
Publié: (2023)
GUIDED: Granular Understanding via Identification, Detection, and Discrimination for Fine-Grained Open-Vocabulary Object Detection
par: Li, Jiaming, et autres
Publié: (2026)
par: Li, Jiaming, et autres
Publié: (2026)
Aligning Step-by-Step Instructional Diagrams to Video Demonstrations
par: Zhang, Jiahao, et autres
Publié: (2023)
par: Zhang, Jiahao, et autres
Publié: (2023)
OW-Rep: Open World Object Detection with Instance Representation Learning
par: Lee, Sunoh, et autres
Publié: (2024)
par: Lee, Sunoh, et autres
Publié: (2024)
SpinBench: Perspective and Rotation as a Lens on Spatial Reasoning in VLMs
par: Zhang, Yuyou, et autres
Publié: (2025)
par: Zhang, Yuyou, et autres
Publié: (2025)
Retrieval-Augmented Open-Vocabulary Object Detection
par: Kim, Jooyeon, et autres
Publié: (2024)
par: Kim, Jooyeon, et autres
Publié: (2024)
Collaborative Novel Object Discovery and Box-Guided Cross-Modal Alignment for Open-Vocabulary 3D Object Detection
par: Cao, Yang, et autres
Publié: (2024)
par: Cao, Yang, et autres
Publié: (2024)
VL-SAM-V2: Open-World Object Detection with General and Specific Query Fusion
par: Lin, Zhiwei, et autres
Publié: (2025)
par: Lin, Zhiwei, et autres
Publié: (2025)
Documents similaires
-
Leveraging Multimodal LLM Descriptions of Activity for Explainable Semi-Supervised Video Anomaly Detection
par: Mumcu, Furkan, et autres
Publié: (2025) -
Is Video Anomaly Detection Misframed? Evidence from LLM-Based and Multi-Scene Models
par: Mumcu, Furkan, et autres
Publié: (2026) -
ComplexVAD: Detecting Interaction Anomalies in Video
par: Mumcu, Furkan, et autres
Publié: (2025) -
Universal and Efficient Detection of Adversarial Data through Nonuniform Impact on Network Layers
par: Mumcu, Furkan, et autres
Publié: (2025) -
Multimodal Attack Detection for Action Recognition Models
par: Mumcu, Furkan, et autres
Publié: (2024)