More Pictures Say More: Visual Intersection Network for Open Set Object Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dong, Bingcheng, Ding, Yuning, Zhang, Jinrong, Zhang, Sifan, Liu, Shenglan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors
par: Wang, Xiangchen, et autres
Publié: (2025)
par: Wang, Xiangchen, et autres
Publié: (2025)
More Clear, More Flexible, More Precise: A Comprehensive Oriented Object Detection benchmark for UAV
par: Ye, Kai, et autres
Publié: (2025)
par: Ye, Kai, et autres
Publié: (2025)
Focaler-IoU: More Focused Intersection over Union Loss
par: Zhang, Hao, et autres
Publié: (2024)
par: Zhang, Hao, et autres
Publié: (2024)
No More Sibling Rivalry: Debiasing Human-Object Interaction Detection
par: Yang, Bin, et autres
Publié: (2025)
par: Yang, Bin, et autres
Publié: (2025)
End-to-End Streaming Video Temporal Action Segmentation with Reinforce Learning
par: Zhang, Jinrong, et autres
Publié: (2023)
par: Zhang, Jinrong, et autres
Publié: (2023)
Towards Generalized Few-Shot Open-Set Object Detection
par: Su, Binyi, et autres
Publié: (2022)
par: Su, Binyi, et autres
Publié: (2022)
Adapted Center and Scale Prediction: More Stable and More Accurate
par: Wang, Wenhao, et autres
Publié: (2020)
par: Wang, Wenhao, et autres
Publié: (2020)
Towards More Unified In-context Visual Understanding
par: Sheng, Dianmo, et autres
Publié: (2023)
par: Sheng, Dianmo, et autres
Publié: (2023)
LV-OSD: Language-Vision-Complementary Open-Set Object Detection
par: Zhang, Yupeng, et autres
Publié: (2026)
par: Zhang, Yupeng, et autres
Publié: (2026)
Grounding DINO 1.5: Advance the "Edge" of Open-Set Object Detection
par: Ren, Tianhe, et autres
Publié: (2024)
par: Ren, Tianhe, et autres
Publié: (2024)
Inner-IoU: More Effective Intersection over Union Loss with Auxiliary Bounding Box
par: Zhang, Hao, et autres
Publié: (2023)
par: Zhang, Hao, et autres
Publié: (2023)
Floating No More: Object-Ground Reconstruction from a Single Image
par: Man, Yunze, et autres
Publié: (2024)
par: Man, Yunze, et autres
Publié: (2024)
Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection
par: Liu, Shilong, et autres
Publié: (2023)
par: Liu, Shilong, et autres
Publié: (2023)
One-for-More: Continual Diffusion Model for Anomaly Detection
par: Li, Xiaofan, et autres
Publié: (2025)
par: Li, Xiaofan, et autres
Publié: (2025)
Beyond Known Objects: A Novel Framework for Open-Set Object Detection using Negative-Aware Norm
par: Zhang, Yuchen, et autres
Publié: (2026)
par: Zhang, Yuchen, et autres
Publié: (2026)
MOSEv2: A More Challenging Dataset for Video Object Segmentation in Complex Scenes
par: Ding, Henghui, et autres
Publié: (2025)
par: Ding, Henghui, et autres
Publié: (2025)
Just a Few Glances: Open-Set Visual Perception with Image Prompt Paradigm
par: Zhang, Jinrong, et autres
Publié: (2024)
par: Zhang, Jinrong, et autres
Publié: (2024)
Samba+: General and Accurate Salient Object Detection via A More Unified Mamba-based Framework
par: Zhao, Wenzhuo, et autres
Publié: (2026)
par: Zhao, Wenzhuo, et autres
Publié: (2026)
MAFE R-CNN: Selecting More Samples to Learn Category-aware Features for Small Object Detection
par: Li, Yichen, et autres
Publié: (2025)
par: Li, Yichen, et autres
Publié: (2025)
OSR-ViT: A Simple and Modular Framework for Open-Set Object Detection and Discovery
par: Inkawhich, Matthew, et autres
Publié: (2024)
par: Inkawhich, Matthew, et autres
Publié: (2024)
Open-Set Object Detection By Aligning Known Class Representations
par: Sarkar, Hiran, et autres
Publié: (2024)
par: Sarkar, Hiran, et autres
Publié: (2024)
Discriminative Consensus Mining with A Thousand Groups for More Accurate Co-Salient Object Detection
par: Zheng, Peng
Publié: (2024)
par: Zheng, Peng
Publié: (2024)
Does Seeing More Mean Knowing More? Mono-Anchored Advantage Normalization for Multi-Source Visual Reasoning
par: Zeng, Fanhu, et autres
Publié: (2026)
par: Zeng, Fanhu, et autres
Publié: (2026)
Less is More: Token Context-aware Learning for Object Tracking
par: Xu, Chenlong, et autres
Publié: (2025)
par: Xu, Chenlong, et autres
Publié: (2025)
MR-GDINO: Efficient Open-World Continual Object Detection
par: Dong, Bowen, et autres
Publié: (2024)
par: Dong, Bowen, et autres
Publié: (2024)
Human Eyes Inspired Recurrent Neural Networks are More Robust Against Adversarial Noises
par: Choi, Minkyu, et autres
Publié: (2022)
par: Choi, Minkyu, et autres
Publié: (2022)
ViUniT: Visual Unit Tests for More Robust Visual Programming
par: Panagopoulou, Artemis, et autres
Publié: (2024)
par: Panagopoulou, Artemis, et autres
Publié: (2024)
Dinomaly: The Less Is More Philosophy in Multi-Class Unsupervised Anomaly Detection
par: Guo, Jia, et autres
Publié: (2024)
par: Guo, Jia, et autres
Publié: (2024)
Boosting Few-Shot Open-Set Object Detection via Prompt Learning and Robust Decision Boundary
par: Wu, Zhaowei, et autres
Publié: (2024)
par: Wu, Zhaowei, et autres
Publié: (2024)
Less-to-More Generalization: Unlocking More Controllability by In-Context Generation
par: Wu, Shaojin, et autres
Publié: (2025)
par: Wu, Shaojin, et autres
Publié: (2025)
Less is More: Discovering Concise Network Explanations
par: Kondapaneni, Neehar, et autres
Publié: (2024)
par: Kondapaneni, Neehar, et autres
Publié: (2024)
Streamlined Open-Vocabulary Human-Object Interaction Detection
par: Sun, Chang, et autres
Publié: (2026)
par: Sun, Chang, et autres
Publié: (2026)
Straightforward Layer-wise Pruning for More Efficient Visual Adaptation
par: Han, Ruizi, et autres
Publié: (2024)
par: Han, Ruizi, et autres
Publié: (2024)
Towards Efficient Vision-Language Tuning: More Information Density, More Generalizability
par: Hao, Tianxiang, et autres
Publié: (2023)
par: Hao, Tianxiang, et autres
Publié: (2023)
Boosting Open-Vocabulary Object Detection by Handling Background Samples
par: Zeng, Ruizhe, et autres
Publié: (2024)
par: Zeng, Ruizhe, et autres
Publié: (2024)
Rethinking Open-Set Object Detection: Issues, a New Formulation, and Taxonomy
par: Hosoya, Yusuke, et autres
Publié: (2022)
par: Hosoya, Yusuke, et autres
Publié: (2022)
Edge Detectors Can Make Deep Convolutional Neural Networks More Robust
par: Ding, Jin, et autres
Publié: (2024)
par: Ding, Jin, et autres
Publié: (2024)
UADet: A Remarkably Simple Yet Effective Uncertainty-Aware Open-Set Object Detection Framework
par: Cheng, Silin, et autres
Publié: (2024)
par: Cheng, Silin, et autres
Publié: (2024)
A Picture is Worth More Than 77 Text Tokens: Evaluating CLIP-Style Models on Dense Captions
par: Urbanek, Jack, et autres
Publié: (2023)
par: Urbanek, Jack, et autres
Publié: (2023)
ODOV: Benchmark the Open-Domain Open-Vocabulary Object Detection
par: Zhang, Yupeng, et autres
Publié: (2025)
par: Zhang, Yupeng, et autres
Publié: (2025)
Documents similaires
-
Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors
par: Wang, Xiangchen, et autres
Publié: (2025) -
More Clear, More Flexible, More Precise: A Comprehensive Oriented Object Detection benchmark for UAV
par: Ye, Kai, et autres
Publié: (2025) -
Focaler-IoU: More Focused Intersection over Union Loss
par: Zhang, Hao, et autres
Publié: (2024) -
No More Sibling Rivalry: Debiasing Human-Object Interaction Detection
par: Yang, Bin, et autres
Publié: (2025) -
End-to-End Streaming Video Temporal Action Segmentation with Reinforce Learning
par: Zhang, Jinrong, et autres
Publié: (2023)