More Pictures Say More: Visual Intersection Network for Open Set Object Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Dong, Bingcheng, Ding, Yuning, Zhang, Jinrong, Zhang, Sifan, Liu, Shenglan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors
por: Wang, Xiangchen, et al.
Publicado: (2025)
por: Wang, Xiangchen, et al.
Publicado: (2025)
More Clear, More Flexible, More Precise: A Comprehensive Oriented Object Detection benchmark for UAV
por: Ye, Kai, et al.
Publicado: (2025)
por: Ye, Kai, et al.
Publicado: (2025)
Focaler-IoU: More Focused Intersection over Union Loss
por: Zhang, Hao, et al.
Publicado: (2024)
por: Zhang, Hao, et al.
Publicado: (2024)
No More Sibling Rivalry: Debiasing Human-Object Interaction Detection
por: Yang, Bin, et al.
Publicado: (2025)
por: Yang, Bin, et al.
Publicado: (2025)
End-to-End Streaming Video Temporal Action Segmentation with Reinforce Learning
por: Zhang, Jinrong, et al.
Publicado: (2023)
por: Zhang, Jinrong, et al.
Publicado: (2023)
Towards Generalized Few-Shot Open-Set Object Detection
por: Su, Binyi, et al.
Publicado: (2022)
por: Su, Binyi, et al.
Publicado: (2022)
Adapted Center and Scale Prediction: More Stable and More Accurate
por: Wang, Wenhao, et al.
Publicado: (2020)
por: Wang, Wenhao, et al.
Publicado: (2020)
Towards More Unified In-context Visual Understanding
por: Sheng, Dianmo, et al.
Publicado: (2023)
por: Sheng, Dianmo, et al.
Publicado: (2023)
LV-OSD: Language-Vision-Complementary Open-Set Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2026)
por: Zhang, Yupeng, et al.
Publicado: (2026)
Grounding DINO 1.5: Advance the "Edge" of Open-Set Object Detection
por: Ren, Tianhe, et al.
Publicado: (2024)
por: Ren, Tianhe, et al.
Publicado: (2024)
Inner-IoU: More Effective Intersection over Union Loss with Auxiliary Bounding Box
por: Zhang, Hao, et al.
Publicado: (2023)
por: Zhang, Hao, et al.
Publicado: (2023)
Floating No More: Object-Ground Reconstruction from a Single Image
por: Man, Yunze, et al.
Publicado: (2024)
por: Man, Yunze, et al.
Publicado: (2024)
Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection
por: Liu, Shilong, et al.
Publicado: (2023)
por: Liu, Shilong, et al.
Publicado: (2023)
One-for-More: Continual Diffusion Model for Anomaly Detection
por: Li, Xiaofan, et al.
Publicado: (2025)
por: Li, Xiaofan, et al.
Publicado: (2025)
Beyond Known Objects: A Novel Framework for Open-Set Object Detection using Negative-Aware Norm
por: Zhang, Yuchen, et al.
Publicado: (2026)
por: Zhang, Yuchen, et al.
Publicado: (2026)
MOSEv2: A More Challenging Dataset for Video Object Segmentation in Complex Scenes
por: Ding, Henghui, et al.
Publicado: (2025)
por: Ding, Henghui, et al.
Publicado: (2025)
Just a Few Glances: Open-Set Visual Perception with Image Prompt Paradigm
por: Zhang, Jinrong, et al.
Publicado: (2024)
por: Zhang, Jinrong, et al.
Publicado: (2024)
Samba+: General and Accurate Salient Object Detection via A More Unified Mamba-based Framework
por: Zhao, Wenzhuo, et al.
Publicado: (2026)
por: Zhao, Wenzhuo, et al.
Publicado: (2026)
MAFE R-CNN: Selecting More Samples to Learn Category-aware Features for Small Object Detection
por: Li, Yichen, et al.
Publicado: (2025)
por: Li, Yichen, et al.
Publicado: (2025)
OSR-ViT: A Simple and Modular Framework for Open-Set Object Detection and Discovery
por: Inkawhich, Matthew, et al.
Publicado: (2024)
por: Inkawhich, Matthew, et al.
Publicado: (2024)
Open-Set Object Detection By Aligning Known Class Representations
por: Sarkar, Hiran, et al.
Publicado: (2024)
por: Sarkar, Hiran, et al.
Publicado: (2024)
Discriminative Consensus Mining with A Thousand Groups for More Accurate Co-Salient Object Detection
por: Zheng, Peng
Publicado: (2024)
por: Zheng, Peng
Publicado: (2024)
Does Seeing More Mean Knowing More? Mono-Anchored Advantage Normalization for Multi-Source Visual Reasoning
por: Zeng, Fanhu, et al.
Publicado: (2026)
por: Zeng, Fanhu, et al.
Publicado: (2026)
Less is More: Token Context-aware Learning for Object Tracking
por: Xu, Chenlong, et al.
Publicado: (2025)
por: Xu, Chenlong, et al.
Publicado: (2025)
MR-GDINO: Efficient Open-World Continual Object Detection
por: Dong, Bowen, et al.
Publicado: (2024)
por: Dong, Bowen, et al.
Publicado: (2024)
Human Eyes Inspired Recurrent Neural Networks are More Robust Against Adversarial Noises
por: Choi, Minkyu, et al.
Publicado: (2022)
por: Choi, Minkyu, et al.
Publicado: (2022)
ViUniT: Visual Unit Tests for More Robust Visual Programming
por: Panagopoulou, Artemis, et al.
Publicado: (2024)
por: Panagopoulou, Artemis, et al.
Publicado: (2024)
Dinomaly: The Less Is More Philosophy in Multi-Class Unsupervised Anomaly Detection
por: Guo, Jia, et al.
Publicado: (2024)
por: Guo, Jia, et al.
Publicado: (2024)
Boosting Few-Shot Open-Set Object Detection via Prompt Learning and Robust Decision Boundary
por: Wu, Zhaowei, et al.
Publicado: (2024)
por: Wu, Zhaowei, et al.
Publicado: (2024)
Less-to-More Generalization: Unlocking More Controllability by In-Context Generation
por: Wu, Shaojin, et al.
Publicado: (2025)
por: Wu, Shaojin, et al.
Publicado: (2025)
Less is More: Discovering Concise Network Explanations
por: Kondapaneni, Neehar, et al.
Publicado: (2024)
por: Kondapaneni, Neehar, et al.
Publicado: (2024)
Streamlined Open-Vocabulary Human-Object Interaction Detection
por: Sun, Chang, et al.
Publicado: (2026)
por: Sun, Chang, et al.
Publicado: (2026)
Straightforward Layer-wise Pruning for More Efficient Visual Adaptation
por: Han, Ruizi, et al.
Publicado: (2024)
por: Han, Ruizi, et al.
Publicado: (2024)
Towards Efficient Vision-Language Tuning: More Information Density, More Generalizability
por: Hao, Tianxiang, et al.
Publicado: (2023)
por: Hao, Tianxiang, et al.
Publicado: (2023)
Boosting Open-Vocabulary Object Detection by Handling Background Samples
por: Zeng, Ruizhe, et al.
Publicado: (2024)
por: Zeng, Ruizhe, et al.
Publicado: (2024)
Rethinking Open-Set Object Detection: Issues, a New Formulation, and Taxonomy
por: Hosoya, Yusuke, et al.
Publicado: (2022)
por: Hosoya, Yusuke, et al.
Publicado: (2022)
Edge Detectors Can Make Deep Convolutional Neural Networks More Robust
por: Ding, Jin, et al.
Publicado: (2024)
por: Ding, Jin, et al.
Publicado: (2024)
UADet: A Remarkably Simple Yet Effective Uncertainty-Aware Open-Set Object Detection Framework
por: Cheng, Silin, et al.
Publicado: (2024)
por: Cheng, Silin, et al.
Publicado: (2024)
A Picture is Worth More Than 77 Text Tokens: Evaluating CLIP-Style Models on Dense Captions
por: Urbanek, Jack, et al.
Publicado: (2023)
por: Urbanek, Jack, et al.
Publicado: (2023)
ODOV: Benchmark the Open-Domain Open-Vocabulary Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2025)
por: Zhang, Yupeng, et al.
Publicado: (2025)
Ejemplares similares
-
Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors
por: Wang, Xiangchen, et al.
Publicado: (2025) -
More Clear, More Flexible, More Precise: A Comprehensive Oriented Object Detection benchmark for UAV
por: Ye, Kai, et al.
Publicado: (2025) -
Focaler-IoU: More Focused Intersection over Union Loss
por: Zhang, Hao, et al.
Publicado: (2024) -
No More Sibling Rivalry: Debiasing Human-Object Interaction Detection
por: Yang, Bin, et al.
Publicado: (2025) -
End-to-End Streaming Video Temporal Action Segmentation with Reinforce Learning
por: Zhang, Jinrong, et al.
Publicado: (2023)