Crowd-SAM: SAM as a Smart Annotator for Object Detection in Crowded Scenes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cai, Zhi, Gao, Yingjie, Zheng, Yaoyan, Zhou, Nan, Huang, Di |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Density-based Object Detection in Crowded Scenes
par: Zhao, Chenyang, et autres
Publié: (2025)
par: Zhao, Chenyang, et autres
Publié: (2025)
Robust Zero-Shot Crowd Counting and Localization With Adaptive Resolution SAM
par: Wan, Jia, et autres
Publié: (2024)
par: Wan, Jia, et autres
Publié: (2024)
SAM-pose2seg: Pose-Guided Human Instance Segmentation in Crowds
par: Kolomiiets, Constantin, et autres
Publié: (2026)
par: Kolomiiets, Constantin, et autres
Publié: (2026)
Implicit Modeling for Transferability Estimation of Vision Foundation Models
par: Zheng, Yaoyan, et autres
Publié: (2025)
par: Zheng, Yaoyan, et autres
Publié: (2025)
CoVFT: Context-aware Visual Fine-tuning for Multimodal Large Language Models
par: Zhou, Nan, et autres
Publié: (2026)
par: Zhou, Nan, et autres
Publié: (2026)
Evaluating SAM2's Role in Camouflaged Object Detection: From SAM to SAM2
par: Tang, Lv, et autres
Publié: (2024)
par: Tang, Lv, et autres
Publié: (2024)
Analysis of Unstructured High-Density Crowded Scenes for Crowd Monitoring
par: Matov, Alexandre
Publié: (2024)
par: Matov, Alexandre
Publié: (2024)
Test-Time Adaptive Object Detection with Foundation Model
par: Gao, Yingjie, et autres
Publié: (2025)
par: Gao, Yingjie, et autres
Publié: (2025)
M$^4$-SAM: Multi-Modal Mixture-of-Experts with Memory-Augmented SAM for RGB-D Video Salient Object Detection
par: Liu, Jiyuan, et autres
Publié: (2026)
par: Liu, Jiyuan, et autres
Publié: (2026)
DynamicTrack: Advancing Gigapixel Tracking in Crowded Scenes
par: Zhao, Yunqi, et autres
Publié: (2024)
par: Zhao, Yunqi, et autres
Publié: (2024)
SAM-COD: SAM-guided Unified Framework for Weakly-Supervised Camouflaged Object Detection
par: Chen, Huafeng, et autres
Publié: (2024)
par: Chen, Huafeng, et autres
Publié: (2024)
CrowdQuery: Density-Guided Query Module for Enhanced 2D and 3D Detection in Crowded Scenes
par: Dähling, Marius, et autres
Publié: (2025)
par: Dähling, Marius, et autres
Publié: (2025)
Semi-Supervised Crowd Counting with Contextual Modeling: Facilitating Holistic Understanding of Crowd Scenes
par: Qian, Yifei, et autres
Publié: (2023)
par: Qian, Yifei, et autres
Publié: (2023)
Deep Common Feature Mining for Efficient Video Semantic Segmentation
par: Zheng, Yaoyan, et autres
Publié: (2024)
par: Zheng, Yaoyan, et autres
Publié: (2024)
ET-SAM: Efficient Point Prompt Prediction in SAM for Unified Scene Text Detection and Layout Analysis
par: Zhang, Xike, et autres
Publié: (2026)
par: Zhang, Xike, et autres
Publié: (2026)
Towards Unbiased Source-Free Object Detection via Vision Foundation Models
par: Cai, Zhi, et autres
Publié: (2026)
par: Cai, Zhi, et autres
Publié: (2026)
ST-SAM: SAM-Driven Self-Training Framework for Semi-Supervised Camouflaged Object Detection
par: Hu, Xihang, et autres
Publié: (2025)
par: Hu, Xihang, et autres
Publié: (2025)
Pro2SAM: Mask Prompt to SAM with Grid Points for Weakly Supervised Object Localization
par: Yang, Xi, et autres
Publié: (2025)
par: Yang, Xi, et autres
Publié: (2025)
One-Shot Crowd Counting With Density Guidance For Scene Adaptation
par: Chen, Jiwei, et autres
Publié: (2026)
par: Chen, Jiwei, et autres
Publié: (2026)
IndoorCrowd: A Multi-Scene Dataset for Human Detection, Segmentation, and Tracking with an Automated Annotation Pipeline
par: Nae, Sebastian-Ion, et autres
Publié: (2026)
par: Nae, Sebastian-Ion, et autres
Publié: (2026)
EdgeSAM: Prompt-In-the-Loop Distillation for SAM
par: Zhou, Chong, et autres
Publié: (2023)
par: Zhou, Chong, et autres
Publié: (2023)
Medical Image Segmentation with SAM-generated Annotations
par: Häkkinen, Iira, et autres
Publié: (2024)
par: Häkkinen, Iira, et autres
Publié: (2024)
Char-SAM: Turning Segment Anything Model into Scene Text Segmentation Annotator with Character-level Visual Prompts
par: Xie, Enze, et autres
Publié: (2024)
par: Xie, Enze, et autres
Publié: (2024)
SEG-SAM: Semantic-Guided SAM for Unified Medical Image Segmentation
par: Huang, Shuangping, et autres
Publié: (2024)
par: Huang, Shuangping, et autres
Publié: (2024)
SAM-IF: Leveraging SAM for Incremental Few-Shot Instance Segmentation
par: Zhou, Xudong, et autres
Publié: (2024)
par: Zhou, Xudong, et autres
Publié: (2024)
3DTeethSAM: Taming SAM2 for 3D Teeth Segmentation
par: Lu, Zhiguo, et autres
Publié: (2025)
par: Lu, Zhiguo, et autres
Publié: (2025)
CrowdSplat: Exploring Gaussian Splatting For Crowd Rendering
par: Sun, Xiaohan, et autres
Publié: (2025)
par: Sun, Xiaohan, et autres
Publié: (2025)
Slide-SAM: Medical SAM Meets Sliding Window
par: Quan, Quan, et autres
Publié: (2023)
par: Quan, Quan, et autres
Publié: (2023)
V$^{2}$-SAM: Marrying SAM2 with Multi-Prompt Experts for Cross-View Object Correspondence
par: Pan, Jiancheng, et autres
Publié: (2025)
par: Pan, Jiancheng, et autres
Publié: (2025)
SAMSOD: Rethinking SAM Optimization for RGB-T Salient Object Detection
par: Liu, Zhengyi, et autres
Publié: (2025)
par: Liu, Zhengyi, et autres
Publié: (2025)
DyCrowd: Towards Dynamic Crowd Reconstruction from a Large-scene Video
par: Wen, Hao, et autres
Publié: (2025)
par: Wen, Hao, et autres
Publié: (2025)
SAM2Auto: Auto Annotation Using FLASH
par: Rocky, Arash, et autres
Publié: (2025)
par: Rocky, Arash, et autres
Publié: (2025)
SAM Struggles in Concealed Scenes -- Empirical Study on Segment Anything
par: Ji, Ge-Peng, et autres
Publié: (2023)
par: Ji, Ge-Peng, et autres
Publié: (2023)
Ranking-based Adaptive Query Generation for DETRs in Crowded Pedestrian Detection
par: Gao, Feng, et autres
Publié: (2023)
par: Gao, Feng, et autres
Publié: (2023)
Efficient-SAM2: Accelerating SAM2 with Object-Aware Visual Encoding and Memory Retrieval
par: Zhang, Jing, et autres
Publié: (2026)
par: Zhang, Jing, et autres
Publié: (2026)
HabiCrowd: A High Performance Simulator for Crowd-Aware Visual Navigation
par: Vuong, An Dinh, et autres
Publié: (2023)
par: Vuong, An Dinh, et autres
Publié: (2023)
Evaluating CrowdSplat: Perceived Level of Detail for Gaussian Crowds
par: Sun, Xiaohan, et autres
Publié: (2025)
par: Sun, Xiaohan, et autres
Publié: (2025)
CrowdFormer: Weakly-supervised Crowd counting with Improved Generalizability
par: Savner, Siddharth Singh, et autres
Publié: (2022)
par: Savner, Siddharth Singh, et autres
Publié: (2022)
Exploring the Magnitude-Shape Plot Framework for Anomaly Detection in Crowded Video Scenes
par: Wang, Zuzheng, et autres
Publié: (2024)
par: Wang, Zuzheng, et autres
Publié: (2024)
MedSAM-U: Uncertainty-Guided Auto Multi-Prompt Adaptation for Reliable MedSAM
par: Zhou, Nan, et autres
Publié: (2024)
par: Zhou, Nan, et autres
Publié: (2024)
Documents similaires
-
Density-based Object Detection in Crowded Scenes
par: Zhao, Chenyang, et autres
Publié: (2025) -
Robust Zero-Shot Crowd Counting and Localization With Adaptive Resolution SAM
par: Wan, Jia, et autres
Publié: (2024) -
SAM-pose2seg: Pose-Guided Human Instance Segmentation in Crowds
par: Kolomiiets, Constantin, et autres
Publié: (2026) -
Implicit Modeling for Transferability Estimation of Vision Foundation Models
par: Zheng, Yaoyan, et autres
Publié: (2025) -
CoVFT: Context-aware Visual Fine-tuning for Multimodal Large Language Models
par: Zhou, Nan, et autres
Publié: (2026)