Beyond Few-shot Object Detection: A Detailed Survey
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chudasama, Vishal, Sarkar, Hiran, Wasnik, Pankaj, Balasubramanian, Vineeth N, Kalla, Jayateja |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
par: Raoufi, Behnam, et autres
Publié: (2025)
par: Raoufi, Behnam, et autres
Publié: (2025)
Prompt Sensitivity in Vision-Language Grounding: How Small Changes in Wording Affect Object Detection
par: Deka, Dawar Jyoti, et autres
Publié: (2026)
par: Deka, Dawar Jyoti, et autres
Publié: (2026)
Adapting SAM with Dynamic Similarity Graphs for Few-Shot Parameter-Efficient Small Dense Object Detection: A Case Study of Chickpea Pods in Field Conditions
par: Jiang, Xintong, et autres
Publié: (2025)
par: Jiang, Xintong, et autres
Publié: (2025)
Capacity Constraint Analysis Using Object Detection for Smart Manufacturing
par: Ahmad, Hafiz Mughees, et autres
Publié: (2024)
par: Ahmad, Hafiz Mughees, et autres
Publié: (2024)
CG-HOI: Contact-Guided 3D Human-Object Interaction Generation
par: Diller, Christian, et autres
Publié: (2023)
par: Diller, Christian, et autres
Publié: (2023)
Visible Iris Area as a Quality Metric for Reliable Iris Recognition Under Pupil Dilation and Eyelid Occlusion
par: Pessaud, Jack, et autres
Publié: (2025)
par: Pessaud, Jack, et autres
Publié: (2025)
SelvaMask: Segmenting Trees in Tropical Forests and Beyond
par: Duguay, Simon-Olivier, et autres
Publié: (2026)
par: Duguay, Simon-Olivier, et autres
Publié: (2026)
Deep Learning-based Depth Estimation Methods from Monocular Image and Videos: A Comprehensive Survey
par: Rajapaksha, Uchitha, et autres
Publié: (2024)
par: Rajapaksha, Uchitha, et autres
Publié: (2024)
Motion-Guided Semantic Alignment with Negative Prompts for Zero-Shot Video Action Recognition
par: Wang, Yiming, et autres
Publié: (2026)
par: Wang, Yiming, et autres
Publié: (2026)
Mistake Attribution: Fine-Grained Mistake Understanding in Egocentric Videos
par: Li, Yayuan, et autres
Publié: (2025)
par: Li, Yayuan, et autres
Publié: (2025)
SelvaBox: A high-resolution dataset for tropical tree crown detection
par: Baudchon, Hugo, et autres
Publié: (2025)
par: Baudchon, Hugo, et autres
Publié: (2025)
DeltaVLM: Interactive Remote Sensing Image Change Analysis via Instruction-guided Difference Perception
par: Deng, Pei, et autres
Publié: (2025)
par: Deng, Pei, et autres
Publié: (2025)
Image-Based Leopard Seal Recognition: Approaches and Challenges in Current Automated Systems
par: Salazar, Jorge Yero, et autres
Publié: (2024)
par: Salazar, Jorge Yero, et autres
Publié: (2024)
Dense Motion Captioning
par: Xu, Shiyao, et autres
Publié: (2025)
par: Xu, Shiyao, et autres
Publié: (2025)
TD3Net: A temporal densely connected multi-dilated convolutional network for lipreading
par: Lee, Byung Hoon, et autres
Publié: (2025)
par: Lee, Byung Hoon, et autres
Publié: (2025)
CoMatcher: Multi-View Collaborative Feature Matching
par: Zhang, Jintao, et autres
Publié: (2025)
par: Zhang, Jintao, et autres
Publié: (2025)
MoDE: Mixture of Diffusion Experts for Any Occluded Face Recognition
par: Fan, Qiannan, et autres
Publié: (2025)
par: Fan, Qiannan, et autres
Publié: (2025)
NeuroGaze-Distill: Brain-informed Distillation and Depression-Inspired Geometric Priors for Robust Facial Emotion Recognition
par: Li, Zilin, et autres
Publié: (2025)
par: Li, Zilin, et autres
Publié: (2025)
Domain-Adaptive Pretraining Improves Primate Behavior Recognition
par: Mueller, Felix B., et autres
Publié: (2025)
par: Mueller, Felix B., et autres
Publié: (2025)
SH17: A Dataset for Human Safety and Personal Protective Equipment Detection in Manufacturing Industry
par: Ahmad, Hafiz Mughees, et autres
Publié: (2024)
par: Ahmad, Hafiz Mughees, et autres
Publié: (2024)
High-Frequency Semantics and Geometric Priors for End-to-End Detection Transformers in Challenging UAV Imagery
par: Peng, Hongxing, et autres
Publié: (2025)
par: Peng, Hongxing, et autres
Publié: (2025)
A Light Perspective for 3D Object Detection
par: Pederiva, Marcelo Eduardo, et autres
Publié: (2025)
par: Pederiva, Marcelo Eduardo, et autres
Publié: (2025)
FeedbackSTS-Det: Sparse Frames-Based Spatio-Temporal Semantic Feedback Network for Moving Infrared Small Target Detection
par: Huang, Yian, et autres
Publié: (2026)
par: Huang, Yian, et autres
Publié: (2026)
Towards a Generalizable Fusion Architecture for Multimodal Object Detection
par: Berjawi, Jad, et autres
Publié: (2025)
par: Berjawi, Jad, et autres
Publié: (2025)
Exploring Surround-View Fisheye Camera 3D Object Detection
par: Li, Changcai, et autres
Publié: (2025)
par: Li, Changcai, et autres
Publié: (2025)
Pedestrian Detection in Low-Light Conditions: A Comprehensive Survey
par: Ghari, Bahareh, et autres
Publié: (2024)
par: Ghari, Bahareh, et autres
Publié: (2024)
LATTE: Latent Trajectory Embedding for Diffusion-Generated Image Detection
par: Vasilcoiu, Ana, et autres
Publié: (2025)
par: Vasilcoiu, Ana, et autres
Publié: (2025)
Geo2Sound: A Scalable Geo-Aligned Framework for Soundscape Generation from Satellite Imagery
par: Wu, Kunlin, et autres
Publié: (2026)
par: Wu, Kunlin, et autres
Publié: (2026)
MSPCaps: A Multi-Scale Patchify Capsule Network with Cross-Agreement Routing for Visual Recognition
par: Hu, Yudong, et autres
Publié: (2025)
par: Hu, Yudong, et autres
Publié: (2025)
TAG-Head: Time-Aligned Graph Head for Plug-and-Play Fine-grained Action Recognition
par: Hassan, Imtiaz Ul, et autres
Publié: (2026)
par: Hassan, Imtiaz Ul, et autres
Publié: (2026)
DejaVid: Encoder-Agnostic Learned Temporal Matching for Video Classification
par: Ho, Darryl, et autres
Publié: (2025)
par: Ho, Darryl, et autres
Publié: (2025)
PhysicsNeRF: Physics-Guided 3D Reconstruction from Sparse Views
par: Barhdadi, Mohamed Rayan, et autres
Publié: (2025)
par: Barhdadi, Mohamed Rayan, et autres
Publié: (2025)
Semi supervised GAN for smart microscopy, fast and data efficient cell cycle classification
par: Manick, Rajeev, et autres
Publié: (2026)
par: Manick, Rajeev, et autres
Publié: (2026)
Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset
par: Zinnen, Mathias, et autres
Publié: (2025)
par: Zinnen, Mathias, et autres
Publié: (2025)
SPMamba-YOLO: An Underwater Object Detection Network Based on Multi-Scale Feature Enhancement and Global Context Modeling
par: Liao, Guanghao, et autres
Publié: (2026)
par: Liao, Guanghao, et autres
Publié: (2026)
Detecting AI-Generated Videos with Spiking Neural Networks
par: Jang, Minsuk, et autres
Publié: (2026)
par: Jang, Minsuk, et autres
Publié: (2026)
Butter: Frequency Consistency and Hierarchical Fusion for Autonomous Driving Object Detection
par: Lin, Xiaojian, et autres
Publié: (2025)
par: Lin, Xiaojian, et autres
Publié: (2025)
Habitat Classification from Ground-Level Imagery Using Deep Neural Networks
par: Shi, Hongrui, et autres
Publié: (2025)
par: Shi, Hongrui, et autres
Publié: (2025)
Sign language recognition based on deep learning and low-cost handcrafted descriptors
par: Carneiro, Alvaro Leandro Cavalcante, et autres
Publié: (2024)
par: Carneiro, Alvaro Leandro Cavalcante, et autres
Publié: (2024)
Beyond still images: Temporal features and input variance resilience
par: Fadaei, Amir Hosein, et autres
Publié: (2023)
par: Fadaei, Amir Hosein, et autres
Publié: (2023)
Documents similaires
-
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
par: Raoufi, Behnam, et autres
Publié: (2025) -
Prompt Sensitivity in Vision-Language Grounding: How Small Changes in Wording Affect Object Detection
par: Deka, Dawar Jyoti, et autres
Publié: (2026) -
Adapting SAM with Dynamic Similarity Graphs for Few-Shot Parameter-Efficient Small Dense Object Detection: A Case Study of Chickpea Pods in Field Conditions
par: Jiang, Xintong, et autres
Publié: (2025) -
Capacity Constraint Analysis Using Object Detection for Smart Manufacturing
par: Ahmad, Hafiz Mughees, et autres
Publié: (2024) -
CG-HOI: Contact-Guided 3D Human-Object Interaction Generation
par: Diller, Christian, et autres
Publié: (2023)