Curriculum for Crowd Counting -- Is it Worthy?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Khan, Muhammad Asif, Menouar, Hamid, Hamila, Ridha |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multimodal Crowd Counting with Pix2Pix GANs
par: Khan, Muhammad Asif, et autres
Publié: (2024)
par: Khan, Muhammad Asif, et autres
Publié: (2024)
Accelerating Deep Learning with Fixed Time Budget
par: Khan, Muhammad Asif, et autres
Publié: (2024)
par: Khan, Muhammad Asif, et autres
Publié: (2024)
Crowd Scene Analysis using Deep Learning Techniques
par: Asif, Muhammad Junaid
Publié: (2025)
par: Asif, Muhammad Junaid
Publié: (2025)
Bound Tightening Network for Robust Crowd Counting
par: Wu, Qiming
Publié: (2024)
par: Wu, Qiming
Publié: (2024)
RCCFormer: A Robust Crowd Counting Network Based on Transformer
par: Liu, Peng, et autres
Publié: (2025)
par: Liu, Peng, et autres
Publié: (2025)
Real-Time Crowd Counting for Embedded Systems with Lightweight Architecture
par: Zhao, Zhiyuan, et autres
Publié: (2025)
par: Zhao, Zhiyuan, et autres
Publié: (2025)
Generative Adversarial Perturbations with Cross-paradigm Transferability on Localized Crowd Counting
par: Anisha, Alabi Mehzabin, et autres
Publié: (2026)
par: Anisha, Alabi Mehzabin, et autres
Publié: (2026)
VelocityNet: Real-Time Crowd Anomaly Detection via Person-Specific Velocity Analysis
par: AlGhamdi, Fatima, et autres
Publié: (2025)
par: AlGhamdi, Fatima, et autres
Publié: (2025)
TCFormer: A 5M-Parameter Transformer with Density-Guided Aggregation for Weakly-Supervised Crowd Counting
par: Guo, Qiang, et autres
Publié: (2025)
par: Guo, Qiang, et autres
Publié: (2025)
Taste More, Taste Better: Diverse Data and Strong Model Boost Semi-Supervised Crowd Counting
par: Yang, Maochen, et autres
Publié: (2025)
par: Yang, Maochen, et autres
Publié: (2025)
MTCNET: Multi-task Learning Paradigm for Crowd Count Estimation
par: Kumar, Abhay, et autres
Publié: (2019)
par: Kumar, Abhay, et autres
Publié: (2019)
Towards Automated Solar Panel Integrity: Hybrid Deep Feature Extraction for Advanced Surface Defect Identification
par: Asif, Muhammad Junaid, et autres
Publié: (2026)
par: Asif, Muhammad Junaid, et autres
Publié: (2026)
CrowdMAC: Masked Crowd Density Completion for Robust Crowd Density Forecasting
par: Fujii, Ryo, et autres
Publié: (2024)
par: Fujii, Ryo, et autres
Publié: (2024)
GroundCount: Grounding Vision-Language Models with Object Detection for Mitigating Counting Hallucinations
par: Chen, Boyuan, et autres
Publié: (2026)
par: Chen, Boyuan, et autres
Publié: (2026)
Adversarial robustness of VAEs through the lens of local geometry
par: Khan, Asif, et autres
Publié: (2022)
par: Khan, Asif, et autres
Publié: (2022)
Improving Point-based Crowd Counting and Localization Based on Auxiliary Point Guidance
par: Chen, I-Hsiang, et autres
Publié: (2024)
par: Chen, I-Hsiang, et autres
Publié: (2024)
LVLM-COUNT: Enhancing the Counting Ability of Large Vision-Language Models
par: Qharabagh, Muhammad Fetrat, et autres
Publié: (2024)
par: Qharabagh, Muhammad Fetrat, et autres
Publié: (2024)
Waste-Bench: A Comprehensive Benchmark for Evaluating VLLMs in Cluttered Environments
par: Ali, Muhammad, et autres
Publié: (2025)
par: Ali, Muhammad, et autres
Publié: (2025)
Weakly Supervised Teacher-Student Framework with Progressive Pseudo-mask Refinement for Gland Segmentation
par: Khan, Hikmat, et autres
Publié: (2026)
par: Khan, Hikmat, et autres
Publié: (2026)
Are you In or Out (of gallery)? Wisdom from the Same-Identity Crowd
par: Bhatta, Aman, et autres
Publié: (2025)
par: Bhatta, Aman, et autres
Publié: (2025)
An End-to-End Deep Learning Framework for Arsenicosis Diagnosis Using Mobile-Captured Skin Images
par: Newaz, Asif, et autres
Publié: (2025)
par: Newaz, Asif, et autres
Publié: (2025)
CountQA: How Well Do MLLMs Count in the Wild?
par: Tamarapalli, Jayant Sravan, et autres
Publié: (2025)
par: Tamarapalli, Jayant Sravan, et autres
Publié: (2025)
RANGER: Sparsely-Gated Mixture-of-Experts with Adaptive Retrieval Re-ranking for Pathology Report Generation
par: Chen, Yixin, et autres
Publié: (2026)
par: Chen, Yixin, et autres
Publié: (2026)
Diffusion Curriculum: Synthetic-to-Real Data Curriculum via Image-Guided Diffusion
par: Liang, Yijun, et autres
Publié: (2024)
par: Liang, Yijun, et autres
Publié: (2024)
Low-Latency Video Anonymization for Crowd Anomaly Detection: Privacy Versus Performance
par: Asres, Mulugeta Weldezgina, et autres
Publié: (2024)
par: Asres, Mulugeta Weldezgina, et autres
Publié: (2024)
CrowdTrack: A Benchmark for Difficult Multiple Pedestrian Tracking in Real Scenarios
par: Fu, Teng, et autres
Publié: (2025)
par: Fu, Teng, et autres
Publié: (2025)
CounterCount: A Diagnostic Framework for Counting Bias in Vision Language Models
par: Alzahrani, Reem, et autres
Publié: (2026)
par: Alzahrani, Reem, et autres
Publié: (2026)
NT-VOT211: A Large-Scale Benchmark for Night-time Visual Object Tracking
par: Liu, Yu, et autres
Publié: (2024)
par: Liu, Yu, et autres
Publié: (2024)
FSKD: Monocular Forest Structure Inference via LiDAR-to-RGBI Knowledge Distillation
par: Khan, Taimur, et autres
Publié: (2026)
par: Khan, Taimur, et autres
Publié: (2026)
Real-Time Object Detection in Occluded Environment with Background Cluttering Effects Using Deep Learning
par: Aamir, Syed Muhammad, et autres
Publié: (2024)
par: Aamir, Syed Muhammad, et autres
Publié: (2024)
Hybrid CNN-ViT Framework for Motion-Blurred Scene Text Restoration
par: Rashid, Umar, et autres
Publié: (2025)
par: Rashid, Umar, et autres
Publié: (2025)
Count What You Want: Exemplar Identification and Few-shot Counting of Human Actions in the Wild
par: Huang, Yifeng, et autres
Publié: (2023)
par: Huang, Yifeng, et autres
Publié: (2023)
Beyond the Failures: Rethinking Foundation Models in Pathology
par: Tizhoosh, Hamid R.
Publié: (2025)
par: Tizhoosh, Hamid R.
Publié: (2025)
ObjectCompose: Evaluating Resilience of Vision-Based Models on Object-to-Background Compositional Changes
par: Malik, Hashmat Shadab, et autres
Publié: (2024)
par: Malik, Hashmat Shadab, et autres
Publié: (2024)
Toward Accessible Dermatology: Skin Lesion Classification Using Deep Learning Models on Mobile-Acquired Images
par: Newaz, Asif, et autres
Publié: (2025)
par: Newaz, Asif, et autres
Publié: (2025)
CountFormer: A Transformer Framework for Learning Visual Repetition and Structure in Class-Agnostic Object Counting
par: Hossain, Md Tanvir, et autres
Publié: (2025)
par: Hossain, Md Tanvir, et autres
Publié: (2025)
Your Vision-Language Model Can't Even Count to 20: Exposing the Failures of VLMs in Compositional Counting
par: Guo, Xuyang, et autres
Publié: (2025)
par: Guo, Xuyang, et autres
Publié: (2025)
Redefining Generalization in Visual Domains: A Two-Axis Framework for Fake Image Detection with FusionDetect
par: Amanzadi, Amirtaha, et autres
Publié: (2025)
par: Amanzadi, Amirtaha, et autres
Publié: (2025)
Open-World Object Counting in Videos
par: Amini-Naieni, Niki, et autres
Publié: (2025)
par: Amini-Naieni, Niki, et autres
Publié: (2025)
RoboSense: Large-scale Dataset and Benchmark for Egocentric Robot Perception and Navigation in Crowded and Unstructured Environments
par: Su, Haisheng, et autres
Publié: (2024)
par: Su, Haisheng, et autres
Publié: (2024)
Documents similaires
-
Multimodal Crowd Counting with Pix2Pix GANs
par: Khan, Muhammad Asif, et autres
Publié: (2024) -
Accelerating Deep Learning with Fixed Time Budget
par: Khan, Muhammad Asif, et autres
Publié: (2024) -
Crowd Scene Analysis using Deep Learning Techniques
par: Asif, Muhammad Junaid
Publié: (2025) -
Bound Tightening Network for Robust Crowd Counting
par: Wu, Qiming
Publié: (2024) -
RCCFormer: A Robust Crowd Counting Network Based on Transformer
par: Liu, Peng, et autres
Publié: (2025)