A Simple-but-effective Baseline for Training-free Class-Agnostic Counting
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Yuhao, Xu, Haiming, Liu, Lingqiao, Shi, Javen Qinfeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Categorical Keypoint Positional Embedding for Robust Animal Re-Identification
di: Lin, Yuhao, et al.
Pubblicazione: (2024)
di: Lin, Yuhao, et al.
Pubblicazione: (2024)
CountingDINO: A Training-free Pipeline for Class-Agnostic Counting using Unsupervised Backbones
di: Pacini, Giacomo, et al.
Pubblicazione: (2025)
di: Pacini, Giacomo, et al.
Pubblicazione: (2025)
A Survey on Deep Neural Network Pruning-Taxonomy, Comparison, Analysis, and Recommendations
di: Cheng, Hongrong, et al.
Pubblicazione: (2023)
di: Cheng, Hongrong, et al.
Pubblicazione: (2023)
Causal Disentanglement and Cross-Modal Alignment for Enhanced Few-Shot Learning
di: Jiang, Tianjiao, et al.
Pubblicazione: (2025)
di: Jiang, Tianjiao, et al.
Pubblicazione: (2025)
CLAP: Isolating Content from Style through Contrastive Learning with Augmented Prompts
di: Cai, Yichao, et al.
Pubblicazione: (2023)
di: Cai, Yichao, et al.
Pubblicazione: (2023)
Vision Transformer Off-the-Shelf: A Surprising Baseline for Few-Shot Class-Agnostic Counting
di: Wang, Zhicheng, et al.
Pubblicazione: (2023)
di: Wang, Zhicheng, et al.
Pubblicazione: (2023)
FocalCount: Towards Class-Count Imbalance in Class-Agnostic Counting
di: Zhu, Huilin, et al.
Pubblicazione: (2025)
di: Zhu, Huilin, et al.
Pubblicazione: (2025)
OCCAM: Class-Agnostic, Training-Free, Prior-Free and Multi-Class Object Counting
di: Spanakis, Michail, et al.
Pubblicazione: (2026)
di: Spanakis, Michail, et al.
Pubblicazione: (2026)
Enhancing Fine-Grained Visual Recognition in the Low-Data Regime Through Feature Magnitude Regularization
di: Chapman, Avraham, et al.
Pubblicazione: (2024)
di: Chapman, Avraham, et al.
Pubblicazione: (2024)
Bootstrapping MLLM for Weakly-Supervised Class-Agnostic Object Counting
di: Zhang, Xiaowen, et al.
Pubblicazione: (2026)
di: Zhang, Xiaowen, et al.
Pubblicazione: (2026)
SQLNet: Scale-Modulated Query and Localization Network for Few-Shot Class-Agnostic Counting
di: Wu, Hefeng, et al.
Pubblicazione: (2023)
di: Wu, Hefeng, et al.
Pubblicazione: (2023)
Does it Really Count? Assessing Semantic Grounding in Text-Guided Class-Agnostic Counting
di: Pacini, Giacomo, et al.
Pubblicazione: (2026)
di: Pacini, Giacomo, et al.
Pubblicazione: (2026)
Training-Free Instance-Aware 3D Scene Reconstruction and Diffusion-Based View Synthesis from Sparse Images
di: Xia, Jiatong, et al.
Pubblicazione: (2026)
di: Xia, Jiatong, et al.
Pubblicazione: (2026)
ChatDiT: A Training-Free Baseline for Task-Agnostic Free-Form Chatting with Diffusion Transformers
di: Huang, Lianghua, et al.
Pubblicazione: (2024)
di: Huang, Lianghua, et al.
Pubblicazione: (2024)
Mind the Prompt: A Novel Benchmark for Prompt-based Class-Agnostic Counting
di: Ciampi, Luca, et al.
Pubblicazione: (2024)
di: Ciampi, Luca, et al.
Pubblicazione: (2024)
Learning to Reason and Navigate: Parameter Efficient Action Planning with Large Language Models
di: Mohammadi, Bahram, et al.
Pubblicazione: (2025)
di: Mohammadi, Bahram, et al.
Pubblicazione: (2025)
A Recipe for CAC: Mosaic-based Generalized Loss for Improved Class-Agnostic Counting
di: Chou, Tsung-Han, et al.
Pubblicazione: (2024)
di: Chou, Tsung-Han, et al.
Pubblicazione: (2024)
Improving Online Source-free Domain Adaptation for Object Detection by Unsupervised Data Acquisition
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)
Augmented Commonsense Knowledge for Remote Object Grounding
di: Mohammadi, Bahram, et al.
Pubblicazione: (2024)
di: Mohammadi, Bahram, et al.
Pubblicazione: (2024)
Weakly and Self-Supervised Class-Agnostic Motion Prediction for Autonomous Driving
di: Li, Ruibo, et al.
Pubblicazione: (2025)
di: Li, Ruibo, et al.
Pubblicazione: (2025)
SlowFast-LLaVA: A Strong Training-Free Baseline for Video Large Language Models
di: Xu, Mingze, et al.
Pubblicazione: (2024)
di: Xu, Mingze, et al.
Pubblicazione: (2024)
The Devil is in the Distributions: Explicit Modeling of Scene Content is Key in Zero-Shot Video Captioning
di: Tian, Mingkai, et al.
Pubblicazione: (2025)
di: Tian, Mingkai, et al.
Pubblicazione: (2025)
Close-up-GS: Enhancing Close-Up View Synthesis in 3D Gaussian Splatting with Progressive Self-Training
di: Xia, Jiatong, et al.
Pubblicazione: (2025)
di: Xia, Jiatong, et al.
Pubblicazione: (2025)
A Simple and Efficient Baseline for Zero-Shot Generative Classification
di: Qi, Zipeng, et al.
Pubblicazione: (2024)
di: Qi, Zipeng, et al.
Pubblicazione: (2024)
CountFormer: A Transformer Framework for Learning Visual Repetition and Structure in Class-Agnostic Object Counting
di: Hossain, Md Tanvir, et al.
Pubblicazione: (2025)
di: Hossain, Md Tanvir, et al.
Pubblicazione: (2025)
A Survey on Class-Agnostic Counting: Advancements from Reference-Based to Open-World Text-Guided Approaches
di: Ciampi, Luca, et al.
Pubblicazione: (2025)
di: Ciampi, Luca, et al.
Pubblicazione: (2025)
On the Value of Cross-Modal Misalignment in Multimodal Representation Learning
di: Cai, Yichao, et al.
Pubblicazione: (2025)
di: Cai, Yichao, et al.
Pubblicazione: (2025)
Training-Free Motion-Guided Video Generation with Enhanced Temporal Consistency Using Motion Consistency Loss
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
SCAPE: A Simple and Strong Category-Agnostic Pose Estimator
di: Liang, Yujia, et al.
Pubblicazione: (2024)
di: Liang, Yujia, et al.
Pubblicazione: (2024)
A Simple and Better Baseline for Visual Grounding
di: Wang, Jingchao, et al.
Pubblicazione: (2025)
di: Wang, Jingchao, et al.
Pubblicazione: (2025)
Regularizing Neural Network Training via Identity-wise Discriminative Feature Suppression
di: Chapman, Avraham, et al.
Pubblicazione: (2022)
di: Chapman, Avraham, et al.
Pubblicazione: (2022)
LFME: A Simple Framework for Learning from Multiple Experts in Domain Generalization
di: Chen, Liang, et al.
Pubblicazione: (2024)
di: Chen, Liang, et al.
Pubblicazione: (2024)
MedVLThinker: Simple Baselines for Multimodal Medical Reasoning
di: Huang, Xiaoke, et al.
Pubblicazione: (2025)
di: Huang, Xiaoke, et al.
Pubblicazione: (2025)
SimpleGVR: A Simple Baseline for Latent-Cascaded Video Super-Resolution
di: Xie, Liangbin, et al.
Pubblicazione: (2025)
di: Xie, Liangbin, et al.
Pubblicazione: (2025)
RELOCATE: A Simple Training-Free Baseline for Visual Query Localization Using Region-Based Representations
di: Khosla, Savya, et al.
Pubblicazione: (2024)
di: Khosla, Savya, et al.
Pubblicazione: (2024)
STRIDE: Training-Free Diversity Guidance via PCA-Directed Feature Perturbation in Single-Step Diffusion Models
di: Yadav, Ankit, et al.
Pubblicazione: (2026)
di: Yadav, Ankit, et al.
Pubblicazione: (2026)
A Simple Baseline for Efficient Hand Mesh Reconstruction
di: Zhou, Zhishan, et al.
Pubblicazione: (2024)
di: Zhou, Zhishan, et al.
Pubblicazione: (2024)
Mamba YOLO: A Simple Baseline for Object Detection with State Space Model
di: Wang, Zeyu, et al.
Pubblicazione: (2024)
di: Wang, Zeyu, et al.
Pubblicazione: (2024)
Revisiting Simple Baselines for In-The-Wild Deepfake Detection
di: Castaneda, Orlando, et al.
Pubblicazione: (2025)
di: Castaneda, Orlando, et al.
Pubblicazione: (2025)
FLUX-Text: A Simple and Advanced Diffusion Transformer Baseline for Scene Text Editing
di: Lan, Rui, et al.
Pubblicazione: (2025)
di: Lan, Rui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Categorical Keypoint Positional Embedding for Robust Animal Re-Identification
di: Lin, Yuhao, et al.
Pubblicazione: (2024) -
CountingDINO: A Training-free Pipeline for Class-Agnostic Counting using Unsupervised Backbones
di: Pacini, Giacomo, et al.
Pubblicazione: (2025) -
A Survey on Deep Neural Network Pruning-Taxonomy, Comparison, Analysis, and Recommendations
di: Cheng, Hongrong, et al.
Pubblicazione: (2023) -
Causal Disentanglement and Cross-Modal Alignment for Enhanced Few-Shot Learning
di: Jiang, Tianjiao, et al.
Pubblicazione: (2025) -
CLAP: Isolating Content from Style through Contrastive Learning with Augmented Prompts
di: Cai, Yichao, et al.
Pubblicazione: (2023)