TFCounter:Polishing Gems for Training-Free Object Counting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ting, Pan, Lin, Jianfeng, Yu, Wenhao, Zhang, Wenlong, Chen, Xiaoying, Zhang, Jinlu, Huang, Binqiang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Progressive Framework of Vision-language Knowledge Distillation and Alignment for Multilingual Scene
par: Zhang, Wenbo, et autres
Publié: (2024)
par: Zhang, Wenbo, et autres
Publié: (2024)
AxisPose: Model-Free Matching-Free Single-Shot 6D Object Pose Estimation via Axis Generation
par: Zou, Yang, et autres
Publié: (2025)
par: Zou, Yang, et autres
Publié: (2025)
Interactive Image Selection and Training for Brain Tumor Segmentation Network
par: Cerqueira, Matheus A., et autres
Publié: (2024)
par: Cerqueira, Matheus A., et autres
Publié: (2024)
Performance Decay in Deepfake Detection: The Limitations of Training on Outdated Data
par: Richings, Jack, et autres
Publié: (2025)
par: Richings, Jack, et autres
Publié: (2025)
DiffMOD: Progressive Diffusion Point Denoising for Moving Object Detection in Remote Sensing
par: Zhang, Jinyue, et autres
Publié: (2025)
par: Zhang, Jinyue, et autres
Publié: (2025)
Poisson Flow Consistency Training
par: Zhang, Anthony, et autres
Publié: (2025)
par: Zhang, Anthony, et autres
Publié: (2025)
MedAD-R1: Eliciting Consistent Reasoning in Interpretible Medical Anomaly Detection via Consistency-Reinforced Policy Optimization
par: Zhang, Haitao, et autres
Publié: (2026)
par: Zhang, Haitao, et autres
Publié: (2026)
Knowledge-Guided Failure Prediction: Detecting When Object Detectors Miss Safety-Critical Objects
par: Zimmermann, Jakob Paul, et autres
Publié: (2026)
par: Zimmermann, Jakob Paul, et autres
Publié: (2026)
Uni-HOI:A Unified framework for Learning the Joint distribution of Text and Human-Object Interaction
par: Zhang, Mengfei, et autres
Publié: (2026)
par: Zhang, Mengfei, et autres
Publié: (2026)
MotionFollower: Editing Video Motion via Lightweight Score-Guided Diffusion
par: Tu, Shuyuan, et autres
Publié: (2024)
par: Tu, Shuyuan, et autres
Publié: (2024)
Real-time Object and Event Detection Service through Computer Vision and Edge Computing
par: Mendes, Marcos, et autres
Publié: (2025)
par: Mendes, Marcos, et autres
Publié: (2025)
InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing
par: Zhang, Jinlu, et autres
Publié: (2025)
par: Zhang, Jinlu, et autres
Publié: (2025)
OCCAM: Class-Agnostic, Training-Free, Prior-Free and Multi-Class Object Counting
par: Spanakis, Michail, et autres
Publié: (2026)
par: Spanakis, Michail, et autres
Publié: (2026)
MvBody: Multi-View-Based Hybrid Transformer Using Optical 3D Body Scan for Explainable Cesarean Section Prediction
par: Cheng, Ruting, et autres
Publié: (2025)
par: Cheng, Ruting, et autres
Publié: (2025)
POA: Pre-training Once for Models of All Sizes
par: Zhang, Yingying, et autres
Publié: (2024)
par: Zhang, Yingying, et autres
Publié: (2024)
Joint Neural Networks for One-shot Object Recognition and Detection
par: Vargas, Camilo J., et autres
Publié: (2024)
par: Vargas, Camilo J., et autres
Publié: (2024)
Point, Segment and Count: A Generalized Framework for Object Counting
par: Huang, Zhizhong, et autres
Publié: (2023)
par: Huang, Zhizhong, et autres
Publié: (2023)
DiffYOLO: Object Detection for Anti-Noise via YOLO and Diffusion Models
par: Liu, Yichen, et autres
Publié: (2024)
par: Liu, Yichen, et autres
Publié: (2024)
Moving Object Proposals with Deep Learned Optical Flow for Video Object Segmentation
par: Shi, Ge, et autres
Publié: (2024)
par: Shi, Ge, et autres
Publié: (2024)
CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion
par: Li, Yanyu, et autres
Publié: (2025)
par: Li, Yanyu, et autres
Publié: (2025)
ObjectAdd: Adding Objects into Image via a Training-Free Diffusion Modification Fashion
par: Zhang, Ziyue, et autres
Publié: (2024)
par: Zhang, Ziyue, et autres
Publié: (2024)
ViMo: Generating Motions from Casual Videos
par: Qiu, Liangdong, et autres
Publié: (2024)
par: Qiu, Liangdong, et autres
Publié: (2024)
TALON: Test-time Adaptive Learning for On-the-Fly Category Discovery
par: Wu, Yanan, et autres
Publié: (2026)
par: Wu, Yanan, et autres
Publié: (2026)
Beyond Color and Lines: Zero-Shot Style-Specific Image Variations with Coordinated Semantics
par: Hu, Jinghao, et autres
Publié: (2024)
par: Hu, Jinghao, et autres
Publié: (2024)
DOD-SA: Infrared-Visible Decoupled Object Detection with Single-Modality Annotations
par: Jin, Hang, et autres
Publié: (2025)
par: Jin, Hang, et autres
Publié: (2025)
Training-free Zero-shot Composed Image Retrieval via Weighted Modality Fusion and Similarity
par: Wu, Ren-Di, et autres
Publié: (2024)
par: Wu, Ren-Di, et autres
Publié: (2024)
MixedNUTS: Training-Free Accuracy-Robustness Balance via Nonlinearly Mixed Classifiers
par: Bai, Yatong, et autres
Publié: (2024)
par: Bai, Yatong, et autres
Publié: (2024)
Less Detail, Better Answers: Degradation-Driven Prompting for VQA
par: Han, Haoxuan, et autres
Publié: (2026)
par: Han, Haoxuan, et autres
Publié: (2026)
Unifying Segment Anything in Microscopy with Vision-Language Knowledge
par: Li, Manyu, et autres
Publié: (2025)
par: Li, Manyu, et autres
Publié: (2025)
SealD-NeRF: Interactive Pixel-Level Editing for Dynamic Scenes by Neural Radiance Fields
par: Huang, Zhentao, et autres
Publié: (2024)
par: Huang, Zhentao, et autres
Publié: (2024)
Effective and Robust Adversarial Training against Data and Label Corruptions
par: Zhang, Peng-Fei, et autres
Publié: (2024)
par: Zhang, Peng-Fei, et autres
Publié: (2024)
Bench2FreeAD: A Benchmark for Vision-based End-to-end Navigation in Unstructured Robotic Environments
par: Peng, Yuhang, et autres
Publié: (2025)
par: Peng, Yuhang, et autres
Publié: (2025)
Scalpel-SAM: A Semi-Supervised Paradigm for Adapting SAM to Infrared Small Object Detection
par: Liu, Zihan, et autres
Publié: (2025)
par: Liu, Zihan, et autres
Publié: (2025)
Learning through Creation: A Hash-Free Framework for On-the-Fly Category Discovery
par: Zhang, Bohan, et autres
Publié: (2026)
par: Zhang, Bohan, et autres
Publié: (2026)
MagicGeo: Training-Free Text-Guided Geometric Diagram Generation
par: Wang, Junxiao, et autres
Publié: (2025)
par: Wang, Junxiao, et autres
Publié: (2025)
Checkerboard: A Simple, Effective, Efficient and Learning-free Clean Label Backdoor Attack with Low Poisoning Budget
par: Yang, Yi, et autres
Publié: (2026)
par: Yang, Yi, et autres
Publié: (2026)
PAT-VCM: Plug-and-Play Auxiliary Tokens for Video Coding for Machines
par: Jiang, Wei, et autres
Publié: (2026)
par: Jiang, Wei, et autres
Publié: (2026)
How Well Do Vision-Language Models Understand Sequential Driving Scenes? A Sensitivity Study
par: Brusnicki, Roberto, et autres
Publié: (2026)
par: Brusnicki, Roberto, et autres
Publié: (2026)
Toward Errorless Training ImageNet-1k
par: Deng, Bo, et autres
Publié: (2025)
par: Deng, Bo, et autres
Publié: (2025)
Spiking-DD: Neuromorphic Event Camera based Driver Distraction Detection with Spiking Neural Network
par: Shariff, Waseem, et autres
Publié: (2024)
par: Shariff, Waseem, et autres
Publié: (2024)
Documents similaires
-
A Progressive Framework of Vision-language Knowledge Distillation and Alignment for Multilingual Scene
par: Zhang, Wenbo, et autres
Publié: (2024) -
AxisPose: Model-Free Matching-Free Single-Shot 6D Object Pose Estimation via Axis Generation
par: Zou, Yang, et autres
Publié: (2025) -
Interactive Image Selection and Training for Brain Tumor Segmentation Network
par: Cerqueira, Matheus A., et autres
Publié: (2024) -
Performance Decay in Deepfake Detection: The Limitations of Training on Outdated Data
par: Richings, Jack, et autres
Publié: (2025) -
DiffMOD: Progressive Diffusion Point Denoising for Moving Object Detection in Remote Sensing
par: Zhang, Jinyue, et autres
Publié: (2025)