DINOv3 Beats Specialized Detectors: A Simple Foundation Model Baseline for Image Forensics
Fuente:
arXiv
Guardado en:
| Autores principales: | Yu, Jieming, Feng, Qiuxiao, Wang, Zhuohan, Ma, Xiaochen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Specialized Foundation Models Struggle to Beat Supervised Baselines
por: Xu, Zongzhe, et al.
Publicado: (2024)
por: Xu, Zongzhe, et al.
Publicado: (2024)
Upsample Anything: A Simple and Hard to Beat Baseline for Feature Upsampling
por: Seo, Minseok, et al.
Publicado: (2025)
por: Seo, Minseok, et al.
Publicado: (2025)
From SAM to DINOv2: Towards Distilling Foundation Models to Lightweight Baselines for Generalized Polyp Segmentation
por: Agnihotri, Shivanshu, et al.
Publicado: (2025)
por: Agnihotri, Shivanshu, et al.
Publicado: (2025)
Brought a Gun to a Knife Fight: Modern VFM Baselines Outgun Specialized Detectors on In-the-Wild AI Image Detection
por: Zhou, Yue, et al.
Publicado: (2025)
por: Zhou, Yue, et al.
Publicado: (2025)
Baseline Method of the Foundation Model Challenge for Ultrasound Image Analysis
por: Deng, Bo, et al.
Publicado: (2026)
por: Deng, Bo, et al.
Publicado: (2026)
Learning to Adapt Foundation Model DINOv2 for Capsule Endoscopy Diagnosis
por: Zhang, Bowen, et al.
Publicado: (2024)
por: Zhang, Bowen, et al.
Publicado: (2024)
FIND: A Simple yet Effective Baseline for Diffusion-Generated Image Detection
por: Li, Jie, et al.
Publicado: (2026)
por: Li, Jie, et al.
Publicado: (2026)
ForensicHub: A Unified Benchmark & Codebase for All-Domain Fake Image Detection and Localization
por: Du, Bo, et al.
Publicado: (2025)
por: Du, Bo, et al.
Publicado: (2025)
Steady Progress Beats Stagnation: Mutual Aid of Foundation and Conventional Models in Mixed Domain Semi-Supervised Medical Image Segmentation
por: Ma, Qinghe, et al.
Publicado: (2025)
por: Ma, Qinghe, et al.
Publicado: (2025)
SimpleGVR: A Simple Baseline for Latent-Cascaded Video Super-Resolution
por: Xie, Liangbin, et al.
Publicado: (2025)
por: Xie, Liangbin, et al.
Publicado: (2025)
MambaIR: A Simple Baseline for Image Restoration with State-Space Model
por: Guo, Hang, et al.
Publicado: (2024)
por: Guo, Hang, et al.
Publicado: (2024)
DINOv3
por: Siméoni, Oriane, et al.
Publicado: (2025)
por: Siméoni, Oriane, et al.
Publicado: (2025)
A Simple Baseline with Single-encoder for Referring Image Segmentation
por: Yu, Seonghoon, et al.
Publicado: (2024)
por: Yu, Seonghoon, et al.
Publicado: (2024)
DINOv3 Visual Representations for Blueberry Perception Toward Robotic Harvesting
por: Wang, Rui-Feng, et al.
Publicado: (2026)
por: Wang, Rui-Feng, et al.
Publicado: (2026)
Community Forensics: Using Thousands of Generators to Train Fake Image Detectors
por: Park, Jeongsoo, et al.
Publicado: (2024)
por: Park, Jeongsoo, et al.
Publicado: (2024)
A Simple and Better Baseline for Visual Grounding
por: Wang, Jingchao, et al.
Publicado: (2025)
por: Wang, Jingchao, et al.
Publicado: (2025)
Revisiting Birds Eye View Perception Models with Frozen Foundation Models: DINOv2 and Metric3Dv2
por: Hayes, Seamie, et al.
Publicado: (2025)
por: Hayes, Seamie, et al.
Publicado: (2025)
AD-DINOv3: Enhancing DINOv3 for Zero-Shot Anomaly Detection with Anomaly-Aware Calibration
por: Yuan, Jingyi, et al.
Publicado: (2025)
por: Yuan, Jingyi, et al.
Publicado: (2025)
Rethinking Cross-Generator Image Forgery Detection through DINOv3
por: Huang, Zhenglin, et al.
Publicado: (2025)
por: Huang, Zhenglin, et al.
Publicado: (2025)
Real-Time Object Detection Meets DINOv3
por: Huang, Shihua, et al.
Publicado: (2025)
por: Huang, Shihua, et al.
Publicado: (2025)
MM-DINOv2: Adapting Foundation Models for Multi-Modal Medical Image Analysis
por: Scholz, Daniel, et al.
Publicado: (2025)
por: Scholz, Daniel, et al.
Publicado: (2025)
CubeFormer: A Simple yet Effective Baseline for Lightweight Image Super-Resolution
por: Wang, Jikai, et al.
Publicado: (2024)
por: Wang, Jikai, et al.
Publicado: (2024)
DINOv3 with Test-Time Training for Medical Image Registration
por: Wang, Shansong, et al.
Publicado: (2025)
por: Wang, Shansong, et al.
Publicado: (2025)
Mamba YOLO: A Simple Baseline for Object Detection with State Space Model
por: Wang, Zeyu, et al.
Publicado: (2024)
por: Wang, Zeyu, et al.
Publicado: (2024)
SimToken: A Simple Baseline for Referring Audio-Visual Segmentation
por: Jin, Dian, et al.
Publicado: (2025)
por: Jin, Dian, et al.
Publicado: (2025)
Spatial Autoregressive Modeling of DINOv3 Embeddings for Unsupervised Anomaly Detection
por: Erdil, Ertunc, et al.
Publicado: (2026)
por: Erdil, Ertunc, et al.
Publicado: (2026)
Optimizing DINOv2 with Registers for Face Anti-Spoofing
por: Feng, Mika, et al.
Publicado: (2025)
por: Feng, Mika, et al.
Publicado: (2025)
On Calibration of Object Detectors: Pitfalls, Evaluation and Baselines
por: Kuzucu, Selim, et al.
Publicado: (2024)
por: Kuzucu, Selim, et al.
Publicado: (2024)
BSED: Baseline Shapley-Based Explainable Detector
por: Kuroki, Michihiro, et al.
Publicado: (2023)
por: Kuroki, Michihiro, et al.
Publicado: (2023)
When Detectors Forget Forensics: Blocking Semantic Shortcuts for Generalizable AI-Generated Image Detection
por: Shuai, Chao, et al.
Publicado: (2026)
por: Shuai, Chao, et al.
Publicado: (2026)
Finally Outshining the Random Baseline: A Simple and Effective Solution for Active Learning in 3D Biomedical Imaging
por: Lüth, Carsten T., et al.
Publicado: (2026)
por: Lüth, Carsten T., et al.
Publicado: (2026)
A Simple Aerial Detection Baseline of Multimodal Language Models
por: Li, Qingyun, et al.
Publicado: (2025)
por: Li, Qingyun, et al.
Publicado: (2025)
INSID3: Training-Free In-Context Segmentation with DINOv3
por: Cuttano, Claudia, et al.
Publicado: (2026)
por: Cuttano, Claudia, et al.
Publicado: (2026)
SINDER: Repairing the Singular Defects of DINOv2
por: Wang, Haoqi, et al.
Publicado: (2024)
por: Wang, Haoqi, et al.
Publicado: (2024)
Evaluating General Purpose Vision Foundation Models for Medical Image Analysis: An Experimental Study of DINOv2 on Radiology Benchmarks
por: Baharoon, Mohammed, et al.
Publicado: (2023)
por: Baharoon, Mohammed, et al.
Publicado: (2023)
DinoDental: Benchmarking DINOv3 as a Unified Vision Encoder for Dental Image Analysis
por: Tang, Kun, et al.
Publicado: (2026)
por: Tang, Kun, et al.
Publicado: (2026)
Does DINOv3 Set a New Medical Vision Standard? Benchmarking 2D and 3D Classification, Segmentation, and Registration
por: Liu, Che, et al.
Publicado: (2025)
por: Liu, Che, et al.
Publicado: (2025)
Leveraging Foundation Models via Knowledge Distillation in Multi-Object Tracking: Distilling DINOv2 Features to FairMOT
por: Faber, Niels G., et al.
Publicado: (2024)
por: Faber, Niels G., et al.
Publicado: (2024)
DINO-MVR: Multi-View Readout of Frozen DINOv3 for Annotation-Efficient Medical Segmentation
por: Jiang, Wei, et al.
Publicado: (2026)
por: Jiang, Wei, et al.
Publicado: (2026)
A Simple Baseline for Unifying Understanding, Generation, and Editing via Vanilla Next-token Prediction
por: Zhu, Jie, et al.
Publicado: (2026)
por: Zhu, Jie, et al.
Publicado: (2026)
Ejemplares similares
-
Specialized Foundation Models Struggle to Beat Supervised Baselines
por: Xu, Zongzhe, et al.
Publicado: (2024) -
Upsample Anything: A Simple and Hard to Beat Baseline for Feature Upsampling
por: Seo, Minseok, et al.
Publicado: (2025) -
From SAM to DINOv2: Towards Distilling Foundation Models to Lightweight Baselines for Generalized Polyp Segmentation
por: Agnihotri, Shivanshu, et al.
Publicado: (2025) -
Brought a Gun to a Knife Fight: Modern VFM Baselines Outgun Specialized Detectors on In-the-Wild AI Image Detection
por: Zhou, Yue, et al.
Publicado: (2025) -
Baseline Method of the Foundation Model Challenge for Ultrasound Image Analysis
por: Deng, Bo, et al.
Publicado: (2026)