DiffYOLO: Object Detection for Anti-Noise via YOLO and Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Yichen, Zhang, Huajian, Gao, Daqing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
BG-YOLO: A Bidirectional-Guided Method for Underwater Object Detection
di: Zhang, Jian, et al.
Pubblicazione: (2024)
di: Zhang, Jian, et al.
Pubblicazione: (2024)
Do Generative Metrics Predict YOLO Performance? An Evaluation Across Models, Augmentation Ratios, and Dataset Complexity
di: Marian, Vasile, et al.
Pubblicazione: (2026)
di: Marian, Vasile, et al.
Pubblicazione: (2026)
Synthetic Industrial Object Detection: GenAI vs. Feature-Based Methods
di: Araya-Martinez, Jose Moises, et al.
Pubblicazione: (2025)
di: Araya-Martinez, Jose Moises, et al.
Pubblicazione: (2025)
Learning Association via Track-Detection Matching for Multi-Object Tracking
di: Adžemović, Momir
Pubblicazione: (2025)
di: Adžemović, Momir
Pubblicazione: (2025)
DOD-SA: Infrared-Visible Decoupled Object Detection with Single-Modality Annotations
di: Jin, Hang, et al.
Pubblicazione: (2025)
di: Jin, Hang, et al.
Pubblicazione: (2025)
One-to-Normal: Anomaly Personalization for Few-shot Anomaly Detection
di: Li, Yiyue, et al.
Pubblicazione: (2025)
di: Li, Yiyue, et al.
Pubblicazione: (2025)
SynthRender and IRIS: Open-Source Framework and Dataset for Bidirectional Sim-Real Transfer in Industrial Object Perception
di: Araya-Martinez, Jose Moises, et al.
Pubblicazione: (2026)
di: Araya-Martinez, Jose Moises, et al.
Pubblicazione: (2026)
Extrapolating and Decoupling Image-to-Video Generation Models: Motion Modeling is Easier Than You Think
di: Tian, Jie, et al.
Pubblicazione: (2025)
di: Tian, Jie, et al.
Pubblicazione: (2025)
YOLO Ensemble for UAV-based Multispectral Defect Detection in Wind Turbine Components
di: Svystun, Serhii, et al.
Pubblicazione: (2025)
di: Svystun, Serhii, et al.
Pubblicazione: (2025)
SurgVLM: A Large Vision-Language Model and Systematic Evaluation Benchmark for Surgical Intelligence
di: Zeng, Zhitao, et al.
Pubblicazione: (2025)
di: Zeng, Zhitao, et al.
Pubblicazione: (2025)
Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset
di: Zinnen, Mathias, et al.
Pubblicazione: (2025)
di: Zinnen, Mathias, et al.
Pubblicazione: (2025)
Multi-scale Temporal Prediction via Incremental Generation and Multi-agent Collaboration
di: Zeng, Zhitao, et al.
Pubblicazione: (2025)
di: Zeng, Zhitao, et al.
Pubblicazione: (2025)
Video-CoE: Reinforcing Video Event Prediction via Chain of Events
di: Su, Qile, et al.
Pubblicazione: (2026)
di: Su, Qile, et al.
Pubblicazione: (2026)
PlaneSAM: Multimodal Plane Instance Segmentation Using the Segment Anything Model
di: Deng, Zhongchen, et al.
Pubblicazione: (2024)
di: Deng, Zhongchen, et al.
Pubblicazione: (2024)
Zero-Shot Multi-Criteria Visual Quality Inspection for Semi-Controlled Industrial Environments via Real-Time 3D Digital Twin Simulation
di: Araya-Martinez, Jose Moises, et al.
Pubblicazione: (2025)
di: Araya-Martinez, Jose Moises, et al.
Pubblicazione: (2025)
UrbanAlign: Post-hoc Semantic Calibration for VLM-Human Preference Alignment
di: Zhang, Yecheng, et al.
Pubblicazione: (2026)
di: Zhang, Yecheng, et al.
Pubblicazione: (2026)
Revisiting Energy-Based Model for Out-of-Distribution Detection
di: Wu, Yifan, et al.
Pubblicazione: (2024)
di: Wu, Yifan, et al.
Pubblicazione: (2024)
ClustViT: Clustering-based Token Merging for Semantic Segmentation
di: Montello, Fabio, et al.
Pubblicazione: (2025)
di: Montello, Fabio, et al.
Pubblicazione: (2025)
Deep Learning Approaches for Human Action Recognition in Video Data
di: Xie, Yufei
Pubblicazione: (2024)
di: Xie, Yufei
Pubblicazione: (2024)
LatentForensics: Towards frugal deepfake detection in the StyleGAN latent space
di: Delmas, Matthieu, et al.
Pubblicazione: (2023)
di: Delmas, Matthieu, et al.
Pubblicazione: (2023)
From Gaze to Insight: Bridging Human Visual Attention and Vision Language Model Explanation for Weakly-Supervised Medical Image Segmentation
di: Chen, Jingkun, et al.
Pubblicazione: (2025)
di: Chen, Jingkun, et al.
Pubblicazione: (2025)
Learning Discriminative Spatio-temporal Representations for Semi-supervised Action Recognition
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
Sequence Matters: Harnessing Video Models in 3D Super-Resolution
di: Ko, Hyun-kyu, et al.
Pubblicazione: (2024)
di: Ko, Hyun-kyu, et al.
Pubblicazione: (2024)
YOLO-Based Defect Detection for Metal Sheets
di: Chou, Po-Heng, et al.
Pubblicazione: (2025)
di: Chou, Po-Heng, et al.
Pubblicazione: (2025)
GSEdit: Efficient Text-Guided Editing of 3D Objects via Gaussian Splatting
di: Palandra, Francesco, et al.
Pubblicazione: (2024)
di: Palandra, Francesco, et al.
Pubblicazione: (2024)
Parking Space Detection in the City of Granada
di: Luis, Crespo-Orti, et al.
Pubblicazione: (2025)
di: Luis, Crespo-Orti, et al.
Pubblicazione: (2025)
When Less is Enough: Adaptive Token Reduction for Efficient Image Representation
di: Allakhverdov, Eduard, et al.
Pubblicazione: (2025)
di: Allakhverdov, Eduard, et al.
Pubblicazione: (2025)
Image Reconstruction as a Tool for Feature Analysis
di: Allakhverdov, Eduard, et al.
Pubblicazione: (2025)
di: Allakhverdov, Eduard, et al.
Pubblicazione: (2025)
Automated Defect Detection for Mass-Produced Electronic Components Based on YOLO Object Detection Models
di: Mao, Wei-Lung, et al.
Pubblicazione: (2025)
di: Mao, Wei-Lung, et al.
Pubblicazione: (2025)
Visual-Text Cross Alignment: Refining the Similarity Score in Vision-Language Models
di: Li, Jinhao, et al.
Pubblicazione: (2024)
di: Li, Jinhao, et al.
Pubblicazione: (2024)
Sat-JEPA-Diff: Bridging Self-Supervised Learning and Generative Diffusion for Remote Sensing
di: Komurcu, Kursat, et al.
Pubblicazione: (2026)
di: Komurcu, Kursat, et al.
Pubblicazione: (2026)
VA-$π$: Variational Policy Alignment for Pixel-Aware Autoregressive Generation
di: Liao, Xinyao, et al.
Pubblicazione: (2025)
di: Liao, Xinyao, et al.
Pubblicazione: (2025)
Training a Student Expert via Semi-Supervised Foundation Model Distillation
di: Taghavi, Pardis, et al.
Pubblicazione: (2026)
di: Taghavi, Pardis, et al.
Pubblicazione: (2026)
Semantic Prioritization in Visual Counterfactual Explanations with Weighted Segmentation and Auto-Adaptive Region Selection
di: Zhang, Lintong, et al.
Pubblicazione: (2025)
di: Zhang, Lintong, et al.
Pubblicazione: (2025)
DSER: Spectral Epipolar Representation for Efficient Light Field Depth Estimation
di: Mohammad, Noor Islam S., et al.
Pubblicazione: (2025)
di: Mohammad, Noor Islam S., et al.
Pubblicazione: (2025)
Hierarchical Spatial Algorithms for High-Resolution Image Quantization and Feature Extraction
di: Mohammad, Noor Islam S.
Pubblicazione: (2025)
di: Mohammad, Noor Islam S.
Pubblicazione: (2025)
A Comprehensive Review of YOLO Architectures in Computer Vision: From YOLOv1 to YOLOv8 and YOLO-NAS
di: Terven, Juan, et al.
Pubblicazione: (2023)
di: Terven, Juan, et al.
Pubblicazione: (2023)
VDPP: Video Depth Post-Processing for Speed and Scalability
di: Yoon, Daewon, et al.
Pubblicazione: (2026)
di: Yoon, Daewon, et al.
Pubblicazione: (2026)
A Survey on Dynamic Neural Networks: from Computer Vision to Multi-modal Sensor Fusion
di: Montello, Fabio, et al.
Pubblicazione: (2025)
di: Montello, Fabio, et al.
Pubblicazione: (2025)
Quantifying and Narrowing the Unknown: Interactive Text-to-Video Retrieval via Uncertainty Minimization
di: Zhang, Bingqing, et al.
Pubblicazione: (2025)
di: Zhang, Bingqing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
BG-YOLO: A Bidirectional-Guided Method for Underwater Object Detection
di: Zhang, Jian, et al.
Pubblicazione: (2024) -
Do Generative Metrics Predict YOLO Performance? An Evaluation Across Models, Augmentation Ratios, and Dataset Complexity
di: Marian, Vasile, et al.
Pubblicazione: (2026) -
Synthetic Industrial Object Detection: GenAI vs. Feature-Based Methods
di: Araya-Martinez, Jose Moises, et al.
Pubblicazione: (2025) -
Learning Association via Track-Detection Matching for Multi-Object Tracking
di: Adžemović, Momir
Pubblicazione: (2025) -
DOD-SA: Infrared-Visible Decoupled Object Detection with Single-Modality Annotations
di: Jin, Hang, et al.
Pubblicazione: (2025)