On the Inherent Robustness of One-Stage Object Detection against Out-of-Distribution Data
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Martinez-Seras, Aitor, Del Ser, Javier, Olivares-Rad, Aitzol, Andres, Alain, Garcia-Bringas, Pablo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DOD-SA: Infrared-Visible Decoupled Object Detection with Single-Modality Annotations
par: Jin, Hang, et autres
Publié: (2025)
par: Jin, Hang, et autres
Publié: (2025)
Learning Sign Language Representation using CNN LSTM, 3DCNN, CNN RNN LSTM and CCN TD
par: Louison, Nikita, et autres
Publié: (2024)
par: Louison, Nikita, et autres
Publié: (2024)
On Memory: A comparison of memory mechanisms in world models
par: Laird, Eli J., et autres
Publié: (2025)
par: Laird, Eli J., et autres
Publié: (2025)
LRVS-Fashion: Extending Visual Search with Referring Instructions
par: Lepage, Simon, et autres
Publié: (2023)
par: Lepage, Simon, et autres
Publié: (2023)
E Pluribus Unum Interpretable Convolutional Neural Networks
par: Dimas, George, et autres
Publié: (2022)
par: Dimas, George, et autres
Publié: (2022)
Harmony: A Joint Self-Supervised and Weakly-Supervised Framework for Learning General Purpose Visual Representations
par: Baharoon, Mohammed, et autres
Publié: (2024)
par: Baharoon, Mohammed, et autres
Publié: (2024)
MB-DSMIL-CL-PL: Scalable Weakly Supervised Ovarian Cancer Subtype Classification and Localisation Using Contrastive and Prototype Learning with Frozen Patch Features
par: Jenkins, Marcus, et autres
Publié: (2026)
par: Jenkins, Marcus, et autres
Publié: (2026)
TowerVision: Understanding and Improving Multilinguality in Vision-Language Models
par: Viveiros, André G., et autres
Publié: (2025)
par: Viveiros, André G., et autres
Publié: (2025)
Unpacking Hateful Memes: Presupposed Context and False Claims
par: Cai, Weibin, et autres
Publié: (2025)
par: Cai, Weibin, et autres
Publié: (2025)
JVLGS: Joint Vision-Language Gas Leak Segmentation
par: Zhao, Xinlong, et autres
Publié: (2025)
par: Zhao, Xinlong, et autres
Publié: (2025)
Point, Detect, Count: Multi-Task Medical Image Understanding with Instruction-Tuned Vision-Language Models
par: Gautam, Sushant, et autres
Publié: (2025)
par: Gautam, Sushant, et autres
Publié: (2025)
Training for X-Ray Vision: Amodal Segmentation, Amodal Content Completion, and View-Invariant Object Representation from Multi-Camera Video
par: Moore, Alexander, et autres
Publié: (2025)
par: Moore, Alexander, et autres
Publié: (2025)
Revisiting Energy-Based Model for Out-of-Distribution Detection
par: Wu, Yifan, et autres
Publié: (2024)
par: Wu, Yifan, et autres
Publié: (2024)
Robust Noise Attenuation via Adaptive Pooling of Transformer Outputs
par: Brothers, Greyson
Publié: (2025)
par: Brothers, Greyson
Publié: (2025)
ShapBPT: Image Feature Attributions Using Data-Aware Binary Partition Trees
par: Rashid, Muhammad, et autres
Publié: (2026)
par: Rashid, Muhammad, et autres
Publié: (2026)
TableMoE: Neuro-Symbolic Routing for Structured Expert Reasoning in Multimodal Table Understanding
par: Zhang, Junwen, et autres
Publié: (2025)
par: Zhang, Junwen, et autres
Publié: (2025)
Perception-Consistency Multimodal Large Language Models Reasoning via Caption-Regularized Policy Optimization
par: Tu, Songjun, et autres
Publié: (2025)
par: Tu, Songjun, et autres
Publié: (2025)
Image-based Facial Rig Inversion
par: Yang, Tianxiang, et autres
Publié: (2025)
par: Yang, Tianxiang, et autres
Publié: (2025)
Fixed-Threshold Evaluation of a Hybrid CNN-ViT for AI-Generated Image Detection Across Photos and Art
par: Khan, Md Ashik, et autres
Publié: (2025)
par: Khan, Md Ashik, et autres
Publié: (2025)
Does CLIP perceive art the same way we do?
par: Asperti, Andrea, et autres
Publié: (2025)
par: Asperti, Andrea, et autres
Publié: (2025)
Contrastive Consolidation of Top-Down Modulations Achieves Sparsely Supervised Continual Learning
par: Tran, Viet Anh Khoa, et autres
Publié: (2025)
par: Tran, Viet Anh Khoa, et autres
Publié: (2025)
Rethinking Visual Intelligence: Insights from Video Pretraining
par: Acuaviva, Pablo, et autres
Publié: (2025)
par: Acuaviva, Pablo, et autres
Publié: (2025)
Advancing Brain Tumor Segmentation via Attention-based 3D U-Net Architecture and Digital Image Processing
par: Gad, Eyad, et autres
Publié: (2025)
par: Gad, Eyad, et autres
Publié: (2025)
WildfireVLM: AI-powered Analysis for Early Wildfire Detection and Risk Assessment Using Satellite Imagery
par: Ayanzadeh, Aydin, et autres
Publié: (2026)
par: Ayanzadeh, Aydin, et autres
Publié: (2026)
HieraEdgeNet: A Multi-Scale Edge-Enhanced Framework for Automated Pollen Recognition
par: Long, Yuchong, et autres
Publié: (2025)
par: Long, Yuchong, et autres
Publié: (2025)
Short-Window Sliding Learning for Real-Time Violence Detection via LLM-based Auto-Labeling
par: Jung, Seoik, et autres
Publié: (2025)
par: Jung, Seoik, et autres
Publié: (2025)
Predictive Modeling of Maritime Radar Data Using Transformer Architecture
par: Qesaraku, Bjorna, et autres
Publié: (2025)
par: Qesaraku, Bjorna, et autres
Publié: (2025)
Fine-grained spatial-temporal perception for gas leak segmentation
par: Zhao, Xinlong, et autres
Publié: (2025)
par: Zhao, Xinlong, et autres
Publié: (2025)
Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset
par: Zinnen, Mathias, et autres
Publié: (2025)
par: Zinnen, Mathias, et autres
Publié: (2025)
Dual-sensing driving detection model
par: K, Leon C. C., et autres
Publié: (2025)
par: K, Leon C. C., et autres
Publié: (2025)
Spectral Integrated Gradients for Coarse-to-Fine Feature Attribution
par: Kim, Soyeon, et autres
Publié: (2026)
par: Kim, Soyeon, et autres
Publié: (2026)
Manifold-Aligned Guided Integrated Gradients for Reliable Feature Attribution
par: Kim, Soyeon, et autres
Publié: (2026)
par: Kim, Soyeon, et autres
Publié: (2026)
IDOL: Instant Photorealistic 3D Human Creation from a Single Image
par: Zhuang, Yiyu, et autres
Publié: (2024)
par: Zhuang, Yiyu, et autres
Publié: (2024)
Balanced conic rectified flow
par: Kim, Shin Seong, et autres
Publié: (2025)
par: Kim, Shin Seong, et autres
Publié: (2025)
Polarization-Based Eye Tracking with Personalized Siamese Architectures
par: Kalkanli, Beyza, et autres
Publié: (2026)
par: Kalkanli, Beyza, et autres
Publié: (2026)
Hierarchical Point-Patch Fusion with Adaptive Patch Codebook for 3D Shape Anomaly Detection
par: Kang, Xueyang, et autres
Publié: (2026)
par: Kang, Xueyang, et autres
Publié: (2026)
Generating Diverse Agricultural Data for Vision-Based Farming Applications
par: Cieslak, Mikolaj, et autres
Publié: (2024)
par: Cieslak, Mikolaj, et autres
Publié: (2024)
LAESI: Leaf Area Estimation with Synthetic Imagery
par: Kałużny, Jacek, et autres
Publié: (2024)
par: Kałużny, Jacek, et autres
Publié: (2024)
BG-YOLO: A Bidirectional-Guided Method for Underwater Object Detection
par: Zhang, Jian, et autres
Publié: (2024)
par: Zhang, Jian, et autres
Publié: (2024)
ATAAT: Adaptive Threat-Aware Adversarial Tuning Framework against Backdoor Attacks on Vision-Language-Action Models
par: Chen, Kewei, et autres
Publié: (2026)
par: Chen, Kewei, et autres
Publié: (2026)
Documents similaires
-
DOD-SA: Infrared-Visible Decoupled Object Detection with Single-Modality Annotations
par: Jin, Hang, et autres
Publié: (2025) -
Learning Sign Language Representation using CNN LSTM, 3DCNN, CNN RNN LSTM and CCN TD
par: Louison, Nikita, et autres
Publié: (2024) -
On Memory: A comparison of memory mechanisms in world models
par: Laird, Eli J., et autres
Publié: (2025) -
LRVS-Fashion: Extending Visual Search with Referring Instructions
par: Lepage, Simon, et autres
Publié: (2023) -
E Pluribus Unum Interpretable Convolutional Neural Networks
par: Dimas, George, et autres
Publié: (2022)