Enregistré dans:
| Auteurs principaux: | Petković, Uroš, Frenkel, Jonas, Hellwich, Olaf, Lazarides, Rebecca |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2407.17209 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Advancing Brain Tumor Segmentation via Attention-based 3D U-Net Architecture and Digital Image Processing
par: Gad, Eyad, et autres
Publié: (2025)
par: Gad, Eyad, et autres
Publié: (2025)
Sequence Matters: Harnessing Video Models in 3D Super-Resolution
par: Ko, Hyun-kyu, et autres
Publié: (2024)
par: Ko, Hyun-kyu, et autres
Publié: (2024)
Learning Discriminative Spatio-temporal Representations for Semi-supervised Action Recognition
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset
par: Zinnen, Mathias, et autres
Publié: (2025)
par: Zinnen, Mathias, et autres
Publié: (2025)
Corn Ear Detection and Orientation Estimation Using Deep Learning
par: Sprague, Nathan, et autres
Publié: (2024)
par: Sprague, Nathan, et autres
Publié: (2024)
Gr-IoU: Ground-Intersection over Union for Robust Multi-Object Tracking with 3D Geometric Constraints
par: Toida, Keisuke, et autres
Publié: (2024)
par: Toida, Keisuke, et autres
Publié: (2024)
DOD-SA: Infrared-Visible Decoupled Object Detection with Single-Modality Annotations
par: Jin, Hang, et autres
Publié: (2025)
par: Jin, Hang, et autres
Publié: (2025)
Underwater SONAR Image Classification and Analysis using LIME-based Explainable Artificial Intelligence
par: Natarajan, Purushothaman, et autres
Publié: (2024)
par: Natarajan, Purushothaman, et autres
Publié: (2024)
ARTPS: Depth-Enhanced Hybrid Anomaly Detection and Learnable Curiosity Score for Autonomous Rover Target Prioritization
par: Baydemir, Poyraz
Publié: (2025)
par: Baydemir, Poyraz
Publié: (2025)
TRACES: Temporal Recall with Contextual Embeddings for Real-Time Video Anomaly Detection
par: Siddiqui, Yousuf Ahmed, et autres
Publié: (2025)
par: Siddiqui, Yousuf Ahmed, et autres
Publié: (2025)
Fast 3D point clouds retrieval for Large-scale 3D Place Recognition
par: Zede, Chahine-Nicolas, et autres
Publié: (2025)
par: Zede, Chahine-Nicolas, et autres
Publié: (2025)
An M-Health Algorithmic Approach to Identify and Assess Physiotherapy Exercises in Real Time
par: Kandylakis, Stylianos, et autres
Publié: (2025)
par: Kandylakis, Stylianos, et autres
Publié: (2025)
Multi-Modal Self-Supervised Learning for Surgical Feedback Effectiveness Assessment
par: Gupta, Arushi, et autres
Publié: (2024)
par: Gupta, Arushi, et autres
Publié: (2024)
DSER: Spectral Epipolar Representation for Efficient Light Field Depth Estimation
par: Mohammad, Noor Islam S., et autres
Publié: (2025)
par: Mohammad, Noor Islam S., et autres
Publié: (2025)
Hierarchical Spatial Algorithms for High-Resolution Image Quantization and Feature Extraction
par: Mohammad, Noor Islam S.
Publié: (2025)
par: Mohammad, Noor Islam S.
Publié: (2025)
AIDOVECL: AI-generated Dataset of Outpainted Vehicles for Eye-level Classification and Localization
par: Kazemi, Amir, et autres
Publié: (2024)
par: Kazemi, Amir, et autres
Publié: (2024)
YOLO Ensemble for UAV-based Multispectral Defect Detection in Wind Turbine Components
par: Svystun, Serhii, et autres
Publié: (2025)
par: Svystun, Serhii, et autres
Publié: (2025)
Generating Natural-Language Surgical Feedback: From Structured Representation to Domain-Grounded Evaluation
par: Nasriddinov, Firdavs, et autres
Publié: (2025)
par: Nasriddinov, Firdavs, et autres
Publié: (2025)
Position: Age Estimation Models Do Not Process Biometric Data
par: Marshalkin, Nikita
Publié: (2026)
par: Marshalkin, Nikita
Publié: (2026)
VALE: A Multimodal Visual and Language Explanation Framework for Image Classifiers using eXplainable AI and Language Models
par: Natarajan, Purushothaman, et autres
Publié: (2024)
par: Natarajan, Purushothaman, et autres
Publié: (2024)
ForensicFormer: Hierarchical Multi-Scale Reasoning for Cross-Domain Image Forgery Detection
par: Samson, Hema Hariharan
Publié: (2026)
par: Samson, Hema Hariharan
Publié: (2026)
Real Time Human Detection by Unmanned Aerial Vehicles
par: Guettala, Walid, et autres
Publié: (2024)
par: Guettala, Walid, et autres
Publié: (2024)
Data Augmentation and Resolution Enhancement using GANs and Diffusion Models for Tree Segmentation
par: Ferreira, Alessandro dos Santos, et autres
Publié: (2025)
par: Ferreira, Alessandro dos Santos, et autres
Publié: (2025)
Multimodal AI-based visualization of strategic leaders' emotional dynamics: a deep behavioral analysis of Trump's trade war discourse
par: Meng, Wei
Publié: (2025)
par: Meng, Wei
Publié: (2025)
Learning Association via Track-Detection Matching for Multi-Object Tracking
par: Adžemović, Momir
Publié: (2025)
par: Adžemović, Momir
Publié: (2025)
ShapBPT: Image Feature Attributions Using Data-Aware Binary Partition Trees
par: Rashid, Muhammad, et autres
Publié: (2026)
par: Rashid, Muhammad, et autres
Publié: (2026)
A Novel Approach to Breast Cancer Segmentation using U-Net Model with Attention Mechanisms and FedProx
par: Gad, Eyad, et autres
Publié: (2025)
par: Gad, Eyad, et autres
Publié: (2025)
A large-scale, physically-based synthetic dataset for satellite pose estimation
par: Velkei, Szabolcs, et autres
Publié: (2025)
par: Velkei, Szabolcs, et autres
Publié: (2025)
Learning Sign Language Representation using CNN LSTM, 3DCNN, CNN RNN LSTM and CCN TD
par: Louison, Nikita, et autres
Publié: (2024)
par: Louison, Nikita, et autres
Publié: (2024)
Skullptor: High Fidelity 3D Head Reconstruction in Seconds with Multi-View Normal Prediction
par: Artru, Noé, et autres
Publié: (2026)
par: Artru, Noé, et autres
Publié: (2026)
Multimodal Structure-Aware Quantum Data Processing
par: Hawashin, Hala, et autres
Publié: (2024)
par: Hawashin, Hala, et autres
Publié: (2024)
OpenFusion++: An Open-vocabulary Real-time Scene Understanding System
par: Jin, Xiaofeng, et autres
Publié: (2025)
par: Jin, Xiaofeng, et autres
Publié: (2025)
UVLM: A Universal Vision-Language Model Loader for Reproducible Multimodal Benchmarking
par: Perez, Joan, et autres
Publié: (2026)
par: Perez, Joan, et autres
Publié: (2026)
Sat-JEPA-Diff: Bridging Self-Supervised Learning and Generative Diffusion for Remote Sensing
par: Komurcu, Kursat, et autres
Publié: (2026)
par: Komurcu, Kursat, et autres
Publié: (2026)
Does CLIP perceive art the same way we do?
par: Asperti, Andrea, et autres
Publié: (2025)
par: Asperti, Andrea, et autres
Publié: (2025)
WildfireVLM: AI-powered Analysis for Early Wildfire Detection and Risk Assessment Using Satellite Imagery
par: Ayanzadeh, Aydin, et autres
Publié: (2026)
par: Ayanzadeh, Aydin, et autres
Publié: (2026)
Extraction Of Cumulative Blobs From Dynamic Gestures
par: Naulakha, Rishabh, et autres
Publié: (2025)
par: Naulakha, Rishabh, et autres
Publié: (2025)
When Less is Enough: Adaptive Token Reduction for Efficient Image Representation
par: Allakhverdov, Eduard, et autres
Publié: (2025)
par: Allakhverdov, Eduard, et autres
Publié: (2025)
Image Reconstruction as a Tool for Feature Analysis
par: Allakhverdov, Eduard, et autres
Publié: (2025)
par: Allakhverdov, Eduard, et autres
Publié: (2025)
Transforming faces into video stories -- VideoFace2.0
par: Brkljač, Branko, et autres
Publié: (2025)
par: Brkljač, Branko, et autres
Publié: (2025)
Documents similaires
-
Advancing Brain Tumor Segmentation via Attention-based 3D U-Net Architecture and Digital Image Processing
par: Gad, Eyad, et autres
Publié: (2025) -
Sequence Matters: Harnessing Video Models in 3D Super-Resolution
par: Ko, Hyun-kyu, et autres
Publié: (2024) -
Learning Discriminative Spatio-temporal Representations for Semi-supervised Action Recognition
par: Wang, Yu, et autres
Publié: (2024) -
Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset
par: Zinnen, Mathias, et autres
Publié: (2025) -
Corn Ear Detection and Orientation Estimation Using Deep Learning
par: Sprague, Nathan, et autres
Publié: (2024)