Classification of freshwater snails of the genus Radomaniola with multimodal triplet networks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Vetter, Dennis, Ahsan, Muhammad, Delicado, Diana, Neubauer, Thomas A., Wilke, Thomas, Roig, Gemma |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On Explaining Knowledge Distillation: Measuring and Visualising the Knowledge Transfer Process
par: Adhane, Gereziher, et autres
Publié: (2024)
par: Adhane, Gereziher, et autres
Publié: (2024)
Human Gaze Boosts Object-Centered Representation Learning
par: Schaumlöffel, Timothy, et autres
Publié: (2025)
par: Schaumlöffel, Timothy, et autres
Publié: (2025)
Caregiver Talk Shapes Toddler Vision: A Computational Study of Dyadic Play
par: Schaumlöffel, Timothy, et autres
Publié: (2023)
par: Schaumlöffel, Timothy, et autres
Publié: (2023)
Evaluation of Randomization through Style Transfer for Enhanced Domain Generalization
par: Eisenhardt, Dustin, et autres
Publié: (2026)
par: Eisenhardt, Dustin, et autres
Publié: (2026)
Efficient Unsupervised Shortcut Learning Detection and Mitigation in Transformers
par: Kuhn, Lukas, et autres
Publié: (2025)
par: Kuhn, Lukas, et autres
Publié: (2025)
FovEx: Human-Inspired Explanations for Vision Transformers and Convolutional Neural Networks
par: Panda, Mahadev Prasad, et autres
Publié: (2024)
par: Panda, Mahadev Prasad, et autres
Publié: (2024)
Learning Object Semantic Similarity with Self-Supervision
par: Aubret, Arthur, et autres
Publié: (2024)
par: Aubret, Arthur, et autres
Publié: (2024)
PASTA: Vision Transformer Patch Aggregation for Weakly Supervised Target and Anomaly Segmentation
par: Neubauer, Melanie, et autres
Publié: (2026)
par: Neubauer, Melanie, et autres
Publié: (2026)
No Identity, no problem: Motion through detection for people tracking
par: Engilberge, Martin, et autres
Publié: (2024)
par: Engilberge, Martin, et autres
Publié: (2024)
FairQuant: Fairness-Aware Mixed-Precision Quantization for Medical Image Classification
par: Woergaard, Thomas, et autres
Publié: (2026)
par: Woergaard, Thomas, et autres
Publié: (2026)
MULTIAQUA: A multimodal maritime dataset and robust training strategies for multimodal semantic segmentation
par: Muhovič, Jon, et autres
Publié: (2025)
par: Muhovič, Jon, et autres
Publié: (2025)
A Deep Features-Based Approach Using Modified ResNet50 and Gradient Boosting for Visual Sentiments Classification
par: Arslan, Muhammad, et autres
Publié: (2024)
par: Arslan, Muhammad, et autres
Publié: (2024)
Closing the gap in multimodal medical representation alignment
par: Grassucci, Eleonora, et autres
Publié: (2026)
par: Grassucci, Eleonora, et autres
Publié: (2026)
S-E Pipeline: A Vision Transformer (ViT) based Resilient Classification Pipeline for Medical Imaging Against Adversarial Attacks
par: S, Neha A, et autres
Publié: (2024)
par: S, Neha A, et autres
Publié: (2024)
Localizing Anomalies via Multiscale Score Matching Analysis
par: Mahmood, Ahsan, et autres
Publié: (2024)
par: Mahmood, Ahsan, et autres
Publié: (2024)
Neighbor-aware informal settlement mapping with graph convolutional networks
par: Hallopeau, Thomas, et autres
Publié: (2025)
par: Hallopeau, Thomas, et autres
Publié: (2025)
A Tumor Aware DenseNet Swin Hybrid Learning with Boosted and Hierarchical Feature Spaces for Large-Scale Brain MRI Classification
par: Shah, Muhammad Ali, et autres
Publié: (2026)
par: Shah, Muhammad Ali, et autres
Publié: (2026)
SELECTOR: Heterogeneous graph network with convolutional masked autoencoder for multimodal robust prediction of cancer survival
par: Pan, Liangrui, et autres
Publié: (2024)
par: Pan, Liangrui, et autres
Publié: (2024)
Buffer replay enhances the robustness of multimodal learning under missing-modality
par: Zhu, Hongye, et autres
Publié: (2025)
par: Zhu, Hongye, et autres
Publié: (2025)
Can multimodal representation learning by alignment preserve modality-specific information?
par: Thoreau, Romain, et autres
Publié: (2025)
par: Thoreau, Romain, et autres
Publié: (2025)
Hierarchical Multi-Label Classification with Missing Information for Benthic Habitat Imagery
par: Xu, Isaac, et autres
Publié: (2024)
par: Xu, Isaac, et autres
Publié: (2024)
Dual-Rate Diffusion: Accelerating diffusion models with an interleaved heavy-light network
par: Bartosh, Grigory, et autres
Publié: (2026)
par: Bartosh, Grigory, et autres
Publié: (2026)
A Survey on Cell Nuclei Instance Segmentation and Classification: Leveraging Context and Attention
par: Nunes, João D., et autres
Publié: (2024)
par: Nunes, João D., et autres
Publié: (2024)
Visual concept ranking uncovers medical shortcuts used by large multimodal models
par: Janizek, Joseph D., et autres
Publié: (2026)
par: Janizek, Joseph D., et autres
Publié: (2026)
Towards a multimodal framework for remote sensing image change retrieval and captioning
par: Ferrod, Roger, et autres
Publié: (2024)
par: Ferrod, Roger, et autres
Publié: (2024)
Inference-Path Optimization via Circuit Duplication in Frozen Visual Transformers for Marine Species Classification
par: Rost, Thomas Manuel
Publié: (2026)
par: Rost, Thomas Manuel
Publié: (2026)
Hybrid Quantum-Classical Model for Image Classification
par: Shahzad, Muhammad Adnan
Publié: (2025)
par: Shahzad, Muhammad Adnan
Publié: (2025)
On the effectiveness of multimodal privileged knowledge distillation in two vision transformer based diagnostic applications
par: Baur, Simon, et autres
Publié: (2025)
par: Baur, Simon, et autres
Publié: (2025)
What do vision-language models see in the context? Investigating multimodal in-context learning
par: Santos, Gabriel O. dos, et autres
Publié: (2025)
par: Santos, Gabriel O. dos, et autres
Publié: (2025)
Similarity Trajectories: Linking Sampling Process to Artifacts in Diffusion-Generated Images
par: Menn, Dennis, et autres
Publié: (2024)
par: Menn, Dennis, et autres
Publié: (2024)
Open-ended VQA benchmarking of Vision-Language models by exploiting Classification datasets and their semantic hierarchy
par: Ging, Simon, et autres
Publié: (2024)
par: Ging, Simon, et autres
Publié: (2024)
Synthetic Data for Robust Runway Detection
par: Chigot, Estelle, et autres
Publié: (2025)
par: Chigot, Estelle, et autres
Publié: (2025)
Generative artificial intelligence in ophthalmology: multimodal retinal images for the diagnosis of Alzheimer's disease with convolutional neural networks
par: Slootweg, I. R., et autres
Publié: (2024)
par: Slootweg, I. R., et autres
Publié: (2024)
A multimodal slice discovery framework for systematic failure detection and explanation in medical image classification
par: Liu, Yixuan, et autres
Publié: (2026)
par: Liu, Yixuan, et autres
Publié: (2026)
AG-Fusion: adaptive gated multimodal fusion for 3d object detection in complex scenes
par: Liu, Sixian, et autres
Publié: (2025)
par: Liu, Sixian, et autres
Publié: (2025)
MosquIoT: A System Based on IoT and Machine Learning for the Monitoring of Aedes aegypti (Diptera: Culicidae)
par: Aira, Javier, et autres
Publié: (2024)
par: Aira, Javier, et autres
Publié: (2024)
Self-supervised cost of transport estimation for multimodal path planning
par: Gherold, Vincent, et autres
Publié: (2024)
par: Gherold, Vincent, et autres
Publié: (2024)
Mapping Rio de Janeiro's favelas: general-purpose vs. satellite-specific neural networks
par: Hallopeau, Thomas, et autres
Publié: (2025)
par: Hallopeau, Thomas, et autres
Publié: (2025)
BioNeRF: Biologically Plausible Neural Radiance Fields for View Synthesis
par: Passos, Leandro A., et autres
Publié: (2024)
par: Passos, Leandro A., et autres
Publié: (2024)
Review of multimodal machine learning approaches in healthcare
par: Krones, Felix, et autres
Publié: (2024)
par: Krones, Felix, et autres
Publié: (2024)
Documents similaires
-
On Explaining Knowledge Distillation: Measuring and Visualising the Knowledge Transfer Process
par: Adhane, Gereziher, et autres
Publié: (2024) -
Human Gaze Boosts Object-Centered Representation Learning
par: Schaumlöffel, Timothy, et autres
Publié: (2025) -
Caregiver Talk Shapes Toddler Vision: A Computational Study of Dyadic Play
par: Schaumlöffel, Timothy, et autres
Publié: (2023) -
Evaluation of Randomization through Style Transfer for Enhanced Domain Generalization
par: Eisenhardt, Dustin, et autres
Publié: (2026) -
Efficient Unsupervised Shortcut Learning Detection and Mitigation in Transformers
par: Kuhn, Lukas, et autres
Publié: (2025)