A study on general visual categorization of objects into animal and plant groups using global shape descriptors with a focus on category-specific deficits
Fuente:
arXiv
Salvato in:
| Autore principale: | Sadeghi, Zahra |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2019
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Technical note: ShinyAnimalCV: open-source cloud-based web application for object detection, segmentation, and three-dimensional visualization of animals using computer vision
di: Wang, Jin, et al.
Pubblicazione: (2023)
di: Wang, Jin, et al.
Pubblicazione: (2023)
Efficiently Enhancing General Agents With Hierarchical-categorical Memory
di: Qiao, Changze, et al.
Pubblicazione: (2025)
di: Qiao, Changze, et al.
Pubblicazione: (2025)
SCREENER: A general framework for task-specific experiment design in quantitative MRI
di: Zheng, Tianshu, et al.
Pubblicazione: (2024)
di: Zheng, Tianshu, et al.
Pubblicazione: (2024)
Improving generalization by mimicking the human visual diet
di: Madan, Spandan, et al.
Pubblicazione: (2022)
di: Madan, Spandan, et al.
Pubblicazione: (2022)
An Innovative Framework for Breast Cancer Detection Using Pyramid Adaptive Atrous Convolution, Transformer Integration, and Multi-Scale Feature Fusion
di: Pour, Ehsan Sadeghi, et al.
Pubblicazione: (2026)
di: Pour, Ehsan Sadeghi, et al.
Pubblicazione: (2026)
BusReF: Infrared-Visible images registration and fusion focus on reconstructible area using one set of features
di: Zhang, Zeyang, et al.
Pubblicazione: (2023)
di: Zhang, Zeyang, et al.
Pubblicazione: (2023)
An efficient plant disease detection using transfer learning approach
di: Sambana, Bosubabu, et al.
Pubblicazione: (2025)
di: Sambana, Bosubabu, et al.
Pubblicazione: (2025)
CheXthought: A global multimodal dataset of clinical chain-of-thought reasoning and visual attention for chest X-ray interpretation
di: Sharma, Sonali, et al.
Pubblicazione: (2026)
di: Sharma, Sonali, et al.
Pubblicazione: (2026)
Can visual language models resolve textual ambiguity with visual cues? Let visual puns tell you!
di: Chung, Jiwan, et al.
Pubblicazione: (2024)
di: Chung, Jiwan, et al.
Pubblicazione: (2024)
Class-specific diffusion models improve military object detection in a low-data domain
di: Fokkinga, Ella P., et al.
Pubblicazione: (2026)
di: Fokkinga, Ella P., et al.
Pubblicazione: (2026)
Reconstruction of the shape of irregular rough particles from their interferometric images using a convolutional neural network
di: Abad, Alexis, et al.
Pubblicazione: (2024)
di: Abad, Alexis, et al.
Pubblicazione: (2024)
Dilated Convolution with Learnable Spacings makes visual models more aligned with humans: a Grad-CAM study
di: Chamas, Rabih, et al.
Pubblicazione: (2024)
di: Chamas, Rabih, et al.
Pubblicazione: (2024)
Eye image segmentation using visual and concept prompts with Segment Anything Model 3 (SAM3)
di: Niehorster, Diederick C., et al.
Pubblicazione: (2026)
di: Niehorster, Diederick C., et al.
Pubblicazione: (2026)
Reducing the gap between general purpose data and aerial images in concentrated solar power plants
di: Pérez-Cutiño, M. A., et al.
Pubblicazione: (2025)
di: Pérez-Cutiño, M. A., et al.
Pubblicazione: (2025)
Behave Your Motion: Habit-preserved Cross-category Animal Motion Transfer
di: Zhang, Zhimin, et al.
Pubblicazione: (2025)
di: Zhang, Zhimin, et al.
Pubblicazione: (2025)
BatStyler: Advancing Multi-category Style Generation for Source-free Domain Generalization
di: Xu, Xiusheng, et al.
Pubblicazione: (2025)
di: Xu, Xiusheng, et al.
Pubblicazione: (2025)
Lester: rotoscope animation through video object segmentation and tracking
di: Tous, Ruben
Pubblicazione: (2024)
di: Tous, Ruben
Pubblicazione: (2024)
GCA-ResUNet:Image segmentation in medical images using grouped coordinate attention
di: Ding, Jun, et al.
Pubblicazione: (2025)
di: Ding, Jun, et al.
Pubblicazione: (2025)
Quantifying the human visual exposome with vision language models
di: Rominger, Christian, et al.
Pubblicazione: (2026)
di: Rominger, Christian, et al.
Pubblicazione: (2026)
Hybrid guided variational autoencoder for visual place recognition
di: Wang, Ni, et al.
Pubblicazione: (2026)
di: Wang, Ni, et al.
Pubblicazione: (2026)
Region-specific Risk Quantification for Interpretable Prognosis of COVID-19
di: Zhong, Zhusi, et al.
Pubblicazione: (2024)
di: Zhong, Zhusi, et al.
Pubblicazione: (2024)
Knowledge-based anomaly detection for identifying network-induced shape artifacts
di: Deshpande, Rucha, et al.
Pubblicazione: (2025)
di: Deshpande, Rucha, et al.
Pubblicazione: (2025)
PGT: Procedurally Generated Tasks for improving visual grounding in MLLMs
di: Assouel, Rim, et al.
Pubblicazione: (2026)
di: Assouel, Rim, et al.
Pubblicazione: (2026)
An analysis of HOI: using a training-free method with multimodal visual foundation models when only the test set is available, without the training set
di: Ai, Chaoyi
Pubblicazione: (2024)
di: Ai, Chaoyi
Pubblicazione: (2024)
Representation geometry shapes task performance in vision-language modeling for CT enterography
di: Minoccheri, Cristian, et al.
Pubblicazione: (2026)
di: Minoccheri, Cristian, et al.
Pubblicazione: (2026)
Stop learning it all to mitigate visual hallucination, Focus on the hallucination target
di: Yoon, Dokyoon, et al.
Pubblicazione: (2025)
di: Yoon, Dokyoon, et al.
Pubblicazione: (2025)
Gamified crowd-sourcing of high-quality data for visual fine-tuning
di: Yadav, Shashank, et al.
Pubblicazione: (2024)
di: Yadav, Shashank, et al.
Pubblicazione: (2024)
ActiveMark: on watermarking of visual foundation models via massive activations
di: Chistyakova, Anna, et al.
Pubblicazione: (2025)
di: Chistyakova, Anna, et al.
Pubblicazione: (2025)
Self-supervised visual learning for analyzing firearms trafficking activities on the Web
di: Konstantakos, Sotirios, et al.
Pubblicazione: (2023)
di: Konstantakos, Sotirios, et al.
Pubblicazione: (2023)
FusionFM: Fusing Eye-specific Foundational Models for Optimized Ophthalmic Diagnosis
di: Zou, Ke, et al.
Pubblicazione: (2025)
di: Zou, Ke, et al.
Pubblicazione: (2025)
CASR-Net: An Image Processing-focused Deep Learning-based Coronary Artery Segmentation and Refinement Network for X-ray Coronary Angiogram
di: Hassan, Alvee, et al.
Pubblicazione: (2025)
di: Hassan, Alvee, et al.
Pubblicazione: (2025)
MM-UNet: Morph Mamba U-shaped Convolutional Networks for Retinal Vessel Segmentation
di: Liu, Jiawen, et al.
Pubblicazione: (2025)
di: Liu, Jiawen, et al.
Pubblicazione: (2025)
Leveraging Foundation Models To learn the shape of semi-fluid deformable objects
di: Assal, Omar El, et al.
Pubblicazione: (2024)
di: Assal, Omar El, et al.
Pubblicazione: (2024)
Physics-Guided Motion Loss for Video Generation Model
di: Xue, Bowen, et al.
Pubblicazione: (2025)
di: Xue, Bowen, et al.
Pubblicazione: (2025)
Memory-Efficient Continual Learning Object Segmentation for Long Video
di: Nazemi, Amir, et al.
Pubblicazione: (2023)
di: Nazemi, Amir, et al.
Pubblicazione: (2023)
Redefining Generalization in Visual Domains: A Two-Axis Framework for Fake Image Detection with FusionDetect
di: Amanzadi, Amirtaha, et al.
Pubblicazione: (2025)
di: Amanzadi, Amirtaha, et al.
Pubblicazione: (2025)
Visual Graph Arena: Evaluating Visual Conceptualization of Vision and Multimodal Large Language Models
di: Babaiee, Zahra, et al.
Pubblicazione: (2025)
di: Babaiee, Zahra, et al.
Pubblicazione: (2025)
Efficient License Plate Recognition via Pseudo-Labeled Supervision with Grounding DINO and YOLOv8
di: Vargoorani, Zahra Ebrahimi, et al.
Pubblicazione: (2025)
di: Vargoorani, Zahra Ebrahimi, et al.
Pubblicazione: (2025)
The Master Key Filters Hypothesis: Deep Filters Are General
di: Babaiee, Zahra, et al.
Pubblicazione: (2024)
di: Babaiee, Zahra, et al.
Pubblicazione: (2024)
Exploring visual language models as a powerful tool in the diagnosis of Ewing Sarcoma
di: Pastor-Naranjo, Alvaro, et al.
Pubblicazione: (2025)
di: Pastor-Naranjo, Alvaro, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Technical note: ShinyAnimalCV: open-source cloud-based web application for object detection, segmentation, and three-dimensional visualization of animals using computer vision
di: Wang, Jin, et al.
Pubblicazione: (2023) -
Efficiently Enhancing General Agents With Hierarchical-categorical Memory
di: Qiao, Changze, et al.
Pubblicazione: (2025) -
SCREENER: A general framework for task-specific experiment design in quantitative MRI
di: Zheng, Tianshu, et al.
Pubblicazione: (2024) -
Improving generalization by mimicking the human visual diet
di: Madan, Spandan, et al.
Pubblicazione: (2022) -
An Innovative Framework for Breast Cancer Detection Using Pyramid Adaptive Atrous Convolution, Transformer Integration, and Multi-Scale Feature Fusion
di: Pour, Ehsan Sadeghi, et al.
Pubblicazione: (2026)