Fine-tuned Vision Language Model for Localization of Parasitic Eggs in Microscopic Images
Fuente:
arXiv
Salvato in:
| Autori principali: | Sien, Chan Hao, Karim, Hezerul Abdul, AlDahoul, Nouar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Advancing Vehicle Plate Recognition: Multitasking Visual Language Models with VehiclePaliGemma
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024)
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024)
Real-Time Human Detection for Aerial Captured Video Sequences via Deep Models
di: AlDahoul, Nouar, et al.
Pubblicazione: (2026)
di: AlDahoul, Nouar, et al.
Pubblicazione: (2026)
AI-generated faces influence gender stereotypes and racial homogenization
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024)
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024)
Exploring Vision Language Models for Facial Attribute Recognition: Emotion, Race, Gender, and Age
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024)
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024)
Benchmarking the Medical Understanding and Reasoning of Large Language Models in Arabic Healthcare Tasks
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)
Detecting Hope, Hate, and Emotion in Arabic Textual Speech and Multi-modal Memes Using Large Language Models
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)
Advancing Content Moderation: Evaluating Large Language Models for Detecting Sensitive Content Across Text, Images, and Videos
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024)
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024)
Benchmarking the Legal Reasoning of LLMs in Arabic Islamic Inheritance Cases
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)
Multitask Mayhem: Unveiling and Mitigating Safety Gaps in LLMs Fine-tuning
di: Jan, Essa, et al.
Pubblicazione: (2024)
di: Jan, Essa, et al.
Pubblicazione: (2024)
Towards Compatible Fine-tuning for Vision-Language Model Updates
di: Wang, Zhengbo, et al.
Pubblicazione: (2024)
di: Wang, Zhengbo, et al.
Pubblicazione: (2024)
Beyond Human Vision: The Role of Large Vision Language Models in Microscope Image Analysis
di: Verma, Prateek, et al.
Pubblicazione: (2024)
di: Verma, Prateek, et al.
Pubblicazione: (2024)
A Longitudinal Analysis of Racial and Gender Bias in New York Times and Fox News Images and Articles
di: Ibrahim, Hazem, et al.
Pubblicazione: (2024)
di: Ibrahim, Hazem, et al.
Pubblicazione: (2024)
Data Selection for Fine-tuning Vision Language Models via Cross Modal Alignment Trajectories
di: Naharas, Nilay, et al.
Pubblicazione: (2025)
di: Naharas, Nilay, et al.
Pubblicazione: (2025)
Fine-tuning Vision Classifiers On A Budget
di: Kumar, Sunil, et al.
Pubblicazione: (2024)
di: Kumar, Sunil, et al.
Pubblicazione: (2024)
Light-weight Fine-tuning Method for Defending Adversarial Noise in Pre-trained Medical Vision-Language Models
di: Han, Xu, et al.
Pubblicazione: (2024)
di: Han, Xu, et al.
Pubblicazione: (2024)
Aligning Modalities in Vision Large Language Models via Preference Fine-tuning
di: Zhou, Yiyang, et al.
Pubblicazione: (2024)
di: Zhou, Yiyang, et al.
Pubblicazione: (2024)
Connecting the Dots: Collaborative Fine-tuning for Black-Box Vision-Language Models
di: Wang, Zhengbo, et al.
Pubblicazione: (2024)
di: Wang, Zhengbo, et al.
Pubblicazione: (2024)
A Conceptual Exploration of Generative AI-Induced Cognitive Dissonance and its Emergence in University-Level Academic Writing
di: Seran, Carl Errol, et al.
Pubblicazione: (2025)
di: Seran, Carl Errol, et al.
Pubblicazione: (2025)
Tutorial on Diffusion Models for Imaging and Vision
di: Chan, Stanley H.
Pubblicazione: (2024)
di: Chan, Stanley H.
Pubblicazione: (2024)
Personalized Preference Fine-tuning of Diffusion Models
di: Dang, Meihua, et al.
Pubblicazione: (2025)
di: Dang, Meihua, et al.
Pubblicazione: (2025)
Proxy-FDA: Proxy-based Feature Distribution Alignment for Fine-tuning Vision Foundation Models without Forgetting
di: Huang, Chen, et al.
Pubblicazione: (2025)
di: Huang, Chen, et al.
Pubblicazione: (2025)
DreamBlend: Advancing Personalized Fine-tuning of Text-to-Image Diffusion Models
di: Ram, Shwetha, et al.
Pubblicazione: (2024)
di: Ram, Shwetha, et al.
Pubblicazione: (2024)
Fine-tuning with Very Large Dropout
di: Zhang, Jianyu, et al.
Pubblicazione: (2024)
di: Zhang, Jianyu, et al.
Pubblicazione: (2024)
ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation
di: Dong, Chengyu, et al.
Pubblicazione: (2025)
di: Dong, Chengyu, et al.
Pubblicazione: (2025)
SelaFD:Seamless Adaptation of Vision Transformer Fine-tuning for Radar-based Human Activity Recognition
di: Wang, Yijun, et al.
Pubblicazione: (2025)
di: Wang, Yijun, et al.
Pubblicazione: (2025)
FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models
di: Zheng, Weiying, et al.
Pubblicazione: (2025)
di: Zheng, Weiying, et al.
Pubblicazione: (2025)
Rethinking Fine-Tuning: Unlocking Hidden Capabilities in Vision-Language Models
di: Zhang, Mingyuan, et al.
Pubblicazione: (2025)
di: Zhang, Mingyuan, et al.
Pubblicazione: (2025)
Efficient Model Editing with Task-Localized Sparse Fine-tuning
di: Iurada, Leonardo, et al.
Pubblicazione: (2025)
di: Iurada, Leonardo, et al.
Pubblicazione: (2025)
Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification
di: Tan, Zhaorui, et al.
Pubblicazione: (2025)
di: Tan, Zhaorui, et al.
Pubblicazione: (2025)
Information Router for Mitigating Modality Dominance in Vision-Language Models
di: Kim, Seulgi, et al.
Pubblicazione: (2026)
di: Kim, Seulgi, et al.
Pubblicazione: (2026)
Fairness-Aware Fine-Tuning of Vision-Language Models for Medical Glaucoma Diagnosis
di: Gu, Zijian, et al.
Pubblicazione: (2025)
di: Gu, Zijian, et al.
Pubblicazione: (2025)
Improved Regularization and Robustness for Fine-tuning in Neural Networks
di: Li, Dongyue, et al.
Pubblicazione: (2021)
di: Li, Dongyue, et al.
Pubblicazione: (2021)
Language Integration in Fine-Tuning Multimodal Large Language Models for Image-Based Regression
di: Jennings, Roy H., et al.
Pubblicazione: (2025)
di: Jennings, Roy H., et al.
Pubblicazione: (2025)
FRISM: Fine-Grained Reasoning Injection via Subspace-Level Model Merging for Vision-Language Models
di: Huang, Chenyu, et al.
Pubblicazione: (2026)
di: Huang, Chenyu, et al.
Pubblicazione: (2026)
Realistic Unsupervised CLIP Fine-tuning with Universal Entropy Optimization
di: Liang, Jian, et al.
Pubblicazione: (2023)
di: Liang, Jian, et al.
Pubblicazione: (2023)
Connect Later: Improving Fine-tuning for Robustness with Targeted Augmentations
di: Qu, Helen, et al.
Pubblicazione: (2024)
di: Qu, Helen, et al.
Pubblicazione: (2024)
ToonOut: Fine-tuned Background-Removal for Anime Characters
di: Muratori, Matteo, et al.
Pubblicazione: (2025)
di: Muratori, Matteo, et al.
Pubblicazione: (2025)
AutoCLIP: Auto-tuning Zero-Shot Classifiers for Vision-Language Models
di: Metzen, Jan Hendrik, et al.
Pubblicazione: (2023)
di: Metzen, Jan Hendrik, et al.
Pubblicazione: (2023)
Dual Risk Minimization: Towards Next-Level Robustness in Fine-tuning Zero-Shot Models
di: Li, Kaican, et al.
Pubblicazione: (2024)
di: Li, Kaican, et al.
Pubblicazione: (2024)
Pre-Trained Model Recommendation for Downstream Fine-tuning
di: Bai, Jiameng, et al.
Pubblicazione: (2024)
di: Bai, Jiameng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Advancing Vehicle Plate Recognition: Multitasking Visual Language Models with VehiclePaliGemma
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024) -
Real-Time Human Detection for Aerial Captured Video Sequences via Deep Models
di: AlDahoul, Nouar, et al.
Pubblicazione: (2026) -
AI-generated faces influence gender stereotypes and racial homogenization
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024) -
Exploring Vision Language Models for Facial Attribute Recognition: Emotion, Race, Gender, and Age
di: AlDahoul, Nouar, et al.
Pubblicazione: (2024) -
Benchmarking the Medical Understanding and Reasoning of Large Language Models in Arabic Healthcare Tasks
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)