Beyond CNNs: Efficient Fine-Tuning of Multi-Modal LLMs for Object Detection on Low-Data Regimes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Elamon, Nirmal, Davoudi, Rouzbeh |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PEFT-DML: Parameter-Efficient Fine-Tuning Deep Metric Learning for Robust Multi-Modal 3D Object Detection in Autonomous Driving
par: Rezaei, Abdolazim, et autres
Publié: (2025)
par: Rezaei, Abdolazim, et autres
Publié: (2025)
Low-rank Attention Side-Tuning for Parameter-Efficient Fine-Tuning
par: Tang, Ningyuan, et autres
Publié: (2024)
par: Tang, Ningyuan, et autres
Publié: (2024)
Stacked Ensemble of Fine-Tuned CNNs for Knee Osteoarthritis Severity Grading
par: Gupta, Adarsh, et autres
Publié: (2025)
par: Gupta, Adarsh, et autres
Publié: (2025)
Multi-Point Positional Insertion Tuning for Small Object Detection
par: Goto, Kanoko, et autres
Publié: (2024)
par: Goto, Kanoko, et autres
Publié: (2024)
Image Generation Models: A Technical History
par: Shirvani, Rouzbeh
Publié: (2026)
par: Shirvani, Rouzbeh
Publié: (2026)
BoxTuning: Directly Injecting the Object Box for Multimodal Model Fine-Tuning
par: Qian, Zekun, et autres
Publié: (2026)
par: Qian, Zekun, et autres
Publié: (2026)
LARGO: Low-Rank Regulated Gradient Projection for Robust Parameter Efficient Fine-Tuning
par: Zhang, Haotian, et autres
Publié: (2025)
par: Zhang, Haotian, et autres
Publié: (2025)
Multi-Modal Parameter-Efficient Fine-tuning via Graph Neural Network
par: Cheng, Bin, et autres
Publié: (2024)
par: Cheng, Bin, et autres
Publié: (2024)
Uncertainty-Encoded Multi-Modal Fusion for Robust Object Detection in Autonomous Driving
par: Lou, Yang, et autres
Publié: (2023)
par: Lou, Yang, et autres
Publié: (2023)
Segment Any Object Model (SAOM): Real-to-Simulation Fine-Tuning Strategy for Multi-Class Multi-Instance Segmentation
par: Khan, Mariia, et autres
Publié: (2024)
par: Khan, Mariia, et autres
Publié: (2024)
S2P-Net: A Spectral-Spatial Polar Network for Rotation-Invariant Object Recognition in Low-Data Regimes
par: Heruth, Albert
Publié: (2026)
par: Heruth, Albert
Publié: (2026)
Diffusion-Based Restoration for Multi-Modal 3D Object Detection in Adverse Weather
par: He, Zhijian, et autres
Publié: (2025)
par: He, Zhijian, et autres
Publié: (2025)
HiddenObject: Modality-Agnostic Fusion for Multimodal Hidden Object Detection
par: Song, Harris, et autres
Publié: (2025)
par: Song, Harris, et autres
Publié: (2025)
Cream of the Crop: Harvesting Rich, Scalable and Transferable Multi-Modal Data for Instruction Fine-Tuning
par: Lyu, Mengyao, et autres
Publié: (2025)
par: Lyu, Mengyao, et autres
Publié: (2025)
Detect an Object At Once without Fine-tuning
par: Hao, Junyu, et autres
Publié: (2024)
par: Hao, Junyu, et autres
Publié: (2024)
Memory-Efficient Fine-Tuning for Quantized Diffusion Model
par: Ryu, Hyogon, et autres
Publié: (2024)
par: Ryu, Hyogon, et autres
Publié: (2024)
Beyond Generation: Unlocking Universal Editing via Self-Supervised Fine-Tuning
par: Chen, Harold Haodong, et autres
Publié: (2024)
par: Chen, Harold Haodong, et autres
Publié: (2024)
Vision Backbone Efficient Selection for Image Classification in Low-Data Regimes
par: Guerin, Joris, et autres
Publié: (2024)
par: Guerin, Joris, et autres
Publié: (2024)
A Survey of Camouflaged Object Detection and Beyond
par: Xiao, Fengyang, et autres
Publié: (2024)
par: Xiao, Fengyang, et autres
Publié: (2024)
Enhancing Fine-Grained Visual Recognition in the Low-Data Regime Through Feature Magnitude Regularization
par: Chapman, Avraham, et autres
Publié: (2024)
par: Chapman, Avraham, et autres
Publié: (2024)
Adaptive Layer Selection for Efficient Vision Transformer Fine-Tuning
par: Devoto, Alessio, et autres
Publié: (2024)
par: Devoto, Alessio, et autres
Publié: (2024)
Efficient Adversarial Training via Criticality-Aware Fine-Tuning
par: Li, Wenyun, et autres
Publié: (2026)
par: Li, Wenyun, et autres
Publié: (2026)
MultiCorrupt: A Multi-Modal Robustness Dataset and Benchmark of LiDAR-Camera Fusion for 3D Object Detection
par: Beemelmanns, Till, et autres
Publié: (2024)
par: Beemelmanns, Till, et autres
Publié: (2024)
AW-MoE: All-Weather Mixture of Experts for Robust Multi-Modal 3D Object Detection
par: Lin, Hongwei, et autres
Publié: (2026)
par: Lin, Hongwei, et autres
Publié: (2026)
Efficient Hyperparameter Importance Assessment for CNNs
par: Wang, Ruinan, et autres
Publié: (2024)
par: Wang, Ruinan, et autres
Publié: (2024)
Parameter-Efficient Fine-Tuning for Medical Image Analysis: The Missed Opportunity
par: Dutt, Raman, et autres
Publié: (2023)
par: Dutt, Raman, et autres
Publié: (2023)
On Modality Incomplete Infrared-Visible Object Detection: An Architecture Compatibility Perspective
par: Yang, Shuo, et autres
Publié: (2025)
par: Yang, Shuo, et autres
Publié: (2025)
Modality Translation for Object Detection Adaptation Without Forgetting Prior Knowledge
par: Medeiros, Heitor Rapela, et autres
Publié: (2024)
par: Medeiros, Heitor Rapela, et autres
Publié: (2024)
PlantDiseaseNet-RT50: A Fine-tuned ResNet50 Architecture for High-Accuracy Plant Disease Detection Beyond Standard CNNs
par: Sagnika, Santwana, et autres
Publié: (2025)
par: Sagnika, Santwana, et autres
Publié: (2025)
Frugal Federated Learning for Violence Detection: A Comparison of LoRA-Tuned VLMs and Personalized CNNs
par: Thuau, Sébastien, et autres
Publié: (2025)
par: Thuau, Sébastien, et autres
Publié: (2025)
Visual Object Tracking across Diverse Data Modalities: A Review
par: Wang, Mengmeng, et autres
Publié: (2024)
par: Wang, Mengmeng, et autres
Publié: (2024)
Multi-Head Explainer: A General Framework to Improve Explainability in CNNs and Transformers
par: Sun, Bohang, et autres
Publié: (2025)
par: Sun, Bohang, et autres
Publié: (2025)
Advancing Green AI: Efficient and Accurate Lightweight CNNs for Rice Leaf Disease Identification
par: Saddami, Khairun, et autres
Publié: (2024)
par: Saddami, Khairun, et autres
Publié: (2024)
Parameter-Efficient Fine-Tuning of Large Pretrained Models for Instance Segmentation Tasks
par: Baker, Nermeen Abou, et autres
Publié: (2026)
par: Baker, Nermeen Abou, et autres
Publié: (2026)
Automated Image Captioning with CNNs and Transformers
par: Cahyono, Joshua Adrian, et autres
Publié: (2024)
par: Cahyono, Joshua Adrian, et autres
Publié: (2024)
UniSOT: A Unified Framework for Multi-Modality Single Object Tracking
par: Ma, Yinchao, et autres
Publié: (2025)
par: Ma, Yinchao, et autres
Publié: (2025)
Confounder-Aware Medical Data Selection for Fine-Tuning Pretrained Vision Models
par: Ji, Anyang, et autres
Publié: (2025)
par: Ji, Anyang, et autres
Publié: (2025)
Beyond Hungarian: Match-Free Supervision for End-to-End Object Detection
par: Qiu, Shoumeng, et autres
Publié: (2026)
par: Qiu, Shoumeng, et autres
Publié: (2026)
Enhanced OoD Detection through Cross-Modal Alignment of Multi-Modal Representations
par: Kim, Jeonghyeon, et autres
Publié: (2025)
par: Kim, Jeonghyeon, et autres
Publié: (2025)
Benchmarking Foundation Models and Parameter-Efficient Fine-Tuning for Prognosis Prediction in Medical Imaging
par: Ruffini, Filippo, et autres
Publié: (2025)
par: Ruffini, Filippo, et autres
Publié: (2025)
Documents similaires
-
PEFT-DML: Parameter-Efficient Fine-Tuning Deep Metric Learning for Robust Multi-Modal 3D Object Detection in Autonomous Driving
par: Rezaei, Abdolazim, et autres
Publié: (2025) -
Low-rank Attention Side-Tuning for Parameter-Efficient Fine-Tuning
par: Tang, Ningyuan, et autres
Publié: (2024) -
Stacked Ensemble of Fine-Tuned CNNs for Knee Osteoarthritis Severity Grading
par: Gupta, Adarsh, et autres
Publié: (2025) -
Multi-Point Positional Insertion Tuning for Small Object Detection
par: Goto, Kanoko, et autres
Publié: (2024) -
Image Generation Models: A Technical History
par: Shirvani, Rouzbeh
Publié: (2026)