Pretraining Objective Matters in Extreme Low-Data FGVC: A Backbone-Controlled Study
Fuente:
arXiv
Salvato in:
| Autori principali: | Hackett, Alexander, Thudumu, Srikanth, Fisher, Ginny, Fisher, Jason |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
OpenAg: Democratizing Agricultural Intelligence
di: Thudumu, Srikanth, et al.
Pubblicazione: (2025)
di: Thudumu, Srikanth, et al.
Pubblicazione: (2025)
Overcoming Semantic Dilution in Transformer-Based Next Frame Prediction
di: Nguyen, Hy, et al.
Pubblicazione: (2025)
di: Nguyen, Hy, et al.
Pubblicazione: (2025)
CSAOT: Cooperative Multi-Agent System for Active Object Tracking
di: Nguyen, Hy, et al.
Pubblicazione: (2025)
di: Nguyen, Hy, et al.
Pubblicazione: (2025)
UniFGVC: Universal Training-Free Few-Shot Fine-Grained Vision Classification via Attribute-Aware Multimodal Retrieval
di: Guo, Hongyu, et al.
Pubblicazione: (2025)
di: Guo, Hongyu, et al.
Pubblicazione: (2025)
MAP: Unleashing Hybrid Mamba-Transformer Vision Backbone's Potential with Masked Autoregressive Pretraining
di: Liu, Yunze, et al.
Pubblicazione: (2024)
di: Liu, Yunze, et al.
Pubblicazione: (2024)
Supervised Quantum Machine Learning: A Future Outlook from Qubits to Enterprise Applications
di: Thudumu, Srikanth, et al.
Pubblicazione: (2025)
di: Thudumu, Srikanth, et al.
Pubblicazione: (2025)
Back to the Barn with LLAMAs: Evolving Pretrained LLM Backbones in Finetuning Vision Language Models
di: Horawalavithana, Sameera, et al.
Pubblicazione: (2026)
di: Horawalavithana, Sameera, et al.
Pubblicazione: (2026)
CPUBone: Efficient Vision Backbone Design for Devices with Low Parallelization Capabilities
di: Nottebaum, Moritz, et al.
Pubblicazione: (2026)
di: Nottebaum, Moritz, et al.
Pubblicazione: (2026)
Vision Backbone Efficient Selection for Image Classification in Low-Data Regimes
di: Guerin, Joris, et al.
Pubblicazione: (2024)
di: Guerin, Joris, et al.
Pubblicazione: (2024)
Generalized Large-Scale Data Condensation via Various Backbone and Statistical Matching
di: Shao, Shitong, et al.
Pubblicazione: (2023)
di: Shao, Shitong, et al.
Pubblicazione: (2023)
PictSure: Pretraining Embeddings Matters for In-Context Learning Image Classifiers
di: Schiesser, Lukas, et al.
Pubblicazione: (2025)
di: Schiesser, Lukas, et al.
Pubblicazione: (2025)
Gaussian Grouping: Segment and Edit Anything in 3D Scenes
di: Ye, Mingqiao, et al.
Pubblicazione: (2023)
di: Ye, Mingqiao, et al.
Pubblicazione: (2023)
A Survey on Backbones for Deep Video Action Recognition
di: Tang, Zixuan, et al.
Pubblicazione: (2024)
di: Tang, Zixuan, et al.
Pubblicazione: (2024)
Empowering Backbone Models for Visual Text Generation with Input Granularity Control and Glyph-Aware Training
di: Li, Wenbo, et al.
Pubblicazione: (2024)
di: Li, Wenbo, et al.
Pubblicazione: (2024)
CCUP: A Controllable Synthetic Data Generation Pipeline for Pretraining Cloth-Changing Person Re-Identification Models
di: Zhao, Yujian, et al.
Pubblicazione: (2024)
di: Zhao, Yujian, et al.
Pubblicazione: (2024)
Revisiting the Integration of Convolution and Attention for Vision Backbone
di: Zhu, Lei, et al.
Pubblicazione: (2024)
di: Zhu, Lei, et al.
Pubblicazione: (2024)
Normalization Equivariance for Arbitrary Backbones, with Application to Image Denoising
di: Saied, Youssef, et al.
Pubblicazione: (2026)
di: Saied, Youssef, et al.
Pubblicazione: (2026)
A Generic Shared Attention Mechanism for Various Backbone Neural Networks
di: Huang, Zhongzhan, et al.
Pubblicazione: (2022)
di: Huang, Zhongzhan, et al.
Pubblicazione: (2022)
ShapeShifter: 3D Variations Using Multiscale and Sparse Point-Voxel Diffusion
di: Maruani, Nissim, et al.
Pubblicazione: (2025)
di: Maruani, Nissim, et al.
Pubblicazione: (2025)
Beyond MACs: Hardware Efficient Architecture Design for Vision Backbones
di: Nottebaum, Moritz, et al.
Pubblicazione: (2026)
di: Nottebaum, Moritz, et al.
Pubblicazione: (2026)
SAFE-KD: Risk-Controlled Early-Exit Distillation for Vision Backbones
di: Khazem, Salim
Pubblicazione: (2026)
di: Khazem, Salim
Pubblicazione: (2026)
RapidNet: Multi-Level Dilated Convolution Based Mobile Backbone
di: Munir, Mustafa, et al.
Pubblicazione: (2024)
di: Munir, Mustafa, et al.
Pubblicazione: (2024)
DisBeaNet: A Deep Neural Network to augment Unmanned Surface Vessels for maritime situational awareness
di: Vemula, Srikanth, et al.
Pubblicazione: (2024)
di: Vemula, Srikanth, et al.
Pubblicazione: (2024)
MLIP: Efficient Multi-Perspective Language-Image Pretraining with Exhaustive Data Utilization
di: Zhang, Yu, et al.
Pubblicazione: (2024)
di: Zhang, Yu, et al.
Pubblicazione: (2024)
Confounder-Aware Medical Data Selection for Fine-Tuning Pretrained Vision Models
di: Ji, Anyang, et al.
Pubblicazione: (2025)
di: Ji, Anyang, et al.
Pubblicazione: (2025)
SAR Object Detection with Self-Supervised Pretraining and Curriculum-Aware Sampling
di: Almalioglu, Yasin, et al.
Pubblicazione: (2025)
di: Almalioglu, Yasin, et al.
Pubblicazione: (2025)
ENCLIP: Ensembling and Clustering-Based Contrastive Language-Image Pretraining for Fashion Multimodal Search with Limited Data and Low-Quality Images
di: Naik, Prithviraj Purushottam, et al.
Pubblicazione: (2024)
di: Naik, Prithviraj Purushottam, et al.
Pubblicazione: (2024)
3D MRI Image Pretraining via Controllable 2D Slice Navigation Task
di: Wang, Yu, et al.
Pubblicazione: (2026)
di: Wang, Yu, et al.
Pubblicazione: (2026)
Representing Beauty: Towards a Participatory but Objective Latent Aesthetics
di: Rusnak, Alexander Michael
Pubblicazione: (2025)
di: Rusnak, Alexander Michael
Pubblicazione: (2025)
Vehicle Classification under Extreme Imbalance: A Comparative Study of Ensemble Learning and CNNs
di: Syarubany, Abu Hanif Muhammad
Pubblicazione: (2025)
di: Syarubany, Abu Hanif Muhammad
Pubblicazione: (2025)
Multi-Aspect Knowledge-Enhanced Medical Vision-Language Pretraining with Multi-Agent Data Generation
di: Li, Xieji, et al.
Pubblicazione: (2025)
di: Li, Xieji, et al.
Pubblicazione: (2025)
LLaVA-MORE: A Comparative Study of LLMs and Visual Backbones for Enhanced Visual Instruction Tuning
di: Cocchi, Federico, et al.
Pubblicazione: (2025)
di: Cocchi, Federico, et al.
Pubblicazione: (2025)
MAE-Based Self-Supervised Pretraining for Data-Efficient Medical Image Segmentation Using nnFormer
di: Sureddi, R. M. Krishna, et al.
Pubblicazione: (2026)
di: Sureddi, R. M. Krishna, et al.
Pubblicazione: (2026)
Strategic Preys Make Acute Predators: Enhancing Camouflaged Object Detectors by Generating Camouflaged Objects
di: He, Chunming, et al.
Pubblicazione: (2023)
di: He, Chunming, et al.
Pubblicazione: (2023)
BabyVLM: Data-Efficient Pretraining of VLMs Inspired by Infant Learning
di: Wang, Shengao, et al.
Pubblicazione: (2025)
di: Wang, Shengao, et al.
Pubblicazione: (2025)
Precise, Fast, and Low-cost Concept Erasure in Value Space: Orthogonal Complement Matters
di: Wang, Yuan, et al.
Pubblicazione: (2024)
di: Wang, Yuan, et al.
Pubblicazione: (2024)
MISS: A Generative Pretraining and Finetuning Approach for Med-VQA
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
On Pretraining Data Diversity for Self-Supervised Learning
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2024)
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2024)
Mapping License Plate Recoverability Under Extreme Viewing Angles for Oppor-tunistic Urban Sensing
di: Adamenko, Igor, et al.
Pubblicazione: (2026)
di: Adamenko, Igor, et al.
Pubblicazione: (2026)
Separators in Enhancing Autoregressive Pretraining for Vision Mamba
di: Liu, Hanpeng, et al.
Pubblicazione: (2026)
di: Liu, Hanpeng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
OpenAg: Democratizing Agricultural Intelligence
di: Thudumu, Srikanth, et al.
Pubblicazione: (2025) -
Overcoming Semantic Dilution in Transformer-Based Next Frame Prediction
di: Nguyen, Hy, et al.
Pubblicazione: (2025) -
CSAOT: Cooperative Multi-Agent System for Active Object Tracking
di: Nguyen, Hy, et al.
Pubblicazione: (2025) -
UniFGVC: Universal Training-Free Few-Shot Fine-Grained Vision Classification via Attribute-Aware Multimodal Retrieval
di: Guo, Hongyu, et al.
Pubblicazione: (2025) -
MAP: Unleashing Hybrid Mamba-Transformer Vision Backbone's Potential with Masked Autoregressive Pretraining
di: Liu, Yunze, et al.
Pubblicazione: (2024)