Foundation Model Insights and a Multi-Model Approach for Superior Fine-Grained One-shot Subset Selection
Fuente:
arXiv
Guardado en:
| Autores principales: | Wan, Zhijing, Wang, Zhixiang, Wang, Zheng, Xu, Xin, Satoh, Shin'ichi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Contributing Dimension Structure of Deep Feature for Coreset Selection
por: Wan, Zhijing, et al.
Publicado: (2024)
por: Wan, Zhijing, et al.
Publicado: (2024)
ReSeDis: A Dataset for Referring-based Object Search across Large-Scale Image Collections
por: Huang, Ziling, et al.
Publicado: (2025)
por: Huang, Ziling, et al.
Publicado: (2025)
Matting by Generation
por: Wang, Zhixiang, et al.
Publicado: (2024)
por: Wang, Zhixiang, et al.
Publicado: (2024)
The Effects of Short Video-Sharing Services on Video Copy Detection
por: Yanagi, Rintaro, et al.
Publicado: (2024)
por: Yanagi, Rintaro, et al.
Publicado: (2024)
Physical Adversarial Attack meets Computer Vision: A Decade Survey
por: Wei, Hui, et al.
Publicado: (2022)
por: Wei, Hui, et al.
Publicado: (2022)
TransRef: Multi-Scale Reference Embedding Transformer for Reference-Guided Image Inpainting
por: Liu, Taorong, et al.
Publicado: (2023)
por: Liu, Taorong, et al.
Publicado: (2023)
Probabilistic Online Event Downsampling
por: Girbau-Xalabarder, Andreu, et al.
Publicado: (2025)
por: Girbau-Xalabarder, Andreu, et al.
Publicado: (2025)
Stronger, Fewer, & Superior: Harnessing Vision Foundation Models for Domain Generalized Semantic Segmentation
por: Wei, Zhixiang, et al.
Publicado: (2023)
por: Wei, Zhixiang, et al.
Publicado: (2023)
Fairness Without Labels: Pseudo-Balancing for Bias Mitigation in Face Gender Classification
por: Dong, Haohua, et al.
Publicado: (2025)
por: Dong, Haohua, et al.
Publicado: (2025)
Did Models Sufficient Learn? Attribution-Guided Training via Subset-Selected Counterfactual Augmentation
por: Chen, Yannan, et al.
Publicado: (2025)
por: Chen, Yannan, et al.
Publicado: (2025)
Seed Optimization with Frozen Generator for Superior Zero-shot Low-light Enhancement
por: Gu, Yuxuan, et al.
Publicado: (2024)
por: Gu, Yuxuan, et al.
Publicado: (2024)
Advancing Fine-Grained Visual Understanding with Multi-Scale Alignment in Multi-Modal Models
por: Wang, Wei, et al.
Publicado: (2024)
por: Wang, Wei, et al.
Publicado: (2024)
Certified Zeroth-order Black-Box Defense with Robust UNet Denoiser
por: Verma, Astha, et al.
Publicado: (2023)
por: Verma, Astha, et al.
Publicado: (2023)
Diverse and Tailored Image Generation for Zero-shot Multi-label Classification
por: Zhang, Kaixin, et al.
Publicado: (2024)
por: Zhang, Kaixin, et al.
Publicado: (2024)
Boosting Pathology Foundation Models via Few-shot Prompt-tuning for Rare Cancer Subtyping
por: He, Dexuan, et al.
Publicado: (2025)
por: He, Dexuan, et al.
Publicado: (2025)
Fine-Grained Erasure in Text-to-Image Diffusion-based Foundation Models
por: Thakral, Kartik, et al.
Publicado: (2025)
por: Thakral, Kartik, et al.
Publicado: (2025)
Uplifting Table Tennis: A Robust, Real-World Application for 3D Trajectory and Spin Estimation
por: Kienzle, Daniel, et al.
Publicado: (2025)
por: Kienzle, Daniel, et al.
Publicado: (2025)
Few-shot Adaptation of Multi-modal Foundation Models: A Survey
por: Liu, Fan, et al.
Publicado: (2024)
por: Liu, Fan, et al.
Publicado: (2024)
Data Adaptive Few-shot Multi Label Segmentation with Foundation Model
por: Reddy, Gurunath, et al.
Publicado: (2024)
por: Reddy, Gurunath, et al.
Publicado: (2024)
Modeling Multi-modal Cross-interaction for Multi-label Few-shot Image Classification Based on Local Feature Selection
por: Yan, Kun, et al.
Publicado: (2024)
por: Yan, Kun, et al.
Publicado: (2024)
FILA: Fine-Grained Vision Language Models
por: Zhu, Shiding, et al.
Publicado: (2024)
por: Zhu, Shiding, et al.
Publicado: (2024)
Devil is in Details: Locality-Aware 3D Abdominal CT Volume Generation for Self-Supervised Organ Segmentation
por: Wang, Yuran, et al.
Publicado: (2024)
por: Wang, Yuran, et al.
Publicado: (2024)
Probing Fine-Grained Action Understanding and Cross-View Generalization of Foundation Models
por: Ponbagavathi, Thinesh Thiyakesan, et al.
Publicado: (2024)
por: Ponbagavathi, Thinesh Thiyakesan, et al.
Publicado: (2024)
TC-OCR: TableCraft OCR for Efficient Detection & Recognition of Table Structure & Content
por: Anand, Avinash, et al.
Publicado: (2024)
por: Anand, Avinash, et al.
Publicado: (2024)
Unbiased Semantic Decoding with Vision Foundation Models for Few-shot Segmentation
por: Wang, Jin, et al.
Publicado: (2025)
por: Wang, Jin, et al.
Publicado: (2025)
FullDiT: Multi-Task Video Generative Foundation Model with Full Attention
por: Ju, Xuan, et al.
Publicado: (2025)
por: Ju, Xuan, et al.
Publicado: (2025)
Focal-RegionFace: Generating Fine-Grained Multi-attribute Descriptions for Arbitrarily Selected Face Focal Regions
por: Zheng, Kaiwen, et al.
Publicado: (2026)
por: Zheng, Kaiwen, et al.
Publicado: (2026)
SGIA: Enhancing Fine-Grained Visual Classification with Sequence Generative Image Augmentation
por: Liao, Qiyu, et al.
Publicado: (2024)
por: Liao, Qiyu, et al.
Publicado: (2024)
KaoLRM: Repurposing Pre-trained Large Reconstruction Models for Parametric 3D Face Reconstruction
por: Zhu, Qingtian, et al.
Publicado: (2026)
por: Zhu, Qingtian, et al.
Publicado: (2026)
StarFT: Robust Fine-tuning of Zero-shot Models via Spuriosity Alignment
por: Kim, Younghyun, et al.
Publicado: (2025)
por: Kim, Younghyun, et al.
Publicado: (2025)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
por: Lan, Long, et al.
Publicado: (2024)
por: Lan, Long, et al.
Publicado: (2024)
LAM: Large Avatar Model for One-shot Animatable Gaussian Head
por: He, Yisheng, et al.
Publicado: (2025)
por: He, Yisheng, et al.
Publicado: (2025)
FashionMAC: Deformation-Free Fashion Image Generation with Fine-Grained Model Appearance Customization
por: Zhang, Rong, et al.
Publicado: (2025)
por: Zhang, Rong, et al.
Publicado: (2025)
Modeling Fine-Grained Hand-Object Dynamics for Egocentric Video Representation Learning
por: Pei, Baoqi, et al.
Publicado: (2025)
por: Pei, Baoqi, et al.
Publicado: (2025)
XR-VLM: Cross-Relationship Modeling with Multi-part Prompts and Visual Features for Fine-Grained Recognition
por: Wang, Chuanming, et al.
Publicado: (2025)
por: Wang, Chuanming, et al.
Publicado: (2025)
One for All: Toward Unified Foundation Models for Earth Vision
por: Xiong, Zhitong, et al.
Publicado: (2024)
por: Xiong, Zhitong, et al.
Publicado: (2024)
DemosaicFormer: Coarse-to-Fine Demosaicing Network for HybridEVS Camera
por: Xu, Senyan, et al.
Publicado: (2024)
por: Xu, Senyan, et al.
Publicado: (2024)
An Adapter-free Fine-tuning Approach for Tuning 3D Foundation Models
por: Paul, Sneha, et al.
Publicado: (2026)
por: Paul, Sneha, et al.
Publicado: (2026)
Rein++: Efficient Generalization and Adaptation for Semantic Segmentation with Vision Foundation Models
por: Wei, Zhixiang, et al.
Publicado: (2025)
por: Wei, Zhixiang, et al.
Publicado: (2025)
Accurate Forgetting for All-in-One Image Restoration Model
por: Su, Xin, et al.
Publicado: (2024)
por: Su, Xin, et al.
Publicado: (2024)
Ejemplares similares
-
Contributing Dimension Structure of Deep Feature for Coreset Selection
por: Wan, Zhijing, et al.
Publicado: (2024) -
ReSeDis: A Dataset for Referring-based Object Search across Large-Scale Image Collections
por: Huang, Ziling, et al.
Publicado: (2025) -
Matting by Generation
por: Wang, Zhixiang, et al.
Publicado: (2024) -
The Effects of Short Video-Sharing Services on Video Copy Detection
por: Yanagi, Rintaro, et al.
Publicado: (2024) -
Physical Adversarial Attack meets Computer Vision: A Decade Survey
por: Wei, Hui, et al.
Publicado: (2022)