Convolutional Networks as Extremely Small Foundation Models: Visual Prompting and Theoretical Perspective
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Wangni, Jianqiao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GPT Carry-On: Training Foundation Model for Customization Could Be Simple, Scalable and Affordable
par: Wangni, Jianqiao
Publié: (2025)
par: Wangni, Jianqiao
Publié: (2025)
Convolutional Initialization for Data-Efficient Vision Transformers
par: Zheng, Jianqiao, et autres
Publié: (2024)
par: Zheng, Jianqiao, et autres
Publié: (2024)
Language Models and Cycle Consistency for Self-Reflective Machine Translation
par: Wangni, Jianqiao
Publié: (2024)
par: Wangni, Jianqiao
Publié: (2024)
Visual Prompting Upgrades Neural Network Sparsification: A Data-Model Perspective
par: Jin, Can, et autres
Publié: (2023)
par: Jin, Can, et autres
Publié: (2023)
Sampling Foundational Transformer: A Theoretical Perspective
par: Nguyen, Viet Anh, et autres
Publié: (2024)
par: Nguyen, Viet Anh, et autres
Publié: (2024)
Multi-Scale Visual Prompting for Lightweight Small-Image Classification
par: Khazem, Salim
Publié: (2025)
par: Khazem, Salim
Publié: (2025)
Convolutional Prompting meets Language Models for Continual Learning
par: Roy, Anurag, et autres
Publié: (2024)
par: Roy, Anurag, et autres
Publié: (2024)
Robust Adaptation of Foundation Models with Black-Box Visual Prompting
par: Oh, Changdae, et autres
Publié: (2024)
par: Oh, Changdae, et autres
Publié: (2024)
Accelerating Vision Foundation Models with Drop-in Depthwise Convolution
par: Scribano, Carmelo, et autres
Publié: (2026)
par: Scribano, Carmelo, et autres
Publié: (2026)
Feature Visualization in 3D Convolutional Neural Networks
par: Li, Chunpeng, et autres
Publié: (2025)
par: Li, Chunpeng, et autres
Publié: (2025)
Emergent Extreme-View Geometry in 3D Foundation Models
par: Zhang, Yiwen, et autres
Publié: (2025)
par: Zhang, Yiwen, et autres
Publié: (2025)
Trading Positional Complexity vs. Deepness in Coordinate Networks
par: Zheng, Jianqiao, et autres
Publié: (2022)
par: Zheng, Jianqiao, et autres
Publié: (2022)
RRCANet: Recurrent Reusable-Convolution Attention Network for Infrared Small Target Detection
par: Liu, Yongxian, et autres
Publié: (2025)
par: Liu, Yongxian, et autres
Publié: (2025)
A Taxonomy and Library for Visualizing Learned Features in Convolutional Neural Networks
par: Grün, Felix, et autres
Publié: (2016)
par: Grün, Felix, et autres
Publié: (2016)
Evaluating Pre-trained Convolutional Neural Networks and Foundation Models as Feature Extractors for Content-based Medical Image Retrieval
par: Mahbod, Amirreza, et autres
Publié: (2024)
par: Mahbod, Amirreza, et autres
Publié: (2024)
SUNY: A Visual Interpretation Framework for Convolutional Neural Networks from a Necessary and Sufficient Perspective
par: Xuan, Xiwei, et autres
Publié: (2023)
par: Xuan, Xiwei, et autres
Publié: (2023)
Foundation Cures Personalization: Improving Personalized Models' Prompt Consistency via Hidden Foundation Knowledge
par: Cai, Yiyang, et autres
Publié: (2024)
par: Cai, Yiyang, et autres
Publié: (2024)
Convolutional Prompting for Broad-Domain Retinal Vessel Segmentation
par: Wei, Qijie, et autres
Publié: (2024)
par: Wei, Qijie, et autres
Publié: (2024)
Asymmetric Masked Distillation for Pre-Training Small Foundation Models
par: Zhao, Zhiyu, et autres
Publié: (2023)
par: Zhao, Zhiyu, et autres
Publié: (2023)
Audio-Visual Intelligence in Large Foundation Models
par: Qin, You, et autres
Publié: (2026)
par: Qin, You, et autres
Publié: (2026)
Attention Lattice Adapter: Visual Explanation Generation for Visual Foundation Model
par: Hirano, Shinnosuke, et autres
Publié: (2025)
par: Hirano, Shinnosuke, et autres
Publié: (2025)
Detection of Virus and Small Cell Patches in Foci Images Using Switchable Convolution and Feature Pyramid Networks
par: Singh, Amrita, et autres
Publié: (2026)
par: Singh, Amrita, et autres
Publié: (2026)
InfoSyncNet: Information Synchronization Temporal Convolutional Network for Visual Speech Recognition
par: Xue, Junxiao, et autres
Publié: (2025)
par: Xue, Junxiao, et autres
Publié: (2025)
BAPLe: Backdoor Attacks on Medical Foundational Models using Prompt Learning
par: Hanif, Asif, et autres
Publié: (2024)
par: Hanif, Asif, et autres
Publié: (2024)
Visual Prompt Engineering for Vision Language Models in Radiology
par: Denner, Stefan, et autres
Publié: (2024)
par: Denner, Stefan, et autres
Publié: (2024)
PF3Det: A Prompted Foundation Feature Assisted Visual LiDAR 3D Detector
par: Li, Kaidong, et autres
Publié: (2025)
par: Li, Kaidong, et autres
Publié: (2025)
Defective Convolutional Networks
par: Luo, Tiange, et autres
Publié: (2019)
par: Luo, Tiange, et autres
Publié: (2019)
XS-VID: An Extremely Small Video Object Detection Dataset
par: Guo, Jiahao, et autres
Publié: (2024)
par: Guo, Jiahao, et autres
Publié: (2024)
Structured Initialization for Attention in Vision Transformers
par: Zheng, Jianqiao, et autres
Publié: (2024)
par: Zheng, Jianqiao, et autres
Publié: (2024)
Probing the 3D Awareness of Visual Foundation Models
par: Banani, Mohamed El, et autres
Publié: (2024)
par: Banani, Mohamed El, et autres
Publié: (2024)
Visual Instruction Pretraining for Domain-Specific Foundation Models
par: Li, Yuxuan, et autres
Publié: (2025)
par: Li, Yuxuan, et autres
Publié: (2025)
ARFC-WAHNet: Adaptive Receptive Field Convolution and Wavelet-Attentive Hierarchical Network for Infrared Small Target Detection
par: Cui, Xingye, et autres
Publié: (2025)
par: Cui, Xingye, et autres
Publié: (2025)
Efficient Higher-order Convolution for Small Kernels in Deep Learning
par: Wen, Zuocheng, et autres
Publié: (2024)
par: Wen, Zuocheng, et autres
Publié: (2024)
$ShiftwiseConv:$ Small Convolutional Kernel with Large Kernel Effect
par: Li, Dachong, et autres
Publié: (2024)
par: Li, Dachong, et autres
Publié: (2024)
Dynamic High-frequency Convolution for Infrared Small Target Detection
par: Li, Ruojing, et autres
Publié: (2026)
par: Li, Ruojing, et autres
Publié: (2026)
A Foundation Model for DAS Signal Recognition and Visual Prompt Tuning of the Pre-trained Model for Downstream Tasks
par: Gui, Kun, et autres
Publié: (2025)
par: Gui, Kun, et autres
Publié: (2025)
Anatomy-Aware Text-Visual Fusion with Dual-Perspective Prompts for Fine-Grained Lumbar Spine Segmentation
par: Lian, Sheng, et autres
Publié: (2025)
par: Lian, Sheng, et autres
Publié: (2025)
Explicit Visual Prompts for Visual Object Tracking
par: Shi, Liangtao, et autres
Publié: (2024)
par: Shi, Liangtao, et autres
Publié: (2024)
Token Coordinated Prompt Attention is Needed for Visual Prompting
par: Liu, Zichen, et autres
Publié: (2025)
par: Liu, Zichen, et autres
Publié: (2025)
AdaFusion: Prompt-Guided Inference with Adaptive Fusion of Pathology Foundation Models
par: Xiao, Yuxiang, et autres
Publié: (2025)
par: Xiao, Yuxiang, et autres
Publié: (2025)
Documents similaires
-
GPT Carry-On: Training Foundation Model for Customization Could Be Simple, Scalable and Affordable
par: Wangni, Jianqiao
Publié: (2025) -
Convolutional Initialization for Data-Efficient Vision Transformers
par: Zheng, Jianqiao, et autres
Publié: (2024) -
Language Models and Cycle Consistency for Self-Reflective Machine Translation
par: Wangni, Jianqiao
Publié: (2024) -
Visual Prompting Upgrades Neural Network Sparsification: A Data-Model Perspective
par: Jin, Can, et autres
Publié: (2023) -
Sampling Foundational Transformer: A Theoretical Perspective
par: Nguyen, Viet Anh, et autres
Publié: (2024)