Lightweight Model Pre-training via Language Guided Knowledge Distillation
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Mingsheng, Zhang, Lin, Zhu, Mingzhen, Huang, Zilong, Yu, Gang, Fan, Jiayuan, Chen, Tao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Can LLM-Generated Text Empower Surgical Vision-Language Pre-training?
por: Che, Chengan, et al.
Publicado: (2026)
por: Che, Chengan, et al.
Publicado: (2026)
CLIPose: Category-Level Object Pose Estimation with Pre-trained Vision-Language Knowledge
por: Lin, Xiao, et al.
Publicado: (2024)
por: Lin, Xiao, et al.
Publicado: (2024)
Compressing Multi-Task Model for Autonomous Driving via Pruning and Knowledge Distillation
por: Wang, Jiayuan, et al.
Publicado: (2025)
por: Wang, Jiayuan, et al.
Publicado: (2025)
Let ViT Speak: Generative Language-Image Pre-training
por: Fang, Yan, et al.
Publicado: (2026)
por: Fang, Yan, et al.
Publicado: (2026)
Flow Distillation Sampling: Regularizing 3D Gaussians with Pre-trained Matching Priors
por: Chen, Lin-Zhuo, et al.
Publicado: (2025)
por: Chen, Lin-Zhuo, et al.
Publicado: (2025)
VILA: On Pre-training for Visual Language Models
por: Lin, Ji, et al.
Publicado: (2023)
por: Lin, Ji, et al.
Publicado: (2023)
Knowledge Distillation via the Target-aware Transformer
por: Lin, Sihao, et al.
Publicado: (2022)
por: Lin, Sihao, et al.
Publicado: (2022)
Improving Lightweight Weed Detection via Knowledge Distillation
por: Saltık, Ahmet Oğuz, et al.
Publicado: (2025)
por: Saltık, Ahmet Oğuz, et al.
Publicado: (2025)
Efficient Face Image Quality Assessment via Self-training and Knowledge Distillation
por: Sun, Wei, et al.
Publicado: (2025)
por: Sun, Wei, et al.
Publicado: (2025)
Classification Done Right for Vision-Language Pre-Training
por: Huang, Zilong, et al.
Publicado: (2024)
por: Huang, Zilong, et al.
Publicado: (2024)
Student-Oriented Teacher Knowledge Refinement for Knowledge Distillation
por: Shen, Chaomin, et al.
Publicado: (2024)
por: Shen, Chaomin, et al.
Publicado: (2024)
FreeKD: Knowledge Distillation via Semantic Frequency Prompt
por: Zhang, Yuan, et al.
Publicado: (2023)
por: Zhang, Yuan, et al.
Publicado: (2023)
FedBM: Stealing Knowledge from Pre-trained Language Models for Heterogeneous Federated Learning
por: Zhu, Meilu, et al.
Publicado: (2025)
por: Zhu, Meilu, et al.
Publicado: (2025)
Continual Forgetting for Pre-trained Vision Models
por: Zhao, Hongbo, et al.
Publicado: (2024)
por: Zhao, Hongbo, et al.
Publicado: (2024)
Teacher-Guided Student Self-Knowledge Distillation Using Diffusion Model
por: Wang, Yu, et al.
Publicado: (2026)
por: Wang, Yu, et al.
Publicado: (2026)
CoMP: Continual Multimodal Pre-training for Vision Foundation Models
por: Chen, Yitong, et al.
Publicado: (2025)
por: Chen, Yitong, et al.
Publicado: (2025)
$Δ$VLA: Prior-Guided Vision-Language-Action Models via World Knowledge Variation
por: Zhu, Yijie, et al.
Publicado: (2026)
por: Zhu, Yijie, et al.
Publicado: (2026)
ComKD-CLIP: Comprehensive Knowledge Distillation for Contrastive Language-Image Pre-traning Model
por: Chen, Yifan, et al.
Publicado: (2024)
por: Chen, Yifan, et al.
Publicado: (2024)
Retaining and Enhancing Pre-trained Knowledge in Vision-Language Models with Prompt Ensembling
por: Kim, Donggeun, et al.
Publicado: (2024)
por: Kim, Donggeun, et al.
Publicado: (2024)
Generic Knowledge Boosted Pre-training For Remote Sensing Images
por: Huang, Ziyue, et al.
Publicado: (2024)
por: Huang, Ziyue, et al.
Publicado: (2024)
Domain Guidance: A Simple Transfer Approach for a Pre-trained Diffusion Model
por: Zhong, Jincheng, et al.
Publicado: (2025)
por: Zhong, Jincheng, et al.
Publicado: (2025)
Exploring Pre-trained Text-to-Video Diffusion Models for Referring Video Object Segmentation
por: Zhu, Zixin, et al.
Publicado: (2024)
por: Zhu, Zixin, et al.
Publicado: (2024)
Exploiting the Semantic Knowledge of Pre-trained Text-Encoders for Continual Learning
por: Yu, Lu, et al.
Publicado: (2024)
por: Yu, Lu, et al.
Publicado: (2024)
SG-MIM: Structured Knowledge Guided Efficient Pre-training for Dense Prediction
por: Son, Sumin, et al.
Publicado: (2024)
por: Son, Sumin, et al.
Publicado: (2024)
MAA: Meticulous Adversarial Attack against Vision-Language Pre-trained Models
por: Zhang, Peng-Fei, et al.
Publicado: (2025)
por: Zhang, Peng-Fei, et al.
Publicado: (2025)
Understanding the Multi-modal Prompts of the Pre-trained Vision-Language Model
por: Ma, Shuailei, et al.
Publicado: (2023)
por: Ma, Shuailei, et al.
Publicado: (2023)
Flow Augmentation and Knowledge Distillation for Lightweight Face Presentation Attack Detection
por: Jabbar, Muhammad Shahid, et al.
Publicado: (2026)
por: Jabbar, Muhammad Shahid, et al.
Publicado: (2026)
SDPose: Tokenized Pose Estimation via Circulation-Guide Self-Distillation
por: Chen, Sichen, et al.
Publicado: (2024)
por: Chen, Sichen, et al.
Publicado: (2024)
DreamLIP: Language-Image Pre-training with Long Captions
por: Zheng, Kecheng, et al.
Publicado: (2024)
por: Zheng, Kecheng, et al.
Publicado: (2024)
Efficient and Effective Universal Adversarial Attack against Vision-Language Pre-training Models
por: Yang, Fan, et al.
Publicado: (2024)
por: Yang, Fan, et al.
Publicado: (2024)
Multi-Resolution Pathology-Language Pre-training Model with Text-Guided Visual Representation
por: Albastaki, Shahad, et al.
Publicado: (2025)
por: Albastaki, Shahad, et al.
Publicado: (2025)
NEVLP: Noise-Robust Framework for Efficient Vision-Language Pre-training
por: Tao, Yiyi, et al.
Publicado: (2024)
por: Tao, Yiyi, et al.
Publicado: (2024)
IRBridge: Solving Image Restoration Bridge with Pre-trained Generative Diffusion Models
por: Wang, Hanting, et al.
Publicado: (2025)
por: Wang, Hanting, et al.
Publicado: (2025)
MS-Mix: Sentiment-Guided Adaptive Augmentation for Multimodal Sentiment Analysis
por: Zhu, Hongyu, et al.
Publicado: (2025)
por: Zhu, Hongyu, et al.
Publicado: (2025)
Rethinking UMM Visual Generation: Masked Modeling for Efficient Image-Only Pre-training
por: Sun, Peng, et al.
Publicado: (2026)
por: Sun, Peng, et al.
Publicado: (2026)
AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
por: Yang, Biao, et al.
Publicado: (2025)
por: Yang, Biao, et al.
Publicado: (2025)
Grounded Knowledge-Enhanced Medical Vision-Language Pre-training for Chest X-Ray
por: Deng, Qiao, et al.
Publicado: (2024)
por: Deng, Qiao, et al.
Publicado: (2024)
Anatomical Structure-Guided Medical Vision-Language Pre-training
por: Li, Qingqiu, et al.
Publicado: (2024)
por: Li, Qingqiu, et al.
Publicado: (2024)
Switch-KD: Visual-Switch Knowledge Distillation for Vision-Language Models
por: Sun, Haoyi, et al.
Publicado: (2026)
por: Sun, Haoyi, et al.
Publicado: (2026)
UNIFORM: Unifying Knowledge from Large-scale and Diverse Pre-trained Models
por: Wang, Yimu, et al.
Publicado: (2025)
por: Wang, Yimu, et al.
Publicado: (2025)
Ejemplares similares
-
Can LLM-Generated Text Empower Surgical Vision-Language Pre-training?
por: Che, Chengan, et al.
Publicado: (2026) -
CLIPose: Category-Level Object Pose Estimation with Pre-trained Vision-Language Knowledge
por: Lin, Xiao, et al.
Publicado: (2024) -
Compressing Multi-Task Model for Autonomous Driving via Pruning and Knowledge Distillation
por: Wang, Jiayuan, et al.
Publicado: (2025) -
Let ViT Speak: Generative Language-Image Pre-training
por: Fang, Yan, et al.
Publicado: (2026) -
Flow Distillation Sampling: Regularizing 3D Gaussians with Pre-trained Matching Priors
por: Chen, Lin-Zhuo, et al.
Publicado: (2025)