Knowledge Distillation via the Target-aware Transformer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Sihao, Xie, Hongwei, Wang, Bing, Yu, Kaicheng, Chang, Xiaojun, Liang, Xiaodan, Wang, Gang |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MLP Can Be A Good Transformer Learner
par: Lin, Sihao, et autres
Publié: (2024)
par: Lin, Sihao, et autres
Publié: (2024)
Learning A Zero-shot Occupancy Network from Vision Foundation Models via Self-supervised Adaptation
par: Lin, Sihao, et autres
Publié: (2025)
par: Lin, Sihao, et autres
Publié: (2025)
Efficient Training of Large Vision Models via Advanced Automated Progressive Learning
par: Li, Changlin, et autres
Publié: (2024)
par: Li, Changlin, et autres
Publié: (2024)
KD-DETR: Knowledge Distillation for Detection Transformer with Consistent Distillation Points Sampling
par: Wang, Yu, et autres
Publié: (2022)
par: Wang, Yu, et autres
Publié: (2022)
MiLA: Multi-view Intensive-fidelity Long-term Video Generation World Model for Autonomous Driving
par: Wang, Haiguang, et autres
Publié: (2025)
par: Wang, Haiguang, et autres
Publié: (2025)
Optimizing Knowledge Distillation in Transformers: Enabling Multi-Head Attention without Alignment Barriers
par: Bing, Zhaodong, et autres
Publié: (2025)
par: Bing, Zhaodong, et autres
Publié: (2025)
Predicting Genetic Mutation from Whole Slide Images via Biomedical-Linguistic Knowledge Enhanced Multi-label Classification
par: Huang, Gexin, et autres
Publié: (2024)
par: Huang, Gexin, et autres
Publié: (2024)
Self-Supervised Multi-Frame Neural Scene Flow
par: Liu, Dongrui, et autres
Publié: (2024)
par: Liu, Dongrui, et autres
Publié: (2024)
AlignMiF: Geometry-Aligned Multimodal Implicit Field for LiDAR-Camera Joint Synthesis
par: Tang, Tao, et autres
Publié: (2024)
par: Tang, Tao, et autres
Publié: (2024)
Knowledge Distillation via Query Selection for Detection Transformer
par: Liu, Yi, et autres
Publié: (2024)
par: Liu, Yi, et autres
Publié: (2024)
Lightweight Model Pre-training via Language Guided Knowledge Distillation
par: Li, Mingsheng, et autres
Publié: (2024)
par: Li, Mingsheng, et autres
Publié: (2024)
Teaching with Uncertainty: Unleashing the Potential of Knowledge Distillation in Object Detection
par: Yi, Junfei, et autres
Publié: (2024)
par: Yi, Junfei, et autres
Publié: (2024)
Ground-R1: Incentivizing Grounded Visual Reasoning via Reinforcement Learning
par: Cao, Meng, et autres
Publié: (2025)
par: Cao, Meng, et autres
Publié: (2025)
DNA Family: Boosting Weight-Sharing NAS with Block-Wise Supervisions
par: Wang, Guangrun, et autres
Publié: (2024)
par: Wang, Guangrun, et autres
Publié: (2024)
Making Large Language Models Better Planners with Reasoning-Decision Alignment
par: Huang, Zhijian, et autres
Publié: (2024)
par: Huang, Zhijian, et autres
Publié: (2024)
Target-aware Bidirectional Fusion Transformer for Aerial Object Tracking
par: Sun, Xinglong, et autres
Publié: (2025)
par: Sun, Xinglong, et autres
Publié: (2025)
Temporal Separation with Entropy Regularization for Knowledge Distillation in Spiking Neural Networks
par: Yu, Kairong, et autres
Publié: (2025)
par: Yu, Kairong, et autres
Publié: (2025)
Contrastive Learning with Counterfactual Explanations for Radiology Report Generation
par: Li, Mingjie, et autres
Publié: (2024)
par: Li, Mingjie, et autres
Publié: (2024)
TransMamba: Fast Universal Architecture Adaption from Transformers to Mamba
par: Chen, Xiuwei, et autres
Publié: (2025)
par: Chen, Xiuwei, et autres
Publié: (2025)
3D Visibility-aware Generalizable Neural Radiance Fields for Interacting Hands
par: Huang, Xuan, et autres
Publié: (2024)
par: Huang, Xuan, et autres
Publié: (2024)
Target-aware Image Editing via Cycle-consistent Constraints
par: Wang, Yanghao, et autres
Publié: (2025)
par: Wang, Yanghao, et autres
Publié: (2025)
Infrared UAV Target Tracking with Dynamic Feature Refinement and Global Contextual Attention Knowledge Distillation
par: Fang, Houzhang, et autres
Publié: (2025)
par: Fang, Houzhang, et autres
Publié: (2025)
Suppressing Prior-Comparison Hallucinations in Radiology Report Generation via Semantically Decoupled Latent Steering
par: Li, Ao, et autres
Publié: (2026)
par: Li, Ao, et autres
Publié: (2026)
Robust MLLM Unlearning via Visual Knowledge Distillation
par: Wang, Yuhang, et autres
Publié: (2025)
par: Wang, Yuhang, et autres
Publié: (2025)
Sitcom-Crafter: A Plot-Driven Human Motion Generation System in 3D Scenes
par: Chen, Jianqi, et autres
Publié: (2024)
par: Chen, Jianqi, et autres
Publié: (2024)
Learning with Semantic Priors: Stabilizing Point-Supervised Infrared Small Target Detection via Hierarchical Knowledge Distillation
par: Yao, Yuanhang, et autres
Publié: (2026)
par: Yao, Yuanhang, et autres
Publié: (2026)
VRM: Knowledge Distillation via Virtual Relation Matching
par: Zhang, Weijia, et autres
Publié: (2025)
par: Zhang, Weijia, et autres
Publié: (2025)
BEVLM: Distilling Semantic Knowledge from LLMs into Bird's-Eye View Representations
par: Monninger, Thomas, et autres
Publié: (2026)
par: Monninger, Thomas, et autres
Publié: (2026)
Rethinking Knowledge in Distillation: An In-context Sample Retrieval Perspective
par: Zhu, Jinjing, et autres
Publié: (2025)
par: Zhu, Jinjing, et autres
Publié: (2025)
SAMKD: Spatial-aware Adaptive Masking Knowledge Distillation for Object Detection
par: Zhang, Zhourui, et autres
Publié: (2025)
par: Zhang, Zhourui, et autres
Publié: (2025)
CLoCKDistill: Consistent Location-and-Context-aware Knowledge Distillation for DETRs
par: Lan, Qizhen, et autres
Publié: (2025)
par: Lan, Qizhen, et autres
Publié: (2025)
360$^\circ$ High-Resolution Depth Estimation via Uncertainty-aware Structural Knowledge Transfer
par: Cao, Zidong, et autres
Publié: (2023)
par: Cao, Zidong, et autres
Publié: (2023)
Structure-Centric Robust Monocular Depth Estimation via Knowledge Distillation
par: Chen, Runze, et autres
Publié: (2024)
par: Chen, Runze, et autres
Publié: (2024)
Target-Driven Distillation: Consistency Distillation with Target Timestep Selection and Decoupled Guidance
par: Wang, Cunzheng, et autres
Publié: (2024)
par: Wang, Cunzheng, et autres
Publié: (2024)
CLIP-CID: Efficient CLIP Distillation via Cluster-Instance Discrimination
par: Yang, Kaicheng, et autres
Publié: (2024)
par: Yang, Kaicheng, et autres
Publié: (2024)
VideoDistill: Language-aware Vision Distillation for Video Question Answering
par: Zou, Bo, et autres
Publié: (2024)
par: Zou, Bo, et autres
Publié: (2024)
Enhancing Adaptive Deep Networks for Image Classification via Uncertainty-aware Decision Fusion
par: Zhang, Xu, et autres
Publié: (2024)
par: Zhang, Xu, et autres
Publié: (2024)
SRKD: Towards Efficient 3D Point Cloud Segmentation via Structure- and Relation-aware Knowledge Distillation
par: Li, Yuqi, et autres
Publié: (2025)
par: Li, Yuqi, et autres
Publié: (2025)
Improving Facial Landmark Detection Accuracy and Efficiency with Knowledge Distillation
par: Hong, Zong-Wei, et autres
Publié: (2024)
par: Hong, Zong-Wei, et autres
Publié: (2024)
A Transformer-in-Transformer Network Utilizing Knowledge Distillation for Image Recognition
par: Rahman, Dewan Tauhid, et autres
Publié: (2025)
par: Rahman, Dewan Tauhid, et autres
Publié: (2025)
Documents similaires
-
MLP Can Be A Good Transformer Learner
par: Lin, Sihao, et autres
Publié: (2024) -
Learning A Zero-shot Occupancy Network from Vision Foundation Models via Self-supervised Adaptation
par: Lin, Sihao, et autres
Publié: (2025) -
Efficient Training of Large Vision Models via Advanced Automated Progressive Learning
par: Li, Changlin, et autres
Publié: (2024) -
KD-DETR: Knowledge Distillation for Detection Transformer with Consistent Distillation Points Sampling
par: Wang, Yu, et autres
Publié: (2022) -
MiLA: Multi-view Intensive-fidelity Long-term Video Generation World Model for Autonomous Driving
par: Wang, Haiguang, et autres
Publié: (2025)