DeiT-LT Distillation Strikes Back for Vision Transformer Training on Long-Tailed Datasets
Fuente:
arXiv
Saved in:
| Main Authors: | Rangwani, Harsh, Mondal, Pradipto, Mishra, Mayank, Asokan, Ashish Ramayee, Babu, R. Venkatesh |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Leveraging Vision-Language Models for Improving Domain Generalization in Image Classification
by: Addepalli, Sravanti, et al.
Published: (2023)
by: Addepalli, Sravanti, et al.
Published: (2023)
DeiTFake: Deepfake Detection Model using DeiT Multi-Stage Training
by: Kumar, Saksham, et al.
Published: (2025)
by: Kumar, Saksham, et al.
Published: (2025)
Deep Learning for Oral Health: Benchmarking ViT, DeiT, BEiT, ConvNeXt, and Swin Transformer
by: George, Ajo Babu, et al.
Published: (2025)
by: George, Ajo Babu, et al.
Published: (2025)
Learning from Limited and Imperfect Data
by: Rangwani, Harsh
Published: (2024)
by: Rangwani, Harsh
Published: (2024)
Learning from Limited and Imperfect Data
by: Rangwani, Harsh
Published: (2025)
by: Rangwani, Harsh
Published: (2025)
Composing Parts for Expressive Object Generation
by: Rangwani, Harsh, et al.
Published: (2024)
by: Rangwani, Harsh, et al.
Published: (2024)
Detecting and recognizing characters in Greek papyri with YOLOv8, DeiT and SimCLR
by: Turnbull, Robert, et al.
Published: (2024)
by: Turnbull, Robert, et al.
Published: (2024)
Selective Mixup Fine-Tuning for Optimizing Non-Decomposable Objectives
by: Ramasubramanian, Shrinivas, et al.
Published: (2024)
by: Ramasubramanian, Shrinivas, et al.
Published: (2024)
DynamicEval: Rethinking Evaluation for Dynamic Text-to-Video Synthesis
by: Babu, Nithin C., et al.
Published: (2025)
by: Babu, Nithin C., et al.
Published: (2025)
Realism in Action: Anomaly-Aware Diagnosis of Brain Tumors from Medical Images Using YOLOv8 and DeiT
by: Hashemi, Seyed Mohammad Hossein, et al.
Published: (2024)
by: Hashemi, Seyed Mohammad Hossein, et al.
Published: (2024)
SemLT3D: Semantic-Guided Expert Distillation for Camera-only Long-Tailed 3D Object Detection
by: Vo, Hao, et al.
Published: (2026)
by: Vo, Hao, et al.
Published: (2026)
VLM-KD: Knowledge Distillation from VLM for Long-Tail Visual Recognition
by: Zhang, Zaiwei, et al.
Published: (2024)
by: Zhang, Zaiwei, et al.
Published: (2024)
Adapters Strike Back
by: Steitz, Jan-Martin O., et al.
Published: (2024)
by: Steitz, Jan-Martin O., et al.
Published: (2024)
Rethinking Dataset Distillation: Hard Truths about Soft Labels
by: Dey, Priyam, et al.
Published: (2026)
by: Dey, Priyam, et al.
Published: (2026)
Text2Place: Affordance-aware Text Guided Human Placement
by: Parihar, Rishubh, et al.
Published: (2024)
by: Parihar, Rishubh, et al.
Published: (2024)
CXR-LT 2026 Challenge: Multi-Center Long-Tailed and Zero Shot Chest X-ray Classification
by: Dong, Hexin, et al.
Published: (2026)
by: Dong, Hexin, et al.
Published: (2026)
Rectifying Soft-Label Entangled Bias in Long-Tailed Dataset Distillation
by: Jiang, Chenyang, et al.
Published: (2025)
by: Jiang, Chenyang, et al.
Published: (2025)
ChromaDistill: Colorizing Monochrome Radiance Fields with Knowledge Distillation
by: Dhiman, Ankit, et al.
Published: (2023)
by: Dhiman, Ankit, et al.
Published: (2023)
Do Vision Language Models Need to Process Image Tokens?
by: Ghosh, Sambit, et al.
Published: (2026)
by: Ghosh, Sambit, et al.
Published: (2026)
Overview of the CXR-LT 2026 Challenge: Multi-Center Long-Tailed and Zero Shot Chest X-ray Classification
by: Dong, Hexin, et al.
Published: (2026)
by: Dong, Hexin, et al.
Published: (2026)
LongTail Driving Scenarios with Reasoning Traces: The KITScenes LongTail Dataset
by: Wagner, Royden, et al.
Published: (2026)
by: Wagner, Royden, et al.
Published: (2026)
IndicSTR12: A Dataset for Indic Scene Text Recognition
by: Lunia, Harsh, et al.
Published: (2024)
by: Lunia, Harsh, et al.
Published: (2024)
SAR Strikes Back: A New Hope for RSVQA
by: Tosato, Lucrezia, et al.
Published: (2025)
by: Tosato, Lucrezia, et al.
Published: (2025)
Empowering Vision Transformers with Multi-Scale Causal Intervention for Long-Tailed Image Classification
by: Yan, Xiaoshuo, et al.
Published: (2025)
by: Yan, Xiaoshuo, et al.
Published: (2025)
Vision-Language Dataset Distillation
by: Wu, Xindi, et al.
Published: (2023)
by: Wu, Xindi, et al.
Published: (2023)
Multi-Tailed Vision Transformer for Efficient Inference
by: Wang, Yunke, et al.
Published: (2022)
by: Wang, Yunke, et al.
Published: (2022)
LT-Soups: Bridging Head and Tail Classes via Subsampled Model Soups
by: Aminbeidokhti, Masih, et al.
Published: (2025)
by: Aminbeidokhti, Masih, et al.
Published: (2025)
ProFeAT: Projected Feature Adversarial Training for Self-Supervised Learning of Robust Representations
by: Addepalli, Sravanti, et al.
Published: (2024)
by: Addepalli, Sravanti, et al.
Published: (2024)
Dynamic Distillation and Gradient Consistency for Robust Long-Tailed Incremental Learning
by: Sakai, Taigo, et al.
Published: (2026)
by: Sakai, Taigo, et al.
Published: (2026)
Revisiting Adversarial Training under Long-Tailed Distributions
by: Yue, Xinli, et al.
Published: (2024)
by: Yue, Xinli, et al.
Published: (2024)
F4-ITS: Fine-grained Feature Fusion for Food Image-Text Search
by: Asokan, Raghul
Published: (2025)
by: Asokan, Raghul
Published: (2025)
Dataset Distillation by Automatic Training Trajectories
by: Liu, Dai, et al.
Published: (2024)
by: Liu, Dai, et al.
Published: (2024)
Dataset Distillation for Pre-Trained Self-Supervised Vision Models
by: Cazenavette, George, et al.
Published: (2025)
by: Cazenavette, George, et al.
Published: (2025)
Depth-Wise Convolutions in Vision Transformers for Efficient Training on Small Datasets
by: Zhang, Tianxiao, et al.
Published: (2024)
by: Zhang, Tianxiao, et al.
Published: (2024)
Open-Set Semi-Supervised Learning for Long-Tailed Medical Datasets
by: Kareem, Daniya Najiha A., et al.
Published: (2025)
by: Kareem, Daniya Najiha A., et al.
Published: (2025)
Class Confidence Aware Reweighting for Long Tailed Learning
by: Jagati, Brainard Philemon, et al.
Published: (2026)
by: Jagati, Brainard Philemon, et al.
Published: (2026)
Vision Transformers with Self-Distilled Registers
by: Chen, Yinjie, et al.
Published: (2025)
by: Chen, Yinjie, et al.
Published: (2025)
Symmetry Strikes Back: From Single-Image Symmetry Detection to 3D Generation
by: Li, Xiang, et al.
Published: (2024)
by: Li, Xiang, et al.
Published: (2024)
Safety-Critical Learning for Long-Tail Events: The TUM Traffic Accident Dataset
by: Zimmer, Walter, et al.
Published: (2025)
by: Zimmer, Walter, et al.
Published: (2025)
Long-tailed Adversarial Training with Self-Distillation
by: Cho, Seungju, et al.
Published: (2025)
by: Cho, Seungju, et al.
Published: (2025)
Similar Items
-
Leveraging Vision-Language Models for Improving Domain Generalization in Image Classification
by: Addepalli, Sravanti, et al.
Published: (2023) -
DeiTFake: Deepfake Detection Model using DeiT Multi-Stage Training
by: Kumar, Saksham, et al.
Published: (2025) -
Deep Learning for Oral Health: Benchmarking ViT, DeiT, BEiT, ConvNeXt, and Swin Transformer
by: George, Ajo Babu, et al.
Published: (2025) -
Learning from Limited and Imperfect Data
by: Rangwani, Harsh
Published: (2024) -
Learning from Limited and Imperfect Data
by: Rangwani, Harsh
Published: (2025)