Classifier-guided CLIP Distillation for Unsupervised Multi-label Classification
Fuente:
arXiv
Salvato in:
| Autori principali: | Kim, Dongseob, Shim, Hyunjung |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Label-Augmented Dataset Distillation
di: Kang, Seoungyoon, et al.
Pubblicazione: (2024)
di: Kang, Seoungyoon, et al.
Pubblicazione: (2024)
Weakly Supervised Semantic Segmentation for Driving Scenes
di: Kim, Dongseob, et al.
Pubblicazione: (2023)
di: Kim, Dongseob, et al.
Pubblicazione: (2023)
Rethinking Data Augmentation for Robust LiDAR Semantic Segmentation in Adverse Weather
di: Park, Junsung, et al.
Pubblicazione: (2024)
di: Park, Junsung, et al.
Pubblicazione: (2024)
Precision matters: Precision-aware ensemble for weakly supervised semantic segmentation
di: Park, Junsung, et al.
Pubblicazione: (2024)
di: Park, Junsung, et al.
Pubblicazione: (2024)
Addressing Image Hallucination in Text-to-Image Generation through Factual Image Retrieval
di: Lim, Youngsun, et al.
Pubblicazione: (2024)
di: Lim, Youngsun, et al.
Pubblicazione: (2024)
3D-Aware Vision-Language Models Fine-Tuning with Geometric Distillation
di: Lee, Seonho, et al.
Pubblicazione: (2025)
di: Lee, Seonho, et al.
Pubblicazione: (2025)
Grounding Driving VLA via Inverse Kinematics
di: Park, Junsung, et al.
Pubblicazione: (2026)
di: Park, Junsung, et al.
Pubblicazione: (2026)
Memory-Efficient Fine-Tuning for Quantized Diffusion Model
di: Ryu, Hyogon, et al.
Pubblicazione: (2024)
di: Ryu, Hyogon, et al.
Pubblicazione: (2024)
Sampling Bag of Views for Open-Vocabulary Object Detection
di: Choi, Hojun, et al.
Pubblicazione: (2024)
di: Choi, Hojun, et al.
Pubblicazione: (2024)
Evaluating Image Hallucination in Text-to-Image Generation with Question-Answering
di: Lim, Youngsun, et al.
Pubblicazione: (2024)
di: Lim, Youngsun, et al.
Pubblicazione: (2024)
No Thing, Nothing: Highlighting Safety-Critical Classes for Robust LiDAR Semantic Segmentation in Adverse Weather
di: Park, Junsung, et al.
Pubblicazione: (2025)
di: Park, Junsung, et al.
Pubblicazione: (2025)
Blind to Position, Biased in Language: Probing Mid-Layer Representational Bias in Vision-Language Encoders for Zero-Shot Language-Grounded Spatial Understanding
di: An, Na Min, et al.
Pubblicazione: (2025)
di: An, Na Min, et al.
Pubblicazione: (2025)
MomentMix Augmentation with Length-Aware DETR for Temporally Robust Moment Retrieval
di: Park, Seojeong, et al.
Pubblicazione: (2024)
di: Park, Seojeong, et al.
Pubblicazione: (2024)
microCLIP: Unsupervised CLIP Adaptation via Coarse-Fine Token Fusion for Fine-Grained Image Classification
di: Silva, Sathira, et al.
Pubblicazione: (2025)
di: Silva, Sathira, et al.
Pubblicazione: (2025)
I0T: Embedding Standardization Method Towards Zero Modality Gap
di: An, Na Min, et al.
Pubblicazione: (2024)
di: An, Na Min, et al.
Pubblicazione: (2024)
Are Large Vision-Language Models Ready to Guide Blind and Low-Vision Individuals?
di: Kim, Eunki, et al.
Pubblicazione: (2025)
di: Kim, Eunki, et al.
Pubblicazione: (2025)
How Blind and Low-Vision Individuals Prefer Large Vision-Language Model-Generated Scene Descriptions
di: An, Na Min, et al.
Pubblicazione: (2025)
di: An, Na Min, et al.
Pubblicazione: (2025)
WaymoQA: A Multi-View Visual Question Answering Dataset for Safety-Critical Reasoning in Autonomous Driving
di: Yu, Seungjun, et al.
Pubblicazione: (2025)
di: Yu, Seungjun, et al.
Pubblicazione: (2025)
Robust Driving QA through Metadata-Grounded Context and Task-Specific Prompts
di: Yu, Seungjun, et al.
Pubblicazione: (2025)
di: Yu, Seungjun, et al.
Pubblicazione: (2025)
Reproducibility Study of CDUL: CLIP-Driven Unsupervised Learning for Multi-Label Image Classification
di: Shah, Manan, et al.
Pubblicazione: (2024)
di: Shah, Manan, et al.
Pubblicazione: (2024)
Debiasing Classifiers by Amplifying Bias with Latent Diffusion and Large Language Models
di: Ko, Donggeun, et al.
Pubblicazione: (2024)
di: Ko, Donggeun, et al.
Pubblicazione: (2024)
CLIP-Guided Unsupervised Semantic-Aware Exposure Correction
di: Wu, Puzhen, et al.
Pubblicazione: (2026)
di: Wu, Puzhen, et al.
Pubblicazione: (2026)
What "Not" to Detect: Negation-Aware VLMs via Structured Reasoning and Token Merging
di: Kang, Inha, et al.
Pubblicazione: (2025)
di: Kang, Inha, et al.
Pubblicazione: (2025)
Interpretable Debiasing of Vision-Language Models for Social Fairness
di: An, Na Min, et al.
Pubblicazione: (2026)
di: An, Na Min, et al.
Pubblicazione: (2026)
LatteCLIP: Unsupervised CLIP Fine-Tuning via LMM-Synthetic Texts
di: Cao, Anh-Quan, et al.
Pubblicazione: (2024)
di: Cao, Anh-Quan, et al.
Pubblicazione: (2024)
DreamCatalyst: Fast and High-Quality 3D Editing via Controlling Editability and Identity Preservation
di: Kim, Jiwook, et al.
Pubblicazione: (2024)
di: Kim, Jiwook, et al.
Pubblicazione: (2024)
EReCu: Pseudo-label Evolution Fusion and Refinement with Multi-Cue Learning for Unsupervised Camouflage Detection
di: Jiang, Shuo, et al.
Pubblicazione: (2026)
di: Jiang, Shuo, et al.
Pubblicazione: (2026)
Real-Time Long Horizon Air Quality Forecasting via Group-Relative Policy Optimization
di: Kang, Inha, et al.
Pubblicazione: (2025)
di: Kang, Inha, et al.
Pubblicazione: (2025)
Occlusion Robustness of CLIP for Military Vehicle Classification
di: van Woerden, Jan Erik, et al.
Pubblicazione: (2025)
di: van Woerden, Jan Erik, et al.
Pubblicazione: (2025)
Simple Unsupervised Knowledge Distillation With Space Similarity
di: Singh, Aditya, et al.
Pubblicazione: (2024)
di: Singh, Aditya, et al.
Pubblicazione: (2024)
Revealing Multi-View Hallucination in Large Vision-Language Models
di: Park, Wooje, et al.
Pubblicazione: (2026)
di: Park, Wooje, et al.
Pubblicazione: (2026)
Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation
di: Wang, Shansong, et al.
Pubblicazione: (2025)
di: Wang, Shansong, et al.
Pubblicazione: (2025)
Learning Primitive Relations for Compositional Zero-Shot Learning
di: Lee, Insu, et al.
Pubblicazione: (2025)
di: Lee, Insu, et al.
Pubblicazione: (2025)
Leveraging Cross-Modal Neighbor Representation for Improved CLIP Classification
di: Yi, Chao, et al.
Pubblicazione: (2024)
di: Yi, Chao, et al.
Pubblicazione: (2024)
VizECGNet: Visual ECG Image Network for Cardiovascular Diseases Classification with Multi-Modal Training and Knowledge Distillation
di: Nam, Ju-Hyeon, et al.
Pubblicazione: (2024)
di: Nam, Ju-Hyeon, et al.
Pubblicazione: (2024)
CLIP-MUSED: CLIP-Guided Multi-Subject Visual Neural Information Semantic Decoding
di: Zhou, Qiongyi, et al.
Pubblicazione: (2024)
di: Zhou, Qiongyi, et al.
Pubblicazione: (2024)
Free Performance Gain from Mixing Multiple Partially Labeled Samples in Multi-label Image Classification
di: Chong, Chak Fong, et al.
Pubblicazione: (2024)
di: Chong, Chak Fong, et al.
Pubblicazione: (2024)
TernaryCLIP: Efficiently Compressing Vision-Language Models with Ternary Weights and Distilled Knowledge
di: Zhang, Shu-Hao, et al.
Pubblicazione: (2025)
di: Zhang, Shu-Hao, et al.
Pubblicazione: (2025)
Classifier-to-Bias: Toward Unsupervised Automatic Bias Detection for Visual Classifiers
di: Guimard, Quentin, et al.
Pubblicazione: (2025)
di: Guimard, Quentin, et al.
Pubblicazione: (2025)
Dual-Student Knowledge Distillation Networks for Unsupervised Anomaly Detection
di: Yao, Liyi, et al.
Pubblicazione: (2024)
di: Yao, Liyi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Label-Augmented Dataset Distillation
di: Kang, Seoungyoon, et al.
Pubblicazione: (2024) -
Weakly Supervised Semantic Segmentation for Driving Scenes
di: Kim, Dongseob, et al.
Pubblicazione: (2023) -
Rethinking Data Augmentation for Robust LiDAR Semantic Segmentation in Adverse Weather
di: Park, Junsung, et al.
Pubblicazione: (2024) -
Precision matters: Precision-aware ensemble for weakly supervised semantic segmentation
di: Park, Junsung, et al.
Pubblicazione: (2024) -
Addressing Image Hallucination in Text-to-Image Generation through Factual Image Retrieval
di: Lim, Youngsun, et al.
Pubblicazione: (2024)