PARIC: Probabilistic Attention Regularization for Language Guided Image Classification from Pre-trained Vison Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Nautiyal, Mayank, Gheorghe, Stela Arranz, Stefa, Kristiana, Ju, Li, Sintorn, Ida-Maria, Singh, Prashant |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Disagreement-Regularized Importance Sampling for Adversarial Label Corruption
von: Horváth, Csongor, et al.
Veröffentlicht: (2026)
von: Horváth, Csongor, et al.
Veröffentlicht: (2026)
Epistemic Uncertainty Quantification for Pre-trained VLMs via Riemannian Flow Matching
von: Ju, Li, et al.
Veröffentlicht: (2026)
von: Ju, Li, et al.
Veröffentlicht: (2026)
Debiasing Vison-Language Models with Text-Only Training
von: Yang, Yunfan, et al.
Veröffentlicht: (2024)
von: Yang, Yunfan, et al.
Veröffentlicht: (2024)
Probabilistic Language-Image Pre-Training
von: Chun, Sanghyuk, et al.
Veröffentlicht: (2024)
von: Chun, Sanghyuk, et al.
Veröffentlicht: (2024)
Unified Medical Image Pre-training in Language-Guided Common Semantic Space
von: He, Xiaoxuan, et al.
Veröffentlicht: (2023)
von: He, Xiaoxuan, et al.
Veröffentlicht: (2023)
Advancing Myopia To Holism: Fully Contrastive Language-Image Pre-training
von: Wang, Haicheng, et al.
Veröffentlicht: (2024)
von: Wang, Haicheng, et al.
Veröffentlicht: (2024)
3D Scene Graph Guided Vision-Language Pre-training
von: Liu, Hao, et al.
Veröffentlicht: (2024)
von: Liu, Hao, et al.
Veröffentlicht: (2024)
Lightweight Model Pre-training via Language Guided Knowledge Distillation
von: Li, Mingsheng, et al.
Veröffentlicht: (2024)
von: Li, Mingsheng, et al.
Veröffentlicht: (2024)
A Generative Adversarial Approach to Adversarial Attacks Guided by Contrastive Language-Image Pre-trained Model
von: Soor, Sampriti, et al.
Veröffentlicht: (2025)
von: Soor, Sampriti, et al.
Veröffentlicht: (2025)
Zero-Shot Referring Expression Comprehension via Vison-Language True/False Verification
von: Liu, Jeffrey, et al.
Veröffentlicht: (2025)
von: Liu, Jeffrey, et al.
Veröffentlicht: (2025)
PLIP: Language-Image Pre-training for Person Representation Learning
von: Zuo, Jialong, et al.
Veröffentlicht: (2023)
von: Zuo, Jialong, et al.
Veröffentlicht: (2023)
DreamLIP: Language-Image Pre-training with Long Captions
von: Zheng, Kecheng, et al.
Veröffentlicht: (2024)
von: Zheng, Kecheng, et al.
Veröffentlicht: (2024)
Let ViT Speak: Generative Language-Image Pre-training
von: Fang, Yan, et al.
Veröffentlicht: (2026)
von: Fang, Yan, et al.
Veröffentlicht: (2026)
Anatomical Structure-Guided Medical Vision-Language Pre-training
von: Li, Qingqiu, et al.
Veröffentlicht: (2024)
von: Li, Qingqiu, et al.
Veröffentlicht: (2024)
Towards Scalable Language-Image Pre-training for 3D Medical Imaging
von: Zhao, Chenhui, et al.
Veröffentlicht: (2025)
von: Zhao, Chenhui, et al.
Veröffentlicht: (2025)
GeoFlowVLM: Geometry-Aware Joint Uncertainty for Frozen Vision-Language Embedding
von: Nautiyal, Mayank, et al.
Veröffentlicht: (2026)
von: Nautiyal, Mayank, et al.
Veröffentlicht: (2026)
A Closer Look at the Explainability of Contrastive Language-Image Pre-training
von: Li, Yi, et al.
Veröffentlicht: (2023)
von: Li, Yi, et al.
Veröffentlicht: (2023)
Pseudo-Prompt Generating in Pre-trained Vision-Language Models for Multi-Label Medical Image Classification
von: Ye, Yaoqin, et al.
Veröffentlicht: (2024)
von: Ye, Yaoqin, et al.
Veröffentlicht: (2024)
OpenPath: Open-Set Active Learning for Pathology Image Classification via Pre-trained Vision-Language Models
von: Zhong, Lanfeng, et al.
Veröffentlicht: (2025)
von: Zhong, Lanfeng, et al.
Veröffentlicht: (2025)
IMITATE: Clinical Prior Guided Hierarchical Vision-Language Pre-training
von: Liu, Che, et al.
Veröffentlicht: (2023)
von: Liu, Che, et al.
Veröffentlicht: (2023)
FLAME: Frozen Large Language Models Enable Data-Efficient Language-Image Pre-training
von: Cao, Anjia, et al.
Veröffentlicht: (2024)
von: Cao, Anjia, et al.
Veröffentlicht: (2024)
Universal Image Restoration Pre-training via Degradation Classification
von: Hu, JiaKui, et al.
Veröffentlicht: (2025)
von: Hu, JiaKui, et al.
Veröffentlicht: (2025)
Multi-Resolution Pathology-Language Pre-training Model with Text-Guided Visual Representation
von: Albastaki, Shahad, et al.
Veröffentlicht: (2025)
von: Albastaki, Shahad, et al.
Veröffentlicht: (2025)
MLIP: Medical Language-Image Pre-training with Masked Local Representation Learning
von: Liu, Jiarun, et al.
Veröffentlicht: (2024)
von: Liu, Jiarun, et al.
Veröffentlicht: (2024)
LoTLIP: Improving Language-Image Pre-training for Long Text Understanding
von: Wu, Wei, et al.
Veröffentlicht: (2024)
von: Wu, Wei, et al.
Veröffentlicht: (2024)
ELIP: Efficient Discriminative Language-Image Pre-training with Fewer Vision Tokens
von: Guo, Yangyang, et al.
Veröffentlicht: (2023)
von: Guo, Yangyang, et al.
Veröffentlicht: (2023)
Continual Retinal Vision-Language Pre-training upon Incremental Imaging Modalities
von: Yao, Yuang, et al.
Veröffentlicht: (2025)
von: Yao, Yuang, et al.
Veröffentlicht: (2025)
SAMIRO: Spatial Attention Mutual Information Regularization with a Pre-trained Model as Oracle for Lane Detection
von: Lee, Hyunjong, et al.
Veröffentlicht: (2025)
von: Lee, Hyunjong, et al.
Veröffentlicht: (2025)
Contrastive Language Video Time Pre-training
von: Liu, Hengyue, et al.
Veröffentlicht: (2024)
von: Liu, Hengyue, et al.
Veröffentlicht: (2024)
VILA: On Pre-training for Visual Language Models
von: Lin, Ji, et al.
Veröffentlicht: (2023)
von: Lin, Ji, et al.
Veröffentlicht: (2023)
TIP: Tabular-Image Pre-training for Multimodal Classification with Incomplete Data
von: Du, Siyi, et al.
Veröffentlicht: (2024)
von: Du, Siyi, et al.
Veröffentlicht: (2024)
Universal Image Restoration Pre-training via Masked Degradation Classification
von: Hu, JiaKui, et al.
Veröffentlicht: (2025)
von: Hu, JiaKui, et al.
Veröffentlicht: (2025)
MedFILIP: Medical Fine-grained Language-Image Pre-training
von: Liang, Xinjie, et al.
Veröffentlicht: (2025)
von: Liang, Xinjie, et al.
Veröffentlicht: (2025)
VELVET-Med: Vision and Efficient Language Pre-training for Volumetric Imaging Tasks in Medicine
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025)
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025)
Semantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-training
von: Liu, Haowei, et al.
Veröffentlicht: (2024)
von: Liu, Haowei, et al.
Veröffentlicht: (2024)
UniQA: Unified Vision-Language Pre-training for Image Quality and Aesthetic Assessment
von: Zhou, Hantao, et al.
Veröffentlicht: (2024)
von: Zhou, Hantao, et al.
Veröffentlicht: (2024)
Supervised Multilabel Image Classification Using Residual Networks with Probabilistic Reasoning
von: Singh, Lokender, et al.
Veröffentlicht: (2025)
von: Singh, Lokender, et al.
Veröffentlicht: (2025)
A Closer Look at Benchmarking Self-Supervised Pre-training with Image Classification
von: Marks, Markus, et al.
Veröffentlicht: (2024)
von: Marks, Markus, et al.
Veröffentlicht: (2024)
Efficient Vision-Language Pre-training by Cluster Masking
von: Wei, Zihao, et al.
Veröffentlicht: (2024)
von: Wei, Zihao, et al.
Veröffentlicht: (2024)
Enhancing Vision-Language Pre-training with Rich Supervisions
von: Gao, Yuan, et al.
Veröffentlicht: (2024)
von: Gao, Yuan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Disagreement-Regularized Importance Sampling for Adversarial Label Corruption
von: Horváth, Csongor, et al.
Veröffentlicht: (2026) -
Epistemic Uncertainty Quantification for Pre-trained VLMs via Riemannian Flow Matching
von: Ju, Li, et al.
Veröffentlicht: (2026) -
Debiasing Vison-Language Models with Text-Only Training
von: Yang, Yunfan, et al.
Veröffentlicht: (2024) -
Probabilistic Language-Image Pre-Training
von: Chun, Sanghyuk, et al.
Veröffentlicht: (2024) -
Unified Medical Image Pre-training in Language-Guided Common Semantic Space
von: He, Xiaoxuan, et al.
Veröffentlicht: (2023)