A Closer Look at the Explainability of Contrastive Language-Image Pre-training
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Yi, Wang, Hualiang, Duan, Yiqun, Zhang, Jiheng, Li, Xiaomeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Closer Look at the Robustness of Contrastive Language-Image Pre-Training (CLIP)
di: Tu, Weijie, et al.
Pubblicazione: (2024)
di: Tu, Weijie, et al.
Pubblicazione: (2024)
A Closer Look at Benchmarking Self-Supervised Pre-training with Image Classification
di: Marks, Markus, et al.
Pubblicazione: (2024)
di: Marks, Markus, et al.
Pubblicazione: (2024)
Forgetting-Resistant and Lesion-Aware Source-Free Domain Adaptive Fundus Image Analysis with Vision-Language Model
di: Huai, Zheang, et al.
Pubblicazione: (2026)
di: Huai, Zheang, et al.
Pubblicazione: (2026)
Learning 3D Gaussians for Extremely Sparse-View Cone-Beam CT Reconstruction
di: Lin, Yiqun, et al.
Pubblicazione: (2024)
di: Lin, Yiqun, et al.
Pubblicazione: (2024)
Feature Augmentation for Self-supervised Contrastive Learning: A Closer Look
di: Zhang, Yong, et al.
Pubblicazione: (2024)
di: Zhang, Yong, et al.
Pubblicazione: (2024)
Tri-Plane Mamba: Efficiently Adapting Segment Anything Model for 3D Medical Images
di: Wang, Hualiang, et al.
Pubblicazione: (2024)
di: Wang, Hualiang, et al.
Pubblicazione: (2024)
DeepSparse: A Foundation Model for Sparse-View CBCT Reconstruction
di: Lin, Yiqun, et al.
Pubblicazione: (2025)
di: Lin, Yiqun, et al.
Pubblicazione: (2025)
MuTri: Multi-view Tri-alignment for OCT to OCTA 3D Image Translation
di: Chen, Zhuangzhuang, et al.
Pubblicazione: (2025)
di: Chen, Zhuangzhuang, et al.
Pubblicazione: (2025)
A Closer Look at Conditional Prompt Tuning for Vision-Language Models
di: Zhang, Ji, et al.
Pubblicazione: (2025)
di: Zhang, Ji, et al.
Pubblicazione: (2025)
Advancing Myopia To Holism: Fully Contrastive Language-Image Pre-training
di: Wang, Haicheng, et al.
Pubblicazione: (2024)
di: Wang, Haicheng, et al.
Pubblicazione: (2024)
C^2RV: Cross-Regional and Cross-View Learning for Sparse-View CBCT Reconstruction
di: Lin, Yiqun, et al.
Pubblicazione: (2024)
di: Lin, Yiqun, et al.
Pubblicazione: (2024)
VAMPIRE: Uncovering Vessel Directional and Morphological Information from OCTA Images for Cardiovascular Disease Risk Factor Prediction
di: Wang, Lehan, et al.
Pubblicazione: (2025)
di: Wang, Lehan, et al.
Pubblicazione: (2025)
SRFormerV2: Taking a Closer Look at Permuted Self-Attention for Image Super-Resolution
di: Zhou, Yupeng, et al.
Pubblicazione: (2023)
di: Zhou, Yupeng, et al.
Pubblicazione: (2023)
Contrastive Language Video Time Pre-training
di: Liu, Hengyue, et al.
Pubblicazione: (2024)
di: Liu, Hengyue, et al.
Pubblicazione: (2024)
Taking A Closer Look at Interacting Objects: Interaction-Aware Open Vocabulary Scene Graph Generation
di: Li, Lin, et al.
Pubblicazione: (2025)
di: Li, Lin, et al.
Pubblicazione: (2025)
A Closer Look at the Few-Shot Adaptation of Large Vision-Language Models
di: Silva-Rodríguez, Julio, et al.
Pubblicazione: (2023)
di: Silva-Rodríguez, Julio, et al.
Pubblicazione: (2023)
A Contrastive Pre-trained Foundation Model for Deciphering Imaging Noisomics across Modalities
di: Gu, Yuanjie, et al.
Pubblicazione: (2026)
di: Gu, Yuanjie, et al.
Pubblicazione: (2026)
D4C: Data-Free Quantization for Contrastive Language-Image Pre-training Models
di: Zhang, Wenlun, et al.
Pubblicazione: (2025)
di: Zhang, Wenlun, et al.
Pubblicazione: (2025)
Sculpting Holistic 3D Representation in Contrastive Language-Image-3D Pre-training
di: Gao, Yipeng, et al.
Pubblicazione: (2023)
di: Gao, Yipeng, et al.
Pubblicazione: (2023)
Token Activation Map to Visually Explain Multimodal LLMs
di: Li, Yi, et al.
Pubblicazione: (2025)
di: Li, Yi, et al.
Pubblicazione: (2025)
RadCLIP: Enhancing Radiologic Image Analysis through Contrastive Language-Image Pre-training
di: Lu, Zhixiu, et al.
Pubblicazione: (2024)
di: Lu, Zhixiu, et al.
Pubblicazione: (2024)
LookCloser: Frequency-aware Radiance Field for Tiny-Detail Scene
di: Zhang, Xiaoyu, et al.
Pubblicazione: (2025)
di: Zhang, Xiaoyu, et al.
Pubblicazione: (2025)
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
di: Li, Yi, et al.
Pubblicazione: (2025)
di: Li, Yi, et al.
Pubblicazione: (2025)
A Generative Adversarial Approach to Adversarial Attacks Guided by Contrastive Language-Image Pre-trained Model
di: Soor, Sampriti, et al.
Pubblicazione: (2025)
di: Soor, Sampriti, et al.
Pubblicazione: (2025)
Rectified Decoupled Dataset Distillation: A Closer Look for Fair and Comprehensive Evaluation
di: Zhong, Xinhao, et al.
Pubblicazione: (2025)
di: Zhong, Xinhao, et al.
Pubblicazione: (2025)
Unraveling Instance Associations: A Closer Look for Audio-Visual Segmentation
di: Chen, Yuanhong, et al.
Pubblicazione: (2023)
di: Chen, Yuanhong, et al.
Pubblicazione: (2023)
FSMODNet: A Closer Look at Few-Shot Detection in Multispectral Data
di: Nkegoum, Manuel, et al.
Pubblicazione: (2025)
di: Nkegoum, Manuel, et al.
Pubblicazione: (2025)
WeakSupCon: Weakly Supervised Contrastive Learning for Encoder Pre-training
di: Zhang, Bodong, et al.
Pubblicazione: (2025)
di: Zhang, Bodong, et al.
Pubblicazione: (2025)
Ultrasound-CLIP: Semantic-Aware Contrastive Pre-training for Ultrasound Image-Text Understanding
di: Jin, Jiayun, et al.
Pubblicazione: (2026)
di: Jin, Jiayun, et al.
Pubblicazione: (2026)
TopoFR: A Closer Look at Topology Alignment on Face Recognition
di: Dan, Jun, et al.
Pubblicazione: (2024)
di: Dan, Jun, et al.
Pubblicazione: (2024)
PLIP: Language-Image Pre-training for Person Representation Learning
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
Resilient Contrastive Pre-training under Non-Stationary Drift
di: Yang, Xiaoyu, et al.
Pubblicazione: (2025)
di: Yang, Xiaoyu, et al.
Pubblicazione: (2025)
UniQA: Unified Vision-Language Pre-training for Image Quality and Aesthetic Assessment
di: Zhou, Hantao, et al.
Pubblicazione: (2024)
di: Zhou, Hantao, et al.
Pubblicazione: (2024)
PreMix: Label-Efficient Multiple Instance Learning via Non-Contrastive Pre-training and Feature Mixing
di: Wong, Bryan, et al.
Pubblicazione: (2024)
di: Wong, Bryan, et al.
Pubblicazione: (2024)
What Are You Doing? A Closer Look at Controllable Human Video Generation
di: Bugliarello, Emanuele, et al.
Pubblicazione: (2025)
di: Bugliarello, Emanuele, et al.
Pubblicazione: (2025)
MLIP: Medical Language-Image Pre-training with Masked Local Representation Learning
di: Liu, Jiarun, et al.
Pubblicazione: (2024)
di: Liu, Jiarun, et al.
Pubblicazione: (2024)
Continual Retinal Vision-Language Pre-training upon Incremental Imaging Modalities
di: Yao, Yuang, et al.
Pubblicazione: (2025)
di: Yao, Yuang, et al.
Pubblicazione: (2025)
MIMIC: Mask Image Pre-training with Mix Contrastive Fine-tuning for Facial Expression Recognition
di: Zhang, Fan, et al.
Pubblicazione: (2024)
di: Zhang, Fan, et al.
Pubblicazione: (2024)
Contrastive Localized Language-Image Pre-Training
di: Chen, Hong-You, et al.
Pubblicazione: (2024)
di: Chen, Hong-You, et al.
Pubblicazione: (2024)
AdFair-CLIP: Adversarial Fair Contrastive Language-Image Pre-training for Chest X-rays
di: Yi, Chenlang, et al.
Pubblicazione: (2025)
di: Yi, Chenlang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Closer Look at the Robustness of Contrastive Language-Image Pre-Training (CLIP)
di: Tu, Weijie, et al.
Pubblicazione: (2024) -
A Closer Look at Benchmarking Self-Supervised Pre-training with Image Classification
di: Marks, Markus, et al.
Pubblicazione: (2024) -
Forgetting-Resistant and Lesion-Aware Source-Free Domain Adaptive Fundus Image Analysis with Vision-Language Model
di: Huai, Zheang, et al.
Pubblicazione: (2026) -
Learning 3D Gaussians for Extremely Sparse-View Cone-Beam CT Reconstruction
di: Lin, Yiqun, et al.
Pubblicazione: (2024) -
Feature Augmentation for Self-supervised Contrastive Learning: A Closer Look
di: Zhang, Yong, et al.
Pubblicazione: (2024)