Enhancing Zero-Shot Vision Models by Label-Free Prompt Distribution Learning and Bias Correcting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhu, Xingyu, Zhu, Beier, Tan, Yi, Wang, Shuo, Hao, Yanbin, Zhang, Hanwang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Selective Vision-Language Subspace Projection for Few-shot CLIP
par: Zhu, Xingyu, et autres
Publié: (2024)
par: Zhu, Xingyu, et autres
Publié: (2024)
Adapting Point Cloud Analysis via Multimodal Bayesian Distribution Learning
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Generalized Logit Adjustment: Calibrating Fine-tuned Models by Removing Label Bias in Foundation Models
par: Zhu, Beier, et autres
Publié: (2023)
par: Zhu, Beier, et autres
Publié: (2023)
Enhancing CLIP Robustness via Cross-Modality Alignment
par: Zhu, Xingyu, et autres
Publié: (2025)
par: Zhu, Xingyu, et autres
Publié: (2025)
Robust Fine-tuning of Zero-shot Models via Variance Reduction
par: Zhu, Beier, et autres
Publié: (2024)
par: Zhu, Beier, et autres
Publié: (2024)
Principled Steering via Null-space Projection for Jailbreak Defense in Vision-Language Models
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Debiased Fine-Tuning for Vision-language Models by Prompt Regularization
par: Zhu, Beier, et autres
Publié: (2023)
par: Zhu, Beier, et autres
Publié: (2023)
Dynamic Multimodal Prototype Learning in Vision-Language Models
par: Zhu, Xingyu, et autres
Publié: (2025)
par: Zhu, Xingyu, et autres
Publié: (2025)
Look Carefully: Adaptive Visual Reinforcements in Multimodal Large Language Models for Hallucination Mitigation
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Prompt-aligned Gradient for Prompt Tuning
par: Zhu, Beier, et autres
Publié: (2022)
par: Zhu, Beier, et autres
Publié: (2022)
Boosting Few-Shot Learning via Attentive Feature Regularization
par: Zhu, Xingyu, et autres
Publié: (2024)
par: Zhu, Xingyu, et autres
Publié: (2024)
Thinking with Images as Continuous Actions: Numerical Visual Chain-of-Thought
par: Zhao, Kesen, et autres
Publié: (2026)
par: Zhao, Kesen, et autres
Publié: (2026)
Hierarchical Semantic Alignment for Image Clustering
par: Zhu, Xingyu, et autres
Publié: (2025)
par: Zhu, Xingyu, et autres
Publié: (2025)
Project-Probe-Aggregate: Efficient Fine-Tuning for Group Robustness
par: Zhu, Beier, et autres
Publié: (2025)
par: Zhu, Beier, et autres
Publié: (2025)
MuSteerNet: Human Reaction Generation from Videos via Observation-Reaction Mutual Steering
par: Zhou, Yuan, et autres
Publié: (2026)
par: Zhou, Yuan, et autres
Publié: (2026)
Mitigating Hallucinations in Large Vision-Language Models without Performance Degradation
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Unsupervised Visual Chain-of-Thought Reasoning via Preference Optimization
par: Zhao, Kesen, et autres
Publié: (2025)
par: Zhao, Kesen, et autres
Publié: (2025)
Distilling Parallel Gradients for Fast ODE Solvers of Diffusion Models
par: Zhu, Beier, et autres
Publié: (2025)
par: Zhu, Beier, et autres
Publié: (2025)
AnomalyAgent: Training-Free Agentic Models for Zero-/Few-Shot Anomaly Detection
par: Zhang, Yi, et autres
Publié: (2026)
par: Zhang, Yi, et autres
Publié: (2026)
SPARC: Score Prompting and Adaptive Fusion for Zero-Shot Multi-Label Recognition in Vision-Language Models
par: Miller, Kevin, et autres
Publié: (2025)
par: Miller, Kevin, et autres
Publié: (2025)
Alternating Training-based Label Smoothing Enhances Prompt Generalization
par: Chen, Yang, et autres
Publié: (2025)
par: Chen, Yang, et autres
Publié: (2025)
GuardAlign: Test-time Safety Alignment in Multimodal Large Language Models
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Attend and Enrich: Enhanced Visual Prompt for Zero-Shot Learning
par: Liu, Man, et autres
Publié: (2024)
par: Liu, Man, et autres
Publié: (2024)
Prompting Language-Informed Distribution for Compositional Zero-Shot Learning
par: Bao, Wentao, et autres
Publié: (2023)
par: Bao, Wentao, et autres
Publié: (2023)
Efficient and Context-Aware Label Propagation for Zero-/Few-Shot Training-Free Adaptation of Vision-Language Model
par: Li, Yushu, et autres
Publié: (2024)
par: Li, Yushu, et autres
Publié: (2024)
Dual-Image Enhanced CLIP for Zero-Shot Anomaly Detection
par: Zhang, Zhaoxiang, et autres
Publié: (2024)
par: Zhang, Zhaoxiang, et autres
Publié: (2024)
Test-Time Adaptation with CLIP Reward for Zero-Shot Generalization in Vision-Language Models
par: Zhao, Shuai, et autres
Publié: (2023)
par: Zhao, Shuai, et autres
Publié: (2023)
BaFTA: Backprop-Free Test-Time Adaptation For Zero-Shot Vision-Language Models
par: Hu, Xuefeng, et autres
Publié: (2024)
par: Hu, Xuefeng, et autres
Publié: (2024)
NICEST: Noisy Label Correction and Training for Robust Scene Graph Generation
par: Li, Lin, et autres
Publié: (2022)
par: Li, Lin, et autres
Publié: (2022)
Bootstrap Fine-Grained Vision-Language Alignment for Unified Zero-Shot Anomaly Localization
par: Deng, Hanqiu, et autres
Publié: (2023)
par: Deng, Hanqiu, et autres
Publié: (2023)
Training-Free Zero-Shot Temporal Action Detection with Vision-Language Models
par: Han, Chaolei, et autres
Publié: (2025)
par: Han, Chaolei, et autres
Publié: (2025)
Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models
par: Yin, Xiaojie, et autres
Publié: (2025)
par: Yin, Xiaojie, et autres
Publié: (2025)
Zero-Shot Out-of-Distribution Detection with Outlier Label Exposure
par: Ding, Choubo, et autres
Publié: (2024)
par: Ding, Choubo, et autres
Publié: (2024)
Local-Prompt: Extensible Local Prompts for Few-Shot Out-of-Distribution Detection
par: Zeng, Fanhu, et autres
Publié: (2024)
par: Zeng, Fanhu, et autres
Publié: (2024)
Accelerating Diffusion Transformer via Error-Optimized Cache
par: Qiu, Junxiang, et autres
Publié: (2025)
par: Qiu, Junxiang, et autres
Publié: (2025)
Expanding Zero-Shot Object Counting with Rich Prompts
par: Zhu, Huilin, et autres
Publié: (2025)
par: Zhu, Huilin, et autres
Publié: (2025)
Free Lunch for Stabilizing Rectified Flow Inversion
par: Wang, Chenru, et autres
Publié: (2026)
par: Wang, Chenru, et autres
Publié: (2026)
Data-Free Generalized Zero-Shot Learning
par: Tang, Bowen, et autres
Publié: (2024)
par: Tang, Bowen, et autres
Publié: (2024)
Controllable Relation Disentanglement for Few-Shot Class-Incremental Learning
par: Zhou, Yuan, et autres
Publié: (2024)
par: Zhou, Yuan, et autres
Publié: (2024)
ZSPAPrune: Zero-Shot Prompt-Aware Token Pruning for Vision-Language Models
par: Zhang, Pu, et autres
Publié: (2025)
par: Zhang, Pu, et autres
Publié: (2025)
Documents similaires
-
Selective Vision-Language Subspace Projection for Few-shot CLIP
par: Zhu, Xingyu, et autres
Publié: (2024) -
Adapting Point Cloud Analysis via Multimodal Bayesian Distribution Learning
par: Zhu, Xingyu, et autres
Publié: (2026) -
Generalized Logit Adjustment: Calibrating Fine-tuned Models by Removing Label Bias in Foundation Models
par: Zhu, Beier, et autres
Publié: (2023) -
Enhancing CLIP Robustness via Cross-Modality Alignment
par: Zhu, Xingyu, et autres
Publié: (2025) -
Robust Fine-tuning of Zero-shot Models via Variance Reduction
par: Zhu, Beier, et autres
Publié: (2024)