Distilling Out-of-Distribution Robustness from Vision-Language Foundation Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Andy, Wang, Jindong, Wang, Yu-Xiong, Wang, Haohan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Robust Prompt Optimization for Defending Language Models Against Jailbreaking Attacks
por: Zhou, Andy, et al.
Publicado: (2024)
por: Zhou, Andy, et al.
Publicado: (2024)
Language Agent Tree Search Unifies Reasoning Acting and Planning in Language Models
por: Zhou, Andy, et al.
Publicado: (2023)
por: Zhou, Andy, et al.
Publicado: (2023)
OISD: On-Policy Internal Self-Distillation of Language Models
por: Liu, Xinyu, et al.
Publicado: (2026)
por: Liu, Xinyu, et al.
Publicado: (2026)
Self-Calibrated Tuning of Vision-Language Models for Out-of-Distribution Detection
por: Yu, Geng, et al.
Publicado: (2024)
por: Yu, Geng, et al.
Publicado: (2024)
Masking Teacher and Reinforcing Student for Distilling Vision-Language Models
por: Lee, Byung-Kwan, et al.
Publicado: (2025)
por: Lee, Byung-Kwan, et al.
Publicado: (2025)
Crafting Adversarial Inputs for Large Vision-Language Models Using Black-Box Optimization
por: Guan, Jiwei, et al.
Publicado: (2026)
por: Guan, Jiwei, et al.
Publicado: (2026)
Generalized Out-of-Distribution Detection and Beyond in Vision Language Model Era: A Survey
por: Miyai, Atsuyuki, et al.
Publicado: (2024)
por: Miyai, Atsuyuki, et al.
Publicado: (2024)
MambaOut: Do We Really Need Mamba for Vision?
por: Yu, Weihao, et al.
Publicado: (2024)
por: Yu, Weihao, et al.
Publicado: (2024)
Group Distributionally Robust Dataset Distillation with Risk Minimization
por: Vahidian, Saeed, et al.
Publicado: (2024)
por: Vahidian, Saeed, et al.
Publicado: (2024)
Dataset Distillation via the Wasserstein Metric
por: Liu, Haoyang, et al.
Publicado: (2023)
por: Liu, Haoyang, et al.
Publicado: (2023)
Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets
por: Nezhurina, Marianna, et al.
Publicado: (2025)
por: Nezhurina, Marianna, et al.
Publicado: (2025)
Towards Long-window Anchoring in Vision-Language Model Distillation
por: Zhou, Haoyi, et al.
Publicado: (2025)
por: Zhou, Haoyi, et al.
Publicado: (2025)
Proposer-Agent-Evaluator(PAE): Autonomous Skill Discovery For Foundation Model Internet Agents
por: Zhou, Yifei, et al.
Publicado: (2024)
por: Zhou, Yifei, et al.
Publicado: (2024)
Probabilistic Conceptual Explainers: Trustworthy Conceptual Explanations for Vision Foundation Models
por: Wang, Hengyi, et al.
Publicado: (2024)
por: Wang, Hengyi, et al.
Publicado: (2024)
Efficient Medical Vision-Language Alignment Through Adapting Masked Vision Models
por: Lian, Chenyu, et al.
Publicado: (2025)
por: Lian, Chenyu, et al.
Publicado: (2025)
Temporal Pair Consistency for Variance-Reduced Flow Matching
por: Maduabuchi, Chika, et al.
Publicado: (2026)
por: Maduabuchi, Chika, et al.
Publicado: (2026)
Impact of Noisy Supervision in Foundation Model Learning
por: Chen, Hao, et al.
Publicado: (2024)
por: Chen, Hao, et al.
Publicado: (2024)
Theia: Distilling Diverse Vision Foundation Models for Robot Learning
por: Shang, Jinghuan, et al.
Publicado: (2024)
por: Shang, Jinghuan, et al.
Publicado: (2024)
X-Prompt: Towards Universal In-Context Image Generation in Auto-Regressive Vision Language Foundation Models
por: Sun, Zeyi, et al.
Publicado: (2024)
por: Sun, Zeyi, et al.
Publicado: (2024)
CFM: Language-aligned Concept Foundation Model for Vision
por: Wittenmayer, Kai, et al.
Publicado: (2026)
por: Wittenmayer, Kai, et al.
Publicado: (2026)
AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models
por: Mai, Zheda, et al.
Publicado: (2025)
por: Mai, Zheda, et al.
Publicado: (2025)
HalluRNN: Mitigating Hallucinations via Recurrent Cross-Layer Reasoning in Large Vision-Language Models
por: Yu, Le, et al.
Publicado: (2025)
por: Yu, Le, et al.
Publicado: (2025)
Situational Awareness Matters in 3D Vision Language Reasoning
por: Man, Yunze, et al.
Publicado: (2024)
por: Man, Yunze, et al.
Publicado: (2024)
Mitigating Bias in Dataset Distillation
por: Cui, Justin, et al.
Publicado: (2024)
por: Cui, Justin, et al.
Publicado: (2024)
From Spatial to Actions: Grounding Vision-Language-Action Model in Spatial Foundation Priors
por: Zhang, Zhengshen, et al.
Publicado: (2025)
por: Zhang, Zhengshen, et al.
Publicado: (2025)
Frustratingly Easy Feature Reconstruction for Out-of-Distribution Detection
por: Wang, Yingsheng, et al.
Publicado: (2025)
por: Wang, Yingsheng, et al.
Publicado: (2025)
UniGame: Turning a Unified Multimodal Model Into Its Own Adversary
por: Su, Zhaolong, et al.
Publicado: (2025)
por: Su, Zhaolong, et al.
Publicado: (2025)
Accessing Vision Foundation Models via ImageNet-1K
por: Zhang, Yitian, et al.
Publicado: (2024)
por: Zhang, Yitian, et al.
Publicado: (2024)
Score identity Distillation: Exponentially Fast Distillation of Pretrained Diffusion Models for One-Step Generation
por: Zhou, Mingyuan, et al.
Publicado: (2024)
por: Zhou, Mingyuan, et al.
Publicado: (2024)
A Reasoning-Enabled Vision-Language Foundation Model for Chest X-ray Interpretation
por: Zhang, Yabin, et al.
Publicado: (2026)
por: Zhang, Yabin, et al.
Publicado: (2026)
FAST: Federated Active Learning with Foundation Models for Communication-efficient Sampling and Training
por: Li, Haoyuan, et al.
Publicado: (2025)
por: Li, Haoyuan, et al.
Publicado: (2025)
Post-pre-training for Modality Alignment in Vision-Language Foundation Models
por: Yamaguchi, Shin'ya, et al.
Publicado: (2025)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2025)
Generalized Out-of-Distribution Detection: A Survey
por: Yang, Jingkang, et al.
Publicado: (2021)
por: Yang, Jingkang, et al.
Publicado: (2021)
Linking Robustness and Generalization: A k* Distribution Analysis of Concept Clustering in Latent Space for Vision Models
por: Kotyan, Shashank, et al.
Publicado: (2024)
por: Kotyan, Shashank, et al.
Publicado: (2024)
ViTime: Foundation Model for Time Series Forecasting Powered by Vision Intelligence
por: Yang, Luoxiao, et al.
Publicado: (2024)
por: Yang, Luoxiao, et al.
Publicado: (2024)
Robust CLIP: Unsupervised Adversarial Fine-Tuning of Vision Embeddings for Robust Large Vision-Language Models
por: Schlarmann, Christian, et al.
Publicado: (2024)
por: Schlarmann, Christian, et al.
Publicado: (2024)
Generalized Category Discovery under Domain Shifts: From Vision to Vision-Language Models
por: Wang, Hongjun, et al.
Publicado: (2026)
por: Wang, Hongjun, et al.
Publicado: (2026)
FlatNAS: optimizing Flatness in Neural Architecture Search for Out-of-Distribution Robustness
por: Gambella, Matteo, et al.
Publicado: (2024)
por: Gambella, Matteo, et al.
Publicado: (2024)
Doubly Debiased Test-Time Prompt Tuning for Vision-Language Models
por: Song, Fei, et al.
Publicado: (2025)
por: Song, Fei, et al.
Publicado: (2025)
Demographic Bias of Expert-Level Vision-Language Foundation Models in Medical Imaging
por: Yang, Yuzhe, et al.
Publicado: (2024)
por: Yang, Yuzhe, et al.
Publicado: (2024)
Ejemplares similares
-
Robust Prompt Optimization for Defending Language Models Against Jailbreaking Attacks
por: Zhou, Andy, et al.
Publicado: (2024) -
Language Agent Tree Search Unifies Reasoning Acting and Planning in Language Models
por: Zhou, Andy, et al.
Publicado: (2023) -
OISD: On-Policy Internal Self-Distillation of Language Models
por: Liu, Xinyu, et al.
Publicado: (2026) -
Self-Calibrated Tuning of Vision-Language Models for Out-of-Distribution Detection
por: Yu, Geng, et al.
Publicado: (2024) -
Masking Teacher and Reinforcing Student for Distilling Vision-Language Models
por: Lee, Byung-Kwan, et al.
Publicado: (2025)