Machine Vision Therapy: Multimodal Large Language Models Can Enhance Visual Robustness via Denoising In-Context Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Zhuo, Liu, Chang, Dong, Yinpeng, Su, Hang, Zheng, Shibao, Liu, Tongliang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exploring the Transferability of Visual Prompting for Multimodal Large Language Models
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
Towards the Worst-case Robustness of Large Language Models
di: Chen, Huanran, et al.
Pubblicazione: (2025)
di: Chen, Huanran, et al.
Pubblicazione: (2025)
Exploring Transferability of Multimodal Adversarial Samples for Vision-Language Pre-training Models with Contrastive Learning
di: Wang, Youze, et al.
Pubblicazione: (2023)
di: Wang, Youze, et al.
Pubblicazione: (2023)
Revisiting Multi-Granularity Representation via Group Contrastive Learning for Unsupervised Vehicle Re-identification
di: Chang, Zhigang, et al.
Pubblicazione: (2024)
di: Chang, Zhigang, et al.
Pubblicazione: (2024)
Omniview-Tuning: Boosting Viewpoint Invariance of Vision-Language Pre-training Models
di: Ruan, Shouwei, et al.
Pubblicazione: (2024)
di: Ruan, Shouwei, et al.
Pubblicazione: (2024)
Exploring the Generalizability of Factual Hallucination Mitigation via Enhancing Precise Knowledge Utilization
di: Zhang, Siyuan, et al.
Pubblicazione: (2025)
di: Zhang, Siyuan, et al.
Pubblicazione: (2025)
Improving Model Generalization by On-manifold Adversarial Augmentation in the Frequency Domain
di: Liu, Chang, et al.
Pubblicazione: (2023)
di: Liu, Chang, et al.
Pubblicazione: (2023)
Unveiling Trust in Multimodal Large Language Models: Evaluation, Analysis, and Mitigation
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
Let's Learn Step by Step: Enhancing In-Context Learning Ability with Curriculum Learning
di: Liu, Yinpeng, et al.
Pubblicazione: (2024)
di: Liu, Yinpeng, et al.
Pubblicazione: (2024)
AdvDreamer Unveils: Are Vision-Language Models Truly Ready for Real-World 3D Variations?
di: Ruan, Shouwei, et al.
Pubblicazione: (2024)
di: Ruan, Shouwei, et al.
Pubblicazione: (2024)
MultiTrust: A Comprehensive Benchmark Towards Trustworthy Multimodal Large Language Models
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
Align is not Enough: Multimodal Universal Jailbreak Attack against Multimodal Large Language Models
di: Wang, Youze, et al.
Pubblicazione: (2025)
di: Wang, Youze, et al.
Pubblicazione: (2025)
Unveiling the Basin-Like Loss Landscape in Large Language Models
di: Chen, Huanran, et al.
Pubblicazione: (2025)
di: Chen, Huanran, et al.
Pubblicazione: (2025)
A Survey on Autonomy-Induced Security Risks in Large Model-Based Agents
di: Su, Hang, et al.
Pubblicazione: (2025)
di: Su, Hang, et al.
Pubblicazione: (2025)
Can Multimodal Large Language Models Truly Perform Multimodal In-Context Learning?
di: Chen, Shuo, et al.
Pubblicazione: (2023)
di: Chen, Shuo, et al.
Pubblicazione: (2023)
Reasoning as State Transition: A Representational Analysis of Reasoning Evolution in Large Language Models
di: Zhang, Siyuan, et al.
Pubblicazione: (2026)
di: Zhang, Siyuan, et al.
Pubblicazione: (2026)
Robust Classification via a Single Diffusion Model
di: Chen, Huanran, et al.
Pubblicazione: (2023)
di: Chen, Huanran, et al.
Pubblicazione: (2023)
FaceCat: Enhancing Face Recognition Security with a Unified Diffusion Model
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
RepoMirage: Probing Repository Context Reasoning in Code Agents with Perturbations
di: Li, Hanyu, et al.
Pubblicazione: (2026)
di: Li, Hanyu, et al.
Pubblicazione: (2026)
Layer-Aware Analysis of Catastrophic Overfitting: Revealing the Pseudo-Robust Shortcut Dependency
di: Lin, Runqi, et al.
Pubblicazione: (2024)
di: Lin, Runqi, et al.
Pubblicazione: (2024)
Every Part Matters: Integrity Verification of Scientific Figures Based on Multimodal Large Language Models
di: Shi, Xiang, et al.
Pubblicazione: (2024)
di: Shi, Xiang, et al.
Pubblicazione: (2024)
Visual In-Context Learning for Large Vision-Language Models
di: Zhou, Yucheng, et al.
Pubblicazione: (2024)
di: Zhou, Yucheng, et al.
Pubblicazione: (2024)
CoVFT: Context-aware Visual Fine-tuning for Multimodal Large Language Models
di: Zhou, Nan, et al.
Pubblicazione: (2026)
di: Zhou, Nan, et al.
Pubblicazione: (2026)
Personalized Vision via Visual In-Context Learning
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
Advancing the Robustness of Large Language Models through Self-Denoised Smoothing
di: Ji, Jiabao, et al.
Pubblicazione: (2024)
di: Ji, Jiabao, et al.
Pubblicazione: (2024)
Revealing Multimodal Causality with Large Language Models
di: Li, Jin, et al.
Pubblicazione: (2025)
di: Li, Jin, et al.
Pubblicazione: (2025)
Investigating and Enhancing the Robustness of Large Multimodal Models Against Temporal Inconsistency
di: Liang, Jiafeng, et al.
Pubblicazione: (2025)
di: Liang, Jiafeng, et al.
Pubblicazione: (2025)
SafeEraser: Enhancing Safety in Multimodal Large Language Models through Multimodal Machine Unlearning
di: Chen, Junkai, et al.
Pubblicazione: (2025)
di: Chen, Junkai, et al.
Pubblicazione: (2025)
Mind over Space: Can Multimodal Large Language Models Mentally Navigate?
di: Zhu, Qihui, et al.
Pubblicazione: (2026)
di: Zhu, Qihui, et al.
Pubblicazione: (2026)
MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments
di: Yang, Xiao, et al.
Pubblicazione: (2025)
di: Yang, Xiao, et al.
Pubblicazione: (2025)
Seeing Sarcasm Through Different Eyes: Analyzing Multimodal Sarcasm Perception in Large Vision-Language Models
di: Chen, Junjie, et al.
Pubblicazione: (2025)
di: Chen, Junjie, et al.
Pubblicazione: (2025)
Few-Shot Adversarial Prompt Learning on Vision-Language Models
di: Zhou, Yiwei, et al.
Pubblicazione: (2024)
di: Zhou, Yiwei, et al.
Pubblicazione: (2024)
Is Gradient Ascent Really Necessary? Memorize to Forget for Machine Unlearning
di: Huang, Zhuo, et al.
Pubblicazione: (2026)
di: Huang, Zhuo, et al.
Pubblicazione: (2026)
MeGU: Machine-Guided Unlearning with Target Feature Disentanglement
di: Wang, Haoyu, et al.
Pubblicazione: (2026)
di: Wang, Haoyu, et al.
Pubblicazione: (2026)
Making Them Ask and Answer: Jailbreaking Large Language Models in Few Queries via Disguise and Reconstruction
di: Liu, Tong, et al.
Pubblicazione: (2024)
di: Liu, Tong, et al.
Pubblicazione: (2024)
Your Diffusion Model is Secretly a Certifiably Robust Classifier
di: Chen, Huanran, et al.
Pubblicazione: (2024)
di: Chen, Huanran, et al.
Pubblicazione: (2024)
Can Large Language Models Help Experimental Design for Causal Discovery?
di: Li, Junyi, et al.
Pubblicazione: (2025)
di: Li, Junyi, et al.
Pubblicazione: (2025)
Toward Robust Non-Transferable Learning: A Survey and Benchmark
di: Hong, Ziming, et al.
Pubblicazione: (2025)
di: Hong, Ziming, et al.
Pubblicazione: (2025)
Towards Safe Reasoning in Large Reasoning Models via Corrective Intervention
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
Visual-Noise Guided In-Context Distillation for Multimodal Large Language Model Unlearning
di: Chen, Junkai, et al.
Pubblicazione: (2026)
di: Chen, Junkai, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Exploring the Transferability of Visual Prompting for Multimodal Large Language Models
di: Zhang, Yichi, et al.
Pubblicazione: (2024) -
Towards the Worst-case Robustness of Large Language Models
di: Chen, Huanran, et al.
Pubblicazione: (2025) -
Exploring Transferability of Multimodal Adversarial Samples for Vision-Language Pre-training Models with Contrastive Learning
di: Wang, Youze, et al.
Pubblicazione: (2023) -
Revisiting Multi-Granularity Representation via Group Contrastive Learning for Unsupervised Vehicle Re-identification
di: Chang, Zhigang, et al.
Pubblicazione: (2024) -
Omniview-Tuning: Boosting Viewpoint Invariance of Vision-Language Pre-training Models
di: Ruan, Shouwei, et al.
Pubblicazione: (2024)