Beyond Standard Benchmarks: A Systematic Audit of Vision-Language Model's Robustness to Natural Semantic Variation Across Diverse Tasks
Fuente:
arXiv
Salvato in:
| Autori principali: | Chengyu, Jia, MaungMaung, AprilPyone, Nguyen, Huy H., Chen, Jinyin, Echizen, Isao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SGM: Safety Glasses for Multimodal Large Language Models via Neuron-Level Detoxification
di: Wang, Hongbo, et al.
Pubblicazione: (2025)
di: Wang, Hongbo, et al.
Pubblicazione: (2025)
Fine-Tuning Text-To-Image Diffusion Models for Class-Wise Spurious Feature Generation
di: MaungMaung, AprilPyone, et al.
Pubblicazione: (2024)
di: MaungMaung, AprilPyone, et al.
Pubblicazione: (2024)
Mitigating Backdoor Attacks using Activation-Guided Model Editing
di: Hsieh, Felix, et al.
Pubblicazione: (2024)
di: Hsieh, Felix, et al.
Pubblicazione: (2024)
EditSleuth: A Dataset of Grounded Reasoning Chains for Image-Edit Forensics
di: Nguyen, Van-Loc, et al.
Pubblicazione: (2026)
di: Nguyen, Van-Loc, et al.
Pubblicazione: (2026)
Stability Analysis of ChatGPT-based Sentiment Analysis in AI Quality Assurance
di: Ouyang, Tinghui, et al.
Pubblicazione: (2024)
di: Ouyang, Tinghui, et al.
Pubblicazione: (2024)
Energy per base pair model from NN parameters and its applications in genomic research
di: Oo, Shwe Sin, et al.
Pubblicazione: (2026)
di: Oo, Shwe Sin, et al.
Pubblicazione: (2026)
Do Social Trust and Tolerance Affect Board Gender Diversity? An International Evidence
di: Fatemeh Kordi, et al.
Pubblicazione: (2025)
di: Fatemeh Kordi, et al.
Pubblicazione: (2025)
Exploring Self-Supervised Vision Transformers for Deepfake Detection: A Comparative Analysis
di: Nguyen, Huy H., et al.
Pubblicazione: (2024)
di: Nguyen, Huy H., et al.
Pubblicazione: (2024)
Modified Coulomb potential and the S-state wavefunction of heavy quarkonia
di: Oo, Shwe Sin, et al.
Pubblicazione: (2024)
di: Oo, Shwe Sin, et al.
Pubblicazione: (2024)
Factors influencing work engagement of nurses in general hospitals: A cross‐sectional study
di: May Zin Maung Maung, et al.
Pubblicazione: (2024)
di: May Zin Maung Maung, et al.
Pubblicazione: (2024)
Status of fisheries in Union of Myanmar
di: Myint, U. Khin Maung
Pubblicazione: (1997)
di: Myint, U. Khin Maung
Pubblicazione: (1997)
Interchange and outcome in coastal fisheries management
di: Aye, U Khin Maung
Pubblicazione: (1997)
di: Aye, U Khin Maung
Pubblicazione: (1997)
Leveraging Chat-Based Large Vision Language Models for Multimodal Out-Of-Context Detection
di: Shalabi, Fatma, et al.
Pubblicazione: (2024)
di: Shalabi, Fatma, et al.
Pubblicazione: (2024)
Quality Text, Robust Vision: The Role of Language in Enhancing Visual Robustness of Vision-Language Models
di: Waseda, Futa, et al.
Pubblicazione: (2025)
di: Waseda, Futa, et al.
Pubblicazione: (2025)
Scoping Review on Strategies for Safe Nucleot(s)ide Analogue Discontinuation and Optimising Functional Cure in Chronic Hepatitis B
di: Soe Thiha Maung, et al.
Pubblicazione: (2025)
di: Soe Thiha Maung, et al.
Pubblicazione: (2025)
Zero-Shot Warning Generation for Misinformative Multimodal Content
di: Delvecchio, Giovanni Pio, et al.
Pubblicazione: (2025)
di: Delvecchio, Giovanni Pio, et al.
Pubblicazione: (2025)
Hepatitis B Surface Antigen Seroclearance Rate After Stopping Nucleos(t)ide Analogues in Chronic Hepatitis B—A Systematic Review and Meta‐Analysis
di: Soe Thiha Maung, et al.
Pubblicazione: (2025)
di: Soe Thiha Maung, et al.
Pubblicazione: (2025)
A Controllable 3D Deepfake Generation Framework with Gaussian Splatting
di: Liu, Wending, et al.
Pubblicazione: (2025)
di: Liu, Wending, et al.
Pubblicazione: (2025)
Steganography Beyond Space-Time with Chain of Multimodal AI
di: Chang, Ching-Chun, et al.
Pubblicazione: (2025)
di: Chang, Ching-Chun, et al.
Pubblicazione: (2025)
Enhancing Robustness of LLM-Synthetic Text Detectors for Academic Writing: A Comprehensive Analysis
di: Dou, Zhicheng, et al.
Pubblicazione: (2024)
di: Dou, Zhicheng, et al.
Pubblicazione: (2024)
LookupForensics: A Large-Scale Multi-Task Dataset for Multi-Phase Image-Based Fact Verification
di: Cui, Shuhan, et al.
Pubblicazione: (2024)
di: Cui, Shuhan, et al.
Pubblicazione: (2024)
Cyber Vaccine for Deepfake Immunity
di: Chang, Ching-Chun, et al.
Pubblicazione: (2023)
di: Chang, Ching-Chun, et al.
Pubblicazione: (2023)
Node Splitting SVMs for Survival Trees Based on an L2-Regularized Dipole Splitting Criteria
di: Maung, Aye Aye, et al.
Pubblicazione: (2025)
di: Maung, Aye Aye, et al.
Pubblicazione: (2025)
Defending Against Physical Adversarial Patch Attacks on Infrared Human Detection
di: Strack, Lukas, et al.
Pubblicazione: (2023)
di: Strack, Lukas, et al.
Pubblicazione: (2023)
Exploring Active Data Selection Strategies for Continuous Training in Deepfake Detection
di: Furuhashi, Yoshihiko, et al.
Pubblicazione: (2025)
di: Furuhashi, Yoshihiko, et al.
Pubblicazione: (2025)
Cross-Attention Watermarking of Large Language Models
di: Baldassini, Folco Bertini, et al.
Pubblicazione: (2024)
di: Baldassini, Folco Bertini, et al.
Pubblicazione: (2024)
Image-Text Out-Of-Context Detection Using Synthetic Multimodal Misinformation
di: Shalabi, Fatma, et al.
Pubblicazione: (2024)
di: Shalabi, Fatma, et al.
Pubblicazione: (2024)
Rethinking Invariance Regularization in Adversarial Training to Improve Robustness-Accuracy Trade-off
di: Waseda, Futa, et al.
Pubblicazione: (2024)
di: Waseda, Futa, et al.
Pubblicazione: (2024)
A Systematic Review of Spatio-Temporal Statistical Models: Theory, Structure, and Applications
di: Habereder, Isabella, et al.
Pubblicazione: (2025)
di: Habereder, Isabella, et al.
Pubblicazione: (2025)
Compliance and coloniality: aid bureaucracy and the failures of ‘localisation’ in Myanmar's complex emergency
di: Anne Décobert, et al.
Pubblicazione: (2025)
di: Anne Décobert, et al.
Pubblicazione: (2025)
Screening for viral hepatitis B infection in cancer patients before receiving chemotherapy – A systematic review and meta‐analysis
di: Soe Thiha Maung, et al.
Pubblicazione: (2024)
di: Soe Thiha Maung, et al.
Pubblicazione: (2024)
Physics-Based Adversarial Attack on Near-Infrared Human Detector for Nighttime Surveillance Camera Systems
di: Niu, Muyao, et al.
Pubblicazione: (2024)
di: Niu, Muyao, et al.
Pubblicazione: (2024)
Steganography in Game Actions
di: Chang, Ching-Chun, et al.
Pubblicazione: (2024)
di: Chang, Ching-Chun, et al.
Pubblicazione: (2024)
Tell-Tale Watermarks for Explanatory Reasoning in Synthetic Media Forensics
di: Chang, Ching-Chun, et al.
Pubblicazione: (2025)
di: Chang, Ching-Chun, et al.
Pubblicazione: (2025)
On the Origin of Synthetic Information by Means of Steganographic Inheritance
di: Chang, Ching-Chun, et al.
Pubblicazione: (2026)
di: Chang, Ching-Chun, et al.
Pubblicazione: (2026)
Chronology of Multi-Agent Interactions for Provenance of Evolving Information
di: Chang, Ching-Chun, et al.
Pubblicazione: (2025)
di: Chang, Ching-Chun, et al.
Pubblicazione: (2025)
Multimodal Adversarial Defense for Vision-Language Models by Leveraging One-To-Many Relationships
di: Waseda, Futa, et al.
Pubblicazione: (2024)
di: Waseda, Futa, et al.
Pubblicazione: (2024)
Measuring Human Involvement in AI-Generated Text: A Case Study on Academic Writing
di: Guo, Yuchen, et al.
Pubblicazione: (2025)
di: Guo, Yuchen, et al.
Pubblicazione: (2025)
Surface Normal Estimation with Transformers
di: Hu, Barry Shichen, et al.
Pubblicazione: (2024)
di: Hu, Barry Shichen, et al.
Pubblicazione: (2024)
GFT-GCN: Privacy-Preserving 3D Face Mesh Recognition with Spectral Diffusion
di: Felouat, Hichem, et al.
Pubblicazione: (2025)
di: Felouat, Hichem, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SGM: Safety Glasses for Multimodal Large Language Models via Neuron-Level Detoxification
di: Wang, Hongbo, et al.
Pubblicazione: (2025) -
Fine-Tuning Text-To-Image Diffusion Models for Class-Wise Spurious Feature Generation
di: MaungMaung, AprilPyone, et al.
Pubblicazione: (2024) -
Mitigating Backdoor Attacks using Activation-Guided Model Editing
di: Hsieh, Felix, et al.
Pubblicazione: (2024) -
EditSleuth: A Dataset of Grounded Reasoning Chains for Image-Edit Forensics
di: Nguyen, Van-Loc, et al.
Pubblicazione: (2026) -
Stability Analysis of ChatGPT-based Sentiment Analysis in AI Quality Assurance
di: Ouyang, Tinghui, et al.
Pubblicazione: (2024)