High-Entropy Tokens as Multimodal Failure Points in Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Mengqi, Tian, Xinyu, Shen, Xin, Ni, Jinhong, Zou, Shu, Yang, Zhaoyuan, Zhang, Jing |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Making High-Level AI Design Decisions Explicit Using a Binary Stream System-Designation Approach
par: Mossbridge, Julia
Publié: (2024)
par: Mossbridge, Julia
Publié: (2024)
A Review of Pseudo-Labeling for Computer Vision
par: Kage, Patrick, et autres
Publié: (2024)
par: Kage, Patrick, et autres
Publié: (2024)
Synthetic Photography Detection: A Visual Guidance for Identifying Synthetic Images Created by AI
par: Mathys, Melanie, et autres
Publié: (2024)
par: Mathys, Melanie, et autres
Publié: (2024)
CerberusDet: Unified Multi-Dataset Object Detection
par: Tolstykh, Irina, et autres
Publié: (2024)
par: Tolstykh, Irina, et autres
Publié: (2024)
Threats and Opportunities in AI-generated Images for Armed Forces
par: Meier, Raphael
Publié: (2025)
par: Meier, Raphael
Publié: (2025)
Efficient Diffusion Training through Parallelization with Truncated Karhunen-Loève Expansion
par: Ren, Yumeng, et autres
Publié: (2025)
par: Ren, Yumeng, et autres
Publié: (2025)
Super-additive Cooperation in Language Model Agents
par: Tonini, Filippo, et autres
Publié: (2025)
par: Tonini, Filippo, et autres
Publié: (2025)
Eye-gaze Guided Multi-modal Alignment for Medical Representation Learning
par: Ma, Chong, et autres
Publié: (2024)
par: Ma, Chong, et autres
Publié: (2024)
Synthetic Image Generation in Cyber Influence Operations: An Emergent Threat?
par: Mathys, Melanie, et autres
Publié: (2024)
par: Mathys, Melanie, et autres
Publié: (2024)
The Continuity Layer: Why Intelligence Needs an Architecture for What It Carries Forward
par: Tanguturi, Samuel Sameer
Publié: (2026)
par: Tanguturi, Samuel Sameer
Publié: (2026)
Explaining Any ML Model? -- On Goals and Capabilities of XAI
par: Renftle, Moritz, et autres
Publié: (2022)
par: Renftle, Moritz, et autres
Publié: (2022)
Vision Transformer-based Model for Severity Quantification of Lung Pneumonia Using Chest X-ray Images
par: Slika, Bouthaina, et autres
Publié: (2023)
par: Slika, Bouthaina, et autres
Publié: (2023)
Context-Aware Full Body Anonymization using Text-to-Image Diffusion Models
par: Zwick, Pascal, et autres
Publié: (2024)
par: Zwick, Pascal, et autres
Publié: (2024)
Sparse vs Contiguous Adversarial Pixel Perturbations in Multimodal Models: An Empirical Analysis
par: Botocan, Cristian-Alexandru, et autres
Publié: (2024)
par: Botocan, Cristian-Alexandru, et autres
Publié: (2024)
Measuring proximity to standard planes during fetal brain ultrasound scanning
par: Di Vece, Chiara, et autres
Publié: (2024)
par: Di Vece, Chiara, et autres
Publié: (2024)
Quaternion Convolutional Neural Networks: Current Advances and Future Directions
par: Altamirano-Gomez, Gerardo, et autres
Publié: (2023)
par: Altamirano-Gomez, Gerardo, et autres
Publié: (2023)
Beyond Specialization: Assessing the Capabilities of MLLMs in Age and Gender Estimation
par: Kuprashevich, Maksim, et autres
Publié: (2024)
par: Kuprashevich, Maksim, et autres
Publié: (2024)
Position: Tensor Networks are a Valuable Asset for Green AI
par: Memmel, Eva, et autres
Publié: (2022)
par: Memmel, Eva, et autres
Publié: (2022)
What Does 'Human-Centred AI' Mean?
par: Guest, Olivia
Publié: (2025)
par: Guest, Olivia
Publié: (2025)
What's my role? Modelling responsibility for AI-based safety-critical systems
par: Ryan, Philippa, et autres
Publié: (2023)
par: Ryan, Philippa, et autres
Publié: (2023)
Towards Friendly AI: A Comprehensive Review and New Perspectives on Human-AI Alignment
par: Sun, Qiyang, et autres
Publié: (2024)
par: Sun, Qiyang, et autres
Publié: (2024)
Provocations from the Humanities for Generative AI Research
par: Klein, Lauren, et autres
Publié: (2025)
par: Klein, Lauren, et autres
Publié: (2025)
Data Feminism for AI
par: Klein, Lauren, et autres
Publié: (2024)
par: Klein, Lauren, et autres
Publié: (2024)
Visual Orientalism in the AI Era: From West-East Binaries to English-Language Centrism
par: Zhao, Zhilong, et autres
Publié: (2025)
par: Zhao, Zhilong, et autres
Publié: (2025)
FUTURE-AI: International consensus guideline for trustworthy and deployable artificial intelligence in healthcare
par: Lekadir, Karim, et autres
Publié: (2023)
par: Lekadir, Karim, et autres
Publié: (2023)
Pictures Of MIDI: Controlled Music Generation via Graphical Prompts for Image-Based Diffusion Inpainting
par: Hawley, Scott H.
Publié: (2024)
par: Hawley, Scott H.
Publié: (2024)
The Landscape of Generative AI in Information Systems: A Synthesis of Secondary Reviews and Research Agendas
par: Jarzębowicz, Aleksander, et autres
Publié: (2026)
par: Jarzębowicz, Aleksander, et autres
Publié: (2026)
SIDEs: Separating Idealization from Deceptive Explanations in xAI
par: Sullivan, Emily
Publié: (2024)
par: Sullivan, Emily
Publié: (2024)
Event-based Solutions for Human-centered Applications: A Comprehensive Review
par: Adra, Mira, et autres
Publié: (2025)
par: Adra, Mira, et autres
Publié: (2025)
GACL: Graph Attention Collaborative Learning for Temporal QoS Prediction
par: Hu, Shengxiang, et autres
Publié: (2024)
par: Hu, Shengxiang, et autres
Publié: (2024)
GuardSec: A Multi-Modal Web Platform for Real-Time Digital Fraud Detection, Entity Verification, and Connection Security Analysis in the African Context
par: Bansimba, Gilda Rech, et autres
Publié: (2026)
par: Bansimba, Gilda Rech, et autres
Publié: (2026)
The Power of Absence: Thinking with Archival Theory in Algorithmic Design
par: Sherman, Jihan, et autres
Publié: (2024)
par: Sherman, Jihan, et autres
Publié: (2024)
Cyber Humanism in Education: Reclaiming Agency through AI and Learning Sciences
par: Adorni, Giovanni
Publié: (2025)
par: Adorni, Giovanni
Publié: (2025)
StereoCrafter: Diffusion-based Generation of Long and High-fidelity Stereoscopic 3D from Monocular Videos
par: Zhao, Sijie, et autres
Publié: (2024)
par: Zhao, Sijie, et autres
Publié: (2024)
COLORA: Efficient Fine-Tuning for Convolutional Models with a Study Case on Optical Coherence Tomography Image Classification
par: Rivera, Mariano, et autres
Publié: (2025)
par: Rivera, Mariano, et autres
Publié: (2025)
Antagonistic AI
par: Cai, Alice, et autres
Publié: (2024)
par: Cai, Alice, et autres
Publié: (2024)
Proto-FG3D: Prototype-based Interpretable Fine-Grained 3D Shape Classification
par: Ma, Shuxian, et autres
Publié: (2025)
par: Ma, Shuxian, et autres
Publié: (2025)
Lookism: The overlooked bias in computer vision
par: Gulati, Aditya, et autres
Publié: (2024)
par: Gulati, Aditya, et autres
Publié: (2024)
AzSLD: Azerbaijani Sign Language Dataset for Fingerspelling, Word, and Sentence Translation with Baseline Software
par: Alishzade, Nigar, et autres
Publié: (2024)
par: Alishzade, Nigar, et autres
Publié: (2024)
Unified Local and Global Attention Interaction Modeling for Vision Transformers
par: Nguyen, Tan, et autres
Publié: (2024)
par: Nguyen, Tan, et autres
Publié: (2024)
Documents similaires
-
Making High-Level AI Design Decisions Explicit Using a Binary Stream System-Designation Approach
par: Mossbridge, Julia
Publié: (2024) -
A Review of Pseudo-Labeling for Computer Vision
par: Kage, Patrick, et autres
Publié: (2024) -
Synthetic Photography Detection: A Visual Guidance for Identifying Synthetic Images Created by AI
par: Mathys, Melanie, et autres
Publié: (2024) -
CerberusDet: Unified Multi-Dataset Object Detection
par: Tolstykh, Irina, et autres
Publié: (2024) -
Threats and Opportunities in AI-generated Images for Armed Forces
par: Meier, Raphael
Publié: (2025)