Vision Transformers Exhibit Human-Like Biases: Evidence of Orientation and Color Selectivity, Categorical Perception, and Phase Transitions
Fuente:
arXiv
Guardado en:
| Autor principal: | Bahador, Nooshin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Chirp Localization via Fine-Tuned Transformer Model: A Proof-of-Concept Study
por: Bahador, Nooshin, et al.
Publicado: (2025)
por: Bahador, Nooshin, et al.
Publicado: (2025)
Don't Show Pixels, Show Cues: Unlocking Visual Tool Reasoning in Language Models via Perception Programs
por: Janjua, Muhammad Kamran, et al.
Publicado: (2026)
por: Janjua, Muhammad Kamran, et al.
Publicado: (2026)
Vision Language Models are Biased
por: Vo, An, et al.
Publicado: (2025)
por: Vo, An, et al.
Publicado: (2025)
From Colors to Classes: Emergence of Concepts in Vision Transformers
por: Dorszewski, Teresa, et al.
Publicado: (2025)
por: Dorszewski, Teresa, et al.
Publicado: (2025)
MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models
por: Chiu, Ming-Chang, et al.
Publicado: (2024)
por: Chiu, Ming-Chang, et al.
Publicado: (2024)
Block Selective Reprogramming for On-device Training of Vision Transformers
por: Sarkar, Sreetama, et al.
Publicado: (2024)
por: Sarkar, Sreetama, et al.
Publicado: (2024)
Active Learning for Finely-Categorized Image-Text Retrieval by Selecting Hard Negative Unpaired Samples
por: Jo, Dae Ung, et al.
Publicado: (2024)
por: Jo, Dae Ung, et al.
Publicado: (2024)
FovEx: Human-Inspired Explanations for Vision Transformers and Convolutional Neural Networks
por: Panda, Mahadev Prasad, et al.
Publicado: (2024)
por: Panda, Mahadev Prasad, et al.
Publicado: (2024)
LetheViT: Selective Machine Unlearning for Vision Transformers via Attention-Guided Contrastive Learning
por: Tong, Yujia, et al.
Publicado: (2025)
por: Tong, Yujia, et al.
Publicado: (2025)
PRISM: Reducing Spurious Implicit Biases in Vision-Language Models with LLM-Guided Embedding Projection
por: Molahasani, Mahdiyar, et al.
Publicado: (2025)
por: Molahasani, Mahdiyar, et al.
Publicado: (2025)
RLS3: RL-Based Synthetic Sample Selection to Enhance Spatial Reasoning in Vision-Language Models for Indoor Autonomous Perception
por: Waite, Joshua R., et al.
Publicado: (2025)
por: Waite, Joshua R., et al.
Publicado: (2025)
Mechanistic Interpretability of Fine-Tuned Vision Transformers on Distorted Images: Decoding Attention Head Behavior for Transparent and Trustworthy AI
por: Bahador, Nooshin
Publicado: (2025)
por: Bahador, Nooshin
Publicado: (2025)
SAVER: Selective As-Needed Vision Evidence for Multimodal Information Extraction
por: Hu, Miaobo, et al.
Publicado: (2026)
por: Hu, Miaobo, et al.
Publicado: (2026)
SelaFD:Seamless Adaptation of Vision Transformer Fine-tuning for Radar-based Human Activity Recognition
por: Wang, Yijun, et al.
Publicado: (2025)
por: Wang, Yijun, et al.
Publicado: (2025)
Native Segmentation Vision Transformers
por: Brasó, Guillem, et al.
Publicado: (2025)
por: Brasó, Guillem, et al.
Publicado: (2025)
Panoptic Pairwise Distortion Graph
por: Janjua, Muhammad Kamran, et al.
Publicado: (2026)
por: Janjua, Muhammad Kamran, et al.
Publicado: (2026)
AIM-Fair: Advancing Algorithmic Fairness via Selectively Fine-Tuning Biased Models with Contextual Synthetic Data
por: Zhao, Zengqun, et al.
Publicado: (2025)
por: Zhao, Zengqun, et al.
Publicado: (2025)
Transitive Vision-Language Prompt Learning for Domain Generalization
por: Wang, Liyuan, et al.
Publicado: (2024)
por: Wang, Liyuan, et al.
Publicado: (2024)
Embracing Biased Transition Matrices for Complementary-Label Learning with Many Classes
por: Mai, Tan-Ha, et al.
Publicado: (2026)
por: Mai, Tan-Ha, et al.
Publicado: (2026)
Iwin Transformer: Hierarchical Vision Transformer using Interleaved Windows
por: Huo, Simin, et al.
Publicado: (2025)
por: Huo, Simin, et al.
Publicado: (2025)
Decorrelation Speeds Up Vision Transformers
por: Carrigg, Kieran, et al.
Publicado: (2025)
por: Carrigg, Kieran, et al.
Publicado: (2025)
Slicing Vision Transformer for Flexible Inference
por: Zhang, Yitian, et al.
Publicado: (2024)
por: Zhang, Yitian, et al.
Publicado: (2024)
RAViT: Resolution-Adaptive Vision Transformer
por: Guidez, Martial, et al.
Publicado: (2026)
por: Guidez, Martial, et al.
Publicado: (2026)
Rotary Position Embedding for Vision Transformer
por: Heo, Byeongho, et al.
Publicado: (2024)
por: Heo, Byeongho, et al.
Publicado: (2024)
You Never Know: Quantization Induces Inconsistent Biases in Vision-Language Foundation Models
por: Slyman, Eric, et al.
Publicado: (2024)
por: Slyman, Eric, et al.
Publicado: (2024)
Beyond Perception Errors: Semantic Fixation in Large Vision-Language Models
por: Alam, Md Tanvirul
Publicado: (2026)
por: Alam, Md Tanvirul
Publicado: (2026)
Perception of Visual Content: Differences Between Humans and Foundation Models
por: Pratama, Nardiena A., et al.
Publicado: (2024)
por: Pratama, Nardiena A., et al.
Publicado: (2024)
Uncolorable Examples: Preventing Unauthorized AI Colorization via Perception-Aware Chroma-Restrictive Perturbation
por: Nii, Yuki, et al.
Publicado: (2025)
por: Nii, Yuki, et al.
Publicado: (2025)
SPoT: Subpixel Placement of Tokens in Vision Transformers
por: Hjelkrem-Tan, Martine, et al.
Publicado: (2025)
por: Hjelkrem-Tan, Martine, et al.
Publicado: (2025)
Compact Vision Transformer by Reduction of Kernel Complexity
por: Wang, Yancheng, et al.
Publicado: (2025)
por: Wang, Yancheng, et al.
Publicado: (2025)
Split Adaptation for Pre-trained Vision Transformers
por: Wang, Lixu, et al.
Publicado: (2025)
por: Wang, Lixu, et al.
Publicado: (2025)
DASViT: Differentiable Architecture Search for Vision Transformer
por: Wu, Pengjin, et al.
Publicado: (2025)
por: Wu, Pengjin, et al.
Publicado: (2025)
Stable Vision Concept Transformers for Medical Diagnosis
por: Hu, Lijie, et al.
Publicado: (2025)
por: Hu, Lijie, et al.
Publicado: (2025)
Leveraging Registers in Vision Transformers for Robust Adaptation
por: Yellapragada, Srikar, et al.
Publicado: (2025)
por: Yellapragada, Srikar, et al.
Publicado: (2025)
Instance-Aware Group Quantization for Vision Transformers
por: Moon, Jaehyeon, et al.
Publicado: (2024)
por: Moon, Jaehyeon, et al.
Publicado: (2024)
Vision Transformer-based Adversarial Domain Adaptation
por: Li, Yahan, et al.
Publicado: (2024)
por: Li, Yahan, et al.
Publicado: (2024)
Elastic Attention Cores for Scalable Vision Transformers
por: Song, Alan Z., et al.
Publicado: (2026)
por: Song, Alan Z., et al.
Publicado: (2026)
Attention Transfer Is Not Universally Effective for Vision Transformers
por: Qin, Huaiyuan, et al.
Publicado: (2026)
por: Qin, Huaiyuan, et al.
Publicado: (2026)
Self-Supervised Vision Transformers for Writer Retrieval
por: Raven, Tim, et al.
Publicado: (2024)
por: Raven, Tim, et al.
Publicado: (2024)
HEAL-SWIN: A Vision Transformer On The Sphere
por: Carlsson, Oscar, et al.
Publicado: (2023)
por: Carlsson, Oscar, et al.
Publicado: (2023)
Ejemplares similares
-
Chirp Localization via Fine-Tuned Transformer Model: A Proof-of-Concept Study
por: Bahador, Nooshin, et al.
Publicado: (2025) -
Don't Show Pixels, Show Cues: Unlocking Visual Tool Reasoning in Language Models via Perception Programs
por: Janjua, Muhammad Kamran, et al.
Publicado: (2026) -
Vision Language Models are Biased
por: Vo, An, et al.
Publicado: (2025) -
From Colors to Classes: Emergence of Concepts in Vision Transformers
por: Dorszewski, Teresa, et al.
Publicado: (2025) -
MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models
por: Chiu, Ming-Chang, et al.
Publicado: (2024)