Black Sheep in the Herd: Playing with Spuriously Correlated Attributes for Vision-Language Recognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Tian, Xinyu, Zou, Shu, Yang, Zhaoyuan, He, Mengqi, Zhang, Jing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Remote Sensing Semantic Segmentation Quality Assessment based on Vision Language Model
por: Shi, Huiying, et al.
Publicado: (2025)
por: Shi, Huiying, et al.
Publicado: (2025)
Uncovering Memorization Effect in the Presence of Spurious Correlations
por: You, Chenyu, et al.
Publicado: (2025)
por: You, Chenyu, et al.
Publicado: (2025)
VALD-MD: Visual Attribution via Latent Diffusion for Medical Diagnostics
por: Siddiqui, Ammar A., et al.
Publicado: (2024)
por: Siddiqui, Ammar A., et al.
Publicado: (2024)
End-to-end learned Lossy Dynamic Point Cloud Attribute Compression
por: Nguyen, Dat Thanh, et al.
Publicado: (2024)
por: Nguyen, Dat Thanh, et al.
Publicado: (2024)
Comparison of ConvNeXt and Vision-Language Models for Breast Density Assessment in Screening Mammography
por: Molina-Román, Yusdivia, et al.
Publicado: (2025)
por: Molina-Román, Yusdivia, et al.
Publicado: (2025)
PSI3D: Plug-and-Play 3D Stochastic Inference with Slice-wise Latent Diffusion Prior
por: Guo, Wenhan, et al.
Publicado: (2025)
por: Guo, Wenhan, et al.
Publicado: (2025)
Lossless Point Cloud Geometry and Attribute Compression Using a Learned Conditional Probability Model
por: Nguyen, Dat Thanh, et al.
Publicado: (2023)
por: Nguyen, Dat Thanh, et al.
Publicado: (2023)
Validating the Clinical Utility of CineECG 3D Reconstructions through Cross-Modal Feature Attribution
por: Dobiczek, Karol, et al.
Publicado: (2026)
por: Dobiczek, Karol, et al.
Publicado: (2026)
Scribe Verification in Chinese manuscripts using Siamese, Triplet, and Vision Transformer Neural Networks
por: Liakopoulos, Dimitrios-Chrysovalantis, et al.
Publicado: (2026)
por: Liakopoulos, Dimitrios-Chrysovalantis, et al.
Publicado: (2026)
Plug-and-Play Regularization on Magnitude with Deep Priors for 3D Near-Field MIMO Imaging
por: Oral, Okyanus, et al.
Publicado: (2023)
por: Oral, Okyanus, et al.
Publicado: (2023)
Neural Architecture Search generated Phase Retrieval Net for Real-time Off-axis Quantitative Phase Imaging
por: Shu, Xin, et al.
Publicado: (2022)
por: Shu, Xin, et al.
Publicado: (2022)
Learned Nonlinear Predictor for Critically Sampled 3D Point Cloud Attribute Compression
por: Do, Tam Thuc, et al.
Publicado: (2023)
por: Do, Tam Thuc, et al.
Publicado: (2023)
SmoothSegNet: A Global-Local Framework for Liver Tumor Segmentation with Clinical KnowledgeInformed Label Smoothing
por: Wang, Hairong, et al.
Publicado: (2024)
por: Wang, Hairong, et al.
Publicado: (2024)
A Deep Learning-Driven Pipeline for Differentiating Hypertrophic Cardiomyopathy from Cardiac Amyloidosis Using 2D Multi-View Echocardiography
por: Peng, Bo, et al.
Publicado: (2024)
por: Peng, Bo, et al.
Publicado: (2024)
SAR-GTR: Attributed Scattering Information Guided SAR Graph Transformer Recognition Algorithm
por: Xiong, Xuying, et al.
Publicado: (2025)
por: Xiong, Xuying, et al.
Publicado: (2025)
Mind Your Vision: Multimodal Estimation of Refractive Disorders Using Electrooculography and Eye Tracking
por: Wei, Xin, et al.
Publicado: (2025)
por: Wei, Xin, et al.
Publicado: (2025)
Lane-Wise Highway Anomaly Detection
por: Qiu, Mei, et al.
Publicado: (2025)
por: Qiu, Mei, et al.
Publicado: (2025)
Tiny-VBF: Resource-Efficient Vision Transformer based Lightweight Beamformer for Ultrasound Single-Angle Plane Wave Imaging
por: Rahoof, Abdul, et al.
Publicado: (2023)
por: Rahoof, Abdul, et al.
Publicado: (2023)
3D-U-SAM Network For Few-shot Tooth Segmentation in CBCT Images
por: Zhang, Yifu, et al.
Publicado: (2023)
por: Zhang, Yifu, et al.
Publicado: (2023)
RETO: A Rotary-Enhanced Transformer Operator for High-Fidelity Prediction of Automotive Aerodynamics
por: Zhang, Bojun, et al.
Publicado: (2026)
por: Zhang, Bojun, et al.
Publicado: (2026)
Incomplete Graph Learning: A Comprehensive Survey
por: Xia, Riting, et al.
Publicado: (2025)
por: Xia, Riting, et al.
Publicado: (2025)
Towards In-Vehicle Multi-Task Facial Attribute Recognition: Investigating Synthetic Data and Vision Foundation Models
por: Seraj, Esmaeil, et al.
Publicado: (2024)
por: Seraj, Esmaeil, et al.
Publicado: (2024)
Super Resolution Based on Deep Operator Networks
por: Yang, Siyuan
Publicado: (2024)
por: Yang, Siyuan
Publicado: (2024)
Comparative Analysis of ImageNet Pre-Trained Deep Learning Models and DINOv2 in Medical Imaging Classification
por: Huang, Yuning, et al.
Publicado: (2024)
por: Huang, Yuning, et al.
Publicado: (2024)
Beyond Single-Channel: Multichannel Signal Imaging for PPG-to-ECG Reconstruction with Vision Transformers
por: Li, Xiaoyan, et al.
Publicado: (2025)
por: Li, Xiaoyan, et al.
Publicado: (2025)
Learning the irreversible progression trajectory of Alzheimer's disease
por: Wang, Yipei, et al.
Publicado: (2024)
por: Wang, Yipei, et al.
Publicado: (2024)
Plug-and-Play Diffusion Meets ADMM: Dual-Variable Coupling for Robust Medical Image Reconstruction
por: Du, Chenhe, et al.
Publicado: (2026)
por: Du, Chenhe, et al.
Publicado: (2026)
NeuroMambaLLM: Dynamic Graph Learning of fMRI Functional Connectivity in Autistic Brains Using Mamba and Language Model Reasoning
por: Torabi, Yasaman, et al.
Publicado: (2026)
por: Torabi, Yasaman, et al.
Publicado: (2026)
Dynamic PET Image Prediction Using a Network Combining Reversible and Irreversible Modules
por: Sun, Jie, et al.
Publicado: (2024)
por: Sun, Jie, et al.
Publicado: (2024)
Beyond Manual Annotation: A Human-AI Collaborative Framework for Medical Image Segmentation Using Only "Better or Worse" Expert Feedback
por: Zhang, Yizhe
Publicado: (2025)
por: Zhang, Yizhe
Publicado: (2025)
Deep Unrolling of Sparsity-Induced RDO for 3D Point Cloud Attribute Coding
por: Do, Tam Thuc, et al.
Publicado: (2025)
por: Do, Tam Thuc, et al.
Publicado: (2025)
Deep Separable Spatiotemporal Learning for Fast Dynamic Cardiac MRI
por: Wang, Zi, et al.
Publicado: (2024)
por: Wang, Zi, et al.
Publicado: (2024)
Efficient Test-Time Adaptation through Latent Subspace Coefficients Search
por: Luo, Xinyu, et al.
Publicado: (2025)
por: Luo, Xinyu, et al.
Publicado: (2025)
Shrinking Your TimeStep: Towards Low-Latency Neuromorphic Object Recognition with Spiking Neural Network
por: Ding, Yongqi, et al.
Publicado: (2024)
por: Ding, Yongqi, et al.
Publicado: (2024)
Edge-boosted graph learning for functional brain connectivity analysis
por: Yang, David, et al.
Publicado: (2025)
por: Yang, David, et al.
Publicado: (2025)
Leveraging Second-Order Curvature for Efficient Learned Image Compression: Theory and Empirical Evidence
por: Zhang, Yichi, et al.
Publicado: (2026)
por: Zhang, Yichi, et al.
Publicado: (2026)
A Literature Review on Fetus Brain Motion Correction in MRI
por: Zhang, Haoran, et al.
Publicado: (2024)
por: Zhang, Haoran, et al.
Publicado: (2024)
DiSC-Med: Diffusion-based Semantic Communications for Robust Medical Image Transmission
por: Guo, Fupei, et al.
Publicado: (2025)
por: Guo, Fupei, et al.
Publicado: (2025)
Physics-Aware Neural Operators for Direct Inversion in 3D Photoacoustic Tomography
por: Wang, Jiayun, et al.
Publicado: (2025)
por: Wang, Jiayun, et al.
Publicado: (2025)
On Privacy-Preserving Image Transmission in Low-Altitude Networks: A Swin Transformer-Based Framework with Federated Learning
por: Zhang, Kexin, et al.
Publicado: (2026)
por: Zhang, Kexin, et al.
Publicado: (2026)
Ejemplares similares
-
Remote Sensing Semantic Segmentation Quality Assessment based on Vision Language Model
por: Shi, Huiying, et al.
Publicado: (2025) -
Uncovering Memorization Effect in the Presence of Spurious Correlations
por: You, Chenyu, et al.
Publicado: (2025) -
VALD-MD: Visual Attribution via Latent Diffusion for Medical Diagnostics
por: Siddiqui, Ammar A., et al.
Publicado: (2024) -
End-to-end learned Lossy Dynamic Point Cloud Attribute Compression
por: Nguyen, Dat Thanh, et al.
Publicado: (2024) -
Comparison of ConvNeXt and Vision-Language Models for Breast Density Assessment in Screening Mammography
por: Molina-Román, Yusdivia, et al.
Publicado: (2025)