Beyond Images: Adaptive Fusion of Visual and Textual Data for Food Classification
Fuente:
arXiv
Saved in:
| Main Authors: | Mittal, Prateek, Goyal, Puneet, Chauhan, Joohi |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multimodal Approaches to Fair Image Classification: An Ethical Perspective
by: Hickmon, Javon
Published: (2024)
by: Hickmon, Javon
Published: (2024)
Beyond Human Vision: The Role of Large Vision Language Models in Microscope Image Analysis
by: Verma, Prateek, et al.
Published: (2024)
by: Verma, Prateek, et al.
Published: (2024)
Looking Beyond What You See: An Empirical Analysis on Subgroup Intersectional Fairness for Multi-label Chest X-ray Classification Using Social Determinants of Racial Health Inequities
by: Moukheiber, Dana, et al.
Published: (2024)
by: Moukheiber, Dana, et al.
Published: (2024)
Mixture of Nested Experts: Adaptive Processing of Visual Tokens
by: Jain, Gagan, et al.
Published: (2024)
by: Jain, Gagan, et al.
Published: (2024)
Classification for everyone : Building geography agnostic models for fairer recognition
by: Jindal, Akshat, et al.
Published: (2023)
by: Jindal, Akshat, et al.
Published: (2023)
Epistemic Uncertainty-Weighted Loss for Visual Bias Mitigation
by: Stone, Rebecca S, et al.
Published: (2022)
by: Stone, Rebecca S, et al.
Published: (2022)
Estimating Environmental Cost Throughout Model's Adaptive Life Cycle
by: Sangarya, Vishwesh, et al.
Published: (2024)
by: Sangarya, Vishwesh, et al.
Published: (2024)
Leveraging Self-Supervised Learning for Scene Classification in Child Sexual Abuse Imagery
by: Valois, Pedro H. V., et al.
Published: (2024)
by: Valois, Pedro H. V., et al.
Published: (2024)
Enhancing Fairness in Skin Lesion Classification for Medical Diagnosis Using Prune Learning
by: Paxton, Kuniko, et al.
Published: (2025)
by: Paxton, Kuniko, et al.
Published: (2025)
A Self-Supervised Learning Pipeline for Demographically Fair Facial Attribute Classification
by: Ramachandran, Sreeraj, et al.
Published: (2024)
by: Ramachandran, Sreeraj, et al.
Published: (2024)
TransFair: Transferring Fairness from Ocular Disease Classification to Progression Prediction
by: Gheisi, Leila, et al.
Published: (2024)
by: Gheisi, Leila, et al.
Published: (2024)
MultiFair: Multimodal Balanced Fairness-Aware Medical Classification with Dual-Level Gradient Modulation
by: Zubair, Md, et al.
Published: (2025)
by: Zubair, Md, et al.
Published: (2025)
Sustainable Intelligence for the Wild: Democratizing Ecological Monitoring via Knowledge-Adaptive Edge Expert Agents
by: Li, Jiaxing, et al.
Published: (2026)
by: Li, Jiaxing, et al.
Published: (2026)
CLIPErase: Efficient Unlearning of Visual-Textual Associations in CLIP
by: Yang, Tianyu, et al.
Published: (2024)
by: Yang, Tianyu, et al.
Published: (2024)
Finetuning Text-to-Image Diffusion Models for Fairness
by: Shen, Xudong, et al.
Published: (2023)
by: Shen, Xudong, et al.
Published: (2023)
Fair Text-to-Image Diffusion via Fair Mapping
by: Li, Jia, et al.
Published: (2023)
by: Li, Jia, et al.
Published: (2023)
Hidden Bias in the Machine: Stereotypes in Text-to-Image Models
by: Porikli, Sedat, et al.
Published: (2025)
by: Porikli, Sedat, et al.
Published: (2025)
Towards Transferable Defense Against Malicious Image Edits
by: Zhang, Jie, et al.
Published: (2025)
by: Zhang, Jie, et al.
Published: (2025)
Data-Driven Fairness Generalization for Deepfake Detection
by: Ezeakunne, Uzoamaka, et al.
Published: (2024)
by: Ezeakunne, Uzoamaka, et al.
Published: (2024)
Exploiting Cultural Biases via Homoglyphs in Text-to-Image Synthesis
by: Struppek, Lukas, et al.
Published: (2022)
by: Struppek, Lukas, et al.
Published: (2022)
Automated Toll Management System Using RFID and Image Processing
by: Ahmed, Raihan, et al.
Published: (2024)
by: Ahmed, Raihan, et al.
Published: (2024)
Ordinal Adaptive Correction: A Data-Centric Approach to Ordinal Image Classification with Noisy Labels
by: Moghaddam, Alireza Sedighi, et al.
Published: (2025)
by: Moghaddam, Alireza Sedighi, et al.
Published: (2025)
Masked Generative Nested Transformers with Decode Time Scaling
by: Goyal, Sahil, et al.
Published: (2025)
by: Goyal, Sahil, et al.
Published: (2025)
Semantic Mismatch and Perceptual Degradation: A New Perspective on Image Editing Immunity
by: Dong, Shuai, et al.
Published: (2025)
by: Dong, Shuai, et al.
Published: (2025)
Demographic Bias of Expert-Level Vision-Language Foundation Models in Medical Imaging
by: Yang, Yuzhe, et al.
Published: (2024)
by: Yang, Yuzhe, et al.
Published: (2024)
DiffusionWorldViewer: Exposing and Broadening the Worldview Reflected by Generative Text-to-Image Models
by: De Simone, Zoe, et al.
Published: (2023)
by: De Simone, Zoe, et al.
Published: (2023)
Slicing Through Bias: Explaining Performance Gaps in Medical Image Analysis using Slice Discovery Methods
by: Olesen, Vincent, et al.
Published: (2024)
by: Olesen, Vincent, et al.
Published: (2024)
Second Edition FRCSyn Challenge at CVPR 2024: Face Recognition Challenge in the Era of Synthetic Data
by: DeAndres-Tame, Ivan, et al.
Published: (2024)
by: DeAndres-Tame, Ivan, et al.
Published: (2024)
Second FRCSyn-onGoing: Winning Solutions and Post-Challenge Analysis to Improve Face Recognition with Synthetic Data
by: DeAndres-Tame, Ivan, et al.
Published: (2024)
by: DeAndres-Tame, Ivan, et al.
Published: (2024)
On Biases in a UK Biobank-based Retinal Image Classification Model
by: Alloula, Anissa, et al.
Published: (2024)
by: Alloula, Anissa, et al.
Published: (2024)
BiPrompt: Bilateral Prompt Optimization for Visual and Textual Debiasing in Vision-Language Models
by: Gupta, Sunny, et al.
Published: (2026)
by: Gupta, Sunny, et al.
Published: (2026)
Jailbreaking Vision-Language Models Through the Visual Modality
by: Azulay, Aharon, et al.
Published: (2026)
by: Azulay, Aharon, et al.
Published: (2026)
CapsFusion: Rethinking Image-Text Data at Scale
by: Yu, Qiying, et al.
Published: (2023)
by: Yu, Qiying, et al.
Published: (2023)
Adaptive Knowledge Distillation for Classification of Hand Images using Explainable Vision Transformers
by: Nguyen, Thanh Thi, et al.
Published: (2024)
by: Nguyen, Thanh Thi, et al.
Published: (2024)
ConTextual: Evaluating Context-Sensitive Text-Rich Visual Reasoning in Large Multimodal Models
by: Wadhawan, Rohan, et al.
Published: (2024)
by: Wadhawan, Rohan, et al.
Published: (2024)
Why are Visually-Grounded Language Models Bad at Image Classification?
by: Zhang, Yuhui, et al.
Published: (2024)
by: Zhang, Yuhui, et al.
Published: (2024)
Embedding an Ethical Mind: Aligning Text-to-Image Synthesis via Lightweight Value Optimization
by: Wang, Xingqi, et al.
Published: (2024)
by: Wang, Xingqi, et al.
Published: (2024)
LLaVA-Zip: Adaptive Visual Token Compression with Intrinsic Image Information
by: Wang, Ke, et al.
Published: (2024)
by: Wang, Ke, et al.
Published: (2024)
Improving Sickle Cell Disease Classification: A Fusion of Conventional Classifiers, Segmented Images, and Convolutional Neural Networks
by: Cardoso, Victor Júnio Alcântara, et al.
Published: (2024)
by: Cardoso, Victor Júnio Alcântara, et al.
Published: (2024)
RadDiff: Describing Differences in Radiology Image Sets with Natural Language
by: Shen, Xiaoxian, et al.
Published: (2026)
by: Shen, Xiaoxian, et al.
Published: (2026)
Similar Items
-
Multimodal Approaches to Fair Image Classification: An Ethical Perspective
by: Hickmon, Javon
Published: (2024) -
Beyond Human Vision: The Role of Large Vision Language Models in Microscope Image Analysis
by: Verma, Prateek, et al.
Published: (2024) -
Looking Beyond What You See: An Empirical Analysis on Subgroup Intersectional Fairness for Multi-label Chest X-ray Classification Using Social Determinants of Racial Health Inequities
by: Moukheiber, Dana, et al.
Published: (2024) -
Mixture of Nested Experts: Adaptive Processing of Visual Tokens
by: Jain, Gagan, et al.
Published: (2024) -
Classification for everyone : Building geography agnostic models for fairer recognition
by: Jindal, Akshat, et al.
Published: (2023)