Comprehensive Evaluation of Large Multimodal Models for Nutrition Analysis: A New Benchmark Enriched with Contextual Metadata
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Coburn, Bruce, He, Jiangpeng, Rollo, Megan E., Dhaliwal, Satvinder S., Kerr, Deborah A., Zhu, Fengqing |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Size Matters: Reconstructing Real-Scale 3D Models from Monocular Images for Food Portion Estimation
par: Vinod, Gautham, et autres
Publié: (2026)
par: Vinod, Gautham, et autres
Publié: (2026)
Gradient Reweighting: Towards Imbalanced Class-Incremental Learning
par: He, Jiangpeng, et autres
Publié: (2024)
par: He, Jiangpeng, et autres
Publié: (2024)
Can You Hear, Localize, and Segment Continually? An Exemplar-Free Continual Learning Benchmark for Audio-Visual Segmentation
par: Raghavan, Siddeshwar, et autres
Publié: (2026)
par: Raghavan, Siddeshwar, et autres
Publié: (2026)
CL-LoRA: Continual Low-Rank Adaptation for Rehearsal-Free Class-Incremental Learning
par: He, Jiangpeng, et autres
Publié: (2025)
par: He, Jiangpeng, et autres
Publié: (2025)
Robust3D-CIL: Robust Class-Incremental Learning for 3D Perception
par: Ma, Jinge, et autres
Publié: (2025)
par: Ma, Jinge, et autres
Publié: (2025)
Online Class-Incremental Learning For Real-World Food Image Classification
par: Raghavan, Siddeshwar, et autres
Publié: (2023)
par: Raghavan, Siddeshwar, et autres
Publié: (2023)
FMiFood: Multi-modal Contrastive Learning for Food Image Classification
par: Pan, Xinyue, et autres
Publié: (2024)
par: Pan, Xinyue, et autres
Publié: (2024)
DELTA: Decoupling Long-Tailed Online Continual Learning
par: Raghavan, Siddeshwar, et autres
Publié: (2024)
par: Raghavan, Siddeshwar, et autres
Publié: (2024)
Implicit-Scale 3D Reconstruction for Multi-Food Volume Estimation from Monocular Images
par: Chen, Yuhao, et autres
Publié: (2026)
par: Chen, Yuhao, et autres
Publié: (2026)
Learning to Classify New Foods Incrementally Via Compressed Exemplars
par: Yang, Justin, et autres
Publié: (2024)
par: Yang, Justin, et autres
Publié: (2024)
PANDA -- Patch And Distribution-Aware Augmentation for Long-Tailed Exemplar-Free Continual Learning
par: Raghavan, Siddeshwar, et autres
Publié: (2025)
par: Raghavan, Siddeshwar, et autres
Publié: (2025)
DietDelta: A Vision-Language Approach for Dietary Assessment via Before-and-After Images
par: Vinod, Gautham, et autres
Publié: (2026)
par: Vinod, Gautham, et autres
Publié: (2026)
Not Your Stereo-Typical Estimator: Combining Vision and Language for Volume Perception
par: Vinod, Gautham, et autres
Publié: (2026)
par: Vinod, Gautham, et autres
Publié: (2026)
Effectiveness of Digital Health Interventions on Body Weight and Dietary Intake Outcomes Among Culturally and Linguistically Diverse (CALD) and Indigenous Populations: A Systematic Review
par: Amira Hassan, et autres
Publié: (2025)
par: Amira Hassan, et autres
Publié: (2025)
MetaFood3D: 3D Food Dataset with Nutrition Values
par: Chen, Yuhao, et autres
Publié: (2024)
par: Chen, Yuhao, et autres
Publié: (2024)
Food Image Generation on Multi-Noun Categories
par: Pan, Xinyue, et autres
Publié: (2025)
par: Pan, Xinyue, et autres
Publié: (2025)
Strategies to Improve Real-World Applicability of Laparoscopic Anatomy Segmentation Models
par: Kolbinger, Fiona R., et autres
Publié: (2024)
par: Kolbinger, Fiona R., et autres
Publié: (2024)
Food Portion Estimation via 3D Object Scaling
par: Vinod, Gautham, et autres
Publié: (2024)
par: Vinod, Gautham, et autres
Publié: (2024)
Probing Image Compression For Class-Incremental Learning
par: Yang, Justin, et autres
Publié: (2024)
par: Yang, Justin, et autres
Publié: (2024)
V-Nutri: Dish-Level Nutrition Estimation from Egocentric Cooking Videos
par: Yue, Chengkun, et autres
Publié: (2026)
par: Yue, Chengkun, et autres
Publié: (2026)
MFP3D: Monocular Food Portion Estimation Leveraging 3D Point Clouds
par: Ma, Jinge, et autres
Publié: (2024)
par: Ma, Jinge, et autres
Publié: (2024)
Long-Tailed Continual Learning For Visual Food Recognition
par: He, Jiangpeng, et autres
Publié: (2023)
par: He, Jiangpeng, et autres
Publié: (2023)
MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models
par: Fu, Chaoyou, et autres
Publié: (2023)
par: Fu, Chaoyou, et autres
Publié: (2023)
OpenDCVCs: A PyTorch Open Source Implementation and Performance Evaluation of the DCVC series Video Codecs
par: Zhang, Yichi, et autres
Publié: (2025)
par: Zhang, Yichi, et autres
Publié: (2025)
Dual-Imbalance Continual Learning for Real-World Food Recognition
par: Zhang, Xiaoyan, et autres
Publié: (2026)
par: Zhang, Xiaoyan, et autres
Publié: (2026)
FPBench: A Comprehensive Benchmark of Multimodal Large Language Models for Fingerprint Analysis
par: Gavas, Ekta, et autres
Publié: (2025)
par: Gavas, Ekta, et autres
Publié: (2025)
LMOD+: A Comprehensive Multimodal Dataset and Benchmark for Developing and Evaluating Multimodal Large Language Models in Ophthalmology
par: Qin, Zhenyue, et autres
Publié: (2025)
par: Qin, Zhenyue, et autres
Publié: (2025)
Reefknot: A Comprehensive Benchmark for Relation Hallucination Evaluation, Analysis and Mitigation in Multimodal Large Language Models
par: Zheng, Kening, et autres
Publié: (2024)
par: Zheng, Kening, et autres
Publié: (2024)
One Adapter for All: Towards Unified Representation in Step-Imbalanced Class-Incremental Learning
par: Zhang, Xiaoyan, et autres
Publié: (2026)
par: Zhang, Xiaoyan, et autres
Publié: (2026)
UrBench: A Comprehensive Benchmark for Evaluating Large Multimodal Models in Multi-View Urban Scenarios
par: Zhou, Baichuan, et autres
Publié: (2024)
par: Zhou, Baichuan, et autres
Publié: (2024)
Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain
par: Luo, Yulin, et autres
Publié: (2025)
par: Luo, Yulin, et autres
Publié: (2025)
Automatic Recognition of Food Ingestion Environment from the AIM-2 Wearable Sensor
par: Huang, Yuning, et autres
Publié: (2024)
par: Huang, Yuning, et autres
Publié: (2024)
OmniMedVQA: A New Large-Scale Comprehensive Evaluation Benchmark for Medical LVLM
par: Hu, Yutao, et autres
Publié: (2024)
par: Hu, Yutao, et autres
Publié: (2024)
CC-OCR: A Comprehensive and Challenging OCR Benchmark for Evaluating Large Multimodal Models in Literacy
par: Yang, Zhibo, et autres
Publié: (2024)
par: Yang, Zhibo, et autres
Publié: (2024)
ICP-3DGS: SfM-free 3D Gaussian Splatting for Large-scale Unbounded Scenes
par: Zhang, Chenhao, et autres
Publié: (2025)
par: Zhang, Chenhao, et autres
Publié: (2025)
LOKI: A Comprehensive Synthetic Data Detection Benchmark using Large Multimodal Models
par: Ye, Junyan, et autres
Publié: (2024)
par: Ye, Junyan, et autres
Publié: (2024)
SPORTU: A Comprehensive Sports Understanding Benchmark for Multimodal Large Language Models
par: Xia, Haotian, et autres
Publié: (2024)
par: Xia, Haotian, et autres
Publié: (2024)
MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI
par: Ying, Kaining, et autres
Publié: (2024)
par: Ying, Kaining, et autres
Publié: (2024)
CrossVid: A Comprehensive Benchmark for Evaluating Cross-Video Reasoning in Multimodal Large Language Models
par: Li, Jingyao, et autres
Publié: (2025)
par: Li, Jingyao, et autres
Publié: (2025)
Benchmarking Large Vision-Language Models on CFMME: A Comprehensive Chinese Financial Multimodal Evaluation Dataset
par: Chen, Qian, et autres
Publié: (2026)
par: Chen, Qian, et autres
Publié: (2026)
Documents similaires
-
Size Matters: Reconstructing Real-Scale 3D Models from Monocular Images for Food Portion Estimation
par: Vinod, Gautham, et autres
Publié: (2026) -
Gradient Reweighting: Towards Imbalanced Class-Incremental Learning
par: He, Jiangpeng, et autres
Publié: (2024) -
Can You Hear, Localize, and Segment Continually? An Exemplar-Free Continual Learning Benchmark for Audio-Visual Segmentation
par: Raghavan, Siddeshwar, et autres
Publié: (2026) -
CL-LoRA: Continual Low-Rank Adaptation for Rehearsal-Free Class-Incremental Learning
par: He, Jiangpeng, et autres
Publié: (2025) -
Robust3D-CIL: Robust Class-Incremental Learning for 3D Perception
par: Ma, Jinge, et autres
Publié: (2025)