FAM-Bench: A Multimodal Benchmark for Condition-Aware Food-as-Medicine Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mao, Mingyang, Medisetti, Bhargav Rishi, Grover, Utkarsh, Ibrahim, Tanvir, Li, Wenyan, Zhang, Tingting, Lin, Xiaomin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RAZOR: Ratio-Aware Layer Editing for Targeted Unlearning in Vision Transformers and Diffusion Models
par: Ranjan, Ravi, et autres
Publié: (2026)
par: Ranjan, Ravi, et autres
Publié: (2026)
PERSA: Reinforcement Learning for Professor-Style Personalized Feedback with LLMs
par: Ranjan, Ravi, et autres
Publié: (2026)
par: Ranjan, Ravi, et autres
Publié: (2026)
G-Drift MIA: Membership Inference via Gradient-Induced Feature Drift in LLMs
par: Ranjan, Ravi, et autres
Publié: (2026)
par: Ranjan, Ravi, et autres
Publié: (2026)
CatRAG: Functor-Guided Structural Debiasing with Retrieval Augmentation for Fair LLMs
par: Ranjan, Ravi, et autres
Publié: (2026)
par: Ranjan, Ravi, et autres
Publié: (2026)
FeynmanBench: Benchmarking Multimodal LLMs on Diagrammatic Physics Reasoning
par: Wang, Zeyu, et autres
Publié: (2026)
par: Wang, Zeyu, et autres
Publié: (2026)
Multi-RAG: A Multimodal Retrieval-Augmented Generation System for Adaptive Video Understanding
par: Mao, Mingyang, et autres
Publié: (2025)
par: Mao, Mingyang, et autres
Publié: (2025)
Embodied Foundation Models at the Edge: A Survey of Deployment Constraints and Mitigation Strategies
par: Grover, Utkarsh, et autres
Publié: (2026)
par: Grover, Utkarsh, et autres
Publié: (2026)
Position: LLMs Must Use Functor-Based and RAG-Driven Bias Mitigation for Fairness
par: Ranjan, Ravi, et autres
Publié: (2026)
par: Ranjan, Ravi, et autres
Publié: (2026)
WeatherReasonSeg: A Benchmark for Weather-Aware Reasoning Segmentation in Visual Language Models
par: Du, Wanjun, et autres
Publié: (2026)
par: Du, Wanjun, et autres
Publié: (2026)
MorphoBench: A Benchmark with Difficulty Adaptive to Model Reasoning
par: Wang, Xukai, et autres
Publié: (2025)
par: Wang, Xukai, et autres
Publié: (2025)
BilliardPhys-Bench: Benchmarking Physical Reasoning and Visual Dynamics of Multimodal LLMs
par: Wang, Ben, et autres
Publié: (2026)
par: Wang, Ben, et autres
Publié: (2026)
MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models
par: Zhou, Pengfei, et autres
Publié: (2025)
par: Zhou, Pengfei, et autres
Publié: (2025)
AbstentionBench: Reasoning LLMs Fail on Unanswerable Questions
par: Kirichenko, Polina, et autres
Publié: (2025)
par: Kirichenko, Polina, et autres
Publié: (2025)
PetroBench: A Benchmark for Large Language Models in Petroleum Engineering
par: Wang, Xiang, et autres
Publié: (2026)
par: Wang, Xiang, et autres
Publié: (2026)
ICU-Bench:Benchmarking Continual Unlearning in Multimodal Large Language Models
par: Wang, Yuhang, et autres
Publié: (2026)
par: Wang, Yuhang, et autres
Publié: (2026)
SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition
par: Xu, Peiran, et autres
Publié: (2025)
par: Xu, Peiran, et autres
Publié: (2025)
EarthSpatialBench: Benchmarking Spatial Reasoning Capabilities of Multimodal LLMs on Earth Imagery
par: Xu, Zelin, et autres
Publié: (2026)
par: Xu, Zelin, et autres
Publié: (2026)
OmniMatBench: A Human-Calibrated Multimodal Reasoning Benchmark Across 19 Materials Science Subfields
par: Liu, Wanhao, et autres
Publié: (2026)
par: Liu, Wanhao, et autres
Publié: (2026)
SciVideoBench: Benchmarking Scientific Video Reasoning in Large Multimodal Models
par: Deng, Andong, et autres
Publié: (2025)
par: Deng, Andong, et autres
Publié: (2025)
$A^3$-Bench: Benchmarking Memory-Driven Scientific Reasoning via Anchor and Attractor Activation
par: Zhang, Jian, et autres
Publié: (2026)
par: Zhang, Jian, et autres
Publié: (2026)
GamiBench: Evaluating Spatial Reasoning and 2D-to-3D Planning Capabilities of MLLMs with Origami Folding Tasks
par: Spencer, Ryan, et autres
Publié: (2025)
par: Spencer, Ryan, et autres
Publié: (2025)
On Path to Multimodal Historical Reasoning: HistBench and HistAgent
par: Qiu, Jiahao, et autres
Publié: (2025)
par: Qiu, Jiahao, et autres
Publié: (2025)
MMR-Bench: A Comprehensive Benchmark for Multimodal LLM Routing
par: Ma, Haoxuan, et autres
Publié: (2026)
par: Ma, Haoxuan, et autres
Publié: (2026)
MLLM-CompBench: A Comparative Reasoning Benchmark for Multimodal LLMs
par: Kil, Jihyung, et autres
Publié: (2024)
par: Kil, Jihyung, et autres
Publié: (2024)
FinMR: A Knowledge-Intensive Multimodal Benchmark for Advanced Financial Reasoning
par: Deng, Shuangyan, et autres
Publié: (2025)
par: Deng, Shuangyan, et autres
Publié: (2025)
SUPERChem: A Multimodal Reasoning Benchmark in Chemistry
par: Zhao, Zehua, et autres
Publié: (2025)
par: Zhao, Zehua, et autres
Publié: (2025)
CriticBench: Benchmarking LLMs for Critique-Correct Reasoning
par: Lin, Zicheng, et autres
Publié: (2024)
par: Lin, Zicheng, et autres
Publié: (2024)
VerifyBench: A Systematic Benchmark for Evaluating Reasoning Verifiers Across Domains
par: Li, Xuzhao, et autres
Publié: (2025)
par: Li, Xuzhao, et autres
Publié: (2025)
ConstraintBench: Benchmarking LLM Constraint Reasoning on Direct Optimization
par: Tso, Joseph, et autres
Publié: (2026)
par: Tso, Joseph, et autres
Publié: (2026)
SMH-Bench: Benchmarking LLM Agents for Environment-Grounded Reasoning and Action in Smart Homes
par: Li, Kuan, et autres
Publié: (2026)
par: Li, Kuan, et autres
Publié: (2026)
CARV: A Diagnostic Benchmark for Compositional Analogical Reasoning in Multimodal LLMs
par: Du, Yongkang, et autres
Publié: (2026)
par: Du, Yongkang, et autres
Publié: (2026)
EgoBench: An Interactive Egocentric Multimodal Benchmark for Tool-Using Agents
par: Liu, Yunqi, et autres
Publié: (2026)
par: Liu, Yunqi, et autres
Publié: (2026)
AECV-Bench: Benchmarking Multimodal Models on Architectural and Engineering Drawings Understanding
par: Kondratenko, Aleksei, et autres
Publié: (2026)
par: Kondratenko, Aleksei, et autres
Publié: (2026)
PalmBench: A Comprehensive Benchmark of Compressed Large Language Models on Mobile Platforms
par: Li, Yilong, et autres
Publié: (2024)
par: Li, Yilong, et autres
Publié: (2024)
ERGeoBench:A Comprehensive Benchmark for Embodied Reasoning and Geo-localization in Multimodal Large Language Models
par: Xue, Kaiwen, et autres
Publié: (2026)
par: Xue, Kaiwen, et autres
Publié: (2026)
M3Retrieve: Benchmarking Multimodal Retrieval for Medicine
par: Acharya, Arkadeep, et autres
Publié: (2025)
par: Acharya, Arkadeep, et autres
Publié: (2025)
GeoGramBench: Benchmarking the Geometric Program Reasoning in Modern LLMs
par: Luo, Shixian, et autres
Publié: (2025)
par: Luo, Shixian, et autres
Publié: (2025)
SymPyBench: A Dynamic Benchmark for Scientific Reasoning with Executable Python Code
par: Imani, Shima, et autres
Publié: (2025)
par: Imani, Shima, et autres
Publié: (2025)
AJ-Bench: Benchmarking Agent-as-a-Judge for Environment-Aware Evaluation
par: Shi, Wentao, et autres
Publié: (2026)
par: Shi, Wentao, et autres
Publié: (2026)
TopoBench: Benchmarking LLMs on Hard Topological Reasoning
par: Maniparambil, Mayug, et autres
Publié: (2026)
par: Maniparambil, Mayug, et autres
Publié: (2026)
Documents similaires
-
RAZOR: Ratio-Aware Layer Editing for Targeted Unlearning in Vision Transformers and Diffusion Models
par: Ranjan, Ravi, et autres
Publié: (2026) -
PERSA: Reinforcement Learning for Professor-Style Personalized Feedback with LLMs
par: Ranjan, Ravi, et autres
Publié: (2026) -
G-Drift MIA: Membership Inference via Gradient-Induced Feature Drift in LLMs
par: Ranjan, Ravi, et autres
Publié: (2026) -
CatRAG: Functor-Guided Structural Debiasing with Retrieval Augmentation for Fair LLMs
par: Ranjan, Ravi, et autres
Publié: (2026) -
FeynmanBench: Benchmarking Multimodal LLMs on Diagrammatic Physics Reasoning
par: Wang, Zeyu, et autres
Publié: (2026)