ReX-MLE: The Autonomous Agent Benchmark for Medical Imaging Challenges
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kenia, Roshan, Zhang, Xiaoman, Rajpurkar, Pranav |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ReXSonoVQA: A Video QA Benchmark for Procedure-Centric Ultrasound Understanding
par: Wang, Xucheng, et autres
Publié: (2026)
par: Wang, Xucheng, et autres
Publié: (2026)
FactCheXcker: Mitigating Measurement Hallucinations in Chest X-ray Report Generation Models
par: Heiman, Alice, et autres
Publié: (2024)
par: Heiman, Alice, et autres
Publié: (2024)
ReXGradient-160K: A Large-Scale Publicly Available Dataset of Chest Radiographs with Free-text Reports
par: Zhang, Xiaoman, et autres
Publié: (2025)
par: Zhang, Xiaoman, et autres
Publié: (2025)
MedAutoCorrect: Image-Conditioned Autocorrection in Medical Reporting
par: Asiimwe, Arnold Caleb, et autres
Publié: (2024)
par: Asiimwe, Arnold Caleb, et autres
Publié: (2024)
ReXInTheWild: A Unified Benchmark for Medical Photograph Understanding
par: Banerjee, Oishi, et autres
Publié: (2026)
par: Banerjee, Oishi, et autres
Publié: (2026)
Uncovering Knowledge Gaps in Radiology Report Generation Models through Knowledge Graphs
par: Zhang, Xiaoman, et autres
Publié: (2024)
par: Zhang, Xiaoman, et autres
Publié: (2024)
ReXVQA: A Large-scale Visual Question Answering Benchmark for Generalist Chest X-ray Understanding
par: Pal, Ankit, et autres
Publié: (2025)
par: Pal, Ankit, et autres
Publié: (2025)
Learning Generalized Medical Image Representations through Image-Graph Contrastive Pretraining
par: Khanna, Sameer, et autres
Publié: (2024)
par: Khanna, Sameer, et autres
Publié: (2024)
Evaluating Contextual Intelligence in Recyclability: A Comprehensive Study of Image-Based Reasoning Systems
par: Park, Eliot, et autres
Publié: (2025)
par: Park, Eliot, et autres
Publié: (2025)
ReXrank: A Public Leaderboard for AI-Powered Radiology Report Generation
par: Zhang, Xiaoman, et autres
Publié: (2024)
par: Zhang, Xiaoman, et autres
Publié: (2024)
3DReasonKnee: Advancing Grounded Reasoning in Medical Vision Language Models
par: Sambara, Sraavya, et autres
Publié: (2025)
par: Sambara, Sraavya, et autres
Publié: (2025)
MedVersa: A Generalist Foundation Model for Medical Image Interpretation
par: Zhou, Hong-Yu, et autres
Publié: (2024)
par: Zhou, Hong-Yu, et autres
Publié: (2024)
3D ReX: Causal Explanations in 3D Neuroimaging Classification
par: Navaratnarajah, Melane, et autres
Publié: (2025)
par: Navaratnarajah, Melane, et autres
Publié: (2025)
Multimodal Foundation Models Exploit Text to Make Medical Image Predictions
par: Buckley, Thomas, et autres
Publié: (2023)
par: Buckley, Thomas, et autres
Publié: (2023)
MedFrameQA: A Multi-Image Medical VQA Benchmark for Clinical Reasoning
par: Yu, Suhao, et autres
Publié: (2025)
par: Yu, Suhao, et autres
Publié: (2025)
RadFlag: A Black-Box Hallucination Detection Method for Medical Vision Language Models
par: Zhang, Serena, et autres
Publié: (2024)
par: Zhang, Serena, et autres
Publié: (2024)
ColonCrafter: A Depth Estimation Model for Colonoscopy Videos Using Diffusion Priors
par: Hardy, Romain, et autres
Publié: (2025)
par: Hardy, Romain, et autres
Publié: (2025)
Medical Image De-Identification Benchmark Challenge
par: Pei, Linmin, et autres
Publié: (2025)
par: Pei, Linmin, et autres
Publié: (2025)
Benchmarking Real-World Medical Image Classification with Noisy Labels: Challenges, Practice, and Outlook
par: Ma, Yuan, et autres
Publié: (2025)
par: Ma, Yuan, et autres
Publié: (2025)
Towards All-in-One Medical Image Re-Identification
par: Tian, Yuan, et autres
Publié: (2025)
par: Tian, Yuan, et autres
Publié: (2025)
X-Mark: Saliency-Guided Robust Dataset Ownership Verification for Medical Imaging
par: Kulkarni, Pranav, et autres
Publié: (2026)
par: Kulkarni, Pranav, et autres
Publié: (2026)
AI-CNet3D: An Anatomically-Informed Cross-Attention Network with Multi-Task Consistency Fine-tuning for 3D Glaucoma Classification
par: Kenia, Roshan, et autres
Publié: (2025)
par: Kenia, Roshan, et autres
Publié: (2025)
Exploring Intrinsic Properties of Medical Images for Self-Supervised Binary Semantic Segmentation
par: Singh, Pranav, et autres
Publié: (2024)
par: Singh, Pranav, et autres
Publié: (2024)
a2z-1 for Multi-Disease Detection in Abdomen-Pelvis CT: External Validation and Performance Analysis Across 21 Conditions
par: Rajpurkar, Pranav, et autres
Publié: (2024)
par: Rajpurkar, Pranav, et autres
Publié: (2024)
PhysMLE: Generalizable and Priors-Inclusive Multi-task Remote Physiological Measurement
par: Wang, Jiyao, et autres
Publié: (2024)
par: Wang, Jiyao, et autres
Publié: (2024)
COOOL: Challenge Of Out-Of-Label A Novel Benchmark for Autonomous Driving
par: AlShami, Ali K., et autres
Publié: (2024)
par: AlShami, Ali K., et autres
Publié: (2024)
Large-Vocabulary Segmentation for Medical Images with Text Prompts
par: Zhao, Ziheng, et autres
Publié: (2023)
par: Zhao, Ziheng, et autres
Publié: (2023)
PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering
par: Zhang, Xiaoman, et autres
Publié: (2023)
par: Zhang, Xiaoman, et autres
Publié: (2023)
A New Benchmark and Model for Challenging Image Manipulation Detection
par: Zhang, Zhenfei, et autres
Publié: (2023)
par: Zhang, Zhenfei, et autres
Publié: (2023)
MLE-UVAD: Minimal Latent Entropy Autoencoder for Fully Unsupervised Video Anomaly Detection
par: Geng, Yuang, et autres
Publié: (2026)
par: Geng, Yuang, et autres
Publié: (2026)
CoRe: Joint Optimization with Contrastive Learning for Medical Image Registration
par: Kats, Eytan, et autres
Publié: (2026)
par: Kats, Eytan, et autres
Publié: (2026)
MedSG-Bench: A Benchmark for Medical Image Sequences Grounding
par: Yue, Jingkun, et autres
Publié: (2025)
par: Yue, Jingkun, et autres
Publié: (2025)
CleanStyle: Plug-and-Play Style Conditioning Purification for Text-to-Image Stylization
par: Feng, Xiaoman, et autres
Publié: (2026)
par: Feng, Xiaoman, et autres
Publié: (2026)
Direct Preference Optimization for Suppressing Hallucinated Prior Exams in Radiology Report Generation
par: Banerjee, Oishi, et autres
Publié: (2024)
par: Banerjee, Oishi, et autres
Publié: (2024)
Open Challenges on Fairness of Artificial Intelligence in Medical Imaging Applications
par: Ferrante, Enzo, et autres
Publié: (2024)
par: Ferrante, Enzo, et autres
Publié: (2024)
Interactive Medical Image Segmentation: A Benchmark Dataset and Baseline
par: Cheng, Junlong, et autres
Publié: (2024)
par: Cheng, Junlong, et autres
Publié: (2024)
Development and Enhancement of Text-to-Image Diffusion Models
par: Sahu, Rajdeep Roshan
Publié: (2025)
par: Sahu, Rajdeep Roshan
Publié: (2025)
Image Segmentation using Chan-Vese Active Contours
par: P, Pranav Shenoy K.
Publié: (2025)
par: P, Pranav Shenoy K.
Publié: (2025)
4Seasons: Benchmarking Visual SLAM and Long-Term Localization for Autonomous Driving in Challenging Conditions
par: Wenzel, Patrick, et autres
Publié: (2022)
par: Wenzel, Patrick, et autres
Publié: (2022)
BenchX: A Unified Benchmark Framework for Medical Vision-Language Pretraining on Chest X-Rays
par: Zhou, Yang, et autres
Publié: (2024)
par: Zhou, Yang, et autres
Publié: (2024)
Documents similaires
-
ReXSonoVQA: A Video QA Benchmark for Procedure-Centric Ultrasound Understanding
par: Wang, Xucheng, et autres
Publié: (2026) -
FactCheXcker: Mitigating Measurement Hallucinations in Chest X-ray Report Generation Models
par: Heiman, Alice, et autres
Publié: (2024) -
ReXGradient-160K: A Large-Scale Publicly Available Dataset of Chest Radiographs with Free-text Reports
par: Zhang, Xiaoman, et autres
Publié: (2025) -
MedAutoCorrect: Image-Conditioned Autocorrection in Medical Reporting
par: Asiimwe, Arnold Caleb, et autres
Publié: (2024) -
ReXInTheWild: A Unified Benchmark for Medical Photograph Understanding
par: Banerjee, Oishi, et autres
Publié: (2026)