GEMA-Score: Granular Explainable Multi-Agent Scoring Framework for Radiology Report Evaluation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Zhenxuan, Lee, Kinhei, Jing, Peiyuan, Deng, Weihang, Zhou, Huichi, Jin, Zihao, Huang, Jiahao, Gao, Zhifan, Marshall, Dominic C, Fang, Yingying, Yang, Guang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Reason Like a Radiologist: Chain-of-Thought and Reinforcement Learning for Verifiable Report Generation
von: Jing, Peiyuan, et al.
Veröffentlicht: (2025)
von: Jing, Peiyuan, et al.
Veröffentlicht: (2025)
Seeing Through Experts Eyes A Foundational Vision Language Model Trained on Radiologists Gaze and Reasoning
von: Lee, Kinhei, et al.
Veröffentlicht: (2026)
von: Lee, Kinhei, et al.
Veröffentlicht: (2026)
Automatic Construction of Clinical Scoring Systems with LLM Agents
von: Estévez, Silas Ruhrberg, et al.
Veröffentlicht: (2026)
von: Estévez, Silas Ruhrberg, et al.
Veröffentlicht: (2026)
Agent Contracts: A Formal Framework for Resource-Bounded Autonomous AI Systems
von: Ye, Qing, et al.
Veröffentlicht: (2026)
von: Ye, Qing, et al.
Veröffentlicht: (2026)
An Adversary-Resistant Multi-Agent LLM System via Credibility Scoring
von: Ebrahimi, Sana, et al.
Veröffentlicht: (2025)
von: Ebrahimi, Sana, et al.
Veröffentlicht: (2025)
Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition
von: Qiao, Dan, et al.
Veröffentlicht: (2025)
von: Qiao, Dan, et al.
Veröffentlicht: (2025)
Causal-Inspired Multi-Agent Decision-Making via Graph Reinforcement Learning
von: Wang, Jing, et al.
Veröffentlicht: (2025)
von: Wang, Jing, et al.
Veröffentlicht: (2025)
Distributed Task Allocation for Multi-Agent Systems: A Submodular Optimization Approach
von: Liu, Jing, et al.
Veröffentlicht: (2024)
von: Liu, Jing, et al.
Veröffentlicht: (2024)
Empowering LLMs in Task-Oriented Dialogues: A Domain-Independent Multi-Agent Framework and Fine-Tuning Strategy
von: Feng, Zihao, et al.
Veröffentlicht: (2025)
von: Feng, Zihao, et al.
Veröffentlicht: (2025)
AGCo-MATA: Air-Ground Collaborative Multi-Agent Task Allocation in Mobile Crowdsensing
von: Shao, Tianhao, et al.
Veröffentlicht: (2025)
von: Shao, Tianhao, et al.
Veröffentlicht: (2025)
R3R: Decentralized Multi-Agent Collision Avoidance with Infinite-Horizon Safety
von: Vielmetti, Thomas Marshall, et al.
Veröffentlicht: (2025)
von: Vielmetti, Thomas Marshall, et al.
Veröffentlicht: (2025)
Unleashing Video Language Models for Fine-grained HRCT Report Generation
von: Fang, Yingying, et al.
Veröffentlicht: (2026)
von: Fang, Yingying, et al.
Veröffentlicht: (2026)
Agent-Kernel: A MicroKernel Multi-Agent System Framework for Adaptive Social Simulation Powered by LLMs
von: Mao, Yuren, et al.
Veröffentlicht: (2025)
von: Mao, Yuren, et al.
Veröffentlicht: (2025)
Learning to Communicate and Collaborate in a Competitive Multi-Agent Setup to Clean the Ocean from Macroplastics
von: Siedler, Philipp Dominic
Veröffentlicht: (2023)
von: Siedler, Philipp Dominic
Veröffentlicht: (2023)
SIGMA: Sheaf-Informed Geometric Multi-Agent Pathfinding
von: Liao, Shuhao, et al.
Veröffentlicht: (2025)
von: Liao, Shuhao, et al.
Veröffentlicht: (2025)
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
von: Yang, Guang, et al.
Veröffentlicht: (2025)
von: Yang, Guang, et al.
Veröffentlicht: (2025)
MA-SAPO: Multi-Agent Reasoning for Score-Aware Prompt Optimization
von: Seo, Wonduk, et al.
Veröffentlicht: (2025)
von: Seo, Wonduk, et al.
Veröffentlicht: (2025)
What Do Agents Communicate? Characterizing Information Exchange in Multi-Agent Systems
von: Chun, Yong Jin, et al.
Veröffentlicht: (2026)
von: Chun, Yong Jin, et al.
Veröffentlicht: (2026)
CONClave -- Secure and Robust Cooperative Perception for CAVs Using Authenticated Consensus and Trust Scoring
von: Andert, Edward, et al.
Veröffentlicht: (2024)
von: Andert, Edward, et al.
Veröffentlicht: (2024)
CogSearch: A Cognitive-Aligned Multi-Agent Framework for Proactive Decision Support in E-Commerce Search
von: Zhai, Zhouwei, et al.
Veröffentlicht: (2026)
von: Zhai, Zhouwei, et al.
Veröffentlicht: (2026)
Agentic Automation of BT-RADS Scoring: End-to-End Multi-Agent System for Standardized Brain Tumor Follow-up Assessment
von: Jabal, Mohamed Sobhi, et al.
Veröffentlicht: (2026)
von: Jabal, Mohamed Sobhi, et al.
Veröffentlicht: (2026)
Logarithmic Scores, Power-Law Discoveries: Disentangling Measurement from Coverage in Agent-Based Evaluation
von: Jung, HyunJoon, et al.
Veröffentlicht: (2026)
von: Jung, HyunJoon, et al.
Veröffentlicht: (2026)
A Comprehensive Survey on Multi-Agent Cooperative Decision-Making: Scenarios, Approaches, Challenges and Perspectives
von: Jin, Weiqiang, et al.
Veröffentlicht: (2025)
von: Jin, Weiqiang, et al.
Veröffentlicht: (2025)
RAI: Flexible Agent Framework for Embodied AI
von: Rachwał, Kajetan, et al.
Veröffentlicht: (2025)
von: Rachwał, Kajetan, et al.
Veröffentlicht: (2025)
A Closed-Loop Multi-Agent Framework for Aerodynamics-Aware Automotive Styling Design
von: Jin, Xinyu, et al.
Veröffentlicht: (2025)
von: Jin, Xinyu, et al.
Veröffentlicht: (2025)
XAgents: A Framework for Interpretable Rule-Based Multi-Agents Cooperation
von: Yang, Hailong, et al.
Veröffentlicht: (2024)
von: Yang, Hailong, et al.
Veröffentlicht: (2024)
REALISM: A Regulatory Framework for Coordinated Scheduling in Multi-Operator Shared Micromobility Services
von: Tan, Heng, et al.
Veröffentlicht: (2025)
von: Tan, Heng, et al.
Veröffentlicht: (2025)
MRGAgents: A Multi-Agent Framework for Improved Medical Report Generation with Med-LVLMs
von: Wang, Pengyu, et al.
Veröffentlicht: (2025)
von: Wang, Pengyu, et al.
Veröffentlicht: (2025)
Musical Score Understanding Benchmark: Evaluating Large Language Models' Comprehension of Complete Musical Scores
von: Dai, Congren, et al.
Veröffentlicht: (2025)
von: Dai, Congren, et al.
Veröffentlicht: (2025)
Diversity of Structured Domains via k-Kemeny Scores
von: Faliszewski, Piotr, et al.
Veröffentlicht: (2025)
von: Faliszewski, Piotr, et al.
Veröffentlicht: (2025)
Foragax: An Agent-Based Modelling Framework Based on JAX
von: Chaturvedi, Siddharth, et al.
Veröffentlicht: (2024)
von: Chaturvedi, Siddharth, et al.
Veröffentlicht: (2024)
Making Teams and Influencing Agents: Efficiently Coordinating Decision Trees for Interpretable Multi-Agent Reinforcement Learning
von: Chen, Rex, et al.
Veröffentlicht: (2025)
von: Chen, Rex, et al.
Veröffentlicht: (2025)
MARS: A Meta-Adaptive Reinforcement Learning Framework for Risk-Aware Multi-Agent Portfolio Management
von: Chen, Jiayi, et al.
Veröffentlicht: (2025)
von: Chen, Jiayi, et al.
Veröffentlicht: (2025)
Bridging Perception and Action: A Lightweight Multimodal Meta-Planner Framework for Robust Earth Observation Agents
von: Xu, Jinghui, et al.
Veröffentlicht: (2026)
von: Xu, Jinghui, et al.
Veröffentlicht: (2026)
Multi-Agent Digital Twinning for Collaborative Logistics: Framework and Implementation
von: Xu, Liming, et al.
Veröffentlicht: (2023)
von: Xu, Liming, et al.
Veröffentlicht: (2023)
GLANCE: A Global-Local Coordination Multi-Agent Framework for Music-Grounded Non-Linear Video Editing
von: Lin, Zihao, et al.
Veröffentlicht: (2026)
von: Lin, Zihao, et al.
Veröffentlicht: (2026)
TWICE: An LLM Agent Framework for Simulating Personalized User Tweeting Behavior with Long-term Temporal Features
von: Jin, Bingrui, et al.
Veröffentlicht: (2025)
von: Jin, Bingrui, et al.
Veröffentlicht: (2025)
Lemon Agent Technical Report
von: Jiang, Haipeng, et al.
Veröffentlicht: (2026)
von: Jiang, Haipeng, et al.
Veröffentlicht: (2026)
HIVEX: A High-Impact Environment Suite for Multi-Agent Research (extended version)
von: Siedler, Philipp Dominic
Veröffentlicht: (2025)
von: Siedler, Philipp Dominic
Veröffentlicht: (2025)
EvoCorps: An Evolutionary Multi-Agent Framework for Depolarizing Online Discourse
von: Lin, Ning, et al.
Veröffentlicht: (2026)
von: Lin, Ning, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Reason Like a Radiologist: Chain-of-Thought and Reinforcement Learning for Verifiable Report Generation
von: Jing, Peiyuan, et al.
Veröffentlicht: (2025) -
Seeing Through Experts Eyes A Foundational Vision Language Model Trained on Radiologists Gaze and Reasoning
von: Lee, Kinhei, et al.
Veröffentlicht: (2026) -
Automatic Construction of Clinical Scoring Systems with LLM Agents
von: Estévez, Silas Ruhrberg, et al.
Veröffentlicht: (2026) -
Agent Contracts: A Formal Framework for Resource-Bounded Autonomous AI Systems
von: Ye, Qing, et al.
Veröffentlicht: (2026) -
An Adversary-Resistant Multi-Agent LLM System via Credibility Scoring
von: Ebrahimi, Sana, et al.
Veröffentlicht: (2025)