CURE-Med: Curriculum-Informed Reinforcement Learning for Multilingual Medical Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Onyame, Eric, Ghosh, Akash, Baidya, Subhadip, Saha, Sriparna, Chen, Xiuying, Agarwal, Chirag |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Survey of Multilingual Reasoning in Language Models
di: Ghosh, Akash, et al.
Pubblicazione: (2025)
di: Ghosh, Akash, et al.
Pubblicazione: (2025)
When Background Matters: Breaking Medical Vision Language Models by Transferable Attack
di: Ghosh, Akash, et al.
Pubblicazione: (2026)
di: Ghosh, Akash, et al.
Pubblicazione: (2026)
Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
The Fragility of Chain-of-Thought Monitoring Across Typologically Diverse Languages
di: Onyame, Eric, et al.
Pubblicazione: (2026)
di: Onyame, Eric, et al.
Pubblicazione: (2026)
Detecting the Machine: A Comprehensive Benchmark of AI-Generated Text Detectors Across Architectures, Domains, and Adversarial Conditions
di: Baidya, Madhav S., et al.
Pubblicazione: (2026)
di: Baidya, Madhav S., et al.
Pubblicazione: (2026)
MedSumm: A Multimodal Approach to Summarizing Code-Mixed Hindi-English Clinical Queries
di: Ghosh, Akash, et al.
Pubblicazione: (2024)
di: Ghosh, Akash, et al.
Pubblicazione: (2024)
CLINIC: Evaluating Multilingual Trustworthiness in Language Models for Healthcare
di: Ghosh, Akash, et al.
Pubblicazione: (2025)
di: Ghosh, Akash, et al.
Pubblicazione: (2025)
Yes, this is what I was looking for! Towards Multi-modal Medical Consultation Concern Summary Generation
di: Tiwari, Abhisek, et al.
Pubblicazione: (2024)
di: Tiwari, Abhisek, et al.
Pubblicazione: (2024)
Exploring the Frontier of Vision-Language Models: A Survey of Current Methodologies and Future Directions
di: Ghosh, Akash, et al.
Pubblicazione: (2024)
di: Ghosh, Akash, et al.
Pubblicazione: (2024)
Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
CURE: Confidence-driven Unified Reasoning Ensemble Framework for Medical Question Answering
di: Elshaer, Ziad, et al.
Pubblicazione: (2025)
di: Elshaer, Ziad, et al.
Pubblicazione: (2025)
Towards Knowledge-Infused Automated Disease Diagnosis Assistant
di: Tomar, Mohit, et al.
Pubblicazione: (2024)
di: Tomar, Mohit, et al.
Pubblicazione: (2024)
Let's Play Across Cultures: A Large Multilingual, Multicultural Benchmark for Assessing Language Models' Understanding of Sports
di: Singh, Punit Kumar, et al.
Pubblicazione: (2025)
di: Singh, Punit Kumar, et al.
Pubblicazione: (2025)
TACLer: Tailored Curriculum Reinforcement Learning for Efficient Reasoning
di: Lai, Huiyuan, et al.
Pubblicazione: (2026)
di: Lai, Huiyuan, et al.
Pubblicazione: (2026)
An EcoSage Assistant: Towards Building A Multimodal Plant Care Dialogue Assistant
di: Tomar, Mohit, et al.
Pubblicazione: (2024)
di: Tomar, Mohit, et al.
Pubblicazione: (2024)
MedCLM: Learning to Localize and Reason via a CoT-Curriculum in Medical Vision-Language Models
di: Kim, Soo Yong, et al.
Pubblicazione: (2025)
di: Kim, Soo Yong, et al.
Pubblicazione: (2025)
ProMed: Shapley Information Gain Guided Reinforcement Learning for Proactive Medical LLMs
di: Ding, Hongxin, et al.
Pubblicazione: (2025)
di: Ding, Hongxin, et al.
Pubblicazione: (2025)
Demystifying ChatGPT: How It Masters Genre Recognition
di: Raj, Subham, et al.
Pubblicazione: (2025)
di: Raj, Subham, et al.
Pubblicazione: (2025)
PassiveQA: A Three-Action Framework for Epistemically Calibrated Question Answering via Supervised Finetuning
di: Baidya, Madhav S
Pubblicazione: (2026)
di: Baidya, Madhav S
Pubblicazione: (2026)
EuropeMedQA Study Protocol: A Multilingual, Multimodal Medical Examination Dataset for Language Model Evaluation
di: Causio, Francesco Andrea, et al.
Pubblicazione: (2026)
di: Causio, Francesco Andrea, et al.
Pubblicazione: (2026)
MedReason: Eliciting Factual Medical Reasoning Steps in LLMs via Knowledge Graphs
di: Wu, Juncheng, et al.
Pubblicazione: (2025)
di: Wu, Juncheng, et al.
Pubblicazione: (2025)
InfiMed: Low-Resource Medical MLLMs with Advancing Understanding and Reasoning
di: Liu, Zeyu, et al.
Pubblicazione: (2025)
di: Liu, Zeyu, et al.
Pubblicazione: (2025)
A Comprehensive Survey of Hallucination in Large Language, Image, Video and Audio Foundation Models
di: Sahoo, Pranab, et al.
Pubblicazione: (2024)
di: Sahoo, Pranab, et al.
Pubblicazione: (2024)
MedAgentsBench: Benchmarking Thinking Models and Agent Frameworks for Complex Medical Reasoning
di: Tang, Xiangru, et al.
Pubblicazione: (2025)
di: Tang, Xiangru, et al.
Pubblicazione: (2025)
MedKGent: A Large Language Model Agent Framework for Constructing Temporally Evolving Medical Knowledge Graph
di: Zhang, Duzhen, et al.
Pubblicazione: (2025)
di: Zhang, Duzhen, et al.
Pubblicazione: (2025)
Polarity-Aware Probing for Quantifying Latent Alignment in Language Models
di: Sadiekh, Sabrina, et al.
Pubblicazione: (2025)
di: Sadiekh, Sabrina, et al.
Pubblicazione: (2025)
MedAgents: Large Language Models as Collaborators for Zero-shot Medical Reasoning
di: Tang, Xiangru, et al.
Pubblicazione: (2023)
di: Tang, Xiangru, et al.
Pubblicazione: (2023)
Curriculum Reinforcement Learning from Easy to Hard Tasks Improves LLM Reasoning
di: Parashar, Shubham, et al.
Pubblicazione: (2025)
di: Parashar, Shubham, et al.
Pubblicazione: (2025)
Multilingual Medical Reasoning for Question Answering with Large Language Models
di: Ferrazzi, Pietro, et al.
Pubblicazione: (2025)
di: Ferrazzi, Pietro, et al.
Pubblicazione: (2025)
Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning
di: Zhang, Sheng, et al.
Pubblicazione: (2025)
di: Zhang, Sheng, et al.
Pubblicazione: (2025)
ExTrans: Multilingual Deep Reasoning Translation via Exemplar-Enhanced Reinforcement Learning
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
CURE: Curriculum-guided Multi-task Training for Reliable Anatomy Grounded Report Generation
di: Messina, Pablo, et al.
Pubblicazione: (2026)
di: Messina, Pablo, et al.
Pubblicazione: (2026)
CURE: A Multimodal Benchmark for Clinical Understanding and Retrieval Evaluation
di: Gu, Yannian, et al.
Pubblicazione: (2026)
di: Gu, Yannian, et al.
Pubblicazione: (2026)
MedCalc-Eval and MedCalc-Env: Advancing Medical Calculation Capabilities of Large Language Models
di: Mao, Kangkun, et al.
Pubblicazione: (2025)
di: Mao, Kangkun, et al.
Pubblicazione: (2025)
Learning When to Translate for Multilingual Reasoning
di: Kang, Deokhyung, et al.
Pubblicazione: (2026)
di: Kang, Deokhyung, et al.
Pubblicazione: (2026)
Scaling Medical Reasoning Verification via Tool-Integrated Reinforcement Learning
di: Zhang, Hang, et al.
Pubblicazione: (2026)
di: Zhang, Hang, et al.
Pubblicazione: (2026)
MedCritical: Enhancing Medical Reasoning in Small Language Models via Self-Collaborative Correction
di: Su, Xinchun, et al.
Pubblicazione: (2025)
di: Su, Xinchun, et al.
Pubblicazione: (2025)
MedAdapter: Efficient Test-Time Adaptation of Large Language Models towards Medical Reasoning
di: Shi, Wenqi, et al.
Pubblicazione: (2024)
di: Shi, Wenqi, et al.
Pubblicazione: (2024)
MedAidDialog: A Multilingual Multi-Turn Medical Dialogue Dataset for Accessible Healthcare
di: Nigam, Shubham Kumar, et al.
Pubblicazione: (2026)
di: Nigam, Shubham Kumar, et al.
Pubblicazione: (2026)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Survey of Multilingual Reasoning in Language Models
di: Ghosh, Akash, et al.
Pubblicazione: (2025) -
When Background Matters: Breaking Medical Vision Language Models by Transferable Attack
di: Ghosh, Akash, et al.
Pubblicazione: (2026) -
Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025) -
The Fragility of Chain-of-Thought Monitoring Across Typologically Diverse Languages
di: Onyame, Eric, et al.
Pubblicazione: (2026) -
Detecting the Machine: A Comprehensive Benchmark of AI-Generated Text Detectors Across Architectures, Domains, and Adversarial Conditions
di: Baidya, Madhav S., et al.
Pubblicazione: (2026)