FineMedLM-o1: Enhancing Medical Knowledge Reasoning Ability of LLM from Supervised Fine-Tuning to Test-Time Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Yu, Hongzhou, Cheng, Tianhao, Wang, Yingwen, He, Wen, Wang, Qing, Cheng, Ying, Zhang, Yuejie, Feng, Rui, Zhang, Xiaobo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CT2C-QA: Multimodal Question Answering over Chinese Text, Table and Chart
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
di: Huang, Zeyu, et al.
Pubblicazione: (2025)
di: Huang, Zeyu, et al.
Pubblicazione: (2025)
Proximal Supervised Fine-Tuning
di: Zhu, Wenhong, et al.
Pubblicazione: (2025)
di: Zhu, Wenhong, et al.
Pubblicazione: (2025)
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
di: Pang, Jinlong, et al.
Pubblicazione: (2025)
di: Pang, Jinlong, et al.
Pubblicazione: (2025)
MedBioLM: Optimizing Medical and Biological QA with Fine-Tuned Large Language Models and Retrieval-Augmented Generation
di: Kim, Seonok
Pubblicazione: (2025)
di: Kim, Seonok
Pubblicazione: (2025)
Reassessing the Role of Supervised Fine-Tuning: An Empirical Study in VLM Reasoning
di: Yu, Yongcan, et al.
Pubblicazione: (2025)
di: Yu, Yongcan, et al.
Pubblicazione: (2025)
AFiRe: Anatomy-Driven Self-Supervised Learning for Fine-Grained Representation in Radiographic Images
di: Liu, Yihang, et al.
Pubblicazione: (2025)
di: Liu, Yihang, et al.
Pubblicazione: (2025)
MedPRMBench: A Fine-grained Benchmark for Process Reward Models in Medical Reasoning
di: Wu, Lingyan, et al.
Pubblicazione: (2026)
di: Wu, Lingyan, et al.
Pubblicazione: (2026)
PAFT: A Parallel Training Paradigm for Effective LLM Fine-Tuning
di: Pentyala, Shiva Kumar, et al.
Pubblicazione: (2024)
di: Pentyala, Shiva Kumar, et al.
Pubblicazione: (2024)
Threshold Filtering Packing for Supervised Fine-Tuning: Training Related Samples within Packs
di: Dong, Jiancheng, et al.
Pubblicazione: (2024)
di: Dong, Jiancheng, et al.
Pubblicazione: (2024)
On-Policy Supervised Fine-Tuning for Efficient Reasoning
di: Zhao, Anhao, et al.
Pubblicazione: (2026)
di: Zhao, Anhao, et al.
Pubblicazione: (2026)
MedFILIP: Medical Fine-grained Language-Image Pre-training
di: Liang, Xinjie, et al.
Pubblicazione: (2025)
di: Liang, Xinjie, et al.
Pubblicazione: (2025)
Stabilizing LLM Supervised Fine-Tuning via Explicit Distributional Control
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models
di: Jiang, Haitao, et al.
Pubblicazione: (2026)
di: Jiang, Haitao, et al.
Pubblicazione: (2026)
Remote Training in Task-Oriented Communication: Supervised or Self-Supervised with Fine-Tuning?
di: Li, Hongru, et al.
Pubblicazione: (2025)
di: Li, Hongru, et al.
Pubblicazione: (2025)
Anchored Supervised Fine-Tuning
di: Zhu, He, et al.
Pubblicazione: (2025)
di: Zhu, He, et al.
Pubblicazione: (2025)
Understanding Overadaptation in Supervised Fine-Tuning: The Role of Ensemble Methods
di: Hao, Yifan, et al.
Pubblicazione: (2025)
di: Hao, Yifan, et al.
Pubblicazione: (2025)
Knowledge Graph-Infused Fine-Tuning for Structured Reasoning in Large Language Models
di: Zhang, Wuyang, et al.
Pubblicazione: (2025)
di: Zhang, Wuyang, et al.
Pubblicazione: (2025)
Med-REFL: Medical Reasoning Enhancement via Self-Corrected Fine-grained Reflection
di: Yang, Zongxian, et al.
Pubblicazione: (2025)
di: Yang, Zongxian, et al.
Pubblicazione: (2025)
Supervised Fine-Tuning or Contrastive Learning? Towards Better Multimodal LLM Reranking
di: Dai, Ziqi, et al.
Pubblicazione: (2025)
di: Dai, Ziqi, et al.
Pubblicazione: (2025)
Towards Efficient Medical Reasoning with Minimal Fine-Tuning Data
di: Zhuang, Xinlin, et al.
Pubblicazione: (2025)
di: Zhuang, Xinlin, et al.
Pubblicazione: (2025)
SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning
di: Fu, Yuqian, et al.
Pubblicazione: (2025)
di: Fu, Yuqian, et al.
Pubblicazione: (2025)
On the Role of Reasoning Patterns in the Generalization Discrepancy of Long Chain-of-Thought Supervised Fine-Tuning
di: Li, Zhaoyi, et al.
Pubblicazione: (2026)
di: Li, Zhaoyi, et al.
Pubblicazione: (2026)
QuantLRM: Quantization of Large Reasoning Models via Fine-Tuning Signals
di: Zhang, Nan, et al.
Pubblicazione: (2026)
di: Zhang, Nan, et al.
Pubblicazione: (2026)
Goal-Conditioned Supervised Learning for LLM Fine-Tuning
di: Li, Shijun, et al.
Pubblicazione: (2026)
di: Li, Shijun, et al.
Pubblicazione: (2026)
LLMs for Explainable Business Decision-Making: A Reinforcement Learning Fine-Tuning Approach
di: Cheng, Xiang, et al.
Pubblicazione: (2025)
di: Cheng, Xiang, et al.
Pubblicazione: (2025)
FedPFT: Federated Proxy Fine-Tuning of Foundation Models
di: Peng, Zhaopeng, et al.
Pubblicazione: (2024)
di: Peng, Zhaopeng, et al.
Pubblicazione: (2024)
Decoupled Training with Local Reinforcement Fine-Tuning in Federated Learning
di: Ma, Yuting, et al.
Pubblicazione: (2026)
di: Ma, Yuting, et al.
Pubblicazione: (2026)
Analyzing the Effects of Supervised Fine-Tuning on Model Knowledge from Token and Parameter Levels
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
Beyond Scores: Diagnostic LLM Evaluation via Fine-Grained Abilities
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
Fine-Tuning is Fine, if Calibrated
di: Mai, Zheda, et al.
Pubblicazione: (2024)
di: Mai, Zheda, et al.
Pubblicazione: (2024)
The Fine-Tuning Paradox: Boosting Translation Quality Without Sacrificing LLM Abilities
di: Stap, David, et al.
Pubblicazione: (2024)
di: Stap, David, et al.
Pubblicazione: (2024)
LR-SQL: A Supervised Fine-Tuning Method for Text2SQL Tasks under Low-Resource Scenarios
di: Wuzhenghong, Wen, et al.
Pubblicazione: (2024)
di: Wuzhenghong, Wen, et al.
Pubblicazione: (2024)
KaLM: Knowledge-aligned Autoregressive Language Modeling via Dual-view Knowledge Graph Contrastive Learning
di: Yu, Peng, et al.
Pubblicazione: (2024)
di: Yu, Peng, et al.
Pubblicazione: (2024)
A Medical Multimodal Large Language Model for Pediatric Pneumonia
di: Tian, Weiwei, et al.
Pubblicazione: (2024)
di: Tian, Weiwei, et al.
Pubblicazione: (2024)
MARFT: Multi-Agent Reinforcement Fine-Tuning
di: Liao, Junwei, et al.
Pubblicazione: (2025)
di: Liao, Junwei, et al.
Pubblicazione: (2025)
Towards Robust LLM Post-Training: Automatic Failure Management for Reinforcement Fine-Tuning
di: Zhang, Lingzhe, et al.
Pubblicazione: (2026)
di: Zhang, Lingzhe, et al.
Pubblicazione: (2026)
InfiMed-Foundation: Pioneering Advanced Multimodal Medical Models with Compute-Efficient Pre-Training and Multi-Stage Fine-Tuning
di: Zhu, Guanghao, et al.
Pubblicazione: (2025)
di: Zhu, Guanghao, et al.
Pubblicazione: (2025)
Rethinking Fine-Tuning when Scaling Test-Time Compute: Limiting Confidence Improves Mathematical Reasoning
di: Chen, Feng, et al.
Pubblicazione: (2025)
di: Chen, Feng, et al.
Pubblicazione: (2025)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
di: Tan, Huajie, et al.
Pubblicazione: (2025)
di: Tan, Huajie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
CT2C-QA: Multimodal Question Answering over Chinese Text, Table and Chart
di: Zhao, Bowen, et al.
Pubblicazione: (2024) -
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
di: Huang, Zeyu, et al.
Pubblicazione: (2025) -
Proximal Supervised Fine-Tuning
di: Zhu, Wenhong, et al.
Pubblicazione: (2025) -
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
di: Pang, Jinlong, et al.
Pubblicazione: (2025) -
MedBioLM: Optimizing Medical and Biological QA with Fine-Tuned Large Language Models and Retrieval-Augmented Generation
di: Kim, Seonok
Pubblicazione: (2025)