Integrating Physician Diagnostic Logic into Large Language Models: Preference Learning from Process Feedback
Fuente:
arXiv
Saved in:
| Main Authors: | Dou, Chengfeng, Jin, Zhi, Jiao, Wenpin, Zhao, Haiyan, Zhao, Yongqiang, Tao, Zhenwei |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Exploring LLM-based Data Annotation Strategies for Medical Dialogue Preference Alignment
by: Dou, Chengfeng, et al.
Published: (2024)
by: Dou, Chengfeng, et al.
Published: (2024)
Enhancing LLM Generation with Knowledge Hypergraph for Evidence-Based Medicine
by: Dou, Chengfeng, et al.
Published: (2025)
by: Dou, Chengfeng, et al.
Published: (2025)
Exploring Data-Efficient Adaptation of Large Language Models for Code Generation
by: Jiang, Xue, et al.
Published: (2024)
by: Jiang, Xue, et al.
Published: (2024)
Your Inference Request Will Become a Black Box: Confidential Inference for Cloud-based Large Language Models
by: Huang, Chung-ju, et al.
Published: (2026)
by: Huang, Chung-ju, et al.
Published: (2026)
PROPHET: An Inferable Future Forecasting Benchmark with Causal Intervened Likelihood Estimation
by: Tao, Zhengwei, et al.
Published: (2025)
by: Tao, Zhengwei, et al.
Published: (2025)
DABL: Detecting Semantic Anomalies in Business Processes Using Large Language Models
by: Guan, Wei, et al.
Published: (2024)
by: Guan, Wei, et al.
Published: (2024)
Preference Tuning with Human Feedback on Language, Speech, and Vision Tasks: A Survey
by: Winata, Genta Indra, et al.
Published: (2024)
by: Winata, Genta Indra, et al.
Published: (2024)
A Comprehensive Evaluation on Event Reasoning of Large Language Models
by: Tao, Zhengwei, et al.
Published: (2024)
by: Tao, Zhengwei, et al.
Published: (2024)
SPIN: Sparsifying and Integrating Internal Neurons in Large Language Models for Text Classification
by: Jiao, Difan, et al.
Published: (2023)
by: Jiao, Difan, et al.
Published: (2023)
A Survey on Human Preference Learning for Large Language Models
by: Jiang, Ruili, et al.
Published: (2024)
by: Jiang, Ruili, et al.
Published: (2024)
Learning to Reason via Self-Iterative Process Feedback for Small Language Models
by: Chen, Kaiyuan, et al.
Published: (2024)
by: Chen, Kaiyuan, et al.
Published: (2024)
CiPO: Counterfactual Unlearning for Large Reasoning Models through Iterative Preference Optimization
by: Li, Junyi, et al.
Published: (2026)
by: Li, Junyi, et al.
Published: (2026)
Generating Feedback-Ladders for Logical Errors in Programming using Large Language Models
by: Heickal, Hasnain, et al.
Published: (2024)
by: Heickal, Hasnain, et al.
Published: (2024)
Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language Models
by: Liu, Yinhong, et al.
Published: (2024)
by: Liu, Yinhong, et al.
Published: (2024)
RuleAlign: Making Large Language Models Better Physicians with Diagnostic Rule Alignment
by: Wang, Xiaohan, et al.
Published: (2024)
by: Wang, Xiaohan, et al.
Published: (2024)
Advancing Process Verification for Large Language Models via Tree-Based Preference Learning
by: He, Mingqian, et al.
Published: (2024)
by: He, Mingqian, et al.
Published: (2024)
Towards Uncovering How Large Language Model Works: An Explainability Perspective
by: Zhao, Haiyan, et al.
Published: (2024)
by: Zhao, Haiyan, et al.
Published: (2024)
Preference Optimization for Reasoning with Pseudo Feedback
by: Jiao, Fangkai, et al.
Published: (2024)
by: Jiao, Fangkai, et al.
Published: (2024)
EVIT: Event-Oriented Instruction Tuning for Event Reasoning
by: Tao, Zhengwei, et al.
Published: (2024)
by: Tao, Zhengwei, et al.
Published: (2024)
Aligning Large Language Models from Self-Reference AI Feedback with one General Principle
by: Bao, Rong, et al.
Published: (2024)
by: Bao, Rong, et al.
Published: (2024)
Exploring Self-supervised Logic-enhanced Training for Large Language Models
by: Jiao, Fangkai, et al.
Published: (2023)
by: Jiao, Fangkai, et al.
Published: (2023)
Exploring Multilingual Probing in Large Language Models: A Cross-Language Analysis
by: Li, Daoyang, et al.
Published: (2024)
by: Li, Daoyang, et al.
Published: (2024)
Beyond Under-Alignment: Atomic Preference Enhanced Factuality Tuning for Large Language Models
by: Yuan, Hongbang, et al.
Published: (2024)
by: Yuan, Hongbang, et al.
Published: (2024)
The Impact of Reasoning Step Length on Large Language Models
by: Jin, Mingyu, et al.
Published: (2024)
by: Jin, Mingyu, et al.
Published: (2024)
ProRAG: Process-Supervised Reinforcement Learning for Retrieval-Augmented Generation
by: Wang, Zhao, et al.
Published: (2026)
by: Wang, Zhao, et al.
Published: (2026)
BESPOKE: Benchmark for Search-Augmented Large Language Model Personalization via Diagnostic Feedback
by: Kim, Hyunseo, et al.
Published: (2025)
by: Kim, Hyunseo, et al.
Published: (2025)
KOCO-BENCH: Can Large Language Models Leverage Domain Knowledge in Software Development?
by: Jiang, Xue, et al.
Published: (2026)
by: Jiang, Xue, et al.
Published: (2026)
Latent Preference Coding: Aligning Large Language Models via Discrete Latent Codes
by: Gong, Zhuocheng, et al.
Published: (2025)
by: Gong, Zhuocheng, et al.
Published: (2025)
Establishing Knowledge Preference in Language Models
by: Zhou, Sizhe, et al.
Published: (2024)
by: Zhou, Sizhe, et al.
Published: (2024)
Defending against Jailbreak through Early Exit Generation of Large Language Models
by: Zhao, Chongwen, et al.
Published: (2024)
by: Zhao, Chongwen, et al.
Published: (2024)
Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language Models
by: Bansal, Hritik, et al.
Published: (2023)
by: Bansal, Hritik, et al.
Published: (2023)
Group Preference Optimization: Few-Shot Alignment of Large Language Models
by: Zhao, Siyan, et al.
Published: (2023)
by: Zhao, Siyan, et al.
Published: (2023)
Linear Alignment: A Closed-form Solution for Aligning Human Preferences without Tuning and Feedback
by: Gao, Songyang, et al.
Published: (2024)
by: Gao, Songyang, et al.
Published: (2024)
LogicAsker: Evaluating and Improving the Logical Reasoning Ability of Large Language Models
by: Wan, Yuxuan, et al.
Published: (2024)
by: Wan, Yuxuan, et al.
Published: (2024)
Transforming the Voice of the Customer: Large Language Models for Identifying Customer Needs
by: Timoshenko, Artem, et al.
Published: (2025)
by: Timoshenko, Artem, et al.
Published: (2025)
Investigating the Feasibility of Mitigating Potential Copyright Infringement via Large Language Model Unlearning
by: Dou, Guangyao
Published: (2024)
by: Dou, Guangyao
Published: (2024)
Theoretical Proof that Auto-regressive Language Models Collapse when Real-world Data is a Finite Set
by: Wang, Lecheng, et al.
Published: (2024)
by: Wang, Lecheng, et al.
Published: (2024)
Learning to Refine with Fine-Grained Natural Language Feedback
by: Wadhwa, Manya, et al.
Published: (2024)
by: Wadhwa, Manya, et al.
Published: (2024)
STEMVerse: A Dual-Axis Diagnostic Framework for STEM Reasoning in Large Language Models
by: Li, Xuzhao, et al.
Published: (2026)
by: Li, Xuzhao, et al.
Published: (2026)
Beyond Empathy: Integrating Diagnostic and Therapeutic Reasoning with Large Language Models for Mental Health Counseling
by: Hu, He, et al.
Published: (2025)
by: Hu, He, et al.
Published: (2025)
Similar Items
-
Exploring LLM-based Data Annotation Strategies for Medical Dialogue Preference Alignment
by: Dou, Chengfeng, et al.
Published: (2024) -
Enhancing LLM Generation with Knowledge Hypergraph for Evidence-Based Medicine
by: Dou, Chengfeng, et al.
Published: (2025) -
Exploring Data-Efficient Adaptation of Large Language Models for Code Generation
by: Jiang, Xue, et al.
Published: (2024) -
Your Inference Request Will Become a Black Box: Confidential Inference for Cloud-based Large Language Models
by: Huang, Chung-ju, et al.
Published: (2026) -
PROPHET: An Inferable Future Forecasting Benchmark with Causal Intervened Likelihood Estimation
by: Tao, Zhengwei, et al.
Published: (2025)