A Comprehensive Survey of Reward Models: Taxonomy, Applications, Challenges, and Future
Fuente:
arXiv
Saved in:
| Main Authors: | Zhong, Jialun, Shen, Wei, Li, Yanzeng, Gao, Songyang, Lu, Hua, Chen, Yicheng, Zhang, Yang, Zhou, Wei, Gu, Jinjie, Zou, Lei |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Detecting Hallucinations in Retrieval-Augmented Generation via Semantic-level Internal Reasoning Graph
by: Hu, Jianpeng, et al.
Published: (2026)
by: Hu, Jianpeng, et al.
Published: (2026)
GAP: Graph-Assisted Prompts for Dialogue-based Medication Recommendation
by: Zhong, Jialun, et al.
Published: (2025)
by: Zhong, Jialun, et al.
Published: (2025)
Leveraging Large Language Model as Simulated Patients for Clinical Education
by: Li, Yanzeng, et al.
Published: (2024)
by: Li, Yanzeng, et al.
Published: (2024)
MMPKUBase: A Comprehensive and High-quality Chinese Multi-modal Knowledge Graph
by: Yi, Xuan, et al.
Published: (2024)
by: Yi, Xuan, et al.
Published: (2024)
HAD: HAllucination Detection Language Models Based on a Comprehensive Hallucination Taxonomy
by: Xu, Fan, et al.
Published: (2025)
by: Xu, Fan, et al.
Published: (2025)
A Survey on Medical Large Language Models: Technology, Application, Trustworthiness, and Future Directions
by: Liu, Lei, et al.
Published: (2024)
by: Liu, Lei, et al.
Published: (2024)
Survey of Natural Language Processing for Education: Taxonomy, Systematic Review, and Future Trends
by: Lan, Yunshi, et al.
Published: (2024)
by: Lan, Yunshi, et al.
Published: (2024)
A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions
by: Huang, Lei, et al.
Published: (2023)
by: Huang, Lei, et al.
Published: (2023)
Vision Mamba: A Comprehensive Survey and Taxonomy
by: Liu, Xiao, et al.
Published: (2024)
by: Liu, Xiao, et al.
Published: (2024)
A Survey of Large Language Models in Medicine: Progress, Application, and Challenge
by: Zhou, Hongjian, et al.
Published: (2023)
by: Zhou, Hongjian, et al.
Published: (2023)
A Survey on Uncertainty Quantification of Large Language Models: Taxonomy, Open Research Challenges, and Future Directions
by: Shorinwa, Ola, et al.
Published: (2024)
by: Shorinwa, Ola, et al.
Published: (2024)
A Comprehensive Survey on Legal Summarization: Challenges and Future Directions
by: Akter, Mousumi, et al.
Published: (2025)
by: Akter, Mousumi, et al.
Published: (2025)
A Survey of Event Causality Identification: Taxonomy, Challenges, Assessment, and Prospects
by: Cheng, Qing, et al.
Published: (2024)
by: Cheng, Qing, et al.
Published: (2024)
Exploiting Prefix-Tree in Structured Output Interfaces for Enhancing Jailbreak Attacking
by: Li, Yanzeng, et al.
Published: (2025)
by: Li, Yanzeng, et al.
Published: (2025)
RMB: Comprehensively Benchmarking Reward Models in LLM Alignment
by: Zhou, Enyu, et al.
Published: (2024)
by: Zhou, Enyu, et al.
Published: (2024)
SEAL: Self-Evolving Agentic Learning for Conversational Question Answering over Knowledge Graphs
by: Wang, Hao, et al.
Published: (2025)
by: Wang, Hao, et al.
Published: (2025)
Capability Salience Vector: Fine-grained Alignment of Loss and Capabilities for Downstream Task Scaling Law
by: Ge, Qiming, et al.
Published: (2025)
by: Ge, Qiming, et al.
Published: (2025)
CTRL-RAG: Contrastive Likelihood Reward Based Reinforcement Learning for Context-Faithful RAG Models
by: Tan, Zhehao, et al.
Published: (2026)
by: Tan, Zhehao, et al.
Published: (2026)
Pre-Trained Policy Discriminators are General Reward Models
by: Dou, Shihan, et al.
Published: (2025)
by: Dou, Shihan, et al.
Published: (2025)
A Survey of Large Language Models in Psychotherapy: Current Landscape and Future Directions
by: Na, Hongbin, et al.
Published: (2025)
by: Na, Hongbin, et al.
Published: (2025)
Enhancing Large Vision Language Models with Self-Training on Image Comprehension
by: Deng, Yihe, et al.
Published: (2024)
by: Deng, Yihe, et al.
Published: (2024)
CompassVerifier: A Unified and Robust Verifier for LLMs Evaluation and Outcome Reward
by: Liu, Shudong, et al.
Published: (2025)
by: Liu, Shudong, et al.
Published: (2025)
Trends in Integration of Knowledge and Large Language Models: A Survey and Taxonomy of Methods, Benchmarks, and Applications
by: Feng, Zhangyin, et al.
Published: (2023)
by: Feng, Zhangyin, et al.
Published: (2023)
Exploring Generative Process Reward Modeling for Semi-Structured Data: A Case Study of Table Question Answering
by: Tang, Lei, et al.
Published: (2025)
by: Tang, Lei, et al.
Published: (2025)
Software-Based Dialogue Systems: Survey, Taxonomy and Challenges
by: Motger, Quim, et al.
Published: (2021)
by: Motger, Quim, et al.
Published: (2021)
A Comprehensive Survey of Scientific Large Language Models and Their Applications in Scientific Discovery
by: Zhang, Yu, et al.
Published: (2024)
by: Zhang, Yu, et al.
Published: (2024)
VL-RewardBench: A Challenging Benchmark for Vision-Language Generative Reward Models
by: Li, Lei, et al.
Published: (2024)
by: Li, Lei, et al.
Published: (2024)
Linear Alignment: A Closed-form Solution for Aligning Human Preferences without Tuning and Feedback
by: Gao, Songyang, et al.
Published: (2024)
by: Gao, Songyang, et al.
Published: (2024)
Large Language Model Agent: A Survey on Methodology, Applications and Challenges
by: Luo, Junyu, et al.
Published: (2025)
by: Luo, Junyu, et al.
Published: (2025)
Insert or Attach: Taxonomy Completion via Box Embedding
by: Xue, Wei, et al.
Published: (2023)
by: Xue, Wei, et al.
Published: (2023)
RJUA-QA: A Comprehensive QA Dataset for Urology
by: Lyu, Shiwei, et al.
Published: (2023)
by: Lyu, Shiwei, et al.
Published: (2023)
Exploring the Limit of Outcome Reward for Learning Mathematical Reasoning
by: Lyu, Chengqi, et al.
Published: (2025)
by: Lyu, Chengqi, et al.
Published: (2025)
Taxonomy of Comprehensive Safety for Clinical Agents
by: Seo, Jean, et al.
Published: (2025)
by: Seo, Jean, et al.
Published: (2025)
Modeling and Optimizing User Preferences in AI Copilots: A Comprehensive Survey and Taxonomy
by: Afzoon, Saleh, et al.
Published: (2025)
by: Afzoon, Saleh, et al.
Published: (2025)
Enhancing Large Language Model Reasoning with Reward Models: An Analytical Survey
by: Liu, Qiyuan, et al.
Published: (2025)
by: Liu, Qiyuan, et al.
Published: (2025)
From Intentions to Techniques: A Comprehensive Taxonomy and Challenges in Text Watermarking for Large Language Models
by: Lalai, Harsh Nishant, et al.
Published: (2024)
by: Lalai, Harsh Nishant, et al.
Published: (2024)
CompassJudger-2: Towards Generalist Judge Model via Verifiable Rewards
by: Zhang, Taolin, et al.
Published: (2025)
by: Zhang, Taolin, et al.
Published: (2025)
Table Question Answering in the Era of Large Language Models: A Comprehensive Survey of Tasks, Methods, and Evaluation
by: Zhou, Wei, et al.
Published: (2025)
by: Zhou, Wei, et al.
Published: (2025)
Self-Rewarding Rubric-Based Reinforcement Learning for Open-Ended Reasoning
by: Ye, Zhiling, et al.
Published: (2025)
by: Ye, Zhiling, et al.
Published: (2025)
SteerRM: Debiasing Reward Models via Sparse Autoencoders
by: Sun, Mengyuan, et al.
Published: (2026)
by: Sun, Mengyuan, et al.
Published: (2026)
Similar Items
-
Detecting Hallucinations in Retrieval-Augmented Generation via Semantic-level Internal Reasoning Graph
by: Hu, Jianpeng, et al.
Published: (2026) -
GAP: Graph-Assisted Prompts for Dialogue-based Medication Recommendation
by: Zhong, Jialun, et al.
Published: (2025) -
Leveraging Large Language Model as Simulated Patients for Clinical Education
by: Li, Yanzeng, et al.
Published: (2024) -
MMPKUBase: A Comprehensive and High-quality Chinese Multi-modal Knowledge Graph
by: Yi, Xuan, et al.
Published: (2024) -
HAD: HAllucination Detection Language Models Based on a Comprehensive Hallucination Taxonomy
by: Xu, Fan, et al.
Published: (2025)