Establishing Reliability Metrics for Reward Models in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yizhou, Liu, Yawen, Wang, Xuesi, Yu, Qingtao, Huzhang, Guangda, Zeng, Anxiang, Yu, Han, Zhou, Zhiming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Optimal Transport-Based Token Weighting scheme for Enhanced Preference Optimization
di: Li, Meng, et al.
Pubblicazione: (2025)
di: Li, Meng, et al.
Pubblicazione: (2025)
Towards Reliable Evaluation of Large Language Models for Multilingual and Multimodal E-Commerce Applications
di: Xie, Shuyi, et al.
Pubblicazione: (2025)
di: Xie, Shuyi, et al.
Pubblicazione: (2025)
Residual Multi-Task Learner for Applied Ranking
di: Fu, Cong, et al.
Pubblicazione: (2024)
di: Fu, Cong, et al.
Pubblicazione: (2024)
Uncertainty Estimation of Large Language Models in Medical Question Answering
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
AMix-2: Establishing Protein as a Native Modality in Large Language Models
di: Qiu, Keyue, et al.
Pubblicazione: (2026)
di: Qiu, Keyue, et al.
Pubblicazione: (2026)
Secrets of RLHF in Large Language Models Part II: Reward Modeling
di: Wang, Binghai, et al.
Pubblicazione: (2024)
di: Wang, Binghai, et al.
Pubblicazione: (2024)
Beyond Reward Hacking: Causal Rewards for Large Language Model Alignment
di: Wang, Chaoqi, et al.
Pubblicazione: (2025)
di: Wang, Chaoqi, et al.
Pubblicazione: (2025)
Full-ECE: A Metric For Token-level Calibration on Large Language Models
di: Liu, Han, et al.
Pubblicazione: (2024)
di: Liu, Han, et al.
Pubblicazione: (2024)
RewardFlow: Topology-Aware Reward Propagation on State Graphs for Agentic RL with Large Language Models
di: Feng, Xiao, et al.
Pubblicazione: (2026)
di: Feng, Xiao, et al.
Pubblicazione: (2026)
DataMan: Data Manager for Pre-training Large Language Models
di: Peng, Ru, et al.
Pubblicazione: (2025)
di: Peng, Ru, et al.
Pubblicazione: (2025)
RewardDS: Privacy-Preserving Fine-Tuning for Large Language Models via Reward Driven Data Synthesis
di: Wang, Jianwei, et al.
Pubblicazione: (2025)
di: Wang, Jianwei, et al.
Pubblicazione: (2025)
Efficient Paths and Dense Rewards: Probabilistic Flow Reasoning for Large Language Models
di: Liu, Yan, et al.
Pubblicazione: (2026)
di: Liu, Yan, et al.
Pubblicazione: (2026)
BadThink: Triggered Overthinking Attacks on Chain-of-Thought Reasoning in Large Language Models
di: Liu, Shuaitong, et al.
Pubblicazione: (2025)
di: Liu, Shuaitong, et al.
Pubblicazione: (2025)
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
di: Wu, Yanru, et al.
Pubblicazione: (2026)
di: Wu, Yanru, et al.
Pubblicazione: (2026)
GRPO and Reflection Reward for Mathematical Reasoning in Large Language Models
di: Wang, Zhijie
Pubblicazione: (2026)
di: Wang, Zhijie
Pubblicazione: (2026)
Large Language Models for Robotics: A Survey
di: Zeng, Fanlong, et al.
Pubblicazione: (2023)
di: Zeng, Fanlong, et al.
Pubblicazione: (2023)
Quantized Large Language Models in Biomedical Natural Language Processing: Evaluation and Recommendation
di: Zhan, Zaifu, et al.
Pubblicazione: (2025)
di: Zhan, Zaifu, et al.
Pubblicazione: (2025)
Learning Reward for Robot Skills Using Large Language Models via Self-Alignment
di: Zeng, Yuwei, et al.
Pubblicazione: (2024)
di: Zeng, Yuwei, et al.
Pubblicazione: (2024)
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
di: Ding, Meidan, et al.
Pubblicazione: (2025)
di: Ding, Meidan, et al.
Pubblicazione: (2025)
HuRef: HUman-REadable Fingerprint for Large Language Models
di: Zeng, Boyi, et al.
Pubblicazione: (2023)
di: Zeng, Boyi, et al.
Pubblicazione: (2023)
Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs
di: Liu, Chris Yuhao, et al.
Pubblicazione: (2024)
di: Liu, Chris Yuhao, et al.
Pubblicazione: (2024)
AHAMask: Reliable Task Specification for Large Audio Language Models without Instructions
di: Guo, Yiwei, et al.
Pubblicazione: (2025)
di: Guo, Yiwei, et al.
Pubblicazione: (2025)
Self-Consistency of the Internal Reward Models Improves Self-Rewarding Language Models
di: Zhou, Xin, et al.
Pubblicazione: (2025)
di: Zhou, Xin, et al.
Pubblicazione: (2025)
RewardAnything: Generalizable Principle-Following Reward Models
di: Yu, Zhuohao, et al.
Pubblicazione: (2025)
di: Yu, Zhuohao, et al.
Pubblicazione: (2025)
Auto MC-Reward: Automated Dense Reward Design with Large Language Models for Minecraft
di: Li, Hao, et al.
Pubblicazione: (2023)
di: Li, Hao, et al.
Pubblicazione: (2023)
Collaborative Editable Model
di: Tang, Kaiwen, et al.
Pubblicazione: (2025)
di: Tang, Kaiwen, et al.
Pubblicazione: (2025)
From Captions to Rewards (CAREVL): Leveraging Large Language Model Experts for Enhanced Reward Modeling in Large Vision-Language Models
di: Dai, Muzhi, et al.
Pubblicazione: (2025)
di: Dai, Muzhi, et al.
Pubblicazione: (2025)
Generating and Evolving Reward Functions for Highway Driving with Large Language Models
di: Han, Xu, et al.
Pubblicazione: (2024)
di: Han, Xu, et al.
Pubblicazione: (2024)
Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models
di: Liu, Yuqing, et al.
Pubblicazione: (2024)
di: Liu, Yuqing, et al.
Pubblicazione: (2024)
Compass-Thinker-7B Technical Report
di: Zeng, Anxiang, et al.
Pubblicazione: (2025)
di: Zeng, Anxiang, et al.
Pubblicazione: (2025)
MemoryRewardBench: Benchmarking Reward Models for Long-Term Memory Management in Large Language Models
di: Tang, Zecheng, et al.
Pubblicazione: (2026)
di: Tang, Zecheng, et al.
Pubblicazione: (2026)
ARISE: An Adaptive Resolution-Aware Metric for Test-Time Scaling Evaluation in Large Reasoning Models
di: Yin, Zhangyue, et al.
Pubblicazione: (2025)
di: Yin, Zhangyue, et al.
Pubblicazione: (2025)
Leveraging Large Language Models for Fuzzy String Matching in Political Science
di: Wang, Yu
Pubblicazione: (2024)
di: Wang, Yu
Pubblicazione: (2024)
Reward Models are Metrics in a Trench Coat
di: Gehrmann, Sebastian
Pubblicazione: (2025)
di: Gehrmann, Sebastian
Pubblicazione: (2025)
Building Autonomous GUI Navigation via Agentic-Q Estimation and Step-Wise Policy Optimization
di: Wang, Yibo, et al.
Pubblicazione: (2026)
di: Wang, Yibo, et al.
Pubblicazione: (2026)
Consolidating Trees of Robotic Plans Generated Using Large Language Models to Improve Reliability
di: Sakib, Md Sadman, et al.
Pubblicazione: (2024)
di: Sakib, Md Sadman, et al.
Pubblicazione: (2024)
CCCaption: Dual-Reward Reinforcement Learning for Complete and Correct Image Captioning
di: Tang, Zhijiang, et al.
Pubblicazione: (2026)
di: Tang, Zhijiang, et al.
Pubblicazione: (2026)
ReasonGRM: Enhancing Generative Reward Models through Large Reasoning Models
di: Chen, Bin, et al.
Pubblicazione: (2025)
di: Chen, Bin, et al.
Pubblicazione: (2025)
A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models
di: Zheng, Congmin, et al.
Pubblicazione: (2025)
di: Zheng, Congmin, et al.
Pubblicazione: (2025)
AINav: Large Language Model-Based Adaptive Interactive Navigation
di: Zhou, Kangjie, et al.
Pubblicazione: (2025)
di: Zhou, Kangjie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Optimal Transport-Based Token Weighting scheme for Enhanced Preference Optimization
di: Li, Meng, et al.
Pubblicazione: (2025) -
Towards Reliable Evaluation of Large Language Models for Multilingual and Multimodal E-Commerce Applications
di: Xie, Shuyi, et al.
Pubblicazione: (2025) -
Residual Multi-Task Learner for Applied Ranking
di: Fu, Cong, et al.
Pubblicazione: (2024) -
Uncertainty Estimation of Large Language Models in Medical Question Answering
di: Wu, Jiaxin, et al.
Pubblicazione: (2024) -
AMix-2: Establishing Protein as a Native Modality in Large Language Models
di: Qiu, Keyue, et al.
Pubblicazione: (2026)