GRAM: A Generative Foundation Reward Model for Reward Generalization
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Chenglong, Gan, Yang, Huo, Yifu, Mu, Yongyu, He, Qiaozhi, Yang, Murun, Li, Bei, Xiao, Tong, Zhang, Chunliang, Liu, Tongran, Zhu, Jingbo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
LRHP: Learning Representations for Human Preferences via Preference Pairs
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards
por: Chang, Kaiyan, et al.
Publicado: (2026)
por: Chang, Kaiyan, et al.
Publicado: (2026)
MSRL: Scaling Generative Multimodal Reward Modeling via Multi-Stage Reinforcement Learning
por: Wang, Chenglong, et al.
Publicado: (2026)
por: Wang, Chenglong, et al.
Publicado: (2026)
Hybrid Alignment Training for Large Language Models
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
Revealing the Parallel Multilingual Learning within Large Language Models
por: Mu, Yongyu, et al.
Publicado: (2024)
por: Mu, Yongyu, et al.
Publicado: (2024)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
por: Zhou, Hang, et al.
Publicado: (2024)
por: Zhou, Hang, et al.
Publicado: (2024)
HEAL: A Hypothesis-Based Preference-Aware Analysis Framework
por: Huo, Yifu, et al.
Publicado: (2025)
por: Huo, Yifu, et al.
Publicado: (2025)
Cross-layer Attention Sharing for Pre-trained Large Language Models
por: Mu, Yongyu, et al.
Publicado: (2024)
por: Mu, Yongyu, et al.
Publicado: (2024)
DaPT: A Dual-Path Framework for Multilingual Multi-hop Question Answering
por: Wang, Yilin, et al.
Publicado: (2026)
por: Wang, Yilin, et al.
Publicado: (2026)
Learning Evaluation Models from Large Language Models for Sequence Generation
por: Wang, Chenglong, et al.
Publicado: (2023)
por: Wang, Chenglong, et al.
Publicado: (2023)
Boosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models
por: Mu, Yongyu, et al.
Publicado: (2025)
por: Mu, Yongyu, et al.
Publicado: (2025)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
por: Huang, Pengcheng, et al.
Publicado: (2024)
por: Huang, Pengcheng, et al.
Publicado: (2024)
SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models
por: Huo, Yifu, et al.
Publicado: (2026)
por: Huo, Yifu, et al.
Publicado: (2026)
Foundations of Large Language Models
por: Xiao, Tong, et al.
Publicado: (2025)
por: Xiao, Tong, et al.
Publicado: (2025)
SERM: Self-Evolving Relevance Model with Agent-Driven Learning from Massive Query Streams
por: Wang, Chenglong, et al.
Publicado: (2026)
por: Wang, Chenglong, et al.
Publicado: (2026)
Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs
por: Liu, Chris Yuhao, et al.
Publicado: (2024)
por: Liu, Chris Yuhao, et al.
Publicado: (2024)
LaTeXTrans: Structured LaTeX Translation with Multi-Agent Coordination
por: Zhu, Ziming, et al.
Publicado: (2025)
por: Zhu, Ziming, et al.
Publicado: (2025)
SLAM: Towards Efficient Multilingual Reasoning via Selective Language Alignment
por: Fan, Yuchun, et al.
Publicado: (2025)
por: Fan, Yuchun, et al.
Publicado: (2025)
CAMEL: Confidence-Gated Reflection for Reward Modeling
por: Zhu, Zirui, et al.
Publicado: (2026)
por: Zhu, Zirui, et al.
Publicado: (2026)
Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation
por: Yang, Wenkai, et al.
Publicado: (2026)
por: Yang, Wenkai, et al.
Publicado: (2026)
Zero-Shot Detection of LLM-Generated Text via Implicit Reward Model
por: Liu, Runheng, et al.
Publicado: (2026)
por: Liu, Runheng, et al.
Publicado: (2026)
GR-Ben: A General Reasoning Benchmark for Evaluating Process Reward Models
por: Sun, Zhouhao, et al.
Publicado: (2026)
por: Sun, Zhouhao, et al.
Publicado: (2026)
Rewarding Creativity: A Human-Aligned Generative Reward Model for Reinforcement Learning in Storytelling
por: Li, Zhaoyan, et al.
Publicado: (2026)
por: Li, Zhaoyan, et al.
Publicado: (2026)
RAG-RewardBench: Benchmarking Reward Models in Retrieval Augmented Generation for Preference Alignment
por: Jin, Zhuoran, et al.
Publicado: (2024)
por: Jin, Zhuoran, et al.
Publicado: (2024)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
por: Fan, Yuchun, et al.
Publicado: (2025)
por: Fan, Yuchun, et al.
Publicado: (2025)
Long-form RewardBench: Evaluating Reward Models for Long-form Generation
por: Huang, Hui, et al.
Publicado: (2026)
por: Huang, Hui, et al.
Publicado: (2026)
Reward Model Perspectives: Whose Opinions Do Reward Models Reward?
por: Elle
Publicado: (2025)
por: Elle
Publicado: (2025)
Dissecting Long-Chain-of-Thought Reasoning Models: An Empirical Study
por: Mu, Yongyu, et al.
Publicado: (2025)
por: Mu, Yongyu, et al.
Publicado: (2025)
Evaluating Reward Model Generalization via Pairwise Maximum Discrepancy Competitions
por: Luo, Shunyang, et al.
Publicado: (2026)
por: Luo, Shunyang, et al.
Publicado: (2026)
SALMON: Self-Alignment with Instructable Reward Models
por: Sun, Zhiqing, et al.
Publicado: (2023)
por: Sun, Zhiqing, et al.
Publicado: (2023)
PerPO: Perceptual Preference Optimization via Discriminative Rewarding
por: Zhu, Zining, et al.
Publicado: (2025)
por: Zhu, Zining, et al.
Publicado: (2025)
Regularizing Hidden States Enables Learning Generalizable Reward Model for LLMs
por: Yang, Rui, et al.
Publicado: (2024)
por: Yang, Rui, et al.
Publicado: (2024)
PartialFormer: Modeling Part Instead of Whole for Machine Translation
por: Zheng, Tong, et al.
Publicado: (2023)
por: Zheng, Tong, et al.
Publicado: (2023)
Beyond Sparse Rewards: Enhancing Reinforcement Learning with Language Model Critique in Text Generation
por: Cao, Meng, et al.
Publicado: (2024)
por: Cao, Meng, et al.
Publicado: (2024)
Reward Generalization in RLHF: A Topological Perspective
por: Qiu, Tianyi, et al.
Publicado: (2024)
por: Qiu, Tianyi, et al.
Publicado: (2024)
Secure Code Generation via Online Reinforcement Learning with Vulnerability Reward Model
por: Wu, Tianyi, et al.
Publicado: (2026)
por: Wu, Tianyi, et al.
Publicado: (2026)
Ejemplares similares
-
GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning
por: Wang, Chenglong, et al.
Publicado: (2025) -
LRHP: Learning Representations for Human Preferences via Preference Pairs
por: Wang, Chenglong, et al.
Publicado: (2024) -
Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
por: Wang, Chenglong, et al.
Publicado: (2025) -
RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data
por: Wang, Chenglong, et al.
Publicado: (2024) -
MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
por: Wang, Chenglong, et al.
Publicado: (2025)