Preference-Aware Rubric Learning for Personalized Evaluation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Qiu, Yilun, Zhao, Xiaoyan, Zhang, Yang, Chen, Yuxin, Yan, Cilin, Cai, Jiayin, Jiang, Xiaolong, Hu, Yao, Yamakata, Yoko, Chua, Tat-Seng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Measuring What Makes You Unique: Difference-Aware User Modeling for Enhancing LLM Personalization
von: Qiu, Yilun, et al.
Veröffentlicht: (2025)
von: Qiu, Yilun, et al.
Veröffentlicht: (2025)
SteerX: Disentangled Steering for LLM Personalization
von: Zhao, Xiaoyan, et al.
Veröffentlicht: (2025)
von: Zhao, Xiaoyan, et al.
Veröffentlicht: (2025)
AgentCVR: Active Multi-Agent Cross-Video Reasoning via Script-Simulated Reinforcement Learning
von: Qiu, Yilun, et al.
Veröffentlicht: (2026)
von: Qiu, Yilun, et al.
Veröffentlicht: (2026)
USB-Rec: An Effective Framework for Improving Conversational Recommendation Capability of Large Language Model
von: Wen, Jianyu, et al.
Veröffentlicht: (2025)
von: Wen, Jianyu, et al.
Veröffentlicht: (2025)
CARL: Criticality-Aware Agentic Reinforcement Learning
von: Shen, Leyang, et al.
Veröffentlicht: (2025)
von: Shen, Leyang, et al.
Veröffentlicht: (2025)
IGD: Token Decisiveness Modeling via Information Gain in LLMs for Personalized Recommendation
von: Lin, Zijie, et al.
Veröffentlicht: (2025)
von: Lin, Zijie, et al.
Veröffentlicht: (2025)
Reinforced Strategy Optimization for Conversational Recommender Systems via Network-of-Experts
von: Zhao, Xiaoyan, et al.
Veröffentlicht: (2025)
von: Zhao, Xiaoyan, et al.
Veröffentlicht: (2025)
Think-While-Generating: On-the-Fly Reasoning for Personalized Long-Form Generation
von: Wang, Chengbing, et al.
Veröffentlicht: (2025)
von: Wang, Chengbing, et al.
Veröffentlicht: (2025)
Know You Before You Speak: User-State Modeling for LLM Personalization in Multi-Turn Conversation
von: Luo, Jiani, et al.
Veröffentlicht: (2026)
von: Luo, Jiani, et al.
Veröffentlicht: (2026)
Understanding Multilingualism in Mixture-of-Experts LLMs: Routing Mechanism, Expert Specialization, and Layerwise Steering
von: Chen, Yuxin, et al.
Veröffentlicht: (2026)
von: Chen, Yuxin, et al.
Veröffentlicht: (2026)
A Highly Clean Recipe Dataset with Ingredient States Annotation for State Probing Task
von: Toyooka, Mashiro, et al.
Veröffentlicht: (2025)
von: Toyooka, Mashiro, et al.
Veröffentlicht: (2025)
G2S: A General-to-Specific Learning Framework for Temporal Knowledge Graph Forecasting with Large Language Models
von: Bai, Long, et al.
Veröffentlicht: (2025)
von: Bai, Long, et al.
Veröffentlicht: (2025)
DreamDPO: Aligning Text-to-3D Generation with Human Preferences via Direct Preference Optimization
von: Zhou, Zhenglin, et al.
Veröffentlicht: (2025)
von: Zhou, Zhenglin, et al.
Veröffentlicht: (2025)
Exploring the Impact of Personality Traits on Conversational Recommender Systems: A Simulation with Large Language Models
von: Zhao, Xiaoyan, et al.
Veröffentlicht: (2025)
von: Zhao, Xiaoyan, et al.
Veröffentlicht: (2025)
Open Rubric System: Scaling Reinforcement Learning with Pairwise Adaptive Rubric
von: Jia, Ruipeng, et al.
Veröffentlicht: (2026)
von: Jia, Ruipeng, et al.
Veröffentlicht: (2026)
Fine-Grained Verifiers: Preference Modeling as Next-token Prediction in Vision-Language Alignment
von: Cui, Chenhang, et al.
Veröffentlicht: (2024)
von: Cui, Chenhang, et al.
Veröffentlicht: (2024)
Large Language Models Empowered Personalized Web Agents
von: Cai, Hongru, et al.
Veröffentlicht: (2024)
von: Cai, Hongru, et al.
Veröffentlicht: (2024)
Hello Again! LLM-powered Personalized Agent for Long-term Dialogue
von: Li, Hao, et al.
Veröffentlicht: (2024)
von: Li, Hao, et al.
Veröffentlicht: (2024)
Latent Inter-User Difference Modeling for LLM Personalization
von: Qiu, Yilun, et al.
Veröffentlicht: (2025)
von: Qiu, Yilun, et al.
Veröffentlicht: (2025)
Deep Research as Rubric for Reinforcement Learning
von: Mei, Wangyi, et al.
Veröffentlicht: (2026)
von: Mei, Wangyi, et al.
Veröffentlicht: (2026)
Personalized Text Generation with Contrastive Activation Steering
von: Zhang, Jinghao, et al.
Veröffentlicht: (2025)
von: Zhang, Jinghao, et al.
Veröffentlicht: (2025)
XNLP: An Interactive Demonstration System for Universal Structured NLP
von: Fei, Hao, et al.
Veröffentlicht: (2023)
von: Fei, Hao, et al.
Veröffentlicht: (2023)
Self-Improvement Towards Pareto Optimality: Mitigating Preference Conflicts in Multi-Objective Alignment
von: Li, Moxin, et al.
Veröffentlicht: (2025)
von: Li, Moxin, et al.
Veröffentlicht: (2025)
Aligning Large Language Models for Faithful Integrity Against Opposing Argument
von: Zhao, Yong, et al.
Veröffentlicht: (2025)
von: Zhao, Yong, et al.
Veröffentlicht: (2025)
CrossVid: A Comprehensive Benchmark for Evaluating Cross-Video Reasoning in Multimodal Large Language Models
von: Li, Jingyao, et al.
Veröffentlicht: (2025)
von: Li, Jingyao, et al.
Veröffentlicht: (2025)
A Survey on Neural Question Generation: Methods, Applications, and Prospects
von: Guo, Shasha, et al.
Veröffentlicht: (2024)
von: Guo, Shasha, et al.
Veröffentlicht: (2024)
Object-centric Video Question Answering with Visual Grounding and Referring
von: Wang, Haochen, et al.
Veröffentlicht: (2025)
von: Wang, Haochen, et al.
Veröffentlicht: (2025)
NextQuill: Causal Preference Modeling for Enhancing LLM Personalization
von: Zhao, Xiaoyan, et al.
Veröffentlicht: (2025)
von: Zhao, Xiaoyan, et al.
Veröffentlicht: (2025)
ALI-Agent: Assessing LLMs' Alignment with Human Values via Agent-based Evaluation
von: Zheng, Jingnan, et al.
Veröffentlicht: (2024)
von: Zheng, Jingnan, et al.
Veröffentlicht: (2024)
Concept -- An Evaluation Protocol on Conversational Recommender Systems with System-centric and User-centric Factors
von: Huang, Chen, et al.
Veröffentlicht: (2024)
von: Huang, Chen, et al.
Veröffentlicht: (2024)
Learning to Generate Explainable Stock Predictions using Self-Reflective Large Language Models
von: Koa, Kelvin J. L., et al.
Veröffentlicht: (2024)
von: Koa, Kelvin J. L., et al.
Veröffentlicht: (2024)
Do LLMs and VLMs Share Neurons for Inference? Evidence and Mechanisms of Cross-Modal Transfer
von: Cui, Chenhang, et al.
Veröffentlicht: (2026)
von: Cui, Chenhang, et al.
Veröffentlicht: (2026)
Learning to Self-Verify Makes Language Models Better Reasoners
von: Chen, Yuxin, et al.
Veröffentlicht: (2026)
von: Chen, Yuxin, et al.
Veröffentlicht: (2026)
Self-Preference Bias in Rubric-Based Evaluation of Large Language Models
von: Pombal, José, et al.
Veröffentlicht: (2026)
von: Pombal, José, et al.
Veröffentlicht: (2026)
Don't Just Say "I don't know"! Self-aligning Large Language Models for Responding to Unknown Questions with Explanations
von: Deng, Yang, et al.
Veröffentlicht: (2024)
von: Deng, Yang, et al.
Veröffentlicht: (2024)
Prospect Personalized Recommendation on Large Language Model-based Agent Platform
von: Zhang, Jizhi, et al.
Veröffentlicht: (2024)
von: Zhang, Jizhi, et al.
Veröffentlicht: (2024)
Search-in-the-Chain: Interactively Enhancing Large Language Models with Search for Knowledge-intensive Tasks
von: Xu, Shicheng, et al.
Veröffentlicht: (2023)
von: Xu, Shicheng, et al.
Veröffentlicht: (2023)
Reinforcing Chain-of-Thought Reasoning with Self-Evolving Rubrics
von: Sheng, Leheng, et al.
Veröffentlicht: (2026)
von: Sheng, Leheng, et al.
Veröffentlicht: (2026)
Learning Query-Specific Rubrics from Human Preferences for DeepResearch Report Generation
von: Lv, Changze, et al.
Veröffentlicht: (2026)
von: Lv, Changze, et al.
Veröffentlicht: (2026)
Transport and Merge: Cross-Architecture Merging for Large Language Models
von: Cui, Chenhang, et al.
Veröffentlicht: (2026)
von: Cui, Chenhang, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Measuring What Makes You Unique: Difference-Aware User Modeling for Enhancing LLM Personalization
von: Qiu, Yilun, et al.
Veröffentlicht: (2025) -
SteerX: Disentangled Steering for LLM Personalization
von: Zhao, Xiaoyan, et al.
Veröffentlicht: (2025) -
AgentCVR: Active Multi-Agent Cross-Video Reasoning via Script-Simulated Reinforcement Learning
von: Qiu, Yilun, et al.
Veröffentlicht: (2026) -
USB-Rec: An Effective Framework for Improving Conversational Recommendation Capability of Large Language Model
von: Wen, Jianyu, et al.
Veröffentlicht: (2025) -
CARL: Criticality-Aware Agentic Reinforcement Learning
von: Shen, Leyang, et al.
Veröffentlicht: (2025)