PERM: Psychology-grounded Empathetic Reward Modeling for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Chengbing, Zheng, Wuqiang, Zhang, Yang, Zhu, Fengbin, Cheng, Junyi, Xie, Yi, Wang, Wenjie, Feng, Fuli |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
From Empathy to Personalized Empathy: Adapting Empathetic Strategies to Individual Users
di: Zheng, Wuqiang, et al.
Pubblicazione: (2026)
di: Zheng, Wuqiang, et al.
Pubblicazione: (2026)
One Adapts to Any: Meta Reward Modeling for Personalized LLM Alignment
di: Cai, Hongru, et al.
Pubblicazione: (2026)
di: Cai, Hongru, et al.
Pubblicazione: (2026)
Think Twice Before Trusting: Self-Detection for Large Language Models through Comprehensive Answer Reflection
di: Li, Moxin, et al.
Pubblicazione: (2024)
di: Li, Moxin, et al.
Pubblicazione: (2024)
CrAM: Credibility-Aware Attention Modification in LLMs for Combating Misinformation in RAG
di: Deng, Boyi, et al.
Pubblicazione: (2024)
di: Deng, Boyi, et al.
Pubblicazione: (2024)
NextAds: Towards Next-generation Personalized Video Advertising
di: Xu, Yiyan, et al.
Pubblicazione: (2026)
di: Xu, Yiyan, et al.
Pubblicazione: (2026)
AlpsBench: An LLM Personalization Benchmark for Real-Dialogue Memorization and Preference Alignment
di: Xiao, Jianfei, et al.
Pubblicazione: (2026)
di: Xiao, Jianfei, et al.
Pubblicazione: (2026)
Navigating Through Paper Flood: Advancing LLM-based Paper Evaluation through Domain-Aware Retrieval and Latent Reasoning
di: Zheng, Wuqiang, et al.
Pubblicazione: (2025)
di: Zheng, Wuqiang, et al.
Pubblicazione: (2025)
CARE: Causality Reasoning for Empathetic Responses by Conditional Graph Generation
di: Wang, Jiashuo, et al.
Pubblicazione: (2022)
di: Wang, Jiashuo, et al.
Pubblicazione: (2022)
Latent Inter-User Difference Modeling for LLM Personalization
di: Qiu, Yilun, et al.
Pubblicazione: (2025)
di: Qiu, Yilun, et al.
Pubblicazione: (2025)
Think-While-Generating: On-the-Fly Reasoning for Personalized Long-Form Generation
di: Wang, Chengbing, et al.
Pubblicazione: (2025)
di: Wang, Chengbing, et al.
Pubblicazione: (2025)
TAT-LLM: A Specialized Language Model for Discrete Reasoning over Tabular and Textual Data
di: Zhu, Fengbin, et al.
Pubblicazione: (2024)
di: Zhu, Fengbin, et al.
Pubblicazione: (2024)
IGD: Token Decisiveness Modeling via Information Gain in LLMs for Personalized Recommendation
di: Lin, Zijie, et al.
Pubblicazione: (2025)
di: Lin, Zijie, et al.
Pubblicazione: (2025)
Large Language Models Empowered Personalized Web Agents
di: Cai, Hongru, et al.
Pubblicazione: (2024)
di: Cai, Hongru, et al.
Pubblicazione: (2024)
Evaluating Mathematical Reasoning of Large Language Models: A Focus on Error Identification and Correction
di: Li, Xiaoyuan, et al.
Pubblicazione: (2024)
di: Li, Xiaoyuan, et al.
Pubblicazione: (2024)
Robust Prompt Optimization for Large Language Models Against Distribution Shifts
di: Li, Moxin, et al.
Pubblicazione: (2023)
di: Li, Moxin, et al.
Pubblicazione: (2023)
Sibyl: Empowering Empathetic Dialogue Generation in Large Language Models via Sensible and Visionary Commonsense Inference
di: Wang, Lanrui, et al.
Pubblicazione: (2023)
di: Wang, Lanrui, et al.
Pubblicazione: (2023)
DRC: Enhancing Personalized Image Generation via Disentangled Representation Composition
di: Xu, Yiyan, et al.
Pubblicazione: (2025)
di: Xu, Yiyan, et al.
Pubblicazione: (2025)
EchoMind: An Interrelated Multi-level Benchmark for Evaluating Empathetic Speech Language Models
di: Zhou, Li, et al.
Pubblicazione: (2025)
di: Zhou, Li, et al.
Pubblicazione: (2025)
RLVER: Reinforcement Learning with Verifiable Emotion Rewards for Empathetic Agents
di: Wang, Peisong, et al.
Pubblicazione: (2025)
di: Wang, Peisong, et al.
Pubblicazione: (2025)
Prospect Personalized Recommendation on Large Language Model-based Agent Platform
di: Zhang, Jizhi, et al.
Pubblicazione: (2024)
di: Zhang, Jizhi, et al.
Pubblicazione: (2024)
Are Large Language Models More Empathetic than Humans?
di: Welivita, Anuradha, et al.
Pubblicazione: (2024)
di: Welivita, Anuradha, et al.
Pubblicazione: (2024)
BLSP-Emo: Towards Empathetic Large Speech-Language Models
di: Wang, Chen, et al.
Pubblicazione: (2024)
di: Wang, Chen, et al.
Pubblicazione: (2024)
Unveiling Language-Specific Features in Large Language Models via Sparse Autoencoders
di: Deng, Boyi, et al.
Pubblicazione: (2025)
di: Deng, Boyi, et al.
Pubblicazione: (2025)
Optimizing Psychological Counseling with Instruction-Tuned Large Language Models
di: Li, Wenjie, et al.
Pubblicazione: (2024)
di: Li, Wenjie, et al.
Pubblicazione: (2024)
A Survey of Generative Search and Recommendation in the Era of Large Language Models
di: Li, Yongqi, et al.
Pubblicazione: (2024)
di: Li, Yongqi, et al.
Pubblicazione: (2024)
Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery
di: Yang, Chaoqun, et al.
Pubblicazione: (2026)
di: Yang, Chaoqun, et al.
Pubblicazione: (2026)
Efficient Inference for Large Language Model-based Generative Recommendation
di: Lin, Xinyu, et al.
Pubblicazione: (2024)
di: Lin, Xinyu, et al.
Pubblicazione: (2024)
Modeling Empathetic Alignment in Conversation
di: Yang, Jiamin, et al.
Pubblicazione: (2024)
di: Yang, Jiamin, et al.
Pubblicazione: (2024)
Unified Data Selection for LLM Reasoning
di: Li, Xiaoyuan, et al.
Pubblicazione: (2026)
di: Li, Xiaoyuan, et al.
Pubblicazione: (2026)
Reason4Rec: Large Language Models for Recommendation with Deliberative User Preference Alignment
di: Fang, Yi, et al.
Pubblicazione: (2025)
di: Fang, Yi, et al.
Pubblicazione: (2025)
An Iterative Associative Memory Model for Empathetic Response Generation
di: Yang, Zhou, et al.
Pubblicazione: (2024)
di: Yang, Zhou, et al.
Pubblicazione: (2024)
NegativePrompt: Leveraging Psychology for Large Language Models Enhancement via Negative Emotional Stimuli
di: Wang, Xu, et al.
Pubblicazione: (2024)
di: Wang, Xu, et al.
Pubblicazione: (2024)
WundtGPT: Shaping Large Language Models To Be An Empathetic, Proactive Psychologist
di: Ren, Chenyu, et al.
Pubblicazione: (2024)
di: Ren, Chenyu, et al.
Pubblicazione: (2024)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
di: Zhou, Hang, et al.
Pubblicazione: (2024)
di: Zhou, Hang, et al.
Pubblicazione: (2024)
Doc2SoarGraph: Discrete Reasoning over Visually-Rich Table-Text Documents via Semantic-Oriented Hierarchical Graphs
di: Zhu, Fengbin, et al.
Pubblicazione: (2023)
di: Zhu, Fengbin, et al.
Pubblicazione: (2023)
Counterfactual Debating with Preset Stances for Hallucination Elimination of LLMs
di: Fang, Yi, et al.
Pubblicazione: (2024)
di: Fang, Yi, et al.
Pubblicazione: (2024)
Generalist Reward Models: Found Inside Large Language Models
di: Li, Yi-Chen, et al.
Pubblicazione: (2025)
di: Li, Yi-Chen, et al.
Pubblicazione: (2025)
Measuring What Makes You Unique: Difference-Aware User Modeling for Enhancing LLM Personalization
di: Qiu, Yilun, et al.
Pubblicazione: (2025)
di: Qiu, Yilun, et al.
Pubblicazione: (2025)
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
di: Ding, Meidan, et al.
Pubblicazione: (2025)
di: Ding, Meidan, et al.
Pubblicazione: (2025)
Empathy Omni: Enabling Empathetic Speech Response Generation through Large Language Models
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
From Empathy to Personalized Empathy: Adapting Empathetic Strategies to Individual Users
di: Zheng, Wuqiang, et al.
Pubblicazione: (2026) -
One Adapts to Any: Meta Reward Modeling for Personalized LLM Alignment
di: Cai, Hongru, et al.
Pubblicazione: (2026) -
Think Twice Before Trusting: Self-Detection for Large Language Models through Comprehensive Answer Reflection
di: Li, Moxin, et al.
Pubblicazione: (2024) -
CrAM: Credibility-Aware Attention Modification in LLMs for Combating Misinformation in RAG
di: Deng, Boyi, et al.
Pubblicazione: (2024) -
NextAds: Towards Next-generation Personalized Video Advertising
di: Xu, Yiyan, et al.
Pubblicazione: (2026)