PsychEval: A Multi-Session and Multi-Therapy Benchmark for High-Realism AI Psychological Counselor
Fuente:
arXiv
Salvato in:
| Autori principali: | Pan, Qianjun, Wang, Junyi, Zhou, Jie, Yang, Yutao, Li, Junsong, Xu, Kaiyin, Zhou, Yougen, Li, Yihan, Zhao, Jingyuan, Chen, Qin, Zhou, Ningning, Chen, Kai, He, Liang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PsychAgent: An Experience-Driven Lifelong Learning Agent for Self-Evolving Psychological Counselor
di: Yang, Yutao, et al.
Pubblicazione: (2026)
di: Yang, Yutao, et al.
Pubblicazione: (2026)
PRMB: Benchmarking Reward Models in Long-Horizon CBT-based Counseling Dialogue
di: Zhou, Yougen, et al.
Pubblicazione: (2026)
di: Zhou, Yougen, et al.
Pubblicazione: (2026)
DiaCBT: A Long-Periodic Dialogue Corpus Guided by Cognitive Conceptualization Diagram for CBT-based Psychological Counseling
di: Zhou, Yougen, et al.
Pubblicazione: (2025)
di: Zhou, Yougen, et al.
Pubblicazione: (2025)
Enhancing Depression-Diagnosis-Oriented Chat with Psychological State Tracking
di: Gu, Yiyang, et al.
Pubblicazione: (2024)
di: Gu, Yiyang, et al.
Pubblicazione: (2024)
Reinforced Interactive Continual Learning via Real-time Noisy Human Feedback
di: Yang, Yutao, et al.
Pubblicazione: (2025)
di: Yang, Yutao, et al.
Pubblicazione: (2025)
Mitigating Strategy Preference Bias in Emotional Support Conversation via Uncertainty Estimations
di: Zhou, Yougen, et al.
Pubblicazione: (2025)
di: Zhou, Yougen, et al.
Pubblicazione: (2025)
LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization
di: Li, Junsong, et al.
Pubblicazione: (2025)
di: Li, Junsong, et al.
Pubblicazione: (2025)
AutoSkill: Experience-Driven Lifelong Learning via Skill Self-Evolution
di: Yang, Yutao, et al.
Pubblicazione: (2026)
di: Yang, Yutao, et al.
Pubblicazione: (2026)
Teaching LLMs for Step-Level Automatic Math Correction via Reinforcement Learning
di: Li, Junsong, et al.
Pubblicazione: (2025)
di: Li, Junsong, et al.
Pubblicazione: (2025)
A Survey of Slow Thinking-based Reasoning LLMs using Reinforced Learning and Inference-time Scaling Law
di: Pan, Qianjun, et al.
Pubblicazione: (2025)
di: Pan, Qianjun, et al.
Pubblicazione: (2025)
Black-box Model Merging for Language-Model-as-a-Service with Massive Model Repositories
di: Chen, Shilian, et al.
Pubblicazione: (2025)
di: Chen, Shilian, et al.
Pubblicazione: (2025)
Forget What's Sensitive, Remember What Matters: Token-Level Differential Privacy in Memory Sculpting for Continual Learning
di: Zhan, Bihao, et al.
Pubblicazione: (2025)
di: Zhan, Bihao, et al.
Pubblicazione: (2025)
Building Self-Evolving Agents via Experience-Driven Lifelong Learning: A Framework and Benchmark
di: Cai, Yuxuan, et al.
Pubblicazione: (2025)
di: Cai, Yuxuan, et al.
Pubblicazione: (2025)
CiPO: Counterfactual Unlearning for Large Reasoning Models through Iterative Preference Optimization
di: Li, Junyi, et al.
Pubblicazione: (2026)
di: Li, Junyi, et al.
Pubblicazione: (2026)
Towards Fundamental Limits for Active Multi-distribution Learning
di: Zhang, Chicheng, et al.
Pubblicazione: (2025)
di: Zhang, Chicheng, et al.
Pubblicazione: (2025)
Psychological Counseling Cannot Be Achieved Overnight: Automated Psychological Counseling Through Multi-Session Conversations
di: Wang, Junzhe, et al.
Pubblicazione: (2025)
di: Wang, Junzhe, et al.
Pubblicazione: (2025)
Multi-view Intent Learning and Alignment with Large Language Models for Session-based Recommendation
di: Qiao, Shutong, et al.
Pubblicazione: (2024)
di: Qiao, Shutong, et al.
Pubblicazione: (2024)
HarmMetric Eval: Benchmarking Metrics and Judges for LLM Harmfulness Assessment
di: Yang, Langqi, et al.
Pubblicazione: (2025)
di: Yang, Langqi, et al.
Pubblicazione: (2025)
SciEval: A Multi-Level Large Language Model Evaluation Benchmark for Scientific Research
di: Sun, Liangtai, et al.
Pubblicazione: (2023)
di: Sun, Liangtai, et al.
Pubblicazione: (2023)
EvolMem: A Cognitive-Driven Benchmark for Multi-Session Dialogue Memory
di: Shen, Ye, et al.
Pubblicazione: (2026)
di: Shen, Ye, et al.
Pubblicazione: (2026)
Semantic-guided Masked Mutual Learning for Multi-modal Brain Tumor Segmentation with Arbitrary Missing Modalities
di: Liang, Guoyan, et al.
Pubblicazione: (2025)
di: Liang, Guoyan, et al.
Pubblicazione: (2025)
Quantifying Bounded Rationality: Formal Verification of Simon's Satisficing Through Flexible Stochastic Dominance
di: Li, Jingyuan, et al.
Pubblicazione: (2025)
di: Li, Jingyuan, et al.
Pubblicazione: (2025)
Effects of styrene–acrylic emulsion on bond performance and interface microstructure of repair mortar of ternary cementitious system
di: Chen Shi, et al.
Pubblicazione: (2024)
di: Chen Shi, et al.
Pubblicazione: (2024)
Psych
Pubblicazione: (2021)
Pubblicazione: (2021)
EvalTalker: Learning to Evaluate Real-Portrait-Driven Multi-Subject Talking Humans
di: Zhou, Yingjie, et al.
Pubblicazione: (2025)
di: Zhou, Yingjie, et al.
Pubblicazione: (2025)
PsychCounsel-Bench: Evaluating the Psychology Intelligence of Large Language Models
di: Zeng, Min
Pubblicazione: (2025)
di: Zeng, Min
Pubblicazione: (2025)
Psyche-R1: Towards Reliable Psychological LLMs through Unified Empathy, Expertise, and Reasoning
di: Dai, Chongyuan, et al.
Pubblicazione: (2025)
di: Dai, Chongyuan, et al.
Pubblicazione: (2025)
Ψ-Arena: Interactive Assessment and Optimization of LLM-based Psychological Counselors with Tripartite Feedback
di: Zhu, Shijing, et al.
Pubblicazione: (2025)
di: Zhu, Shijing, et al.
Pubblicazione: (2025)
Physion-Eval: Evaluating Physical Realism in Generated Video via Human Reasoning
di: Zhang, Qin, et al.
Pubblicazione: (2026)
di: Zhang, Qin, et al.
Pubblicazione: (2026)
Multi-source Multi-level Multi-token Ethereum Dataset and Benchmark Platform
di: Li, Haoyuan, et al.
Pubblicazione: (2025)
di: Li, Haoyuan, et al.
Pubblicazione: (2025)
EchoMind: An Interrelated Multi-level Benchmark for Evaluating Empathetic Speech Language Models
di: Zhou, Li, et al.
Pubblicazione: (2025)
di: Zhou, Li, et al.
Pubblicazione: (2025)
PsyDT: Using LLMs to Construct the Digital Twin of Psychological Counselor with Personalized Counseling Style for Psychological Counseling
di: Xie, Haojie, et al.
Pubblicazione: (2024)
di: Xie, Haojie, et al.
Pubblicazione: (2024)
Unveiling the Vulnerability of Graph-LLMs: An Interpretable Multi-Dimensional Adversarial Attack on TAGs
di: Fan, Bowen, et al.
Pubblicazione: (2025)
di: Fan, Bowen, et al.
Pubblicazione: (2025)
SD-Eval: A Benchmark Dataset for Spoken Dialogue Understanding Beyond Words
di: Ao, Junyi, et al.
Pubblicazione: (2024)
di: Ao, Junyi, et al.
Pubblicazione: (2024)
PsychēChat: An Empathic Framework Focused on Emotion Shift Tracking and Safety Risk Analysis in Psychological Counseling
di: Xia, Zhentao, et al.
Pubblicazione: (2026)
di: Xia, Zhentao, et al.
Pubblicazione: (2026)
Contextual Multi-Objective Optimization: Rethinking Objectives in Frontier AI Systems
di: Zhou, Jie, et al.
Pubblicazione: (2026)
di: Zhou, Jie, et al.
Pubblicazione: (2026)
Multi-dimensional Assessment and Explainable Feedback for Counselor Responses to Client Resistance in Text-based Counseling with LLMs
di: Li, Anqi, et al.
Pubblicazione: (2026)
di: Li, Anqi, et al.
Pubblicazione: (2026)
"Hidden" mechanisms for Gouy-Chapman layer and other critical features via Poisson-Boltzmann equations
di: Huang, Kaiyin, et al.
Pubblicazione: (2024)
di: Huang, Kaiyin, et al.
Pubblicazione: (2024)
Facial Attractiveness and Group Identity Influence Decision‐Making
di: Junchen Shang, et al.
Pubblicazione: (2025)
di: Junchen Shang, et al.
Pubblicazione: (2025)
AudioEval: Automatic Dual-Perspective and Multi-Dimensional Evaluation of Text-to-Audio-Generation
di: Wang, Hui, et al.
Pubblicazione: (2025)
di: Wang, Hui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PsychAgent: An Experience-Driven Lifelong Learning Agent for Self-Evolving Psychological Counselor
di: Yang, Yutao, et al.
Pubblicazione: (2026) -
PRMB: Benchmarking Reward Models in Long-Horizon CBT-based Counseling Dialogue
di: Zhou, Yougen, et al.
Pubblicazione: (2026) -
DiaCBT: A Long-Periodic Dialogue Corpus Guided by Cognitive Conceptualization Diagram for CBT-based Psychological Counseling
di: Zhou, Yougen, et al.
Pubblicazione: (2025) -
Enhancing Depression-Diagnosis-Oriented Chat with Psychological State Tracking
di: Gu, Yiyang, et al.
Pubblicazione: (2024) -
Reinforced Interactive Continual Learning via Real-time Noisy Human Feedback
di: Yang, Yutao, et al.
Pubblicazione: (2025)