PRMB: Benchmarking Reward Models in Long-Horizon CBT-based Counseling Dialogue
Fuente:
arXiv
Saved in:
| Main Authors: | Zhou, Yougen, Chen, Qin, Zhou, Ningning, Zhou, Jie, He, Liang |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DiaCBT: A Long-Periodic Dialogue Corpus Guided by Cognitive Conceptualization Diagram for CBT-based Psychological Counseling
by: Zhou, Yougen, et al.
Published: (2025)
by: Zhou, Yougen, et al.
Published: (2025)
Mitigating Strategy Preference Bias in Emotional Support Conversation via Uncertainty Estimations
by: Zhou, Yougen, et al.
Published: (2025)
by: Zhou, Yougen, et al.
Published: (2025)
Enhancing Depression-Diagnosis-Oriented Chat with Psychological State Tracking
by: Gu, Yiyang, et al.
Published: (2024)
by: Gu, Yiyang, et al.
Published: (2024)
All-in-one Graph-based Indexing for Hybrid Search on GPUs
by: Li, Zhonggen, et al.
Published: (2025)
by: Li, Zhonggen, et al.
Published: (2025)
VectraFlow: Long-Horizon Semantic Processing over Data and Event Streams with LLMs
by: Chen, Shu, et al.
Published: (2026)
by: Chen, Shu, et al.
Published: (2026)
Benchmarking Data Management Systems for Microservices
by: Laigner, Rodrigo, et al.
Published: (2024)
by: Laigner, Rodrigo, et al.
Published: (2024)
Large Language Model-Enhanced Relational Operators: Taxonomy, Benchmark, and Analysis
by: Su, Yunxiang, et al.
Published: (2026)
by: Su, Yunxiang, et al.
Published: (2026)
DiaHalu: A Dialogue-level Hallucination Evaluation Benchmark for Large Language Models
by: Chen, Kedi, et al.
Published: (2024)
by: Chen, Kedi, et al.
Published: (2024)
DB-GPT-Hub: Towards Open Benchmarking Text-to-SQL Empowered by Large Language Models
by: Zhou, Fan, et al.
Published: (2024)
by: Zhou, Fan, et al.
Published: (2024)
Revolutionizing Database Q&A with Large Language Models: Comprehensive Benchmark and Evaluation
by: Zheng, Yihang, et al.
Published: (2024)
by: Zheng, Yihang, et al.
Published: (2024)
Utility-based Privacy Preserving Data Mining
by: Zhou, Qingfeng, et al.
Published: (2025)
by: Zhou, Qingfeng, et al.
Published: (2025)
Downsizing Diffusion Models for Cardinality Estimation
by: Mu, Xinhe, et al.
Published: (2025)
by: Mu, Xinhe, et al.
Published: (2025)
High Throughput Shortest Distance Query Processing on Large Dynamic Road Networks
by: Zhou, Xinjie, et al.
Published: (2024)
by: Zhou, Xinjie, et al.
Published: (2024)
Efficient Partition-based Approaches for Diversified Top-k Subgraph Matching
by: Chen, Liuyi, et al.
Published: (2025)
by: Chen, Liuyi, et al.
Published: (2025)
An Empirical Survey and Benchmark of Learned Distance Indexes for Road Networks
by: Choudhary, Gautam, et al.
Published: (2026)
by: Choudhary, Gautam, et al.
Published: (2026)
Discovering Top-k Periodic and High-Utility Patterns
by: Zhou, Qingfeng, et al.
Published: (2025)
by: Zhou, Qingfeng, et al.
Published: (2025)
Efficient Data Valuation Approximation in Federated Learning: A Sampling-based Approach
by: Wei, Shuyue, et al.
Published: (2025)
by: Wei, Shuyue, et al.
Published: (2025)
ODUTQA-MDC: A Task for Open-Domain Underspecified Tabular QA with Multi-turn Dialogue-based Clarification
by: Wang, Zhensheng, et al.
Published: (2026)
by: Wang, Zhensheng, et al.
Published: (2026)
Online Marketplace: A Benchmark for Data Management in Microservices
by: Laigner, Rodrigo, et al.
Published: (2024)
by: Laigner, Rodrigo, et al.
Published: (2024)
Revisiting Graph Analytics Benchmark
by: Meng, Lingkai, et al.
Published: (2025)
by: Meng, Lingkai, et al.
Published: (2025)
CroTad: A Contrastive Reinforcement Learning Framework for Online Trajectory Anomaly Detection
by: Xue, Rui, et al.
Published: (2025)
by: Xue, Rui, et al.
Published: (2025)
SMARTFEAT: Efficient Feature Construction through Feature-Level Foundation Model Interactions
by: Lin, Yin, et al.
Published: (2023)
by: Lin, Yin, et al.
Published: (2023)
Fast Commitment for Geo-Distributed Transactions via Decentralized Co-coordinators
by: Zhang, Zihao, et al.
Published: (2023)
by: Zhang, Zihao, et al.
Published: (2023)
Workspace-Bench 1.0: Benchmarking AI Agents on Workspace Tasks with Large-Scale File Dependencies
by: Tang, Zirui, et al.
Published: (2026)
by: Tang, Zirui, et al.
Published: (2026)
OODBench: Out-of-Distribution Benchmark for Large Vision-Language Models
by: Lin, Ling, et al.
Published: (2026)
by: Lin, Ling, et al.
Published: (2026)
BridgeScope: A Universal Toolkit for Bridging Large Language Models and Databases
by: Weng, Lianggui, et al.
Published: (2025)
by: Weng, Lianggui, et al.
Published: (2025)
FeatInsight: An Online ML Feature Management System on 4Paradigm Sage-Studio Platform
by: Tong, Xin, et al.
Published: (2025)
by: Tong, Xin, et al.
Published: (2025)
PBench: Workload Synthesizer with Real Statistics for Cloud Analytics Benchmarking
by: Zhou, Yan, et al.
Published: (2025)
by: Zhou, Yan, et al.
Published: (2025)
PsychEval: A Multi-Session and Multi-Therapy Benchmark for High-Realism AI Psychological Counselor
by: Pan, Qianjun, et al.
Published: (2026)
by: Pan, Qianjun, et al.
Published: (2026)
Sm-Nd Isotope Data Compilation from Geoscientific Literature Using an Automated Tabular Extraction Method
by: Guo, Zhixin, et al.
Published: (2024)
by: Guo, Zhixin, et al.
Published: (2024)
A Universal Scheme for Dynamic Partitioned Shortest Path Index: Survey, Improvement, and Experiments
by: Zhang, Mengxuan, et al.
Published: (2023)
by: Zhang, Mengxuan, et al.
Published: (2023)
A Graph-native Optimization Framework for Complex Graph Queries
by: Lyu, Bingqing, et al.
Published: (2025)
by: Lyu, Bingqing, et al.
Published: (2025)
Milliscale: Fast Commit on Low-Latency Object Storage
by: Zhou, Jiatang, et al.
Published: (2026)
by: Zhou, Jiatang, et al.
Published: (2026)
Gate-Based and Annealing-Based Quantum Algorithms for the Maximum K-Plex Problem
by: Li, Xiaofan, et al.
Published: (2025)
by: Li, Xiaofan, et al.
Published: (2025)
SynchroStore: A Cost-Based Fine-Grained Incremental Compaction for Hybrid Workloads
by: Zhang, Yinan, et al.
Published: (2025)
by: Zhang, Yinan, et al.
Published: (2025)
OpenGLT: A Comprehensive Benchmark of Graph Neural Networks for Graph-Level Tasks
by: Li, Haoyang, et al.
Published: (2025)
by: Li, Haoyang, et al.
Published: (2025)
CARPO: Leveraging Listwise Learning-to-Rank for Context-Aware Query Plan Optimization
by: Zhou, Wenrui, et al.
Published: (2025)
by: Zhou, Wenrui, et al.
Published: (2025)
Efficient Size Constraint Community Search over Heterogeneous Information Networks
by: Zhang, Xinjian, et al.
Published: (2025)
by: Zhang, Xinjian, et al.
Published: (2025)
Exploring Distance Query Processing in Edge Computing Environments
by: Zhang, Xiubo, et al.
Published: (2024)
by: Zhang, Xiubo, et al.
Published: (2024)
Disk-Resident Graph ANN Search: An Experimental Evaluation
by: Chen, Xiaoyu, et al.
Published: (2026)
by: Chen, Xiaoyu, et al.
Published: (2026)
Similar Items
-
DiaCBT: A Long-Periodic Dialogue Corpus Guided by Cognitive Conceptualization Diagram for CBT-based Psychological Counseling
by: Zhou, Yougen, et al.
Published: (2025) -
Mitigating Strategy Preference Bias in Emotional Support Conversation via Uncertainty Estimations
by: Zhou, Yougen, et al.
Published: (2025) -
Enhancing Depression-Diagnosis-Oriented Chat with Psychological State Tracking
by: Gu, Yiyang, et al.
Published: (2024) -
All-in-one Graph-based Indexing for Hybrid Search on GPUs
by: Li, Zhonggen, et al.
Published: (2025) -
VectraFlow: Long-Horizon Semantic Processing over Data and Event Streams with LLMs
by: Chen, Shu, et al.
Published: (2026)