CBT-Bench: Evaluating Large Language Models on Assisting Cognitive Behavior Therapy
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Mian, Yang, Xianjun, Zhang, Xinlu, Labrum, Travis, Chiu, Jamie C., Eack, Shaun M., Fang, Fei, Wang, William Yang, Chen, Zhiyu Zoey |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Preference Learning Unlocks LLMs' Psycho-Counseling Skills
by: Zhang, Mian, et al.
Published: (2025)
by: Zhang, Mian, et al.
Published: (2025)
PATIENT-Ψ: Using Large Language Models to Simulate Patients for Training Mental Health Professionals
by: Wang, Ruiyi, et al.
Published: (2024)
by: Wang, Ruiyi, et al.
Published: (2024)
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
by: Zhang, Xinlu, et al.
Published: (2024)
by: Zhang, Xinlu, et al.
Published: (2024)
Search Wisely: Mitigating Sub-optimal Agentic Searches By Reducing Uncertainty
by: Wu, Peilin, et al.
Published: (2025)
by: Wu, Peilin, et al.
Published: (2025)
A Survey on Large Language Models for Critical Societal Domains: Finance, Healthcare, and Law
by: Chen, Zhiyu Zoey, et al.
Published: (2024)
by: Chen, Zhiyu Zoey, et al.
Published: (2024)
AutoCBT: An Autonomous Multi-agent Framework for Cognitive Behavioral Therapy in Psychological Counseling
by: Xu, Ancheng, et al.
Published: (2025)
by: Xu, Ancheng, et al.
Published: (2025)
IDEA: Enhancing the Rule Learning Ability of Large Language Model Agent through Induction, Deduction, and Abduction
by: He, Kaiyu, et al.
Published: (2024)
by: He, Kaiyu, et al.
Published: (2024)
CBT-LLM: A Chinese Large Language Model for Cognitive Behavioral Therapy-based Mental Health Question Answering
by: Na, Hongbin
Published: (2024)
by: Na, Hongbin
Published: (2024)
CCD-CBT: Multi-Agent Therapeutic Interaction for CBT Guided by Cognitive Conceptualization Diagram
by: Liu, Chang, et al.
Published: (2026)
by: Liu, Chang, et al.
Published: (2026)
AlpaCare:Instruction-tuned Large Language Models for Medical Application
by: Zhang, Xinlu, et al.
Published: (2023)
by: Zhang, Xinlu, et al.
Published: (2023)
Do Retrieval-Augmented Language Models Adapt to Varying User Needs?
by: Wu, Peilin, et al.
Published: (2025)
by: Wu, Peilin, et al.
Published: (2025)
Complying with the National Institutes of Health Public Access Policy to Facilitate Science Availability for All
by: Eack, Shaun M.
Published: (2015)
by: Eack, Shaun M.
Published: (2015)
Enhancing Small Medical Learners with Privacy-preserving Contextual Prompting
by: Zhang, Xinlu, et al.
Published: (2023)
by: Zhang, Xinlu, et al.
Published: (2023)
Are Large Language Models Possible to Conduct Cognitive Behavioral Therapy?
by: Shen, Hao, et al.
Published: (2024)
by: Shen, Hao, et al.
Published: (2024)
DiaCBT: A Long-Periodic Dialogue Corpus Guided by Cognitive Conceptualization Diagram for CBT-based Psychological Counseling
by: Zhou, Yougen, et al.
Published: (2025)
by: Zhou, Yougen, et al.
Published: (2025)
Therapy as an NLP Task: Psychologists' Comparison of LLMs and Human Peers in CBT
by: Iftikhar, Zainab, et al.
Published: (2024)
by: Iftikhar, Zainab, et al.
Published: (2024)
PCA-Bench: Evaluating Multimodal Large Language Models in Perception-Cognition-Action Chain
by: Chen, Liang, et al.
Published: (2024)
by: Chen, Liang, et al.
Published: (2024)
Quokka: An Open-source Large Language Model ChatBot for Material Science
by: Yang, Xianjun, et al.
Published: (2024)
by: Yang, Xianjun, et al.
Published: (2024)
ClinBench-HPB: A Clinical Benchmark for Evaluating LLMs in Hepato-Pancreato-Biliary Diseases
by: Li, Yuchong, et al.
Published: (2025)
by: Li, Yuchong, et al.
Published: (2025)
ValueBench: Towards Comprehensively Evaluating Value Orientations and Understanding of Large Language Models
by: Ren, Yuanyi, et al.
Published: (2024)
by: Ren, Yuanyi, et al.
Published: (2024)
PLLaMa: An Open-source Large Language Model for Plant Science
by: Yang, Xianjun, et al.
Published: (2024)
by: Yang, Xianjun, et al.
Published: (2024)
VC-Bench: Pioneering the Video Connecting Benchmark with a Dataset and Evaluation Metrics
by: Yin, Zhiyu, et al.
Published: (2026)
by: Yin, Zhiyu, et al.
Published: (2026)
Weak-to-Strong Jailbreaking on Large Language Models
by: Zhao, Xuandong, et al.
Published: (2024)
by: Zhao, Xuandong, et al.
Published: (2024)
HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models
by: Que, Haoran, et al.
Published: (2024)
by: Que, Haoran, et al.
Published: (2024)
AI-Enhanced Cognitive Behavioral Therapy: Deep Learning and Large Language Models for Extracting Cognitive Pathways from Social Media Texts
by: Jiang, Meng, et al.
Published: (2024)
by: Jiang, Meng, et al.
Published: (2024)
IW-Bench: Evaluating Large Multimodal Models for Converting Image-to-Web
by: Guo, Hongcheng, et al.
Published: (2024)
by: Guo, Hongcheng, et al.
Published: (2024)
OmniEduBench: A Comprehensive Chinese Benchmark for Evaluating Large Language Models in Education
by: Zhang, Min, et al.
Published: (2025)
by: Zhang, Min, et al.
Published: (2025)
Assessing the Effectiveness of LLMs in Delivering Cognitive Behavioral Therapy
by: Bedi, Navdeep Singh, et al.
Published: (2026)
by: Bedi, Navdeep Singh, et al.
Published: (2026)
TurtleBench: Evaluating Top Language Models via Real-World Yes/No Puzzles
by: Yu, Qingchen, et al.
Published: (2024)
by: Yu, Qingchen, et al.
Published: (2024)
E-Bench: Towards Evaluating the Ease-of-Use of Large Language Models
by: Zhang, Zhenyu, et al.
Published: (2024)
by: Zhang, Zhenyu, et al.
Published: (2024)
OralMLLM-Bench: Evaluating Cognitive Capabilities of Multimodal Large Language Models in Dental Practice
by: Wang, Rongyang, et al.
Published: (2026)
by: Wang, Rongyang, et al.
Published: (2026)
Feel the Difference? A Comparative Analysis of Emotional Arcs in Real and LLM-Generated CBT Sessions
by: Wang, Xiaoyi, et al.
Published: (2025)
by: Wang, Xiaoyi, et al.
Published: (2025)
Unveiling the Misuse Potential of Base Large Language Models via In-Context Learning
by: Wang, Xiao, et al.
Published: (2024)
by: Wang, Xiao, et al.
Published: (2024)
EVALALIGN: Supervised Fine-Tuning Multimodal LLMs with Human-Aligned Data for Evaluating Text-to-Image Models
by: Tan, Zhiyu, et al.
Published: (2024)
by: Tan, Zhiyu, et al.
Published: (2024)
Evaluating Cognitive-Behavioral Fixation via Multimodal User Viewing Patterns on Social Media
by: Wang, Yujie, et al.
Published: (2025)
by: Wang, Yujie, et al.
Published: (2025)
VULCA-Bench: A Multicultural Vision-Language Benchmark for Evaluating Cultural Understanding
by: Yu, Haorui, et al.
Published: (2026)
by: Yu, Haorui, et al.
Published: (2026)
Perceptions of AI-CBT: Trust and Barriers in Chinese Postgrads
by: Sio, Chan-in, et al.
Published: (2025)
by: Sio, Chan-in, et al.
Published: (2025)
Exploring Fast and Flexible Zero‐Shot Low‐Light Image/Video Enhancement
by: Xianjun Han, et al.
Published: (2024)
by: Xianjun Han, et al.
Published: (2024)
MulCogBench: A Multi-modal Cognitive Benchmark Dataset for Evaluating Chinese and English Computational Language Models
by: Zhang, Yunhao, et al.
Published: (2024)
by: Zhang, Yunhao, et al.
Published: (2024)
COCOA: CBT-based Conversational Counseling Agent using Memory Specialized in Cognitive Distortions and Dynamic Prompt
by: Lee, Suyeon, et al.
Published: (2024)
by: Lee, Suyeon, et al.
Published: (2024)
Similar Items
-
Preference Learning Unlocks LLMs' Psycho-Counseling Skills
by: Zhang, Mian, et al.
Published: (2025) -
PATIENT-Ψ: Using Large Language Models to Simulate Patients for Training Mental Health Professionals
by: Wang, Ruiyi, et al.
Published: (2024) -
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
by: Zhang, Xinlu, et al.
Published: (2024) -
Search Wisely: Mitigating Sub-optimal Agentic Searches By Reducing Uncertainty
by: Wu, Peilin, et al.
Published: (2025) -
A Survey on Large Language Models for Critical Societal Domains: Finance, Healthcare, and Law
by: Chen, Zhiyu Zoey, et al.
Published: (2024)