Computation and Language · Computer Science
PsychiatryBench: A Multi-Task Benchmark for LLMs in Psychiatry
Aya E. Fouda, Abdelrahamn A. Hassan, Radwa J. Hanafy, Mohammed E. Fouda
2025-11-25
Computation and Language · Computer Science
PsychBench: A comprehensive and professional benchmark for evaluating the performance of LLM-assisted psychiatric clinical practice
Shuyu Liu, Ruoxi Wang, Ling Zhang, Xuequan Zhu +6
2025-06-19
Computation and Language · Computer Science
Large Language Models in Mental Health Care: a Scoping Review
Yining Hua, Fenglin Liu, Kailai Yang, Zehan Li +8
2025-07-14
Computation and Language · Computer Science
PsycoLLM: Enhancing LLM for Psychological Understanding and Evaluation
Jinpeng Hu, Tengteng Dong, Luo Gang, Hui Ma +5
2024-12-09
Computers and Society · Computer Science
Large Language Model for Mental Health: A Systematic Review
Zhijun Guo, Alvina Lai, Johan Hilge Thygesen, Joseph Farrington +2
2024-08-14
Computation and Language · Computer Science
Beyond Empathy: Integrating Diagnostic and Therapeutic Reasoning with Large Language Models for Mental Health Counseling
He Hu, Yucheng Zhou, Juzheng Si, Qianning Wang +5
2025-11-04
Computation and Language · Computer Science
Large Language Models for Mental Health: A Multilingual Evaluation
Nishat Raihan, Sadiya Sayara Chowdhury Puspo, Ana-Maria Bucur, Stevie Chancellor +1
2026-02-03
Computation and Language · Computer Science
MindEval: Benchmarking Language Models on Multi-turn Mental Health Support
José Pombal, Maya D'Eon, Nuno M. Guerreiro, Pedro Henrique Martins +2
2025-12-08
Artificial Intelligence · Computer Science
Applying and Evaluating Large Language Models in Mental Health Care: A Scoping Review of Human-Assessed Generative Tasks
Yining Hua, Hongbin Na, Zehan Li, Fenglin Liu +3
2024-08-22
Computation and Language · Computer Science
TrustMH-Bench: A Comprehensive Benchmark for Evaluating the Trustworthiness of Large Language Models in Mental Health
Zixin Xiong, Ziteng Wang, Haotian Fan, Xinjie Zhang +1
2026-03-04
Computation and Language · Computer Science
Evaluating large language models in medical applications: a survey
Xiaolan Chen, Jiayang Xiang, Shanfu Lu, Yexin Liu +2
2024-05-14
Computation and Language · Computer Science
Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving
Yuxuan Zhou, Xien Liu, Chenwei Yan, Chen Ning +7
2025-06-11
Computation and Language · Computer Science
Building Multilingual Datasets for Predicting Mental Health Severity through LLMs: Prospects and Challenges
Konstantinos Skianis, John Pavlopoulos, A. Seza Doğruöz
2026-02-10
Computation and Language · Computer Science
Psy-LLM: Scaling up Global Mental Health Psychological Services with AI-based Large Language Models
Tin Lai, Yukun Shi, Zicong Du, Jiajie Wu +3
2023-09-04
Computation and Language · Computer Science
Role-Playing Evaluation for Large Language Models
Yassine El Boudouri, Walter Nuninger, Julian Alvarez, Yvan Peter
2025-05-20
Computation and Language · Computer Science
LLMEval-Med: A Real-world Clinical Benchmark for Medical LLMs with Physician Validation
Ming Zhang, Yujiong Shen, Zelin Li, Huayu Sha +12
2025-09-03
Artificial Intelligence · Computer Science
A Comprehensive Evaluation of Large Language Models on Mental Illnesses
Abdelrahman Hanafi, Mohammed Saad, Noureldin Zahran, Radwa J. Hanafy +1
2025-11-25
Computation and Language · Computer Science
A Survey on Evaluation of Large Language Models
Yupeng Chang, Xu Wang, Jindong Wang, Yuan Wu +12
2024-01-01
Computation and Language · Computer Science
When Can We Trust LLMs in Mental Health? Large-Scale Benchmarks for Reliable LLM Evaluation
Abeer Badawi, Elahe Rahimi, Md Tahmid Rahman Laskar, Sheri Grach +5
2025-10-23
Computers and Society · Computer Science
Humanizing LLMs: A Survey of Psychological Measurements with Tools, Datasets, and Human-Agent Applications
Wenhan Dong, Yuemeng Zhao, Zhen Sun, Yule Liu +9
2025-05-02
Computation and Language · Computer Science
Evaluating Large Language Models with Psychometrics
Yuan Li, Yue Huang, Hongyi Wang, Ying Cheng +3
2025-10-20
Computation and Language · Computer Science
The opportunities and risks of large language models in mental health
Hannah R. Lawrence, Renee A. Schneider, Susan B. Rubin, Maja J. Mataric +2
2024-08-02
Computation and Language · Computer Science
MedEthicEval: Evaluating Large Language Models Based on Chinese Medical Ethics
Haoan Jin, Jiacheng Shi, Hanhui Xu, Kenny Q. Zhu +1
2025-03-05
Computation and Language · Computer Science
SemioLLM: Evaluating Large Language Models for Diagnostic Reasoning from Unstructured Clinical Narratives in Epilepsy
Meghal Dani, Muthu Jeyanthi Prakash, Filip Rosa, Zeynep Akata +1
2026-04-01