标注社交感知维度:热情与能力的句子级数据集
计算与语言
2026-04-28 v3
摘要
热情(W)(通常进一步细分为信任(T)和社交性(S))以及能力(C)是人们评估个体和社交群体(Fiske, 2018)所沿用的核心维度。虽然这些构念在社会心理学中已为人所知,但仅凭词汇水平的词典,尚未在自然语言处理研究中得到充分关注,这些词典无法完全捕捉在更大文本单元和语境中的情境表达。在本工作中,我们引入了热情与能力句子(Warmth and Competence Sentences,W&C-Sent),这是第一个标注热情与能力的句子级数据集。该数据集包含超过1600个英文句子-目标配对,沿三个维度进行标注:信任与社交性(热情的组成部分),以及能力。W&C-Sent中的句子是表达关于特定个体或社交群体(我们标注的目标)态度和意见的社交媒体帖子。我们详细描述了数据收集、标注和质量控制程序,并评估了各种大型语言模型(LLMs)在识别信任、社交性和能力方面的能力。W&C-Sent为分析语言中的热情与能力提供了新的资源,支持未来在自然语言处理与计算社会科学交叉领域的研究。
引用
@article{arxiv.2601.06316,
title = {Annotating Dimensions of Social Perception in Text: A Sentence-Level Dataset of Warmth and Competence},
author = {Mutaz Ayesh and Saif M. Mohammad and Nedjma Ousidhoum},
journal= {arXiv preprint arXiv:2601.06316},
year = {2026}
}
备注
Accepted at ACL2026 (Main Conference)