场景抽象:用于词汇语义的结构化情境含义表示
计算与语言
2026-05-26 v2
摘要
咖啡和茶共享许多属性,却唤起截然不同的情境、氛围和情感联想。这些词义的情境维度是真实且系统性的,但在大多数计算的词汇含义表示中仍是隐式的。我们提出场景抽象(Scene Abstraction),用于构建词汇在不同使用情境中所参与的解释场景的结构化表示。每个场景由情境场景(事件、实体、场所)和以表达为中心的表达轮廓(参与事件、可概括属性、唤起情感)组成,通过大型语言模型的零样本提示实现。我们的贡献有三点:(1)用于情境词汇含义的结构化表示框架;(2)COCA-场景,包含 26 个关键词的 520 个使用实例用于不同场景识别;(3)来自两个实验的实证证据表明,场景在人类观察者之间可被可靠地识别(准确率为 82.4%,比仅基于文本的嵌入高出 11.8 个百分点),且我们的场景轮廓更贴近人类对词汇在语境中的解释(在三个语义维度上,偏好程度达到 86.4%)。
引用
@article{arxiv.2605.22542,
title = {Scene Abstraction for Lexical Semantics: Structured Representations of Situated Meaning},
author = {Yejin Cho and Katrin Erk},
journal= {arXiv preprint arXiv:2605.22542},
year = {2026}
}