作为利用机器学习度量文本公平性启发式的黄金法则
计算与语言
2022-11-07 v4 人工智能
摘要
在本文中,我们提出一个自然语言编程框架,以考量如何度量行为的公平性。就本文目的而言,公平行为被定义为若施加于自身则会被接受的行为。该方法基于黄金法则(GR)在数字领域的实现。尽管 GR 作为公理贯穿历史广为流传,但尚无将此道德哲学转入计算系统的先例。在本文中我们考量如何以算法使该法则可操作化,从而可用于度量诸如“男孩伤害了女孩”这样的句子,并将其分类为公平或不公平。我们对针对 GR 的批评进行了评述与回应。并就如何实施该技术以避免词嵌入中的不公平偏见提出建议——鉴于个体通常不愿成为不公平行为(如种族主义)的承受方,无论所用语料库是否将此类歧视视为值得赞扬。
引用
@article{arxiv.2111.00107,
title = {The Golden Rule as a Heuristic to Measure the Fairness of Texts Using Machine Learning},
author = {Ahmed Izzidien and David Stillwell},
journal= {arXiv preprint arXiv:2111.00107},
year = {2022}
}