中文

主观性与客观性总是一致吗?以 Stack Overflow 问题为例的研究

软件工程 2023-04-10 v1

摘要

在 Stack Overflow(SO)中,帖子(即问题和答案)的质量由用户通过投票机制主观评价。帖子获得的净投票数(赞数减踩数)常被视为其质量的近似。然而,约半数获得可行解决方案的问题得到的踩数多于赞数。此外,约 18% 的已采纳答案(即已验证解决方案)也未获得最高票数。所有这些反直觉发现令人们对 SO 所采用评价机制的可靠性产生怀疑。而且,许多用户对其评价提出质疑,尤其是对其帖子的踩票。因此,亟需对主观评价进行严格验证,以确保无偏且可靠的质量评估机制。本文使用 250 万条问题和十项文本分析指标,比较问题的主观评估与客观评估。根据我们的调查,四项客观指标与主观评价一致,两项不一致,一项或一致或不一致,其余三项既不一致也不不一致。随后我们开发机器学习模型对受推崇和被劝阻的问题进行分类。我们的模型以最高约 76%–87% 的准确率优于最先进模型。

关键词

引用

@article{arxiv.2304.03563,
  title  = {Do Subjectivity and Objectivity Always Agree? A Case Study with Stack Overflow Questions},
  author = {Saikat Mondal and Mohammad Masudur Rahman and Chanchal K. Roy},
  journal= {arXiv preprint arXiv:2304.03563},
  year   = {2023}
}

备注

Accepted in the International Conference on Mining Software Repositories (MSR 2023)