中文

重新思考 CyberSecEval:一种基于 LLM 的评估批判方法

人工智能 2024-11-14 v1

摘要

网络安全评估领域的一个关键发展是 Meta 通过其 CyberSecEval 方法所做的工作。虽然这项工作无疑是对这一新兴领域的有益贡献,但存在一些限制其效用的显著特征。主要缺点集中在 Meta 方法论中不安全代码检测部分。我们探讨这些局限性,并将其作为 LLM 辅助基准分析的测试用例。

关键词

引用

@article{arxiv.2411.08813,
  title  = {Rethinking CyberSecEval: An LLM-Aided Approach to Evaluation Critique},
  author = {Suhas Hariharan and Zainab Ali Majid and Jaime Raldua Veuthey and Jacob Haimes},
  journal= {arXiv preprint arXiv:2411.08813},
  year   = {2024}
}

备注

NeurIPS 2024, 2 pages