中文

o3-mini vs DeepSeek-R1:哪个更安全?

软件工程 2025-02-03 v2 人工智能

摘要

DeepSeek-R1的闯入是AI行业尤其是LLM的一个转折点。其能力在多项任务中表现出色,包括创造性思维、代码生成、数学和自动程序修复,且执行成本明显更低。然而,LLM必须遵守一个重要的定性属性,即它们与安全和人类价值观的一致性。DeepSeek-R1的一个明显竞争对手是其美国对手OpenAI的o3-mini模型,预计该模型将在性能、安全和成本方面设定高标准。在本技术报告中,我们系统地评估了DeepSeek-R1(70b版本)和OpenAI的o3-mini(测试版)的安全水平。为此,我们使用了最近发布的自动化安全测试工具ASTRAL。利用该工具,我们自动系统地生成并在两个模型上执行了1,260个测试输入。在对两个LLM提供的结果进行半自动评估后,结果表明DeepSeek-R1产生的不安全响应(12%)明显多于OpenAI的o3-mini(1.2%)。

关键词

引用

@article{arxiv.2501.18438,
  title  = {o3-mini vs DeepSeek-R1: Which One is Safer?},
  author = {Aitor Arrieta and Miriam Ugarte and Pablo Valle and José Antonio Parejo and Sergio Segura},
  journal= {arXiv preprint arXiv:2501.18438},
  year   = {2025}
}

备注

arXiv admin note: substantial text overlap with arXiv:2501.17749