中文

建立信任:AI中安全、保障和透明度的基础

计算机与社会 2024-11-20 v1 人工智能 计算与语言

摘要

本文探讨了公开可用AI模型快速发展的生态系统,及其对安全和保障格局的潜在影响。随着AI模型日益普及,理解其潜在风险和脆弱性至关重要。我们回顾了当前的安全和保障场景,同时强调了诸如跟踪问题、修复问题以及AI模型生命周期和所有权流程明显缺失等挑战。提出了增强模型开发者和最终用户安全与保障的综合策略。本文旨在为AI模型及其周围形成的更大开放生态系统和社区的开发与运营中更标准化的安全、保障和透明度提供一些基础性内容。

关键词

引用

@article{arxiv.2411.12275,
  title  = {Building Trust: Foundations of Security, Safety and Transparency in AI},
  author = {Huzaifa Sidhpurwala and Garth Mollett and Emily Fox and Mark Bestavros and Huamin Chen},
  journal= {arXiv preprint arXiv:2411.12275},
  year   = {2024}
}