负责任AI技术报告
计算与语言
2026-03-23 v4 人工智能
摘要
KT 开发了一套负责任AI(RAI)评估方法论与风险缓解技术,以确保AI服务的安全性与可靠性。通过分析AI基本法案的实施与全球AI治理趋势,我们建立了一种独特的监管合规方法,并系统性地识别和管理从AI开发到运行的全流程潜在风险因素。我们提出了一种可靠的评估方法论,基于KT针对国内环境定制的AI风险分类体系,系统性地验证模型安全性与鲁棒性。我们还提供了管理已识别AI风险及缓解风险的实用工具。随着本报告的发布,我们也发布了专有的 Guardrail: SafetyGuard,可在实时中阻断AI模型的有害响应,支持国内AI开发生态系统的安全性提升。我们也相信这些研究成果为致力于开发负责任AI的组织提供了有价值的见解。
引用
@article{arxiv.2509.20057,
title = {Responsible AI Technical Report},
author = {KT and : and Yunjin Park and Jungwon Yoon and Junhyung Moon and Myunggyo Oh and Wonhyuk Lee and Sujin Kim and Youngchol Kim and Eunmi Kim and Hyoungjun Park and Eunyoung Shin and Wonyoung Lee and Somin Lee and Minwook Ju and Minsung Noh and Dongyoung Jeong and Jeongyeop Kim and Wanjin Park and Soonmin Bae},
journal= {arXiv preprint arXiv:2509.20057},
year = {2026}
}
备注
23 pages, 8 figures