基于大语言模型关键词检测的人工智能反欺凌系统开发
人工智能
2024-08-21 v1 计算与语言
摘要
本文提出并评估了开发人工智能(AI)反欺凌系统的工作。该系统旨在识别通过社交媒体和其他机制发起的协调性欺凌攻击,刻画其特征,并提出针对性的 remediation 和 response 活动。具体而言,使用大语言模型(Large Language Model, LLM)来填充增强型专家系统基础网络模型中的欺凌攻击。这有助于进行分析和 remediation 活动——例如生成针对社交媒体公司的报告消息——确定性决策。本文描述了该系统,并分析了LLM用于填充模型的有效性。
引用
@article{arxiv.2408.10417,
title = {Development of an AI Anti-Bullying System Using Large Language Model Key Topic Detection},
author = {Matthew Tassava and Cameron Kolodjski and Jordan Milbrath and Adorah Bishop and Nathan Flanders and Robbie Fetsch and Danielle Hanson and Jeremy Straub},
journal= {arXiv preprint arXiv:2408.10417},
year = {2024}
}