检测对话搜索中生成的原生广告
信息检索
2024-05-01 v2 计算与语言
摘要
此类对话搜索引擎如 YouChat 和 Microsoft Copilot 采用大语言模型(LLM)生成查询响应。进而让同一技术在生成的响应中插入广告,而非单独放置广告,这只是一步小小的演进。插入的广告类似于原生广告和产品植入,这两者都是极其有效的隐蔽且具操纵性的广告形式。鉴于 LLM 高昂的计算成本,服务提供商需要构建可持续的商业模式,用户使用对话搜索引擎时,可能会在不久的将来面临生成的原生广告。为此,本文采取第一步,探讨 LLM 是否也可作为一种反制手段,即阻止生成的原生广告。我们编译了 Webis Generated Native Ads 2024 数据集,包含查询和自动插入广告的生成响应,并评估 LLM 或微调的句子转换器是否能够检测这些广告。在实验中,研究中的 LLM 在该任务上表现不佳,但句子转换器实现了超过 0.9 的精确率和召回率。
引用
@article{arxiv.2402.04889,
title = {Detecting Generated Native Ads in Conversational Search},
author = {Sebastian Schmidt and Ines Zelch and Janek Bevendorff and Benno Stein and Matthias Hagen and Martin Potthast},
journal= {arXiv preprint arXiv:2402.04889},
year = {2024}
}
备注
WWW'24 Short Papers Track; 4 pages