保险人需要多少车联网信息用于索赔分类?
应用统计
2021-10-26 v2
摘要
文献中已多次表明,机动车保险中收集的远程信息处理(telematics)数据有助于更好地理解被保险人的驾驶风险。使用这些数据的保险人获得若干益处,例如对纯保费的更好估计、更细分化的定价以及更少的逆向选择。硬币的另一面是,收集的远程信息处理信息往往敏感,从而可能损害保单持有人的隐私。此外,由于其海量,这类数据储存成本高且难以处理。这些因素,加上保险监管机构倾向于就远程信息处理数据的收集和使用发布越来越多建议,使得保险人确定应收集的远程信息处理信息适量十分重要。除被保险人的年龄和性别等传统合同信息外,我们可获取一个按行程汇总信息的远程信息处理数据集。我们首先从这些行程摘要中导出若干关注特征,然后使用传统与远程信息处理特征构建索赔分类模型。通过比较几种分类算法,我们发现带lasso惩罚的逻辑回归最适合我们的问题。利用该模型,我们开发了一种方法以确定保险人应保留多少关于保单持有人驾驶的信息。利用一家北美保险公司的真实数据,我们发现从索赔分类角度看,在约3个月或4,000公里观测后远程信息处理数据变得冗余。
引用
@article{arxiv.2105.14055,
title = {How much telematics information do insurers need for claim classification?},
author = {Francis Duval and Jean-Philippe Boucher and Mathieu Pigeon},
journal= {arXiv preprint arXiv:2105.14055},
year = {2021}
}
备注
21 pages, 8 figures, 6 tables